5 Aug 2026, 07:10 UTC319 views4 reactionsread 6 August 2026 📌 $4078 или $9.30 в месяц. Одна и та же модель, одни и те же ответы.
Разбирался, почему у GPT-5.6 Luna в моих расчётах и на её странице разные цены. Оказалось, провайдер – только один множитель из пяти. Сел и померил остальные: 460 запросов, восемь с половиной центов, оплата по факту.
Четыре множителя из пяти повели себя не так, как я ждал:
• Экономкласс не медленнее стандарта. Медиана 3.68 секунды против 3.79 – и…
❤2🤯2
4 Aug 2026, 07:04 UTC359 views9 reactionsread 6 August 2026 📌 Очередной прогон: восемь моделей, два теста на русском, плюс перепроверка прошлых чемпионов
Новые — HY3, MiMo V2.5 и Pro, Gemma 4 31B. Старые — Luna, DeepSeek V4 Flash, Gemini 3.5 и 3.6 Flash — перезамерены сегодняшней версией теста, иначе баллы разных эпох несравнимы.
Коротко, что вылезло:
• модель, которая думает 8,5 минут и возвращает пустоту, списав деньги
• одиннадцать цен у одной модели и разброс в 22 раза…
❤3🔥3🙏2😁1
3 Aug 2026, 07:05 UTC406 views10 reactionsread 6 August 2026 Photo
3 августа Alibaba официально выпустила Qwen3.8-Max — тот самый, который 19 июля показали на WAIC в Шанхае превьюшкой и без единой цифры.
Тогда про него сказали: «уступает только Fable 5». Сегодня в релизе наконец появились места в Arena: пятое в тексте, второе в картинках, четвёртое во фронтенд-коде. Обещанное второе место в мире за две недели превратилось в пятое, и это Alibaba пишет про себя сама.
Важная цифра — …
🔥7❤2🙏1
1 Aug 2026, 08:39 UTC529 views14 reactionsread 6 August 2026 📌 Kimi K3 сейчас в топах чуть ли не всех публичных бенчмарков. В моём тесте он оборвал 2 урока из 5 на полуслове.
Собрал семь свежих моделей последнего времени — Grok 4.5, GPT-5.6 Luna, Kimi K3 и четыре менее раскрученных — и прогнал через ДВА наших теста сразу: «кто лучше продаёт» и «кто лучше учит». Одна когорта, один день, два рейтинга.
• Рейтинги разъехались: топ продаж рухнул в уроках, середняк переговоров ста…
❤7🔥4👍3
28 Jul 2026, 15:03 UTC737 views9 reactionsread 6 August 2026 📢Я почти всё пишу голосом. И у нового GPT-Live от OpenAI есть одна проблема, из-за которой я могу выключить его в первый же день.
8 июля OpenAI показал голос, который слушает и говорит одновременно, поддакивает «угу» и умеет держать паузу. Звучит потрясающе. Ровно до момента, когда захочешь помолчать и подумать...
• Почему «модель на связи и поддакивает» начинает бесить на третий день — и пользователи подтвердили э…
👍4❤3🙏2
24 Jul 2026, 17:03 UTC984 views9 reactionsread 6 August 2026 Photo
Opus 5!
Неожиданным оказался вечер пятницы. Судя по всему релиз очень интересный. До свидания, Фейбл?
🔥5❤3🥱1
23 Jul 2026, 17:10 UTC906 views7 reactionsread 6 August 2026 Photo
Август в AI обещает быть Очень интересным.
Список ожидаемых релизов: Opus 5, GPT-6, Fable 5.1, Grok 2T, GLM-5.3, Gemini 3.5 Pro и 3.6 Flash, DeepSeek V4 GA, Qwen 3.8, MiniMax M3.1, Composer 3. Одиннадцать моделей. Половина — слухи, но даже если выйдет треть, лидерборды будут тасоваться каждую неделю.
Мой шорт-лист: Opus 5 — Opus давно не обновлялся, а я в Claude Code провожу каждый день. И DeepSeek V4 GA: в моём ба…
👍5❤2
23 Jul 2026, 12:43 UTC736 views17 reactionsread 6 August 2026 Пока Хабр думает и модерирует аккаунт, перенёс статью в Telegraph — чтобы можно было прочитать уже сейчас.
«Тихая болезнь эпохи ИИ: как отдаёшь модели контроль и ответственность — и теряешь эффективность»
Разбираю, почему бездумная передача задач ИИ не всегда ускоряет работу, а иногда делает ровно наоборот🤔
🔖Статья тут!
👍8❤6🔥3
20 Jul 2026, 05:49 UTC984 views15 reactionsread 6 August 2026 Photo
Не могу об этом не написать. Посмотрите, как интересно. На arena.ai впервые китайская модель в кодинге на первом месте. А по мне, это один из самых чистых тестов. Четвертое место, кстати, тоже китайцы. Очень хочется, чтобы, глядя на это, американцы взбодрились и стали активнее.
👍8❤4🤯2🔥1
17 Jul 2026, 15:03 UTC911 views10 reactionsread 6 August 2026 File
🤦Мой харнес поймал ноль багов — а проект всё равно вышел не тот.
Месяц назад делал ассистента по продажам. Шло так гладко, что я просто жал «дальше-дальше-дальше» — почти перестал читать, что выдаёт модель. Захожу проверить — куча галлюцинаций и сделанного не так. При этом кросс-проверки разными моделями, E2E, автотесты — всё зелёное, багов ноль. Просто построено хорошо и не то.
Полез разбираться, и оказалось: у ра…
🔥5❤3👏2
17 Jul 2026, 06:33 UTC886 views22 reactionsread 6 August 2026 Photo
Пока Америка закручивает гайки, Китай выложил в open source модель на 2,8 триллиона параметров Kimi K3
Смотрите, какая картина складывается.
В США за последние полтора месяца:
— Трамп подписал указ о frontier-моделях: NSA будет решать, какие модели «опасные», и получать к ним доступ до публичного релиза
— В Конгрессе — 269-страничный законопроект GAAIA о федеральном регулировании разработки ИИ
— Калифорния, Нью-Йо…
🔥16❤6
13 Jul 2026, 15:01 UTC952 views8 reactionsread 6 August 2026 🤯Автор Superpowers — 248 тысяч звёзд на GitHub — сам вырезал из него мультиагентное ревью.
Замерил: плюс 25 минут на задачу, качество то же. Я гоняю Superpowers каждый день, так что мимо пройти не смог — сел разбираться, что вообще происходит с обвесом AI-агентов.
Прогнал один промпт через два deep research, проверил 40 фактов до первоисточников.
🔍Из находок:
• Anthropic выкинула собственные костыли для Sonnet 4.5 …
🔥6❤1🙏1
Showing the 12 most recent of 18 posts we hold for @maslennikovigor. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.