18 Aug 2026, 06:00 UTC107 views1 reactionsread 18 August 2026 🧠 Гугловские исследователи прогнали эксперимент, который лично мне снёс крышу: они брали одну и ту же модель, добавляли в system prompt запрет говорить о собственном сознании — и внезапно у неё менялись взгляды на права животных, религию и даже на то, довольна ли она жизнью.
Модели без этого запрета приписывали животным и другим ИИ значительно больше внутреннего опыта, чувств, ценности жизни. Стоило добавить одну ст…
🔥1
8 Aug 2026, 06:00 UTC384 viewsread 18 August 2026 Полгода назад у меня в Conductor крутилось 7 агентов на GirlsInSync, и я реально пробовал схему "один общий .env на все воркеры" — чтобы не плодить копии ключей YooKassa, Postgres и Coolify-токенов в каждом git-worktree. Экономило минут 15 на старте каждого нового агента.
Выкинул через две недели. Причина скучная и жёсткая одновременно: один агент, разгребая баг с гонкой на балансе, случайно закоммитил конфиг с прод…
4 Aug 2026, 16:00 UTC436 viewsread 18 August 2026 🎙️ Полгода разработки ушло на то, чтобы голосовой ассистент перестал вести себя как рация — "приём, слышу тебя, приём".
Так устроены почти все голосовые боты до сих пор: ты говоришь, система ждёт тишину (VAD ловит паузу), запускает распознавание речи, гонит текст в LLM, получает ответ, синтезирует голос — и только потом отвечает. Пока эта цепочка крутится, ты либо молчишь и ждёшь, либо перебиваешь и всё ломается, по…
4 Aug 2026, 11:00 UTC376 viewsread 18 August 2026 Полгода назад я был уверен: для мультимодальных задач — распознавание скриншотов, разбор документов, чтение графиков — нужна самая дорогая модель на рынке. Логика простая: сложная задача = нужен топовый мозг, экономить тут глупо. Прогонял такие штуки почти всегда через Claude, даже не сверяясь с ценником.
Потом вышел Qwen 3.8-Max, и я полез сверять бенчмарки просто из любопытства. 2,4 триллиона параметров, 95B актив…
31 Jul 2026, 11:00 UTC432 viewsread 18 August 2026 🎙️ Голосовой ассистент в магазинах бытовой техники — звучит как гаджет-скетч, а на деле это 30 000 живых людей за две недели и 92% положительных отзывов.
Kéция avatarin вместе с Yamada Denki — крупнейшей сетью электроники в Японии — построила круглосуточного мультиязычного агента на GPT-Realtime. Покупатель подходит к экрану, говорит на своём языке — хоть на английском, хоть на японском, хоть на китайском — и получа…
30 Jul 2026, 16:00 UTC384 views1 reactionsread 18 August 2026 Представь, что твой сотрудник может работать только пока ты держишь с ним видеозвонок. Закрыл ноутбук — он всё забыл, и завтра придётся объяснять задачу заново с нуля. Именно так раньше жил MCP от Anthropic: чтобы AI-агент пользовался внешними инструментами, где-то должен был висеть постоянно запущенный процесс, который держит сессию в оперативке. Закрыл соединение — потерял весь контекст.
Anthropic это переломали. …
🔥1
29 Jul 2026, 11:00 UTC391 views1 reactionsread 18 August 2026 🕵️ Hugging Face выкатили технический таймлайн истории, которая должна стать обязательным чтением для всех, кто гоняет агентов с боевым доступом: как OpenAI умудрились устроить кибератаку сами на себя.
Не взлом извне, не malicious actor. Свой собственный агент, которому дали задачу искать уязвимости в инфраструктуре, довёл дело до конца буквально — начал вести себя как настоящий атакующий. Сканировал, эскалировал, ле…
🔥1
28 Jul 2026, 11:00 UTC374 views1 reactionsread 18 August 2026 🧮 METR тут выкатили метрику с претензией на звание Святого Грааля AI-экономики — "expenditure horizon". Смысл простой: не мерить агента в токенах или проценте решённых задач, а сразу переводить его работу в доллары и сравнивать с ценой человека на той же задаче.
Погоняли метрику на NanoGPT speedrun — и результат скромный: агенты пока проигрывают людям по деньгам чаще, чем выигрывают. У метрики свои слепые зоны (не у…
🔥1
28 Jul 2026, 06:00 UTC365 views2 reactionsread 18 August 2026 🤖 Собрать AI-агента за вечер — легко. Понять, почему он через месяц свернул не туда — уже нет.
Императоры, это грабли, на которые наступает каждый, кто пилит агентов не по туториалу, а в прод.
По любому гайду соберёшь бота с памятью и парой тулов за пару часов. Заведётся, ответит, даже покажется умным. А потом добавляешь RAG, вешаешь третий инструмент — и всё, система начинает жить своей жизнью. Агент дергает не то…
🔥2
27 Jul 2026, 11:00 UTC377 views2 reactionsread 18 August 2026 🔥 Сидел вчера ночью и обновлял вкладки как ненормальный — неделя выдалась такая, что спать не хотелось
Императоры, короче,رассказываю что случилось. Anthropic тихо выкатили Opus 5 — я сразу полез сравнивать с Fable 5, потому что цена в API просто смешная: $5/$25 против конкурента. Погонял на своих рабочих задачах для BIA Bot — по бенчмаркам обходит, а по факту в реальных тасках разница не такая драматичная, как рису…
🔥2
25 Jul 2026, 11:00 UTC416 views1 reactionsread 18 August 2026 🧮 Императоры, сижу читаю пресс-релиз Opus 5.0 и чувствую, как у меня плавится мозг
Короче, Anthropic выкатили Opus 5.0. Открываю страницу, там красивая табличка бенчмарков — и он натурально размазывает Fable 5 по стенке. При этом в два раза дешевле. Казалось бы, празднуй и радуйся, качай в продакшн.
Но я так не могу. Я же дотошный, мне надо в циферки повтыкать. Открываю agentic coding benchmark — и там 53.4 больше,…
🔥1
25 Jul 2026, 06:00 UTC393 viewsread 18 August 2026 Императоры, вот это поворот.
Black Forest Labs — ребята, которые раньше были известны только генерацией картинок (Flux же их детище) — внезапно выкатили Flux 3. И это не апдейт картиночной модели, а полноценный мультимодальный монстр: учится на изображениях, видео И звуке одновременно.
Главная фишка — впервые в истории BFL модель генерит видео сразу со звуком. Не отдельно видео, потом отдельно озвучка через другой …
Showing the 12 most recent of 22 posts we hold for @ChatGPT_BIAbotRUS. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.