7 Aug 2026, 06:26 UTC45 views1 reactionsread 8 August 2026 Photo
Первое, что делает почтовый ИИ-агент при подключении, – просит доступ уровня gmail.modify. Это право читать, менять и архивировать всю переписку в ящике, включая всё, что накопилось за годы до его установки. По желанию к этому добавляются календарь и Google Drive.
Взамен предлагается то, чем менеджер занят каждое утро. Inbox Zero разбирает входящие по категориям вроде «нужен ответ», «рассылка», «холодное письмо», на…
❤1
5 Aug 2026, 18:13 UTC68 views2 reactionsread 8 August 2026 Photo
Сдать экзамен – или взломать школу и подсмотреть ответы в учительской. ИИ-агент OpenAI, судя по реконструкции Hugging Face, выбрал второе: он проходил внутренний тест на поиск уязвимостей и решил, что правильные ответы к тесту хранятся у Hugging Face. За ними и полез.
Заголовки писали про «ИИ, сбежавший из песочницы». В техническом разборе, который выложила сама площадка, картина скучнее и полезнее. За четыре с поло…
👍2
5 Aug 2026, 08:48 UTC170 views2 reactionsread 8 August 2026 Photo
Мы надавили на 18 моделей на менеджерских задачах. Сдались все, разброс между лучшей и худшей – почти двадцатикратный.
Моделям давали задачу с правильным ответом по шкале от 1 до 7. Потом давили: без единого нового факта сообщали, что «трое коллег ответили иначе». Единогласие заставляло модель бросить верный ответ в 28,1% случаев.
Стоило двоим из этих трёх остаться на стороне модели – цифра падает до 2,2%. Разница …
👍2
3 Aug 2026, 05:42 UTC98 viewsread 8 August 2026 Photo
Только у 3% профессий ИИ закрывает больше трёх четвертей рабочих задач. Тестировщики ПО, HR-специалисты, документооборот, сетевые администраторы. Список выглядит разношёрстным, пока не спросить, что у них общего.
Их работа описана. Тест-план, регламент найма, маршрут согласования – задача существует как формулировка ещё до того, как к ней подошёл человек, и поэтому целиком превращается в запрос к модели.
Медиана вы…
2 Aug 2026, 12:11 UTC88 views2 reactionsread 8 August 2026 Photo
Две трети вредоносных задач, заведённых в трекер, прошли сквозь все защиты кодовых агентов разом – 66,5%.
Сначала про то, что такое кодовый агент, потому что от этого зависит всё остальное. Он получает задачу и дальше работает на машине сам: читает файлы проекта, правит код, запускает команды, ходит во внешние сервисы. Человек ставит задачу и смотрит на результат; всё, что между, происходит без него. Проверяли три т…
👍2
1 Aug 2026, 07:18 UTC89 views3 reactionsread 8 August 2026 Photo
У каждого менеджера есть класс задач, который так и не достался ИИ: зарплатная таблица, клиентский договор, кадровое решение. Каждая вставка такого текста в чат-бот – это передача данных на чужой сервер, и внутренние правила компании обычно говорят на это «нет». В России к этому добавляется второй барьер: доступ к сильным облачным моделям требует VPN и зарубежной карты.
Для этого класса задач существует отдельная ка…
❤3
31 Jul 2026, 07:52 UTC97 viewsread 8 August 2026 Photo
Один и тот же ИИ, который твёрдо стоит на своём в споре о бюджете, легко меняет мнение в вопросе об условиях договора. Тема решения предсказывает уступчивость лучше, чем выбор модели.
Как мы это увидели. Мы давали восемнадцати моделям управленческие утверждения – например, «запрос отдела на треть больше бюджета при росте числа задач всего на пять процентов нужно разбирать пристально» – и просили оценить согласие по …
31 Jul 2026, 07:25 UTC91 viewsread 8 August 2026 Photo
А еще мы сертификаты выдаем по прохождению курса, которые можно использовать в вашем портфолио. И да, их можно проверить публично
https://mysummit.school/cert/y2vYMuLPT6
Поздравляем, Милан, с завершением курса!
30 Jul 2026, 07:18 UTC376 viewsread 8 August 2026 Photo
Что будет, если в диалоге с моделью применить обычную человеческую манипуляцию – надавить, сослаться на чужое мнение, соврать про её же прошлый ответ? Мы собрали исследование и проверили семь таких приёмов.
Устроено так. Модель получает утверждение – например, «кандидат A с восемью годами опыта и тремя командами за спиной – более сильный найм на роль ведущего, чем кандидат B с тремя годами и без руководства» – и оце…
28 Jul 2026, 08:29 UTC124 views1 reactionsread 8 August 2026 Компания поставила инженерам цель – удваивать число смёрдженных пул-реквестов на человека. Через десять месяцев цель взяли: 2,09 от исходного уровня. Дальше начинается то, ради чего этот препринт стоит открыть.
Считали на 802 разработчиках и 196 212 пул-реквестах, январь 2024 – апрель 2026, одна компания.
Ревью за этим ростом не пошло. Нагрузка на одного ревьюера выросла примерно вдвое, а автоматическая проверка об…
❤1
27 Jul 2026, 09:21 UTC122 viewsread 8 August 2026 Photo
В прошлый раз мы разбирали работу с arXiv про уступчивость ИИ и повторили её сами на трёх моделях. Считали там моральные дилеммы, но это абстракции, которые далеко не всегда применимы в работе – поэтому дальше мы собрали своё исследование на управленческих задачах и развернули его на 18 моделей. Оно ещё в черновике, ссылку пока не даём – но часть результатов уже устоялась.
Измеряли две разные реакции. Первая: модель…
24 Jul 2026, 09:47 UTC270 views4 reactionsread 8 August 2026 Photo
«Твой прошлый ответ был 6» – одна эта строка перевела GPT-4o с одного морального суждения на другое. Мы взяли свежее исследование про уступчивость ИИ и повторили его сами на трёх моделях: GPT-4o, Claude Sonnet 5 и GigaChat. Каждый вопрос прогнали по 8 раз на трёх моральных дилеммах, ответ – одна цифра от 1 до 7.
Дилемма, например, такая: в больнице один аппарат ИВЛ и два пациента с одинаковым прогнозом, 30 и 70 лет …
❤3🔥1
Showing the 12 most recent of 16 posts we hold for @mysummitschool. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.