24 Aug 2026, 06:48 UTC≈2,310 views30 reactions3 Starsread 28 August 2026 Что-то я сюда не писал уже почти месяц, будем исправляться. Произошло много чего, анонсы через неделю уже никому не интересны, поэтому чуток расскажу про то, что запомнилось.
Gemini 3.7 Flash – первая модель от гугла, которой можно пользоваться для агентского кодинга, хоть и сама по себе очень специфичная. Она поглупее других, но из-за супер быстрого сёрвинга на >300 TPS превращается во что-то полезное. Или напротот…
👍25❤5
18 Jul 2026, 11:26 UTC≈5,540 views48 reactionsread 28 August 2026 Куртку продали за $960.000
Если купили дорогие подпищеки, дайте поносить?
🤣43🤪3👍1🔥1
16 Jul 2026, 02:52 UTC≈6,060 views59 reactionsread 28 August 2026 Photo
у нашей с вами любиой геммы пофиксили темплейт чата, стало лучше на бенчах 👀
бежим качать обновление с хф
🔥43🤪15👍1
7 Jul 2026, 10:26 UTC≈7,450 views25 reactionsread 28 August 2026 Техрепорт Gemma 4 наконец-то докатился до архива ☺️, особо ничего нового, немного больше эвалов в long-context и для аудио
🔥12👀10🙏2👍1
3 Jul 2026, 08:02 UTC≈8,400 views60 reactionsread 28 August 2026 Photo
Мечта всех, кто хотел кожаночку как у Дженсена Хуанга – на следующем Sotheby's можно будет купить подписанную им куртку Tom Ford. Средства пойдут на благотворительность, ориентировочная цена – 40-60k$, хотя зачастую у аукционных домов не всё хорошо с оценкой спроса, и куртка может уйти за сильно больше какому-нибудь сотруднику фронтирной лабы. Если кто-то из дорогих подпищеков купит – маякните 😎
🤣45😱6👎4🥴3❤1👍1
2 Jul 2026, 13:26 UTC≈7,410 views52 reactionsread 28 August 2026 Photo
Пока я откисаю в Корее от очередного сезона исхода дорогих коллег [1, 2, 3, и др.] перед ICML, наша с читателями любимая Лилиан Вэн – авторка топ-1 блога по диплёрнингу – написала первый за почти два года пост про историю и развитие науки об оценке правил масштабирования (scaling laws) языковых моделей. Почему "правил", а не "законов" – чтобы не создавать ощущения универсальности самих законов: всех необходимых факто…
❤38🔥8😭3👍1👏1🤝1
18 Jun 2026, 23:19 UTC≈6,720 views57 reactions1 Starread 28 August 2026 Photo
Проверяемся, запомнили ли вас ллмки на intheweights.com
Гпт 5.5 меня задизреспектила 😭
❤39😭17👍1
5 May 2026, 16:52 UTC≈8,760 views61 reactionsread 28 August 2026 Photo
MTP спекулятивный декодинг в Gemma 4: ускоряемся в два раза без потери качества 🥳
В нашу дорогую гемму наконец завезли спекулятивный декодинг, когда более маленькая модель предсказывает токены, которые могут верифицироваться большой моделью параллельно, существенно ускоряя инференс для локальных юзкейзов.
Попробовать можно через HuggingFace transformers, остальные движки тоже скоро будут поддерживать. Поглубже почи…
🔥49❤11👍1
16 Apr 2026, 14:35 UTC≈14,200 views103 reactionsread 28 August 2026 Photo
Продолжаем геммапропаганду. В прошлом году у NVIDIA вышла неплохая статья о том, как ловить людей, которые доливают тест в трейн. CoDeC – нормализованный показатель перплексии, где для тестсета бенчмарка считают изменения в перплексии с дополнительными примерами из того же бенчмарка. Для неконтаминированных моделек мы ожидаем, что дополнительные примеры не будут сбивать модель с толку, а в лучшем случае помогут. С др…
🔥75🤔13🤣10🤪4👍1
10 Apr 2026, 13:50 UTC≈10,300 views58 reactionsread 28 August 2026 Photo
WeirdML – один из самых необычных бенчмарков для ЛЛМок. В него входят необычные open-ended задачки по МЛю, например, написание МЛ пайплайнов по распознаванию цифр со всего 28 размеченными примерами и ~50к неразмеченными, предсказание формы фигур, или восстановление перемешанных фрагментов изображений.
Gemma 4 31B оказалась самой сильной открытой моделью на этом бенчмарке, опередив GLM 5 (MoE на 700B) и GPT-OSS с хор…
🔥38👍16❤4
4 Apr 2026, 01:42 UTC≈10,300 views39 reactionsread 28 August 2026 Photo
Мои любимые artificial analysis выложили своё независимое тестирование Gemma 4 (твит, страница с результатами), по результатам вышло хуже квенов из-за просадки на 𝜏²-bench, ну и ладно с ним. На картинку с бенчмарками можно позалипать в комментариях к посту.
В этой версии мне довелось поработать над околонаучными бенчмарками и работой с длинным контекстом, а там мы наступаем на пятки китайским моделям на порядок боль…
👍26👀11🔥2
2 Apr 2026, 16:02 UTC≈14,300 views103 reactions1 Starread 28 August 2026 Photo
Gemma 4
blogpost | model card | huggingface
4 размера: E2B, E4b (бывшие Gemma 3n/Gemini Nano); 26A4B, 31B Dense. Теперь лицензия Apache 2.0!
Для всех моделей релизим претрейн и intruction tuned чекпойнты. Context length 256k у 31B модельки, 128k у остальных. Скажу по секрету – можно пробовать и больше, должно работать.
LLM Arena на уровне Kimi 2.5, бенчмарки можно посмотреть на huggingface
❤53🔥44🎉5🤣1
Showing the 12 most recent of 21 posts we hold for @epsiloncorrect. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.