7 Aug 2026, 15:00 UTC643 views12 reactionsread 7 August 2026 99 usage limit resets in Codex, 99 usage limit resets
Take one down and pass it around, 98 usage limit resets in Codex
98 usage limit resets in Codex, 98 usage limit resets
Take one down and pass it around, 97 usage limit resets in Codex
...
No usage limit resets in Codex, no more usage limit resets
Go to chatgpt.com and buy a new subscription, 99 usage limit resets in Codex
👏12
7 Aug 2026, 09:25 UTC835 views52 reactionsread 7 August 2026 Photo
Лайфак по использованию агентов.
Если не запускать GPT Sol и Claude Opus на любой чих, то подписка расходуется не так быстро.
😁48👎4
5 Aug 2026, 20:53 UTC≈1,040 views23 reactionsread 7 August 2026 Когда месяц еще только начался, а ты израсходовал на вайбкодинг почти всю месячную квоту.
https://youtu.be/W7rnkwrgEm0?si=Ug5Ah5GYNy_Eqh5d
😁21❤1🔥1
5 Aug 2026, 08:25 UTC≈1,010 views14 reactionsread 7 August 2026 🧪 Метод и эксперименты
Основными задачи при разработке кернела были:
• Уменьшить обьем CPU работы и CPU-GPU синхронизации
• Максимально эффективно перекрывать вычисления и коммуникации
Рассматриваются два типа dispatching
Push-based dispatch (традиционный подход)
1. Router для каждого токена определяет его экспертов.
2. Для каждого токена выполняется: Отправить этот токен эксперту №7.
То есть именно токен "толк…
❤14
5 Aug 2026, 08:19 UTC≈1,030 views19 reactionsread 7 August 2026 Photo
Mixture-of-Kittens: our open-source MoE megakernel for NVL72s
📄 Блогпост
💻 Код
Ребята из курсора реализовали MXFP8 мегакернел под названием Mixture-of-Kittens, где пофьюжены все операции для слоя смеси экспертов, специализированный под GB300 NVL72s.
В отличие от MegaMoE от команды Дипсика 🐋, этот кернел не только под инференс, а еще и под обучение.
🏆12👍5🥰2
4 Aug 2026, 07:56 UTC≈1,150 views33 reactionsread 7 August 2026 File
📚 Презентация про квантизацию с моего выступления на нашей Hardware Efficiency Reading Group, где мы обсуждаем статьи, идеи и практические аспекты эффективного глубокого обучения.
🎥 Записи и 📋 программу прошлых семинаров можно найти здесь.
🗓️ Семинар проходит (почти) каждый понедельник с 13:00 до 14:00.
📢 Группа с анонсами и материалами — тут.
Будем рады всем, кто интересуется эффективным глубоким обучением, GPU,…
👍17❤11🔥5
3 Aug 2026, 14:47 UTC≈7,900 views17 reactionsread 7 August 2026 🚀 Лаба Song Han (одного из апостолов EfficientDL) из MIT выпустила репозиторий со скиллом для агентов, предназначенным для оптимизации кернелов под Hopper и Blackwell.
📚 Репозиторий содержит набор скриптов, которые позволяют агенту обращаться к различным базам знаний, блогам, PR'ам и другим артефактам, посвященным тензорным ядрам и архитектурным особенностям Hopper и Blackwell.
🛠️ В частности, в него заложены знани…
🔥11❤4👍2
31 Jul 2026, 20:54 UTC≈1,800 views29 reactionsread 7 August 2026 step: 11 loss: 9.8672 grad_norm: 2.8441 tps: 5,471 time/step: 2.99s tflops: 198,319.19 mfu: 63563.84% memory: 243.85GiB
MFU > 60000%
Такое даже Уроборосу не снилось)
😁17🤣7🔥5
30 Jul 2026, 13:27 UTC≈2,030 views21 reactionsread 7 August 2026 Серёжа сьел токены сына
Зачем? Не объяснив причину
Серёжа запускает клод, рой агентов
И сьедает квоту его
Зачем так ждать чего-то?
Так сильно хотеть чего-то?
Так сильно обливать сердце кровью?
И в снег, и в метель, и в грозы
Писать Деду Морозу
Чтоб выслал новые токены
А не какой-нибудь сраный пенал…
😭16👏3👎1🥴1
23 Jul 2026, 15:03 UTC≈2,780 views19 reactionsread 7 August 2026 Бывает и такое, что Reviewer #2 ставит тебе Accept.
Но ревью настолько короткое и несодержательное, что Area Chair не примет во внимание...
😁14💯5
22 Jul 2026, 20:01 UTC≈2,750 views10 reactionsread 7 August 2026 Интересная по описанию либа Humming от InclusionAI.
Позиционируется как легковесный, высокопроизводительный фреймворк с JIT-компилированными GEMM-операциями (под NVIDIA GPU).
⚙️ Он предлагает широкий ассортимент кернелов под разные конфигурации квантованных весов и активаций:
• 🧮 Веса можно квантовать почти в любую целочисленную битность от 1 до 8, а также в разные варианты FP.
• ⚡ Активации можно квантовать в FP1…
❤10
21 Jul 2026, 20:52 UTC≈1,890 views7 reactionsread 7 August 2026 🧪 Метод и эксперименты
В данной работе фокусируются на 2-битном weight-only-сжатии ризонящих моделей. В аппендиксе есть эксперименты с FP4, со сжатием активаций и KV-кэшей. Квантизуют модели Qwen3-8B / Qwen3-32B через GPTQ.
Оказывается, что квантизация сильно меняет поведение трейсов ризонинга:
🔄 Число циклов резко возрастает, особенно для меньшей модели.
📏 Многие трейсы не вписываются в заданный лимит токенов.
⚠️…
❤7
Showing the 12 most recent of 22 posts we hold for @quant_prune_distill. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.