5 Aug 2026, 15:52 UTC383 views65 reactionsread 6 August 2026 Конец Точковской арки
Где-то в далёком 2021 году я пришел в Точку интерном, только закончив 10 класс школы и выиграв местный хакатон по AutoML. Проработал я там, получается, уже больше 5 лет.
Ну и вот, в конце августа, у меня будет последний день в компании. Ухожу сам, куда и зачем - расскажу позже :)
Как водится, во время таких перемен, хочется подводить разные ретроспективы. Что же я успел сделать за 5 лет? Из н…
❤43🏆13💅8🔥1
29 Jun 2026, 15:37 UTC≈1,090 views81 reactionsread 6 August 2026 Photo
misis finished 🫡
🔥57❤16👍8
13 Jun 2026, 12:18 UTC≈2,050 views14 reactionsread 6 August 2026 Я иногда здесь пишу про разное не только в ML/AI, но и про другие штуки, которые мне интересны. Сейчас как раз такой случай. Вчера была одна из самых больших атак на Arch User Repository, - пользовательский репозиторий пакетов для дистрибутива Arch Linux. Были инфицированы более чем 1500 пакетов. И как-то эта атака недостаточно хорошо освещена, хотя в ней есть очень много вещей, которым можно поучиться не только поль…
👍6🔥6❤2
18 May 2026, 01:34 UTC≈1,660 views45 reactionsread 6 August 2026 Photo
Летом буду рассказывать про трен фреймворк для ллмок на английском в Ереване 🤠
❤29🔥16
8 Apr 2026, 23:22 UTC≈1,960 views11 reactionsread 6 August 2026 Про zero-centered RMSNorm'ы
Классический RMSNorm инициализирует вектор параметров единичками и применяет его при вычислении так: y = x * w / RMS(x).
Однако в некоторых новых моделях, например, Qwen3.5 и Qwen3-Next, ребята стали делать чуть по-другому, - инициализируют вектор весов нулями, и вычисляют RMSNorm как y = x * (w + 1) / RMS(x).
Мотивация у этого следующая, - теперь можно применять weight decay к этому па…
❤11
8 Apr 2026, 20:42 UTC≈1,540 views6 reactionsread 6 August 2026 Тем временем в flash-linear-attention появился context parallelism для GDNок 👀
https://github.com/fla-org/flash-linear-attention/blob/main/fla/ops/cp/README.md
🔥6
5 Apr 2026, 16:00 UTC≈1,940 views12 reactionsread 6 August 2026 Photo
Недавно ползал по arxiv'у в поисках малоизвестных работ вокруг распределённого вычисления аттеншона, и вот что нашёл.
Чуваки из Together AI выложили препринт работы Untied Ulysses, включающей доработки в DeepSpeed Ulysses, которые экономят пиковое потребление VRAM.
В классическом Ulysses и вычисления, и коммуникации происходит сразу по всем локальным головам. Untied Ulysses предлагает делать вычисления в несколько …
🔥10💅2
28 Mar 2026, 02:24 UTC≈1,590 views26 reactionsread 6 August 2026 🧐 Part II. Джентльменский набор статических анализаторов кода для Python ML проекта
Часто вижу, как кодовая база без жёстких правил превращается в неконсистентное месиво. Часть этого месива позволят не допустить, а ещё и сильно упростят вам жизнь, правильно настроенные статические анализаторы кода. Статья ориентирована в основном на MLE и DS-ов, потому что, товарищи SWE, вы, скорее всего, всё это и так уже 300 раз з…
❤17💅8👎1
14 Mar 2026, 15:45 UTC≈1,420 views22 reactionsread 6 August 2026 Photo
Немного из моей биографии - ещё до того как заниматься all the AI things, я какое-то время делал библиотеки и тулы для Kotlin Multiplatform. И я до сих пор считаю, что Kotlin - один из самых хорошо задизайненных general purpose языков, жаль, что рынок у него очень узкий вне мобильной разработки.
И вот сейчас заметил, что одна из довольно нишевых старых моих штук собрала 100 звёзд на GH 🫡. Приятно, что какие-то вещи …
❤22
2 Mar 2026, 07:40 UTC≈1,730 views14 reactionsread 6 August 2026 Мой коллега Стас дропнул вот такую имбу
aiofence — библиотека для для удобного cancelling'а вашего асинхронного кода.
https://github.com/stanislaushimovolos/aiofence
Проблема: таска отменилась — это таймаут? клиент отключился? graceful shutdown? Из коробки такая информация не доступна. Кроме того, вы не контроллируете момент прерывания вашего кода — обычно любой CancellError это убийство вашей таски без предупрежд…
❤10👍3🤡1
26 Feb 2026, 21:20 UTC≈1,510 views17 reactionsread 6 August 2026 🐞 Как я баги в PyTorch находил
Иногда кажется, что вероятность найти баг в каком-то очень большом инструменте, где куча контрибьюторов из Калифорнии на зепешке, стремится к нулю. Но нет, достаточно просто начать пользоваться каким-то нишевым функционалом 💅.
1️⃣ Первую проблему я нашёл ещё в конце октября прошлого года, когда экспериментировал с пайплайнингом (да, я люблю пайплайны, зовите меня Марио). Суть в чём - …
❤10🔥7
25 Feb 2026, 14:50 UTC≈1,200 viewsread 6 August 2026 А напишите пж в комменты, какой контент вы бы хотели видеть в канале, - про инженерку, разборы актуальных статей, мемы, мб что-то ещё?
Showing the 12 most recent of 20 posts we hold for @downloadmoregpus. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.