28 Jul 2026, 13:01 UTC958 views4 reactionsread 7 August 2026 У меня наконец-то дошли руки научиться, как обновлять веб-приложение https://bouquet.metademolab.com для добавления переводов в бенчмарк BOUQuET, и я там починил пару мелких багов.
Если вы вдруг тоже через него добавляете переводы (или собираетесь это делать), и у вас есть обратная связь, пишите мне напрямую)
👍4
26 Jul 2026, 15:31 UTC≈1,150 views31 reactionsread 7 August 2026 С тех пор, как я ещё в 2023 выкладывал тьюториал по дообучению моделей NLLB, я был уверен, что их токенайзер основан на алгоритме unigram (ибо так говорила и всё ещё говорит документация на huggingface). И подходил к модификации словаря токенов соответственно. Недавно решил ещё раз залезть в токенайзер, и оказалось — там всё-таки BPE.
В чём принципиальная разница? Оба алгоритма сначала разделяют текст на «слова» рег…
❤21👍10
4 Jul 2026, 21:22 UTC≈2,490 views55 reactionsread 7 August 2026 Очень лениво заниматься абсолютно всем. То ли я выгорел, то ли вконец офранцузился, то ли просто начинаю стареть — так или иначе, браться за любую задачу максимально влом. Как по работе, так и вне её.
Тем не менее, есть три задачи (все – в статусе хобби), до которых, возможно, в ближайшие пару месяцев у меня дотянуться ручки:
1) Сделать лидерборд современных моделей по FLORES+, наподобие того, что мы недавно сделали…
❤39👍13✍1🏆1🔥1
14 Jun 2026, 23:28 UTC≈2,970 views23 reactionsread 7 August 2026 Пост про путешествия, а не про NLP: моя супруга Дарина (inst @cloudberrin) в этом году снова организует классные роуд-трипы в красивые и отдалённые места.
Уже в июле будут заполярная Норвегия и Исландия; осенью — Памирский тракт и Доломитовы Альпы.
Расписание и подробности на сайте plamenproject.com/travel.
Смотрите, подписывайтесь, и делитесь со знакомыми, которым потенциально было бы интересно в такое путешествие…
❤15🔥8
28 May 2026, 08:46 UTC≈3,290 views29 reactionsread 7 August 2026 Photo
Три маленьких апдейта по датасету BOUQuET (напомню, что это наш бенчмарк для мультиязычного перевода, более разнообразный, чем FLORES, и включающий на данный момент 275 разновидности языков):
1. Мы поменяли лицензию со специальной метовской на CC-BY-4.0. Мелочь, но для некоторых организаций, готовых добавлять туда новые языки, это было важно.
2. Мы выложили интерактивный лидерборд с почти всеми моделями, которые мы…
❤17🔥8💯4
26 Apr 2026, 12:36 UTC≈3,120 views29 reactionsread 7 August 2026 Как вы знаете, я участвую в Open Language Data Initiative: мы занимается поддержкой датасетов FLORES+ и Seed и помогаем желающим добавить туда новые языки или улучшить качество имеющихся переводов.
В этом году, как и прежде, мы организуем shared task при конференции WMT26. Идея такая: вы вносите какой-то вклад (добавление или правки) в наши или любые другие открытые мультиязычные датасеты и пишете про это короткую с…
👍21❤8
24 Mar 2026, 23:56 UTC≈2,830 views16 reactionsread 7 August 2026 Photo
Бонус: вот как выглядят ChrF++ скоры для перевода с английского на 1560 языков нашего библейского бенчмарка и в обратную сторону (чуть-чуть сглаженные для читабельности).
Видно, что OMT-NLLB уже в принципе близка к задаче понимания всех этих языков, а OMT-LLaMA неплохо продвинулась по пути генерации более чем тысячи из них.
Все остальные модели курят в сторонке.
🔥13👍3
24 Mar 2026, 23:53 UTC≈1,810 views8 reactionsread 7 August 2026 Photo
(2/2, начало)
Но хоть ChrF++ и условно пригодна для сравнения, какая из моделей лучше переводит, по её абсолютным значениям нельзя в общем случае судить, плох перевод или хорош (только относительно: больше значит лучше), плюс сравнение её значений для перевода на разные языки абсолютно бессмысленно (с разных языков на один и тот же — норм, т.к. переводы сравниваются с одним и тем же референсом). Для межъязыковых сра…
🔥8
24 Mar 2026, 23:51 UTC≈1,270 views5 reactionsread 7 August 2026 Photo
Пост про оценку качества перевода в проекте Omnilingual MT.
Для чего вообще заморачиваться с методами оценки качества?
1) Точность бенчмаркинга: когда перевод довольно плохой, все метрики адекватно реагируют на улучшения, но по мере насыщения качества, они начинают показывать в разные стороны. Например, на топ-50 языках TranslateGemma (которая на них специализируется) обходит обычную Gemma по MetricX, но уступает е…
🔥5
24 Mar 2026, 18:38 UTC≈1,180 views13 reactionsread 7 August 2026 Пишу третий длиннопост про OMT — и буду очень рад ответить на связанные и не очень вопросы; если у вас таковые имеются, не стесняйтесь, welcome в комментарии 🙃
❤9👍4
23 Mar 2026, 19:30 UTC≈1,470 views27 reactionsread 7 August 2026 (2/2, начало)
Но когда мы поменяли энкодер-учитель со старого SONAR на новый, возникла непредвиденная сложность: модель-ученик стала осваивать новые языки сильно хуже. Похоже, новое пространство оказалось более сложным для запихивания туда нового языка. Пришлось много повозиться с рецептом обучения, добавив кроме MSE два контрастных лосса, причём с разными параметрами для «старых» и «новых» языков, и тем самым слегк…
🔥18❤5⚡4
23 Mar 2026, 19:30 UTC≈1,340 views15 reactionsread 7 August 2026 Теперь рассказ про Omnilingual SONAR. Статья, на самом деле — «комплексный обед» из минимум пяти разных проектов, но я поведаю только про парочку из них.
Напомню, что SONAR (оригинальная версия) — это текстовый энкодер предложений (1 предложение => 1 вектор) в общее пространство для 200 языков, и декодер, восстанавливающий предложения из этого пространства. В паре они могут работать как переводчик, плюс сходство пар…
🔥9❤4👍1🤮1
Showing the 12 most recent of 18 posts we hold for @izolenta_mebiusa. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.