8 Jul 2026, 10:11 UTC414 views5 reactionsread 8 August 2026 Photo
Как я разработал легковесный Guardrails для русского языка
Написал статью на Хабр, в которой поделился процессом разработки своей версии легковесного Guardrails.
Рассказал что такое Guardrails, основные компоненты lite-guardrails, его архитектура, этапы разработки, настройкой observability, а также создание документации по проекту.
Ссылка на GitHub - здесь
Ссылка на статью - здесь
Максим Максимов // IT, AI
👍3🔥1🤯1
11 Jun 2026, 09:02 UTC612 views7 reactionsread 8 August 2026 Forwarded from @rmr_rnd
⚡️ Открываем бенчмарк для детекции PII в русском тексте
Мы тут много рассказывали про работу guardrails. А теперь выкатываем в открытый доступ бенчмарк для детекции персональных данных на русском языке. На нём можно сравнивать NER-модели, PII-детекторы и системы анонимизации.
Внутри датасета 21 тип персональных данных:
• ФИО: имя, фамилия, отчество;
• адресная иерархия: страна, регион, город, район, улица, дом;
• к…
❤3👍3🤯1
6 Jun 2026, 15:49 UTC841 views16 reactionsread 8 August 2026 Photo
Как дообучить LLM. Рассказываю шаг за шагом
Написал статью на Хабр, в которой рассказал шаг за шагом как дообучить LLM под свою задачу. От описания эксперимента, подготовки данных, метрик до обучения модели и ее тестирования.
В качестве примера обучил Qwen2.5-0.5B извлечению информации из текста по заданной схеме в формате JSON.
🔥 Welcome!
❤9🔥4🤯2🤔1
Максим Максимов // IT, AI pinned «🤷 Когда использовать BERT, а когда LLM? Во время решения различных NLP задач ловлю себя на мысли, что часто можно применить LLM. Задача классификации? - Берём LLM + Structured Output. Задача NER? - Тоже можно взять LLM, написать пару промптов и алгоритмов…»
11 May 2026, 07:33 UTC≈1,020 views15 reactionsread 8 August 2026 🤷 Когда использовать BERT, а когда LLM?
Во время решения различных NLP задач ловлю себя на мысли, что часто можно применить LLM.
Задача классификации? - Берём LLM + Structured Output.
Задача NER? - Тоже можно взять LLM, написать пару промптов и алгоритмов и вуаля - будем находить персональные данные в тексте.
Но, к сожалению, не так все просто.
1️⃣ Первое, во что упираемся - это инфраструктура и требования к сис…
❤7👍4🔥3🤯1
Максим Максимов // IT, AI pinned «🤑 Как платить меньше за инференс LLM Занимался изучением вопроса удешевления стоимости токенов во время работы с облачными LLM. Изучил некоторые способы и решил рассказать о двух популярных и простых в использовании подходах, которые можно применить для…»
24 Apr 2026, 07:49 UTC912 views8 reactionsread 8 August 2026 🤑 Как платить меньше за инференс LLM
Занимался изучением вопроса удешевления стоимости токенов во время работы с облачными LLM.
Изучил некоторые способы и решил рассказать о двух популярных и простых в использовании подходах, которые можно применить для этого.
🔺Кэширование промптов (Prompt Caching)
Это метод, в котором часто используемые промпты сохраняются в памяти провайдера LLM. Он основан на сохранении KV-cac…
👍5🤯3
22 Apr 2026, 12:40 UTC625 views3 reactionsread 8 August 2026 Forwarded from @rmr_rnd
⚡️ Открываем NSFW-бенчмарк для систем модерации
В прошлых постах мы много говорили о фильтрации NSFW. А теперь выкатываем в открытый доступ наш двуязычный бенчмарк для систем модерации контента.
Что внутри датасета:
• контрастные пары — о которых мы уже писали,
• сложные пограничные примеры — hard negatives.
Все данные собирались, отсеивались и валидировались полностью вручную.
В карточке датасета рассказали, как…
🤯2🔥1
Максим Максимов // IT, AI pinned «Как решать задачу NER на практике Опубликовал статью на Хабр, в которой разобрал задачу NER на реальном примере — извлечение сущностей из резюме. Прошёлся по основным этапам: от поиска данных и разметки в Label Studio до обучения BERT моделей и написания…»
14 Apr 2026, 20:12 UTC759 views11 reactionsread 8 August 2026 Как решать задачу NER на практике
Опубликовал статью на Хабр, в которой разобрал задачу NER на реальном примере — извлечение сущностей из резюме.
Прошёлся по основным этапам: от поиска данных и разметки в Label Studio до обучения BERT моделей и написания сервиса на FastAPI. Старался давать меньше теории и больше практики с кодом на Python.
Ссылка на статью
❤4🤯3👍2🔥2
10 Apr 2026, 17:48 UTC716 views8 reactionsread 8 August 2026 Forwarded from @rmr_rndPhoto
Тестирование AI-агентов ✅
Представим, что вы разработали AI-агента. Как понять, что он работает хорошо? А если поменять параметры — стало лучше или хуже?
Что такое «хорошо» для вашего агента
Для начала нужно определить, какую задачу агент выполняет в системе. На этом этапе выделяются сценарии работы и end-to-end метрики: выполняется ли задача, какова точность результата, сколько времени и ресурсов требуется.
Оцен…
👍4👏2🤯2
Максим Максимов // IT, AI pinned a photo
Showing the 12 most recent of 20 posts we hold for @maks_it_ai. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.