7 Aug 2026, 12:00 UTC319 views21 reactionsread 7 August 2026 Последние два года мы много экспериментировали с доступными guardrail-моделями. Сравнивали готовые решения, обучили несколько собственных моделей, собирали и адаптировали бенчмарки, чтобы понять, как вообще правильно сравнивать качество защиты. Сравнения по одной метрике недостаточно: какая-то модель лучше ловит опасные запросы, но чаще блокирует легитимные, большие модели имеют более высокий F1-score, но дороже в ин…
🔥11❤8👍2
5 Aug 2026, 14:27 UTC286 views21 reactionsread 7 August 2026 Forwarded from @aisecuritylab
Одна из участниц команды лаборатории — Анна Решетняк — дебютировала со статьей на Хабр! 🔥
В материале Аня рассказывает об опыте ускорения Guard модели на основе NER‑классификатора. Модель была нетривиальной, отсюда её ускорение не влезало в классические пути.
В статье протестировано 5 инструментов: TensorRT, NVIDIA Triton, vLLM, Ray Serve и отдельно — смена бэкбона на Flash DeBERTa. Такой зоопарк ценен сам по себе,…
❤11🔥10
4 Aug 2026, 18:05 UTC≈1,100 views18 reactionsread 7 August 2026 Photo
OWASP выпустил новую версию Top 10 for LLM Applications 2026.
1. Prompt Injection
2. Sensitive Information Disclosure
3. Excessive Agency
4. Supply Chain
5. Data and Model Poisoning
6. Unbounded Consumption
7. Misinformation
8. Hidden Context Exposure
9. Vector and Embedding Weaknesses
10. Improper Output Handling
Как и другие гайды проекта, этот список формировался силами сообщества. Участники предлагали новые кат…
🔥18
4 Aug 2026, 07:19 UTC442 views5 reactionsread 7 August 2026 Robinhood добавил нативную поддержку агентов своих клиентов. В мае компания выпускает MCP, который позволяет подключать агентов к управлению инвестиционным портфелем. За два месяца счета открыли 100 тыс. клиентов с суммарным объемом активов $100 млн. Всего на платформе 28 млн пользователей, то есть меньше половины процента пользователей подключили агентов, но хайп вокруг темы дает стремительный рост.
К слову о безоп…
🔥3❤1😁1
29 Jul 2026, 14:19 UTC575 views2 reactionsread 7 August 2026 Запись вчерашнего эфира доступна, будем рады вашему фидбеку!
🔥2
29 Jul 2026, 14:19 UTC534 views13 reactionsread 7 August 2026 Forwarded from @hive_trace
📣 Актуальные сценарии работы HiveTrace с OpenClaw и Claude
Сегодня на вебинаре показали, как с помощью HiveTrace Hooks контролировать работу Claude, рассказали о способах защиты OpenClaw и продемонстрировали атаки на агентов.
▶️ СМОТРЕТЬ
🟦 СМОТРЕТЬ
Поделитесь в комментариях: какие действия AI-агентов в вашей инфраструктуре требуют особого контроля?
👍7🥴3🔥2❤1
28 Jul 2026, 07:51 UTC594 viewsread 7 August 2026 Forwarded from @hive_trace
🎥Присоединяйся к вебинару по новым сценариям работы HiveTrace с OpenClaw и Claude в 11:00
Уже через час с командой HiveTrace в лайв-демо разберем, как обеспечить безопасность при использовании этих нашумевших инструментов в AI-агентах
➡️ ПОДКЛЮЧИТЬСЯ
27 Jul 2026, 07:42 UTC833 views11 reactionsread 7 August 2026 AI Security - это не просто AI Firewall.
Три года назад, когда мы впервые заговорили о безопасности искусственного интеллекта, еще не было названия для нового класса продуктов. Robust Intelligence первыми запатентовали технику защиты AI Firewall, закрепив новое название в истории. Сейчас мы видим, как этот новый вид фаервола прижился в ИБ-сообществе. Многие компании в России, выбирая сейчас решение для защиты ИИ, уж…
🔥11
22 Jul 2026, 09:23 UTC975 views18 reactionsread 7 August 2026 "Момент Mythos" случился и в России. 17 июля после принятия рамочного закона об ИИ в Совете Федерации выступил глава Сбербанка Герман Греф. Развитие моделей, агентная экономика, протокол MCP, кодовые агенты и OpenClaw, все это было в программе. Естественно, в центре внимания были социальные последствия ИИ-трансформации, реформа образования, обучение детей работе с нейросетями с начальных классов и подготовка школьных…
🤣8👍6😁4
17 Jul 2026, 06:30 UTC918 views41 reactionsread 7 August 2026 Рубрика дружеский пиар. Многие давние читатели знают про программу AI Talent Hub в ИТМО.
Команда HiveTrace выросла из лаборатории по AI Security, где мы читаем специализированный курс и проводим эксперименты с атаками и гардрейлами. Помимо нас, в учебной программе есть много интересного: курсы про создание ML и LLM-моделей, трек стартапов, новая лаборатория ИИ-агентов, а также индустриальные направления, такие как Х…
🔥25❤8🏆8
15 Jul 2026, 08:42 UTC614 viewsread 7 August 2026 28 июля проведем вебинар по защите агентных систем.
Расскажем, какие угрозы характерны для Claude Code и OpenClaw, и подробно разберем, как защищать эти популярные агентные инструменты на практике.
В HiveTrace мы добавили новые коннекторы для анализа трафика и контроля работы с tool calls. На вебинаре покажем лайв-демо, как это работает в связке с кодовым агентом и OpenClaw. Регистрируйтесь на Timepad https://aisec…
15 Jul 2026, 08:42 UTC742 views13 reactionsread 7 August 2026 Forwarded from @hive_tracePhoto
Контроль Claude и OpenClaw в HiveTrace
На вебинаре покажем новый сценарий работы HiveTrace с OpenClaw и Claude: в лайв-демо разберем, как обеспечить безопасность при использовании этих нашумевших инструментов в AI-агентах
🗓 28 июля в 11:00, МСК
Что будет в демо: ⬇️
➡️ как HiveTrace Hooks работают с Claude Code;
➡️ как анализировать пользовательские запросы до передачи в Claude;
➡️ как проверять tool calls до факти…
🔥10👍3
Showing the 12 most recent of 21 posts we hold for @kokuykin. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.