14 Mar 2026, 13:43 UTC357 views4 reactionsread 8 August 2026 Awesome Agentic Hardening: как защищать AI-агентов
Тема безопасности LLM-агентов набирает обороты, и среди awesome-репозиториев очередное пополнение - Awesome Agentic Hardening . Это репозиторий с подборкой статей, фреймворков и инструментов по атакам и защите AI-агентов, которые автономно дёргают тулы, ходят в базы и принимают решения.
Что внутри: prompt injection (прямые и indirect), мультимодальные инъекции, pay…
❤2👍1🔥1
12 Mar 2026, 18:15 UTC213 viewsread 8 August 2026 Forwarded from @okmlai
ML supply chain - реальная поверхность атаки. Конкретные примеры, почему это не теория (начало тут)
Hugging Face прямо предупреждает, что pickle при десериализации исполняет последовательность opcode-инструкций; именно поэтому они поддерживают pickle-scanning. В качестве более безопасного формата Hugging Face продвигает safetensors, который позиционируется как безопасная альтернатива pickle для хранения тензоров.
H…
12 Mar 2026, 11:27 UTC201 views2 reactionsread 8 August 2026 Boundary Point Jailbreak: обход ограничений AI одним префиксом
Занятный ресерч от UK AI Safety Institute -- ребята придумали метод Boundary Point Jailbreaking, который автоматически генерирует универсальные jailbreak-и для обхода input-классификаторов в black-box условиях. То есть атакующий не видит ничего, кроме "заблокировано / пропущено", и этого достаточно.
Суть: метод ищет adversarial prefix - набор токенов, к…
👍2
11 Mar 2026, 10:55 UTC≈2,550 views7 reactionsread 8 August 2026 Prompt injection -> supply chain: как AI-бот скомпрометировал 4000 разработчиков
Занятная и пугающая история про то, как prompt injection через заголовок GitHub issue превратился в полноценную supply chain атаку. Разбор читается как сценарий триллера, только всё по-настоящему.
Суть: в репозитории использовался claude-code-action от Anthropic для автоматической обработки issue. Конфигурация была с allowed_non_write_…
🔥4👍2👌1
30 Oct 2025, 13:41 UTC342 views9 reactionsread 8 August 2026 Forwarded from @okmlaiPhoto
Project CodeGuard: Security Rules for AI Coding Agents
ИИ ускоряет разработку 🏃, но часто генерит уязвимый код. Можно столкнуться с пропуском валидации ввода, хардкодом секретов, слабой криптографией (и даже самописной), небезопасными функциями, пробелами в аутентификации/авторизации и бесконечный список и т.д. Project CodeGuard «подмешивает» 🥧защиту прямо в этапы планирования, генерации и последующего ревью кода. Э…
🔥5❤2💯2
28 Oct 2025, 17:41 UTC262 views3 reactionsread 8 August 2026 Forwarded from @YoungDaCode
😳 🧠 Agentic AI и безопасность — кто контролирует твои данные?
Наткнулся на интересную статью в блоге Мартина Фаулера — Agentic AI Security.
Она разбирает безопасность в работе LLM и объясняет, почему использование агентов — это не просто “умные помощники”, а ещё и новые векторы уязвимостей.
Заглавный вопрос статьи: LLM не различает данные и инструкции.
Когда агент объединяет несколько итераций текста и вызовов инс…
👍3
5 Jul 2025, 14:58 UTC263 views3 reactionsread 8 August 2026 ИИ в тренде!
А вы знали, что на OFFZone есть отдельный трек по ИИ и их безопасности, а также а атакам на них!
Ну и конечно, как их можно применять в безопасности в самых разных сферах!
Если вам есть, чем поделиться, смело подавайтесь!
❤3
5 Jul 2025, 14:58 UTC264 views4 reactionsread 8 August 2026 Forwarded from @offzone_moscowVideo
⚡️ Через неделю закроем прием заявок на доклады
Но это будет через неделю. А пока — ждем вас и ваши темы докладов.
Напоминаем, что можно податься сразу на несколько треков. А еще напоминаем, что мы написали подробный гайд о том, как правильно оформить заявку. Хорошая заявка повысит ваш шанс пройти отбор.
Дерзайте :)
❤4
27 Jun 2025, 20:33 UTC300 views4 reactionsread 8 August 2026 Как получить полноценный доступ к API ChatGPT
Очень интересный кейс случился со мной, когда я стал использовать API от ChatGPT.
По идее все очень просто, заходишь в аккаунт, выписываешь ключик, да пользуешься!
Но дьявол кроется в деталях:
1. Даже с оплаченного аккаунта запросы к API стоят отдельных денег, которые списываются с вашего баланса.
2. Через API нельзя генерировать картинки, если у вас неподтвержденный а…
👍2🔥2
26 Jun 2025, 19:50 UTC226 views6 reactionsread 8 August 2026 Как же все-таки получить оплаченный аккаунт Gppgle Gemini?
Всем привет!
Два раза я пробовал получить платную версию Gemini, но каждый раз сталкивался с тем, что либо аккаунт заблокируют, либо он будет общий и без сохранения истории, то через пару дней буквально кончится премиум-доступ. Благо денежка была совсем небольшая, но все равно неприятно. И наконец-то у меня получилось!
Сразу скажу, что путь не самый простой…
🔥3❤2👍1
8 Jun 2025, 10:58 UTC206 views4 reactionsread 8 August 2026 Photo
«Подождите немного и я вам отвечу» или как ленятся нейросети
Как-то раз, работая с ChatGPT, вгрузив в него кучу информации, уточнив детально, что нужно делать, я получил примерно такой ответ: «Я уже занимаюсь задачей и отправлю тебе всю информацию, как только она будет готова. Это займет от 15 минут до часа». И я радостный переключился на другие дела, подумав вот это круто, до чего дошел прогресс 😉
Но конечно, ни ч…
👍3🔥1
3 Jun 2025, 08:36 UTC≈6,280 views6 reactionsread 8 August 2026 Как AI-ассистенты открывают всему миру вашу почту и календарь
Всем привет!
Сегодня безумно популярна тема различных AI-агентов и в частности персональных AI-помощников, эдаких «Джарвисов» на минималках.
Эти помощники умеют читать и отправлять почту, ставить встречи в календарь и напоминать нам о них. И все это через удобный и привычный Телеграм!
Офигенно удобно, полезно и всячески ускоряет и упрощает нам жизнь! Е…
👍5❤1
Showing the 12 most recent of 20 posts we hold for @ai_she4ka. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.