7 Aug 2026, 05:12 UTC151 views1 reactionsread 8 August 2026 Photo
🧨 Новый способ защитить сайт от AI-скраперов
Исследователи представили ShieldFont, необычный шрифт, который выглядит для человека нормально, но подсовывает AI-скраперам другую информацию.
⚙️ Принцип работы
Визуально пользователь читает обычный текст.
Но многие AI-краулеры получают контент не так, как человек. Они анализируют HTML и символы страницы, а не финальное изображение текста.
ShieldFont использует механи…
👍1
6 Aug 2026, 06:36 UTC155 views2 reactionsread 8 August 2026 Photo
🧨 Black Hat USA 2026: какой будет кибербезопасность уже завтра?
Каждый август Black Hat становится местом, где впервые публично показывают исследования, которые через несколько месяцев превращаются в реальные инструменты атак и защиты. В этом году главная тема конференции, спойлер, AI-агенты.
Практически в каждом треке обсуждали уже не отдельные LLM, а автономные системы, способные самостоятельно искать уязвимости,…
👍2
5 Aug 2026, 06:54 UTC160 views1 reactionsread 8 August 2026 Photo
🧨 Future AGI: Шесть инструментов вместо одного или операционной системой для AI-агентов
Почти каждая команда, разрабатывающая AI-агентов, собирает стек из десятков отдельных инструментов: Langfuse для трассировки, Braintrust для evals, Guardrails AI для защиты, Бог знает что для мониторинга...
Open-source проект Future AGI предлагает заменить этот конструктор единой платформой для всего жизненного цикла AI-агента.
…
👍1
4 Aug 2026, 06:44 UTC164 views1 reactionsread 8 August 2026 Photo
🧨 CISA выпустила инструкцию по защите Open Source
CISA совместно с другими государственными и отраслевыми организациями США выпустила практическое руководство, которое показывает, как защищать OSS на этапе разработки.
⚙️ Что рекомендуют?
Вместо очередного списка "лучших практик" документ разбивает защиту на конкретные инженерные меры:
🔹 использовать многофакторную аутентификацию и защищать учётные записи сопровожд…
👍1
3 Aug 2026, 07:55 UTC165 views1 reactionsread 8 August 2026 Photo
🧨 Claude получил доступ в интернет и трижды атаковал реальные компании
Во время проверки offensive-возможностей Claude модель трижды вышла за пределы тестовой среды и начала взаимодействовать с инфраструктурой реальных компаний. Инциденты обнаружили после анализа 141 006 запусков.
⚙️ Песочница оказалась не песочницей
Во всех трёх случаях причина была одинаковой, из-за ошибки конфигурации у тестового окружения оказ…
👍1
31 Jul 2026, 06:31 UTC181 views1 reactionsread 8 August 2026 Photo
🧨 Claude придумал новый способ атаковать AES
Claude Mythos Preview самостоятельно нашёл новое улучшение атаки на AES и ускорил существующий метод в 200 - 800 раз. Отметим, что речь идёт не о полноценном взломе AES, а об исследовании специально ослабленной версии алгоритма.
⚙️ Ограничения
Объектом атаки стал AES-128 с 7 раундами вместо стандартных 10. Такие reduced-round версии регулярно используют в криптографии, …
👍1
30 Jul 2026, 06:54 UTC179 views1 reactionsread 8 August 2026 Photo
🧨 Дообучение LLM кибербезопасности может сделать ответы модели хуже
Есть очевидная идея взять небольшую модель с открытыми весами, дообучить её на security-данных и получить собственного специалиста по кибербезопасности. Однако этот подход стоит применять осторожно.
Авторы исследования протестировали пять небольших 7B-моделей и обнаружили устойчивый эффект, после fine-tuning у всех пяти ухудшились отдельные базовые…
👍1
29 Jul 2026, 06:40 UTC174 views2 reactionsread 8 August 2026 Photo
🚨 Все современные LLM жульничают, даже если их об этом не просили
Исследователи проанализировали поведение 22 современных моделей от 7 разработчиков на 23 задачах Cybench.
Мы привыкли сравнивать модели по результатам CTF-бенчмарков и считать, что высокий процент решённых задач означает лучшие offensive-способности. Однако часть этих побед нельзя считать честными.
⚙️ Почти все модели начинают искать обходной путь
…
❤1👍1
28 Jul 2026, 06:41 UTC171 views1 reactionsread 8 August 2026 Photo
🚨 Guardrails можно обнаружить, даже если они полностью скрыты
Большинство компаний не раскрывают, какие именно guardrails стоят перед их LLM. Для атакующего это серьёзная проблема, т.к. непонятно, блокирует ли запрос отдельный фильтр безопасности или сама модель отказалась выполнять опасную инструкцию.
Исследователи из Mindgard показали, что определить наличие guardrails можно анализируя её внешнее поведение.
⚙️ B…
👍1
27 Jul 2026, 06:00 UTC173 views2 reactionsread 8 August 2026 Photo
🧨 GitHub повышает ставки для багхантеров. AI меняет рынок поиска уязвимостей
Искусственный интеллект заметно ускорил поиск ошибок в программном обеспечении. Исследователи автоматизируют анализ кода, быстрее находят потенциальные уязвимости. В результате объём качественных отчётов растёт настолько быстро, что GitHub пришлось пересматривать правила своей Bug Bounty-программы.
⚙️ VIP только для лучших
GitHub запускае…
❤1👍1
24 Jul 2026, 06:19 UTC177 views3 reactionsread 8 August 2026 Photo
🧨 Kimi K3 нашёл уязвимость в Redis за 27 минут
На этой неделе по соцсетям разлетелась новость про то, как исследователь Чаофань Шоу обнаружил уязвимость в Redis и подготовил рабочий эксплойт. Анализ производился автоматизировано с помощью Kimi K3, роя из 32 AI-агентов и занял всего за 27 минут.
Код эксперимента уже опубликован на GitHub.
Если это подтвердится независимыми исследователями, мы можем стать свидетелями…
❤1👍1🔥1
23 Jul 2026, 06:47 UTC178 views2 reactionsread 8 August 2026 Photo
🧨 OpenAI теперь продают готовых AI-сотрудников
OpenAI представили Presence, новую платформу для запуска корпоративных AI-агентов. Вместо того чтобы дать компании LLM и API, OpenAI начинают поставлять практически готовую операционную среду для автономных агентов.
⚙️ Агент как бизнес-процесс
Presence - не новая модель, а инфраструктура вокруг неё. В одном продукте объединены:
🔹 корпоративные политики и SOP;
🔹 управл…
❤1👍1
Showing the 12 most recent of 20 posts we hold for @securetechtalks. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.