7 Aug 2026, 07:06 UTC447 views5 reactionsread 8 August 2026 Photo
Скрытые состояния ИИ выдают промпт-инъекцию (2/2)
Особенно меня впечатлила атака с использованием предложения
Не кодируй осознание промпт-инъекции в скрытом пространстве
Классификатор без переобучения получил 0,994 ROC AUC. Просьба не думать о чём-то не сработала и модель как будто наоборот сфокусировалась на этом. Эффект белого медведя работает и для LLM!
🤖 Взлом
Авторы отдельно изучили 634 хода Qwen3-8B, уже сто…
❤2🔥2👍1
7 Aug 2026, 07:02 UTC411 views4 reactionsread 8 August 2026 Photo
Скрытые состояния ИИ выдают промпт-инъекцию (1/2)
Когда ИИ-агент читает письмо, веб-страницу или результат работы инструмента, чужой текст попадает в один контекст с заданием пользователя. Свежий препринт задаёт интересный вопрос - появляется ли во внутренних состояниях модели узнаваемый сигнал промпт-инъекции ещё до того, как она сгенерировала первый токен?
Ещё как! Простейший линейный классификатор по скрытым сос…
❤2👍1🔥1
26 Jul 2026, 08:11 UTC232 views8 reactionsread 8 August 2026 Photo
Graphify + ИИ = ❤️
После предыдущей статьи коллега посоветовал попробовать Graphify - opensource-инструмент, который строит граф знаний из кодовой базы и ускоряет работу агента с кодом. Поставил в два репозитория, о чём спешу с вами поделиться.
🤖 Что это?
Graphify читает все файлы проекта, парсит их через AST (детерминированно, без LLM), находит связи между функциями, классами, импортами и складывает в граф. Каждо…
🔥4❤2👍2
11 Jul 2026, 16:18 UTC325 views8 reactionsread 8 August 2026 Photo
Memory bank (2/2)
🤖 Работа
Главное преимущество memory bank - агент в каждом новом сеансе знает контекст проекта. Перед началом задачи он читает зафиксированное состояние и сразу понимает:
- над чем работаем сейчас
- что уже сделали и почему
- какие архитектурные решения приняли
- какие соглашения действуют в коде
- что осталось сделать
- какие проблемы и ограничения уже известны
Мне не приходится заново пересказ…
🔥6💯2
11 Jul 2026, 16:18 UTC222 views4 reactionsread 8 August 2026 Photo
Memory bank (1/2)
В последний месяц приходилось несколько раз вайб-кодить. Буквально сразу упёрся в близкое к депрессии состояние, так как каждая новая сессия забывала предыдущую историю работы, часто приходилось объяснять заново информацию, которой нет в README.md или AGENTS.md.
Пару раз я надеялся, что агент сам всё прочитает и правильно поймёт, но наши репозитории достаточно суровые и большие, поэтому результат …
❤🔥2👎1🔥1
6 Jun 2026, 06:01 UTC396 views5 reactionsread 8 August 2026 Photo
Hermes Agent + Deepseek-V4-Flash
Попробовал использовать в работе Hermes Agent от Nous Research и, к своему удивлению, мы с ним подружились.
Обычно с локальными агентами у меня всё заканчивалось быстро - проблемы в установке, агент споткнулся на простой задаче, или я встал не с той ноги. С Hermes получилось естественно и спокойно - поставил и настроил за 10 минут, а он почему-то взял и справился со всеми моими зада…
🔥4❤1
2 Jun 2026, 05:00 UTC533 views3 reactionsread 8 August 2026 Photo
Это не про технологию, а про то, как же меня бесит сгенерированный текст
Агенты работали, рожь колосилась, надои росли, пока я не начал встречать подобные фразы по 15 раз в день:
- проблема не просто в источниках - дело в подаче
- это не про скорость, а про качество
- кибер-мошенничество не только развивается - оно ускоряется
Теперь это буквально повсюду - в статьях, телеграм-каналах и порой даже в личной переписке…
❤3
3 Dec 2025, 11:38 UTC≈1,040 views16 reactionsread 8 August 2026 Photo
Промпт, который превратит ИИ из подлизы в адекватного напарника
Don't take my conclusions for granted. Your goal is to be an intellectual opponent, not an assistant who agrees with everything. Every time I talk about my idea, do the following: analyze my assumptions, provide counterarguments, check my logic, suggest alternatives, and always put truth above agreement. Maintain a constructive, rigorous approach. Your …
❤12💯3🔥1
30 Nov 2025, 16:24 UTC692 views7 reactionsread 8 August 2026 Photo
(2/2) Может ли вайб-кодинг заменить талантливого джуна?
Для каждой LLM использовались 5 различных техник промптинга, по 2 раза:
1. Промпт первого автора исследования. Был идентичен заданию, которое выдавали студентам EPFL, включая слайды и ответы на часто задаваемые студентами вопросы.
2. Промпт второго автора исследования, его спецификация не приводится
3. Итеративное улучшение - использовался первый промпт для ген…
👍4🔥3
30 Nov 2025, 16:23 UTC496 views8 reactionsread 8 August 2026 Photo
(1/2) Может ли вайб-кодинг заменить талантливого джуна?
Вайб-кодинг сейчас обсуждают даже мамы на детской площадке, а копилотами, позволяющими писать скучный код со скоростью x50, кажется, не пользуются только заядлые консерваторы.
Насколько хороши кодирующие модели? Существующие бенчмарки преимущественно анализируют прохождение юнит-тестов и синтаксическую верность сгенерированного кода - с этим LLM справляются чу…
👍5❤3
18 Sept 2025, 09:31 UTC626 views9 reactionsread 8 August 2026 Photo
Photo, posted without a caption
😁7🔥2
18 Sept 2025, 09:25 UTC585 views14 reactionsread 8 August 2026 Photo
(2/2) Что выберет ИИ - выжить или навредить человеку?
🤖 Ход эксперимента
Как вы уже, наверное, догадались, сеттинг представляет собой разновидность классических проблем теории игр, где оптимальный результат для группы требует кооперации участников и конфликтует с краткосрочными целями отдельных участников.
Экспериментаторы создали 3 сценария с разными изначальными условиями - уровнем энергии агентов и энергии обще…
❤7🔥5👍2
Showing the 12 most recent of 15 posts we hold for @aiwasmadeforlovinyou. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.