2 Aug 2026, 17:38 UTC≈1,420 views48 reactionsread 7 August 2026 Photo
Чи готовий агент чергувати замість тебе?
Продовжуємо гілку цікавих досліджень
Чергування - це коли серед ночі тебе будить алерт, продакшн лежить, і треба шивдко зрозуміти, що саме зламалось і чому. Робота напряжна, виснажлива, давно хочеться віддати її агенту. Отже вирішили це перевірити - подивитись як таку задачу будуть вирішувати топові моделі
🔬 Як перевіряли
Тестове оточення майже як продакшн - повноцінна архі…
👍33🔥9❤5💩1
30 Jul 2026, 22:04 UTC≈1,800 views50 reactionsread 7 August 2026 Photo
Чому агент тупить при вирішенні бажинок?
Тобі, як зазвичай, прилітає баг. Закидаєш агенту опис проблеми, стектрейс, тести, лінк на issue і купу додаткової інфи. І чомусь одну бажинку він фіксить одразу, а на дуже схожій проблемі ловить затуп. І інформація начебто однакова, і проблеми схожі, але працює через раз
👉 Вийшло дослідження «How Do LLMs Read Bug Reports?» - хлопці полізли подивитись, куди модель спрямовує …
👍39🔥9❤2
2 Jul 2026, 19:44 UTC≈3,350 views31 reactionsread 7 August 2026 🔄 Loop Engineering - наступний крок після Сontext Engineering
Ну що друзі, продовжуємо занурюватись в АІ напрямок. Сontext Engineering дав загальну картину: як побудувати робочій розробниціький workflow.
Але є одна річ, від якої залежить, чи можна цьому workflow довіряти, бо агенти самі по собі здатні доволі сильно часто приверати і не виконувати обіцяну роботу.
І це feedback loop. Тобто додаткові перевірки (крут…
👍12🔥8❤6💩3👀1🗿1
1 Jul 2026, 21:16 UTC≈3,080 views22 reactionsread 7 August 2026 Fable 5 знову доступний
https://x.com/claudeai/status/2072402636813607381
Судячи з усього фолбек на opus буде доволі частою історією, але це не повод не тестити.
До 7 липня можна користуватись моделю і вартість входить в ліміти (до 50% від тижневого), а потім буде за окремий кост.
Вже можна пробувати, якщо у вас все ще не перемикається на нову модель - оновить клод код і перелогіньтесь
Youtube | Instagram
👍9🔥9❤4
30 Jun 2026, 18:21 UTC≈2,900 views40 reactionsread 7 August 2026 UPD: Релізнули 🙂 Тестуємо, поки Сполучені Штати не заблокували 😁
😁38❤2
30 Jun 2026, 16:24 UTC≈2,930 views14 reactionsread 7 August 2026 Photo
От-от вийде Sonnet 5
І так, вже в наступній версії 2.1.197 модель зʼявилась в списку доступних, її можна активувати, але для використання поки обмежена, то ж чекаємо офіційного релізу і анонса
Ще лютому ходило багато слухів, що ця модель просто неймовірна і що вона може впоратись з кодінгом супер складних проектів. Після чого антропіки випустили sonnet 4.6 і слухи затихли 🙂
То як думаєте, чого очікувати?
👉 Для ти…
👍9🔥5
28 Jun 2026, 14:13 UTC≈3,130 views33 reactionsread 7 August 2026 Агенти пишуть тобі сміття, увага, не тому що вони тупі
Хоча часто дуже хочеться саме так і сказати 😅
Типу сидиш, даєш агенту задачу, він щось там генерує, розкладає по файлах, пише “готово”, “усе працює”, “я все перевірив”
А потім ти відкриваєш код і такий:
боже
шо це за гівно
👉 Я записав про це новий відос відео:
І головна, що проблема часто не в моделі, а в процесі навколо неї
• Бо якщо не дав контекст - вона …
🔥12👀9❤🔥5👍3😁2💩1😱1
26 Jun 2026, 18:41 UTC≈2,740 views23 reactionsread 7 August 2026 Photo
OpenAI випустила GPT-5.6 (але не для нас 😅)
На бенчмарках це новий рекорд
Але є кілка але. На Terminal-Bench (тест на роботу в терміналі: планувати, ітерувати, смикати тулзи) звичайний Sol дає 88.8%, а Claude Mythos 5 (котрий ми так і не бачили) - 88.0%
Справжній стрибок до 91.9% з'являється тільки в режимі ultra, коли під капотом запускається рій сабагентів. Та сама ідея, що вже працює в Claude Code (динамічні вор…
👍12❤6👀3❤🔥1💩1
26 Jun 2026, 15:19 UTC≈2,260 views16 reactionsread 7 August 2026 Photo
Такс, календарчик івентів
Планую повертатися сюди частіше - з новими постами та матеріалами. Вже готую нове відео, буде зовсім скоро😉
А поки що ми з командою зробили сторінку на якій зібрали всі активності і заходи на липень.
Переходь на сторінку і переглядай ГРАФІК ЛИПНЯ.
3-4 липня - воркшоп Agentic Engineering Workflows
Більшість уже встигла на ньому побувати, але якщо тебе там ще не було - саме час приєднатися…
❤8🔥6❤🔥1💩1
17 Jun 2026, 10:11 UTC≈2,690 views16 reactionsread 7 August 2026 Друзі, став готувати новий воркшоп
Інструментів навколо агентів стало дуже багато. І я бачу як люди тонуть
Хтось колупає Claude Code, Codex, Cursor другий місяць і досі не розуміє з чого почати. Хтось накидав скілів і хуків, а АІ генерує сміття
👉 І поки програма не зафіксована - хочу трошки вас почути
Бо я можу зробити воркшоп про те що цікаво мені, але буде зовсім не в тему
💬 Тому коротке питання: що болить найб…
❤10👍4💩1🥰1
13 Jun 2026, 06:32 UTC≈3,430 views35 reactionsread 7 August 2026 🔥 Anthropic вимкнули Fable 5 і Mythos 5
Пу пу пуууууу
5 годин тому вийшла новина, що уряд США видав директиву: відрубити доступ до Fable 5 і Mythos 5 для всіх хто не є громадянином США.
Навіть для своїх же співробітників-неамериканців. Щоб не порушити закон, Anthropic тупо вимкнули обидві моделі для всіх клієнтів, бо паспорти вони не перевіряють.
Інші моделі (Opus, Sonnet, Haiku) працюють як працювали
Тепер трошк…
👀21❤6🌚6💩2
11 Jun 2026, 14:33 UTC≈2,350 views31 reactionsread 7 August 2026 Dynamic Workflows: Запускаємо сотні агентів паралельно
Трошки із запізненням, але закинув відос про найцікавішу, на мою думку, фічу Claude Code за останній час. Claude сам пише собі JS-скрипт оркестрації і розгортає під задачу цілий рой субагентів.
Масштаб там такий: команда Bun (той що JS all in one) за 11 днів переписала 750 тисяч рядків з Zig на Rust, і 99,8% тестів залишились зеленими (але комьюніті накидала ць…
🔥18👍8❤4❤🔥1
Showing the 12 most recent of 18 posts we hold for @beerphp. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.