8 Aug 2026, 15:18 UTC73 views1 reactionsread 9 August 2026 🎨 xAI выпустила Grok Imagine Image 2.0
Новая модель стала основой режима Quality в Grok Imagine. Она точнее следует промптам, лучше справляется с композицией, типографикой и мелким текстом, а также сохраняет детали между последовательными генерациями и правками.
Появилось точечное редактирование отдельных областей, автоматическое выделение объектов, удаление фона, расширение изображения под другое соотношение сторо…
custom 58845003926407801421
7 Aug 2026, 12:00 UTC89 views1 reactionsread 9 August 2026 Video
🧠 OpenAI обновила GPT-5.6 Sol в ChatGPT
GPT-5.6 Sol стала точнее отвечать на вопросы, лучше подбирать объём ответа и реже перегружать его лишними подробностями и оформлением. В Plus и Pro одна и та же Sol теперь используется как для быстрых ответов, так и для глубокого рассуждения.
Появился ползунок глубины рассуждения. Во внутренних тестах OpenAI на финансовых, медицинских и юридических вопросах ответы хотя бы с о…
custom 58845003926407801421
7 Aug 2026, 11:35 UTC18 viewsread 9 August 2026 Forwarded from @GreenNeuralRobotsPhoto
По слухам, NVIDIA разрабатывает технологию использования SSD в качестве расширения видеопамяти. Это позволит запускать крупные нейросети на босяцких GPU
Данные, не помещающиеся в основную GDDR7-память, будут храниться на SSD и подгружаться по требованию. Технология будет работать в связке с DirectStorage и RTX IO
Энтузиасты уже создали подобный проект GreenBoost (на гитлабе адская процедура регистрации, я не осилил…
6 Aug 2026, 17:02 UTC431 views1 reactionsread 9 August 2026 🧠 Bad Theory Labs выпустила BTL-4 и BTL-4 Compact
BTL-4 — открытая агентная модель на 35 млрд параметров для программирования и работы с инструментами. Разработчики заявляют 78,4% на SWE-bench Verified и почти четырёхкратное ускорение относительно Qwen3.5-35B в их тестах.
Главная особенность — BTL-4 Compact. Всю модель ужали в один файл размером 9,96 ГБ — около 2,3 бита на вес. По заявлению Bad Theory Labs, она пом…
custom 58845003926407801421
6 Aug 2026, 16:35 UTC21 views2 reactionsread 9 August 2026 Photo
⚡ DeepSeek V4 Flash ускорили почти в 2 раза
Unsloth добавила поддержку DSpark для локального запуска DeepSeek-V4-Flash-0731. Технология использует дополнительный модуль модели для предварительного предсказания токенов и ускоряет генерацию примерно в 1,4–2 раза без изменения качества ответов.
На NVIDIA B200 получили 119,7 токена/с против 62,6 токена/с без DSpark — ускорение в 1,91 раза. Оптимальным оказался режим DS…
custom 58845003926407801422
6 Aug 2026, 16:29 UTC14 viewsread 9 August 2026 Forwarded from @GreenNeuralRobotsVideo
SeedRealtime
Полнодуплексная аудиовизуальная интерактивная модель от ByteDance, рилтайм
Фокус на естественное двустороннее общение.
• понимает звук и картинку одновременно
• ловит цель взаимодействия и намерения пользователя
• смотрит, слушает, говорит без задержек
весов нет, ссылки на демо, API нет
#duplex #dialog #realtime #interactive #multimodal #asr #tts
6 Aug 2026, 16:08 UTC15 viewsread 9 August 2026 Forwarded from @GreenNeuralRobotsPhoto
Wan 3.0 вышел в публичную бету
• Нативная генерация 30-секундных видео
• Реализм
• Омни-референс: помимо текста, изображений, аудио и видео теперь поддерживает документы, таблицы, презентации, веб-страницы и многое другое
Где попробовать:
• Alibaba Cloud Model Studio
• Qwen Cloud
• Скоро на wan.video (только для участников)
Цены на API:
• 480p — 0,05 доллара за секунду
• 720p — 0,10 доллара за секунду
• 1080p — 0,…
6 Aug 2026, 16:04 UTC14 viewsread 9 August 2026 Forwarded from @GreenNeuralRobotsVideo
JoyAI-Video-Edit
Авторегрессивная диффузионная модель для потокового редактирования видео
• стиль видео по промпту
• добавление/удаление объектов
• замена фона на лету
• локальные правки без пересчёта всего ролика
• 720p в реальном времени
• ~30 FPS на одном GPU
• 16B параметров
Гитхаб
HF
Демо - там только для своих, нужен инвайт
#streaming #videoediting #v2v #realtime
6 Aug 2026, 00:14 UTC92 views2 reactionsread 9 August 2026 🤖 Meta выпустила Muse Code — нового агента для программирования
Muse Code работает прямо в терминале и использует новую модель Muse Spark 1.2. Агент рассчитан на долгие задачи: может планировать работу, менять сразу много файлов и самостоятельно проверять результат.
Для сложных задач Muse Code запускает постоянных субагентов, которые работают параллельно. История действий сохраняется, поэтому после сбоя агент может…
custom 58845003926407801422
5 Aug 2026, 16:36 UTC19 viewsread 9 August 2026 Forwarded from @GreenNeuralRobotsPhoto
UEmbed
мультимодальная модель эмбеддингов от Alibaba
2B, 4B, 9B
UEmbed это decoder‑only модель, которая в одном проходе генерирует сразу два типа представлений:
- плотные (dense) для семантического поиска и задач типа retrieval
- разреженные (sparse, лексические) хорошо работает для классического лексического поиска
При этом модель принимает на вход текст, изображения и видео и выдаёт для них совместимые эмбеддин…
4 Aug 2026, 19:16 UTC90 views2 reactionsread 9 August 2026 Photo
🧠 Pokee выпустила Isaac 28B с контекстом на 10 млн токенов
Pokee-Isaac 28B — агентная модель с новой фирменной архитектурой. Разработчики заявляют 93,3% в RULER при обработке всех 10 млн токенов и запуск на одной RTX 4090.
Модель рассчитана на длительные задачи и работу с инструментами. В собственных испытаниях Pokee она лидирует в BFCL v4 и τ³-bench, а скорость обработки контекста достигает 137 тысяч токенов в сек…
custom 58845003926407801422
4 Aug 2026, 18:46 UTC114 views1 reactionsread 9 August 2026 Photo
🤖 Liquid AI выпустила агентную LFM2.5-2.6B
Компактная модель получила 2,69 млрд параметров, контекст на 128 тысяч токенов и поддержку 16 языков, включая русский. Её обучили на 34 трлн токенов.
LFM2.5-2.6B умеет рассуждать, вызывать инструменты и выполнять многоэтапные задачи. В тестах на следование инструкциям и работу с инструментами она соперничает с моделями до четырёх раз крупнее.
В формате GGUF модель занимае…
custom 58845003926407801421
Showing the 12 most recent of 15 posts we hold for @ezoneenews. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.