6 Aug 2026, 01:45 UTC715 views7 reactionsread 8 August 2026 Photo
🚀 GPT Transcribe — точная транскрипция от OpenAI
Новая модель OpenAI для преобразования речи в текст с поддержкой реального времени и специализированных терминов. Закрывает задачи от записи аудио до стриминговой транскрипции.
🔸 Характеристики: Audio → Transcription
🔸 Поддержка свободного контекста и подсказок по ключевым словам — удобно для отраслевой терминологии
🔸 Многоязычные подсказки: точная обработка смешанно…
🔥3❤2👍2
6 Aug 2026, 01:43 UTC676 views6 reactionsread 8 August 2026 Photo
🚀 Muse Spark 1.2 — модель рассуждений для агентных задач
Новая модель, заточенную под сложные мультиагентные сценарии — от планирования и делегирования до параллельного выполнения задач субагентами.
Что нового и крутого:
🔸 Характеристики: текст, изображение, видео, аудио, PDF → текст, контекст 1 048 576 токенов.
🔸 Поддержка нескольких кодовых оболочек и параллельных вызовов функций.
🔸 Структурированный вывод и наст…
🔥5👍1
4 Aug 2026, 18:48 UTC827 views8 reactionsread 8 August 2026 Photo
🚀 FLUX.3 Video — генерация видео под полным контролем
Black Forest Labs выпустили модель, которая превращает текст и изображения в видео с точным управлением сюжетом — от первого кадра до последнего.
Что нового и крутого:
🔸 Характеристики: текст, изображение → видео, контекст не указан.
🔸 Генерация видео по текстовому описанию (text-to-video)
🔸 Использование начальных и конечных ключевых кадров для управления сцено…
🔥4👍3👏1
3 Aug 2026, 16:51 UTC937 views20 reactionsread 8 August 2026 Photo
🚀 Qwen3.8 Max — флагманское мультимодальное рассуждение от Alibaba
Финальный релиз после Preview-версии: Alibaba выпустила Qwen3.8 Max — мощную мультимодальную модель для задач, где требуется глубокий анализ и точное мышление.
Что нового и крутого:
🔸 Характеристики: Text, Image, Video → Text, контекст 1 000 000 токенов
🔸 Мультимодальное рассуждение — работает с текстом, изображениями и видео в одном запросе
🔸 Заточ…
🔥10👍4🍾3❤2😎1
31 Jul 2026, 03:46 UTC≈1,340 views9 reactionsread 8 August 2026 Photo
🚀 MiniMax H3 — лёгкая модель для точной генерации видео
Компактная модель с открытыми весами, которая позволяет управлять видеогенерацией с высокой точностью — от редактирования по инструкциям до рендеринга текста и брендов.
Что нового и крутого:
🔸 Характеристики: Текст, Изображение → Видео, контекст не указан.
🔸 Точное мультимодальное редактирование контента по инструкциям.
🔸 Качественный рендеринг текста и бренди…
🔥6👍2👏1
31 Jul 2026, 01:25 UTC≈1,180 views9 reactionsread 8 August 2026 Photo
🚀 Runway Gen-4.5 — кинематографичное видео из текста и картинок
Новая модель генерации видео от Runway выводит визуальное качество и точность движения на уровень, приближенный к профессиональной съёмке.
Что нового и крутого:
🔸 Характеристики: text, image → video, контекст не указан.
🔸 Поддержка режимов text-to-video и image-to-video в единой модели.
🔸 Высокая кинематографичность сцен: реалистичное движение камеры и…
🔥7👍1👏1
31 Jul 2026, 01:25 UTC≈1,010 views7 reactionsread 8 August 2026 Photo
🚀 Runway Aleph 2.0 — точечный монтаж видео силой текста
Больше не нужно пересъёмок ради одной детали: модель редактирует готовые видеоролики по текстовым командам, аккуратно сохраняя всё, что менять не требуется.
Что нового и крутого:
🔸 Характеристики: text → video, контекст не указан.
🔸 Редактирование по текстовым инструкциям без переработки всего кадра.
🔸 Поддержка правок, привязанных к ключевым кадрам.
🔸 Сохране…
🔥5👍1👏1
31 Jul 2026, 01:25 UTC901 views8 reactionsread 8 August 2026 Photo
🚀 S2 Pro — многоязычный синтез речи с эмоциями
Fish Audio выкатили модель, которая превращает текст в естественную, выразительную речь — с поддержкой нескольких языков и тонкой настройкой интонаций прямо через описание на естественном языке.
Что нового и крутого:
🔸 Характеристики: текст → речь, поддержка многоязычного синтеза.
🔸 Управление стилем и эмоциями через текстовые инструкции — без сложных пресетов.
🔸 Подхо…
🔥5✍2👍1
28 Jul 2026, 00:54 UTC≈1,270 views11 reactionsread 8 August 2026 Photo
🚀 Qwen3.7 Flash — мультимодальный агент нового поколения
Модель рассуждений от Alibaba, заточенная под визуальные задачи: от анализа скриншотов до автономного взаимодействия с интерфейсами. Мощный инструмент для агентов, которым нужно "видеть" и понимать реальный мир.
Что нового и крутого:
🔸 Характеристики: текст, изображение, видео → текст, контекст 1 000 000 токенов
🔸 Сильное распознавание объектов и пространстве…
🔥5❤3🍾2👍1
25 Jul 2026, 04:33 UTC≈1,470 views15 reactionsread 8 August 2026 Photo
🚀 Claude Opus 5 — флагман для сложных задач
Anthropic выпустила Claude Opus 5 — модель, ориентированную на глубокое рассуждение, программирование и долгосрочные агентные задачи. Особенно сильна там, где нужна точность и последовательность на протяжении всего рабочего процесса.
Что нового и крутого:
🔸 Характеристики: text, image, file → text, контекст 1 000 000 токенов.
🔸 Полный цикл разработки: от написания кода до…
❤6👍5🔥3😱1
22 Jul 2026, 00:42 UTC≈1,650 views6 reactionsread 8 August 2026 Photo
🚀 Gemini 3.5 Flash-Lite — мощный мультимодальный агент для сложных воркфлоу
Gemini 3.5 Flash-Lite создан для работы в роли субагента в многоагентных системах: быстро, точно, с поддержкой широкого спектра входных данных.
Что нового и крутого:
🔸 Характеристики: text, image, video, file, audio → text, контекст 1 048 576 токенов.
🔸 Улучшенные агентные возможности — модель оптимизирована для целенаправленного выполнения…
❤3🔥2👍1
22 Jul 2026, 00:42 UTC≈1,310 views6 reactionsread 8 August 2026 Photo
🚀 Gemini 3.6 Flash — мультимодальный флагман для агентных задач
Gemini 3.6 Flash заточен под реальную разработку: меньше итераций, меньше токенов, больше результата. Идеален для агентных пайплайнов и веб-разработки.
🔸 Характеристики: text, image, video, file, audio → text, контекст 1 048 576 токенов.
🔸 Оптимизирован для кодирования и агентных рабочих процессов — снижает количество вызовов модели при выполнении зада…
🔥4🤩1🙏1
Showing the 12 most recent of 20 posts we hold for @routerai_news. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.