21 Apr 2026, 20:13 UTC156 views11 reactionsread 9 August 2026 Как сделать VLA быстрее, чем телеоп демонстрации. Делюсь двумя подходами, которые работают на практике.
Проблема простая: телеоп медленный по природе — оператор осторожно управляет манипулятором, делает паузы. Модель учится на этих данных и воспроизводит ту же скорость. Но физически робот может двигаться быстрее.
1️⃣ Upsampling на этапе обучения — ускоряем эпизоды перед тренировкой, пропуская каждые N наблюдений и …
❤5👍4👏2
12 Apr 2026, 07:32 UTC181 views8 reactionsread 9 August 2026 В Иннополисе я работал с Антоном Станиславовичем Ширяевым — известным в кругах нелинейного управления учёным. Помимо прочего, он прекрасно знал историю развития теории управления и множество историй про именитых исследователей в этой области.
Слушать его было очень интересно и иногда даже весело — такие истории помогали увидеть контекст за событиями в управлении и робототехнике.
Недавно вышло интересное видео в луч…
❤4👍2💯1🤩1
9 Feb 2026, 06:09 UTC277 views9 reactionsread 9 August 2026 Ребята из Центра робототехники выпустили статью Green-VLA — VLA-модель для манипуляции. Обучили в четыре этапа: общее пространственное понимание (physical grounding), предобучение на роботных данных, файнтюн под конкретное воплощение и обучение с подкреплением (RL).
В статье несколько страниц уделено данным, их фильтрации и оценке качества. Для увеличения объёма собственных данных авторы использовали две аугментации…
❤🔥4💅3🔥2
1 Feb 2026, 05:54 UTC287 views17 reactionsread 9 August 2026 Меня недавно попросили порекомендовать хорошие ресурсы для изучения Reinforcement Learning.
Решил поделиться здесь материалами, которые реально помогли мне разобраться в RL, применять его в работе и в итоге получить офер на позицию RL Research Engineer.
Основательно учим RL
Теория вероятности — учим по мере надобности. Встретили importance sampling → сразу идёте разбираться.
База — Sutton & Barto (Part I) или Sta…
👍10❤3❤🔥2🎉1🤝1
12 Jan 2026, 15:24 UTC263 views15 reactionsread 9 August 2026 Год назад я собеседовался в Яндекс Humanoid, прошел через 7 раундов интервью и получил отказ. Рассказываю, как это было.
После предзащиты PhD я начал активно искать работу в робототехнике. Откликнулся на позицию контрол-инженера в Яндекс Humanoid, но в процессе собеседований фокус проекта менялся — под конец меня рассматривали уже на роль инженера по манипуляции.
Первое интервью было с лидом (на тот момент), где м…
🔥9❤5👍1
Posted without readable text
8 Jan 2026, 16:45 UTC214 views25 reactionsread 9 August 2026 Друзья, поздравляю всех с наступившим Новым годом!
Надеюсь, что 2025 год был для вас полон побед — маленьких и больших, а следующий станет ещё лучше🦾
Этот пост — небольшая рефлексия по итогам 2025 года и одновременно вопрос к вам о том, что вам было бы интересно читать в этом канале.
Для меня 2025 год выдался очень насыщенным. В январе я защитился в KU (запись защиты) Leuven и спустя почти 4 года стал PhD.
Сразу …
👏12🎄9❤4
20 Dec 2025, 19:01 UTC222 views16 reactionsread 9 August 2026 Что такое action chunk и зачем он нужен
Раньше контроллеры управления роботами на каждом временном шаге предсказывали ровно одно действие — например, положение и ориентацию захвата. Это действие затем отрабатывалось низкоуровневыми контроллерами.
На следующем шаге контроллер получал новые наблюдения (изображения с камер и состояние робота) и предсказывал следующее действие. Такой подход позволял роботу быстро реаг…
✍8🔥5👍3
21 Nov 2025, 12:21 UTC187 views9 reactionsread 9 August 2026 Написали с Антоном небольшую статью про VLA для DeepSchool. Если интересно, заходите читать
❤🔥4🔥3👍2
21 Nov 2025, 12:21 UTC223 views16 reactionsread 9 August 2026 Forwarded from @deep_school
Vision-Language-Action (VLA) Models: от токенов к действиям
Современные мультимодальные модели умеют работать с визуальными данными и текстом. Следующий шаг их развития — взаимодействие с физическим миром. Для управления роботами создаются Vision-Language-Action (VLA) модели, которые переводят визуальные данные и текстовые инструкции прямо в моторные команды робота. О том, как устроены такие модели, рассказываем в н…
🔥6❤🔥5👍4🐳1
21 Oct 2025, 11:47 UTC910 views19 reactionsread 9 August 2026 На прошлой неделе Hugging Face порадовал сразу двумя релизами для всех, кто интересуется робототехникой
1️⃣ Обзорная статья по Robot Learning
Отличный разбор всех современных подходов: обучение с подкреплением, с демонстраций и фундаментальные модели для робототехники (aka VLA — Vision-Language-Action модели).
2️⃣ Полноценный курс по Robot Learning
Подходит даже для абсолютных новичков. Авторы начинают с основ …
👍10🔥6❤3
25 Sept 2025, 05:38 UTC592 views17 reactionsread 9 August 2026 Принёс вам хорошую обзорную статью про VLA.
Но сначала — коротко о том, что это такое. Всё началось с больших языковых моделей (LLM), с которыми сегодня знакомы почти все. Позже им «дали глаза» — так появились vision-language models (VLM), которые принимают на вход изображение и текст и умеют отвечать на вопросы и рассуждать о картинках.
Логичный следующий шаг: если VLM понимают изображения и язык, почему бы не нау…
🔥9❤5❤🔥3
Showing the 12 most recent of 20 posts we hold for @robot_learning. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.