Google заходят в робототехнику по-своему
Пока Tesla, Figure и Unitree пытаются собрать лучшего гуманойдного робота, Google заходит с другой стороны. Компания продолжает фокусироваться на мозгах. Они представили Gemini Robotics 2 — универсальную модель, которая может адаптироваться под роботов разных производителей.
На самом деле Google представила сразу три связанные модели:
• Gemini Robotics 2 превращает изображение и текстовую команду в движения робота.
• Gemini Robotics ER 2 понимает происходящее, составляет план, проверяет результат и координирует нескольких роботов.
• Gemini Robotics On-Device 2 работает локально и адаптируется под совершенно новое тело менее чем на 200 примерах.
Главный апдейт с первой версии
Появилось управление всем телом одной системой. Раньше модель управляла руками роботов.
Теперь робот под управлением модели может одновременно идти, приседать, удерживать равновесие и тянуться к предмету. Раньше такие действия часто обслуживались отдельными контроллерами и заранее собранными последовательностями.
Робот получает цель и сам превращает её в непрерывное физическое поведение. Например, говоришь своему гаечному "убери захламлённую комнату". И Gemini Robotics 2 в ответ на запрос осматривается, составляет план, двигает предметы, проверяет результат, исправляет ошибки и при необходимости подключает другого робота.
По сути, Гуглойды двигают уже неплохо сложившуюся индустрию робототехники ближе к бесшовному взаимодействию с обычными людьми.
А что по реальным задачам?
Google показывает в демо ролике закручивание лампочки, завязывание пакетов и работу с зиплоком.
Однако собственные гугловые замеры успешности выполнения разных действий с помощью новой модели возвращают нас на землю:
• выкрутить лампочку — 92% успешных попыток
• закрутить обратно — 36%
• завязать пакет — 44%
• закрыть Ziplock — 40%
• воспользоваться совком — 32%
Получается эффектное демо уже можно снять. А вот уборку вашей кухни доверять терминаторам еще рано 😁
Завтра расскажу про рынок робототехники и AI в нем пошире. Stay tuned.