Горячая линия обслуживания
Google DeepMind запускает две новые модели искусственного интеллекта, призванные помочь роботам «выполнять более широкий спектр реальных задач, чем когда-либо прежде». Первая модель, названная Джемини Роботикс, представляет собой модель «видение-язык-действие», способную понимать новые ситуации даже без предварительной подготовки.
![]()
Gemini Robotics построена на Близнецы 2.0, последняя версия флагманской модели искусственного интеллекта Google. Во время пресс-конференции Каролина Парада, старший директор и руководитель отдела робототехники в Google DeepMind, заявила, что Gemini Robotics «использует понимание Gemini мультимодального мира и переносит его в реальный мир, добавляя физические действия в качестве новой модальности».
Новая модель достигла прогресса в трех ключевых областях, которые Google DeepMind считает решающими для создания полезных роботов: обобщение, интерактивность и ловкость. Помимо своей способности обобщать новые сценарии, Gemini Robotics может лучше взаимодействовать с людьми и окружающей средой. Он также может выполнять более точные физические задачи, такие как складывание листа бумаги или снятие крышки с бутылки.
Новая модель Gemini Robotics от Google DeepMind делает роботов более ловкими.
Парада сказал: «Раньше мы добивались прогресса в каждой из этих областей по отдельности, но теперь мы значительно повышаем производительность во всех трех областях с помощью одной модели. Это позволяет нам создавать роботов, которые более способны, отзывчивы и устойчивы к изменениям окружающей среды».
Google DeepMind также представил Gemini Robotics-ER (Воплощенное рассуждение), которое компания описывает как усовершенствованную модель языка видения, способную «понимать наш сложный и постоянно меняющийся мир».
Как объяснил Парада, когда вы упаковываете ланч-бокс с различными предметами на столе перед вами, вам нужно знать, где все находится, как открыть ланч-бокс, как брать предметы и куда их класть. Именно для таких рассуждений и предназначен Gemini Robotics-ER. Он направлен на то, чтобы позволить экспертам по робототехнике подключаться к существующим контроллерам низкого уровня (системам, которые управляют движениями робота), позволяя им включать новые функции, поддерживаемые Gemini Robotics-ER.
Gemini Robotics также может помогать роботам выполнять ряд задач.
Что касается безопасности, Викас Синдхвани, исследователь Google DeepMind, сообщил журналистам, что компания разрабатывает «многоуровневый подход», и добавил, что модель Gemini Robotics-ER «обучена оценивать, безопасно ли выполнение потенциальных действий в определенных сценариях». Компания также выпустила новые бенчмарки и фреймворки, чтобы помочь индустрии ИИ и дальше продвигать исследования безопасности. В прошлом году Google DeepMind представила «Конституцию робота» — набор правил для роботов, вдохновленный Айзеком Азимовым.
Google DeepMind сотрудничает с Apptronik для «создания следующего поколения человекоподобных роботов». Кроме того, Google DeepMind предоставляет «доверенным тестировщикам» доступ к своей модели Gemini Robotics-ER, включая Agile Robots, Agility Robotics, Boston Dynamics и Enchanted Tools. Парада сказал: «Мы сосредоточены на создании интеллекта, который может понимать физический мир и действовать в нем. Мы очень рады использовать это в различных воплощениях и приложениях».




粤公网安备44030002007346号