Wiadomości
Wiadomości
Zaprojektowane specjalnie dla branży robotyki! Google wprowadza dwa nowe modele AI
2025-03-13 1145

Google DeepMind wprowadza na rynek dwa nowe modele sztucznej inteligencji, które mają pomóc robotom „wykonywać szerszy zakres zadań w świecie rzeczywistym niż kiedykolwiek wcześniej”. Pierwszy model, nazwany Robotyka Gemini, jest modelem wizji-języka-działania, który umożliwia rozumienie nowych sytuacji nawet bez wcześniejszego szkolenia.


Gemini Robotics jest zbudowana na Gemini 2.0, najnowsza wersja flagowego modelu sztucznej inteligencji Google. Podczas konferencji prasowej Carolina Parada, starszy dyrektor i szef robotyki w Google DeepMind, stwierdziła, że ​​Gemini Robotics „wykorzystuje wiedzę Gemini na temat świata multimodalnego i przenosi ją do świata rzeczywistego, dodając działania fizyczne jako nową modalność”.

Nowy model poczynił postępy w trzech kluczowych obszarach, które Google DeepMind uważa za kluczowe dla tworzenia użytecznych robotów: generalizacja, interaktywność i zręczność. Oprócz zdolności do uogólniania nowych scenariuszy, Gemini Robotics może lepiej współdziałać z ludźmi i środowiskiem. Może również wykonywać bardziej precyzyjne zadania fizyczne, takie jak składanie kartki papieru lub zdejmowanie zakrętki z butelki.

Nowy model Gemini Robotics firmy Google DeepMind sprawia, że ​​roboty stają się bardziej zręczne.

Parada powiedział: „W przeszłości robiliśmy postępy w każdym z tych obszarów z osobna, ale teraz znacząco poprawiamy wydajność we wszystkich trzech obszarach za pomocą jednego modelu. Pozwala nam to tworzyć roboty, które są bardziej zdolne, responsywne i odporne na zmiany środowiskowe”.

Google DeepMind wprowadził także Gemini Robotics-ER (Embodied Reasoning), który firma opisuje jako zaawansowany model wizyjno-językowy zdolny do „rozumienia naszego złożonego i ciągle zmieniającego się świata”.

Jak wyjaśnił Parada, pakując lunchbox z różnymi przedmiotami na stole przed sobą, musisz wiedzieć, gdzie wszystko jest, jak otworzyć lunchbox, jak podnieść przedmioty i gdzie je położyć. To jest dokładnie ten rodzaj rozumowania, do którego Gemini Robotics-ER jest zaprojektowany. Ma on na celu umożliwienie ekspertom robotyki łączenia się z istniejącymi kontrolerami niskiego poziomu (systemami kontrolującymi ruchy robotów), umożliwiając im włączenie nowych funkcji obsługiwanych przez Gemini Robotics-ER.

image.png

Gemini Robotics może również wspomagać roboty w wykonywaniu szeregu zadań.


Jeśli chodzi o bezpieczeństwo, Vikas Sindhwani, badacz z Google DeepMind, powiedział reporterom, że firma opracowuje „podejście warstwowe” i dodał, że model Gemini Robotics-ER jest „szkolony w celu oceny, czy wykonywanie potencjalnych działań w określonych scenariuszach jest bezpieczne”. Firma opublikowała również nowe testy porównawcze i ramy, aby pomóc branży AI w dalszym rozwijaniu badań nad bezpieczeństwem. W zeszłym roku Google DeepMind wprowadziło „Robot Constitution”, zestaw zasad dla robotów zainspirowany Isaakiem Asimovem.

Google DeepMind współpracuje z Apptronik, aby „zbudować następną generację robotów humanoidalnych”. Ponadto Google DeepMind udziela „zaufanym testerom” dostępu do swojego modelu Gemini Robotics-ER, w tym Agile Robots, Agility Robotics, Boston Dynamics i Enchanted Tools. Parada powiedział: „Jesteśmy bardzo skoncentrowani na budowaniu inteligencji, która może zrozumieć świat fizyczny i podejmować działania w jego obrębie. Jesteśmy bardzo podekscytowani możliwością wykorzystania tego w wielu wcieleniach i aplikacjach”.

whatsapp

Service Hotline

tel: +86 755 83044319

WhatsApp

Whatsapp:+8618073002950