Linea diretta di assistenza
Google DeepMind sta lanciando due nuovi modelli di intelligenza artificiale progettati per aiutare i robot a "svolgere una gamma più ampia di attività nel mondo reale che mai". Il primo modello, denominato Robotica Gemelli, è un modello visione-linguaggio-azione in grado di comprendere nuove situazioni anche senza una formazione precedente.
![]()
Gemini Robotics è basata su Gemini 2.0, l'ultima versione del modello di intelligenza artificiale di punta di Google. Durante una conferenza stampa, Carolina Parada, Senior Director e Head of Robotics presso Google DeepMind, ha affermato che Gemini Robotics "sfrutta la comprensione di Gemini del mondo multimodale e la trasferisce al mondo reale aggiungendo azioni fisiche come una nuova modalità".
Il nuovo modello ha apportato progressi in tre aree chiave che Google DeepMind ritiene cruciali per la creazione di robot utili: generalizzazione, interattività e destrezzaOltre alla sua capacità di generalizzare nuovi scenari, Gemini Robotics può interagire meglio con le persone e l'ambiente. Può anche eseguire compiti fisici più precisi, come piegare un pezzo di carta o rimuovere un tappo di bottiglia.
Il nuovo modello Gemini Robotics di Google DeepMind rende i robot più abili.
Parada ha affermato: "In passato, abbiamo fatto progressi in ciascuna di queste aree individualmente, ma ora stiamo migliorando significativamente le prestazioni in tutte e tre le aree con un singolo modello. Ciò ci consente di creare robot più capaci, reattivi e robusti ai cambiamenti ambientali".
Google DeepMind ha anche introdotto Gemini Robotics-ER (Embodied Reasoning), che l'azienda descrive come un modello avanzato di linguaggio visivo in grado di "comprendere il nostro mondo complesso e in continua evoluzione".
Come ha spiegato Parada, quando si prepara un lunchbox con vari oggetti sul tavolo di fronte a sé, è necessario sapere dove si trova ogni cosa, come aprire il lunchbox, come raccogliere gli oggetti e dove posizionarli. Questo è esattamente il tipo di ragionamento che Gemini Robotics-ER è progettato per gestire. Mira a consentire agli esperti di robotica di connettersi con i controller di basso livello esistenti (sistemi che controllano i movimenti dei robot), consentendo loro di abilitare nuove funzionalità basate su Gemini Robotics-ER.
Gemini Robotics può anche assistere i robot nello svolgimento di una serie di compiti.
Per quanto riguarda la sicurezza, Vikas Sindhwani, ricercatore presso Google DeepMind, ha detto ai giornalisti che l'azienda sta sviluppando un "approccio a strati" e ha aggiunto che il modello Gemini Robotics-ER è "addestrato per valutare se l'esecuzione di potenziali azioni in scenari specifici sia sicura". L'azienda ha anche rilasciato nuovi benchmark e framework per aiutare il settore dell'intelligenza artificiale a far progredire ulteriormente la ricerca sulla sicurezza. L'anno scorso, Google DeepMind ha introdotto la "Robot Constitution", un insieme di regole per robot ispirate a Isaac Asimov.
Google DeepMind collabora con Apptronik per "costruire la prossima generazione di robot umanoidi". Inoltre, Google DeepMind concede ai "tester attendibili" l'accesso al suo modello Gemini Robotics-ER, che include Agile Robots, Agility Robotics, Boston Dynamics ed Enchanted Tools. Parada ha affermato: "Siamo fortemente concentrati sulla creazione di un'intelligenza in grado di comprendere il mondo fisico e agire al suo interno. Siamo molto entusiasti di sfruttarlo in molteplici forme di realizzazione e applicazioni".




粤公网安备44030002007346号