Google presenteert versie 2 van Gemini Robotics ER. Dit verbeterde AI-model laat robots de fysieke wereld zien en doorgronden, waarbij ze taken in meerdere stappen kunnen opdelen en met elkaar kunnen samenwerken. Het doel is om mensen bij te staan in alledaagse omgevingen.
De nieuwe versie 2 is volgens Google een grote upgrade ten opzichte van de voorgaande versie 1.6. Het vernieuwde 'brein' verwerkt videobeeld van de fysieke wereld zodat robots uiteenlopende taken met objecten en obstakels kunnen uitvoeren. Ze gebruiken daarbij alle ledematen en mogelijkheden daarvan, zoals fijnmotorische grip van individuele vingers bij humanoïde robots.
Gemini Robotics ER (embodied reasoning) 2 zet een flinke stap vooruit voor echt flexibele robots in gewone omgevingen waar mensen leven en werken, aldus Google. De ontwikkelaars bij AI-afdeling DeepMind stellen dat de meeste robots voorgeprogrammeerd zijn of op afstand worden bediend en dat ze alleen beperkte, herhalende taken aankunnen.
Elkaar dingen leren
"Ze missen het vermogen om echt zelf te leren of zich aan te passen aan onvoorspelbare omgevingen", schrijft roboticstopvrouw Carolina Parada in een blogpost. Verder is het 'enorm moeilijk' om geleerde vaardigheden over te dragen van het ene robotlichaam naar een heel ander robotlichaam. De nieuwe AI-software voor fysieke robots brengt hier verandering in.
Google toont in een video onder meer hoe een humanoïde robot (Apollo) samenwerkt met een stationair model (Duo) dat uit twee industriële armen bestaat. Apollo geeft Duo spraakcommando's om een krat met huishoudspullen en gereedschap op te ruimen. Daarnaast laat de video zien hoe de humanoïde robot een cassettebandje in een boombox plaatst, boeken in een kast zet, een gamecartridge in een vintage Atari 2600-gameconsole plaatst, een lamp verwisselt en een vuilniszak dichtknoopt.
:strip_icc():strip_exif()/u/16203/linux.jpg?f=community)
:strip_icc():strip_exif()/u/177567/crop5f8591cadf088_cropped.jpeg?f=community)
:strip_exif()/u/109857/ico2.gif?f=community)