Google laat robots samenwerken in de fysieke wereld door Gemini Robotics ER 2
Google presenteert versie 2 van Gemini Robotics ER. Dit verbeterde AI-model laat robots de fysieke wereld zien en doorgronden, waarbij ze taken in meerdere stappen kunnen opdelen en met elkaar kunnen samenwerken. Het doel is om mensen bij te staan in alledaagse omgevingen.
De nieuwe versie 2 is volgens Google een grote upgrade ten opzichte van de voorgaande versie 1.6. Het vernieuwde 'brein' verwerkt videobeeld van de fysieke wereld zodat robots uiteenlopende taken met objecten en obstakels kunnen uitvoeren. Ze gebruiken daarbij alle ledematen en mogelijkheden daarvan, zoals fijnmotorische grip van individuele vingers bij humanoïde robots.
Gemini Robotics ER (embodied reasoning) 2 zet een flinke stap vooruit voor echt flexibele robots in gewone omgevingen waar mensen leven en werken, aldus Google. De ontwikkelaars bij AI-afdeling DeepMind stellen dat de meeste robots voorgeprogrammeerd zijn of op afstand worden bediend en dat ze alleen beperkte, herhalende taken aankunnen.
Elkaar dingen leren
"Ze missen het vermogen om echt zelf te leren of zich aan te passen aan onvoorspelbare omgevingen", schrijft roboticstopvrouw Carolina Parada in een blogpost. Verder is het 'enorm moeilijk' om geleerde vaardigheden over te dragen van het ene robotlichaam naar een heel ander robotlichaam. De nieuwe AI-software voor fysieke robots brengt hier verandering in.
Google toont in een video onder meer hoe een humanoïde robot (Apollo) samenwerkt met een stationair model (Duo) dat uit twee industriële armen bestaat. Apollo geeft Duo spraakcommando's om een krat met huishoudspullen en gereedschap op te ruimen. Daarnaast laat de video zien hoe de humanoïde robot een cassettebandje in een boombox plaatst, boeken in een kast zet, een gamecartridge in een vintage Atari 2600-gameconsole plaatst, een lamp verwisselt en een vuilniszak dichtknoopt.
30-07-2026 • 19:26
Lees meer
Reacties (9)
Wie bedenkt de combinaties...🥴
Er wordt momenteel massaal menselijke handelingen opgenomen. Ik heb zelfs een video gezien waarin iemand een camera (volgens mij op het hoofd) bij zich droegt om alledaagse klusjes te filmen zodat de beelden gebruikt werden voor het trainen van modellen.Dit verbeterde AI-model laat robots de fysieke wereld zien en doorgronden, waarbij ze taken in meerdere stappen kunnen opdelen en met elkaar kunnen samenwerken.
AI, ofwel de LLM's die we nu kennen zijn vooral digitaal aanwezig. Robots fysiek... dat vind ik persoonlijk nog wel een veel grotere disruptieve ontwikkeling die er aankomt dan LLM's.
https://arxiv.org/abs/2607.15330
Bedoelt men hier specifiek multimodale LLMs of VLMs?AI is the missing piece of the robotics puzzle
Dat is een indrukwekkend stukje techniek, alle props aan de ingenieurs daarvoor, maar de term AI wordt hier wel erg breed en als een recent ontdekt toverwoord gebruikt.
Wat voegt Gemini Robotics hier nou fundamenteel toe dat er voorheen niet was?
AI is meer dan llm..
ik verwacht dat je hier een beetje richting de tesla FSD ai wereld moet. Omgevingsbewust zijn, locatie bewust zijn etc..
Om te kunnen reageren moet je ingelogd zijn
:strip_icc():strip_exif()/u/16203/linux.jpg?f=community)
:strip_icc():strip_exif()/u/177567/crop5f8591cadf088_cropped.jpeg?f=community)
:strip_exif()/u/109857/ico2.gif?f=community)