A fizikai AI 2.0 új architektúrája pontosabbá teszi a robotok valóság-érzékelését
A fizikai AI 2.0 új architektúrája a valóság torz adatai alapján is pontosabb képet fest a robotok környezetéről, de a puszta adatnövelés nem elég.

A robotok és önvezető autók mesterséges intelligenciája (AI) hatalmas adathalmazokon és szimulációkon alapul, ám továbbra is létezik egy kritikus rés a rendszerek látásmódja és a valóság között. A fizikai állapot-visszaállítás hiánya miatt a robotok nem értik pontosan környezetük fizikai állapotát, ami téves döntésekhez vezethet — írja a The Robot Report.
Physical AI 1.0 vs. 2.0
A jelenlegi, fizikai AI 1.0 fázisban az iparág a hatalmas adatmennyiségre és az NVIDIA Cosmos platformjához hasonló szimulációkra támaszkodik. Ez a „vízió-központú” megközelítés feltételezi, hogy elegendő kamera és számítási kapacitás mellett a robotok képesek pontosan megjósolni a jövőt. Azonban a valóságban a vakító napfény, az árnyékok, a szenzorok zajos adatai mind ezt megnehezítik. A fizikai AI 2.0 bevezet egy új, lényeges réteget: a fizikai állapot-visszaállítást. Ez a különbség azért számít, mert a fizikai AI-ban már nem csak a modell a verseny egysége; a robotoknál a modellnek együtt kell működnie szenzorokkal, szimulációval, képzéssel, vezérléssel és visszajelzésekkel.
Kapcsolódó: Nvidia keretrendszer
Az új architektúra: a valóság megértése
Egy biztonságos rendszernek négy képességre van szüksége: világmodellekre (a múlt tapasztalatai alapján tanult tudás), fizikai állapot-visszaállításra (a torz szenzoradatokból rekonstruálja a valóságot), érvelő rendszerekre (döntéshozatal) és cselekvésre. Az érvelés csak a pontos állapotbecslésen alapulhat; ha az észlelés tökéletlen, a legjobb modell is tévedhet. A fizikai AI nem csupán leír vagy jósol, hanem a döntéseket mozgássá alakítja, ami megváltoztatja a világot és új megfigyeléseket generál.
Kapcsolódó: AI dinamikus viselkedés
Miért nem elég a több adat?
Az end-to-end modellek méretének növelése önmagában nem oldja meg a problémát. Egy dedikált állapot-visszaállító modul hatékonyabb, mivel lehetővé teszi speciális szenzorok (pl. radar, érintés) kihasználását, mielőtt a magasabb szintű „agy” elkezdene gondolkodni. Ez megakadályozza, hogy minden új robotnak a fizika alapjait kelljen újra megtanulnia. A nehéz esetek megkülönböztetése a rosszul megfigyelt esetektől kulcsfontosságú; a több adat nem segít, ha az alapvető megfigyelés sérült. A megoldás egy erősebb visszaállító réteg, amely fizikai korlátokat és gazdagabb szenzoradatokat használ a rejtett állapot láthatóvá tételéhez.
Kapcsolódó: Robotok érzelemfelismerése
Gyakorlati példák és a jövő
Ezt az architektúrát szemlélteti egy humanoid robot ruhát hajtogatva, ahol a modell a gyűrött, árnyékos ruhadarabot is felismeri, vagy egy önvezető autó, amely a parkoló teherautó mögött rejtőző biciklist is követi. Mindkét esetben a rendszer nemcsak a látottakat, hanem a valós fizikai állapotot is pontosan becsüli. A fizikai AI következő határvonala nem csupán az okosabb érvelés, hanem a jobb megfigyelés. Az AI-versenyt az a rendszer nyeri, amely a digitális jóslat és a fizikai valóság közötti szakadékot a legpontosabban tudja áthidalni. Dr. Behrooz Rezvani, az Atomathic vezérigazgatója szerint a jövő robotjai számára a láthatatlan megfigyelése lesz a kulcs — írja a The Robot Report.
Kapcsolódó: Multimodális AI korlátai