50 millió dolláros befektetést gyűjtött a Patronus AI, fejleszti digitális világmodelljeit
Az AI-ügynökök megbízhatóságát tesztelő digitális világmodelleket fejlesztő Patronus AI 50 millió dolláros Series B befektetést gyűjtött Greenfield Partners vezetésével.

Az AI-ügynökök egyre kifinomultabbak, komplex feladatok önálló végrehajtására képesek. Mielőtt azonban megbízhatnának bennük felhasználók nevében történő utazásfoglalás vagy pénzügyi elemzés elvégzésére, a modellfejlesztőknek és az ügynököket építő startupoknak biztosítaniuk kell, hogy ezek az ügynökök megbízhatóan teljesítsenek a legkülönfélébb forgatókönyvekben. A Patronus AI, a korábbi Meta AI kutatói által 2023-ban alapított startup, éppen ebben segít: szimulált digitális környezeteket hoz létre az ügynökök teljesítményének értékelésére.
A San Franciscó-i székhelyű cég bevételnövekedése 15-szeres volt az elmúlt évben, ami jelentős befektetői érdeklődést váltott ki. A Patronus AI csütörtökön jelentette be 50 millió dolláros Series B körét, amelyet a Greenfield Partners vezetett, és amelyben részt vett a Notable Capital, a Lightspeed, a Datadog és a Samsung is. A körrel a cég teljes finanszírozása 70 millió dollárra emelkedett.
Kapcsolódó: AI-hirdetések
Digitális világmodellek és megerősítő tanulás
A Patronus AI „digitális világmodelleket” használ weboldalak és belső rendszerek másolatainak létrehozására. Ezekben a környezetekben az ügynököket képzés után stressztesztelik megerősítő tanulási (reinforcement learning) módszerekkel, amelyek iteratívan jutalmazzák a sikeres feladatvégzést és büntetik a hibákat. Az AI-laboratóriumok nagy értéket látnak ezekben a digitális szimulációkban, mivel lehetőséget adnak az ügynököknek különböző, néha kiszámíthatatlan forgatókönyvek kipróbálására. A cég megközelítését ahogyan a Waymo az önvezető autókat képezte, először szintetikus világokat építve, hogy ritka veszélyekkel, például extrém időjárással vagy egy labda után szaladó gyermekkel szemben teszteljék a járműveket.
Kapcsolódó: Meta fizetős AI-terméke
Koncepció és versenyhelyzet
A különbség az AI-ügynökök esetében az, hogy hajlamosak „rövid utakat” keresni, ami azt jelenti, hogy nem mindig teljesítik helyesen a feladatot. „A Patronus nagyon jó a trükkök kiszúrásában, és biztosítja, hogy a modellek elszámoltathatók legyenek” — mondta Glenn Solomon, a Notable Capital ügyvezető igazgatója.
Kapcsolódó: Upscale AI értékelése
A Patronus jelenleg szoftvermérnöki és pénzügyi területeken kínálja digitális világait, de ezek csak a kezdetet jelentik Kannappan szerint. „Ma nagyon erősen koncentrálunk azokra a problémákra, amelyek igazolhatók, tehát azokra, amelyeket azonnal ellenőrizni lehet, de rengeteg további terület létezik, amelyek nagyon nem igazolhatók vagy nagyon nehezen igazolhatók” — mondta. Az, hogy ezek a folyamatok igazolhatók, nem jelenti azt, hogy egyszerűek. „Azt akarjuk, hogy képesek legyünk létrehozni azt a környezetet, amelyben egy 10 órán, 10 napon vagy 10 héten át futó ügynököt működtethetünk” — tette hozzá Kannappan.
Kapcsolódó: Meta robotfelvásárlás
A versenytársakat illetően a Patronus elsősorban azokkal az internalizált csapatokkal versenyez, amelyeket az AI-laboratóriumok már felépítettek az ügynökök viselkedésének értékelésére. Míg az olyan emberi adatokat szolgáltató cégek, mint a Mercor és a Surge, segítenek a modellfejlesztőknek a megerősítő tanulásban, a Patronus másképp működik: emberi beavatkozás nélkül értékeli az ügynökök viselkedését.
Kapcsolódó: Exa AI kereső
A Patronus AI a jövőben arra törekszik, hogy az ügynökök akár 10 órán át, vagy akár 10 napon át futhassanak a szimulált környezetekben. A cég elsődleges versenytársai az AI-laboratóriumok saját belső értékelő csapatai.