Új hangmodellt bocsátott ki az OpenAI, kevésbé vág közbe
Az OpenAI új, GPT-Live-1 nevű hangmodellje szimultán képes beszélni és hallgatni, így kevésbé vág közbe a felhasználóba. A modell a mélyebb elemzéshez a GPT-5.5-öt használja.

Az OpenAI átalakítja a ChatGPT hang módját egy új modellel, amely állításuk szerint „inkább olyan, mintha egy másik emberrel beszélgetnénk”. Az új GPT-Live-1-et úgy tervezték, hogy kevésbé vágjon közbe, és kivárja, amíg a felhasználó folytatja a beszédet egy szünet után.
Kundan Kumar, az OpenAI kutatási vezetője a GPT-Live-1-et nevezte a cég eddigi „legokosabb hangmodelljének”. Automatikusan továbbítja a lekérdezéseket a legjobb szöveges modelljeihez, például a GPT-5.5-höz, amikor mélyebb érvelésre vagy webes keresésre van szükség. Ez lehetővé teszi a gyorsabb átmenetet a kutatott téma és annak eredményeinek megbeszélése között. A továbbfejlesztett modell kiegészíti az időjárással, részvényekkel és sporttal kapcsolatos beszélgetéseket AI-generált vizuális elemekkel, amelyek releváns információkat jelenítenek meg, mint például a sporteredmények vagy az aktuális előrejelzés.
Kapcsolódó: GPT-5.5 Instant hibajavítása
Valós idejű fordítás és vizuális kiegészítések
A ChatGPT korábban egy régebbi, körökre osztott hangmodellt használt, amely nem mindig adott pontos válaszokat, és néha nehezen tartotta a természetes beszélgetési folyamatot. „Ez egy teljes duplex modell” – mondta Atty Eleti, az OpenAI termékvezetője. „Ez azt jelenti, hogy egyszerre tud beszélni és hallgatni. A modell oldaláról képes folyamatosan és szimultán feldolgozni a bemeneti adatfolyamot és előállítani a kimeneti adatfolyamot.” Ez a felállás új funkciókat nyit meg a ChatGPT hangmódja előtt, mint például a valós idejű fordítás. Mostantól, ahelyett, hogy megvárná, amíg abbahagyja a beszédet a fordításhoz, a ChatGPT tud beszélni, miközben fordít. Azt is kérheti a ChatGPT Voice-tól, hogy hagyja abba a beszédet, amíg nem szólítják meg, ami az OpenAI szerint korábban nem volt lehetséges. Elismeri, hogy figyel, olyan kifejezésekkel, mint a „mhmm” vagy „igen”, és „értem”.
Kapcsolódó: GPT-5.5 Instant finomhangolása
Biztonsági intézkedések és elérhetőség
Az OpenAI megjegyzi, hogy beépített biztonsági mechanizmusokat adott hozzá, amelyek elterelik a modellt a káros válaszoktól, vagy teljesen lezárják a csevegéseket „magasabb kockázatú” helyzetekben. A modell arra van betanítva, hogy „szakértők által ellenőrzött válságsegély-támogatást” kínáljon az öngyilkossági gondolatokkal kapcsolatos beszélgetésekben, és arra is tervezték, hogy „életkornak megfelelő” válaszokat adjon a tinédzsereknek.
Kapcsolódó: Egészségügyi pontosság javulása
A GPT-Live-1 az iOS, Android és a webes felületen keresztül válik elérhetővé. Ez fogja működtetni a ChatGPT Voice for Go, Plus és Pro előfizetőit, míg egy kisebb, hatékonyabb GPT-Live-1 mini modell lesz az alapértelmezett a szabad felhasználók számára.
Kapcsolódó: ChatGPT hallucinációs csökkenése