ÉlőUtoljára: 1 órájaMa: 5
Eszközökfrissítve: 10:46

Szöveget rejt PNG-képbe az új nyílt forráskódú eszköz, 70%-kal csökkenti a tokenköltséget

Az új nyílt forráskódú pxpipe eszköz szöveget alakít PNG-képpé, így akár 70%-kal csökkentheti a Claude és Fable 5 tokenköltségeit. Fejlesztője, Steven Chong szerint az átlagos megtakarítás 59–70% között mozog.

Szöveget rejt PNG-képbe az új nyílt forráskódú eszköz, 70%-kal csökkenti a tokenköltséget
Fotó: Pankaj Patel / Unsplash
forrás: The Decoder·AI Forradalom szerk.·
Megosztás

A pxpipe nevű nyílt forráskódú eszköz hosszú szöveges bemeneteket alakít át tömör PNG-képekké a Claude Code és a Fable 5 tokenköltségeinek csökkentése érdekében. A trükk az Anthropic képek árképzési módszerén alapul: míg a szöveg karakterenként nagyjából egy tokent kóstál, a képek ára a képpontméretükön alapul, függetlenül a benne lévő szöveg mennyiségétől. Így egy sűrűn kódolt kép nagyjából 3,1 karaktert tud csomagolni képtokenenként.

A pxpipe helyi proxyként működik, és átirányítja a Claude Code felé irányuló kéréseket. A statikus részeket, mint a rendszerüzenetek, dokumentáció vagy korábbi csevegési előzmények, képpé alakítja. Egy 48 000 karakteres rendszerüzenet szövegként 25 000 tokent tenne ki, képként viszont csak nagyjából 2700-at. Fejlesztője, Steven Chong becslései szerint az átlagos megtakarítás 59–70% között mozog, egy Fable 5 demóban pedig a munkamenet költsége 42,21 dollárról 6,06 dollárra csökkent. Ha a módszer elterjed, az AI-cégek emelhetik a képfeldolgozási árakat.

Kapcsolódó: Anthropic AI-kódoló

Az eljárásnak vannak hátrányai: veszteséges, így pontos karaktersorozatok, például hash-ek, hibásan olvashatók vissza a képekből. A feldolgozás lassabb is, mivel a modellnek a képeket egy látás-enkóderen kell átküldenie ahelyett, hogy közvetlenül szöveget olvasna. Alapértelmezetten a pxpipe a Claude Fable 5 és a GPT 5.6 verziókat támogatja. A Fable 5 benchmarkokon 100%-os pontosságot ér el matematikai feladatokban, míg az Opus 4.7 és 4.8 nagyjából 7%-ban olvassa félre a képeket, a GPT 5.5 pedig rosszabbul teljesít képi kontextussal.

Kapcsolódó: Moebius AI böngészőben

A szöveg képekbe kódolása nem új keletű ötlet. A Deepseek korábban egy OCR-rendszert fejlesztett, amely szöveges dokumentumokat képként dolgoz fel, és akár tízszeres tömörítést ér el a tartalom 97%-ának megtartása mellett. A pxpipe által jelentett költségcsökkentések és pontossági adatok Steven Chongtól származnak, és nem függetlenek ellenőrzött eredmények.

Kapcsolódó: Claude Code token-drén

Forrás

Feldolgozott sajtóforrás·The Decoder

Eredeti cikk megnyitása →

Ez a cikk a fenti sajtóforrás alapján készült AI-összefoglalóval.

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom