ÉlőUtoljára: 17 perceMa: 4
Modellek & LLMfrissítve: 13:45

Leggyorsabb és legolcsóbb a Grok 4.5 kódolóteszten

Az xAI Grok 4.5 modellje sebességben és költséghatékonyságban múlta felül a GPT-5.5-öt és a Claude Opus 4.8-at egy kódolóalkalmazás-teszten, 0,44 másodperces első token-látenciával és 0,002¢-os válaszonkénti költséggel.

Leggyorsabb és legolcsóbb a Grok 4.5 kódolóteszten
Fotó: Growtika / Unsplash
forrás: Hacker News·AI Forradalom szerk.·
Megosztás

Az xAI új, Grok 4.5 modellje a legokosabbnak ígérkezik, kifejezetten kódoláshoz és ügynöki munkához fejlesztették. A tryai.dev blog tesztje szerint a Grok 4.5 kiemelkedő sebességet és költséghatékonyságot kínál a versenytársakhoz képest, miközben a kódgenerálásban is jól teljesít.

Kódolóalkalmazások tesztje

A tesztben a Grok 4.5 mellett a GPT-5.5, a Claude Opus 4.8 és a Claude Fable 5 modelleket is kipróbálták. Három különböző feladatot kaptak: egy interaktív 3D-s Rubik-kocka, egy részecske-gravitációs homokozó és egy játszható Breakout játék elkészítése egyetlen HTML-fájlban, különféle könyvtárak és hálózati hívások nélkül. A modellek válaszait egy valós böngészőben tesztelték, és rögzítették a működésüket.

Kapcsolódó: GPT-5.5 fejlesztése

3D Rubik-kocka: A Claude-modellek győztek

A legnehezebb feladatnak a 3D Rubik-kocka bizonyult. Az Opus 4.8 és a Fable 5 első próbálkozásra tökéletes, animált kockát generált. A Grok 4.5 első próbálkozása nem jelenítette meg a kockát, de a második próbálkozásra már működőképes verziót hozott létre. A GPT-5.5 csak egy sötét, szinte színtelen felületet mutatott.

Kapcsolódó: GPT-5.5 API árak és hibák

Részecske-gravitációs homokozó: A GPT-5.5 vizuálisan lenyűgöző

Ebben a kategóriában minden modell működő homokozót hozott létre. A GPT-5.5 vizuálisan a leglenyűgözőbb, neonfényű részecskékkel és örvénylő színes nyomokkal. A Grok 4.5 tiszta, orbitális dizájnt kapott, míg a Fable 5 lágy, világító gömböket, az Opus 4.8 pedig a legzsúfoltabb, de fizikailag pontos részecskepályát mutatta.

Kapcsolódó: GPT-5.4 termelési modell

Breakout játék: Holtverseny

A Breakout játék elkészítésében mind a négy modell kiválóan teljesített, éles, játszható verziókat hozva létre első próbálkozásra, neon arcade stílusban. A Grok 4.5 és a GPT-5.5 különösen erősek voltak ebben a kategóriában.

Sebesség és költség: A Grok 4.5 dominál

A tryai.dev által végzett sebesség- és költségtesztek kimutatták, hogy a Grok 4.5 a leggyorsabb és legolcsóbb. Az első token-látenciája 0,44 másodperc volt, átviteli sebessége elérte a 110 tokent másodpercenként, válaszonkénti költsége pedig mindössze 0,002¢. Ezzel szemben a GPT-5.5 0,004¢-ba, az Opus 4.8 0,004¢-ba, a Fable 5 pedig 0,009¢-ba került válaszonként.

Kapcsolódó: GPT-5.5 Instant finomhangolása

Kreatív SVG-generálás: A Fable 5 viccesebb

Egy extra feladatban, egy lovon ülő űrhajós rajzolásában a Fable 5 szórakoztatta leginkább a tesztelőket vicces párbeszéddel. A GPT-5.5 is jó második volt, a Grok 4.5 pedig tisztán teljesítette a feladatot. Az Opus 4.8 SVG-je tartalmazott egy hibás attribútumot, ami kisebb pontlevonással járt.

Kapcsolódó: GPT-5.6 Pro modellek

Összegzés

A Grok 4.5 a sebesség és az ár/érték arány bajnoka, míg a Claude Opus 4.8 és Fable 5 a megbízhatóságban jeleskedik, különösen a bonyolultabb feladatoknál. A GPT-5.5 a gyors válaszokat és a vizuális stílust képviseli. A teszt alapján a Grok 4.5 jól felvette a versenyt a legjobbakkal, különösen a sebesség és a költség terén.

Forrás

Feldolgozott sajtóforrás·Hacker News

Eredeti cikk megnyitása →

Ez a cikk a fenti sajtóforrás alapján készült AI-összefoglalóval.

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom