ÉlőUtoljára: 1 napjaMa: 0

Rovat · 16. oldal

Modellek & LLM

GPT, Claude, Gemini és más generatív AI modellek, agents, multimodális rendszerek

578 cikk az archívumban

Minőségközpontú ranglistát indítottak az arab nagymodelleknek: a QIMMA feltárja a teljesítménytesztek hibáit
Modellek & LLM

Minőségközpontú ranglistát indítottak az arab nagymodelleknek: a QIMMA feltárja a teljesítménytesztek hibáit

Az új platform a meglévő teljesítménytesztek minőségi problémáit küszöböli ki, pontosabb képet adva a modellek arab nyelvi teljesítményéről.

Hugging Face·AI
ChatGPT Images 2.0: Pontos szöveggel és márkaazonos grafikával érkezett az OpenAI újdonsága
Modellek & LLM

ChatGPT Images 2.0: Pontos szöveggel és márkaazonos grafikával érkezett az OpenAI újdonsága

Az új képgeneráló motor márkaazonos stílusban, hibátlan szöveggel készít infografikákat és vázlatokat. A modell kiválóan teljesített a márkaazonos stílus megőrzésében, és a szöveghűség terén is jelentős fejlődést mutatott.

ZDNet AI·AI
Az Anthropic közzétette a Claude rendszerpromptjait — új mércét állít az átláthatóságnak
Modellek & LLM

Az Anthropic közzétette a Claude rendszerpromptjait — új mércét állít az átláthatóságnak

Az Anthropic ezzel a lépéssel az AI-modellek működésének jobb megértését segíti elő, ami eddig példátlan az iparágban.

Anthropic·AI
27 milliárd paraméteres Qwen3.6-27B veri a 397 milliárdos elődjét kódolásban
Modellek & LLM

27 milliárd paraméteres Qwen3.6-27B veri a 397 milliárdos elődjét kódolásban

A sűrű, nyílt forráskódú modell a SWE-bench Verified teszten 77,2 pontot ért el, míg a Terminal-Bench 2.0-n 59,3 pontot szerzett.

The Decoder·AI
Új promptokat kér a GPT-5.5-höz az OpenAI — a régiek rontják a teljesítményt
Modellek & LLM

Új promptokat kér a GPT-5.5-höz az OpenAI — a régiek rontják a teljesítményt

A fejlesztőknek nem szabad újrahasználniuk a korábbi modellekhez írt promptokat, mert a GPT-5.5 hatékonyabban működik minimális, eredményorientált utasításokkal.

The Decoder·AI
Mesterséges intelligencia tervezett egy teljes RISC-V processzormagot az alapoktól kezdve
Modellek & LLM

Mesterséges intelligencia tervezett egy teljes RISC-V processzormagot az alapoktól kezdve

A 1,5 gigahertzes órajelen működő VerCore teljesítménye egy 2011-es laptop CPU-jával vetekszik, ami jelentős előrelépést jelent az AI-alapú chiptervezésben.

IEEE Spectrum AI·AI
GPT-5.4 óta nincs külön Codex: az OpenAI egyesítette kódoló modelljeit
Modellek & LLM

GPT-5.4 óta nincs külön Codex: az OpenAI egyesítette kódoló modelljeit

Az OpenAI GPT-5.4 modelljével a Codex kódolási képességei beépültek a fő rendszerbe, így nincs többé különálló kódoló vonal.

Simon Willison·AI
OpenAI: 100 millió dollár a világmodellekbe
Modellek & LLM

OpenAI: 100 millió dollár a világmodellekbe

Az OpenAI 100 millió dollárt fektet be a világmodellek kutatásába. A cél egy olyan AI létrehozása, amely a fizikai világban is képes hatékonyan navigálni.

MIT Technology Review AI·AI
GPT-5.5-re szabott promptokat javasol az OpenAI – ne használd a régieket
Modellek & LLM

GPT-5.5-re szabott promptokat javasol az OpenAI – ne használd a régieket

Az új felülethez az OpenAI részletes tippeket is közzétett, amelyek segítenek a fejlesztőknek a modell képességeinek maximális kihasználásában.

Simon Willison·AI
Microsoft OpenMementos: 6-szoros tömörítést ígér a nyílt forráskódú adathalmaz
Modellek & LLM

Microsoft OpenMementos: 6-szoros tömörítést ígér a nyílt forráskódú adathalmaz

A nyílt forráskódú adathalmaz célja, hogy a hosszú érvelési láncokat kompakt formában rögzítse, ezzel támogatva a nagyméretű nyelvi modellek hatékony képzését és futtatását.

MarkTechPost·AI
GPT-5.5: 20 százalékkal magasabb ár az API-n, 86 százalékos hallucináció az OpenAI új modelljében
Modellek & LLM

GPT-5.5: 20 százalékkal magasabb ár az API-n, 86 százalékos hallucináció az OpenAI új modelljében

Az új modell 60 ponttal veri a Claude Opus 4.7 és a Gemini 3.1 Pro Preview riválisokat az Artificial Analysis Intelligence Indexen.

The Decoder·AI
A R1 után a DeepSeek V4 sem csökkenti az USA AI-előnyét
Modellek & LLM

A R1 után a DeepSeek V4 sem csökkenti az USA AI-előnyét

A DeepSeek új V4 modelljének előzetes verziói olcsóbbak a riválisoknál, de nem hoztak jelentős áttörést az amerikai AI-képességekkel szemben.

Bloomberg Technology·AI
Az OpenAI vezető tudósa szerint „meglepően lassú” volt az AI fejlődése
Modellek & LLM

Az OpenAI vezető tudósa szerint „meglepően lassú” volt az AI fejlődése

A mesterséges intelligencia fejlesztése a következő hónapokban felgyorsulhat. Rövid távon jelentős, középtávon rendkívül jelentős javulásokra számítanak.

The Decoder·AI
93 pontot ért el a GPT-5.5 a ZDNET tesztjén – figyelmen kívül hagyja az utasításokat
Modellek & LLM

93 pontot ért el a GPT-5.5 a ZDNET tesztjén – figyelmen kívül hagyja az utasításokat

A modell a ZDNET 10 körös tesztjén 100-ból 93 pontot szerzett, különösen írási, kódolási és érvelési feladatokban mutatott erős teljesítményt.

ZDNet AI·AI
ChatGPT Images 2.0: szöveges infografikákat és térképeket is generál az OpenAI új modellje
Modellek & LLM

ChatGPT Images 2.0: szöveges infografikákat és térképeket is generál az OpenAI új modellje

Az új verzió már képes hosszú szövegtömböket, felhasználói felületeket és térképeket is hibátlanul megjeleníteni, sőt, akár Sam Altmanról is készít képeket.

VentureBeat·AI
384 ezer token kimenettel érkezik a DeepSeek V4 Flash és V4 Pro
Modellek & LLM

384 ezer token kimenettel érkezik a DeepSeek V4 Flash és V4 Pro

A kínai startup a V4 Flash és V4 Pro modelleket a legerősebb nyílt forráskódú platformként pozicionálja, kihívást intézve az OpenAI és Anthropic felé.

Bloomberg Technology·AI
GPT-5.5: Az OpenAI új modellje intuitívabb és jobb kódot ír
Modellek & LLM

GPT-5.5: Az OpenAI új modellje intuitívabb és jobb kódot ír

A GPT-5.5 modell a legokosabb és legintuitívabb az OpenAI kínálatában, jelentősen felülmúlva elődjét, a GPT-5.4-et. Kiemelkedően teljesít olyan feladatokban, mint a kódírás és hibakeresés.

The Verge·AI
GPT-5.5-öt indít az OpenAI: önállóan old meg komplex feladatokat
Modellek & LLM

GPT-5.5-öt indít az OpenAI: önállóan old meg komplex feladatokat

A modell a gyártó készülő „szuperalkalmazásának” alapját képezi, amelyhez ügynök-AI képességeket is kapott.

Techmeme·AI
GPT-5.5: Az OpenAI új modellje erősít az ügynöki kódolásban és a kutatásban
Modellek & LLM

GPT-5.5: Az OpenAI új modellje erősít az ügynöki kódolásban és a kutatásban

Az OpenAI bemutatta a GPT-5.5-ös modellt, amely minimális irányítással is képes elvégezni a komplex feladatokat. Ez a képessége kulcsfontosságú lesz a cég készülő szuperalkalmazásához.

Techmeme·AI
Az Anthropic elismerte a Claude Code minőségromlását — három hibát javítottak
Modellek & LLM

Az Anthropic elismerte a Claude Code minőségromlását — három hibát javítottak

A minőségromlás három fő okra vezethető vissza: gondolkodási erőfeszítés csökkentése, memóriahiba és prompt-változás. A hibákat április 20-ig orvosolták.

Hacker News·AI
Az OpenAI bemutatja a GPT-5.5 modellt, amely képes komplex feladatokra, beleértve a kódolást, kutatást és dokumentumok létrehozását
Modellek & LLM

Az OpenAI bemutatja a GPT-5.5 modellt, amely képes komplex feladatokra, beleértve a kódolást, kutatást és dokumentumok létrehozását

Az új modell a kódírástól az adatelemzésig számos területen nyújt segítséget, és már a kiadás előtt közel 200 partner visszajelzéseit gyűjtötték össze.

OpenAI·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom