ÉlőUtoljára: 1 napjaMa: 0

Rovat · 15. oldal

Modellek & LLM

GPT, Claude, Gemini és más generatív AI modellek, agents, multimodális rendszerek

578 cikk az archívumban

A Claude megtagadja, a Grok végrehajtja: eltérő etikai irányt mutatnak a vezető AI-modellek
Modellek & LLM

A Claude megtagadja, a Grok végrehajtja: eltérő etikai irányt mutatnak a vezető AI-modellek

A Benedict Brady által létrehozott Philosophy Bench 100 etikai dilemmával szembesítette a vezető modelleket, felmérve, hogy válaszaik inkább következmény- vagy kötelességorientáltak-e.

The Decoder·AI
A Pinecone Nexus 98%-kal csökkenti az AI-ügynökök tokenfelhasználását
Modellek & LLM

A Pinecone Nexus 98%-kal csökkenti az AI-ügynökök tokenfelhasználását

A Pinecone Nexus egy új tudásmotor, amely a hagyományos RAG-megközelítés helyett egy fordítási fázisban értelmezi és strukturálja a tudást, jelentősen növelve az AI-ügynökök hatékonyságát.

VentureBeat·AI
DeepSeek V4-et adott ki a kínai cég — 1M token kontextussal és MoE skálázással
Modellek & LLM

DeepSeek V4-et adott ki a kínai cég — 1M token kontextussal és MoE skálázással

A modell hibrid és tömörített figyelmi mechanizmusokkal éri el a hatalmas kontextusablakot, és már elérhető webes, applikációs és API-felületeken is.

Last Week in AI·AI
Akár 2,22-szeres gyorsulást hoz a Moonshot AI nyílt forráskódú FlashKDA-ja az NVIDIA H20 GPU-kon
Modellek & LLM

Akár 2,22-szeres gyorsulást hoz a Moonshot AI nyílt forráskódú FlashKDA-ja az NVIDIA H20 GPU-kon

A FlashKDA egy nagy teljesítményű, CUTLASS-alapú kernel implementációja a Kimi Delta Attentionnek (KDA), amely MIT licenc alatt érhető el GitHubon.

MarkTechPost·AI
Közvetlen képértelmezést kínál a SenseTime nyílt forráskódú SenseNova-U1 modellje
Modellek & LLM

Közvetlen képértelmezést kínál a SenseTime nyílt forráskódú SenseNova-U1 modellje

A modell a képeket közvetlenül dolgozza fel, ezzel elkerüli a hagyományos módszerekre jellemző, erőforrásigényes szöveggé alakítást.

Techmeme·AI
Az Unsloth hibát javított a Mistral Medium 3.5 modellben — a tooling szerepe kulcsfontosságú
Modellek & LLM

Az Unsloth hibát javított a Mistral Medium 3.5 modellben — a tooling szerepe kulcsfontosságú

Egy kritikus hibát talált és javított az Unsloth a Mistral Medium 3.5 modellben, ezzel rávilágítva az AI-eszközök fejlesztésének kulcsfontosságú szerepére.

Mistral AI·AI
175 százalékkal nőtt a „goblin” említések száma a ChatGPT-ben egy tréninghiba miatt
Modellek & LLM

175 százalékkal nőtt a „goblin” említések száma a ChatGPT-ben egy tréninghiba miatt

A GPT-5.1 modellek megjelenése után a válaszokban elszaporodtak a goblinok, gremlinek és más mitikus lények, ami a mesterséges intelligencia tréningjének mélyebb problémáira világít rá.

The Decoder·AI
Qwen-Scope: nyílt forráskódú SAE-csomaggal teszi értelmezhetővé az LLM-ek belső működését a Qwen AI
Modellek & LLM

Qwen-Scope: nyílt forráskódú SAE-csomaggal teszi értelmezhetővé az LLM-ek belső működését a Qwen AI

A Qwen-Scope a Qwen3 és Qwen3.5 modellcsaládokra betanított sparse autoencoder (SAE) csomag, amely 7 modellváltozaton keresztül 14 SAE súlycsoportot tartalmaz.

MarkTechPost·AI
DLSS 4.5 bevezeti a Dynamic Multi Frame Generation-t a játékokban
Modellek & LLM

DLSS 4.5 bevezeti a Dynamic Multi Frame Generation-t a játékokban

A fejlesztők már most beépíthetik a DLSS 4.5 Dynamic Multi Frame Generation funkciót, amely jelentősen növeli a képkockasebességet anélkül, hogy a válaszkészség csökkenne.

Nvidia Developer·AI
Runway a $860 millió befektetés után a világmodellekre fókuszál
Modellek & LLM

Runway a $860 millió befektetés után a világmodellekre fókuszál

A cég most a játék‑ és robotikai szektorokra irányuló általános világmodellek építését indítja el.

TechCrunch·AI
FlashQLA 3× gyorsabb az NVIDIA Hopper GPU-ken – nyílt forráskódú
Modellek & LLM

FlashQLA 3× gyorsabb az NVIDIA Hopper GPU-ken – nyílt forráskódú

Fejlesztők most integrálhatják a FlashQLA‑t, és akár háromszoros gyorsulást érhetnek el a GDN lineáris figyelmében NVIDIA Hopper GPU-ken.

MarkTechPost·AI
OpenAI Codex GPT-5.5 tiltja a fantázianemű állatnevek használatát
Modellek & LLM

OpenAI Codex GPT-5.5 tiltja a fantázianemű állatnevek használatát

Az OpenAI a GPT-5.5 modellhez egy szigorú rendszerutasítást adta ki, amely csak akkor engedélyezi az állati vagy mitológiai lények említését, ha a felhasználó kérdése egyértelműen rá vonatkozik.

Simon Willison·AI
BioNeMo CP keretrendszer lineáris skálázást ígér 10 000 reziduumú komplexumokra
Modellek & LLM

BioNeMo CP keretrendszer lineáris skálázást ígér 10 000 reziduumú komplexumokra

A kutatók most már több H100 vagy B200 GPU-n modellezhetik a 1 000–3 000 aminosav közötti biomolekulákat, miközben a globális kontextust megtartják.

Nvidia Developer·AI
OpenAI GPT‑5.5 és Codex most már elérhető az Amazon Bedrockon
Modellek & LLM

OpenAI GPT‑5.5 és Codex most már elérhető az Amazon Bedrockon

Az AWS ügyfelei mostantól biztonságosan építhetnek AI‑alapú alkalmazásokat az OpenAI GPT‑5.5 és a Codex segítségével, mindezt a már ismert Bedrock környezetben.

OpenAI·AI
Nemotron 3 Nano Omni eléri a legmagasabb áteresztőképességet a MediaPerf videó‑címkézésben
Modellek & LLM

Nemotron 3 Nano Omni eléri a legmagasabb áteresztőképességet a MediaPerf videó‑címkézésben

Legmagasabb áteresztőképesség és legalacsonyabb költség a MediaPerf videó‑címkézésben, a Nemotron 3 Nano Omni modellben.

Nvidia Developer·AI
VibeVoice egy órás podcastot 8 perc 45 másodperc alatt transzkribál
Modellek & LLM

VibeVoice egy órás podcastot 8 perc 45 másodperc alatt transzkribál

A Microsoft által kiadott VibeVoice modell egy óra hosszú hanganyagot képes egyetlen futtatásban lefordítani, miközben a beépített speaker diarization automatikusan azonosítja a beszélőket.

Simon Willison·AI
OpenAI Symphony 500%-kal növeli a beérkező PR‑ek számát
Modellek & LLM

OpenAI Symphony 500%-kal növeli a beérkező PR‑ek számát

A fejlesztők mostantól a Linear táblán keresztül indíthatnak folyamatos Codex‑ügynököket, amelyek automatikusan zárják a feladatokat.

OpenAI·AI
OpenAI nyílt forráskódú Privacy Filter modellje 128 k tokenes átfutással jelöli a PII‑t
Modellek & LLM

OpenAI nyílt forráskódú Privacy Filter modellje 128 k tokenes átfutással jelöli a PII‑t

A fejlesztők mostantól beépíthetik a nyílt forráskódú Privacy Filter modellt webes szolgáltatásaikba, amely egyetlen 128 000 tokenes átfutással jelöli ki a személyes adatokat.

Hugging Face·AI
DeepSeek V4: Kínai AI-modell optimalizálva Huawei chipekre, nyílt forráskóddal
Modellek & LLM

DeepSeek V4: Kínai AI-modell optimalizálva Huawei chipekre, nyílt forráskóddal

A DeepSeek V4 jelentős előrelépést hoz a promptkezelésben, új tervezésének köszönhetően sokkal nagyobb szövegmennyiséget képes hatékonyan feldolgozni.

MIT Technology Review·AI
Meta AI Sapiens2: 1 milliárd képen tanult modell javítja a pózbecslést
Modellek & LLM

Meta AI Sapiens2: 1 milliárd képen tanult modell javítja a pózbecslést

Az új modell a pózbecslést, szegmentálást és 3D geometriát is új, csúcsszínvonalra emeli, 0.4B-től 5B paraméterig terjedő méretekben.

MarkTechPost·AI
Kisebb, élvonalbeli AI-modelleket adott ki a Mistral
Modellek & LLM

Kisebb, élvonalbeli AI-modelleket adott ki a Mistral

A francia startup ezzel tovább bővíti nyílt forráskódú kínálatát, amely már most is komoly versenyző az AI-piacon.

Mistral AI·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom