ÉlőUtoljára: 23 órájaMa: 0

Rovat · 14. oldal

Modellek & LLM

GPT, Claude, Gemini és más generatív AI modellek, agents, multimodális rendszerek

578 cikk az archívumban

Alibaba Qwen3.7-Max 35 órán át működik autonóm módban
Modellek & LLM

Alibaba Qwen3.7-Max 35 órán át működik autonóm módban

Az új modell képes volt önállóan optimalizálni egy figyelmi kernelt egy T-Head ZW-M890 PPU-val felszerelt szerveren, amelyet korábban sosem látott.

Anthropic·AI
Qwen 3.6 35B GGUF kvantizációkat adott ki a ByteShape NTP és MTP változatokban
Modellek & LLM

Qwen 3.6 35B GGUF kvantizációkat adott ki a ByteShape NTP és MTP változatokban

A Qwen 3.6 35B modell GGUF kvantizált verzióit adta ki a ByteShape standard NTP és MTP változatokban. A MTP modellek jobb perplexitást kínálnak azonos kvantizációs szinten, ami jobb minőséget jelenthet, különösen hosszabb kontextus esetén.

Reddit LocalLLaMA·AI
Hatperces zeneszámokat generál a Stable Audio 3.0 — nyílt súlyokkal érkezik
Modellek & LLM

Hatperces zeneszámokat generál a Stable Audio 3.0 — nyílt súlyokkal érkezik

Az új modell három változata nyílt súlyokkal érhető el, a Stability AI pedig jogi kártalanítást is kínál a vállalati ügyfeleknek a szerzői jogi aggodalmak elkerülése érdekében.

The Decoder·AI
Képzés nélkül jósol táblázatos adatokból a H2O.ai új tabH2O modellje
Modellek & LLM

Képzés nélkül jósol táblázatos adatokból a H2O.ai új tabH2O modellje

Az új rendszer in-context learning technológiát használ, kiküszöbölve a hagyományos gépi tanulási munkafolyamatokat, mint a feature engineering és az adatok tárolása.

TNW·AI
Perplexity Pro: 50%-os korlátcsökkenés
Modellek & LLM

Perplexity Pro: 50%-os korlátcsökkenés

Több felhasználó jelezte, hogy a Perplexity Pro fejlett AI-modellek használati korlátait drasztikusan csökkentette, miközben a használatuk nem emelkedett. A változásról a felhasználókat nem tájékoztatták előzetesen.

Perplexity·AI
31 nyelven szólal meg a Supertonic v3 – kevesebb olvasási hibával dolgozik
Modellek & LLM

31 nyelven szólal meg a Supertonic v3 – kevesebb olvasási hibával dolgozik

Az új, ONNX-alapú rendszer 99 millió paraméterrel működik, és a korábbi 5 nyelv helyett már 31 ISO nyelvkódot ismer, köztük a magyart is.

MarkTechPost·AI
Az IBM Granite R2 bemutatja: 97M paraméteres modell veri a 100M alatti riválisokat
Modellek & LLM

Az IBM Granite R2 bemutatja: 97M paraméteres modell veri a 100M alatti riválisokat

A 97 millió paraméteres kompakt modell 60,3 pontot ért el a MTEB Multilingual Retrieval teljesítményteszten, ezzel felülmúlva minden nyílt, 100 millió paraméter alatti riválisát.

Hugging Face·AI
API-n keresztül nyitja meg Uni-1.1 képmodelljét a Luma — ára és minősége az OpenAI-t és a Google-t is eléri
Modellek & LLM

API-n keresztül nyitja meg Uni-1.1 képmodelljét a Luma — ára és minősége az OpenAI-t és a Google-t is eléri

A REST felületen keresztül a fejlesztők szöveges parancsokkal generálhatnak és szerkeszthetnek képeket, akár kilenc referenciafotó felhasználásával.

The Decoder·AI
AntAngelMed: 103 milliárd paraméteres orvosi modell nyílt forráskóddal, 7-szeres hatékonysággal
Modellek & LLM

AntAngelMed: 103 milliárd paraméteres orvosi modell nyílt forráskóddal, 7-szeres hatékonysággal

Az új modell a Mixture-of-Experts (MoE) architektúrát használja 1/32-es aktiválási aránnyal, így futás közben mindössze 6,1 milliárd paraméter aktív.

MarkTechPost·AI
26 milliós paraméterű AI-modellt desztillált a Cactus Compute a Gemini 3.1-ből
Modellek & LLM

26 milliós paraméterű AI-modellt desztillált a Cactus Compute a Gemini 3.1-ből

A „Simple Attention Network” architektúrára épülő modell a Gemini 3.1 eszközhívási funkcióit képes utánozni, miközben a FunctionGemma-270m-et is felülmúlja.

Hacker News·AI
94 százalékkal csökkenti a betanítási költségeket a Baidu Ernie 5.1 modellje
Modellek & LLM

94 százalékkal csökkenti a betanítási költségeket a Baidu Ernie 5.1 modellje

A Baidu Ernie 5.1 modellje 94 százalékkal csökkenti a betanítási költségeket a hasonló modellekhez képest. A modell a Search Arena ranglistán május 9-én a 4. helyen végzett.

The Decoder·AI
NVIDIA Star Elastic: egyetlen modellben 30, 23 és 12 milliárd paraméteres változat
Modellek & LLM

NVIDIA Star Elastic: egyetlen modellben 30, 23 és 12 milliárd paraméteres változat

Az új megközelítés egyetlen ellenőrzőpontban tárolja a 30 milliárd, 23 milliárd és 12 milliárd paraméteres modelleket, így nincs szükség külön finomhangolásra.

MarkTechPost·AI
Google: AI Overviews
Modellek & LLM

Google: AI Overviews

A Google az AI Overviews funkción belül több külső hivatkozást jelenít meg a generált válaszokban. A változtatás a kiadók aggodalmaira reagál, akik a mesterséges intelligencia alapú keresés miatt csökkenő forgalmat tapasztalnak.

Ars Technica·AI
25%-kal gyorsítja az LLM-betanítást az Unsloth és az NVIDIA új közös fejlesztése
Modellek & LLM

25%-kal gyorsítja az LLM-betanítást az Unsloth és az NVIDIA új közös fejlesztése

Az optimalizációk az Unsloth már eleve 2-5-szörös gyorsításán felül további 25%-os sebességnövekedést hoznak, az eredmények pedig pontosságvesztés nélkül érhetők el.

Hacker News·AI
GPT-5 szintű érveléssel érkezik az OpenAI új hangmodellje, a GPT-Realtime-2
Modellek & LLM

GPT-5 szintű érveléssel érkezik az OpenAI új hangmodellje, a GPT-Realtime-2

Az új modellekkel az OpenAI célja, hogy a hangalapú interfészek ne csak válaszoljanak, hanem valós munkát is végezzenek: hallgassanak, érveljenek, fordítsanak, átírjanak és cselekedjenek.

Techmeme·AI
Háromszoros sebességnövekedést hozhat a Google Gemma 4 modelljeinek spekulatív dekódolása
Modellek & LLM

Háromszoros sebességnövekedést hozhat a Google Gemma 4 modelljeinek spekulatív dekódolása

A Multi-Token Prediction (MTP) technológia egy könnyűsúlyú modell segítségével tippel előre tokeneket, amelyeket a fő modell párhuzamosan ellenőriz, így kihasználva a számítási ciklusokat.

Ars Technica·AI
iOS 27: Saját AI-modellek választhatók lesznek az Apple Intelligence-ben
Modellek & LLM

iOS 27: Saját AI-modellek választhatók lesznek az Apple Intelligence-ben

Idén ősszel az iOS 27, iPadOS 27 és macOS 27 rendszereken a felhasználók saját preferenciáik szerint választhatnak külső AI-modellt a beépített funkciókhoz. A változás az Apple operációs rendszereinek következő frissítésével érkezik.

The Verge·AI
52,5%-kal kevesebb hallucinációt produkál az új GPT-5.5 Instant a ChatGPT-ben
Modellek & LLM

52,5%-kal kevesebb hallucinációt produkál az új GPT-5.5 Instant a ChatGPT-ben

Az új GPT-5.5 Instant modell 52,5%-kal kevesebb hallucinált állítást tartalmaz, mint elődje, és 37,3%-kal pontosabban válaszol a kihívást jelentő kérdésekre.

VentureBeat·AI
GPT-5.5 Instant: okosabb és személyre szabottabb válaszokat ígér az OpenAI
Modellek & LLM

GPT-5.5 Instant: okosabb és személyre szabottabb válaszokat ígér az OpenAI

Az új modell, amely a ChatGPT minden felhasználója számára elérhető, a korábbi verzióknál lényegesen jobb teljesítményt nyújt a ténybeli pontosság és a válaszok tömörsége terén.

OpenAI·AI
Az Inworld AI bemutatta a Realtime TTS-2-t: a modell 100 nyelven is megérti a hangulatot
Modellek & LLM

Az Inworld AI bemutatta a Realtime TTS-2-t: a modell 100 nyelven is megérti a hangulatot

Az új modell zárt hurkú rendszerként működik, így nemcsak a szöveget, hanem a beszélgetés teljes hanganyagát is elemzi, felismerve a felhasználó hangszínét, tempóját és érzelmi állapotát.

MarkTechPost·AI
52,5%-kal kevesebb hallucinációt ígér a ChatGPT új GPT-5.5 Instant modellje
Modellek & LLM

52,5%-kal kevesebb hallucinációt ígér a ChatGPT új GPT-5.5 Instant modellje

Az új modell jelentősen javítja a matematikai, tudományos és vizuális érvelési teljesítményteszt eredményeket, miközben a válaszok rövidebbek és lényegre törőbbek.

The Decoder·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom