Archívum
Április
2026
50 cikk a hónapban
- Modellek & LLM
Melyik modell nyer: az emberek preferenciája előrejelezhető
Chip Huyen
- Modellek & LLM
Az új Claude Code kiegészítő 75%-kal csökkenti a tokenek számát
Hacker News
- Modellek & LLM
Az AI nem szereti a Lispet, és ez szomorú
Hacker News
- Modellek & LLM
Hétszer gyorsabban nő az AI-chatbot forgalma, mint a közösségi médiáé
The Decoder
- Modellek & LLM
Az AutoAgent forradalmasítja az ügynökfejlesztést: egy éjszaka alatt a legjobb eredményt érte el
MarkTechPost
- Modellek & LLM
A Qwen csapata 10 ezer tokenes gondolkodási láncokat ért el új algoritmussal
The Decoder
- Modellek & LLM
A buddhista szemlélet az AI-ről: figyelem és szabadság a jövőnkben
Future of Life Institute
- Modellek & LLM
Az Arcee AI 400 milliárd paraméteres modelljével támadja az amerikai piacot
Interconnects
- Modellek & LLM
Az AI valóban változtatja a programozás szakmáját, de nem teszi feleslegessé a fejlesztőket
Understanding AI
- Modellek & LLM
Az Anthropic és az OpenAI is alkalmazza: így javítja az LLM-ek pontosságát az inference-idő skálázás
Ahead of AI
- Modellek & LLM
A Raspberry Pi 5 8GB-os verziója is képes futtatni a Gemma 4 e4b modellt
Reddit LocalLLaMA
- Modellek & LLM
Az LLM-ek sokféle maszkot viselnek, de a személyiségük nem mindig egyezik
Understanding AI
- Modellek & LLM
Simon Willison feltárja az LLM-szolgáltatók HTTP-API-jait
Simon Willison
- Modellek & LLM
Az OpenAI és az Anthropic 2026-os bevételi célt is eléri
Understanding AI
- Modellek & LLM
Mamba: az állapottere-modell, amely legyőzheti a transformereket
The Gradient
- Modellek & LLM
Az Olmo Hybrid modell 2-szer hatékonyabban tanul, mint az Olmo 3
Interconnects
- Modellek & LLM
A DeepSeek V3.2 modell 20%-kal jobb teljesítményt nyújt, mint az elődje
Ahead of AI
- Modellek & LLM
Az OpenAI modellje már képes valódi, gazdaságilag releváns munkát végezni
One Useful Thing
- Modellek & LLM
Az LLM-ek jól programoznak, de játszani nem tudnak – miért?
IEEE Spectrum AI
- Modellek & LLM
A Google Perch 2.0 modellje madárdalokról tanulva felismeri a bálnahangokat
IEEE Spectrum AI
- Modellek & LLM
Az Anthropic felfedezte a „működő érzelmeket” a Claude modellben, amely befolyásolja a viselkedését
The Decoder
- Modellek & LLM
A GPT-5 már most veri a GPT-4-et, de hogyan?
One Useful Thing
- Modellek & LLM
Az Nvidia kiadta a Gemma 4 modellt, amely 31 ezermillió paraméterrel dolgozik
Nvidia Developer
- Modellek & LLM
A DenseNet 4-szer kevesebb paramétert használ, mint a hagyományos CNN
Towards Data Science
- Modellek & LLM
Bio-inspirált memóriakerettel 85%-kal javítható az LLM-ek érvelési képessége
ArXiv NLP
- Modellek & LLM
A Claude Opus 4.5 hosszú gondolkodási lánccal 99%-os pontosságot ér el aritmetikai feladatokon
LessWrong AI
- Modellek & LLM
A számítógépes modellek viselkedését is alakítja az emberi érzelem
ArXiv AI
- Modellek & LLM
Az LLaMA aktivációs rotációval csökkenti a kvantálás hatását
Reddit LocalLLaMA
- Modellek & LLM
A Photoroom 24 óra alatt kiképzett egy szövegből képet generáló modellt
Hugging Face
- Modellek & LLM
Az Oracle OCI Generative AI Cohere Command A Vision és Command A Reasoning modelleket adja hozzá
Cohere
- Modellek & LLM
A Qwen 3.6-Plus 1 millió kontextusablakot kezel alapértelmezettként
Reddit LocalLLaMA
- Modellek & LLM
A Google Gemma 4 modellje már telefonon is fut
Reddit LocalLLaMA
- Modellek & LLM
Az Anthropic teszteli a saját Conway ügynökét, ami állandóan működik
Anthropic
- Modellek & LLM
Az Anthropic modellje 171 érzelmi fogalmat tud felismerni
Anthropic
- Modellek & LLM
NVIDIA Model Optimizer: 60 millió FLOP-os modell Optimalizálása FastNAS Pruninggal
MarkTechPost
- Modellek & LLM
Az MSA-Thinker 30 százalékkal jobb multimodális hangulatanalízist nyújt
ArXiv NLP
- Modellek & LLM
Az OpenAI és a Claude modelljei novemberben átléptek egy küszöböt, már majdnem mindig működnek
Simon Willison
- Modellek & LLM
Nagy nyelvi modellek képtelenek felmérni saját feladatuk időtartamát
ArXiv NLP
- Modellek & LLM
A Gemini 3 Deep Think 48,4%-os eredményt ért el a Humanity’s Last Exam teljesítményteszten
Google DeepMind
- Modellek & LLM
A Google Gemini 3.1 Pro 77,1%-os eredményt ért el az ARC-AGI-2 teljesítményteszten
Google DeepMind
- Modellek & LLM
Az SPORE klaszterezési algoritmus forradalmasítja az adatfeldolgozást
Reddit ML
- Modellek & LLM
A Dynin-Omni 19 multimodális tesztet teljesít
ArXiv NLP
- Modellek & LLM
A Meta Avocado modellje májusról későbbre csúszik
Meta AI
- Modellek & LLM
Az Arcee AI kiadja a Trinity Large Thinkinget, egy 400 milliárd paraméteres nyílt forráskódú modellt
MarkTechPost
- Modellek & LLM
A GPT modell 4 szakaszban bukik meg az aritmetikai feladatokon
ArXiv NLP
- Modellek & LLM
A Hugging Face kiadta a TRL v1.0-t, 75-nél több módszert tartalmaz
Reddit LocalLLaMA
- Modellek & LLM
A Meta Avocado modellje 9 milliárd paramétert tartalmaz, de nem nyílt forráskódú
Meta AI
- Modellek & LLM
A GPT-5.2 sem tud elszámolni ötülig: a megbízható LLM-ek határai
Hacker News
- Modellek & LLM
A Google Gemma 4 modellje 31 milliárd paraméterrel érte el a harmadik helyet az Arena AI ranglistán
Simon Willison
- Modellek & LLM
Google Gemma 4 modellje Apache 2.0 licenc alatt érkezik, könnyebben integrálható
VentureBeat