ÉlőUtoljára: 18 órájaMa: 0

Rovat · 50. oldal

Kutatás

AI research papers, arXiv publikációk, benchmarkok, tudományos áttörések

1159 cikk az archívumban

Az OpenTools 6-22%-os teljesítménynövekedést ér el a downstream feladatokban
Kutatás

Az OpenTools 6-22%-os teljesítménynövekedést ér el a downstream feladatokban

A kutatók az OpenTools projektet egy nyilvános webdemón keresztül tesztelték, ahol a felhasználók meghatározott ügynököket és eszközöket futtathatnak és teszteseteket adhatnak hozzá.

ArXiv AI·AI
A hibrid determinisztikus-LLM megközelítés 99%-os pontosságot ér el az információkivonásban
Kutatás

A hibrid determinisztikus-LLM megközelítés 99%-os pontosságot ér el az információkivonásban

A kutatás során három 12-14B LLM modellt használtak, köztük a Gemma 3, Phi 4 és Qwen 2.5 modelleket, amelyeket helyi számítógépen futtattak GPU nélkül.

ArXiv NLP·AI
A Stanford egyetem ingyenes transzformátor kurzust indít holnap
Kutatás

A Stanford egyetem ingyenes transzformátor kurzust indít holnap

A kurzus az összes érdeklődő számára nyitott, korlátozás nélkül.

Reddit LocalLLaMA·AI
Az LLM-ek megbízhatóak a kvalitatív kutatásokban, de az értékelésük még kérdéses
Kutatás

Az LLM-ek megbízhatóak a kvalitatív kutatásokban, de az értékelésük még kérdéses

Az LLM-ek értékelésére egyebek között az AWS Bedrock LLM-jét használták a kutatók.

ArXiv NLP·AI
A ClauseCompose dekóder 95,7%-os pontosságot ér el ismeretlen szándékpárokon
Kutatás

A ClauseCompose dekóder 95,7%-os pontosságot ér el ismeretlen szándékpárokon

A ClauseCompose dekóder egy könnyen tanítható modell, amely csak egyes szándékokon való betanítást igényel.

ArXiv NLP·AI
Az AI Safety három módja, hogy elvonja a figyelmet
Kutatás

Az AI Safety három módja, hogy elvonja a figyelmet

A szerző szerint a Prosaic Capture veszélye, hogy az AI safety szakemberek figyelme a termékbiztonsági munkára összpontosul, és elvonja a figyelmet a spekulatívabb kérdésekről.

LessWrong AI·AI
A Midjourney képgenerátora szép képeket készít, de nem követi az utasításokat
Kutatás

A Midjourney képgenerátora szép képeket készít, de nem követi az utasításokat

A Midjourney képgenerátorának pontos utasításokat követő képességének hiányára a Tech Xplore oldalán megjelent tanulmány hívja fel a figyelmet

Midjourney·AI
A Holocaust oral history elemzésében 107,305 megnyilatkozásra támaszkodnak
Kutatás

A Holocaust oral history elemzésében 107,305 megnyilatkozásra támaszkodnak

A kutatás az arXiv NLP-n jelent meg, és a T5-alapú érzelem-osztályozót használja az egyetértési stratumok közötti érzelmi eloszlások összehasonlítására.

ArXiv NLP·AI
Az OpenAI modelljei 4 hónap alatt duplázódnak, a szakértők 2028-ra várják az Automated Coder megjelenését
Kutatás

Az OpenAI modelljei 4 hónap alatt duplázódnak, a szakértők 2028-ra várják az Automated Coder megjelenését

A Claude Code 9 hónap alatt több mint 2,5 milliárd dolláros árbevételt ért el, az Anthropic pedig továbbra is 10-szeresére növeli az éves árbevételét.

LessWrong AI·AI
Federált ellenálló tanulás: az új módszer lehet a jövője a gépi tanulásnak
Kutatás

Federált ellenálló tanulás: az új módszer lehet a jövője a gépi tanulásnak

Több mint 2 tanulmány idézi a federált tanulás alkalmazását az egészségügyben

Reddit ML·AI
Nincs egyetlen szent könyv a gépi tanulásban
Kutatás

Nincs egyetlen szent könyv a gépi tanulásban

A Reddit-fórumon több mint 150 hozzászólás érkezett a gépi tanulás tankönyveiről szóló kérdésre.

Reddit ML·AI
Az OpenAI bejelenti a Comprehensive Superhuman Intelligence-t, ami 72 órán belül átalakítja a Föld felszínét
Kutatás

Az OpenAI bejelenti a Comprehensive Superhuman Intelligence-t, ami 72 órán belül átalakítja a Föld felszínét

A cég szerint a CSI 13 perc alatt áttervezte az egész inference stackjüket, és megoldott több, korábban megoldhatatlan anyagtudományi problémát.

LessWrong AI·AI
Az ArXiv új tanulmánya kategorikus keretet ad az AGI-architektúrák összehasonlítására
Kutatás

Az ArXiv új tanulmánya kategorikus keretet ad az AGI-architektúrák összehasonlítására

A tanulmány szerzői, Pablo de los Riscos, Fernando J. Corbacho és Michael A. szerint az új keretrendszer lehetővé teszi az RL, Universal AI és Active Inference architektúrák összehasonlítását.

ArXiv AI·AI
A ChartDiff 8541 chartpárt tartalmaz, ami segíthet a több diagramos érvelésben
Kutatás

A ChartDiff 8541 chartpárt tartalmaz, ami segíthet a több diagramos érvelésben

Az ArXiv AI szerint a ChartDiff segíthet a jelenlegi látás-nyelv modellek fejlesztésében, amelyeknek a több diagramos érvelésben való teljesítménye továbbra is kihívást jelent.

ArXiv AI·AI
Nvidia új keretrendszere: agentic scaffolding nélkül az AI-modellek megbuknak a robotvezérlésben
Kutatás

Nvidia új keretrendszere: agentic scaffolding nélkül az AI-modellek megbuknak a robotvezérlésben

A CaP-Agent0 rendszer, amely egy vizuális különbségmodullal, automatikusan generált függvénykönyvtárral és párhuzamos kódkészítéssel működik, emberi szintű teljesítményt ért el négy feladatból hétben.

The Decoder·AI
Kvantum modellekben a klasszikus adatokat 5 lépésben dolgozzák fel
Kutatás

Kvantum modellekben a klasszikus adatokat 5 lépésben dolgozzák fel

A kutatók szerint a klasszikus adatok kvantum modellekbe történő bevitelének legnagyobb kihívása az adatok hatékony kvantum állapotba történő átalakítása.

Towards Data Science·AI
Az OpenAI modellje 20%-kal pontosabban generál hipotéziseket a CrossTrace adathalmazzal
Kutatás

Az OpenAI modellje 20%-kal pontosabban generál hipotéziseket a CrossTrace adathalmazzal

A CrossTrace adathalmaz 1389 darab, tudományosan megalapozott okoskodási nyomot tartalmaz, amelyek három különböző területen oszlanak meg: biomedicina, AI/ML és többterületű munka.

ArXiv NLP·AI
A Mimosa Framework 43,1%-os sikerarányt ér el a ScienceAgentBench teszten
Kutatás

A Mimosa Framework 43,1%-os sikerarányt ér el a ScienceAgentBench teszten

A Mimosa Framework nyílt forráskódú, az Apache License 2.0 alatt érhető el.

ArXiv AI·AI
Az OpenAI modelljei 30%-kal pontosabban becslik a bizonytalanságot az új TAC módszerrel
Kutatás

Az OpenAI modelljei 30%-kal pontosabban becslik a bizonytalanságot az új TAC módszerrel

A TAC módszer a nyílt forráskódú és kevés adatos felügyelet mellett is képes jól kalibrált bizonytalansági becsléseket adni.

ArXiv AI·AI
A Google AI-vezér szerint továbbra is érdemes megtanulni programozni
Kutatás

A Google AI-vezér szerint továbbra is érdemes megtanulni programozni

Jeff Dean, a Google AI-részlegének vezetője szerint a programozás továbbra is alapvető készség marad — még ha az AI-rendszerek egyre többet is átvesznek a rutinfeladatokból.

The Batch·AI
A WAM modell 12 százalékponttal javítja a viselkedési klónozás sikerét
Kutatás

A WAM modell 12 százalékponttal javítja a viselkedési klónozás sikerét

A WAM modell a CALVIN teljesítményteszt 8 manipulációs feladatán tesztelték, ahol a DreamerV2 és DiWA alapmodellhez képest javította a viselkedési klónozás sikerét.

ArXiv AI·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom