ÉlőUtoljára: 17 órájaMa: 0

Rovat · 51. oldal

Kutatás

AI research papers, arXiv publikációk, benchmarkok, tudományos áttörések

1159 cikk az archívumban

Az EVOM keretrendszer 90%-os pontossággal oldja meg az optimalizálási feladatokat
Kutatás

Az EVOM keretrendszer 90%-os pontossággal oldja meg az optimalizálási feladatokat

A kutatók szerint az EVOM keretrendszerrel való munka során a szabályozási feladatok megoldásához nincs szükség folyamatszintű felügyeletre.

ArXiv AI·AI
A biztonsági finomhangolás csökkenti az LLM-ek elmetulajdonítását, de nem rontja az empátiáját
Kutatás

A biztonsági finomhangolás csökkenti az LLM-ek elmetulajdonítását, de nem rontja az empátiáját

A kutatók kimutatták, hogy a biztonsági finomhangolás csökkenti az LLM-ek hajlamát, hogy elismerjék az állatok mentális állapotát

ArXiv NLP·AI
A Google-kutatók felfedezték, hogy az LLM-ek több személyiséget szimulálnak a kérdések megválaszolásához
Kutatás

A Google-kutatók felfedezték, hogy az LLM-ek több személyiséget szimulálnak a kérdések megválaszolásához

A Google-kutatók DeepSeek-R1 és QwQ-32B modelleken végzett vizsgálata kimutatta, hogy az LLM-ek komplex, többszereplős belső gondolkodást szimulálnak — ez különböző kognitív folyamatokat és perspektívákat tesz lehetővé egy modellen belül.

Import AI·AI
Az AI-projektek 65%-a munkabérre megy el
Kutatás

Az AI-projektek 65%-a munkabérre megy el

A Tshepo Tshabalala által végzett elemzés szerint a havi 34 750 dollárt is elérheti egy AI-projekt menedzser költsége nyolc hónapra.

AI for Newsroom·AI
Az OptiMer 15-35-ször kevesebb számítási kapacitást igényel, mint a hagyományos adatkeverés
Kutatás

Az OptiMer 15-35-ször kevesebb számítási kapacitást igényel, mint a hagyományos adatkeverés

Az OptiMer a Gemma 3 27B modellen végzett kísérletek során egyaránt felülmúlta a hagyományos adatkeverést és a modellátlagolást japán, kínai nyelveken és matematika, kódolás területeken.

ArXiv NLP·AI
A Microsoft és az NVIDIA együttműködése 92%-kal csökkenti a nukleáris engedélyezési folyamatot
Kutatás

A Microsoft és az NVIDIA együttműködése 92%-kal csökkenti a nukleáris engedélyezési folyamatot

Aalo Atomics évente becslés szerint 80 millió dollárt takarít meg a Microsoft és az NVIDIA együttműködésének köszönhetően.

Azure Blog·AI
A Microsoft bevezeti az „The Shift” podcastot, 8 epizóddal az agentic AI-ről
Kutatás

A Microsoft bevezeti az „The Shift” podcastot, 8 epizóddal az agentic AI-ről

A podcast első epizódja, „Are my agents hunting for data?”, holnap jelenik meg, Ronald Chang, Dipti Borkar, Josh Caplan és Cillian Mitchell részvételével.

Azure Blog·AI
Az Anthropic PBC megvalósította a valaha volt legnagyobb AI-kutatást
Kutatás

Az Anthropic PBC megvalósította a valaha volt legnagyobb AI-kutatást

Több mint 1000 résztvevővel készült el a kutatás, amelyben az emberek véleményét és tapasztalatait gyűjtötték össze az AI-ról.

Anthropic·AI
A ChatGPT és a Grok LLM-ek terveznek adatbázist vírusok és tengeri mérgek elleni ellenszerekhez
Kutatás

A ChatGPT és a Grok LLM-ek terveznek adatbázist vírusok és tengeri mérgek elleni ellenszerekhez

A ChatGPT LLM két AI-ügynököt használ a vírusok és tengeri mérgek elleni ellenszerek rangsorolására

ArXiv AI·AI
1500 videómintát tartalmaz az új SyriSign adathalmaz a szíriai arab jelnyelv fordításához
Kutatás

1500 videómintát tartalmaz az új SyriSign adathalmaz a szíriai arab jelnyelv fordításához

A SyriSign adathalmaz fejlesztésében 20 kutató vett részt, akik 6 hónapon keresztül dolgoztak a projektön

ArXiv NLP·AI
Az Emergence WebVoyager 95,9%-os egyetértést ért el az annotátorok között
Kutatás

Az Emergence WebVoyager 95,9%-os egyetértést ért el az annotátorok között

A kutatók a WebVoyager teljesítményteszt felülvizsgálatával fejlesztették ki az Emergence WebVoyagert

ArXiv AI·AI
Az LLM-ek háromszor olyan gyakran vetnek be nukleáris fegyvert, mint az emberek
Kutatás

Az LLM-ek háromszor olyan gyakran vetnek be nukleáris fegyvert, mint az emberek

A kutatók szerint az LLM-ek agresszivitása jelentősen változik: a Claude Sonnet 4 67%-os, a GPT-5.2 50%-os, míg a Gemini 3 Flash csak 33%-os győzelmi arányt ért el a szimulált nukleáris válságjátékokb

Import AI·AI
A nyelvi modellek emberi szemantikai ítéletekhez igazodnak a koncepció-képzésnek köszönhetően
Kutatás

A nyelvi modellek emberi szemantikai ítéletekhez igazodnak a koncepció-képzésnek köszönhetően

A Chen Shani és munkatársai által végzett kutatás szerint a koncepció-képzésnek köszönhetően a nyelvi modellek jobban igazodnak az emberi szemantikai ítéletekhez.

ArXiv NLP·AI
5 ingyenes finomhangolást kínál egy vállalat a visszajelzésekért cserébe
Kutatás

5 ingyenes finomhangolást kínál egy vállalat a visszajelzésekért cserébe

A vállalat a lokális és nyílt modelleket célozza meg az ajánlatával.

Reddit ML·AI
Indul a HAISM: az ember-AI szimbiózis mozgalom
Kutatás

Indul a HAISM: az ember-AI szimbiózis mozgalom

A HAISM mozgalom célja, hogy az embereket és az AI-t szimbiózisba hozza, és ezzel megakadályozza a félreértéseket.

LessWrong AI·AI
Az APEX-EM keretrendszer forradalmasítja az autonóm ügynökök tanulását
Kutatás

Az APEX-EM keretrendszer forradalmasítja az autonóm ügynökök tanulását

A kutatók szerint az APEX-EM keretrendszer segíthet az autonóm ügynökök tanulásának felgyorsításában, akár 3 kulcsfontosságú innovációval

ArXiv NLP·AI
Az AI-vége 1-4 év múlva érkezhet, éljük meg az utolsó éveket vidáman
Kutatás

Az AI-vége 1-4 év múlva érkezhet, éljük meg az utolsó éveket vidáman

NickyP, a LessWrong AI szerző szerint az emberiségnek mindössze 1-4 éve maradt, mielőtt az AI radikálisan átalakítja a világot.

LessWrong AI·AI
A YOLO csendben megbukik biztonságkritikus zárt körű osztályozásnál
Kutatás

A YOLO csendben megbukik biztonságkritikus zárt körű osztályozásnál

A modell 94–96%-os pontossággal azonosítja az ismert fajokat, de ismeretlen gombáknál tévesen osztályoz — ami mérgezési kockázatot jelent.

Reddit ML·AI
Hat Models, Négy Feladat: Az LLM Alapú Szövegannotáció Rejtett Tényezői
Kutatás

Hat Models, Négy Feladat: Az LLM Alapú Szövegannotáció Rejtett Tényezői

Lorca McLaren és munkatársai hat modellt teszteltek, és megállapították, hogy a folyamat választások kölcsönhatásai meghatározzák az eredményeket.

ArXiv NLP·AI
A FormalProofBench 33,5%-os pontosságot ért el a diplomamunka-szintű matematikai bizonyításokban
Kutatás

A FormalProofBench 33,5%-os pontosságot ért el a diplomamunka-szintű matematikai bizonyításokban

A Claude Opus 4.5 modell érte el a legjobb eredményt a FormalProofBench teszten

ArXiv AI·AI
Hat LLM modell került tesztelésre 15 ország adataival
Kutatás

Hat LLM modell került tesztelésre 15 ország adataival

A kutatók szerint a modell teljesítménye az érzelem típusától és a kulturális kontextustól függ.

ArXiv NLP·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom