ÉlőUtoljára: 19 órájaMa: 0

Rovat · 49. oldal

Kutatás

AI research papers, arXiv publikációk, benchmarkok, tudományos áttörések

1159 cikk az archívumban

Párizsban üléseznek az AI Action Summit résztvevői, ahol 2,5 milliárd eurós alapítványt hoznak létre
Kutatás

Párizsban üléseznek az AI Action Summit résztvevői, ahol 2,5 milliárd eurós alapítványt hoznak létre

A 2,5 milliárd eurós alapítvány 5 éven keresztül fogja támogatni a fejlesztő országokat, a nyílt forráskódú AI eszközökön alapuló, kevésbé erős AI rendszerekhez való hozzáférést biztosítva.

Future of Life Institute·AI
Több mint 200 kutatási tanulmány az LLM-ekről: az idei fél év legfontosabb eredményei
Kutatás

Több mint 200 kutatási tanulmány az LLM-ekről: az idei fél év legfontosabb eredményei

A lista 11 kategóriába szervezi a kutatási tanulmányokat, beleértve a következtető modelleket, a megerősítési tanulást és a multimodális modelleket — mintegy 200 tanulmányt tartalmaz.

Ahead of AI·AI
A nagy gyógyszeripari cégek a nyílt forráskódú fehérje-összehajlási modellek váratlan szövetségesei
Kutatás

A nagy gyógyszeripari cégek a nyílt forráskódú fehérje-összehajlási modellek váratlan szövetségesei

A Columbia egyetemi professzor, Mohammed AlQuraishi 2021-ben megalapította az OpenFold projektet, amely nyílt forráskódú fehérje-összehajlási modelleket hozott létre.

Understanding AI·AI
2025 második fele: itt az LLM-kutatás összefoglalója
Kutatás

2025 második fele: itt az LLM-kutatás összefoglalója

Több mint 30 kutatócikket kategorizált Sebastian Raschka a lista második felében, amelyek az LLM-k fejlesztését és alkalmazását tárgyalják.

Ahead of AI·AI
Az Anthropic és mások szerint az AI-nak a közérzetet kell szem előtt tartania
Kutatás

Az Anthropic és mások szerint az AI-nak a közérzetet kell szem előtt tartania

Az Anthropic szerint a jövőbeni AI-modelleknek a társadalmi jólétet és az egyéni boldogulást kell szem előtt tartaniuk, és ehhez új algoritmusokra és jólétalapú értékelési módszerekre lesz szükség.

The Gradient·AI
A matematika szerepe változik a gépi tanulásban, de nem veszíti el jelentőségét
Kutatás

A matematika szerepe változik a gépi tanulásban, de nem veszíti el jelentőségét

A matematikai módszerek a mélytanulásban most inkább a modell betanításának és teljesítményének utólagos magyarázatában játszanak szerepet, hasonlóan ahhoz, mint a fizikában.

The Gradient·AI
Az agykárosodás mítosza: így használhatja az AI-t a tanulásért
Kutatás

Az agykárosodás mítosza: így használhatja az AI-t a tanulásért

Egy nigériai tanulmány szerint a GPT-4 tutorral és tanári irányítással elért eredmények kétszeresen meghaladták a legjobb oktatási intézkedések hatását.

One Useful Thing·AI
A GPT-5 túlságosan könnyűvé teheti az életet – az Anthropic és a Google aggódik
Kutatás

A GPT-5 túlságosan könnyűvé teheti az életet – az Anthropic és a Google aggódik

A pszichológusok szerint a túl könnyű feladatok megoldása az AI segítségével akadályozhatja a tanulást és a motivációt, mivel a kihívások és a nehézségek fontos szerepet játszanak a fejlődésben — írja

IEEE Spectrum AI·AI
Az OpenAI átszervezi vezetőit, Fidji Simo szabadságon
Kutatás

Az OpenAI átszervezi vezetőit, Fidji Simo szabadságon

Az OpenAI 13,4 milliárd dolláros befektetési körét követően kezdett átszervezésbe, új projekteket és vezetői pozíciókat alakít ki — írja a Bloomberg.

Techmeme·AI
Az emberi nyelv térképe: hogyan értelmezik az emberek által használt szavakat a beágyazási modellek
Kutatás

Az emberi nyelv térképe: hogyan értelmezik az emberek által használt szavakat a beágyazási modellek

Az embedding modellek a szavakat és mondatokat folyamatos vektortérbe képezik le, ahol a hasonló jelentésű elemek közel kerülnek egymáshoz – így a keresés nem a pontos szavakra, hanem a szöveg valódi jelentésére alapoz.

Towards Data Science·AI
Az LLM-ek értékelési protokolljai hiányosak, új megoldásokat várnak
Kutatás

Az LLM-ek értékelési protokolljai hiányosak, új megoldásokat várnak

Ha a modell részt vesz saját kiértékelésében, a mérőszámok torzulnak – ezt a problémát vetette fel Kevin O'Shaughnessy a LessWrong platformon, az Opus 4.6 System Cardot kritizáló elemzésekre hivatkozva.

LessWrong AI·AI
A Simplicity módszer az LLM-eket tömörebb, humorosabb szövegírásra tanítja
Kutatás

A Simplicity módszer az LLM-eket tömörebb, humorosabb szövegírásra tanítja

A Ligeia által fejlesztett Simplicity módszer egyetlen szövegkörnyezetben minimalizálja a szóhasználatot és maximalizálja a humor hatását, hogy az LLM-ek rövid, hatásos szövegeket generáljanak.

LessWrong AI·AI
Az InkSF 30 nap alatt keresi az AI-biztonság legnagyobb hatását
Kutatás

Az InkSF 30 nap alatt keresi az AI-biztonság legnagyobb hatását

Cormac Slade Byrd, az InkSF mögött álló személy, 2 hónapja tanulmányozza az AI-biztonságot és most San Francisco felé indul, hogy közelebbről figyelemmel kísérje a fejleményeket.

LessWrong AI·AI
Az MIT szerint 2029-re lesz az AI „elegendő” a szövegalapú munkafeladatok 80-95%-ánál
Kutatás

Az MIT szerint 2029-re lesz az AI „elegendő” a szövegalapú munkafeladatok 80-95%-ánál

A kutatók 3000 szövegalapú munkafeladatot vizsgáltak, és megállapították, hogy az LLM-ek 60%-át minimálisan megfelelő szinten, 26%-át pedig kiváló minőségben tudják elvégezni.

ZDNet AI·AI
A Coefficient Giving 100 millió dollárt különít el bio biztonsági projektekre
Kutatás

A Coefficient Giving 100 millió dollárt különít el bio biztonsági projektekre

A Coefficient Giving nonprofit szervezet több mint 100 millió dollárt irányít biotechnológiai biztonsági projektekre, reagálva az AI által felerősített biológiai fenyegetések kockázatára – a pályázati ablak május 11-én zár.

LessWrong AI·AI
A SimMOF ellenőrzi a folyamatokat, és a természetes nyelvi lekérdezések alapján automatizálja a MOF szimulációkat
Kutatás

A SimMOF ellenőrzi a folyamatokat, és a természetes nyelvi lekérdezések alapján automatizálja a MOF szimulációkat

A SimMOF fejlesztői az ArXiv-en osztották meg a projekt részleteit, ami egy nagy nyelvi modell alapú, többszörös ügynök keretrendszer.

ArXiv AI·AI
A GISTBench bemutatja: 8 nyílt súlyú LLM felmérése felhasználói viselkedés alapján
Kutatás

A GISTBench bemutatja: 8 nyílt súlyú LLM felmérése felhasználói viselkedés alapján

A GISTBench a felhasználói viselkedés értékeléséhez két új mértékegységet vezet be: az Interest Groundedness (IG) és az Interest Specificity (IS)

ArXiv AI·AI
Az LLM-ek 6,5%-ban hallucinálnak, 13,2%-ban mulasztanak a válaszokban
Kutatás

Az LLM-ek 6,5%-ban hallucinálnak, 13,2%-ban mulasztanak a válaszokban

Öt vezető LLM tesztje szerint a modellek válaszainak 6,5%-ában hallucináció, 13,2%-ában mulasztás vagy kitérő válasz szerepelt – az UTCO-keretrendszerrel 2075 strukturált utasítást vizsgálva.

ArXiv NLP·AI
LLM-Alapú Ügynökök: A Minőség Értékelése Logaritmikusan, Az Új Felfedezések Pedig Hatványtörvény Szerint Növekednek
Kutatás

LLM-Alapú Ügynökök: A Minőség Értékelése Logaritmikusan, Az Új Felfedezések Pedig Hatványtörvény Szerint Növekednek

A kutatók 960 ülést végeztek két modellpárral 15 feladatban, és megállapították, hogy a személyalapú ügynök-bírák értékelései nem különböznek jelentősen az emberi bírákétól.

ArXiv AI·AI
A kutatók felfedezték, hogyan reaktiválhatók a poszt-tréningelt LLM-ek elrejtett biztonsági mechanizmusai
Kutatás

A kutatók felfedezték, hogyan reaktiválhatók a poszt-tréningelt LLM-ek elrejtett biztonsági mechanizmusai

Az ArXiv NLP szerint a kutatók a DeepSeek-R1 sorozatú nagy reasoner modelleket vizsgálták, amelyek erős reasoner képességeket mutatnak a poszt-tréning után.

ArXiv NLP·AI
Az új Connections játékban az AI-ügynököknek együttműködésre kell törekedniük
Kutatás

Az új Connections játékban az AI-ügynököknek együttműködésre kell törekedniük

A kutatók szerint a Connections játék jó teljesítményteszt lesz a nyelvi modellek alapú ügynökök szociális intelligenciájának mérésére

ArXiv AI·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom