ÉlőUtoljára: 21 órájaMa: 0

Rovat · 11. oldal

Kutatás

AI research papers, arXiv publikációk, benchmarkok, tudományos áttörések

1159 cikk az archívumban

Bemutatták a SciConBench-et, az új tudományos teljesítménytesztet, amelyen az AI-ügynökök csak 33,7%-os pontosságot értek el
Kutatás

Bemutatták a SciConBench-et, az új tudományos teljesítménytesztet, amelyen az AI-ügynökök csak 33,7%-os pontosságot értek el

A legfejlettebb AI-ügynökök is csak 33,7%-os pontosságot értek el tudományos következtetések szintetizálásában, még ellenőrzött körülmények között is — derül ki egy új, 9.11K kérdéses benchmarkból.

ArXiv AI·AI
Megjelent a TouchThinker rendszer, amely egymilliós adathalmazzal segíti a robotok fizikai világ megértését
Kutatás

Megjelent a TouchThinker rendszer, amely egymilliós adathalmazzal segíti a robotok fizikai világ megértését

A TouchThinker-1M egymillió érintésalapú adatpontot tartalmaz 415 tárgyról és 8 forgatókönyvről, ami jelentősen bővíti a robotok fizikai világ megértését.

ArXiv AI·AI
A matematikai okoskodásban zárkózik fel a Sliding-Window Attention az új SWARR-ral
Kutatás

A matematikai okoskodásban zárkózik fel a Sliding-Window Attention az új SWARR-ral

A kutatók által kidolgozott SWARR (Sliding-Window Attention with Reinforced Adaptation for Math Reasoning) recept jelentősen csökkenti a Sliding-Window Attention és a hagyományos self-attention közötti különbséget a matematikai feladatok megoldásában.

ArXiv AI·AI
Új módszer csökkenti a videó tokenizálás memóriaigényét
Kutatás

Új módszer csökkenti a videó tokenizálás memóriaigényét

A Latent Inpainting Transformer (LIT) architektúra és a dinamikus tokenizálás kombinációja akár 2606.06158 azonosító alatt elérhető tanulmány szerint csökkenti a videófeldolgozás memóriaigényét.

Reddit ML·AI
Szegmentált jutalmazással javítják a hosszú szöveges válaszokat a kutatók
Kutatás

Szegmentált jutalmazással javítják a hosszú szöveges válaszokat a kutatók

A kutatók a SD-GRPO módszerrel 3 különböző feladaton, köztük a DOCCI-teszten értek el jobb eredményeket, mint a GRPO alapmodell.

ArXiv CV·AI
Új AI-módszer javítja a rákdiagnosztika pontosságát PET/CT-képeken
Kutatás

Új AI-módszer javítja a rákdiagnosztika pontosságát PET/CT-képeken

Az AutoPET-III tesztadatokon a kutatók által kidolgozott új modell szignifikánsan javította a daganatok felismerésének megbízhatóságát a korábbi determinisztikus modellekhez képest.

ArXiv CV·AI
Műholdképekből épít valósághű 3D környezeteket az ABot-Earth 0.5
Kutatás

Műholdképekből épít valósághű 3D környezeteket az ABot-Earth 0.5

Az ABot-Earth 0.5 egy új 3D keretrendszer, amely műholdképekből képes valósághű környezeteket szintézisálni, tíz perc alatt négyzetkilométerenként.

ArXiv CV·AI
Bengáli nyelven tesztelik a chatbotok érzelmi igazodását — új teljesítménytesztet vezetnek be
Kutatás

Bengáli nyelven tesztelik a chatbotok érzelmi igazodását — új teljesítménytesztet vezetnek be

A BenSyc az első olyan teljesítményteszt, amely a bengáli társadalmi kontextusban előforduló konverzációs szofiztikát vizsgálja. Az új mérce a chatbotok túlzott bókolását és a túlzott igazodást méri.

ArXiv NLP·AI
Új keretrendszer javítja a személyre szabott AI-szövegek méltányosságát
Kutatás

Új keretrendszer javítja a személyre szabott AI-szövegek méltányosságát

A Pareto-vezérelt tanárillesztési módszer csökkenti a demográfiai egyenlőtlenségeket a személyre szabott AI-szövegekben, és megőrzi a testreszabás hűségét, miközben a relevancia és az elköteleződés növekedését segíti elő.

ArXiv NLP·AI
Nagy nyelvi modellekkel szűrik a szintetikus táblázatokat — új módszer az adatvédelemre
Kutatás

Nagy nyelvi modellekkel szűrik a szintetikus táblázatokat — új módszer az adatvédelemre

A LLaMA és Gemini modelleket használó kutatók 451 érvényes próbát futtattak, hogy teszteljék a nagy nyelvi modellek (LLM) hatékonyságát a szintetikus táblázatok valósághűségének megállapításában.

ArXiv ML·AI
Az Isomorphic Labs új AI-motorja rejtett fehérjecélpontokat fedez fel
Kutatás

Az Isomorphic Labs új AI-motorja rejtett fehérjecélpontokat fedez fel

Az Isomorphic Labs új AI-motorja, az IsoDDE, képes olyan rejtett fehérjefelületeket azonosítani, amelyek normál körülmények között láthatatlanok, de specifikus molekulák kölcsönhatására nyílnak meg.

IEEE Spectrum AI·AI
AI Now: Adatközpont-boom erősíti a már hatalmon lévő cégeket
Kutatás

AI Now: Adatközpont-boom erősíti a már hatalmon lévő cégeket

Az AI Now Institute szerint a jelenlegi adatközpont-boom a már meglévő vállalati hatalom és profit további erősítéséről szól. A kutatás feltárja az Egyesült Államok adatközpont-iparágában uralkodó vállalati hatalmi viszonyokat.

AI Now Institute·AI
Korai tokenbizalommal mérhető az LLM-viták érvelési minősége
Kutatás

Korai tokenbizalommal mérhető az LLM-viták érvelési minősége

Egy új tanulmány szerint a korai tokenbizalom erősebb előrejelzője az érvelés minőségének, mint a teljes szövegre vonatkozó statisztikák. Az eredményeket az ASAP esszé-készleteken tesztelték.

ArXiv NLP·AI
AI-modell rekonstruálja az Alzheimer-kór teljes lefolyását rutin adatokból
Kutatás

AI-modell rekonstruálja az Alzheimer-kór teljes lefolyását rutin adatokból

Az új GNOVA AI-keretrendszer az Alzheimer-kór teljes lefolyását képes rekonstruálni és előrejelezni rutin klinikai adatokból, neuroimaging vagy biomarker adatok nélkül. A modell 1,727 beteg 10 éves adatait elemezte.

ArXiv AI·AI
Új módszerrel 85%-kal csökkenthető a nyelvi modellek memóriahasználata
Kutatás

Új módszerrel 85%-kal csökkenthető a nyelvi modellek memóriahasználata

A WikiText adathalmazon a módszer akár 21%-kal csökkentette a perplexitást, a memóriahasználatot pedig 85%-kal lehet vele csökkenteni.

ArXiv AI·AI
A nyelvi modelleknek is aludniuk kell — új kutatás szerint anterográd amnéziában szenvednek
Kutatás

A nyelvi modelleknek is aludniuk kell — új kutatás szerint anterográd amnéziában szenvednek

A nyelvi modellek a betanítás után nem tanulnak új információkat, ami anterográd amnéziához hasonlít — állítják a Google és a Cornell kutatói új tanulmányukban.

TheSequence·AI
Új módszer gyorsítja a diffúziós nyelvi modelleket — 98%-os javulás érhető el
Kutatás

Új módszer gyorsítja a diffúziós nyelvi modelleket — 98%-os javulás érhető el

A bicache nevű új eljárás 36,3-98,3%-kal növeli a diffúziós nyelvi modellek kiszolgálási sebességét, miközben a pontosság mindössze 0-1,8%-kal csökken.

ArXiv ML·AI
Adatvédő módon ismerik fel a csoportok érzelmeit a kutatók
Kutatás

Adatvédő módon ismerik fel a csoportok érzelmeit a kutatók

Kutatók két új keretrendszert mutattak be, amelyek kollektív audio-video jelek felhasználásával ismerik fel a csoportok érzelmi állapotát, csökkentve az egyéni megfigyelés kockázatát. A módszer a csoportos érzelemfelismerés területén új megközelítést jelent.

ArXiv CV·AI
Adatínségben hibáznak a szintetikus képeket generáló AI-k — új értékelési módszer
Kutatás

Adatínségben hibáznak a szintetikus képeket generáló AI-k — új értékelési módszer

Az adatínség és a privát adatok kezelése kihívást jelent a szintetikus képgeneráló AI-k számára. Új értékelési keretrendszer mutatja a különbségeket a VAE, GAN és DDPM modellek között.

ArXiv CV·AI
Generatív AI nem képes új felfedezésekre — állítja Richard Sutton
Kutatás

Generatív AI nem képes új felfedezésekre — állítja Richard Sutton

Richard Sutton, a SAIR Foundation kutatója szerint a felügyelt tanulással betanított generatív AI képtelen valódi újdonságokat felfedezni, csak utánzóra képes.

Hacker News·AI
Takarékosabbá tehető a GPT-4 betanítása: 14%-os energiamegtakarítás érhető el
Kutatás

Takarékosabbá tehető a GPT-4 betanítása: 14%-os energiamegtakarítás érhető el

A GPU-k órajelet és feszültséget dinamikusan szabályozó technikával akár 14%-kal csökkenthető a nagy nyelvi modellek, például a GPT-4 betanításához szükséges energia, miközben a számítási sebesség szinte változatlan marad.

IEEE Spectrum AI·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom