ÉlőUtoljára: 20 órájaMa: 0

Rovat · 47. oldal

Kutatás

AI research papers, arXiv publikációk, benchmarkok, tudományos áttörések

1159 cikk az archívumban

A QIMMA kiszűri a hibákat az arab nyelvi LLM-benchmarkingból
Kutatás

A QIMMA kiszűri a hibákat az arab nyelvi LLM-benchmarkingból

Több mint 52 ezer mintát tartalmazó értékelési csomagot hozott létre a QIMMA, ezzel a meglévő arab nyelvi LLM-benchmarkingok hiányosságait orvosolja.

ArXiv NLP·AI
A Memento-Skills maga írja át a saját képességeit, nem kell betanítani
Kutatás

A Memento-Skills maga írja át a saját képességeit, nem kell betanítani

A több egyetem kutatói által fejlesztett Memento-Skills rendszer a GAIA teljesítményteszt során 13,7 százalékponttal javította a teszteredmények pontosságát egy statikus alapmodellhez képest.

VentureBeat·AI
Új AI-módszer javítja a klinikai diagnózist: figyelembe veszi a bizonytalanságot
Kutatás

Új AI-módszer javítja a klinikai diagnózist: figyelembe veszi a bizonytalanságot

A módszer egy tervező és egy diagnosztikai LLM-ügynökön keresztül kezeli a bizonytalanságot, képes a szekvenciális adatgyűjtést modellezni.

ArXiv AI·AI
Új teszt kerüli meg az LLM-ek korlátját a telekommunikációban
Kutatás

Új teszt kerüli meg az LLM-ek korlátját a telekommunikációban

A TelcoAgent-Bench nevű keretrendszer nem csupán a nyelvi megértést méri, hanem a strukturált hibaelhárítási folyamatokkal való összehangolást és a forgatókönyv-változatok stabilitását is értékeli.

ArXiv NLP·AI
Az AI chatbotok homogenizálják gondolkodásunkat, csökkentve a kollektív bölcsességet
Kutatás

Az AI chatbotok homogenizálják gondolkodásunkat, csökkentve a kollektív bölcsességet

Egy USC-tanulmány szerint a chatbotok egységesítik az írás stílusát és az érvelési stratégiákat — a kutatók több valós diverzitást sürgetnek a betanítási adatokban.

Hacker News·AI
Az OSGym 90%-kal olcsóbbá teszi az AI ügynökök képzését
Kutatás

Az OSGym 90%-kal olcsóbbá teszi az AI ügynökök képzését

A MIT, UIUC, CMU és UC Berkeley kutatói által fejlesztett OSGym keretrendszer egyidejűleg több mint ezer virtuális asztalt képes kezelni, naponta mindössze 23 centért.

MarkTechPost·AI
AI-jal gyorsítják a 5G hálózatokat, nincs szükség CSI-re
Kutatás

AI-jal gyorsítják a 5G hálózatokat, nincs szükség CSI-re

A kutatók a hagyományos pilot-alapú csatornabecslést felhasználói lokalizációs adatokkal váltották ki, jelentősen csökkentve a számítási terhelést.

ArXiv AI·AI
Az AI elengedheti a rádiós hálózatok legnagyobb terhét az ArXiv szerint
Kutatás

Az AI elengedheti a rádiós hálózatok legnagyobb terhét az ArXiv szerint

A kutatók mechanikusan állítható fém reflektortömbökkel kísérleteztek, melyekkel a jövő okos rádiókörnyezeteit forradalmasíthatják.

ArXiv AI·AI
Az amerikai hadsereg saját chatbotot fejleszt a harctéri feladatokhoz
Kutatás

Az amerikai hadsereg saját chatbotot fejleszt a harctéri feladatokhoz

Létezik már a Victor névre keresztelt prototípus, amelybe több mint 500 adatrepozitóriumot tápláltak be. A rendszer célja, hogy a katonák hasznos információkhoz jussanak.

Wired·AI
Az AI fejleszti az AI-t: új módszert talált a bizonytalanság mérésére
Kutatás

Az AI fejleszti az AI-t: új módszert talált a bizonytalanság mérésére

A mesterséges intelligencia által generált új UQ-módszerek akár 6,7%-os javulást hoztak a ROC-AUC mutatóban kilenc adathalmazon, felülmúlva a manuálisan tervezett alapmodelleket.

ArXiv NLP·AI
A TABQAWORLD a vizuális és szöveges adatokkal javítja a táblázatkezelést
Kutatás

A TABQAWORLD a vizuális és szöveges adatokkal javítja a táblázatkezelést

A TABQAWORLD nevű új keretrendszer dinamikusan vált a vizuális és szöveges adatok között, ezzel optimalizálva a többlépcsős táblázatkezelési feladatokat.

ArXiv AI·AI
Megtanulja a mesterséges intelligencia, hol melegszik a sütő: 14%-kal javult az IBM modellje
Kutatás

Megtanulja a mesterséges intelligencia, hol melegszik a sütő: 14%-kal javult az IBM modellje

Az ALTK-Evolve nevű, hosszú távú memóriarendszerrel felvértezett AI-ügynökök nem pusztán feljegyzéseket olvasnak újra, hanem az elveket sajátítják el a tapasztalatokból.

Hugging Face·AI
Új módszerrel becsülnék meg az LLM-ek hibaszázalékát
Kutatás

Új módszerrel becsülnék meg az LLM-ek hibaszázalékát

A módszer három különböző adatforrást kombinál, többek között emberi címkézésű kalibrációs adatkészleteket és LLM-alapú értékeléseket.

ArXiv NLP·AI
Hatmadár-elmélet: az AI-ügynökök nem önálló entitások
Kutatás

Hatmadár-elmélet: az AI-ügynökök nem önálló entitások

Az ArXiv AI-n közzétett tanulmány szerint az úgynevezett Six Birds Theory az AI-ügynököket makroszkopikus objektumként kezeli. A kutatók ezzel új szemléletet kínálnak az AI-ügynökök működésére.

ArXiv AI·AI
Az AI-ügynökök eszköztudása illúzió lehet egy új tanulmány szerint
Kutatás

Az AI-ügynökök eszköztudása illúzió lehet egy új tanulmány szerint

Korlátozott kísérletek félrevezető következtetésekhez vezethettek az AI-ügynökök eszköztudásával kapcsolatban. Az AI-ügynökök eszköztudása illúzió lehet.

ArXiv NLP·AI
A VIGIL valós időben vadássza le a kognitív torzításokat az AI-szövegekben
Kutatás

A VIGIL valós időben vadássza le a kognitív torzításokat az AI-szövegekben

A mesterséges intelligencia által generált tartalmak egyre nagyobb veszélyt jelentenek az online információk megbízhatóságára és a társadalmi diskurzusra, ezért fejlesztették ki a VIGIL-t, egy

ArXiv NLP·AI
Tíz alacsony erőforrású nyelven is hatékonyabb a sok példás ICL
Kutatás

Tíz alacsony erőforrású nyelven is hatékonyabb a sok példás ICL

A kutatók húsz, korábban kevésbé támogatott nyelven tesztelték a módszert, amely a nyelvi modellek fordítási képességét javítja.

ArXiv NLP·AI
Játékkal edzenéd magad LLM ellen? A szerepjáték növeli az AI-ellenállást
Kutatás

Játékkal edzenéd magad LLM ellen? A szerepjáték növeli az AI-ellenállást

A LLMimic nevű interaktív oktatóanyagban a felhasználók egy LLM szerepébe bújva sajátíthatják el a betanítási folyamat főbb lépéseit.

ArXiv NLP·AI
Az új neuro-szimbolikus architektúra 24%-kal javítja az LLM-ek pontosságát ARC-feladatokban
Kutatás

Az új neuro-szimbolikus architektúra 24%-kal javítja az LLM-ek pontosságát ARC-feladatokban

A rendszer a hagyományos, tisztán neurális hálózatok és a szigorúan szimbolikus rendszerek hiányosságait küszöböli ki, miközben az LLM-eket objektumreprezentációkkal egészíti ki.

ArXiv AI·AI
Az LLM mint bíró tanít be kisebb modelleket, címke nélkül
Kutatás

Az LLM mint bíró tanít be kisebb modelleket, címke nélkül

Az új RL-keretrendszerrel a kisebb nyelvi modellek képesek felülmúlni a hagyományos, címkézett adatokkal történő betanítást, különösen matematikai feladatoknál.

ArXiv NLP·AI
A XpertBench felrázza az LLM-tesztelést, 1346 feladattal méri a szakértelmet
Kutatás

A XpertBench felrázza az LLM-tesztelést, 1346 feladattal méri a szakértelmet

A 80 kategóriát átfogó adatbázist több mint ezer iparági és kutatói szakértő állította össze, ezzel garantálva a feladatok valósághűségét és relevanciáját.

ArXiv AI·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom