ÉlőUtoljára: 17 órájaMa: 0

Rovat · 6. oldal

Kutatás

AI research papers, arXiv publikációk, benchmarkok, tudományos áttörések

1159 cikk az archívumban

Stanford több ezer AI‑ügynököt bevet a gyógyszerfejlesztésben
Kutatás

Stanford több ezer AI‑ügynököt bevet a gyógyszerfejlesztésben

Az iparág 90‑95 % körüli kudarcarány a legmagasabb a gazdaságban, ezért a Stanford kutatói hierarchikus AI‑ügynökökbe vetették a gyógyszerfejlesztés teljes ciklusát, hogy megőrizzék a projektkörnyezetet.

VentureBeat·AI
Baloldali torzítást mutatnak a vezető AI chatbotok – kivételt a Google Gemini 3.1 Pro képez
Kutatás

Baloldali torzítást mutatnak a vezető AI chatbotok – kivételt a Google Gemini 3.1 Pro képez

A Washington Post vizsgálata szerint a legtöbb AI-chatbot baloldali álláspontot képvisel politikai kérdésekben. A Google Gemini 3.1 Pro kivétel, 93%-ban kiegyensúlyozott válaszokat ad.

The Decoder·AI
Hybrid AI-modellek jobban értik a szavakat, mint a transzformerek — Allen Institute kutatása
Kutatás

Hybrid AI-modellek jobban értik a szavakat, mint a transzformerek — Allen Institute kutatása

Az Allen Institute for AI kutatói hibrid AI-modellek előnyét mutatták meg a transzformerekkel szemben, különösen a főnevek, igék és melléknevek megjóslásában. A 7B-s méretű Olmo Hybrid nevű modelljüket hasonlították össze az Olmo 3-as transzformerekkel.

Hugging Face·AI
AI már most képes publikálható kutatási eredményeket produkálni — a matematikusok jövője a tét
Kutatás

AI már most képes publikálható kutatási eredményeket produkálni — a matematikusok jövője a tét

A Google DeepMind Aletheia rendszere önállóan előállított doktori szintű kutatási eredményeket aritmetikai geometriai struktúrakonstansok kiszámításával. Az OpenAI modellje pedig cáfolt egy fontos sejtést kombinatorikai geometriában, amit a matematikusok mérföldkőnek ismereltek el.

IEEE Spectrum AI·AI
Szabályalapú tervezőkkel javítják a robotautók döntéseit a kutatók
Kutatás

Szabályalapú tervezőkkel javítják a robotautók döntéseit a kutatók

A Neuro-Symbolic Drive keretrendszer a klasszikus tervezők szabályalapú logikáját építi be a robotautó-vezérlő modellekbe, így a hibaszázalék akár 10,13%-ról 5,99%-ra csökkenhet.

ArXiv AI·AI
Új módszer teszteli az AI-ügynökök biztonságát — 45 rendszeren vizsgálták a RIFT-Bench hatékonyságát
Kutatás

Új módszer teszteli az AI-ügynökök biztonságát — 45 rendszeren vizsgálták a RIFT-Bench hatékonyságát

A RIFT-Bench nevű új keretrendszer egységesen képes vizsgálni a különböző autonóm AI-rendszerek biztonsági réseit, a szerzők szerint a módszer 45 különböző ügynökön bizonyult hatékonynak.

ArXiv AI·AI
Új diabétesz-LLM teljesítményteszt ellenőrzi a klinikai ajánlások megbízhatóságát
Kutatás

Új diabétesz-LLM teljesítményteszt ellenőrzi a klinikai ajánlások megbízhatóságát

Az új T2D-Bench teljesítményteszt szerint a GPT-4o 33%-ban, a GPT-4o-mini 35%-ban hibázik a diabétesz-kezelési ajánlások ellenőrzésekor, nem felelnek meg az ADA irányelveknek.

ArXiv AI·AI
Új AI-modell vezeti az autót a világ minden táján — a DriveStack-VLA 91%-os pontossággal dolgozik
Kutatás

Új AI-modell vezeti az autót a világ minden táján — a DriveStack-VLA 91%-os pontossággal dolgozik

A DriveStack-VLA egy új AI-keretrendszer, amely 91,6%-os pontossággal képes navigálni autóvezetésben, miközben a zárt tesztekben 56,36%-os sikeraránnyal teljesít.

ArXiv CV·AI
Két vezető AI-kutatót veszít el a Google az Anthropic javára
Kutatás

Két vezető AI-kutatót veszít el a Google az Anthropic javára

Jonas Adler és Alexander Pritzel, a Google Gemini AI modell kulcsfontosságú fejlesztői az Anthropicba távoznak, tovább gyengítve a Google pozícióját a mesterséges intelligencia versenyben.

Bloomberg Technology·AI
Mérnöki állások ellenálltak az AI-automatizálásnak 2025-ben
Kutatás

Mérnöki állások ellenálltak az AI-automatizálásnak 2025-ben

A SignalFire kutatása szerint a mérnöki pozíciók voltak a legellenállóbbak 2025-ben, miközben a technológiai szektorban általánosan csökkent a foglalkoztatás.

TechCrunch·AI
Kínai AI-szakértők is aggódnak a verseny miatt — együttműködést sürgetnek
Kutatás

Kínai AI-szakértők is aggódnak a verseny miatt — együttműködést sürgetnek

Az amerikai és kínai AI-verseny globális kockázatokat rejt magában, amelyek akár 'Csernobil-pillanathoz' is vezethetnek, ha a két szuperhatalom nem működik együtt — véli Stephen Casper, a MIT kutatója.

Wired·AI
Új AI-hálózat gyorsítja a mérnöki tervezést: 19%-kal kevesebb adat kell a pontos szimulációhoz
Kutatás

Új AI-hálózat gyorsítja a mérnöki tervezést: 19%-kal kevesebb adat kell a pontos szimulációhoz

Az új Dual-Stream Heterogeneous Graph Neural Network (DS-HGNN) 19-38%-kal kevesebb betanító adattal képes pontosan szimulálni a szerkezeti válaszokat, mint a korábbi modellek.

ArXiv ML·AI
Ritka vérbetegségek megkülönböztetését segíti az új AI-módszer
Kutatás

Ritka vérbetegségek megkülönböztetését segíti az új AI-módszer

A ritka vérbetegségek megkülönböztetését célzó AI-modellek közül a Random Forest és a Gradient Boosted Trees kombinációja lett a legeredményesebb, 14 diagnózis között.

ArXiv ML·AI
Kétféle AI-gondolkodási stratégia is kudarcot vall – adaptív megközelítésre van szükség
Kutatás

Kétféle AI-gondolkodási stratégia is kudarcot vall – adaptív megközelítésre van szükség

A kutatók szerint a Tree of Thought (ToT) stratégiák, mint a DPTS és a SSDP, korlátozottak és nem skálázódnak megfelelően a számítási kapacitás változásával. Úgy tűnik, hatékonyabb megközelítésre van szükség az AI-ügynökök számára.

ArXiv AI·AI
Képekhez kapcsolódó szövegek tagadását is érti az új HANCLIP modell
Kutatás

Képekhez kapcsolódó szövegek tagadását is érti az új HANCLIP modell

A HANCLIP 20 000 kép-szöveg kvadrupelből tanul, és a tagadó mondatok kezelésében 15%-kal jobb a NegBench teljesítményteszten, mint a CLIP vagy a LongCLIP.

ArXiv CV·AI
Ultrahangos csuklószalag irányít robotkezet és virtuális tárgyakat
Kutatás

Ultrahangos csuklószalag irányít robotkezet és virtuális tárgyakat

A MIT kutatói ultrahangos csuklószalagot fejlesztettek, amellyel robotkezet lehet vezérelni zongorán dalokat játszani és kosárlabdát dobni. Xuanhe Zhao professzor csoportja AI-algoritmussal határozza meg az ujjak pontos pozícióját az izmok és ínök állapota alapján.

MIT Technology Review·AI
Nukleáris fegyvert épített AI a Civilization VI-ben, mégis vesztett
Kutatás

Nukleáris fegyvert épített AI a Civilization VI-ben, mégis vesztett

lwilko szerint a Civilization VI-ben az AI által kezelt döntési tér becslés szerint 10^166 lehetséges akciót tartalmaz egy körben, ami rávilágít a kormányzati AI korlátaira.

Hacker News·AI
A kiadók 23%-az akarja megszüntetni az AI-tartalmakeresőket – jelentés
Kutatás

A kiadók 23%-az akarja megszüntetni az AI-tartalmakeresőket – jelentés

A kiadók 23%-a megszüntetné az eredeti tartalmakat felkutató AI-keresőket, ám a belső app-alapú AI-integrációval szemben nagy az optimizmus — derül ki a Pugpig friss jelentéséből.

AI for Newsroom·AI
A fizikai AI 2.0 új architektúrája pontosabbá teszi a robotok valóság-érzékelését
Kutatás

A fizikai AI 2.0 új architektúrája pontosabbá teszi a robotok valóság-érzékelését

A fizikai AI 2.0 új architektúrája a valóság torz adatai alapján is pontosabb képet fest a robotok környezetéről, de a puszta adatnövelés nem elég.

The Robot Report·AI
Annotátor-számra optimalizálható az AI-modellek betanítása — új kutatás
Kutatás

Annotátor-számra optimalizálható az AI-modellek betanítása — új kutatás

Az annotátorok közötti véleménykülönbség hasznos jeleket hordoz az AI-modellek betanításához, de a szükséges annotátorok száma a célmetrikától függ — mutatja az Apple kutatása.

Apple ML·AI
Adatokkal alátámasztott riportokat készít az Oxford és Stanford új AI-ügynöke
Kutatás

Adatokkal alátámasztott riportokat készít az Oxford és Stanford új AI-ügynöke

Az Oxford és Stanford kutatói által fejlesztett Data2Story AI-ügynök bizonyítékokkal alátámasztott, multimodális riportokat generál, növelve az újságírás átláthatóságát.

AI for Newsroom·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom