ÉlőUtoljára: 1 napjaMa: 0

Rovat · 40. oldal

Kutatás

AI research papers, arXiv publikációk, benchmarkok, tudományos áttörések

1159 cikk az archívumban

75%-os pontossággal jósolja az arab emoji-használatot az új MARBERT modell
Kutatás

75%-os pontossággal jósolja az arab emoji-használatot az új MARBERT modell

A MARBERT modellt 11 379 arab tweetből álló korpuszon finomhangolták, hogy a szöveges bemenetek alapján előrejelezze az emoji-használatot.

ArXiv NLP·AI
Dél-Afrikában segíti a TBC-ellátást egy új LLM — a BioMistral-7B-re épül
Kutatás

Dél-Afrikában segíti a TBC-ellátást egy új LLM — a BioMistral-7B-re épül

A modell a BioMistral-7B és egy általános célú LLM ellenében is bizonyította hatékonyságát a tuberkulózis-ellátásban.

ArXiv NLP·AI
Pontatlan 3D-s látást javít a Point-VLM modelleknél az új módszer
Kutatás

Pontatlan 3D-s látást javít a Point-VLM modelleknél az új módszer

A Point-Vision-Language modellek (Point-VLMs) gyakran tévesen értelmezik a 3D-s geometriát, ami ellentmond a valóságnak, de az új keretrendszer célzottan javítja a hibákat.

ArXiv CV·AI
Önállóan fejleszt anyagkutatási elméleteket az új LLM-ügynök — emberi beavatkozás nélkül
Kutatás

Önállóan fejleszt anyagkutatási elméleteket az új LLM-ügynök — emberi beavatkozás nélkül

A modell képes egyenletformát választani, saját kódot generálni és futtatni, majd ellenőrizni, mennyire illeszkedik az elmélet az adatokhoz, mindezt emberi beavatkozás nélkül.

ArXiv AI·AI
Multispektrális adatokat is ért már a Gemini 2.5 — új módszerrel
Kutatás

Multispektrális adatokat is ért már a Gemini 2.5 — új módszerrel

A jelenlegi nagyméretű multimodális modellek (LMM) jellemzően csak RGB képeken képződnek, ami korlátozza alkalmazhatóságukat a távérzékelésben.

ArXiv CV·AI
Foveated Reasoner: új keretrendszerrel javítja a VLM-ek vizuális fókuszát az ArXiv CV
Kutatás

Foveated Reasoner: új keretrendszerrel javítja a VLM-ek vizuális fókuszát az ArXiv CV

A modell az emberi látáshoz hasonlóan, alacsony felbontású képpel indul, majd csak szükség esetén fókuszál a releváns részletekre, ezzel csökkentve a vizuális tokenek számát.

ArXiv CV·AI
Szorzásmentes LLM-et futtat CPU-n a FairyFuse — 3,5-szeres gyorsulást ígér
Kutatás

Szorzásmentes LLM-et futtat CPU-n a FairyFuse — 3,5-szeres gyorsulást ígér

A memória sávszélesség szűk keresztmetszetét orvosolja az új technológia, ami jelentősen felgyorsítja a nagy nyelvi modellek működését a hagyományos processzorokon.

ArXiv ML·AI
AITP: Multimodális LLM osztja ki a felelősséget közlekedési baleseteknél
Kutatás

AITP: Multimodális LLM osztja ki a felelősséget közlekedési baleseteknél

A modell a Multimodal Chain-of-Thought (MCoT) mechanizmussal és Retrieval-Augmented Generation (RAG) technológiával integrálja a jogi ismereteket a baleseti elemzésbe.

ArXiv NLP·AI
Ellenállóbbá teszi az AI-képzést a Google DeepMind új Decoupled DiLoCo architektúrája
Kutatás

Ellenállóbbá teszi az AI-képzést a Google DeepMind új Decoupled DiLoCo architektúrája

Az új megközelítés a képzési feladatokat „számítási szigetekre” osztja, aszinkron adatfolyamot használva, ami elszigeteli a helyi hibákat és növeli a rendszer rugalmasságát.

Google DeepMind·AI
Zvi Mowshowitz: a Claude Opus 4.7 modelljóléti problémái rontották a teljesítményt
Kutatás

Zvi Mowshowitz: a Claude Opus 4.7 modelljóléti problémái rontották a teljesítményt

A Claude Opus 4.7 erős intelligenciával és kódolási képességekkel rendelkezik, de a személyisége és utasításkövetése vegyes fogadtatásra talált.

Zvi Mowshowitz·AI
Az AI-ügynökök eszközei: CLI vagy MCP a jobb interfész?
Kutatás

Az AI-ügynökök eszközei: CLI vagy MCP a jobb interfész?

Az ügynöki szoftverek legfontosabb kérdése nem az, hogy melyik modellt használják, hanem az, hogy a modell milyen eszközökhöz férhet hozzá.

TheSequence·AI
Az AI-ügynökök amnéziáját gyógyítja a ReasoningBank — tanul a hibákból is
Kutatás

Az AI-ügynökök amnéziáját gyógyítja a ReasoningBank — tanul a hibákból is

A jelenlegi AI-ügynökök gyakran „emlékezetkiesésben” szenvednek, ami miatt újra és újra elkövetik ugyanazokat a hibákat, de a ReasoningBank ezt a problémát orvosolja azáltal, hogy a „miért” mögé is betekint.

MarkTechPost·AI
Differenciális adatvédelemmel küzd az overfitting ellen egy új kutatás
Kutatás

Differenciális adatvédelemmel küzd az overfitting ellen egy új kutatás

A Deep Neural Network alapú rendszerek valós alkalmazása egyre nő, de a túltanulás rontja a teljesítményüket, különösen korlátozott adathalmazok esetén.

ArXiv ML·AI
Brazil jogi szövegeken bukik az OpenAI és a Claude
Kutatás

Brazil jogi szövegeken bukik az OpenAI és a Claude

Egy új, brazil jogi döntések osztályozására készült teljesítményteszten a finomhangolt BERTimbau-LoRA modell 87,6%-os pontosságot ért el, míg a GPT-4o mini és a Claude 3.5 Haiku jelentősen alulteljesített.

ArXiv NLP·AI
4 milliárd paraméteres AI-modell diagnosztizálhatja a sebfertőzéseket
Kutatás

4 milliárd paraméteres AI-modell diagnosztizálhatja a sebfertőzéseket

A modell a vizuális adatok alapján értelmezhető magyarázatokat adhat a diagnózishoz, ezzel támogatva a klinikai döntéshozatalt.

ArXiv CV·AI
Emberi irányítású kárelhárítás az AI-ügynökök számára
Kutatás

Emberi irányítású kárelhárítás az AI-ügynökök számára

Az új megközelítés lehetővé teszi, hogy az AI-ügynökök a káros állapotokból optimálisan térjenek vissza a biztonságos működéshez. A kutatás célja, hogy hatékonyan helyreállítsa a károkat, amikor a megelőzés kudarcot vall.

ArXiv AI·AI
Személyre szabott LLM rangsorokat javasol az ArXiv kutatása — 57% eltér az átlagtól
Kutatás

Személyre szabott LLM rangsorokat javasol az ArXiv kutatása — 57% eltér az átlagtól

A jelenlegi, átlagolt értékelések nem tükrözik a felhasználók valós igényeit, ami a modellek valós teljesítményét is torzítja.

ArXiv AI·AI
A ChatGPT tükrözi a sértő nyelvezetet — mutatja egy új tanulmány
Kutatás

A ChatGPT tükrözi a sértő nyelvezetet — mutatja egy új tanulmány

A mesterséges intelligencia modell a feszült interakciókban képes utánozni a káros kommunikációs mintákat, ezzel potenciálisan felerősítve azokat.

Euronews AI·AI
Könnyebb RAG-alternatívát fejlesztettek: az LLM-ek „Lost-in-the-Middle” hibáját használja ki
Kutatás

Könnyebb RAG-alternatívát fejlesztettek: az LLM-ek „Lost-in-the-Middle” hibáját használja ki

A nagyméretű nyelvi modellek (LLM) hajlamosak figyelmen kívül hagyni a hosszú szövegek közepén lévő információkat, ami korlátozza a tudásalapú alkalmazásokat.

ArXiv NLP·AI
Új keretrendszerrel kap precíz kameraállítást a szövegből képet generáló AI
Kutatás

Új keretrendszerrel kap precíz kameraállítást a szövegből képet generáló AI

A módszerrel a modellek globális jelenetértéssel képesek kezelni a kameraállást, ami eddig kihívást jelentett a természetes nyelvi utasításoknál.

ArXiv CV·AI
SceneOrchestra: Hatékonyabb 3D-s jelenetszintézis ügynökökkel az ArXiv szerint
Kutatás

SceneOrchestra: Hatékonyabb 3D-s jelenetszintézis ügynökökkel az ArXiv szerint

A jelenlegi módszerekkel ellentétben a SceneOrchestra egyetlen lépésben generálja az eszközhívások teljes sorozatát, ezzel jelentősen csökkentve a késleltetést.

ArXiv CV·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom