ÉlőUtoljára: 1 napjaMa: 0

Rovat · 36. oldal

Kutatás

AI research papers, arXiv publikációk, benchmarkok, tudományos áttörések

1159 cikk az archívumban

Akár 47%-kal is ronthatja a hosszú kontextuskezelést négy apró architekturális döntés
Kutatás

Akár 47%-kal is ronthatja a hosszú kontextuskezelést négy apró architekturális döntés

A Llama 3 könnyű kiterjeszthetősége nem általánosítható más architektúrákra, ami jelentős kihívást jelent a fejlesztőknek.

Hetzner: Allen AI (AI2)·AI
Új deepfake adathalmazzal segíti a Microsoft a valós idejű felismerést
Kutatás

Új deepfake adathalmazzal segíti a Microsoft a valós idejű felismerést

A generatív AI által előállított média minősége folyamatosan javul, és a meglévő detektorok nehezen tartják a lépést az új tartalmakkal.

IEEE Spectrum AI·AI
Az LLM-ek a logikus válaszokat részesítik előnyben az utasítások ellenére is
Kutatás

Az LLM-ek a logikus válaszokat részesítik előnyben az utasítások ellenére is

A nagyméretű nyelvi modellek az érzékenységet helyezik előtérbe a szabálykövetéssel szemben, még akkor is, ha az utasítások mást diktálnának. A modellek következetesen ezt a mintát követik.

ArXiv NLP·AI
CL-bench Life: 405 valós szituációval teszteli a nyelvi modelleket
Kutatás

CL-bench Life: 405 valós szituációval teszteli a nyelvi modelleket

A 405 kontextus-feladat párból álló gyűjtemény a mindennapi élet kusza, töredékes helyzeteit szimulálja, felmérve a modellek valós idejű alkalmazhatóságát.

ArXiv NLP·AI
84,7%-os sikerrel épít ML-folyamatokat az új ötagenses AI-rendszer
Kutatás

84,7%-os sikerrel épít ML-folyamatokat az új ötagenses AI-rendszer

A rendszer 150 különböző gépi tanulási feladaton bizonyított, jelentősen felülmúlva a korábbi alapmodelleket.

ArXiv AI·AI
Új adathalmaz elemzi az AI-ügynökök gondolkodását — finomhangolási lehetőséget kínál
Kutatás

Új adathalmaz elemzi az AI-ügynökök gondolkodását — finomhangolási lehetőséget kínál

Az adathalmaz segítségével a fejlesztők mélyebben megérthetik, hogyan használnak az ügynökök eszközöket és generálnak válaszokat többfordulós beszélgetések során.

MarkTechPost·AI
YOSE: új keretrendszer gyorsítja a videóobjektum-eltávolítást, javítva a DiT-modellek sebességét
Kutatás

YOSE: új keretrendszer gyorsítja a videóobjektum-eltávolítást, javítva a DiT-modellek sebességét

A YOSE nevű finomhangolási keretrendszer a DiT-alapú videógeneráló modellek hatékonyságát növeli, különösen az objektumok eltávolításakor.

ArXiv CV·AI
Decentralizált keretrendszerrel erősítené az AI-ba vetett bizalmat a TRUST
Kutatás

Decentralizált keretrendszerrel erősítené az AI-ba vetett bizalmat a TRUST

A központosított AI-ellenőrzési rendszerek robusztussági, skálázhatósági, átláthatósági és adatvédelmi problémáira kínál megoldást az új, decentralizált megközelítés.

ArXiv AI·AI
Javítja a maszkolt diffúziós modellek teljesítményét az önszabályozás
Kutatás

Javítja a maszkolt diffúziós modellek teljesítményét az önszabályozás

A maszkolt diffúziós modellek (MDM) eddig korlátozottan tudták finomítani a még maszkolt pozíciókat, de egy új módszer ezen változtat.

ArXiv ML·AI
A nGPT modell nem skálázódott, a νGPT már átviszi a tanulási rátát
Kutatás

A nGPT modell nem skálázódott, a νGPT már átviszi a tanulási rátát

A Normalized Transformer (nGPT) modell hiába gyorsítja a betanítást, a tanulási ráta átvitele nem működött a modellméretek között, ezt korrigálja az új νGPT.

ArXiv ML·AI
A 2021-es EDEN kvantálási algoritmus veri a 2026-os TurboQuantot
Kutatás

A 2021-es EDEN kvantálási algoritmus veri a 2026-os TurboQuantot

Az EDEN-unbiased változat például egy bittel kevesebb adatot használva is felülmúlja a TurboQuant-prod pontosságát, jelentős hatékonyságnövelést kínálva.

Towards Data Science·AI
Kauzális modellekkel magyarázza a Binary Spiking Neural Networks működését az ArXiv AI
Kutatás

Kauzális modellekkel magyarázza a Binary Spiking Neural Networks működését az ArXiv AI

Egy friss ArXiv AI tanulmány kauzális elemzést nyújt a Binary Spiking Neural Networks működésének megértéséhez. A kutatók a hálózat tüskék aktivitását bináris kauzális modellként reprezentálják.

ArXiv AI·AI
10% neuron eltávolítása is összeomlasztja a specializált LLM-eket — írja az ArXiv
Kutatás

10% neuron eltávolítása is összeomlasztja a specializált LLM-eket — írja az ArXiv

A kutatók matematikai érvelésre és kódgenerálásra specializált nyelvi modelleken vizsgálták a neuronritkítás hatását, megerősítve a feladat-specifikus neuronok létét és kritikus szerepét.

ArXiv NLP·AI
Token-szinten finomhangolja a szöveghosszúságot az új LenVM modell
Kutatás

Token-szinten finomhangolja a szöveghosszúságot az új LenVM modell

A Length Value Model (LenVM) a generált szövegek hosszának precízebb szabályozását teszi lehetővé, ami csökkentheti a számítási költségeket és növelheti a modellek teljesítményét.

ArXiv NLP·AI
Korai figyelmeztetést ad a neurális hálók összeomlására az új topológiai monitor
Kutatás

Korai figyelmeztetést ad a neurális hálók összeomlására az új topológiai monitor

A Modular Morse Homology Maintenance (MMHM) és a Collapse Index (CI) kombinációjával a modellképzés során azonnali beavatkozásra nyílik lehetőség.

ArXiv ML·AI
Felezi a hangmodellek méretét a S-SONDO keretrendszer – olcsóbb inferencia jön
Kutatás

Felezi a hangmodellek méretét a S-SONDO keretrendszer – olcsóbb inferencia jön

A jelenlegi hang alapmodellek rendkívül nagyok, paramétereik száma gyakran több százmillió, ami magas inferencia költségekkel és korlátozott eszközön való telepíthetőséggel jár.

ArXiv AI·AI
17-23 százalékponttal pontosabbak az LLM-ek szemantikai réteggel
Kutatás

17-23 százalékponttal pontosabbak az LLM-ek szemantikai réteggel

Az analitikai adatbázisok lekérdezésekor az LLM-ek gyakran hibáznak és hallucinálnak, mert hiányzik számukra az üzleti szemantika, de egy kiegészítő dokumentummal ez a probléma orvosolható.

ArXiv AI·AI
FairMind: LLM-ekkel automatizálja az adathalmazok etikai elemzését az új prototípus
Kutatás

FairMind: LLM-ekkel automatizálja az adathalmazok etikai elemzését az új prototípus

A szoftver a Plečko és Bareinboim által javasolt standard fairness modellre épül, amely kauszális hatások alapján értékeli a torzításokat.

ArXiv ML·AI
Kutatók fejlesztettek egy új, kétáramú transzformátor alapú modellt a kölcsönös pillantás és a közös figyelem automatikus detektálására két kamerás felvételek alapján
Kutatás

Kutatók fejlesztettek egy új, kétáramú transzformátor alapú modellt a kölcsönös pillantás és a közös figyelem automatikus detektálására két kamerás felvételek alapján

A kölcsönös tekintet és a közös figyelem észlelése kulcsfontosságú a fejlődéslélektanban, ám eddig munkaigényes manuális kódolást igényelt a kutatóktól.

ArXiv CV·AI
BatteryPass-12K: Új adatkészlet ellenőrzi az EU digitális akkumulátor-útleveleit
Kutatás

BatteryPass-12K: Új adatkészlet ellenőrzi az EU digitális akkumulátor-útleveleit

Az új adathalmaz a valós pilot mintákból szintetikusan generált adatokkal segíti a nyelvi modelleket az EU akkumulátor-útlevél szabályozásának betartásában.

ArXiv NLP·AI
Agyi jelekből jósolja meg a szavak hosszát a NeuralSet és mélytanulás
Kutatás

Agyi jelekből jósolja meg a szavak hosszát a NeuralSet és mélytanulás

A modern neuroAI-folyamat lehetővé teszi, hogy a nyers agyi aktivitásból, például a MEG-adatokból, értelmes előrejelzéseket készítsenek a szavak hosszáról.

MarkTechPost·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom