ÉlőUtoljára: 1 napjaMa: 0

Rovat · 42. oldal

Kutatás

AI research papers, arXiv publikációk, benchmarkok, tudományos áttörések

1159 cikk az archívumban

Új GroupDPO módszerrel optimalizálják az LLM-eket, csökken a memóriahasználat
Kutatás

Új GroupDPO módszerrel optimalizálják az LLM-eket, csökken a memóriahasználat

A GroupDPO nevű új algoritmus jelentősen csökkenti a nagyméretű nyelvi modellek (LLM) betanításához szükséges memóriaigényt, miközben megőrzi a gradiensinformációkat.

ArXiv NLP·AI
DeepER-Med: Ügynök AI-rendszerrel erősíti az orvosi kutatásokat az ArXiv
Kutatás

DeepER-Med: Ügynök AI-rendszerrel erősíti az orvosi kutatásokat az ArXiv

A DeepER-Med egy mély bizonyítékalapú kutatási keretrendszer, amely ügynök AI-rendszerrel segíti a komplex orvosi kérdések megválaszolását.

ArXiv AI·AI
Új AI-modell pontosabb eső-előrejelzést ígér a NEXRAD adatokkal
Kutatás

Új AI-modell pontosabb eső-előrejelzést ígér a NEXRAD adatokkal

A modell a vizuális radarfelvételeket és a numerikus időjárás-állomás méréseket ötvözi, hogy valós idejű, lokalizált csapadék-előrejelzést készítsen.

ArXiv ML·AI
1,4-szeres gyorsulást hoz az új módszer lengyel LLM-eknek Apple Siliconon
Kutatás

1,4-szeres gyorsulást hoz az új módszer lengyel LLM-eknek Apple Siliconon

A technika lehetővé teszi, hogy a különböző tokenizálókat használó modellek is együttműködjenek, jelentősen felgyorsítva a válaszadást a fogyasztói eszközökön.

ArXiv NLP·AI
ArXiv kutatás: a robotok térbeli memóriaigénye két nagyságrenddel csökkenthető
Kutatás

ArXiv kutatás: a robotok térbeli memóriaigénye két nagyságrenddel csökkenthető

A látásalapú robotok egyre nagyobb környezetekben navigálnak, de a térbeli memóriájuk korlátlan növekedése kimeríti a számítási erőforrásokat, különösen a beágyazott platformokon.

ArXiv CV·AI
Új AI-modell javítja az időjárás-előrejelzést: a Mosaic felülmúlja a finomabb adatokat használó rendszereket
Kutatás

Új AI-modell javítja az időjárás-előrejelzést: a Mosaic felülmúlja a finomabb adatokat használó rendszereket

A Mosaic nevű új valószínűségi időjárás-előrejelző modell a gépi tanuláson alapuló rendszerek spektrális romlásának két fő okát is kezeli, jelentősen javítva a pontosságot.

ArXiv ML·AI
AI Index 2026: a top modellek már emberi szintet érnek el tudományban és matematikában
Kutatás

AI Index 2026: a top modellek már emberi szintet érnek el tudományban és matematikában

A mesterséges intelligencia fejlődése tovább gyorsul: a legfejlettebb modellek már emberi szinten teljesítenek tudományos, matematikai és nyelvi teszteken.

MIT Technology Review AI·AI
The Gradient: a ChatGPT és társai felerősítik a nemi előítéleteket
Kutatás

The Gradient: a ChatGPT és társai felerősítik a nemi előítéleteket

A kutatók évek óta dolgoznak azon, hogy mérjék és kezeljék a mesterséges intelligencia rendszerekben jelen lévő nemi torzításokat, amelyek a betanításukhoz használt emberi adatokból származnak.

The Gradient·AI
Új Mamba-modell jósolja meg az agy szerkezeti változásait MRI alapján
Kutatás

Új Mamba-modell jósolja meg az agy szerkezeti változásait MRI alapján

A CLIMB, egy új mesterséges intelligencia keretrendszer, képes előre jelezni az agy szerkezeti változásait az idő múlásával, ami korai beavatkozást tehet lehetővé a betegségek kezelésében.

ArXiv CV·AI
AI Now Institute: az „AI a jóért" szlogenek mögött kizsákmányolás áll
Kutatás

AI Now Institute: az „AI a jóért" szlogenek mögött kizsákmányolás áll

Az AI Now Institute elemzése feltárja, hogy az AI-ipar „hatásnyelv" mögött környezeti kizsákmányolás és társadalmi kirekesztés húzódik.

AI Now Institute·AI
Az OpenMed 165 dollárból képzett mRNA nyelvi modelleket 25 fajra
Kutatás

Az OpenMed 165 dollárból képzett mRNA nyelvi modelleket 25 fajra

A projekt a fehérje 3D-szerkezetének előrejelzésétől a kodonoptimalizált DNS-szekvenciákig terjedő, végponttól-végpontig folyamat, amit a Hugging Face publikált.

Hugging Face·AI
Stein 10%-os javulás
Kutatás

Stein 10%-os javulás

A Stein operátor beépítése a paramétertérbe 10%-os javulást eredményez a kombinatorikus optimalizációban. Jelentősen csökken a populáció szórása.

ArXiv AI·AI
Automatizált AI kutatás: az Anthropic ügynökei felülmúlják az emberi szakértőket
Kutatás

Automatizált AI kutatás: az Anthropic ügynökei felülmúlják az emberi szakértőket

Az Anthropic kutatói sikeresen automatizálták az AI biztonsági kutatást, ahol az AI ügynökök jobban teljesítettek, mint az emberi kutatók a gyenge-erős felügyelet területén.

Import AI·AI
ArXiv: A szekvenciális KV cache tömörítés túlszárnyalja a per-vektor limiteket
Kutatás

ArXiv: A szekvenciális KV cache tömörítés túlszárnyalja a per-vektor limiteket

A nagyméretű nyelvi modellek (LLM) működését gyorsító KV cache tömörítés új megközelítése jelentősen javíthatja az inferencia sebességét.

ArXiv ML·AI
A komplex ábrák megfelezik a legjobb AI-modellek teljesítményét
Kutatás

A komplex ábrák megfelezik a legjobb AI-modellek teljesítményét

A legfejlettebb, zárt forráskódú AI-modellek is közel felére esik vissza a teljesítményük, amikor valós adatokból épített, összetett vizualizációkat kell értelmezniük.

The Decoder·AI
Már 10 perc AI-használat is rontja a problémamegoldó képességet
Kutatás

Már 10 perc AI-használat is rontja a problémamegoldó képességet

Egy új tanulmány szerint az AI-használat rövid ideig tartó megszokása is negatív hatással lehet a felhasználók teljesítményére, függetlenül attól, hogy milyen feladatokat kell megoldaniuk.

The Decoder·AI
Új keretrendszer tanítja meg a modelleket a kódtváltásra a jobb érvelésért
Kutatás

Új keretrendszer tanítja meg a modelleket a kódtváltásra a jobb érvelésért

A nagyméretű nyelvi modellek (LLM) érvelési képességei jelentősen fejlődtek az utóbbi időben, ám a nyelvkeverés, vagyis a kódtváltás eddig kihívást jelentett a fejlesztőknek.

ArXiv NLP·AI
DeepSeek V3: új figyelem és MoE-rétegekkel javítja az LLM-hatékonyságot
Kutatás

DeepSeek V3: új figyelem és MoE-rétegekkel javítja az LLM-hatékonyságot

A DeepSeek V3 architektúra két kulcsfontosságú technológiát vezet be: az új figyelmi mechanizmust és a MoE-rétegeket, amelyek jelentősen javítják a számítási hatékonyságot.

Ahead of AI·AI
PolicyBank: Új memóriamechanizmus segíti az LLM-ügynökök szabálykövetését
Kutatás

PolicyBank: Új memóriamechanizmus segíti az LLM-ügynökök szabálykövetését

A PolicyBank egy új memóriamechanizmus, amely lehetővé teszi a nagyméretű nyelvi modellek (LLM) alapú ügynökök számára, hogy interaktív visszajelzésekkel finomítsák szabályértelmezésüket.

ArXiv NLP·AI
Mollick: A multimodális AI nem hoz emberi szintű AGI-t a közeljövőben
Kutatás

Mollick: A multimodális AI nem hoz emberi szintű AGI-t a közeljövőben

A jelenlegi multimodális AI-megközelítések, amelyek különböző modalitásokat ragasztanak össze, nem elegendőek az emberi szintű általános mesterséges intelligencia (AGI) eléréséhez a közeljövőben.

The Gradient·AI
Új Triton kernel gyorsítja a Vision Transformer modelleket az ArXiv szerint
Kutatás

Új Triton kernel gyorsítja a Vision Transformer modelleket az ArXiv szerint

A Vision Transformer (ViT) modellek feldolgozási sebessége jelentősen javulhat egy új, könnyűsúlyú Triton figyelmi kernellel, amely a token-metszés előnyeit a gyakorlatban is érvényesíti.

ArXiv ML·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom