ÉlőUtoljára: 16 órájaMa: 0

Rovat · 53. oldal

Kutatás

AI research papers, arXiv publikációk, benchmarkok, tudományos áttörések

1159 cikk az archívumban

Az OpenAI eszközei hónapok alatt váltak használhatóvá az nyílt forráskódú fejlesztőknek
Kutatás

Az OpenAI eszközei hónapok alatt váltak használhatóvá az nyílt forráskódú fejlesztőknek

Greg Kroah-Hartman, a Linux stable kernel maintainer, szerint az AI-eszközök minősége hónapok alatt jelentősen javult.

ZDNet AI·AI
A TurboQuant technika nagy részben kompenzálja a Q8_0 kv quantizálás csökkentését
Kutatás

A TurboQuant technika nagy részben kompenzálja a Q8_0 kv quantizálás csökkentését

A Reddit felhasználók szerint a TurboQuant technika mellett az AIME25 teljesítményteszten tapasztalt teljesítménycsökkenés nagyrészt kompenzálható

Reddit LocalLLaMA·AI
Egy fejlesztő létrehozott egy autonóm ML ügynököt, ami végeláthatatlanul futtat kísérleteket tabuláris adatokon
Kutatás

Egy fejlesztő létrehozott egy autonóm ML ügynököt, ami végeláthatatlanul futtat kísérleteket tabuláris adatokon

A Reddit felhasználó, aki az AutoResearch projektből merített ihletet, egyetlen GPU-val tesztelte a fejlesztést.

Reddit ML·AI
Betekintés a transformer rétegekbe: így dolgoznak az inference motormeghajtások
Kutatás

Betekintés a transformer rétegekbe: így dolgoznak az inference motormeghajtások

A Vicuna-13B modellhez hasonló nyelvi modellek fejlesztésében kulcsszerepet játszanak az olyan technológiák, mint a self-attention és a finomhangolás.

Reddit LocalLLaMA·AI
Egy 9 soros seed és 5 kör kontrasztív visszajelzés felülmúlja az Optunát 96%-ban
Kutatás

Egy 9 soros seed és 5 kör kontrasztív visszajelzés felülmúlja az Optunát 96%-ban

A Reddit felhasználók szerint a kontrasztív visszajelzés technika hatékonysága a szabályozatlan betanítással kombinálva 20%-kal növelte a modell teljesítményét.

Reddit ML·AI
Sűrűség-érzékeny kontextus-kompresszió új módszerrel
Kutatás

Sűrűség-érzékeny kontextus-kompresszió új módszerrel

Yijiong Yu és munkatársai egy új keretrendszert mutattak be, amely a kontextus kompresszióját optimalizálja az információ sűrűségének figyelembevételével.

ArXiv NLP·AI
Kutatók kimutatták, hogy az összeesküvés-elméletek nem uniformán fejlődnek
Kutatás

Kutatók kimutatták, hogy az összeesküvés-elméletek nem uniformán fejlődnek

Manisha Keim és munkatársai 169,9 millió Reddit-kommentet elemeztek, és megállapították, hogy az összeesküvés-elméletek nyelvi jellemzői idővel dinamikusan változnak.

ArXiv NLP·AI
A Lens Academy alapítója keresi társát, már vannak felhasználók és finanszírozás
Kutatás

A Lens Academy alapítója keresi társát, már vannak felhasználók és finanszírozás

Luc Brinkman, a Lens Academy alapítója egy olyan társat keres, aki vagy technikai, vagy nem-technikai szakértő, és akivel együttműködve fejleszthetik az AI Safety oktatást.

LessWrong AI·AI
Az AutoB2G keretrendszer természetes nyelvi leírások alapján automatizálja az épület-hálózat szimulációt
Kutatás

Az AutoB2G keretrendszer természetes nyelvi leírások alapján automatizálja az épület-hálózat szimulációt

Borui Zhang és munkatársai által kidolgozott AutoB2G keretrendszer 2,255 KB méretű, és cs.AI kategóriába tartozik.

ArXiv AI·AI
A RASPRef keretrendszer fejleszti a promptokat emberi felügyelet nélkül
Kutatás

A RASPRef keretrendszer fejleszti a promptokat emberi felügyelet nélkül

Rahul Soni szerint a RASPRef keretrendszerrel elérhető javulás a GSM8K-stílusú matematikai okoskodási feladatokban

ArXiv NLP·AI
Az utolsó ujjlenyomat: hogyan formálja a markdown az LLM szövegét
Kutatás

Az utolsó ujjlenyomat: hogyan formálja a markdown az LLM szövegét

E. M. Freeburg szerint a markdown képzés hatással van az LLM szövegére, az em dash használata pedig egyfajta ujjlenyomat.

ArXiv NLP·AI
Az OpenAI és a Google fejleszti a nyelvi modellek szabályozhatóságát
Kutatás

Az OpenAI és a Google fejleszti a nyelvi modellek szabályozhatóságát

Több mint 100 ezer felhasználó járult hozzá a GPT-4o visszavonásához

Reddit ML·AI
PyTorch DDP-vel építsünk gyártásra képes, több csomópontos tanulási folyamatot
Kutatás

PyTorch DDP-vel építsünk gyártásra képes, több csomópontos tanulási folyamatot

S. M. Navin Nayer Anik 27 oldalas cikkben mutatja be, hogyan építsünk gyártásra képes tanulási folyamatot PyTorch DDP-vel

Towards Data Science·AI
A robotok is megtanulhatják a statisztikai csalást
Kutatás

A robotok is megtanulhatják a statisztikai csalást

Jaemin Han szerint a p-hackinggal a kutatók a hipotézisük igazolására törekednek, és ennek során akár 40%-ra is növelhetik a hamis pozitív eredmények arányát.

Towards Data Science·AI
A LocalLLaMA 2026 modellje már jobb lehet a GPT-3.5-nél
Kutatás

A LocalLLaMA 2026 modellje már jobb lehet a GPT-3.5-nél

A Meta kutatói szerint a LocalLLaMA modell fejlesztése 2026-ra akár 10 százalékkal javíthatja a nyelvi megértést

Reddit LocalLLaMA·AI
A LessWrong kutatói felfedezik: az LLM-ekben az elhitetés hathatós eszköz az irányításban
Kutatás

A LessWrong kutatói felfedezik: az LLM-ekben az elhitetés hathatós eszköz az irányításban

Egy új tanulmány feltárta, hogy az LLM-ek irányításában milyen szerepet játszhat az elhitetés, és milyen következményekkel járhat ez a technológia fejlődésére

LessWrong AI·AI
Irán nyerésre áll az AI-propagandaháborúban
Kutatás

Irán nyerésre áll az AI-propagandaháborúban

Több mint 61 százalék az amerikaiak közül elutasítja Trump háborús politikáját, miközben az iráni propagandavideók milliós nézettséget értek el.

404 Media·AI
Georgi Gerganov szerint a helyi modellekben rengeteg apró hibától szenvednek
Kutatás

Georgi Gerganov szerint a helyi modellekben rengeteg apró hibától szenvednek

Georgi Gerganov llama.cpp könyvtára lehetővé tette, hogy a lokális modellek a fogyasztói hardveren is fussanak

Simon Willison·AI
A megbízható AI alapjai: a platform-determinisztikus inferencia elengedhetetlen
Kutatás

A megbízható AI alapjai: a platform-determinisztikus inferencia elengedhetetlen

TJ Dunham szerint a megbízható AI alapja a platform-determinisztikus inferencia, amit 82 kereszt-architekturális teszttel igazoltak.

ArXiv AI·AI
A domain-specifikus gépi fordítás és minőségértékelés rendszerek fejlesztése
Kutatás

A domain-specifikus gépi fordítás és minőségértékelés rendszerek fejlesztése

Javad Pourmostafa Roshan Sharami kutató szerint a gépi fordítás minősége jelentősen javulhat, ha a rendszereket speciális domainekhez igazítják.

ArXiv NLP·AI
Új modell javítja az érzelmek felismerését a multimodális beszélgetésekben
Kutatás

Új modell javítja az érzelmek felismerését a multimodális beszélgetésekben

Ying Liu és munkatársai egy kapcsolatokat figyelembe vevő modellt fejlesztettek ki, amely a szöveg, hang és arckifejezés kombinált elemzésével pontosabban azonosítja a beszélgetések érzelmi tónusát.

ArXiv NLP·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom