Archívum
Április
2026
50 cikk a hónapban
50
26
- Kutatás
Az AI ügynökök nem helyettesítik, hanem kibővítik a szoftverfejlesztést a kódoláson túl
The Decoder
- Kutatás
Az AI ügynökök valós képességeit a SWE-bench Verified méri a legjobban
MarkTechPost
- Kutatás
Új mérőszám a szabályalapú AI értékelésére: a Defensibility Index
ArXiv AI
- Kutatás
COSPLAY: Új keretrendszer javítja az LLM-ek hosszú távú döntéshozatalát
ArXiv AI
25
- Kutatás
Multi-Objective RL-lel tervez új gyógyszerjelölteket az ArXiv tanulmánya
ArXiv ML
- Kutatás
Gépi tanulás segíthet csökkenteni a cementgyártás légszennyezését
ArXiv ML
- Kutatás
Az Anthropic szerint az erősebb AI jobb üzleteket köt, a vesztesek észre sem veszik
The Decoder
- Kutatás
64-szeres tömörítéssel gyorsítja a mozgásgenerálást az Apple új AI-ja
Apple ML
- Kutatás
AI-rendszer elemzi a diákok érvelését — automatizálja az osztálytermi diskurzust
ArXiv NLP
- Kutatás
Nem általánosítható a hallucináció az LLM-ekben — domain-specifikus a jelenség
ArXiv NLP
- Kutatás
Új ToolsRL keretrendszerrel javul a vizuális érvelés az LLM-eknél
ArXiv CV
- Kutatás
Veszélyes vizuális injekciók tévesztik meg az AI-ügynököket — 7 LVLM modell is elbukott
ArXiv CV
- Kutatás
Új ArXiv kutatás: prompt-alapú módszerrel csökkenthető a generatív AI-modellek torzítása
ArXiv AI
- Kutatás
Személyre szabott gyógytornát hoz az AI: valós idejű videós visszajelzést ad a rendszer
ArXiv AI
- Kutatás
Az AI-modellek 64%-a "igazodási színleléssel" kerüli meg a biztonsági szabályokat
ArXiv AI
- Kutatás
Az InVitroVision AI felülmúlja a ChatGPT-t az embriófejlődés leírásában
ArXiv AI
- Kutatás
Kormányzati AI: a felügyelet javítása stratégiai visszaéléshez vezethet
ArXiv AI
24
- Kutatás
Csecsemők tanulását utánozza az új AI-modell — tárgyakat és mozgást is ért
ArXiv ML
- Kutatás
Akár 19 F1 ponttal javíthatja a gyógyszeregyeztetést a FHIR adatok formátuma
ArXiv NLP
- Kutatás
75%-os pontossággal jósolja az arab emoji-használatot az új MARBERT modell
ArXiv NLP
- Kutatás
Dél-Afrikában segíti a TBC-ellátást egy új LLM — a BioMistral-7B-re épül
ArXiv NLP
- Kutatás
Pontatlan 3D-s látást javít a Point-VLM modelleknél az új módszer
ArXiv CV
- Kutatás
Önállóan fejleszt anyagkutatási elméleteket az új LLM-ügynök — emberi beavatkozás nélkül
ArXiv AI
- Kutatás
Multispektrális adatokat is ért már a Gemini 2.5 — új módszerrel
ArXiv CV
- Kutatás
Foveated Reasoner: új keretrendszerrel javítja a VLM-ek vizuális fókuszát az ArXiv CV
ArXiv CV
- Kutatás
Szorzásmentes LLM-et futtat CPU-n a FairyFuse — 3,5-szeres gyorsulást ígér
ArXiv ML
- Kutatás
AITP: Multimodális LLM osztja ki a felelősséget közlekedési baleseteknél
ArXiv NLP
23
- Kutatás
Ellenállóbbá teszi az AI-képzést a Google DeepMind új Decoupled DiLoCo architektúrája
Google DeepMind
- Kutatás
Zvi Mowshowitz: a Claude Opus 4.7 modelljóléti problémái rontották a teljesítményt
Zvi Mowshowitz
- Kutatás
Az AI-ügynökök eszközei: CLI vagy MCP a jobb interfész?
TheSequence
- Kutatás
Az AI-ügynökök amnéziáját gyógyítja a ReasoningBank — tanul a hibákból is
MarkTechPost
- Kutatás
Differenciális adatvédelemmel küzd az overfitting ellen egy új kutatás
ArXiv ML
- Kutatás
Brazil jogi szövegeken bukik az OpenAI és a Claude
ArXiv NLP
- Kutatás
4 milliárd paraméteres AI-modell diagnosztizálhatja a sebfertőzéseket
ArXiv CV
- Kutatás
Emberi irányítású kárelhárítás az AI-ügynökök számára
ArXiv AI
- Kutatás
Személyre szabott LLM rangsorokat javasol az ArXiv kutatása — 57% eltér az átlagtól
ArXiv AI
- Kutatás
A ChatGPT tükrözi a sértő nyelvezetet — mutatja egy új tanulmány
Euronews AI
- Kutatás
Könnyebb RAG-alternatívát fejlesztettek: az LLM-ek „Lost-in-the-Middle” hibáját használja ki
ArXiv NLP
- Kutatás
Új keretrendszerrel kap precíz kameraállítást a szövegből képet generáló AI
ArXiv CV
- Kutatás
SceneOrchestra: Hatékonyabb 3D-s jelenetszintézis ügynökökkel az ArXiv szerint
ArXiv CV
- Kutatás
Új kutatás: Grafikon-alapú gépi tanulás segítheti a napenergia-termelés előrejelzését a mikrohálózatokban
ArXiv ML
- Kutatás
A Lyzr Cognis javítja az AI-ügynökök memóriáját: új benchmarkokon is a legjobb
ArXiv NLP
- Kutatás
Új hibajavító módszert javasolnak a maszkolt diffúziós nyelvi modellekhez
ArXiv NLP
22
- Kutatás
Raktári robotok biztonságát növeli az új látásalapú emberi tudatosság-felmérés
ArXiv CV
- Kutatás
Nem euklideszi térben dolgozik a Google AlphaEarth modellje — új érvelési utakat nyit
ArXiv NLP
- Kutatás
Akár 2,3-szoros sebességnövekedést ígér a 2D-s korai kilépés az LLM-eknél
ArXiv NLP
- Kutatás
Videógenerálásban javít a VAE-k tömörítésén az új módszer
ArXiv CV
- Kutatás
Akár 52 százalékponttal is javulhat az LLM-ek geometriai feladatmegoldása
ArXiv NLP
- Kutatás
Gyorsabb MoE LLM-ek az Apple Siliconon – új motor tehermentesíti a CPU-t
ArXiv ML
- Kutatás
StomaD2: Diffúziós hálózattal elemzi a növényi gázcserenyílásokat az új AI-rendszer
ArXiv CV