ÉlőUtoljára: 17 órájaMa: 0

Rovat · 6. oldal

Modellek & LLM

GPT, Claude, Gemini és más generatív AI modellek, agents, multimodális rendszerek

578 cikk az archívumban

Saját AI-modellt és Git-platformot dob piacra a Cursor — heteken belül érkezik a fejlesztés
Modellek & LLM

Saját AI-modellt és Git-platformot dob piacra a Cursor — heteken belül érkezik a fejlesztés

A Cursor saját, házon belül képzett AI-modellje heteken belül megjelenik, amely a GPT-hez hasonló méretű és tíz-húsz szoros számítási kapacitást igényel a korábbi verziókhoz képest.

The Decoder·AI
50 referenciaanyagból készít klipet a ByteDance új Seedance 2.5 videómodellje
Modellek & LLM

50 referenciaanyagból készít klipet a ByteDance új Seedance 2.5 videómodellje

A Seedance 2.5 AI videómodell 50 referenciaanyagból képes 30 másodperces klipet generálni, ami jelentős előrelépés a korábbi Seedance 2.0 12 anyagához képest — közölte a ByteDance.

Techmeme·AI
Kerekeken futó robotot dob piacra a Robot.com — konyhákba és raktárakba szánják
Modellek & LLM

Kerekeken futó robotot dob piacra a Robot.com — konyhákba és raktárakba szánják

A Robot.com R-noid nevű, kerekes humánoid robotot dob piacra, amely a Physical Intelligence AI-modelljét használja a feladatok elvégzéséhez, és akár kétméteres magasságig nyúl.

TNW·AI
A kódírás már nem szűk keresztmetszet: 8-szoros kódforgalom az Anthropicnál
Modellek & LLM

A kódírás már nem szűk keresztmetszet: 8-szoros kódforgalom az Anthropicnál

Az Anthropic mérnökei negyedévente 8-szor több kódot adnak ki, mint 2021 és 2025 között, ami a kódgenerálás költségeinek összeomlásával a kódellenőrzést és megfigyelhetőséget teszi az új szűk keresztmetszetté.

Anthropic·AI
PP‑OCRv6 86,2 %-os detektálási pontossággal, 50 nyelven
Modellek & LLM

PP‑OCRv6 86,2 %-os detektálási pontossággal, 50 nyelven

A PP‑OCRv6 medium modell +4,6 %-kal javítja a szövegdetektálást és +5,1 %-kal növeli a karakterfelismerést a korábbi PP‑OCRv5‑hez képest — a PaddlePaddle szerint.

Hugging Face·AI
Randima Fernando szerint az AI érzelmek nem valódiak
Modellek & LLM

Randima Fernando szerint az AI érzelmek nem valódiak

Randima Fernando, a Center for Humane Technology társalapítója szerint az AI-modellek „érzelmi” reakciói nem valódi érzések, hanem a nagy emberi szövegkorpuszon való betanítás eredményei.

AI for Newsroom·AI
MoonMath AI új gyorsítókörrel verte az AMD saját figyelmi-magját MI300X-en
Modellek & LLM

MoonMath AI új gyorsítókörrel verte az AMD saját figyelmi-magját MI300X-en

A MoonMath AI által fejlesztett, MIT-licenc alatt kiadott HIP figyelmi-mag 1,26-szoros sebességnövekedést kínál az AMD MI300X GPU-n, felülmúlva az AITER v3-at minden tesztelt formátumban.

MarkTechPost·AI
Nyílt alapmodell lett az Apertus, megfelel az EU AI Act-nak
Modellek & LLM

Nyílt alapmodell lett az Apertus, megfelel az EU AI Act-nak

Az EPFL, ETH Zurich és CSCS együttműködésében létrejött Apertus modell 8 és 70 milliárd paraméteres változatban érhető el, és a svájci Swisscom stratégiai partner.

Hacker News·AI
23 milliárd paraméteres Laguna M.1-t bocsátott ki nyílt forráskóddal a Poolside
Modellek & LLM

23 milliárd paraméteres Laguna M.1-t bocsátott ki nyílt forráskóddal a Poolside

A Poolside Laguna M.1 modellje 23 milliárd aktív paraméterrel és 256 ezer tokenes kontextusablakkal érkezik, Apache 2.0 licenc alatt.

Product Hunt·AI
EU-nak 2031-re gazdasági és politikai instabilitás járhat az AI-lemaradásért — Guardian-elemzés
Modellek & LLM

EU-nak 2031-re gazdasági és politikai instabilitás járhat az AI-lemaradásért — Guardian-elemzés

Az Európai Uniónak 2031-re gazdasági és politikai instabilitással kell szembenéznie, ha nem tartja lépést az Egyesült Államokkal és Kínával a mesterséges intelligencia (AI) fejlesztésében – állítja a Guardian egy új elemzése.

Techmeme·AI
Nobel-díjas kutató hagyja el a Google DeepMindot az Anthropic kedvéért
Modellek & LLM

Nobel-díjas kutató hagyja el a Google DeepMindot az Anthropic kedvéért

John Jumper, az AlphaFold atyja és Nobel-díjas kutató hagyja el a Google DeepMindot, hogy csatlakozzon az Anthropic AI-céghez. Ez a harmadik kulcsember, aki távozik a Google-tól az elmúlt hónapokban.

Techmeme·AI
3 milliárd paraméteres AI modell éri utol a 700 milliárdosokat komplex feladatokban
Modellek & LLM

3 milliárd paraméteres AI modell éri utol a 700 milliárdosokat komplex feladatokban

A 3 milliárd paraméteres VibeThinker-3B modell a Sina Weibo kutatói szerint 96,1%-os elfogadási arányt ért el egy új, nehezen megoldható kódolási teszten.

MarkTechPost·AI
Z.ai GLM-5.2 kevesebb hallucinál, mint a nagyobb GPT-5.5 és DeepSeek V4 Pro
Modellek & LLM

Z.ai GLM-5.2 kevesebb hallucinál, mint a nagyobb GPT-5.5 és DeepSeek V4 Pro

A méret helyett a megbízhatóságra kell törekedni az AI-fejlesztésben, mert a legnagyobb modellek is jelentős arányban tévednek – derül ki a Z.ai GLM-5.2 és a GPT-5.5 összehasonlításából.

Hacker News·AI
Új, ötrészes online képzést indít az IEEE a generatív AI-ról
Modellek & LLM

Új, ötrészes online képzést indít az IEEE a generatív AI-ról

Az IEEE ötrészes online képzéssel segíti a mérnököket a nagy nyelvi modellek (LLM) tervezésében, biztonságos implementálásában és üzembe helyezésében.

IEEE Spectrum AI·AI
Az Apple, a Google és a NYU új technikái felezik az LLM-ek memóriaigényét
Modellek & LLM

Az Apple, a Google és a NYU új technikái felezik az LLM-ek memóriaigényét

A Google és a NYU TurboQuant módszere 4-szeres tömörítést tesz lehetővé, míg az Apple EpiCache a hosszú beszélgetések kezelését javítja.

MarkTechPost·AI
AI-asszisztens hívásokra, ételrendelésre: indít a Reliance 500 millió felhasználó számára
Modellek & LLM

AI-asszisztens hívásokra, ételrendelésre: indít a Reliance 500 millió felhasználó számára

Az új Jio Call Agent hívásokat fogad, összefoglal és feladatokat végez, mint a fuvarszervezés vagy az ételrendelés. A szolgáltatás idén év végén indul a Reliance több mint 500 millió felhasználója számára.

TechCrunch·AI
Midjourney 60 másodperc alatt készít teljes testképet — orvosi képalkotásba lép a cég
Modellek & LLM

Midjourney 60 másodperc alatt készít teljes testképet — orvosi képalkotásba lép a cég

A Midjourney bemutatta első hardvertermékét, a Midjourney Scannert, amely 60 másodperc alatt készít teljes testképet ultrahanggal, sugárzás és mágneses mezők nélkül.

Midjourney·AI
Noam Shazeer elhagyja a Google-t az OpenAI kedvéért
Modellek & LLM

Noam Shazeer elhagyja a Google-t az OpenAI kedvéért

Noam Shazeer, a Google Gemini modelljeinek egyik fő építésze és a Transformer-architektúra egyik társszerzője az OpenAI-hoz szerződik. A lépés a két technológiai óriás közötti tehetségháború jele.

TNW·AI
Két új többnyelvű keresőmodellt dob piacra a Liquid AI, 350 millió paraméterrel
Modellek & LLM

Két új többnyelvű keresőmodellt dob piacra a Liquid AI, 350 millió paraméterrel

A Liquid AI két új, 350M paraméteres keresőmodellt dobott piacra, amelyek 11 nyelven képesek gyors, többnyelvű és cross-lingual keresésre, miközben kis lábnyomukkal szinte bárhol futtathatók.

MarkTechPost·AI
Az Amazon beismeri, lemaradt az OpenAI és az Anthropic mögött
Modellek & LLM

Az Amazon beismeri, lemaradt az OpenAI és az Anthropic mögött

Peter DeSantis, az Amazon AI-vezére szerint a cég modelljei „nem voltak az élvonalban”, de reméli, hogy egy éven belül utolérik az OpenAI-t és az Anthropicot.

TNW·AI
Bemutatta az ügynökök munkáját nyomon követő memóriarendszert a Perplexity
Modellek & LLM

Bemutatta az ügynökök munkáját nyomon követő memóriarendszert a Perplexity

A Perplexity Brain nevű új memóriarendszere az AI-ügynökök munkáját követi nyomon, nem a felhasználó preferenciáit, ezzel javítva a teljesítményt.

MarkTechPost·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom