ÉlőUtoljára: 18 órájaMa: 0

Rovat · 8. oldal

Modellek & LLM

GPT, Claude, Gemini és más generatív AI modellek, agents, multimodális rendszerek

578 cikk az archívumban

Count Anything pontosabb objektumszámlálást ér el, mint a versenytársak
Modellek & LLM

Count Anything pontosabb objektumszámlálást ér el, mint a versenytársak

Az új Count Anything modell átlagosan csak kilenc hibát követ el egy képben, miközben a legközelebbi versenytárs több mint tizennyolc hibát tesz — a Tsinghua kutatók a 220 000 képes CLOC adathalmazon alapozzák.

The Decoder·AI
Vintage LLM 340 M paraméterrel, 1900 előtti tudáskorláttal érkezik
Modellek & LLM

Vintage LLM 340 M paraméterrel, 1900 előtti tudáskorláttal érkezik

A projekt összköltsége mindössze 80 USD GPU-díj, a kód és a modell a HuggingFace-en és a GitHubon szabadon letölthető, így bárki kipróbálhatja a 1900 előtti tudáskorláttal rendelkező Vintage LLM-et.

Hacker News·AI
Michael Ronis rámutatott, hogy az AI nem helyettesíti a toborzót
Modellek & LLM

Michael Ronis rámutatott, hogy az AI nem helyettesíti a toborzót

Az AI-alapú szűrés már 88%-ban része a vállalatok toborzási folyamata, miközben a cégek évente több mint egymillió pályázatot kapnak.

TNW·AI
Klinikai beszélgetésekre optimalizál AI-modellt az Nvidia és az Abridge
Modellek & LLM

Klinikai beszélgetésekre optimalizál AI-modellt az Nvidia és az Abridge

Az Nvidia és az Abridge orvosi párbeszédekre optimalizált AI-modellt képez ki de-identifikált adatok és Nemotron modellek felhasználásával – közölte a Wall Street Journal.

Techmeme·AI
Bemutatta a GPT-Realtime-2 modellt az OpenAI, amely dokumentumok kontextusával is képes beszélgetni
Modellek & LLM

Bemutatta a GPT-Realtime-2 modellt az OpenAI, amely dokumentumok kontextusával is képes beszélgetni

A modell a böngészőben érhető el, és hangalapú beszélgetéseket tesz lehetővé a felhasználók számára, akár dokumentumok kontextusával is.

Simon Willison·AI
Bemutatta a MiniMax M3 modellt az NVIDIA, 428 milliárd paraméterrel és 1 millió token kontextusával
Modellek & LLM

Bemutatta a MiniMax M3 modellt az NVIDIA, 428 milliárd paraméterrel és 1 millió token kontextusával

A 428 milliárd paraméteres MiniMax M3 modell 1 millió token kontextusával és natív multimodalitásával az NVIDIA Blackwell infrastruktúrán fut, egyesítve a szöveg-, látás- és kódfeladatokat.

Nvidia Developer·AI
Infografikák generálására hangolta finomra a SenseNova U1 modellt
Modellek & LLM

Infografikák generálására hangolta finomra a SenseNova U1 modellt

A fejlesztésnek köszönhetően a modell pontosabban dolgoz fel vizuális információkat és hoz létre tartalmat.

Reddit LocalLLaMA·AI
Varya 10‑ször gyorsabb és 20‑szor olcsóbb videómodellt hozott Indiára
Modellek & LLM

Varya 10‑ször gyorsabb és 20‑szor olcsóbb videómodellt hozott Indiára

10‑ször gyorsabb és 20‑szor olcsóbb videómodell, a Varya, 5 másodperces 720p klipet 45 másodperc alatt generál, és csak ₹0,48 ($0,005) másodpercenként – az Avataar AI szerint.

TechCrunch·AI
Fejlesztői modellt adott ki a Google, gyorsabb szöveggenerálást tesz lehetővé
Modellek & LLM

Fejlesztői modellt adott ki a Google, gyorsabb szöveggenerálást tesz lehetővé

A Google kiadta a DiffusionGemma-modell fejlesztői útmutatóját, amely a Gemma 4 alapjaira épül, és célja a fejlesztői munkafolyamatok megkönnyítése.

Reddit LocalLLaMA·AI
Bemutatta a Gemma-4-12B-OBLITERATED modellt az OBLITERATUS, több mint 8100 letöltésnél jár
Modellek & LLM

Bemutatta a Gemma-4-12B-OBLITERATED modellt az OBLITERATUS, több mint 8100 letöltésnél jár

A Gemma-4-12B-OBLITERATED nevű, 12 milliárd paraméteres transformer modell már 8106 letöltésnél jár a Hugging Face-en, 189 kedvelést gyűjtve.

Hetzner: Hugging Face Models (trending)·AI
KKR elindította a Helix Digital-et, hogy felgyorsítsa az AI‑infrastruktúra kiépítését
Modellek & LLM

KKR elindította a Helix Digital-et, hogy felgyorsítsa az AI‑infrastruktúra kiépítését

A több mint 10 milliárd dolláros elkötelezett tőkével a Helix Digital célja, hogy AI‑adatközpontok, energiaellátás és kapcsolódási infrastruktúra kiépítését gyorsítsa.

Techmeme·AI
Oasis 3 valós idejű vezetői szimulációt kínál, költsége 0,02 dollár másodpercenként
Modellek & LLM

Oasis 3 valós idejű vezetői szimulációt kínál, költsége 0,02 dollár másodpercenként

Az Oasis 3 API-ját másodpercenként 0,02 dollárért kínálja a Decart, miközben a cég értéke közel 4 milliárd dollárra emelkedett a legutóbbi 300 millió dolláros tőkebevonás után.

TechCrunch·AI
Bemutatta a Google a DiffusionGemma modellt, amely négyszer gyorsabban generál szöveget
Modellek & LLM

Bemutatta a Google a DiffusionGemma modellt, amely négyszer gyorsabban generál szöveget

A Google DiffusionGemma nevű új nyílt kísérleti modell akár 4-szer gyorsabban generál szöveget, mint a hagyományos autoregresszív LLM-ek, miközben csak 3,8 milliárd paramétert aktivál futtatáskor.

Google DeepMind·AI
A Rubrik bevezette az Agent Cloudot, három új AI‑biztonsági funkcióval
Modellek & LLM

A Rubrik bevezette az Agent Cloudot, három új AI‑biztonsági funkcióval

Az új Agent Cloud három kulcsfunkciója – a SAGE kormányzómotor, az Agent Rewind visszagörgetés és a Codebase Resilience helyreállítás – a vállalatok számára automatikus kódvédelmet nyújt.

Anthropic·AI
Fejlesztők nagy lépésekre számítanak az Apple AI-jétől — új API-k jöhetnek
Modellek & LLM

Fejlesztők nagy lépésekre számítanak az Apple AI-jétől — új API-k jöhetnek

Az Apple fejlesztői nagyszerű API-kat várhatnak, amelyek kiterjedhetnek a rendszerszintű AI-funkciókra. A fejlesztők jelentős előrelépéseket várnak az Apple mesterséges intelligenciájának fejlesztéseitől.

Bloomberg Technology·AI
Az AI-generált kód nehezíti a rendszerek karbantartását
Modellek & LLM

Az AI-generált kód nehezíti a rendszerek karbantartását

Az AI-generált kód komplexitást hoz a rendszerekbe, ami nehezebbé teszi a karbantartást. Az AI által generált kód függőséget okozhat a fejlesztőkben.

Hacker News·AI
Tartós AI-munkavállalókat hozhatnak létre a fejlesztők az Anthropic új szolgáltatásával
Modellek & LLM

Tartós AI-munkavállalókat hozhatnak létre a fejlesztők az Anthropic új szolgáltatásával

Az Anthropic új Managed Agents szolgáltatása lehetővé teszi, hogy a fejlesztők tartós AI-munkavállalókat hozzanak létre, ne csak ideiglenes demókat.

The Neuron·AI
Cohere bemutatja a North Mini Code-ot: 33.4-es kódolási indexszel veri a riválisokat
Modellek & LLM

Cohere bemutatja a North Mini Code-ot: 33.4-es kódolási indexszel veri a riválisokat

A Cohere bemutatta North Mini Code nevű új AI-modelljét, amely 30 milliárd paraméterével és 33.4-es kódolási indexével a fejlesztőket célozza. A Mixture-of-Experts architektúrájú modell 70 ezer feladatot dolgoz fel.

Hugging Face·AI
Új készségekkel bővíthető az Anthropic Claude AI-ja — egyedi utasításokat tanít be
Modellek & LLM

Új készségekkel bővíthető az Anthropic Claude AI-ja — egyedi utasításokat tanít be

Az Anthropic Claude AI-ja mostantól képes egyedi készségeket betanulni. A felhasználók markdown utasításokat hozhatnak létre, amelyeket a rendszer automatikusan alkalmaz.

Anthropic·AI
Az Anthropic Fable 5 modellje 78%-os eredményt ér el a kibertámadások elleni teszten
Modellek & LLM

Az Anthropic Fable 5 modellje 78%-os eredményt ér el a kibertámadások elleni teszten

A korlátozott válaszadás ellenére az új modell fejlesztése jelentős lépésnek számít a mesterséges intelligencia biztonságos fejlesztése terén, és az Anthropic reméli, hogy a jövőben további fejlesztésekkel sikerül majd a korlátokat enyhíteni.

Ars Technica·AI
Az NVIDIA 50%-kal csökkenti a CLIP-kódolók méretét az FP8 kvantálással
Modellek & LLM

Az NVIDIA 50%-kal csökkenti a CLIP-kódolók méretét az FP8 kvantálással

Az NVIDIA bejelentette, hogy az FP8 kvantálás segítségével akár 50%-kal csökkentheti a CLIP-kódolók méretét. Ez a technológia az NVIDIA TensorRT motorral kombinálva 1,39-1,45-szörös sebességnövekedést eredményez az FP16-hoz képest.

Nvidia Developer·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom