Home Hírek Kína DeepSeek kiadta továbbfejlesztett R1 mesterséges intelligencia modelljét, növelve ezzel az OpenAI-val...

Kína DeepSeek kiadta továbbfejlesztett R1 mesterséges intelligencia modelljét, növelve ezzel az OpenAI-val való versenyét

DeepSeek

A kínai mesterséges intelligencia (AI) start-up DeepSeek frissítette R1 logikai következtetés-modelljét. Ez növeli a versenyt az olyan amerikai vállalatokkal szemben, mint az OpenAI, jelentette ma a Reuters.

A kínai DeepSeek R1 modell mindenkit meglepetésként ért.

A DeepSeek új modelljét a Hugging Face fejlesztői platformon mutatta be. Azonban még nem tett közzé hivatalos bejelentést az új modellről, és nem tett közzé leírást vagy összehasonlítást sem.

A LiveCodeBench ranglistán, amely a mesterséges intelligencia modellek programozási teljesítményét hasonlítja össze, és amelyet a Kaliforniai Egyetem, a Massachusettsi Műszaki Intézet (MIT) és a Cornell Egyetem kutatói fejlesztettek ki, a frissített R1 érvelési modell csak kissé maradt el az OpenAI o4 mini és o3 modelleitől a kódgenerálás terén, megelőzve az xAI Grok 3 mini és az Alibaba Qwen 3 modelleit. Ez jelentős eredmény a kínai AI-szektor számára, mivel azt mutatja, hogy a kínai modellek a programkód-generálás igényes területén is felveszik a versenyt a világ legjobbjaival.

A DeepSeek megváltoztatja a játékszabályokat

A DeepSeek az év elején cáfolta azt a vélekedést, hogy az amerikai exportkorlátozások gátolják Kína fejlődését az AI területén, amikor olyan modelleket hozott forgalomba, amelyek ugyanolyan jók vagy jobbak voltak az amerikaiak legjobbjainál, és csak töredékükbe kerültek.

Az R1 modell piacra dobása januárban a Kínán kívüli technológiai részvények hirtelen esését okozta, és megkérdőjelezte azt a nézetet, hogy a mesterséges intelligencia terjeszkedéséhez hatalmas számítási teljesítményre és beruházásokra van szükség. A DeepSeek továbbra is várhatóan kiadja az R1 utódját, az R2-t. A Reuters márciusban forrásokra hivatkozva arról számolt be, hogy az R2 kiadását eredetileg májusra tervezték. A vállalat márciusban frissítette nagy nyelvi modelljét, a V3-at is.

A nyelvi modellek elsődleges célja a szövegek feldolgozása és generálása.Erősségeik közé tartozik a folyékony és természetes nyelv, képességeik között pedig a beszélgetés, a fordítás, az összefoglalás és a stílus. A logikai következtetés modellek elsősorban a problémamegoldásra és a pontos logikára összpontosítanak.

Erősségeik közé tartozik a helyes és szisztematikus érvelés, kevésbé hangsúlyozva a nyelvet. Nem csak arról van szó, hogy a válasz természetesen hangzik, hanem arról is, hogy logikailag helyes és átgondolt, és képes például matematikai problémákat megoldani vagy funkcionális kódot programozni.

Forrás: Reuters

LEAVE A REPLY

Please enter your comment!
Please enter your name here