Chiński start-up zajmujący się sztuczną inteligencją (AI) DeepSeek wypuścił aktualizację swojego modelu logicznego rozumowania R1. Zwiększa to presję konkurencyjną na amerykańskie firmy, takie jak OpenAI, poinformowała dziś agencja Reuters.
Chiński model DeepSeek R1 zaskoczył wszystkich
DeepSeek wprowadził swój nowy model na platformę programistów Hugging Face. Nie ogłosił jednak jeszcze publicznie informacji o nowym modelu, ani nie opublikował jego opisu lub porównania.
W rankingu LiveCodeBench, który porównuje wydajność modeli AI w programowaniu i został opracowany przez naukowców z Uniwersytetu Kalifornijskiego w Berkeley, Massachusetts Institute of Technology (MIT) i Cornell University, zaktualizowany model rozumowania R1 uplasował się tylko nieznacznie za modelami o4 mini i o3 firmy OpenAI w zakresie generowania kodu, wyprzedzając modele Grok 3 mini firmy xAI i Qwen 3 firmy Alibaba. Jest to znaczące osiągnięcie dla chińskiego sektora sztucznej inteligencji, ponieważ pokazuje, że chińskie modele dorównują najlepszym na świecie w wymagającej dziedzinie generowania kodu programowego.
DeepSeek zmienia zasady gry
DeepSeek obalił przekonanie, że amerykańskie kontrole eksportu hamują postępy Chin w dziedzinie sztucznej inteligencji, wprowadzając na rynek modele, które były równie dobre lub lepsze od najlepszych amerykańskich modeli, a to za ułamek ceny. Wprowadzenie modelu R1 spowodowało w styczniu gwałtowny spadek wartości akcji spółek technologicznych poza Chinami i podważyło pogląd, że rozwój AI wymaga ogromnej mocy obliczeniowej i inwestycji.
DeepSeek nadal ma wypuścić R2, następcę R1. Reuters podał w marcu, powołując się na źródła, że premiera R2 była pierwotnie planowana na maj. W marcu firma wypuściła również aktualizację swojego dużego modelu językowego V3.
Głównym celem modeli językowych jest przetwarzanie i generowanie tekstu.Ich mocne strony to płynność i naturalność języka, a możliwości obejmują konwersację, tłumaczenie, streszczanie i styl. Modele logicznego rozumowania koncentrują się przede wszystkim na rozwiązywaniu problemów i precyzyjnej logice. Ich mocne strony to poprawne i systematyczne rozumowanie, przy mniejszym nacisku na język. Nie chodzi tylko o to, aby odpowiedź brzmiała naturalnie, ale także o to, aby była logicznie poprawna i dobrze przemyślana oraz aby była w stanie rozwiązać problem matematyczny lub zaprogramować funkcjonalny kod.
Źródło: Reuters








