DeepSeek wprowadza bardzo tani model AI, zwiększając presję na amerykańskie laboratoria
Chiński startup AI DeepSeek, rozwijający modele na otwartych zasadach, udostępnił dziś model V4.1-Flash. Oferuje on tokeny (jednostki tekstu) po znacznie niższej cenie niż porównywalne modele amerykańskich firm.
DeepSeek poinformował również, że nowy model wymaga tylko części pamięci o dużej przepustowości (HBM) oraz przestrzeni na dyskach SSD potrzebnych w przypadku innych modeli. V4.1-Flash stanowi nowe wyzwanie dla czołowych amerykańskich laboratoriów AI, takich jak OpenAI, Anthropic i Google DeepMind.
Coraz więcej amerykańskich firm korzysta już z chińskich modeli AI rozwijanych na otwartych zasadach ze względu na niższe koszty. Według głównego ekonomisty BCA Petera Berezina pod koniec 2025 roku modele amerykańskie odpowiadały za około 80% tokenów przetwarzanych przez 50 najpopularniejszych modeli AI. Udział modeli chińskich wynosił wtedy mniej niż 20%.
Do sierpnia 2026 roku proporcje się odwróciły. Modele chińskie odpowiadały za ponad 60% zużycia tokenów, a udział modeli amerykańskich spadł poniżej 40%.
Jednocześnie amerykańskie agencje wywiadowcze zarzuciły dużym chińskim firmom AI, w tym DeepSeek i Moonshot AI, że systematycznie pozyskują zastrzeżone dane z amerykańskich modeli i wykorzystują je do trenowania własnych systemów.
„Przedstawiamy najmniejszy model w naszej nowej rodzinie architektur, wyposażony w natywne rozumienie obrazu” – napisał DeepSeek w czwartek na platformie X. „Został zaprojektowany z myślą o większych możliwościach, szybszym wnioskowaniu, wyższej przepustowości oraz skalowaniu do większych modeli”.
Model ma 552 mld parametrów, czyli zmiennych wykorzystywanych przez sztuczną inteligencję do przetwarzania informacji. Korzysta z nowej, przyczynowej architektury kodera-dekodera. Podczas przetwarzania danych wejściowych aktywnych jest tylko 8 mld parametrów, a przy generowaniu odpowiedzi – 16 mld.
W porównaniu z poprzednią generacją pamięć podręczna KV modelu V4.1-Flash wymaga jednej czwartej ilości pamięci HBM oraz jednej ósmej przestrzeni na dysku SSD – podał DeepSeek.
Nowy model jest już dostępny za pośrednictwem interfejsu API DeepSeek, który pozwala innym aplikacjom korzystać z jego funkcji.
Z danych przedstawionych przez DeepSeek wynika, że V4.1-Flash osiągnął lepsze wyniki niż Anthropic Opus 5 i OpenAI GPT 5.6-Sol w wybranych testach porównawczych. Dotyczyło to testów DeepSWE v1.1, CyberGym i Automation-Bench. Modele Anthropic i OpenAI uzyskały jednak lepsze wyniki od V4.1-Flash w teście Terminal Bench 3.0.
Zobacz nasze centrum wiedzy o Sektory i technologia▸ Komentarze (0)
Brak komentarzy. Bądź pierwszy/pierwsza — daj znać co myślisz.