DeepSeek V4: Otwarty model, który jest tańszy, dłuższy i może nawet na Huawei
Model V4 od DeepSeek jest tańszy, mądrzejszy i ma dłuższy kontekst niż kiedykolwiek - i może właśnie pomóc Chinom porzucić Nvidię na rzecz Huawei, token po tokenie.
24 kwietnia chińska firma AI DeepSeek wypuściła V4, swój długo wyczekiwany nowy flagowy model, i szczerze mówiąc, to całkiem duża sprawa - nawet jeśli nie wstrząśnie światem AI tak jak jego poprzednik R1. V4 może przetwarzać znacznie dłuższe prompty dzięki sprytnemu nowemu projektowi, jest open source (więc każdy może go pobrać, używać i modyfikować) i robi hałas z powodów wykraczających poza same benchmarki.
Po pierwsze, cena. DeepSeek twierdzi, że wydajność V4 dorównuje najlepszym modelom za ułamek kosztów, co jest świetną wiadomością dla deweloperów, którzy nie chcą zastawiać swoich startupów, aby zapłacić za AI. V4 występuje w dwóch wariantach: V4-Pro, większy model do kodowania i złożonych zadań, oraz V4-Flash, mniejsza i szybsza wersja. Oba mają tryby rozumowania, które pozwalają modelowi pokazać swoją pracę, jak nauczyciel matematyki, któremu naprawdę zależy. Ceny? V4-Pro kosztuje 1,74 USD za milion tokenów wejściowych i 3,48 USD za milion tokenów wyjściowych - to pestka w porównaniu z OpenAI i Anthropic. V4-Flash jest jeszcze tańszy - około 0,14 USD za milion tokenów wejściowych i 0,28 USD za milion tokenów wyjściowych, co czyni go jednym z najtańszych modeli z najwyższej półki. To taki poziom cenowy, że ma się ochotę zbudować aplikację tylko dlatego, że można.
Jeśli chodzi o wydajność, V4 to ogromny skok w porównaniu z R1, co jest mniej więcej tak zaskakujące, jak odkrycie, że woda jest mokra. W głównych benchmarkach V4-Pro dorównuje Claude-Opus-4.6 od Anthropic, GPT-5.4 od OpenAI i Gemini-3.1 od Google, a także pokonuje otwartych rywali, takich jak Qwen-3.5 od Alibaba i GLM-5.1 od Z.ai, w kodowaniu, matematyce i problemach STEM. Świetnie radzi sobie również w agentowych zadaniach kodowania i wieloetapowym rozwiązywaniu problemów. Wewnętrzna ankieta DeepSeek wśród 85 deweloperów? Ponad 90% umieściło V4-Pro w swoich najlepszych wyborach do kodowania. A dla entuzjastów agentów, V4 jest zoptymalizowany pod kątem frameworków takich jak Claude Code, OpenClaw i CodeBuddy - bo kto nie chce, żeby jego AI miało pomocnika?
A teraz sprawa długiego kontekstu. Obie wersje V4 obsługują 1 milion tokenów - wystarczająco, aby zmieścić wszystkie trzy tomy Władcy Pierścieni i Hobbita razem wzięte. To dużo hobbitów. Ale prawdziwą innowacją jest to, jak DeepSeek to osiągnął: zmodyfikowali mechanizm uwagi, aby był bardziej selektywny, kompresując starsze informacje i skupiając się na tym, co jest teraz ważne. To zmniejsza moc obliczeniową do 27% i pamięć do 10% w porównaniu z poprzednim modelem V3.2 w kontekście 1 miliona tokenów (V4-Flash zużywa tylko 10% mocy obliczeniowej i 7% pamięci). Oznacza to, że możesz zbudować asystenta kodowania AI, który czyta całą twoją bazę kodu, nie zapominając, co przeczytał pięć minut temu.
A teraz geopolityka. V4 to pierwszy model DeepSeek zoptymalizowany pod kątem rodzimych chińskich chipów, a konkretnie Huawei Ascend. To ważne, ponieważ jest to test, czy Chiny mogą uniezależnić się od Nvidii. Amerykańskie kontrole eksportu odcięły chińskie firmy od najlepszych chipów Nvidii, więc Pekin naciska na rodzimy stos AI. Podobno DeepSeek udzielił wczesnego dostępu tylko chińskim producentom chipów, a Huawei ogłosił w piątek, że jego superwęzły Ascend 950 będą obsługiwać V4. Ale nie wybiegajmy w przyszłość: raport techniczny DeepSeek sugeruje, że używają chińskich chipów do wnioskowania, ale trenowanie może nadal opierać się na Nvidii. Profesor Tsinghua Liu Zhiyuan powiedział MIT Technology Review, że tylko część treningu V4 została dostosowana do chińskich chipów, a wiele anonimowych źródeł stwierdziło, że chińskie chipy są lepsze do wnioskowania niż do trenowania. Mimo to DeepSeek twierdzi, że ceny V4-Pro mogą znacznie spaść, gdy superwęzły Ascend 950 od Huawei zaczną być dostarczane na masową skalę w drugiej połowie tego roku.
Więc, czy V4 wstrząśnie światem jak R1? Prawdopodobnie nie, ale to znak, że Chiny budują równoległą infrastrukturę AI - i robią to z ceną, która sprawi, że zrobisz podwójne spojrzenie.
The Good Times
Wiadomości w Twojej skrzynce.
Sardoniczne podsumowanie, dostarczane według Twojego harmonogramu. Bezpłatnie. Zrezygnuj kiedy chcesz.
Już subskrybujesz, ale nigdy do Ciebie nie docieramy? Zajrzyj do folderu spam i kliknij 'To nie spam' (lub 'Usuń ze spamu'), żeby wyciągnąć nas z czyśćca niechcianej poczty. Przy okazji pomożesz wszystkim innym.
Jeśli przez miesiąc nie otworzysz żadnego z naszych e-maili, zostaniesz automatycznie usunięty z listy.
Rewrite Article
Select parts to regenerate with a fresh AI pass. Translations will be updated automatically.
Generate AI Image
Creates a sardonic version of the article image using OpenAI.