Aktualności, narzędzia i prawo AIPolska · codziennie
Biznes

DeepSeek V4.1 Flash - cena API w złotych, możliwości i ryzyka dla firm

DeepSeek wydał V4.1 Flash, otwarty model na licencji MIT z oknem 1 mln tokenów. Liczymy koszt API w złotych, godziny tańszych stawek w Polsce i ryzyka dla firm z UE.

Widok z drona na terminal kontenerowy w porcie w Gdańsku o świcie
Ilustracja redakcyjna dailyAI

DeepSeek V4.1 Flash to model udostępniony 10 września 2026 roku w API DeepSeek i jako otwarte wagi na licencji MIT. W godzinach szczytu kosztuje 0,30 USD za milion tokenów wejściowych i 1,20 USD za milion wyjściowych, a poza szczytem połowę tej kwoty. Obsługuje obraz, tekst i kontekst do 1 mln tokenów. Dane w API są przetwarzane w Chinach.

Co zmienia DeepSeek V4.1 Flash

DeepSeek V4.1 Flash zastępuje dotychczasowe modele V4 Flash i tymczasowo także V4 Pro. Według komunikatu z 10 września 2026 roku nowy model wyprzedza V4 Pro pod względem wyników, kosztu, szybkości i czasu wykonania zadań. To deklaracja producenta, którą warto sprawdzić na własnych danych.

Model zbudowano w architekturze MoE (mixture of experts), w której przy każdym zapytaniu pracuje tylko część parametrów. Ma 552 mld parametrów, z czego 8 mld jest aktywnych przy przetwarzaniu wejścia i 16 mld przy generowaniu odpowiedzi. DeepSeek podaje, że pamięć podręczna KV zajmuje czterokrotnie mniej pamięci HBM i ośmiokrotnie mniej miejsca na dyskach SSD niż w poprzedniej generacji.

Model obsługuje natywnie obraz i tekst, tryb rozumowania (thinking mode), odpowiedzi w formacie JSON i wywoływanie narzędzi. Okno kontekstu wynosi 1 mln tokenów, a maksymalna długość odpowiedzi 384 tys. tokenów. Według cennika API DeepSeek jest też zgodne z formatem API Anthropic, co ułatwia podmianę modelu w istniejących integracjach.

Ile kosztuje DeepSeek V4.1 Flash w złotych

Cennik rozróżnia godziny szczytu i pozostały czas, a poza szczytem obowiązuje 50 proc. stawki. Przeliczenie według średniego kursu NBP z 25 września 2026 roku (1 USD = 3,8404 zł), bez VAT. Ceny dotyczą modelu deepseek-flash za milion tokenów:

  • Wejście z trafieniem w pamięć podręczną: 0,006 USD (ok. 0,02 zł) w szczycie, 0,003 USD (ok. 0,01 zł) poza szczytem.
  • Wejście bez pamięci podręcznej: 0,30 USD (ok. 1,15 zł) w szczycie, 0,15 USD (ok. 0,58 zł) poza szczytem.
  • Wyjście: 1,20 USD (ok. 4,61 zł) w szczycie, 0,60 USD (ok. 2,30 zł) poza szczytem.
  • Dla porównania deepseek-v4-pro w cenniku: 1,32 USD (ok. 5,07 zł) za wejście i 3,96 USD (ok. 15,21 zł) za wyjście w szczycie.

Godziny szczytu w polskim czasie

DeepSeek wyznacza szczyt od poniedziałku do piątku w godzinach 01:00-04:00 i 06:00-10:00 UTC, z wyłączeniem chińskich świąt. Do 25 października 2026 roku, gdy w Polsce obowiązuje czas letni, oznacza to 03:00-06:00 i 08:00-12:00. Po zmianie czasu szczyt przypada na 02:00-05:00 i 07:00-11:00.

Dla polskiej firmy wniosek jest praktyczny: przedpołudnie w dni robocze to najdroższa pora. Zadania wsadowe, na przykład nocne przetwarzanie dokumentów czy generowanie opisów produktów, wystarczy uruchomić po południu lub w weekend, by płacić połowę stawki.

Scenariusz kosztów dla polskiego sklepu internetowego

Przykładowy sklep co miesiąc przetwarza 50 mln tokenów wejściowych bez pamięci podręcznej i generuje 10 mln tokenów odpowiedzi, np. opisy produktów i odpowiedzi na pytania klientów. W godzinach szczytu kosztowałoby to 27 USD, czyli ok. 104 zł miesięcznie bez VAT. Ta sama praca poza szczytem to 13,50 USD, czyli ok. 52 zł.

Przy takich kwotach o wyborze modelu częściej decydują jakość po polsku, ochrona danych i stabilność usługi niż sama cena. Opłata za tokeny to tylko część kosztu: dochodzą praca nad integracją, kontrola wyników i obsługa błędów.

Wyniki testów i otwarte wagi

Karta modelu na Hugging Face podaje m.in. 74,1 proc. w MMLU-Pro, 79,4 proc. w HumanEval, 93,0 proc. w GSM8K, 74,2 proc. rozwiązanych zadań w DeepSWE v1.1 i 90,6 proc. w Terminal-Bench 2.1. To wyniki producenta, a testy prowadzono głównie po angielsku, więc nie mówią wiele o jakości pracy na polskich tekstach.

Wagi modelu są dostępne na licencji MIT, co pozwala uruchomić go na własnych serwerach, np. przez vLLM lub SGLang. Przy 552 mld parametrów wymaga to jednak poważnej infrastruktury GPU. W API model nazywa się deepseek-flash, a stare nazwy deepseek-v4-flash i deepseek-v4-flash-vision-exp są tymczasowo przekierowywane.

Ryzyka, RODO i znaczenie dla firm w Polsce

Najważniejsze ograniczenie dotyczy danych. Polityka prywatności DeepSeek, zaktualizowana 10 lutego 2026 roku, mówi wprost, że firma zbiera, przetwarza i przechowuje dane osobowe w Chińskiej Republice Ludowej. Polityka ma osobną część dla EOG i wskazuje przedstawiciela w UE, firmę Prighter Group, ale przekazywanie danych do Chin wymaga od polskiej firmy własnej oceny prawnej.

W ocenie redakcji dailyAI firmy z UE mają trzy realne ścieżki. Pierwsza to API DeepSeek do danych, które nie zawierają informacji osobowych ani tajemnic handlowych. Druga to otwarte wagi uruchomione na własnej infrastrukturze lub u dostawcy chmury w UE, co eliminuje przesył do Chin. Trzecia to rezygnacja z modelu w procesach z danymi klientów.

Trzeba też pamiętać o zmianach technicznych. Przekierowanie deepseek-v4-pro do V4.1 Flash od 14 września 2026 roku jest tymczasowe i ma trwać do premiery V4.1 Pro, a stare nazwy modeli mogą przestać działać. Integracje warto od razu przełączyć na nazwę deepseek-flash.

Źródła i data sprawdzenia

  1. DeepSeek-V4.1-Flash ReleaseDeepSeek API Docs, publikacja: 2026-09-10, sprawdzono: 2026-09-26
  2. Models & PricingDeepSeek API Docs, publikacja: 2026-09-10, sprawdzono: 2026-09-26
  3. DeepSeek-V4.1-Flash model cardHugging Face / DeepSeek, publikacja: 2026-09-10, sprawdzono: 2026-09-26
  4. DeepSeek Privacy PolicyDeepSeek, publikacja: 2026-02-10, sprawdzono: 2026-09-26
  5. Kurs średni USD, tabela 187/A/NBP/2026Narodowy Bank Polski, publikacja: 2026-09-25, sprawdzono: 2026-09-26
Nota redakcyjna

Artykuł ma charakter informacyjny. Przy decyzjach prawnych, finansowych lub organizacyjnych warto zweryfikować wnioski w odniesieniu do konkretnej sytuacji.