Wan3.0: 30 sekund wideo z PDF-a od 1,50 USDCzytaj →
News

DeepSeek V4-Pro: nowy cennik, rano 2x drożej

Nowe stawki DeepSeeka działają od 16 sierpnia. Szczyt wypada w Polsce na 8:00-12:00: ta sama sesja agentowa kosztuje 5,28 USD rano i 2,64 USD po południu.

Wykres słupkowy cen DeepSeek V4-Pro za milion tokenów: ciemne słupki stawek w godzinach szczytu dwukrotnie wyższe niż limonkowe słupki stawek poza szczytem

DeepSeek przestawił cennik API tak, że ta sama praca kosztuje różnie w zależności od godziny. Nowe stawki obowiązują od 16 sierpnia 2026 od 16:00 czasu UTC i dzielą dobę na dwie taryfy: godziny szczytu w pełnej cenie i całą resztę doby dokładnie o połowę taniej. Dla nas ma to konkretną konsekwencję, o której producent nie napisze: w polskim czasie letnim szczyt przypada między 3:00 a 6:00 oraz między 8:00 a 12:00. Poranek pracy w Polsce to najdroższe okno w całej dobie.

Nowy cennik: dwie taryfy w ciągu doby

Stawki za milion tokenów w dolarach: wejście to wszystko, co wysyłasz do modelu, wyjście to tekst, który model generuje. Nazwy modeli się nie zmieniły, dalej są to deepseek-v4-pro i deepseek-v4-flash.

Model i pozycja Szczyt Poza szczytem
V4-Pro, wejście bez cache 1,32 USD 0,66 USD
V4-Pro, wejście z cache 0,044 USD 0,022 USD
V4-Pro, wyjście 3,96 USD 1,98 USD
V4-Flash, wejście bez cache 0,44 USD 0,22 USD
V4-Flash, wejście z cache 0,014 USD 0,007 USD
V4-Flash, wyjście 1,32 USD 0,66 USD

Zasada jest prosta i taka sama w każdej pozycji: stawka poza szczytem to połowa stawki szczytowej. Najdroższą pozycją pozostaje wyjście modelu Pro, czyli tekst, który model generuje. W szczycie kosztuje 3,96 USD za milion tokenów, po godzinach schodzi do 1,98 USD. Trafienie w pamięć podręczną, czyli sytuacja, w której model znów dostaje ten sam fragment kontekstu, jest tańsze o kilka rzędów wielkości i pozostaje tanie o każdej porze.

Warto zestawić to z poprzednim cennikiem, który opisywaliśmy przy wejściu V4 do API. Wtedy Pro kosztował 0,435 USD za milion tokenów wejścia i 0,87 USD za milion wyjścia, bez żadnego podziału na godziny. Nowa taryfa poza szczytem jest od tamtej wyższa o połowę na wejściu i ponad dwukrotnie na wyjściu. W szczycie różnica sięga trzech razy na wejściu i ponad czterech na wyjściu. To nie jest obniżka rozpisana na godziny: to podwyżka z rabatem dla tych, którzy pracują wtedy, gdy serwery DeepSeeka mają luz.

Dlaczego to uderza akurat w polski poranek

Godziny szczytu w cenniku podane są w czasie UTC: 01:00-04:00 oraz 06:00-10:00. Cała pozostała część doby jest w taryfie tańszej. W Polsce mamy teraz czas letni, czyli UTC+2, więc trzeba dodać dwie godziny. Wychodzi szczyt od 3:00 do 6:00 i drugi, ten istotny, od 8:00 do 12:00.

Innymi słowy, klasyczny blok pracy przed lunchem mieści się w drogiej taryfie w całości. Wszystko po dwunastej, czyli popołudnie, wieczór i noc poza pasmem 3:00-6:00, liczy się o połowę taniej. Pamiętaj też, że po ostatniej niedzieli października wracamy na czas zimowy i wtedy okna przesuną się o godzinę wcześniej, na 2:00-5:00 i 7:00-11:00.

Policzmy to na konkretnym przykładzie. Dłuższa sesja z agentem, w której zużyjesz milion tokenów wejścia bez trafienia w cache i milion tokenów wyjścia na modelu Pro, kosztuje w szczycie 1,32 USD plus 3,96 USD, czyli 5,28 USD. Ta sama sesja odpalona o 13:00 to 0,66 USD plus 1,98 USD, czyli 2,64 USD. Na modelu Flash ta sama sesja to odpowiednio 1,76 USD i 0,88 USD.

Agenty i trzy poziomy wysiłku rozumowania

Nowe stawki weszły razem z aktualizacją ogłoszoną 13 sierpnia, w której DeepSeek skupił się na trybie agentowym, czyli na scenariuszach, gdzie model sam wykonuje ciąg kroków zamiast odpowiadać jednym akapitem. Ulepszenia działają i w aplikacji, i przez API.

Do tego doszedł przełącznik, którego wcześniej nie było. Oba modele V4 przyjmują teraz trzy poziomy wysiłku rozumowania (reasoning effort):

  • low: proste zadania, gdzie model nie musi się zastanawiać.
  • high: codzienna praca z agentem, poziom domyślny do większości roboty.
  • max: najtrudniejsze zadania, gdzie zależy Ci na jakości bardziej niż na rachunku.

Ten przełącznik ma bezpośredni związek z cennikiem, bo im wyższy poziom, tym więcej tokenów wyjścia model zużywa na własne rozumowanie. A wyjście jest najdroższą pozycją w tabeli.

Trzecia zmiana dotyczy podpięcia. DeepSeek obsługuje teraz natywnie Responses API od OpenAI, z optymalizacją pod Codex i konfiguracją jednym kliknięciem. W praktyce oznacza to, że w narzędziach mówiących językiem OpenAI, na czele z Codex CLI, można podstawić DeepSeeka w miejsce modelu OpenAI bez przepisywania integracji. Nazwy modeli zostały te same, więc nikt nie musi powtarzać ćwiczenia z lipca, kiedy znikały stare aliasy deepseek-chat i deepseek-reasoner.

Co to znaczy dla vibe codingu

Rada jest banalna w wykonaniu i policzalna w skutkach: cięższe rzeczy rób po dwunastej. Rano, kiedy i tak zwykle planujesz, czytasz i klikasz po interfejsie, korzystaj z modelu w krótkich zapytaniach. Długie sesje z agentem, przepisywanie całych modułów, generowanie testów czy przeczesanie dużego repozytorium wrzuć na popołudnie albo na wieczór. Za każdy dolar wydany w szczycie płacisz dokładnie dwa razy więcej niż za tę samą pracę o 13:00.

Skala oszczędności zależy od tego, ile realnie zużywasz. Jeśli spalasz na DeepSeeku 50 USD miesięcznie i cała ta praca dzieje się rano, przesunięcie jej na popołudnie zostawia w kieszeni 25 USD. Przy 200 USD to 100 USD. Nic tu nie trzeba konfigurować, wystarczy zmiana pory dnia.

Drugi wniosek dotyczy poziomu rozumowania. Skoro to wyjście kosztuje najwięcej, ustawienie max tam, gdzie wystarczy high, potrafi podnieść rachunek bardziej niż wybór złej godziny. Zacznij od poziomu niższego i podnoś go tylko wtedy, gdy model faktycznie nie daje rady z zadaniem.

Newsletter

Opanuj AI‑coding w 5 minut. W każdy poniedziałek.

Konkretne premiery, analizy cen i jeden trik, który przyspieszy Twoją pracę. Po polsku, bez żargonu, prosto na maila.

Zero spamu · wypisujesz się jednym kliknięciem.