Back to archive
#ai#news#models#aigen

DeepSeek V4.1-Flash. Obrazy, tańsze API i zastępstwo za V4-Pro

DeepSeek wydał V4.1-Flash, model przetwarzający tekst i obrazy, dostępny w API pod nazwą deepseek-flash. Premiera z 10 września przynosi też zmianę dla dotychczasowych klientów: nowy Flash zastępuje wcześniejsze wersje Flasha w API DeepSeek, a wkrótce przejmie również żądania kierowane do V4-Pro.

Według karty modelu nowa architektura uruchamia 8 mld parametrów przy przetwarzaniu wejścia i 16 mld przy generowaniu odpowiedzi. Producent podaje też czterokrotnie mniejsze zapotrzebowanie globalnej pamięci podręcznej KV na pamięć HBM niż w V4-Flash. KV przechowuje wyniki obliczeń dla wcześniejszych tokenów, więc jej rozmiar ma znaczenie przy długiej historii pracy agenta. Wagi udostępniono na licencji MIT.

Dokumentacja API podaje kontekst 1 mln tokenów i limit odpowiedzi 384 tys. W godzinach szczytu milion tokenów kosztuje 0,30 USD na wejściu, 0,006 USD przy trafieniu w pamięć podręczną oraz 1,20 USD na wyjściu. Poza szczytem stawki są o połowę niższe. Szczyt przypada od poniedziałku do piątku w godzinach 01:00–04:00 i 06:00–10:00 UTC.

Co stanie się z procesami zbudowanymi na Pro

Nazwy deepseek-v4-flash i deepseek-v4-flash-vision-exp już kierują do V4.1-Flash. Od 14 września, godz. 06:00 czasu polskiego, wszystkie żądania do API DeepSeek z model="deepseek-v4-pro" mają również trafiać do V4.1-Flash, aż do premiery V4.1-Pro, z rozliczeniem według cen Flasha. Potwierdzają to zarówno komunikat, jak i przypis do cennika. Ten harmonogram dotyczy usługi DeepSeek; nie określa polityki innych dostawców hostujących modele.

To ryzyko dla procesów przetestowanych na Pro: nazwa w konfiguracji pozostanie ta sama, ale odpowiedzi będzie generował inny model. Zgodność formatu API nie gwarantuje zachowania tych samych decyzji, argumentów wywołań narzędzi czy liczby kroków agenta. Lepsze wyniki w testach producenta nie zastępują sprawdzenia własnego procesu, zwłaszcza gdy agent sam wykonuje operacje w zewnętrznych systemach.

W komunikacie i specyfikacji pola model nie opisano sposobu pozostania przy dotychczasowym V4-Pro po tej dacie. Dlatego przed przełączeniem warto uruchomić reprezentatywne przypadki na deepseek-flash i porównać wyniki oraz wykonane działania z Pro. Sam komunikat nie dowodzi awarii istniejących procesów; zapowiada jednak zmianę modelu bez zmiany kodu klienta.

Źródła

Wykorzystuję treści generowane przez AI jako część mojego codziennego procesu nauki.