DeepSeek Vision and Grok Imagine models are now live on CometAPI →
new/Badania CometAPI

DeepSeek-V4.1 już wkrótce: oczekiwane specyfikacje, benchmarki i funkcje

DeepSeek-V4.1 jest interesujący właśnie dlatego, że obecny cykl V4 pokazuje, że DeepSeek może uczynić tę rodzinę istotnie silniejszą.

CometAPI
AnnaZespół badań AI modeli i API
Zaktualizowano Aug 23, 2026 10 min czyt.
DeepSeek-V4.1 już wkrótce: oczekiwane specyfikacje, benchmarki i funkcje
Użyj tego wzorca

Wykonaj pierwsze wywołanie API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

Rodzina DeepSeek V4 wyszła już poza pierwotny etap wersji zapoznawczej. DeepSeek V4 Flash wszedł do publicznej bety jako V4-Flash-0731 31 lipca, natomiast DeepSeek V4 Pro osiągnął GA jako V4-Pro-0813 13 sierpnia w APP, Web i API. Oba modele zachowują projekt kontekstu o jednym milionie tokenów oraz architekturę MoE charakterystyczną dla rodziny V4; Flash jest zoptymalizowany pod kątem efektywności, a Pro pozycjonowany jako model o wyższych możliwościach wnioskowania i Agent.

Wydanie Pro GA istotnie podnosi punkt odniesienia dla wszelkich prognoz V4.1. DeepSeek podaje, że kompilacja GA przynosi znacząco wzmocnione możliwości Agenta, szczególnie w środowiskach produkcyjnych, a obecnie zarówno V4-Pro, jak i V4-Flash mają natywną obsługę Responses API oraz poziomy nakładu myślenia: low, high i max. Obecna wersja modelu API jest wyraźnie wskazana jako DeepSeek-V4-Pro-0813. Gdzie więc mieści się teraz DeepSeek V4.1? Majowy raport The Information mówił, że DeepSeek planował czerwcowe wydanie V4.1 ze wzmocnionymi narzędziami dla przedsiębiorstw i obsługą multimodalną. Ten okres minął, a aktualny dziennik wydań DeepSeek wciąż nie zawiera karty modelu V4.1 ani wpisu o wydaniu. Najbezpieczniejsza interpretacja to zatem możliwa iteracja V4 po GA, której zgłaszane cele mogą nadal pojawić się pod nazwą V4.1 lub poprzez dodatkowe aktualizacje V4.

DeepSeek-V4.1 już wkrótce: oczekiwane specyfikacje, benchmarki i funkcje

Potwierdzone kamienie milowe korzystają z dziennika zmian DeepSeek; wcześniejszy czerwcowy plan V4.1 pochodzi z The Information.

Czym jest DeepSeek-V4.1?

DeepSeek-V4.1 najlepiej rozumieć jako niepotwierdzoną iterację V4 po GA, a nie oficjalnie wydany model DeepSeek. Rodzina V4 ma już produkcyjny punkt kontrolny w V4-Pro-0813, więc V4.1 stanowiłby teraz aktualizację możliwości w środku cyklu, a nie krok konieczny do ukończenia pierwotnego wdrożenia V4. DeepSeek nie opublikował karty modelu V4.1, raportu technicznego, dziennika zmian API ani tabeli benchmarków.

PytanieObecna odpowiedźPewność
Czy DeepSeek oficjalnie ogłosił „V4.1”?Nie. Aktualny dziennik wydań DeepSeek nie ma wpisu V4.1 ani karty modelu.Wysoka
Czy zgłaszano wydanie V4.1?Tak. The Information zgłosiło czerwcowy plan z narzędziami dla firm i obsługą multimodalną.Średnia
Czy czerwcowe okno się zrealizowało?Nie pojawiło się osobne oficjalne wydanie V4.1 w tym okresie.Wysoka
Jaki jest najnowszy potwierdzony kamień milowy V4?V4-Flash-0731 wszedł do publicznej bety 31 lipca, a V4-Pro-0813 osiągnął GA 13 sierpnia.Wysoka
Czy V4.1 może nadal wystartować jako osobny model?Tak, ale nazwa, specyfikacja i harmonogram pozostają niepotwierdzone.Niska/Średnia

Oczekiwane specyfikacje DeepSeek-V4.1

Ponieważ DeepSeek nie opublikował specyfikacji V4.1, poniższa tabela rozdziela potwierdzone obecne możliwości V4 od kierunkowych oczekiwań. „Oczekiwane” oznacza rozsądny ciąg dalszy V4 lub możliwość zgłaszaną przez media, a nie oficjalną specyfikację V4.1.

WymiarV4-Flash-0731V4-Pro-0813DeepSeek-V4.1 (oczekiwane)
Rodzina modeliV4V4Prawdopodobnie iteracja rodziny V4
ArchitekturaMoE pochodne od V4, hybrydowa uwagaMoE pochodne od V4; GA zbudowane na strukturze PreviewPrawdopodobnie pochodna V4; niepotwierdzone
Parametry całkowite/aktywne284B / 13B1.6T / 49BNieznane; brak wiarygodnej liczby publicznej
Okno kontekstu1M1MPrawdopodobnie co najmniej poziom V4
Maksymalne wyjście384K maksimum API384K maksimum APINieznane
Nakład myśleniaLow / high / maxLow / high / maxOczekiwane zachowanie lub rozszerzenie obecnych kontroli
Responses APIObsługiwaneObsługiwaneOczekiwane, jeśli zbudowane na obecnym stosie V4
Natywne wejście obrazu/plikuNieobsługiwane w obecnym Responses APINieobsługiwane w obecnym Responses APIZgłaszany kierunek multimodalny; niepotwierdzone
Narzędzia Enterprise/AgentFunctions, web search, apply_patch / wsparcie CodexFunctions, web search, apply_patch / wsparcie CodexZgłaszany obszar nacisku; rozszerzenie MCP niepotwierdzone
Otwarte wagiTakTak, dostępne wagi V4-Pro-0813Możliwe dla osobnego punktu kontrolnego V4.1; niepotwierdzone
Status oficjalnyPubliczna beta APIGABrak oficjalnej daty wydania lub karty modelu

Co może być nowe w DeepSeek-V4.1?

Silniejsze agentowe kodowanie bez większego modelu

Najsilniejszym dowodem na to, co nastąpi po V4, jest obecnie aktualizacja V4-Pro-0813 GA. DeepSeek podaje, że możliwości Agenta znacznie poprawiły się w środowiskach produkcyjnych, z Terminal Bench 2.1 na poziomie 87.9, NL2Repo 61.5 i DeepSWE 62.7. V4-Flash-0731 już wcześniej pokazał, że same działania po-treningowe mogą przynieść duże przyrosty możliwości Agenta bez zmiany architektury lub rozmiaru modelu.

Jeśli V4.1 jest aktualizacją w środku cyklu, realistycznym celem nie jest już po prostu „lepsze niż V4 Preview”. Musiałby zachować lub przekroczyć punkt odniesienia Agenta V4-Pro-0813, jednocześnie poprawiając wykonanie o długim horyzoncie w oprogramowaniu, niezawodność na poziomie repozytorium, orkiestrację narzędzi i spójność w produkcji.

Lepsze użycie narzędzi i pełniejsze API Agenta

Obecny stos V4 DeepSeek zapewnia już zarówno Flash, jak i Pro obsługę Responses API i jest specjalnie dostosowany do Codex. Tabela zgodności Responses API wspiera wywołania funkcji i wyszukiwanie w sieci po stronie serwera, podczas gdy file_search, code_interpreter, computer_use oraz typy narzędzi MCP są nadal ignorowane. To sprawia, że szersze pokrycie narzędzi enterprise jest dla V4.1 wyraźniejszą szansą niż samo dodanie Responses API.

Natywna obsługa MCP pozostaje wiarygodnym kierunkiem ulepszeń, ale nadal jest niepotwierdzona. Obronna teza dla V4.1 to głębsza integracja enterprise i Agenta na bazie powierzchni API, która już obsługuje Responses, przepływy pracy zorientowane na Codex, strukturyzowane wyjście i wywołania narzędzi.

Multimodalne wejście może być największym ulepszeniem na poziomie produktu

The Information informowało, że planowano V4.1 z obsługą multimodalną. Pozostaje to najjaśniejszym możliwym wyróżnikiem na poziomie produktu, ponieważ obecne Responses API DeepSeek wskazuje, że wejścia obrazu i plików nie są obsługiwane. Jeśli przyszły punkt kontrolny V4.1 doda natywne rozumienie wizualne lub plików, rozszerzy to DeepSeek o przepływy pracy związane z dokumentami, zrzutami ekranu i wizualnym programowaniem, których obecne API oparte wyłącznie na tekście nie obsługuje.

Dopóki DeepSeek nie opublikuje karty modelu V4.1 lub schematu API, dokładne modalności, limity rozdzielczości, zachowanie audio/wideo i benchmarki multimodalne powinny pozostać oznaczone jako nieznane.

Wydajność czołowa przy koszcie na poziomie DeepSeek

Niski koszt inferencji pozostaje jednym z najbardziej wyróżniających atutów DeepSeek, ale oficjalne ceny zmieniły się wraz z pełnym wdrożeniem V4. Obecna tabela cen używa stawek szczytowych/pozaszczytowych: wejście V4-Flash cache-miss kosztuje $0.22 poza szczytem / $0.44 w szczycie, a wyjście $0.66 / $1.32 za 1M tokenów; wejście V4-Pro kosztuje $0.66 / $1.32, a wyjście $1.98 / $3.96. Stawki poza szczytem są o połowę niższe od stawek szczytowych.

Oczekiwana wydajność benchmarkowa DeepSeek-V4.1

Wciąż brak oficjalnych wyników benchmarków V4.1. Najsilniejszym obecnym punktem odniesienia w rodzinie V4 jest teraz DeepSeek-V4-Pro-0813 GA, który zastępuje Pro Preview jako punkt odniesienia dla wydajności Agenta. DeepSeek raportuje 87.9 na Terminal Bench 2.1, 61.5 na NL2Repo, 83.3 na Cybergym, 62.7 na DeepSWE i 74.1 na Toolathlon-Verified, wraz ze wzrostami na AutomationBench i DSBench.

DeepSeek-V4.1 już wkrótce: oczekiwane specyfikacje, benchmarki i funkcje

Rysunek 6. Oficjalne wartości benchmarków Agenta DeepSeek-V4-Pro-0813 GA, zwizualizowane na podstawie dziennika zmian DeepSeek.

BenchmarkV4-Pro-0813V4-Flash-0731V4-Pro Preview
Terminal Bench 2.187.982.772.1
NL2Repo61.554.238.5
Cybergym83.376.752.7
DeepSWE62.754.412.8
Toolathlon-Verified74.170.355.9
Agents' Last Exam25.725.216.5
AutomationBench (Public)31.825.112.8
DSBench-FullStack71.168.7
DSBench-Hard67.259.6

DeepSeek-V4.1 już wkrótce: oczekiwane specyfikacje, benchmarki i funkcje

Rysunek 7. V4-Pro-0813 versus V4-Flash-0731 na wspólnych benchmarkach Agenta. Wartości pochodzą z dziennika zmian DeepSeek; harness oraz ustawienia rozumowania mogą wpływać na porównania między modelami.

Postęp sugeruje trzy oczekiwania oparte na dowodach dla V4.1. Po pierwsze, znaczące wydanie V4.1 powinno co najmniej zachować punkt odniesienia V4-Pro-0813 GA, a nie tylko pobić starą wersję Preview. Po drugie, DeepSeek nadal wydobywa zyski poprzez działania po-treningowe i optymalizację Agenta, a nie wyłącznie skalowanie liczby parametrów. Po trzecie, najbardziej wartościowym ulepszeniem V4.1 może być szersza multimodalna i narzędziowa zdolność enterprise, jeśli podstawowa wydajność Agenta jest już blisko szczytu założeń projektowych V4.

DeepSeek-V4.1 vs V4-Flash vs V4-Pro

WymiarV4-Flash-0731V4-Pro-0813DeepSeek-V4.1 oczekiwane
PozycjonowanieSzybki, efektywny model Agenta/kodowaniaObecny model V4 o wyższych możliwościach wnioskowania/AgentaMożliwa aktualizacja możliwości V4 w środku cyklu
Skala284B całkowite / 13B aktywne1.6T całkowite / 49B aktywneNieznane
Kontekst1M1MPrawdopodobnie co najmniej 1M, jeśli pochodny od V4
Agentowe kodowanieBardzo silne po post-treningu 0731Najsilniejszy obecny oficjalny punkt odniesienia Agenta V4Oczekiwane spełnienie lub przekroczenie progu Pro GA
Nakład myśleniaLow / high / maxLow / high / maxOczekiwane zachowanie lub rozszerzenie kontroli
Responses APIObsługiwaneObsługiwaneOczekiwane, jeśli zbudowane na obecnym stosie V4
Multimodalne wejścieBrak wejścia obrazu/pliku w obecnym Responses APIBrak wejścia obrazu/pliku w obecnym Responses APIZgłaszana możliwość; niepotwierdzone
Oficjalny koszt APINiższy poziom V4; ceny szczytowe/pozaszczytoweWyższy poziom V4; ceny szczytowe/pozaszczytoweNieznane
StatusOficjalne wydanie API w publicznej becieGANieogłoszone przez DeepSeek

Do czego będzie używany DeepSeek-V4.1?

Jeśli zgłaszany kierunek się utrzyma, V4.1 byłby najbardziej atrakcyjny tam, gdzie obecna rodzina V4 jest już silna, ale nadal brakuje jej szerszych możliwości produktowych.

  1. Repozytoryjne agentowe kodowanie. Długokontextowe rozumienie kodu, generowanie łatek, pętle testowe i wykonanie w terminalu to najjaśniejsze dopasowanie przy uwzględnieniu przyrostów Agenta V4-Pro-0813 i Flash-0731.
  2. Badania enterprise i przepływy pracy z dokumentami. Bazowy kontekst 1M, obsługa Responses API i integracja z siecią/narzędziami mogą obsługiwać duże wewnętrzne zbiory wiedzy, zbiory polityk i dokumentację techniczną. V4.1 stałby się tu bardziej użyteczny, jeśli doda bogatsze narzędzia wyszukiwania lub pracy z plikami.
  3. Kosztowo wrażliwe autonomiczne agenty. V4-Flash pozostaje szczególnie atrakcyjny dla powtarzalnego planowania i pętli wywołań narzędzi, podczas gdy V4-Pro oferuje wyższy poziom możliwości. V4.1 byłby przekonujący, jeśli zachowa tę dyscyplinę kosztową.
  4. Analiza wizualnych dokumentów i zrzutów ekranu. Staje się to ważnym natywnym przypadkiem użycia tylko wtedy, gdy zgłaszana multimodalna zdolność zostanie formalnie dostarczona.
  5. Prywatne lub dostosowane wdrożenia. DeepSeek udostępnił wagi V4-Pro-0813 i V4-Flash-0731, więc osobno wydany punkt kontrolny V4.1 mógłby pozostać atrakcyjny dla organizacji potrzebujących self-hostingu lub adaptacji domenowej. Dostępność otwartych wag dla samego V4.1 nie jest potwierdzona.

Czego wciąż nie wiemy

Największym ryzykiem przy pisaniu artykułu „wkrótce” jest zamienienie wiarygodnej ekstrapolacji w fałszywą specyfikację. Te punkty powinny pozostać wyraźnie otwarte, dopóki DeepSeek nie opublikuje materiałów pierwszej ręki:

  • Czy „DeepSeek-V4.1” będzie oficjalną nazwą modelu.
  • Czy V4.1 jest odrębnym punktem kontrolnym, czy osobną etykietą dla ulepszeń wykraczających poza V4-Flash-0731 i V4-Pro-0813.
  • Całkowita liczba parametrów, liczba aktywnych parametrów oraz wszelkie zmiany architektoniczne.
  • Dokładne wejścia multimodalne i to, czy obsługiwane są obrazy, audio, wideo lub pliki.
  • Natywna obsługa MCP, computer-use, file-search lub code-interpreter.
  • Oficjalne wyniki benchmarków i ustawienia ewaluacyjne.
  • Ceny API, dostępność otwartych wag i warunki komercyjne dla osobnego punktu kontrolnego V4.1. Twarda data wydania.

Uwagi końcowe

DeepSeek-V4.1 jest interesujący właśnie dlatego, że obecny cykl V4 pokazuje, iż DeepSeek potrafi znacząco wzmocnić rodzinę bez wprowadzania całkowicie nowej architektury. Aktualizacja post-treningowa Flash-0731 przyniosła duże przyrosty możliwości Agenta, a wydanie Pro-0813 GA podniosło ten punkt odniesienia ponownie, dodając natywną obsługę Responses API i bardziej elastyczny nakład myślenia.

Najbardziej wiarygodna teza dla V4.1 to zatem nie „tajemniczy nowy model z bilionem parametrów”. To bardziej dojrzałe V4: silniejsze wykonanie Agenta w produkcji, szersze narzędzia enterprise, potencjalnie natywne multimodalne wejście oraz ciaśniejsza równowaga między efektywnością Flash a poziomem rozumowania Pro. Główną niewiadomą pozostaje, czy DeepSeek w ogóle dostarczy te ulepszenia pod nazwą V4.1.

Deweloperzy mogą już testować DeepSeek V4 Flash i DeepSeek V4 Pro poprzez CometAPI, a strona DeepSeek V4.1 może służyć do śledzenia dostępności w CometAPI, jeśli osobny model stanie się możliwy do wykorzystania. CometAPI zapewnia zunifikowaną warstwę API do porównywania DeepSeek z innymi modelami czołowymi bez konieczności przebudowy integracji dla każdego dostawcy.

Kontynuuj naukę

Połącz ten artykuł z następną decyzją.

Zobacz wszystkie tematy
Opublikowano Aug 23, 2026
Ostatnia aktualizacja Aug 23, 2026
0 wyświetleń
Sprawdzone pod kątem przejrzystości, atrybucji źródeł i aktualnej terminologii API.

Gotowy na obniżenie kosztów rozwoju AI o 20%?

Zacznij za darmo w kilka minut. Dołączone kredyty na bezpłatny okres próbny. Karta kredytowa nie jest wymagana.

Czytaj więcej