Termin to 24 lipca, godzina 15:59 UTC
Dokumentacja API DeepSeeka mówi to wprost: nazwy modeli deepseek-chat i deepseek-reasoner zostaną wycofane 24.07.2026 o 15:59 UTC. Po tym momencie żądanie wskazujące którykolwiek z tych ciągów jest żądaniem modelu, który nie istnieje. Wszystko, co mają Państwo na produkcji i co nadal wysyła te nazwy, przestaje działać. Dzieje się to w piątek późnym popołudniem czasu europejskiego.
To jest widoczna połowa. To także ta połowa, która zostanie naprawiona, bo twardy błąd sam się zgłasza w logach i ktoś dostaje powiadomienie. Dziewięć dni to dość, żeby zmienić dwa ciągi znaków. Większość zespołów zdąży.
Dlaczego to ważne: naprawa jest trywialna, lekcja już nie. Dostawca właśnie pokaże, w ściśle określonym momencie, kto w Państwa organizacji naprawdę wie, jakie modele działają na produkcji. W większości firm uczciwa odpowiedź brzmi: nikt tego nie sprawdzał od czasu zbudowania integracji.
Alias już się przeniósł i nikt tego nie zapisał
Proszę przeczytać tę samą dokumentację linijkę dalej. Stare nazwy są dziś nadal obsługiwane, bo są przekierowywane: deepseek-chat odpowiada trybowi bez rozumowania modelu deepseek-v4-flash, a deepseek-reasoner odpowiada jego trybowi z rozumowaniem. Nazwy przetrwały. Model pod nimi już nie.
Jeśli więc Państwa zespół wpisał deepseek-chat do pliku konfiguracyjnego rok temu i nigdy go już nie ruszył, Państwa aplikacja została już przeniesiona na inny model, przez dostawcę, bez wdrożenia, bez wpisu w Państwa rejestrze zmian i bez ponownego uruchomienia choćby jednej ewaluacji. Nic się nie zepsuło i właśnie dlatego nikt tego nie zauważył. Odpowiedzi nadal przychodziły we właściwym kształcie.
Rozróżnienie, które trzeba zapamiętać: alias to wygoda, a nie przypięcie wersji. Obiecuje, że odpowie coś rozsądnego, a nie że odpowie to samo. Każda nazwa modelu bez wersji jest ruchomym celem i dotyczy to każdego dostawcy, nie tylko tego jednego.
Na co Państwo naprawdę migrują
Dwa obecne modele to deepseek-v4-flash i deepseek-v4-pro. Oba mają okno kontekstu o wielkości miliona tokenów i mogą zwrócić do 384 000 tokenów w jednej odpowiedzi, co jest innym zakresem pracy niż ten, pod który projektowano większość integracji.
Kosztowo nie są wymienne. Opublikowane ceny za milion tokenów stawiają Flasha na 0,14 dolara za wejście bez trafienia w pamięć podręczną i 0,28 dolara za wyjście, podczas gdy Pro kosztuje 0,435 dolara za wejście i 0,87 dolara za wyjście. Wejście z pamięci podręcznej jest w obu przypadkach dramatycznie tańsze. Zamiana deepseek-chat na niewłaściwy z tych dwóch nie wyrzuci błędu: po prostu zmieni miesięczny rachunek trzykrotnie albo po cichu obniży jakość rozumowania w procesie, o którym już Państwo opowiedzieli klientom.
Tak, ale: to nie jest argument za panicznym przypięciem się do Pro. To argument za świadomym wyborem, dokonanym raz, na własnym zestawie ewaluacyjnym, zamiast pozwolić, by tablica routingu wybrała za Państwa po raz drugi.
Lista kontrolna na dziewięć dni
Proszę przeszukać wszystko, nie tylko repozytorium aplikacji. Stare ciągi kryją się w domyślnych ustawieniach SDK, w konfiguracjach bram i serwerów pośredniczących, w notatnikach, w zadaniach zaplanowanych i w każdym wewnętrznym narzędziu, które kolega sklecił szybko i nigdy do niego nie wrócił. Proszę wyszukać obie nazwy i traktować każde trafienie jako produkcję, dopóki nie zostanie udowodnione, że jest inaczej.
Następnie proszę ponownie uruchomić ewaluacje na wybranym modelu V4 i porównać wyniki z tym, co Państwo sądzili, że otrzymują. To jedyny moment, w którym cicha migracja staje się mierzalna, bo wreszcie widać, co przekierowany model już robił z Państwa odpowiedziami.
Na koniec proszę to zapisać. Dokładny identyfikator modelu, datę przypięcia, kto to zatwierdził i co pokazała ewaluacja. Uprawnienia egzekucyjne europejskiego rozporządzenia o sztucznej inteligencji wobec modeli ogólnego przeznaczenia zaczynają działać od 2 sierpnia, a niezależnie od tego, jakie okażą się Państwa konkretne obowiązki, rejestr wskazujący model wycofany dziewięć dni wcześniej nie jest dowodem kontroli. Jest dowodem na to, że Państwo nie patrzyli.
Czytaj dalej: Chiny pozwalają swoim laboratoriom kupić H200 | Chiński model może właśnie odpowiadać na twoje prompty



