DeepSeek wygasza dziś stare endpointy. V4 staje się jedyną wersją — z wynikiem 80,6 proc. w SWE-bench za setną ceny GPT-5.6 Sol
Po 15:59 UTC DeepSeek wyłącza legacy endpointy deepseek-chat i deepseek-reasoner, domykając migrację do stabilnej rodziny V4. Wariant Pro z wynikiem 80,6 proc. w SWE-bench Verified kosztuje ułamek ceny zamkniętych flagowców — a w poniedziałek darmowe wagi udostępni Kimi K3.
Dziś po godzinie 15:59 UTC DeepSeek wyłącza swoje stare endpointy deepseek-chat i deepseek-reasoner, zmuszając deweloperów do ostatecznej migracji na rodzinę V4. To formalne domknięcie przejścia modelu do fazy stabilnej — i sygnał, że chińskie laboratorium prowadzi dojrzały produkt z dyscypliną wersjonowania, a nie eksperymentalny release.
Rodzina liczy dwa warianty, oba z oknem kontekstowym 1 mln tokenów. V4-Pro ma 1,6 bln parametrów (49 mld aktywnych) i kosztuje 0,435 dol. za milion tokenów wejściowych i 0,87 dol. za wyjściowych. V4-Flash to 284 mld parametrów (13 mld aktywnych) za 0,14 i 0,28 dol. odpowiednio.
Benchmark przy cenie z innej epoki
Znaczenie cennika bierze się z wyników. DeepSeek V4-Pro-Max osiąga 80,6 proc. w SWE-bench Verified — najlepszy rezultat wśród modeli z otwartymi wagami i remis z Gemini 3.1 Pro. Model konkurencyjny wobec systemów frontier w realnych zadaniach inżynierskich kosztuje ułamek ich ceny: V4-Flash przy 0,28 dol. za milion tokenów wyjściowych to mniej więcej setna część stawki GPT-5.6 Sol (30 dol.), a ułamek ceny nowego, agresywnie wycenionego Gemini 3.6 Flash (7,50 dol.).
Dla rutynowych zadań o dużej skali, które dominują w korporacyjnych wydatkach na AI, taka różnica jest rozstrzygająca. Dostawcy zamkniętych modeli muszą teraz uzasadniać premium czymś więcej niż surową zdolnością — pozostają niezawodność, wsparcie, bezpieczeństwo, najtrudniejsze rozumowanie i wolność od pytań o proweniencję chińskich modeli. To realne argumenty, ale węższe niż rok temu i nieaplikowalne do większości wolumenu.
Tydzień, który obniżył cenową podłogę
Wygaszenie endpointów to operacyjny drobiazg o większym znaczeniu: wymuszona migracja na stabilne V4 usuwa niepewność, która trzymała ostrożne korporacje z dala. A w poniedziałek, 27 lipca, swoje wagi udostępni za darmo Kimi K3 — wtedy pauza subskrypcyjna Moonshot przestanie mieć znaczenie, bo model będzie można hostować samodzielnie lub u dostawców inferencji.
Podłoga cenowa modeli open-weight spadła właśnie do poziomu, który przedefiniowuje ekonomię masowego AI. To nie zabija modeli komercyjnych, ale zmusza je do rywalizacji realnym wyróżnikiem zamiast domyślnym wyborem — co dla wszystkich budujących na tych systemach jest zdrowszym układem.
Komentarze