Przejdź do treści
Czas na świecieEU--:--UK--:--USA--:--CN--:--PLDEFRIT中文EN

portal o AI i technologiiwydarzenia · analizy · wywiady · tło techniczne

Szukaj
NA ŻYWO
›

Otwarte modele zbiły ceny. Anthropic i OpenAI grają już o koszt

Opus 5.5 oraz GPT-6 Sol i Luna nie przynoszą przełomu w możliwościach. Przynoszą niższe ceny, a wymusiła je konkurencja otwartych wag, w tym DeepSeek V4.1 Flash na licencji MIT.

OpinieOpiniaJakub OstrowskiOpublikowano: 26 września 20265 min czytaniaŹródła 4
Otwarte modele zbiły ceny. Anthropic i OpenAI grają już o koszt

Licencja MIT i optymalizacje inferencji zrobiły z ceny główne pole walki, a nie benchmarki. To dobra wiadomość dla użytkowników i zła dla modelu biznesowego opartego na rzadkości dostępu.

Anthropic i OpenAI wypuściły nowe modele, Opus 5.5 oraz GPT-6 w wariantach Sol i Luna, z tym samym komunikatem: szybciej i taniej. Nie „mądrzej o rząd wielkości”, nie „bliżej AGI”, lecz taniej. To reakcja na konkurencję, którą coraz trudniej ignorować. Modele otwarte zaczęły wyznaczać pułap cenowy, poniżej którego płatny dostęp musi się bronić funkcjami, a nie samym istnieniem.

Najlepszym dowodem jest DeepSeek V4.1 Flash. Premiera 10 września 2026 r., architektura MoE o 552 mld parametrów, z czego 8 mld aktywowanych w prefillu i 16 mld w dekodowaniu. Model obsługuje natywnie obrazy do 384 tokenów, a jego pamięć podręczna klucz-wartość zajmuje 890 bajtów na token, około czterokrotnie mniej niż w poprzedniej wersji V4, i utrzymuje kontekst miliona tokenów. Wszystko to na licencji MIT. Każdy operator może więc hostować model we własnej infrastrukturze, bez negocjacji, bez opłat i bez pytania o pozwolenie.

Do tego dochodzi warstwa optymalizacji, która obniża koszt bez zmiany wag modelu. Chiński zespół 是石科技 zaprezentował silnik Meta-Infer. Sama optymalizacja oprogramowania, bez dotykania sprzętu, podniosła przepustowość inferencji DeepSeeka niemal siedmiokrotnie. Półtora akceleratora klasy 6000D miało dzięki temu przewyższać jeden B300. Firma zarządza ponad 20 tys. PFLOPS mocy i dziesięcioma centrami obliczeniowymi. Wąskim gardłem jest warstwa abstrakcji sprzętowej: gdy operatorzy sięgają po generyczne jądra, przepustowość spada o rząd wielkości. To praca inżynierska ze zwrotem liczonym w pieniądzu, a nie w punktach na liście rankingowej.

Skala komercji potwierdza kierunek. DeepSeek ma przekroczyć 1 mld dolarów rocznego przychodu w ujęciu annualizowanym, kilka miesięcy wcześniej było to poniżej 500 mln. Firma prowadzi drugą turę finansowania o wartości 7,5 mld dolarów, celuje w wycenę 500 mld juanów i przygotowuje debiut na giełdzie w Szanghaju. Ponad 70 proc. mocy obliczeniowej przeznacza na trening nowych modeli, zostawiając mniej niż 30 proc. na obsługę tych już istniejących. Zarząd twierdzi, że podniesienie cen interfejsu API nie odebrało klientów. To portret dostawcy, który nie musi wygrywać ceną, bo wygrywa dostępnością wagi.

Era, w której najdroższy model był domyślnym wyborem, kończy się. Organizacje zaczynają traktować modele jak portfel aktywów: tanie otwarte wagi do zadań masowych, drogie modele frontier do wąskiego, krytycznego ułamka pracy. Dostawcy płatni mogą odpowiedzieć tylko w jeden sposób: jeszcze większą obniżką albo funkcjami, których otwarta waga nie da, jak audyt, gwarancje czy integracja. „Drożej, bo lepiej” przestało być argumentem.

Komentarze 0

Źródła

4
  1. 01DeepSeek-V4.1-Flash — model cardEN
  2. 02New Anthropic, OpenAI models make same promise: a little more for a lot less moneyEN
  3. 03纯软件优化,DeepSeek 推理吞吐提升近 7 倍ZH
  4. 04曝 DeepSeek 确定 75 亿美元第二轮融资,年化营收突破 10 亿美元ZH

Wszystkie liczby i cytaty w tym tekście pochodzą z poniższych źródeł. Nie dopisujemy danych, których w źródłach nie ma.

Materiały zostały przygotowane przez zespół redakcyjny wspierane przez AI.

Jakub Ostrowski

Jakub Ostrowski

Opinie i komentarze

Jakub Ostrowski pisze w dziale opinii i komentarzy FLASH24, opierając się na dokumentach źródłowych, orzeczeniach i danych urzędowych, a nie na doniesieniach agencyjnych. Każdą liczbę z tekstu sprawdza w co najmniej dwóch niezależnych źródłach, a rozbieżności opisuje w przypisie. W kalendarzu czeka na publikacje uzasadnień Trybunału Konstytucyjnego i porównuje je z wcześniejszym orzecznictwem, rozmawia też z prawnikami prowadzącymi konkretne sprawy. Prywatnie czyta historię idei, co pozwala mu osadzać spory prawne w szerszym kontekście doktrynalnym. Nie publikuje komentarza, jeśli nie widział pełnego tekstu orzeczenia.

Redakcja →

Komentarze

0
  1. Brak komentarzy — bądź pierwszy.

Dodaj komentarz

Komentarze są widoczne publicznie. Nie publikujemy wulgaryzmów, spamu i treści reklamowych.