AI Giganci Ogłaszają Nowe Modele, Które Kosztują Mniej, Robią Trochę Więcej i Zdecydowanie Nie Panikują z Powodu Tanich Rywali
OpenAI i Anthropic wypuszczają nowe modele, które kosztują mniej i robią trochę więcej, ponieważ konkurowanie z tanimi alternatywami open-weight to najwyraźniej nowa granica.
W ruchu, który nie zaskoczy absolutnie nikogo, kto obserwował nieustępliwy marsz branży AI w stronę „taniej, szybciej, wystarczająco dobrze", zarówno OpenAI, jak i Anthropic wypuściły nowe modele wymierzone prosto w twój portfel - a dokładniej, w portfel twojego działu zakupów korporacyjnych. Anthropic ogłosił Opus 5.5, najnowszą wersję swojego masowego konia roboczego do kodowania i złożonej pracy wiedzy. OpenAI odpowiedziało GPT-6 Sol i Luna, swoimi modelami średniej półki i mniejszymi, skoncentrowanymi na wydajności. Żadne z tych wydań nie obiecuje przełomowych nowych możliwości. Zamiast tego chodzi o wydajność, bo nic nie mówi „nowatorska innowacja" jak wyścig na dno cenowe.
Ponieważ obie firmy celują w klientów korporacyjnych, czują presję ze strony modeli open-weight. Organizacje zaczęły eksplorować routery modeli i zmieniać swoje praktyki, aby rzadziej używać tych drogich modeli frontier, wybierając tańsze alternatywy. Więc Anthropic i OpenAI robią to, co zrobiłaby każda racjonalna firma w obliczu konkurencji: argumentują, że ich nowe wydania przesuwają granice frontier (skromnie, ma się rozumieć), jednocześnie znacznie obniżając koszty. To AI-owy odpowiednik luksusowego producenta samochodów, który nagle oferuje budżetowy sedan i upiera się, że wciąż ma ten premium feel.
Opus 5.5 plasuje się na wyższym końcu modeli ogłoszonych dziś, ale bądźmy szczerzy: Anthropic trochę goni OpenAI. Wcześniej w tym miesiącu OpenAI wydało GPT-6 Astra, który czasami skromnie bije Opus 5 w benchmarkach i sentymencie użytkowników. Pod względem ceny i możliwości Astra konkuruje zarówno z Opus, jak i Fable. Benchmarki od Anthropic i jego partnerów pokazują teraz, że Opus 5.5 radzi sobie lepiej w kodowaniu i pracy wiedzy niż GPT-6 Astra w niektórych przypadkach - aczkolwiek skromnie, bo nie możemy mieć niczego zbyt dramatycznego.
Prawdziwą historią są tutaj koszty. Z ogłoszenia Anthropic: „Tokeny wejściowe i wyjściowe kosztują 4 i 20 dolarów za milion, o 20% mniej niż Opus 5. Odczyty z cache (które stanowią większość kosztów pracy agentowej i kodowania) kosztują 0,20 dolara za milion tokenów, o 60% mniej niż Opus 5. Opus 5.5 generuje również wyniki ponad 30% szybciej niż Opus 5." Anthropic twierdzi dalej, że oszczędności są bliższe 40 procent w porównaniu do Opus 5 dla typowych obciążeń przy domyślnych ustawieniach, ponieważ oprócz spadku kosztów tokenów, Opus 5.5 zużywa mniej tokenów podczas wykonywania zadań. To jak podwójny kupon rabatowy, ale na twój rachunek za AI.
Mówi się, że Opus 5.5 jest szczególnie zdolny w „obszarach wysokiego ryzyka" takich jak cyberbezpieczeństwo i biologia, więc te same zabezpieczenia, które dotyczyły Fable 5.1, będą miały zastosowanie również tutaj. Twoje żądania mogą być automatycznie i transparentnie kierowane do starszego modelu, jeśli zostaną oznaczone jako wkraczające na chronione terytorium. Bo nic nie mówi „nowatorski" jak ciche zdegradowanie do zeszłorocznego modelu, gdy pytasz o badania nad wzmocnieniem funkcji.
GPT-6 Sol i Luna od OpenAI to iteracyjny krok naprzód. Niedawno firma wprowadziła konwencję nazewnictwa Sol, Terra, Luna dla rodziny modeli GPT-5.6. Ostatnio - właśnie w tym miesiącu - wprowadziła GPT-6 Astra, swój najbardziej zaawansowany i potężny model. Może nie być oczywiste, co oznaczają te nazwy, więc oto szybkie podsumowanie: Astra to najbardziej agresywnie potężny (i drogi) model, przeznaczony do ciężkiego kodowania i badań. Sol to zdolna, ale bardziej wydajna i przystępna cenowo alternatywa - codzienny kierowca. Terra to zrównoważony, ogólnego przeznaczenia model. A Luna to szybka, tania opcja. Można z grubsza umieścić Astra przeciwko Fable od Anthropic, Sol przeciwko Opus, Terra przeciwko Sonnet, a Luna przeciwko Haiku, ale to niedoskonałe mapowanie, zwłaszcza dla modeli wyższej klasy. Pomyśl o tym jak o mylącym menu, gdzie wszystko brzmi jak planeta, ale smakuje jak opłata subskrypcyjna.
OpenAI twierdzi, że GPT-6 Sol i Luna były trenowane podobnymi metodami co GPT-6 Astra. W zależności od benchmarku, są czasami o kilka punktów procentowych bardziej zdolne niż ich poprzednicy w某些 zadaniach, ale kosztują połowę tyle.
The Good Times
Wiadomości w Twojej skrzynce.
Sardoniczne podsumowanie, dostarczane według Twojego harmonogramu. Bezpłatnie. Zrezygnuj kiedy chcesz.
Już subskrybujesz, ale nigdy do Ciebie nie docieramy? Zajrzyj do folderu spam i kliknij 'To nie spam' (lub 'Usuń ze spamu'), żeby wyciągnąć nas z czyśćca niechcianej poczty. Przy okazji pomożesz wszystkim innym.
Jeśli przez miesiąc nie otworzysz żadnego z naszych e-maili, zostaniesz automatycznie usunięty z listy.
Rewrite Article
Select parts to regenerate with a fresh AI pass. Translations will be updated automatically.
Generate AI Image
Creates a sardonic version of the article image using OpenAI.