Google wypuściło w czwartek Gemini 3.7 Flash, niedrogi model do kodowania i agentów, który jest teraz ogólnie dostępny.
OpenAI zaprezentowało GPT-5.6 Sol Ultrafast, warstwę opartą na Cerebras, która uruchamia ich najbardziej zaawansowany model nawet 14 razy szybciej.
Wyścig o szybkość przesunął się z surowej inteligencji na agentów działających w czasie rzeczywistym, ale tylko model Google'a jest dziś dostępny dla każdego programisty.
Google i OpenAI przekazały dziś ten sam komunikat: AI jest teraz wystarczająco szybkie, aby robić wrażenie na użytkownikach agentów AI, a każda z firm ogłosiła ultrawydajne modele.
Te dwie premiery są zbudowane inaczej i tylko jedna jest dziś faktycznie w Twoich rękach.
Google wypuściło Gemini 3.7 Flash, swój najnowszy model dostrojony do kodowania oprogramowania i autonomicznych przepływów pracy w biznesie. OpenAI otworzyło ograniczony podgląd GPT-5.6 Sol Ultrafast, nowego poziomu usług, który uruchamia jego najbardziej wydajny model z prędkością do 750 tokenów wyjściowych na sekundę.
Dziś wprowadzamy Gemini 3.7 Flash, nasz najbardziej inteligentny model roboczy do kodowania i agentów.
Ten model przynosi znaczne zyski w inżynierii oprogramowania, tworzeniu stron internetowych i złożonej pracy umysłowej.
Gemini 3.7 Flash to model ogólnie dostępny. Przyjmuje do miliona tokenów wejściowych (około 750 000 słów) i zwraca 64 000, obsługując tekst, obrazy, wideo, audio i pliki PDF, a także może wywoływać narzędzia i sterować komputerem. Google przedstawia go jako tani mózg dla systemów autonomicznych, które planują zadania i wykonują wieloetapowe prace przy mniejszej pomocy człowieka.
Model nie poświęca jakości na rzecz szybkości. Jest zarówno bardziej wydajny, jak i efektywniejszy, będąc w stanie ukończyć nasze zadanie testowe z kodowaniem w 2 minuty i 13 sekund, podczas gdy najnowszy model Flash zajmował ponad 5 minut. Różnica w jakości między nimi jest również zauważalna.
Ultrafast od OpenAI nie jest nowym modelem. To GPT-5.6 Sol—ten sam model, który OpenAI wykorzystało zespół czerwony AI do wzmocnienia przed atakami polegającymi na wstrzykiwaniu promptów przed premierą—na szybszym torze, napędzany przez producenta chipów Cerebras. Jest około 14 razy szybszy niż standardowa prędkość samego GPT-5.6 Sol.
Podgląd trybu Ultrafast: GPT-5.6 Sol z prędkością do 14x.
Premiera najpierw w API OpenAI dla wybranej grupy klientów z rozszerzonym dostępem dla większej liczby firm w miarę wzrostu wydajności. pic.twitter.com/a5dleofiDJ
Chipy o skali płytki Cerebrasa generują do 750 tokenów na sekundę, około 560 słów, wystarczająco szybko, aby agent głosowy mógł myśleć w trakcie rozmowy.
Liczby, które się liczą
Własna tabela benchmarków Google stawia Gemini 3.7 Flash przed Claude Sonnet 5, GPT-5.6 Terra i innymi w 11 z 18 testowanych kategorii, w tym z najwyższym wynikiem Code Arena web-dev wynoszącym 1588 Elo i 30,4% w AutomationBench dla przepływów pracy w przedsiębiorstwach. To wszystko opiera się na metodologii Google, więc traktuj tę przewagę jako twierdzenie firmy.
Jak każdy Gemini Flash, model jest również tani. Przy 75 centach za milion tokenów wejściowych i 3,75 dolara za milion tokenów wyjściowych do końca roku, to połowa pierwotnej stawki Gemini 3.6 Flash. Ta cena promocyjna wygasa 31 grudnia, a następnie podwaja się do 1,50 i 7,50 dolara, co nadal jest tanio jak na model Google.
OpenAI nie opublikowało bezpośrednich wyników porównawczych dla Ultrafast poza cytatami klientów. Inżynier AI z Jane Street, John Crepezzi, powiedział w ogłoszeniu OpenAI, że szybkość Cerebras „umożliwia różne sposoby korzystania z modeli”. Lider produktu Podium, Courtland Lykins, nazwał ją „nieocenioną w naszym stacku głosowym”, mówiąc, że szybkość „całkowicie zmienia doświadczenie rozmowy”. Ta warstwa jest na razie dostępna wyłącznie na zaproszenie.
Nacisk na szybkość pojawia się, gdy laboratoria przechodzą od „kto jest najmądrzejszy” do „kto jest wystarczająco szybki dla agentów”. Czas działania Google jest celowy. Jego flagowy Gemini 3.5 Pro wciąż nie jest dostępny, bez podanej daty premiery, trzy tygodnie po 3.6 Flash i kilka dni po przetasowaniach w kierownictwie DeepMind, które odsunęło Demisa Hassabisa na rzecz zastępcy Koraya Kavukcuoglu. OpenAI tymczasem wynajmuje szybkość Cerebras zamiast czekać na własny stack.
Gemini 3.7 Flash jest już dostępny w ponad 160 krajach; GPT-5.6 Sol Ultrafast jest nadal dostępny tylko na zaproszenie.