Elon Musk wyznaczył cel na początek sierpnia dla Grok 4.6 i ujawnił plany dotyczące większego modelu Grok 4.7, gdy SpaceXAI zaostrza konkurencję z OpenAI, Anthropic i chińskim Moonshot AI.
Podsumowanie
- Grok 4.6 jest zaplanowany na około 7 sierpnia, według Muska.
- Nadchodzący model będzie miał 1,5 biliona parametrów i ulepszone post-trenowanie.
- Grok 4.7 może pojawić się kilka tygodni później z 2,1 biliona parametrów.
- Grok 4.5 zajął pierwsze miejsce pod względem stosunku ceny do wydajności w cyberbezpieczeństwie w ocenie Vercel.
Grok 4.6 celuje w premierę 7 sierpnia
Musk ujawnił harmonogram w poście na X z 28 lipca, mówiąc, że Grok 4.6 zostanie wydany „około 7 sierpnia”. Opisał go jako model z 1,5 biliona parametrów z silniejszym nadzorowanym dostrajaniem i uczeniem przez wzmacnianie.
Nadzorowane dostrajanie trenuje model na wybranych przykładach, aby poprawić jakość jego odpowiedzi. Uczenie przez wzmacnianie wykorzystuje informacje zwrotne i sygnały nagrody, aby udoskonalić sposób, w jaki model radzi sobie z zadaniami i postępuje zgodnie z instrukcjami.
Musk powiedział również, że Grok 4.7 pojawi się „kilka tygodni później” jako model z 2,1 biliona parametrów. Nie podał jednak dokładnej daty premiery ani nie ujawnił szczegółów dotyczących ceny i dostępności dla żadnej z wersji.
„Będzie lepszy od 4.6 pod każdym względem, poza nieco wolniejszym działaniem, choć z jeszcze lepszą wydajnością tokenów” – powiedział Musk o Grok 4.7.
Obie daty pozostają celami, a nie potwierdzonymi terminami premiery. Harmonogramy rozwoju modeli mogą ulec zmianie podczas trenowania, testowania i wdrażania.
Grok 4.5 stanowi punkt odniesienia dla ulepszeń
SpaceXAI wprowadził Grok 4.5 na początku lipca jako model zaprojektowany do kodowania, zadań opartych na agentach i pracy wiedzowej. Firma obecnie pobiera opłaty w wysokości 2 USD za milion tokenów wejściowych i 6 USD za milion tokenów wyjściowych.
Musk ogłosił dwa kolejne modele w odpowiedzi na ocenę od CEO Vercel, Guillermo Raucha, który opisał Grok 4.5 jako najlepiej działający model cyberbezpieczeństwa w stosunku do ceny w najnowszych testach Vercel.
Według posta Raucha, Grok 4.5 był 10 razy tańszy niż GPT-5.6 Sol od OpenAI, 5,7 razy tańszy niż Opus 5 od Anthropic i 2,2 razy tańszy niż Kimi K3 od Moonshot, oferując wydajność zbliżoną do Kimi.
Rauch nadal uznał Sol za wiodący model graniczny, przed Opus 5. Jego ustalenia odzwierciedlają metody testowania Vercel i nie ustanawiają uniwersalnego rankingu dla wszystkich obciążeń AI.
SpaceXAI nie powiedział, czy Grok 4.6 i Grok 4.7 zachowają ceny Grok 4.5. Szybkość usługi, użycie tokenów i koszty API określą, czy nowsze modele utrzymają tę samą przewagę cenowo-wydajnościową.
Amerykańskie firmy AI pod presją chińskiego Kimi K3
Planowane ulepszenia Grok pojawiają się, gdy chińscy deweloperzy zmniejszają lukę w stosunku do wiodących amerykańskich firm AI. Moonshot AI udostępnił pełne wagi Kimi K3 27 lipca, umożliwiając deweloperom pobranie, modyfikację i uruchomienie modelu na własnej infrastrukturze.
Kimi K3 ma 2,8 biliona parametrów, natywne możliwości wizualne i okno kontekstowe o długości miliona tokenów. Jego skala i otwarta struktura wag zwiększyły presję na amerykańskie firmy, które dystrybuują swoje najbardziej zaawansowane modele głównie przez zamknięte platformy i płatne API.
SpaceXAI, OpenAI i Anthropic konkurują również w zakresie kodowania, cyberbezpieczeństwa, rozumowania i kosztów wymaganych do wykonania każdego zadania. Większa architektura Grok 4.7 może poprawić jego możliwości, ale Musk przyznał, że będzie działał wolniej niż Grok 4.6.
Sama liczba parametrów nie decyduje o jakości modelu. Dane treningowe, architektura, metody potreningowe, systemy wnioskowania i wydajność tokenów mogą wpływać na wydajność.
Amerykańskie firmy AI podzielone w kwestii nadzoru federalnego
OpenAI i Anthropic zgodziły się już udostępniać urzędnikom USA wczesny dostęp do niepublikowanych modeli granicznych w celu testów bezpieczeństwa. Umowy te stały się podstawą szerszego dobrowolnego federalnego ramowego przeglądu, który obecnie obejmuje innych głównych deweloperów, w tym SpaceXAI, Google DeepMind i Microsoft.
Prezydent Donald Trump sformalizował te ramy poprzez rozporządzenie wykonawcze z czerwca. Uczestniczące firmy mogą udostępniać objęte modele rządowi federalnemu na okres do 30 dni przed ich udostępnieniem zaufanym partnerom. Rozporządzenie stanowi, że przeglądy nie tworzą obowiązkowego systemu licencjonowania ani wstępnej zgody.
Jednak branża pozostaje podzielona co do tego, jak Waszyngton powinien traktować modele o otwartej wadze. Nvidia, Microsoft, Meta, OpenAI, Palantir i inne organizacje ostrzegły amerykańskich decydentów przed szerokimi ograniczeniami w liście otwartym z 24 lipca. Argumentowały, że otwarte modele wspierają konkurencję, obniżają koszty wdrożenia i pozwalają deweloperom uruchamiać i modyfikować systemy AI na własnej infrastrukturze.
Debata nasiliła się po wydaniu przez Moonshot AI modelu Kimi K3 o 2,8 biliona parametrów. Urzędnicy administracji Trumpa oskarżyli Moonshot o wykorzystywanie wyników modelu Fable firmy Anthropic do trenowania Kimi K3 poprzez destylację na dużą skalę. Doradca techniczny Białego Domu Michael Kratsios opisał rzekomą praktykę jako próbę uzyskania zastrzeżonej technologii USA, podczas gdy sekretarz skarbu Scott Bessent powiedział, że administracja rozważa sankcje i umieszczenie Moonshot na czarnej liście handlowej.
Moonshot nie przyjął publicznie tych zarzutów. Spór postawił jednak Kimi K3 w centrum szerszej walki politycznej o to, czy Waszyngton powinien celować w konkretne zagrożenia bezpieczeństwa i własności intelektualnej, czy też szerzej ograniczać dostęp do chińskich modeli o otwartej wadze. Grok 4.6 i Grok 4.7 wejdą na ten rynek, gdy amerykańscy deweloperzy będą pod presją poprawy wydajności przy jednoczesnym spełnianiu pojawiających się federalnych wymogów bezpieczeństwa.






