SpaceXAI wypuściło Grok 4.7, a niezależne oceny plasują go na czwartym miejscu wśród czołowych laboratoriów sztucznej inteligencji.
Artificial Analysis, niezależna firma testująca AI, przyznała modelowi 46 punktów w Indeksie Inteligencji, o 2 więcej niż Grok 4.6. Claude Fable 5.1, GPT-6 Astra i Claude Opus 5 wciąż mają wyższe wyniki.
Grok 4.7 wprowadza SpaceXAI do czołowej czwórki laboratoriów AI
Elon Musk zapowiedział przed premierą, że model będzie działać na bazie 2,1 bln parametrów i przewyższy wszystkie obecne modele. Dodał, iż do trenowania użył danych firmy SpaceX.
Obserwuj nas na X, aby śledzić najnowsze wiadomości na bieżąco
Grok 4.7 is here.
It's a notable improvement over Grok 4.6 at the same price and speed. pic.twitter.com/H3OTBbXyvO
Jak jednak działa Grok 4.7 w praktyce? Na AA-Briefcase, teście Artificial Analysis do realistycznych zadań zawodowych, Grok 4.7 zdobył 1657 Elo. To aż o 111 punktów więcej niż Grok 4.6 i poziom zbliżony do Claude Opus 5.
Na GDPval-AA model uzyskał 1695 Elo, czyli o 90 punktów lepiej od poprzednika. Wyniki programowania też wzrosły.
W połączeniu z Grok Build — własnym agentem programującym — Grok 4.7 zdobył 56 punktów w Indeksie Agenta Kodującego. To o 9 punktów więcej niż Grok 4.6.
Model wyprzedził GPT-5.6 Sol i w tej chwili ustępuje już tylko Claude Fable 5.1 od Anthropic, GPT-6 Astra i Opus 5.
„Grok 4.7 zdobywa 46 punktów w Artificial Analysis Intelligence Index, wprowadzając SpaceXAI do czołowej czwórki laboratoriów AI. Wynik Indeksu Agenta Kodującego również wzrósł, przeganiając GPT-5.6 Sol.”
W innych miejscach model praktycznie się nie zmienił. Zyskał 4,5 punktu procentowego na Terminal-Bench 4.0 i 3 punkty na GDP.pdf. Wyniki spadły w testach AA-LCR i AutomationBench-AA. Grok 4.5 był najlepszy w AutomationBench w lipcu, co potwierdziło twierdzenie Muska, iż dorównuje Claude Opus.
Postęp kosztuje więcej tokenów
Cennik pozostał bez zmian. Grok 4.7 przez cały czas kosztuje 2 USD za mln tokenów wejściowych oraz 6 USD za mln tokenów wyjściowych. Trafienia z pamięci podręcznej wciąż kosztują 0,50 USD, a kontekst 500 000 tokenów przechodzi z Grok 4.6.
Model generuje jednak znacznie więcej tokenów przy każdej odpowiedzi. Artificial Analysis zmierzył średnio 81 000 tokenów wyjściowych na jedno zadanie z Indeksu, wobec 36 000 dla Grok 4.6 i 27 000 dla GPT-6 Astra. Stała cena za token daje przez to wyższy koszt zadania.
To zapotrzebowanie na tokeny pojawia się w oddziale, który już odnotował stratę 1,26 mld USD. Tymczasem Musk ogłosił 14 września, iż Grok 4.8 zakończy trenowanie w ciągu tygodnia.
Spodziewa się też, iż Grok 5 będzie modelem, który osiągnie ogólną sztuczną inteligencję. Kolejna wersja pokaże, czy SpaceXAI wskoczy wyżej w rankingach bez palenia więcej mocy obliczeniowej.
Subskrybuj nasz kanał na YouTube, aby poznać opinie ekspertów i dziennikarzy
BeInCrypto Polska - Elon Musk powiedział, iż Grok 4.7 przewyższy każdy model. Czy spełnił oczekiwania?

4 godzin temu
