Powiązane z tym tematemRada Technologii Przyszłości i AI

Elon Musk powiedział, że Grok 4.7 przewyższy każdy model. Czy spełnił oczekiwania?

  • Grok 4.7 uzyskał wynik 46 w indeksie inteligencji sztucznej analizy, wchodząc do pierwszej czwórki.
  • Model wyprzedził GPT-5.6 Sol w kodowaniu, ale zyski mają swoją cenę.
  • Musk mówi, że Grok 4.8 ukończy trening, a Grok 5 będzie bliski osiągnięcia AGI.
Promo

SpaceXAI wypuściło Grok 4.7, a niezależne oceny plasują go na czwartym miejscu wśród czołowych laboratoriów sztucznej inteligencji.

Artificial Analysis, niezależna firma testująca AI, przyznała modelowi 46 punktów w Indeksie Inteligencji, o 2 więcej niż Grok 4.6. Claude Fable 5.1, GPT-6 Astra i Claude Opus 5 wciąż mają wyższe wyniki.

Sponsorowane
Sponsorowane

Grok 4.7 wprowadza SpaceXAI do czołowej czwórki laboratoriów AI

Elon Musk zapowiedział przed premierą, że model będzie działać na bazie 2,1 bln parametrów i przewyższy wszystkie obecne modele. Dodał, że do trenowania użył danych firmy SpaceX.

Obserwuj nas na X, aby śledzić najnowsze wiadomości na bieżąco

Jak jednak działa Grok 4.7 w praktyce? Na AA-Briefcase, teście Artificial Analysis do realistycznych zadań zawodowych, Grok 4.7 zdobył 1657 Elo. To aż o 111 punktów więcej niż Grok 4.6 i poziom zbliżony do Claude Opus 5.

Na GDPval-AA model uzyskał 1695 Elo, czyli o 90 punktów lepiej od poprzednika. Wyniki programowania też wzrosły.

W połączeniu z Grok Build — własnym agentem programującym — Grok 4.7 zdobył 56 punktów w Indeksie Agenta Kodującego. To o 9 punktów więcej niż Grok 4.6.

Model wyprzedził GPT-5.6 Sol i obecnie ustępuje już tylko Claude Fable 5.1 od Anthropic, GPT-6 Astra i Opus 5.

Sponsorowane
Sponsorowane

„Grok 4.7 zdobywa 46 punktów w Artificial Analysis Intelligence Index, wprowadzając SpaceXAI do czołowej czwórki laboratoriów AI. Wynik Indeksu Agenta Kodującego również wzrósł, przeganiając GPT-5.6 Sol.”

Jak wypada Grok 4.7.
Jak wypada Grok 4.7. Źródło: X/Artificial Analysis

W innych miejscach model praktycznie się nie zmienił. Zyskał 4,5 punktu procentowego na Terminal-Bench 4.0 i 3 punkty na GDP.pdf. Wyniki spadły w testach AA-LCR i AutomationBench-AA. Grok 4.5 był najlepszy w AutomationBench w lipcu, co potwierdziło twierdzenie Muska, że dorównuje Claude Opus.

Postęp kosztuje więcej tokenów

Cennik pozostał bez zmian. Grok 4.7 nadal kosztuje 2 USD za mln tokenów wejściowych oraz 6 USD za mln tokenów wyjściowych. Trafienia z pamięci podręcznej wciąż kosztują 0,50 USD, a kontekst 500 000 tokenów przechodzi z Grok 4.6.

Model generuje jednak znacznie więcej tokenów przy każdej odpowiedzi. Artificial Analysis zmierzył średnio 81 000 tokenów wyjściowych na jedno zadanie z Indeksu, wobec 36 000 dla Grok 4.6 i 27 000 dla GPT-6 Astra. Stała cena za token daje przez to wyższy koszt zadania.

To zapotrzebowanie na tokeny pojawia się w oddziale, który już odnotował stratę 1,26 mld USD. Tymczasem Musk ogłosił 14 września, że Grok 4.8 zakończy trenowanie w ciągu tygodnia.

Spodziewa się też, że Grok 5 będzie modelem, który osiągnie ogólną sztuczną inteligencję. Kolejna wersja pokaże, czy SpaceXAI wskoczy wyżej w rankingach bez palenia więcej mocy obliczeniowej.

Subskrybuj nasz kanał na YouTube, aby poznać opinie ekspertów i dziennikarzy

https://youtu.be/IcgIaeIE7LI

Zastrzeżenie

BeInCrypto dokłada wszelkich starań, aby zapewnić bezstronne i przejrzyste relacjonowanie. Niniejszy artykuł informacyjny ma na celu dostarczenie dokładnych i aktualnych informacji. Zaleca się jednak, aby czytelnicy samodzielnie weryfikowali fakty i konsultowali się ze specjalistą przed podjęciem jakichkolwiek decyzji na podstawie niniejszych treści. Informujemy, że nasz Regulamin, nasza Polityka prywatności oraz nasze Zastrzeżenia prawne zostały zaktualizowane.

Sponsorowane
Sponsorowane