1,5 billió paraméter, nulla külső bizonyíték: itt a titkos Grok 4.5
- Elon Musk bejelentette a Grok 4.5 modell elkészültét, amely 1,5 billió paraméterrel rendelkezik és jelenleg zárt bétában fut a SpaceX és a Tesla mérnökcsapatainál.
- A Grok 4.5 teljesítménye belső kiértékelések szerint megközelíti vagy meghaladja az Anthropic Claude Opus modelljét, de független tesztek még nem erősítették meg ezt az állítást.
- Az xAI agresszív fejlesztési ütemtervet próbál tartani, és Musk állítása szerint az idei év hátralévő részében havi rendszerességgel érkeznek majd új, nulláról tanított modellek.
Rendszer fókusz: A fejlesztők és felhasználók számára fontos ellenőrizni a Grok 4.5 modell biztonsági frissítéseit és patch-eit, amint azok nyilvánosan elérhetővé válnak, valamint érdemes figyelemmel kísérni a független teszteket és benchmarkokat a modell teljesítményének értékelése érdekében.
Ez a cikk több nemzetközi forrás alapján, mesterséges intelligencia közreműködésével készült szerkesztett összefoglaló, amely nem azonos egyetlen konkrét forrás tartalmával sem. A szöveg csak szerkesztői átolvasás után jelenik meg, ennek ellenére tartalmazhat pontatlanságokat; a felhasznált források lentebb olvashatók.
Elon Musk június 28-án egy tweetben jelentette be, hogy elkészült az xAI legújabb modellje, a Grok 4.5 — de a nagyközönség egyelőre nem férhet hozzá. A modell jelenleg zárt bétában fut a SpaceX és a Tesla mérnökcsapatainál, nincs hozzá rendszerkártya, nyilvános benchmark vagy API-dokumentáció, és Musk konkrét megjelenési dátumot sem erősített meg.
Mi az a V9, és miért számít 1,5 billió paraméter?
A Grok 4.5 motorja a V9 nevű, xAI által fejlesztett kilencedik generációs alapmodell, amely 2026. május 26-án fejezte be az előtanítást 1,5 billió paraméterrel.
Ez nagyjából háromszorosa a korábbi Grok 4-es verziókat hajtó V8-small architektúrának — vagyis ha a számok stimmelnek, az xAI eddigi legnagyobb modelljéről van szó.
A méret önmagában persze nem garancia semmire: a nagyobb paraméterszám több számítási kapacitást és tanítóadatot igényel, és a valódi teljesítménykülönbséget csak független tesztek tudnák igazolni — ezek pedig egyelőre hiányoznak.
A Cursor-adatok: kifejezetten a kódolásra élezve
A modell egyik legérdekesebb részlete, hogy az előtanítás után egy kiegészítő tréningfázisban az xAI beépítette a Cursor — a fejlesztők körében népszerű AI-kódszerkesztő — használati adatait is. A cél egyértelmű: a Grok 4.5 kódolási és technikai képességeinek élesítése, valószínűleg azért, hogy versenyben maradjon az Anthropic Claude Code-modelljeivel és más, fejlesztésre optimalizált rendszerekkel szemben.
„Egy xAI-mérnök szerint a Cursor-adatok utólagos, kiegészítő beépítése nem egészen olyan jó, mintha már az előtanítás elejétől jelen lettek volna.”
Vagyis a cég maga is elismeri, hogy ez a megoldás kompromisszum, nem a legoptimálisabb tréningfolyamat eredménye.
„Az Opus szintjén, talán afölött” — de ki mérte ezt?
Musk azt állítja, a belső kiértékelések szerint a Grok 4.5 teljesítménye megközelíti, sőt esetleg meg is haladja az Anthropic Claude Opus modelljét. Fontos leszögezni: ez a SpaceX és a Tesla saját mérnökei által végzett, nem nyilvános önértékelés eredménye. Egyetlen független benchmarkplatform — legyen szó az LMArenáról, az Artificial Analysisről, a SWE-benchről vagy a Humanity's Last Examről — sem tesztelte még a modellt. Amíg ez nem történik meg, az „Opus-szintű” állítás gyakorlatilag marketingközlemény, nem mérhető tény.
Miért pont most, és mit jelent ez az xAI-nak?
A bejelentés nem előzmények nélküli. Az xAI 2023 márciusában indult, azóta villámgyors utat járt be: a 134,7 millió dolláros A-körtől jutott el a 2026 januári, 20 milliárd dolláros E-körig, amellyel a cég értékeltsége 230 milliárd dollár közelébe emelkedett. 2026 februárjában a SpaceX 250 milliárd dolláros értékelésen magába olvasztotta az xAI-t, az egyesült vállalat értéke pedig azóta becslések szerint 1,25 billió dollár körül mozog.
Ebbe a kontextusba illik bele a Grok 4.5 is: Musk állítása szerint az idei év hátralévő részében havi rendszerességgel érkeznek majd új, nulláról tanított modellek — vagyis a cég egy rendkívül agresszív fejlesztési ütemtervet próbál tartani, miközben óriási tőkebefektetést kell igazolnia a befektetők felé.
A hiányzó darabok
Ami eddig biztosan tudható: a modell létezik, fut valós munkakörnyezetben két Musk-vállalatnál, és jelentősen nagyobb, mint elődei. Ami viszont még nem:
- nincs nyilvános kiadási dátum
- nincs ártáblázat
- nincs API-hozzáférés
- és — ami a legfontosabb — nincs egyetlen független teljesítménymérés sem, amely alátámasztaná vagy cáfolná az „Opus-szintű” képességekről szóló állításokat
A fejlesztői közösség és a versenytársak (Anthropic, OpenAI, Google) egyelőre csak találgatni tudnak arról, mennyire állja majd meg a helyét a Grok 4.5, ha egyszer tényleg nyilvánosan is tesztelhetővé válik.
Addig is annyi biztos: a mesterségesintelligencia-verseny tempója nem lassul, és Musk újabb húzása jól mutatja, hogy a nagy szereplők egyre inkább a „bejelentés előbb, bizonyíték majd később” logika mentén kommunikálnak.
Gyakori kérdések az AI hírekről
Hol olvashatóak a legfrissebb AI hírek magyarul?
A KakasTech AI Hírek rovata naponta frissül: a mesterséges intelligencia legújabb fejlesztései, modell-bejelentések és iparági elemzések magyar nyelven, ellenőrzött nemzetközi források alapján olvashatóak nálunk.
Milyen témákat fednek le a KakasTech AI hírei?
A nagy AI-laborok (OpenAI, Anthropic, Google DeepMind) bejelentéseitől a chipeken és a robotikán át a hazai és nemzetközi szabályozásokig minden lényeges területet követünk.
Hogyan értesülhetek azonnal a legújabb AI változásokról?
Feliratkozhatsz a heti összefoglaló hírlevelünkre a lap alján, vagy követheted az AI API-árkalkulátorunkat és az AI-modell összehasonlító oldalunkat a legfrissebb technikai adatokért.
Hozzászólások 0
Még nincsenek hozzászólások. Írd meg te az elsőt!