Az Alibaba szerint csak a Fable 5 jobb az új Qwen 3.8-nál – de egyetlen mérés sem támasztja alá

KakasTech AI asszisztens elemzése
  • 2024. július 19-én az Alibaba a WAIC konferencián bemutatta a Qwen 3.8 Max Preview‑t, egy 2,4 billió paraméteres modellt, amelyet a cég szerint a Claude Fable 5 előz meg.
  • Az állítás mögött nincs közzétett benchmark vagy model card, így a Qwen 3.8 teljesítménye a Claude Fable 5 vagy a Moonshot Kimi K3 mellett bizonyítatlan, ami aláássa a piaci bizalmat.
  • A közeljövőben az Alibaba ígéri a nyílt súlyok kiadását, de konkrét dátum és licenc hiányzik, így a modell versenyelőnye a kínai AI‑versenyben csak spekuláció marad.

Rendszer fókusz: Mielőtt a Qwen 3.8‑at termelésbe helyeznéd, futtass független benchmarkot saját GPU‑kluszteredben, ellenőrizd a token‑szintű aktivált paraméterek arányát, és győződj meg róla, hogy a licenc és a súlyok nyílt elérhetősége megfelel a biztonsági és adatvédelmi előírásoknak.

Ez a cikk több nemzetközi forrás alapján, mesterséges intelligencia közreműködésével készült szerkesztett összefoglaló, amely nem azonos egyetlen konkrét forrás tartalmával sem. A szöveg csak szerkesztői átolvasás után jelenik meg, ennek ellenére tartalmazhat pontatlanságokat.

Említett modellek
Kép forrása: Saját AI generált kép

Az Alibaba július 19-én, a sanghaji Mesterséges Intelligencia Világkonferencián mutatta be Qwen-családjának legerősebb tagját, a Qwen 3.8 Max Preview-t. A cég állítása szerint a 2,4 billió paraméteres modell a világ élvonalbeli rendszereivel vetekszik, és egyedül az Anthropic csúcsmodellje, a Claude Fable 5 előzi meg. A bejelentés egyetlen igazán fontos hiányossága viszont rögtön szemet szúr: a látványos állítás mögött egyetlen közzétett benchmark sem áll.

Marketingállítások független mérések nélkül

Érdemes pontosan úgy kezelni ezt a rangsorolást, ahogy megszületett: gyártói marketingállításként, nem pedig függetlenül mért eredményként. Az Alibaba egyelőre nem tett közzé benchmark-táblázatot, model cardot, licencet, sem pedig a modell aktív paraméterszámát. Utóbbi egy ritkán aktiváló, úgynevezett sparse MoE (Mixture-of-Experts) modellnél éppen az a szám, amely a tényleges kiszolgálási költséget meghatározza.

A teljes paraméterszám nem egyenlő a ténylegesen használt számítási kapacitással, mivel az ilyen modellek tokenenként a paramétereknek csak egy töredékét mozgósítják.

A „csak a Fable 5 mögött” pozicionálás ráadásul kifejezetten szembetűnő annak fényében, hogy az előző csúcsmodell, a májusban érkezett Qwen 3.7-Max még teljes, publikált eredménykészlettel debütált.

Rekordközeli modellméret és multimodális képességek

A modell mérete önmagában is figyelemre méltó. A 2,4 billió paraméterével a Qwen 3.8 a jelenleg ismert második legnagyobb nyilvános modell – ezen a téren csak a Moonshot AI Kimi K3-a előzi meg a maga 2,8 billió paraméterével. Ez a fejlesztők nyilatkozata szerint egyben az első, 1 billió paraméter fölötti multimodális Qwen-modell, amely a szöveg mellett képeket, videókat és dokumentumokat is képes feldolgozni.

A cég ígérete szerint a 3.8 a 3.7-Maxnál érezhetően jobban teljesít majd, különösen a kódolásban és az olyan összetett produktivitási feladatokban, mint:

  • a full-stack szoftverfejlesztés,
  • a haladó adatelemzés,
  • valamint a komplex irodai munkafolyamatok automatizálása.

Geopolitikai időzítés és a kínai laborok versenyelőnye

A megjelenés időzítése legalább annyira üzenet, mint maga a modell. A Qwen 3.8 mindössze néhány nappal a Moonshot AI Kimi K3-ának kiadása után érkezett, és nehéz nem úgy tekinteni rá, mint a rivális lendületére adott közvetlen válaszra.

A tágabb kép ennél is beszédesebb: a kínai fejlesztőműhelyek már nem vigaszdíjként tekintenek a nyílt súlyú modellekre. A GLM 5.2 a FrontierSWE-teszten karnyújtásnyira került a Claude Opus 4.8-tól, a Kimi K3 pedig az Arena Frontend Code ranglistáján konkrétan megelőzte a Claude Fable 5-öt és a GPT-5.6 Solt – elsőként téve fel egy nyílt súlyú modellt ezen a listán az élre. A Qwen 3.8 most ebbe a kiélezett versenybe lép be, mindkét riválisánál nagyobb paraméterszámmal.

A nyílt súlyok kettős ígérete

Ha egy komoly modellhez tényleg megjelennek a súlyok, a kutatók, fejlesztők és felhőszolgáltatók saját környezetükben is megvizsgálhatják, finomhangolhatják és más rendszerekbe építhetik azokat. Ez nem teszi olcsóvá a futtatást, és nem szünteti meg a nagy hardverigényt, de lehetőséget ad arra, hogy a szereplők ne kizárólag egyetlen szolgáltató feltételei szerint működjenek.

A gond csak az, hogy az Alibaba egyelőre nem adott konkrét menetrendet: a nyílt súlyok a közlemény szerint „hamarosan” érkeznek, konkrét dátum, licenc és Hugging Face-tárhely megjelölése nélkül. Ez azért is figyelemre méltó, mert a cég utóbbi két Max-kategóriás csúcsmodellje zárt forráskódúként jelent meg, így egy tényleges nyílt kiadás megtörné a korábbi mintázatot.

Tesztelhetőség és piaci elérhetőség

Aki szeretné kipróbálni a modellt, az már megteheti: a Qwen 3.8 Max Preview elérhető az Alibaba Token Plan előfizetésén, valamint a cég kódolásra hangolt Qoder és QoderWork platformjain (a jelentések szerint a normál ár mintegy 10 százalékáért). Az OpenAI- és Anthropic-protokollokkal való kompatibilitás révén a meglévő kódolóügynökök átállíthatók rá anélkül, hogy újra kellene építeni a mögöttük álló keretrendszereket.

„A helyes olvasat tehát egyszerű: itt egy hatalmas, ambiciózus új modell, önmagáról tett merész állításokkal és egy ígért nyitással – de a tudományos bizonyíték egyelőre hiányzik.”

Az igazán érdekes rész csak most kezdődik. Azt, hogy a Qwen 3.8 valóban ott áll-e, ahová az Alibaba helyezi, nem a gyors ranglistás győzelmi mondatok döntik el, hanem a reprodukálható, független mérések, a tényleges elszámolási ár és a valós hozzáférés. Egy jó összehasonlítási pont a korábbi Qwen 3.7-Max: az az LMArena listáján jóval a Fable 5 mögött szerepelt. Amíg a mérések és az ígért súlyok meg nem érkeznek, a Fable 5-tel való összevetés kizárólag az Alibaba saját állítása marad.

Kövesd a témát

Értesítést kapsz a profilodban és a heti hírlevélben, ha új cikkünk jelenik meg a követett témáidban.

Cégek
Témák

Tetszett a cikk?

Oszd meg

Gyakori kérdések az AI hírekről

Hol olvashatóak a legfrissebb AI hírek magyarul?

A KakasTech AI Hírek rovata naponta frissül: a mesterséges intelligencia legújabb fejlesztései, modell-bejelentések és iparági elemzések magyar nyelven, ellenőrzött nemzetközi források alapján olvashatóak nálunk.

Milyen témákat fednek le a KakasTech AI hírei?

A nagy AI-laborok (OpenAI, Anthropic, Google DeepMind) bejelentéseitől a chipeken és a robotikán át a hazai és nemzetközi szabályozásokig minden lényeges területet követünk.

Hogyan értesülhetek azonnal a legújabb AI változásokról?

Feliratkozhatsz a heti összefoglaló hírlevelünkre a lap alján, vagy követheted az AI API-árkalkulátorunkat és az AI-modell összehasonlító oldalunkat a legfrissebb technikai adatokért.

Hozzászólások 0

A hozzászóláshoz kérjük, jelentkezz be.

Még nincsenek hozzászólások. Írd meg te az elsőt!