Kreatív AI az emberek zsebében
- A Meta július 7-én, a Google pedig július 8-án mutatta be a Muse Image és a Video Remix funkciót, amelyek kreatív AI-t építenek az Instagramba, WhatsAppba és Google Photos alkalmazásokba.
- A beépített AI-eszközök a Midjourney-t és Adobe-t kiszorító stratégiát alkalmaznak: a Meta 3 milliárd felhasználója számára teszi elérhetővé a képgenerálást, a Google pedig fizetős előfizetőknek kínál filmes videószerkesztést.
- A trend a platformfüggőség mélyítését célozza: a Google Photos és Meta ökoszisztéma AI-képességei az Apple Intelligence ellen versenyeznek, miközben a kreatív AI-startupok piaci terét szűkítik.
Rendszer fókusz: A Meta opt-out alapú képfelhasználási gyakorlata miatt azonnal ellenőrizd az Instagram beállításokban az adatvédelmi opciókat, és kapcsold ki a nyilvános képek AI-generálásba való bevonását, hogy megakadályozd mások fotóinak felhasználását az engedélyed nélkül.
Ez a cikk több nemzetközi forrás alapján, mesterséges intelligencia közreműködésével készült szerkesztett összefoglaló, amely nem azonos egyetlen konkrét forrás tartalmával sem. A szöveg csak szerkesztői átolvasás után jelenik meg, ennek ellenére tartalmazhat pontatlanságokat; a felhasznált források lentebb olvashatók.
Egy héten belül két tech-óriás tett olyan bejelentést, amelyek külön-külön is figyelemre méltóak lennének – együtt viszont egy határozottan kirajzolódó trendet mutatnak: a kreatív AI-képességek nem maradnak az alkotók eszközkészletében. Beköltöznek azokba az appokba, amelyeket a hétköznapokon már mindenki használ. A Meta július 7-én debütáltatta a Muse Image-et, a Google pedig egy nappal később a Video Remix funkciót – és mindkét termék ugyanazt a kérdést teszi fel az Adobe Premiere Prónak és a Midjourney-nek: mire jó egy külön kreatív eszköz, ha a telefonod galériája már mindent tud?
Meta Muse Image: 3 milliárd felhasználó kreativitása, egyetlen modellel
A Meta Superintelligence Labs – az Alexandr Wang vezette, milliárdokat felemésztő AI-divízió, amelynek felállítása tavaly rengette meg a Silicon Valley toborzási piacát – július 7-én mutatta be első saját képgeneráló modelljét. A Muse Image elérhető a Meta AI appban, az Instagram Storiesban az USA-ban, és a WhatsAppon korlátozott országokban, hamarosan pedig a Facebookon és a Messengeren is. Ez nem egy zárt béta – ez globális, azonnali beágyazás a Meta teljes ökoszisztémájába.
Technikailag a Muse Image nem szokványos képgenerátor. Ágensként működik: a prompt feldolgozásakor webkeresést végez, kódot futtat, önmaga kimenetét értékeli és finomítja, mielőtt a végeredményt megmutatná. A Meta saját Muse Spark nyelvi modelljével is szoros integrációban dolgozik, ami azt jelenti, hogy a két rendszer közösen tud tervezni – például animált GIF-et, weboldalt vagy interaktív vizuális játékot generálni egyetlen utasításból.
A benchmark-eredmények szerint a modell az Arena text-to-image ranglistáján a második helyen áll – az OpenAI GPT Image 2 mögött, de a Google Nano Banana 2 előtt. A szerkesztési feladatoknál – multi-referencia kompozíciók, közvetlen kép-annotáción alapuló módosítások, iteratív finomítás – a Meta szerint különösen erős.
Főbb funkciók
- Szöveges promptból kép: összetett, többmondatos leírásokból is
- Fotószerkesztés: meglévő képek módosítása – elemek törlése, háttér cseréje, stílusváltás
- Multi-referencia kompozíció: több forrásképből egyetlen új kép
- Instagram-integráció: a nyilvános profilok @-mentionnel bevonhatók a generálásba
- Hirdetési használat: az Advantage+ rendszeren keresztül hamarosan a hirdetők is elérhetik
Ez utóbbi a lényeg a Meta számára: a reklámbevétel az anyavállalat fő üzleti modellje, és egy beépített képgenerátorral a kreatív anyagok gyártása töredék idő és költség alatt megvalósítható lesz. Az alaphasználat ingyenes, az intenzívebb igénybevételhez Meta-előfizetés szükséges.
A botrány, ami az első napot beárnyékolta
A Muse Image bevezetésével szinte egyidőben megjelent egy funkció, ami azonnal vitát gerjesztett: a nyilvános Instagram-profilok képeit – beleértve más emberek fotóit is – alapértelmezetten be lehet vonni az AI-generálásba. A felhasználók @-mentionnel jelölhetnek meg nyilvános fiókokat, és azok képeit felhasználhatják saját generálásaikhoz – anélkül, hogy az érintett személy explicit engedélyt adott volna.
A rendszer opt-out alapú: aki nem akarja, hogy a fotóit így felhasználják, annak ki kell kapcsolnia ezt a beállításokban. A kritikusok rámutattak, hogy ez pontosan fordítva működik, mint ahogy kellene – különösen egy olyan platform esetén, amely 2019-ben 5 milliárd dolláros bírságot fizetett az FTC-nek adatvédelmi visszaélések miatt. A Meta egyelőre nem változtatott az alapértelmezett beállításon.
Google Video Remix: a telefonos videóid mostantól a Gemini Omnival dolgoznak
Egy nappal a Meta bejelentése után, július 8-án a Google is előrukkolt a maga kreatív AI-újdonságával: a Video Remix funkcióval a Google Photosban. A Gemini Omni modellre épülő eszköz az alkalmazás Create fülén érhető el, és egy egyszerű célt követ: pár tapintással lehessen olyat csinálni egy átlagos telefonos videóklipből, amihez korábban Premiere Pro vagy DaVinci Resolve kellett.
A Gemini Omni a Google legképesebb multimodális modellje – a Nano Banana és a Veo 3.1 videógenerátor utódjaként pozicionált rendszer, amely szélesebb inputtartományt kezel, és az olyan fizikai erőket is jobban érti, mint a gravitáció vagy a mozgásenergia, ami valósághűbb jeleneteket eredményez.
A Video Remix konkrét funkciói
- Cinematic relighting: sötét felvételek utólagos megvilágítása filmes hatással
- Háttércsere: az unalmas háttér lecserélése bármi másra
- Művészeti stílusok: akvarell, olajfestmény, vázlatkönyv-effekt élő mozgóképre alkalmazva
- Digitális avatar: a felhasználó saját maga is beilleszthető egy videóba, SynthID-vízjellel ellátva
A feldolgozási idő néhány másodperc – egy 10 másodperces klipnek legfeljebb 2 perc kell. Az eszköz jelenleg 14 országban érhető el, köztük az USA-ban, Indiában, Japánban, Mexikóban és Dél-Koreában, kizárólag a fizetős Google AI Plus, Pro és Ultra előfizetőknek.
Stratégiai lefejezés: a kreatív AI beépül a mainstreambe
A két bejelentés önmagában is megállná a helyét – együtt azonban egy stratégiai képet mutat.
A kreatív AI korábban különálló eszközökben élt: a Midjourney a saját platformján, az Adobe Firefly a Creative Cloud falai között, a Runway és a Pika Labs pedig saját appként működött. A mostani lépésekkel a Meta és a Google nem egy új terméket mutat be – hanem a meglévő, milliárdos felhasználói bázissal rendelkező alkalmazásaikba ágyazzák be ugyanezeket a képességeket.
„Ez stratégiai lefejezés (decapitation): a különálló kreatív AI-startupok piaci érve – miszerint »mi egy dedikált, jobb eszközt kínálunk« – elhalványul, ha ugyanaz a funkció elérhető abban az appban, amelyet a felhasználó már eleve megnyit minden nap.”
A Google oldaláról nézve a Photos nem véletlenül kap egyre több AI-funkciót. A milliárdos felhasználói bázis és a rengeteg tárolt médiatartalom mély felhasználói kötődést jelent – minden új AI-képesség mélyíti a platformfüggőséget és a prémium előfizetés vonzerejét egyszerre. Az Apple ugyanezt csinálja az Apple Intelligence csomaggal, de eltérő filozófiával: a cupertinói cég az adatokat lehetőség szerint az eszközön dolgozza fel, míg a Google felhőalapú Gemini modelleket használ. A két megközelítés közötti verseny egyértelműen az egyik legfontosabb fogyasztói tech-csata lesz a következő két évben.
Kövesd a témát
Értesítést kapsz a profilodban és a heti hírlevélben, ha új cikkünk jelenik meg a követett témáidban.
A követéshez jelentkezz be.
Gyakori kérdések az AI hírekről
Hol olvashatóak a legfrissebb AI hírek magyarul?
A KakasTech AI Hírek rovata naponta frissül: a mesterséges intelligencia legújabb fejlesztései, modell-bejelentések és iparági elemzések magyar nyelven, ellenőrzött nemzetközi források alapján olvashatóak nálunk.
Milyen témákat fednek le a KakasTech AI hírei?
A nagy AI-laborok (OpenAI, Anthropic, Google DeepMind) bejelentéseitől a chipeken és a robotikán át a hazai és nemzetközi szabályozásokig minden lényeges területet követünk.
Hogyan értesülhetek azonnal a legújabb AI változásokról?
Feliratkozhatsz a heti összefoglaló hírlevelünkre a lap alján, vagy követheted az AI API-árkalkulátorunkat és az AI-modell összehasonlító oldalunkat a legfrissebb technikai adatokért.
Hozzászólások 0
Még nincsenek hozzászólások. Írd meg te az elsőt!