China ocupă 9 din primele 10 locuri în AI video; Miza reală ar putea fi roboții

1.418 ori 11-08-2026
China ocupă 9 din primele 10 locuri în AI video; Miza reală ar putea fi roboții

China domină deja generarea video cu AI: 9 din primele 10 modele sunt chinezești. O analiză Bloomberg Opinion atrage atenția că avantajul nu privește doar producția de clipuri sau Hollywood-ul, ci ar putea conta în cursa pentru viitoarele „world models” — sisteme care încearcă să înțeleagă mișcarea, relațiile dintre obiecte și dinamica lumii fizice.

Datele sunt greu de ignorat. În clasamentul Text-to-Video al Artificial Analysis, Google este singurul nume occidental din primele zece poziții. Restul aparțin MiniMax, ByteDance, Alibaba, KlingAI și Skywork AI. Clasamentul este construit din comparații oarbe între clipuri, utilizatorii alegând rezultatul preferat fără să știe modelul care l-a generat.

Nouă poziții din zece, dar nu nouă companii

LocModelCompanie
1Gemini Omni FlashGoogle
2MiniMax H3MiniMax
3Dreamina Seedance 2.0ByteDance
4Wan2.7-260612Alibaba
5HappyHorse 1.1Alibaba-ATH
6HappyHorse 1.0Alibaba-ATH
7Wan 2.7Alibaba
8Kling 3.0 ProKlingAI
9SkyReels V4Skywork AI
10Kling 3.0 StandardKlingAI

Nuanța contează: China nu are nouă companii diferite în top 10, ci nouă modele sau variante de modele. Google rămâne chiar pe primul loc cu Gemini Omni Flash, despre care am scris și pe Mobilissimo, dar imediat sub el clasamentul devine aproape integral chinezesc. MiniMax H3 și Seedance 2.0 se află foarte aproape, iar Alibaba ocupă patru dintre primele șapte poziții prin familiile Wan și HappyHorse.

Situația arată foarte diferit față de perioada în care Sora părea să stabilească ritmul întregii industrii. Între timp, OpenAI a închis produsul Sora, iar laboratoarele chineze au continuat să lanseze generații noi într-un ritm agresiv. ByteDance, de exemplu, spune că Seedance 2.0 poate combina text, imagini, audio și video într-o singură arhitectură de generare multimodală.

Hollywood-ul este partea vizibilă. Roboții ar putea fi miza mai mare

Un generator video bun trebuie să păstreze obiectele coerente de la un cadru la altul și să aproximeze cum se mișcă oamenii, lichidele sau obiectele. De aici apare legătura cu world models: modele capabile să reprezinte cum evoluează o lume în timp și să anticipeze ce se întâmplă după o anumită acțiune.

Asta nu înseamnă că un model aflat sus într-un benchmark video știe automat fizică sau poate conduce un robot. Artificial Analysis măsoară preferința oamenilor pentru clipurile generate, nu capacitatea unui sistem de a planifica sigur în lumea reală. Cercetarea din robotică arată însă că modelele video sunt deja studiate pentru simulare, predicția acțiunilor, planificare vizuală și antrenarea roboților, tocmai pentru că pot învăța dinamica mediului din secvențe vizuale.

ByteDance merge deja în direcția asta. Echipa Seed a prezentat proiectul VideoWorld, conceput pentru a învăța reguli, raționament și planificare din informație vizuală, iar compania are separat cercetare în robotică. Noi am urmărit inclusiv roboții ByteDance care învață să împăturească haine și să manipuleze obiecte.

Aici devine interesant avantajul Chinei. Un clip spectaculos de 10 secunde poate lua like-uri și poate speria studiourile de film; un model care începe să prezică fidel ce se întâmplă când un robot mută, împinge sau scapă un obiect poate avea o valoare industrială cu totul diferită. Cele nouă poziții din top 10 nu demonstrează că această cursă a fost deja câștigată, dar arată că AI-ul video este unul dintre domeniile în care laboratoarele chineze nu mai încearcă să recupereze terenul - ele stabilesc o bună parte din ritm.

?>
Continuă lectura

Cele mai noi știri din categoria Diverse

Știri recente din aceeași zonă editorială, ușor de parcurs după subiectul curent.

?>