Keling AI lance Kling 3.0 : VIDEO 3.0 et Omni remodèlent la « logique narrative de la lumière et du son »
Kuaishou Keling AI lance la série KlingAI 3.0, avec le slogan officiel « All in One, One for All » ; VIDEO 3.0 et Omni prennent en charge nativement une analyse approfondie des commandes multimodales et une intégration multi-tâches, réalisant ainsi la double liaison de l'identité visuelle et de l'intonation vocale.
Kling AI (Kling), une filiale de Kuaishou, a lancé la nouvelle série KlingAI 3.0, dont le slogan officiel est « Tout en un, un pour tous ». En tant qu'acteur majeur du secteur vidéo national de l'IA, l'orientation de mise à niveau de Keling pour cette génération n'est pas simplement « plus longue et plus claire », mais se concentre sur une analyse approfondie des commandes multimodales et une intégration multi-tâches**.
VIDEO 3.0 et mise à niveau narrative d'Omni
La série de modèles Kling 3.0 repose sur une architecture entièrement mise à niveau, dans laquelle VIDEO 3.0 et VIDEO 3.0 Omni prennent en charge nativement une analyse approfondie des commandes multimodales et une intégration multitâche. La description officielle est assez visuelle : elle redéfinit la "logique narrative de la lumière et du son" - du contrôle précis du long storyboard narratif au découplage fonctionnel piloté par Native Audio, réalisant la double liaison de l'identité visuelle et de l'intonation de la voix. Dans les commutations multi-scènes complexes, VIDEO 3.0 combine une grande liberté de création avec une excellente cohérence.
Traduit dans un langage que les utilisateurs peuvent percevoir : dans le passé, les vidéos Wensheng étaient « les images suivent le texte », mais Kling 3.0 veut que « la voix participe également au récit » - l'identité, l'émotion et l'intonation des personnages de la vidéo sont unifiées, et il n'y a plus de « saut » lors du basculement entre plusieurs scènes.
Compétition face à face avec Seedance
En remettant Kling 3.0 dans le système de coordonnées de l'industrie, son adversaire direct est Seedance de Byte. L'article d'analyse de 36Kr de juillet 2026 « Ke Ling Can't Become Seedance » a déjà discuté des différences entre les deux : Seedance s'appuie sur le moteur Volcano pour monétiser le MaaS côté B, tandis que Ke Ling s'appuie sur Kuaishou Ecology pour explorer le côté C et l'économie des créateurs. Il est également rapporté qu'elle envisage de se séparer et de promouvoir son introduction en bourse.
Du point de vue de l'industrie, Keling 3.0 parie sur la « double narration visuelle et sonore » pour fournir aux créateurs du côté C davantage d'outils créatifs de narration - ce qui est cohérent avec sa voie « d'économie des créateurs ». Alors que Byte ouvre la voie dans le MaaS côté B, Keling choisit de se concentrer sur « l'expérience narrative » et les « outils de création ». Les deux sociétés ne sont pas obligées de rivaliser dans la même dimension, mais la concurrence dans les capacités « lumière et son » déterminera directement quel modèle les utilisateurs finaux C utiliseront pour raconter des histoires.
Plusieurs orientations à suivre dans le futur :
- L'effet réel de Native Audio : la double liaison du son et de la vision est-elle stable pendant la génération.
- Contrôle du contrôle du storyboard narratif long : équilibre entre liberté créative et cohérence dans le cadre d'une commutation multi-scènes complexe.
- Les progrès de l'introduction en bourse du spin-off de Keling : la série 3.0 peut-elle soutenir le récit de cotation ?
- Adoption réelle par les créateurs du côté C : si les nouvelles fonctionnalités peuvent être transformées en activité de l'écosystème des créateurs.
Avis