Ceci vient de tuer le montage vidéo par IA avec GPT 6 Astra

AAI LABS
컴퓨터/소프트웨어마케팅/광고AI/미래기술

스크립트

00:00:00Beaucoup de gens laissent désormais des modèles créer leurs vidéos de bout en bout, de la planification
00:00:04des plans au montage final en passant par l'ajout de la musique. Savoir concevoir ces vidéos
00:00:09est d'autant plus crucial si vous développez un produit, car elles constituent le moyen le plus rapide
00:00:13d'attirer l'attention sur ce que vous avez créé, sans obliger les gens à le tester. Mais si vous
00:00:18vous lancez directement dans la création, vous n'obtiendrez pas la qualité voulue et vous gaspillerez
00:00:22beaucoup de temps et de tokens. Pour éviter cela, il faut suivre un flux de travail complet garantissant que la
00:00:27vidéo corresponde exactement à vos attentes. Pour notre part, nous utilisons GPT-6 Astra dans Claude Code,
00:00:33car Astra figure parmi les meilleurs modèles de montage vidéo. Cette configuration nous permet d'exploiter
00:00:37les atouts des deux. Si vous découvrez notre chaîne, nous sommes une entreprise de logiciels, voici AI Labs, et dans cette
00:00:42vidéo, nous allons détailler ce workflow pas à pas, y compris les problèmes que vous pourriez rencontrer
00:00:47en chemin et la manière de les résoudre. Vous vous demandez peut-être pourquoi faire tourner Astra dans Claude Code
00:00:52alors qu'Astra intègre déjà ses propres outils dans Codex. C'est simplement parce que nous préférons les outils offerts par Claude Code,
00:00:58et c'est pourquoi nous l'utilisons pour quasiment tout ce que nous développons. Et si nous n'utilisons pas
00:01:02les modèles natifs de Claude ici, c'est qu'Astra offre globalement une meilleure direction artistique, se montrant
00:01:08d'ailleurs supérieur en matière de design face à Fable dans notre vidéo précédente. Avec cette méthode, Astra assure
00:01:14la direction créative de la vidéo, tandis que Claude Code exécute les outils pour la fabriquer. Mais si vous ne souhaitez pas
00:01:18utiliser Claude Code, vous pouvez aussi utiliser Codex en direct ou l'agent de code de votre choix. Si vous utilisez
00:01:24Codex, vous pouvez passer l'étape de configuration d'Astra dans Claude Code et aller directement à l'installation des outils
00:01:29vidéo. Pour utiliser Astra dans Claude Code comme nous, plusieurs étapes sont nécessaires. D'abord, il faut
00:01:35configurer Astra pour que Claude Code le reconnaisse en tant que modèle. Une solution consiste à payer l'API d'OpenAI
00:01:42et à la connecter à Claude Code, mais nous vous le déconseillons : ce modèle est onéreux et
00:01:47générer des vidéos consomme énormément de tokens, ce qui vous reviendrait très cher. L'autre solution consiste à utiliser Astra
00:01:53via votre abonnement Codex existant. Mais pour y avoir accès dans Claude Code, il vous faut
00:01:58un outil appelé CLI Proxy API. Il lance un petit serveur local sur votre machine qui relie Claude Code
00:02:04aux agents de code déjà installés. Ce serveur vous permet d'exploiter votre abonnement actuel sans
00:02:09payer de frais d'API supplémentaires. Il fonctionne avec de nombreux agents, et nous l'avons aussi utilisé dans notre vidéo
00:02:14sur le design de Kimmy. Pour l'utiliser, installez d'abord l'outil en exécutant la commande brew install dans votre
00:02:20terminal. Une fois installé, quelques réglages s'imposent, notamment modifier certains paramètres
00:02:25et générer une clé d'API. Mais plutôt que de faire tout cela vous-même, il est bien plus simple de demander
00:02:30à l'agent que vous utilisez de le paramétrer à votre place, en précisant dans votre prompt quel modèle vous souhaitez
00:02:35exploiter via cet outil. Une fois les réglages terminés, l'agent vous fournira la clé d'API dont Claude Code
00:02:40aura besoin pour se connecter à l'outil. Conservez bien cette clé pour l'étape de connexion. Une fois installé,
00:02:45l'outil démarrera automatiquement, sans qu'aucune commande supplémentaire ne soit requise. Notez bien que la
00:02:50clé fournie par l'agent n'est pas une clé d'API classique qui vous facture à chaque token. Cette clé
00:02:55vous permet simplement d'utiliser les agents installés via un serveur tournant sur votre ordinateur. Elle ne fonctionne
00:03:00que sur votre système et nulle part ailleurs. Ensuite, vous devez connecter CLI Proxy API à votre compte Codex
00:03:06à l'aide de sa commande de connexion. En l'exécutant dans votre terminal, votre navigateur s'ouvrira pour vous inviter
00:03:11à vous authentifier. Une fois connecté, l'outil enregistre vos identifiants Codex pour pouvoir exploiter votre abonnement.
00:03:16Une fois identifié, vous devez lancer Claude Code avec Astra. En temps normal, Claude Code transmet
00:03:21toutes vos requêtes à Anthropic, ce qui vous donne accès aux modèles de Claude. Mais comme vous ne voulez pas
00:03:26des modèles de Claude pour le moment, il faut modifier le paramètre « base URL » pour que Claude Code redirige
00:03:32toutes les requêtes vers le serveur local de votre ordinateur. Ajoutez ensuite la clé d'API copiée
00:03:36précédemment, puis définissez GPT-6 Astra comme modèle. Dès le lancement de Claude Code, GPT-6 Astra sera
00:03:43disponible et immédiatement opérationnel. Une fois cela fait, il ne reste plus qu'une étape de configuration :
00:03:48installer les outils dédiés à la création vidéo. Vous pouvez faire une pause ici, prendre une capture d'écran
00:03:53de cette liste et la transmettre à votre agent afin qu'il installe l'ensemble. Ces outils intègrent
00:03:58des compétences qui indiquent à l'agent comment les manipuler pour monter la vidéo. Une fois installés, vous êtes
00:04:03prêt à générer vos vidéos. Mais avant de poursuivre notre tutoriel, n'hésitez pas
00:04:08à vous abonner à la chaîne et à cliquer sur le bouton d'encouragement, ce petit geste de soutien compte énormément pour nous.
00:04:13Pour notre vidéo de présentation, nous avons pris pour exemple une boutique de vêtements artistiques où l'on compose une tenue avant de l'acheter.
00:04:18Nous avons conçu cette boutique à partir du modèle d'application partagé avec notre communauté, qui constitue un excellent point de départ
00:04:23pour développer votre propre projet. Avant de générer la vidéo, il a fallu définir quelles parties
00:04:28du site mettre en valeur et de quelle façon. La planification est essentielle, car le rendu peut
00:04:33prendre des heures : sans un plan vérifié en amont, vous risquez de perdre un temps fou pour un résultat non conforme
00:04:38à vos attentes. Pour cadrer tout cela, nous avons fourni à Claude Code l'URL locale de notre boutique afin qu'il puisse
00:04:43l'ouvrir et concevoir la vidéo en conséquence. Nous avons aussi précisé la durée et le format souhaités :
00:04:48une vidéo de 30 secondes au ratio 16:9, le format horizontal standard des démonstrations de produit.
00:04:55Vous pouvez opter pour le 9:16 si vous visez un format vertical pour les réseaux sociaux. Nous voulions également une musique de fond
00:05:00sans voix off, ce que nous avons aussi spécifié dans le prompt. Or, si le plan se contente de décrire
00:05:05les plans sous forme de texte, il est difficile de visualiser le rendu final. Nous lui avons donc demandé d'afficher le plan
00:05:10dans notre navigateur pour prévisualiser la vidéo et demander des ajustements. Nous avons aussi exigé
00:05:15un espace pour laisser des commentaires sur le storyboard, afin d'indiquer précisément à l'agent les éléments à modifier.
00:05:20Nous lui avons également demandé de s'inspirer des vidéos de lancement d'Anthropic et de Linear pour définir l'esthétique
00:05:26et le dynamisme de notre vidéo. Donner des références est crucial, car l'agent cerne ainsi parfaitement la vision
00:05:31que vous avez en tête. Ces références l'aident aussi à orchestrer les travellings sur la page ou les zooms
00:05:36sur un bouton précis. Dès réception du prompt, il a chargé les compétences installées avec Hyperframes. Hyperframes
00:05:41fait partie des outils que nous avons installés pour aider l'agent à concevoir la vidéo. L'agent a mobilisé ses compétences vidéo
00:05:46pour planifier les prises de vue, puis ses autres compétences pour structurer toute la vidéo. Une fois terminé, il a ouvert
00:05:52l'intégralité du plan dans le navigateur. On y voyait ce qui apparaîtrait à chaque seconde, la trajectoire de la
00:05:56caméra et les interactions sur le site. Et comme demandé, un espace de commentaires permettait
00:06:01de lui indiquer les retouches souhaitées. Vous pouvez en ajouter autant que nécessaire pour veiller à ce
00:06:06que le résultat vous convienne parfaitement. Votre relecture finie, demandez-lui d'analyser vos retours, d'actualiser le
00:06:11plan et d'appliquer les corrections. Dès que le storyboard vous convient, demandez à l'agent de le verrouiller
00:06:16afin qu'il sache que cette orientation est définitive. Vous pouvez ensuite passer à l'étape
00:06:21suivante. Mais d'abord, un mot de notre sponsor, Luma AI. Tout outil vidéo IA vous oblige à choisir deux critères sur
00:06:27trois : rapide, économique ou qualitatif. Ray 3.2 brise cette règle. Nous y avons testé des plans cinématographiques et de l'anime, et tout
00:06:34a été rendu en 1080p natif, HDR intégral, quatre fois plus vite et pour un tiers du coût de Ray 3. Le comparatif de vitesse
00:06:41était presque déconcertant : on cliquait sur Générer en s'attendant à attendre, et c'était déjà prêt. Ce qui nous a encore plus surpris,
00:06:46c'est la fidélité : les prompts collaient de bien plus près à nos demandes, les bugs ont disparu et le style restait homogène
00:06:52d'une image à l'autre. Si vous avez déjà rendu un plan en vous disant « ça ira, je corrigerai en post-prod »,
00:06:57ce n'est plus nécessaire. Ray 3.2 gère les images clés et propose un outil de retouche pour modifier directement un plan terminé
00:07:04et le rectifier. De plus, Luma héberge désormais SeaDance 2.5, en nette progression par rapport à la version 2.0, ainsi que Gen-4.5 et Kling 3.0,
00:07:13pour vous laisser choisir le modèle idéal. Testez Ray 3.2 via le lien en commentaire épinglé ou flashez le QR code à l'écran.
00:07:20L'étape suivante consiste à créer chaque plan séparément. À ce stade, nous générons une version basique
00:07:25de chaque prise de vue afin de valider les mouvements de caméra avant de consacrer du temps aux finitions. Si
00:07:30nous générons chaque plan de façon isolée, c'est parce que si l'un d'eux ne convient pas, il suffit de modifier
00:07:35ce plan précis sans avoir à recalculer toute la vidéo. C'est également à ce moment-là
00:07:40que l'on vérifie les zooms et les cadrages pour s'assurer qu'ils sont conformes. Pour cela, nous lui avons soumis un
00:07:45prompt lui demandant d'ouvrir le navigateur, d'enregistrer chaque plan en plein écran et d'en faire un clip vidéo
00:07:51afin de pouvoir vérifier la bonne exécution des mouvements de caméra. Suite à ce prompt, l'agent s'est mis au travail
00:07:56sur les plans. Il a généré le tout premier et nous a demandé de le valider avant de poursuivre, évitant ainsi
00:08:01qu'un éventuel défaut ne se répercute sur l'ensemble de la vidéo en le repérant le plus tôt possible.
00:08:06Il a ensuite affiché les images et le clip enregistré dans notre navigateur. Si la première séquence nécessite des retouches, vous pouvez les demander,
00:08:12et dès qu'elle vous satisfait, lancez la génération du reste. Une fois l'opération terminée, vous pouvez visionner
00:08:17l'ensemble dans votre navigateur. Dans notre cas, plusieurs clips tremblaient bizarrement et
00:08:22certains zooms ne correspondaient pas au storyboard initial. Nous lui avons donc demandé de les corriger. Vous pouvez
00:08:26continuer à demander des ajustements sur n'importe quel passage jusqu'à obtenir le résultat escompté. L'intérêt
00:08:31de valider ces versions brutes d'abord est que si un plan doit être refait, nous n'avons pas encore perdu de temps
00:08:36à peaufiner ses finitions. Une fois le contenu visuel approuvé, nous pouvons fluidifier les mouvements et assembler les plans
00:08:41en une seule vidéo. À ce stade, nous avions des clips distincts avec des mouvements et zooms basiques, et il fallait
00:08:47les monter en un ensemble fluide et cohérent. Pour peaufiner le rendu, nous avons demandé à Claude Code d'adoucir les
00:08:53mouvements et de fusionner les séquences pour que chaque plan s'enchaîne naturellement avec le suivant. Dans cette consigne,
00:08:58nous avons précisé la trajectoire de la caméra, les points de zoom et le moment où la saisie de texte devait apparaître.
00:09:02La génération de la vidéo complète a pris pas mal de temps, mais au final, nous avons obtenu un montage unifié
00:09:07sans musique. L'agent enregistre le fichier dans son dossier de travail, ce qui permet de l'ouvrir directement pour
00:09:13le contrôler. Si un élément cloche, il vous suffit de préciser à l'agent à quel moment cela se produit.
00:09:17Chez nous, l'un des plans était trop décalé sur la droite : nous lui avons donc demandé de le recentrer
00:09:22correctement. Une fois toutes les modifications apportées, demandez-lui d'analyser à nouveau la vidéo
00:09:27pour repérer les éventuels défauts restants. Les outils installés intègrent déjà des tests de contrôle vérifiant
00:09:32les moindres imperfections, si bien qu'après leur exécution, la vidéo finale en est totalement exempte.
00:09:38L'ultime étape consiste à ajouter la musique. C'est une phase primordiale, car c'est la musique qui
00:09:43maintient le spectateur en haleine d'un plan à l'autre et rend la vidéo bien plus captivante. Si
00:09:48vous vous contentez de lui demander d'ajouter de la musique, l'agent choisira un morceau seul, mais qui risque de détonner.
00:09:54Il faut lui donner des directives sur le style recherché. Pour encadrer ce choix, nous avons créé une compétence
00:09:59qui indique très précisément à l'agent comment sélectionner la musique. Elle analyse l'ambiance du produit définie dans le
00:10:04plan et mesure le rythme des transitions entre les plans. Elle s'appuie sur cette cadence pour chercher
00:10:10un morceau dont le tempo colle à la vidéo, en fouillant le site Mixkit parmi les morceaux libres de droits, dans des registres comme
00:10:16« calme » ou « piano ». Pour concevoir cette compétence, nous avons fourni à Claude Code un prompt détaillant le processus exact
00:10:21à suivre, et il a généré l'outil avec tout le nécessaire pour trouver la musique et l'intégrer à la vidéo.
00:10:26Si vous souhaitez obtenir cette compétence, vous pouvez copier le prompt et le transmettre à votre agent afin qu'il suive
00:10:31la même démarche et la crée pour vous. Pour l'utiliser, il suffit de taper « / » suivi du nom de la
00:10:36compétence : l'agent déniche alors la musique et l'ajoute au montage, puis exporte une nouvelle version de la vidéo
00:10:42avec la bande-son intégrée. Nous avons regroupé et perfectionné l'ensemble de ce workflow dans une compétence prête à l'emploi
00:10:52que vous pouvez directement intégrer à vos flux de travail. Elle a été peaufinée au fil de nombreux tests et optimisations,
00:10:57et elle est accessible sur AI Labs Pro, notre communauté. Alors si vous appréciez notre travail et désirez
00:11:03soutenir la chaîne, c'est le meilleur moyen de le faire. Le lien se trouve dans la description. Nous arrivons au terme de
00:11:08cette vidéo. Si vous souhaitez soutenir notre travail et nous aider à continuer d'en créer d'autres, vous pouvez
00:11:13le faire via le bouton « Merci » situé ci-dessous. Comme toujours, merci pour votre fidélité et à très bientôt pour la suite !

핵심 요약

L'association de GPT-6 Astra et de Claude Code via CLI Proxy API permet de concevoir et de monter automatiquement des vidéos de démonstration produit sur mesure grâce à un flux de travail structuré allant du storyboard interactif à l'ajout d'une bande-son synchronisée.

하이라이트

  • L'utilisation de GPT-6 Astra dans Claude Code via l'outil open source CLI Proxy API permet d'exploiter un abonnement Codex existant sans payer de frais d'API OpenAI supplémentaires.

  • La génération d'une vidéo de démonstration produit au format 16:9 de 30 secondes nécessite l'URL locale de l'application pour concevoir un storyboard interactif prévisualisable dans le navigateur.

  • Le découpage du rendu en plans individuels bruts évite le recalcul de l'ensemble de la séquence vidéo en cas d'erreur de cadrage ou de trajectoire de caméra.

  • L'intégration du modèle Ray 3.2 de Luma AI offre un rendu natif en 1080p HDR quatre fois plus rapide et pour un tiers du coût de la version précédente Ray 3.

  • L'automatisation du choix musical repose sur une compétence personnalisée qui analyse le rythme des transitions et extrait des morceaux libres de droits au tempo adapté depuis Mixkit.

타임라인

Avantages de la combinaison entre GPT-6 Astra et Claude Code

  • La création intégrale de vidéos par des modèles IA accélère la promotion de nouveaux produits sans nécessiter de tests manuels par les utilisateurs.
  • GPT-6 Astra surpasse Fable en matière de direction artistique et de design visuel.
  • L'exécution d'Astra au sein de Claude Code combine la sensibilité créative du premier avec les capacités d'exécution d'outils du second.

L'absence de méthodologie structurée lors de la génération vidéo entraîne un gaspillage important de temps et de tokens. GPT-6 Astra assure la direction artistique globale tandis que Claude Code orchestre les outils de montage nécessaires à la fabrication. Ce duo constitue une alternative supérieure aux agents nartifs pour piloter la production visuelle.

Configuration technique de CLI Proxy API et installation des outils

  • L'utilisation directe de l'API OpenAI s'avère extrêmement coûteuse en raison de la forte consommation de tokens liée à la vidéo.
  • CLI Proxy API crée un serveur local via la commande Homebrew pour lier Claude Code à un abonnement Codex existant.
  • La redirection du paramètre base URL dans Claude Code permet d'exécuter GPT-6 Astra sans frais d'API par token.

Le serveur local CLI Proxy API sert de pont d'authentification sécurisé et restreint à la machine de l'utilisateur. Après authentification sur le compte Codex via le navigateur, la modification de l'URL de base dans Claude Code redirige les requêtes vers ce serveur local. L'injection d'un jeu de compétences vidéo dédiées finalise l'environnement de travail.

Planification et validation du storyboard interactif dans le navigateur

  • L'accès à l'URL locale de l'application permet à l'agent de concevoir un plan séquentiel précis pour une vidéo de 30 secondes au format 16:9.
  • L'outil Hyperframes génère un storyboard Web interactif incluant les trajectoires de caméra et un espace de commentaires.
  • Le verrouillage du plan d'action après révision empêche toute modification intempestive lors des phases de rendu ultérieures.

La planification initiale évite de perdre des heures de calcul sur des rendus non conformes aux besoins du projet. L'affichage du storyboard directement dans le navigateur offre une prévisualisation seconde par seconde des mouvements de caméra et des interactions de l'interface. L'annotation directe sur cette interface permet à l'agent d'ajuster le plan avant de figer la direction artistique.

Performances du modèle de rendu visuel Ray 3.2 de Luma AI

  • Ray 3.2 génère des séquences en 1080p HDR quatre fois plus rapidement que Ray 3 pour un tiers du coût.
  • Le système intègre un outil de retouche directe pour rectifier les images clés sans reprendre le rendu à zéro.
  • La plateforme Luma regroupe d'autres modèles avancés comme SeaDance 2.5, Gen-4.5 et Kling 3.0.

Contrairement aux générateurs classiques qui imposent un compromis entre vitesse, coût et qualité, Ray 3.2 élimine ces contraintes. Les tests menés sur des plans cinématographiques et des styles d'animation montrent une fidélité accrue aux consignes visuelles. La gestion des images clés et les fonctions d'édition intégrées simplifient la correction des imperfections visuelles en post-production.

Génération individuelle des plans et assemblage de la vidéo finale

  • La génération isolée de chaque plan limite le besoin de recalculer l'intégralité de la vidéo en cas d'erreur sur un cadrage.
  • L'agent valide le tout premier plan généré avec l'utilisateur avant de poursuivre la production de la suite de la séquence.
  • La phase d'assemblage applique un lissage des trajectoires de caméra et exécute des tests de contrôle automatisés.

Chaque scène est d'abord enregistrée sous forme de clip brut dans le navigateur pour contrôler la précision des zooms et des saisies de texte. Cette approche granulaire permet d'ajuster les éléments tremblants ou mal centrés sans gaspiller de ressources. Une fois les séquences individuelles approuvées, Claude Code fusionne l'ensemble en une vidéo fluide et exécute des tests de contrôle pour supprimer les derniers défauts visuels.

Sélection automatique et intégration de la musique de fond

  • Une compétence sur mesure évalue l'ambiance du produit et le rythme des transitions pour sélectionner la bande-son idéale.
  • L'agent extrait des pistes libres de droits au tempo correspondant sur la plateforme Mixkit.
  • La commande dédiée exécute la recherche, la synchronisation et l'exportation du fichier vidéo final avec la musique.

Laisser le choix musical à un agent sans directives strictes produit souvent un décalage tonale avec l'ambiance du produit. La compétence développée analyse la cadence du montage et télécharge automatiquement une piste adaptée depuis Mixkit. L'ensemble de ce processus est condensé dans une commande unique qui finalise l'exportation de la vidéo.

커뮤니티 글

아직 글이 없습니다. 이 영상에 대한 첫 번째 글을 작성해 보세요!

이 영상에 대해 글쓰기