Aperçu
MMAudio génère de l'audio synchronisé à partir du contenu vidéo en utilisant l'IA, résolvant l'une des parties les plus chronophages de la post-production vidéo : trouver ou créer un son qui correspond réellement à ce qui est à l'écran. Sur Picasso IA, vous téléchargez un clip muet ou avec peu d'audio, décrivez les sons que vous souhaitez, et le modèle synthétise de l'audio qui correspond au contexte visuel. Un cinéaste ajoutant de la pluie ambiante à une scène en extérieur, un créateur de médias sociaux ayant besoin de sons de pas subtils pour une vidéo de cuisine, ou un animateur voulant un bourdonnement de machine doux pour une démo technologique peut tous l'utiliser sans aucun logiciel audio. Le résultat est un fichier vidéo téléchargeable avec l'audio généré déjà intégré et prêt à être utilisé.
- Téléchargez votre fichier vidéo dans le panneau d'entrée du modèle.
- Écrivez un prompt textuel décrivant les sons que vous souhaitez, comme « pluie légère sur les feuilles » ou « ambiance de café occupée ».
- Ajoutez éventuellement un prompt négatif pour exclure les sons que vous ne souhaitez pas, comme la musique ou la parole, pour garder la sortie concentrée sur ce dont vous avez besoin.
- Ajustez la durée pour qu'elle corresponde à la longueur de votre clip et définissez le nombre d'étapes d'inférence pour contrôler l'équilibre entre qualité et vitesse.
- Soumettez le travail et téléchargez votre vidéo avec la piste audio synthétisée déjà attachée.
Questions fréquemment posées
Ai-je besoin de compétences en programmation ou de connaissances techniques pour utiliser ceci ?
Non, ouvrez simplement MMAudio sur Picasso IA, ajustez les paramètres que vous souhaitez et cliquez sur générer.
MMAudio est-il gratuit à essayer ?
Oui, vous pouvez exécuter le modèle gratuitement sur Picasso IA sans vous inscrire. Des crédits peuvent s'appliquer pour des générations plus longues ou de meilleure qualité.
Combien de temps faut-il pour obtenir les résultats ?
La plupart des générations se terminent en moins d'une minute pour les clips jusqu'à 8 secondes. Les clips plus longs ou les nombres d'étapes d'inférence supérieurs peuvent prendre un peu plus de temps.
Quel format de sortie MMAudio retourne-t-il ?
Le modèle retourne un fichier vidéo avec l'audio généré déjà fusionné, prêt à télécharger et à insérer dans votre chronologie d'édition.
Puis-je personnaliser le style ou le contenu audio ?
Oui. Le prompt textuel vous permet de décrire n'importe quel environnement sonore dans un langage clair, et le prompt négatif vous permet d'exclure des types de sons spécifiques comme la musique ou les voix. Le paramètre CFG strength contrôle la proximité avec laquelle la sortie suit votre prompt.
Que se passe-t-il si l'audio généré ne correspond pas bien à la vidéo ?
Essayez d'affiner votre prompt textuel avec des descripteurs plus spécifiques, augmentez le nombre d'étapes d'inférence pour une meilleure qualité, ou utilisez une graine aléatoire différente pour obtenir une variation nouvelle de l'audio.