अवलोकन
MMAudio AI का उपयोग करके वीडियो सामग्री से सिंक्रोनाइज़्ड ऑडियो उत्पन्न करता है, जो वीडियो पोस्ट-प्रोडक्शन के सबसे समय लेने वाले भागों में से एक को हल करता है: ध्वनि ढूंढना या बनाना जो वास्तव में स्क्रीन पर क्या है इससे मेल खाता है। Picasso IA पर, आप एक मौन या कम-ऑडियो क्लिप अपलोड करते हैं, वह ध्वनि का वर्णन करते हैं जो आप चाहते हैं, और मॉडल ऑडियो संश्लेषित करता है जो दृश्य संदर्भ से मेल खाता है। एक फिल्मकार बाहरी दृश्य में परिवेश बारिश जोड़ रहा है, एक सोशल मीडिया निर्माता को खाना पकाने के वीडियो के लिए सूक्ष्म पदचिन्ह की आवश्यकता है, या एक एनिमेटर को तकनीकी डेमो के लिए नरम मशीन की गुनगुनाहट चाहिए, ये सभी बिना किसी ऑडियो सॉफ्टवेयर के इसका उपयोग कर सकते हैं। परिणाम एक डाउनलोड योग्य वीडियो फ़ाइल है जिसमें उत्पन्न ऑडियो पहले से ही एम्बेड किया गया है और उपयोग के लिए तैयार है।
यह कैसे काम करता है
- अपनी वीडियो फ़ाइल को मॉडल इनपुट पैनल पर अपलोड करें।
- ऐसी ध्वनियों का वर्णन करते हुए एक पाठ प्रॉम्प्ट लिखें जो आप चाहते हैं, जैसे "पत्तियों पर हल्की बारिश" या "व्यस्त कॉफी शॉप का माहौल।"
- वैकल्पिक रूप से एक नकारात्मक प्रॉम्प्ट जोड़ें ताकि आप जो ध्वनि नहीं चाहते, जैसे संगीत या भाषण, को बाहर कर सकें, जिससे आउटपुट इस पर केंद्रित रहे जो आपको आवश्यकता है।
- अपनी क्लिप की लंबाई से मेल खाने के लिए अवधि को समायोजित करें और गुणवत्ता और गति के बीच संतुलन को नियंत्रित करने के लिए अनुमान चरणों की संख्या सेट करें।
- काम जमा करें और अपनी वीडियो डाउनलोड करें जिसमें संश्लेषित ऑडियो ट्रैक पहले से ही संलग्न है।
अक्सर पूछे जाने वाले प्रश्न
क्या इसे उपयोग करने के लिए मुझे प्रोग्रामिंग कौशल या तकनीकी ज्ञान की आवश्यकता है?
नहीं, बस MMAudio को Picasso IA पर खोलें, जो सेटिंग्स चाहते हैं उन्हें समायोजित करें, और जेनरेट दबाएं।
क्या MMAudio को आजमाने के लिए मुफ़्त है?
हां, आप Picasso IA पर साइन अप किए बिना मॉडल को मुफ़्त में चला सकते हैं। लंबी या उच्च-गुणवत्ता वाली पीढ़ी के लिए क्रेडिट लागू हो सकते हैं।
परिणाम प्राप्त करने में कितना समय लगता है?
अधिकांश पीढ़ी 8 सेकंड तक की क्लिप के लिए एक मिनट से कम समय में समाप्त हो जाती है। लंबी क्लिप या उच्च अनुमान चरण गिनती में थोड़ा अधिक समय लग सकता है।
MMAudio कौन सा आउटपुट प्रारूप लौटाता है?
मॉडल एक वीडियो फ़ाइल लौटाता है जिसमें उत्पन्न ऑडियो पहले से ही मर्ज किया गया है, डाउनलोड करने और आपकी संपादन समयरेखा में डालने के लिए तैयार है।
क्या मैं ऑडियो शैली या सामग्री को अनुकूलित कर सकता हूं?
हां। पाठ प्रॉम्प्ट आपको किसी भी ध्वनि वातावरण को सादी भाषा में वर्णित करने देता है, और नकारात्मक प्रॉम्प्ट आपको संगीत या आवाज जैसे विशिष्ट ध्वनि प्रकार को बाहर करने देता है। CFG शक्ति सेटिंग नियंत्रित करती है कि आउटपुट आपके प्रॉम्प्ट का कितने निकटता से पालन करता है।
यदि जेनरेट की गई ऑडियो वीडियो से अच्छी तरह से मेल नहीं खाती तो क्या होता है?
अधिक विशिष्ट विवरणकर्ताओं के साथ अपने पाठ प्रॉम्प्ट को परिष्कृत करने का प्रयास करें, बेहतर गुणवत्ता के लिए अनुमान चरणों की संख्या बढ़ाएं, या ऑडियो की एक नई भिन्नता पाने के लिए एक अलग यादृच्छिक बीज का उपयोग करें।