كيفية استخدام مولّد فيديو بالذكاء الاصطناعي متعدد الوسائط
أنشئ مقاطع فيديو بالذكاء الاصطناعي من وصف نصي وصورة أو فيديو مرجعي ضمن سير عمل متعدد الوسائط.
- مرجع بصري استخدم <Picture 1> و<Video 1> و<Audio 1> في الوصف. انقر على الوسم لإدراجه. يُستخدم الفيديو للصورة والحركة فقط؛ ارفع الصوت بشكل منفصل.
- وصف الفيديو صف المشهد والحركة والمظهر المطلوب...
- ابدأ المعالجة قم بتشغيل الأداة واتركها تعالج الملف.
- تنزيل النتيجة تم! فيديو الذكاء الاصطناعي جاهز للتنزيل.
لماذا يستخدم الأشخاص هذه الأداة
- لا يتم تخزين الأوامر والنتائج.
- مجهول وخاص.
- مدعوم بنماذج ذكاء اصطناعي متميزة.
- سير عمل سريع وبسيط.
FAQ - مولّد فيديو بالذكاء الاصطناعي متعدد الوسائط
- ما هو توليد الفيديو متعدد الوسائط بالذكاء الاصطناعي وكيف تعمل الأداة؟
- يجمع توليد الفيديو متعدد الوسائط بالذكاء الاصطناعي بين موجه نصي وصفي ومراجع بصرية وسمعية (صور، مقاطع فيديو وملفات صوتية). بدلاً من معالجة نص مجرد أو صورة ثابتة واحدة، يقوم النموذج بتحليل وسائط متعددة في آن واحد، مما يمنحك تحكماً دقيقاً في الشخصيات وحركات الكاميرا وتكوين المشهد والإضاءة في مقطع فيديو عالي الدقة.
- كيف أستخدم وسوم المراجع مثل <Picture 1> و <Video 1> و <Audio 1> في الموجه؟
- عند رفع ملفات مرجعية، يتم ترقيمها تلقائياً. يمكنك كتابة وسوم مثل <Picture 1> أو <Video 1> أو <Audio 1> داخل الموجه النصي أو النقر على شارة المعاينة لإدراجها. حدد للذكاء الاصطناعي بدقة دور كل مرجع، مثل: "الشخصية من <Picture 1> تمشي في المدينة بحركة الكاميرا الديناميكية من <Video 1>". يوفر الفيديو توجيه المشهد والحركة، بينما يقدم الصوت التوجيه الصوتي والأجواء.
- ما هي صيغ الملفات وحدود الأحجام المدعومة عند الرفع؟
- يمكنك رفع ما يصل إلى 3 صور (JPG أو PNG أو WebP بحجم يصل إلى 10 ميجابايت لكل صورة)، ومقطع فيديو مرجعي واحد (MP4 أو WebM أو MOV بمدة بين 2 و10 ثوانٍ وبحجم حتى 30 ميجابايت)، وما يصل إلى ملفين صوتيين (MP3 أو WAV أو M4A أو FLAC أو OGG بحجم حتى 10 ميجابايت). لا يجوز أن يتجاوز الحجم الإجمالي لجميع المراجع المرفوعة 32 ميجابايت.
- ما الفرق بين هذا التوليد وتوليد الفيديو التقليدي من نص أو من صورة؟
- في تحويل النص إلى فيديو التقليدي، يضطر الذكاء الاصطناعي لتخمين المشهد كاملاً من الكلمات وحدها، مما قد يعطي تفاصيل عشوائية. أما في تحويل الصورة إلى فيديو، فعادةً ما يتم تحريك صورة ثابتة واحدة. يجمع التوليد متعدد الوسائط بين أفضل ما في الطريقتين: تضبط ملامح الشخصية بالصور، وتوجه زوايا الكاميرا وحركتها بفيديو مرجعي، وتضبط التفاصيل بالنص والصوت لأعلى اتساق بصري.
- كيف يتم تحديد نسبة العرض إلى الارتفاع ودقة الفيديو؟
- تكتشف الأداة تلقائياً نسبة الأبعاد المناسبة بالاعتماد على الصورة أو الفيديو المرجعي المرفوع للحفاظ على التكوين الأصلي. بدلاً من ذلك، يمكنك اختيار نسب قياسية يدوياً من الإعدادات، مثل الشاشة العريضة (16:9)، أو الوضع الرأسي لـ Reels وTikTok وShorts (9:16)، أو المربع (1:1)، أو 4:3.
- كم عدد النقاط (Credits) المطلوبة للتوليد وكيف يتم الحساب؟
- يُحسب السعر من الخادم: من دون مرجع فيديو، 90 رصيداً + 5 أرصدة لكل ثانية إضافية أو جزء منها بعد 3 ثوانٍ، و+10 عند إضافة صورة واحدة على الأقل و+5 لكل مرجع صوت مستقل. مع مرجع فيديو، يكون السعر 150 رصيداً +10 لكل ثانية إضافية أو جزء منها بعد 3 ثوانٍ، و+5 عند إضافة صورة واحدة على الأقل ولكل مرجع صوت. المدة من 3 إلى 10 ثوانٍ. مثال: 10 ثوانٍ مع مرجع فيديو تكلف 220 رصيداً. يظهر السعر الدقيق على الزر قبل البدء، ولا تُخصم أرصدة عند الفشل أو الإلغاء.
- كم يستغرق التوليد وما هي صيغة الفيديو النهائية؟
- نظراً لأن نماذج الذكاء الاصطناعي متعددة الوسائط تجري معالجة متقدمة لدمج عدة مصادر في نفس الوقت، تستغرق العملية عادةً من دقيقتين إلى 4 دقائق. يتم تسليم الفيديو النهائي بصيغة MP4 عالية الجودة، ويمكن تشغيله مباشرة في المشغل المدمج وتنزيله على جهازك.
- هل يحق لي استخدام مقاطع الفيديو المولدة لأغراض تجارية؟
- نعم، جميع مقاطع الفيديو التي يتم إنشاؤها باستخدام النقاط المميزة يمكن استخدامها بحرية في المشاريع التجارية وحسابات التواصل الاجتماعي ويوتيوب والحملات الإعلانية وأعمال العملاء وفقاً لشروط الخدمة.
- هل يتم تخزين بياناتي والوسائط التي تم توليدها؟
- لا. لحماية خصوصيتك، يتم نقل جميع الوسائط والأوامر المحملة مؤقتًا للمعالجة، وحذفها فورًا عند الانتهاء ولا يتم تخزينها على خوادمنا. لن يراها أحد سواك على الإطلاق. يتم تخزين سجل الدردشة وجميع النتائج التي تم توليدها محليًا فقط في متصفحك على جهازك الخاص.
الأداة غير متاحة حاليًا
تم إيقاف هذه الأداة مؤقتًا. ستعود قريبًا — وحتى ذلك الحين، أدواتنا الأخرى في خدمتك.