Black Forest Labs ByteDance Disney Flux 2 Google Imagen Google Veo Hedra HeyGen Hollywood Kling AI LTX Studio Magnific Midjourney Netflix OpenAI Runway Topaz أدوات الذكاء الاصطناعي إنتاج الأفلام الأفاتار الرقمي التقاط الأداء الذكاء الاصطناعي في التصوير الصوت المكاني النص إلى فيديو تحرير الصور تحرير الفيديو تحريك الشخصيات تحسين الصور تقنيات الصوت توليد الصور بالذكاء الاصطناعي توليد فيديو بالذكاء الاصطناعي ذكاء اصطناعي صوتي ذكاء اصطناعي في الترفيه صناعة الأفلام مزامنة الشفاه نماذج الذكاء الاصطناعي نماذج مفتوحة المصدر
نشر فريق بحثي من هونغ كونغ demo لأداة طال انتظارها: Neural Spatial Audio Generation.
ترفع مقطع فيديو، وتضيف الأداة مؤثرات صوتية تفهم عمق المشهد واتجاه الأصوات — ليس مجرد صوت mono مسطّح، بل صوت يتحرك مع الصورة ويعكس الفضاء ثلاثي الأبعاد للمشهد.
إذا كنت تستخدم سماعات أثناء مشاهدة الـ demo، ستلاحظ فرقًا واضحًا جدًا: الأصوات تأتي من اتجاهات مختلفة تتوافق مع الصورة.
هذه الميزة غائبة عن معظم أدوات الفيديو الحالية. ظهورها يُشير إلى أنها ستصبح standard قريبًا، مما سيرفع جودة المحتوى المولَّد بالذكاء الاصطناعي إلى مستوى جديد.
Comments0