Flux 3 — إنشاء فيديوهات AI مع صوت مدمج، حتى 20 ثانية
أطلقت Black Forest Labs Flux 3 — أول نموذج يولد فيديو وصوتاً في وقت واحد، حتى 20 ثانية، مما يمثل علامة فارقة في تاريخ إنشاء محتوى الوسائط بالذكاء الاصطناعي.
Flux 3 — إنشاء فيديوهات AI مع صوت مدمج
في 23 يوليو 2026، أعلنت شركة Black Forest Labs رسمياً عن Flux 3 — أول نموذج متعدد الوسائط يمكنه إنشاء فيديوهات مع صوت مدمج ومتزامن، تصل مدتها إلى 20 ثانية. هذه لحظة فارقة في تاريخ إنشاء محتوى الوسائط بالذكاء الاصطناعي.
ما هو Flux 3 ولماذا هو مهم؟
Flux 3 هو الجيل الثالث من عائلة نماذج Flux من Black Forest Labs. بينما أنشأت الإصدارات السابقة صوراً ثابتة وفيديوهات صامتة، فإن Flux 3 يضيف البعد الصوتي — مما ينتج محتوى وسائطياً متكاملاً. استخدمت الإصدارات السابقة على نطاق واسع لإنشاء الصور والفيديوهات دون صوت، لكن Flux 3 يغير قواعد اللعبة بإنشاء الفيديو والصوت معاً في خطوة واحدة.
الابتكار التقني: هندسة Self-Flow
يستخدم Flux 3 هندسة معمارية جديدة تسمى Self-Flow، وهي بنية تضمن تزامن الصوت مع الفيديو. يتنبأ النموذج بكل من الإطارات المرئية والموجات الصوتية في آن واحد، مما ينتج عنه فيديوهات بجودة 1080 بكسل مع صوت طبيعي. هذا نهج يختلف عن النماذج الأخرى التي تنشئ الصوت كمرحلة منفصلة بعد الفيديو.
الإتاحة والوصول المفتوح
تخطط Black Forest Labs لإتاحة Flux 3 عبر واجهة برمجة التطبيقات السحابية أولاً، يليه نشر محلي. ومن المثير للاهتمام أنهم سيطلقون إصداراً مفتوح الوزن يسمى Flux 3 Dev، مما يتيح لمطوري الطرف الثالث تطوير تطبيقات خاصة بهم. هذا القرار يجعلها منافساً جاداً في ساحة نماذج الوسائط المفتوحة.
التأثير على الصناعة
يمثل Flux 3 قفزة كبيرة في إنشاء محتوى الذكاء الاصطناعي. قدرة إنشاء فيديو وصوت متكاملين بجهد واحد تفتح إمكانيات للتسويق وإنشاء المحتوى وحتى الروبوتات. بالمقارنة، لا تزال نماذج مثل Sora من OpenAI وMovie Gen من Meta وVeo من Google في مراحل سابقة.