ادوبی بهطور رسمی ابزار تولید صدای فایرفلای را با قابلیتهای “تولید موسیقی”، “تولید صدا” و “تولید افکت صوتی” راهاندازی کرد. این ابزارها به کاربران امکان میدهند تا محتوای صوتی امن برای استفاده تجاری را مستقیماً در اپلیکیشن وب دسکتاپ و موبایل فایرفلای ایجاد کنند و قابلیتهای صوتی هوش مصنوعی را در گردش کار تولید ویدئو ادغام نمایند.
نیاز فزاینده به موسیقی و چالشهای تولید آن
بر اساس نظرسنجی اخیر ادوبی و کالج موسیقی برکلی، ۱۰۰ درصد از تولیدکنندگان ویدئو، موسیقیدانان و بازاریابان مورد بررسی، از موسیقی در ویدئوهای خود استفاده میکنند. ۳۲.۷ درصد از آنها در حال حاضر از موسیقی تولیدشده با هوش مصنوعی بهره میبرند. با این حال، موانع مهمی در این مسیر وجود دارد؛ ۴۳.۲ درصد به خطرات قانونی حق چاپ و نشر و ۳۸.۹ درصد به هزینههای مجوز اشاره کردند.
راهکارهای فایرفلای برای تولید محتوای صوتی
برای رفع این چالشها، قابلیت “تولید موسیقی” فایرفلای میتواند موسیقی اصلی و دارای مجوز کامل را بر اساس محتوای ویدئو، اتمسفر، ریتم و مدت زمان تولید کند. این ابزار چهار گزینه برای ویرایش و انتخاب در اختیار کاربران قرار میدهد. ادوبی اعلام کرده است که محتوای تولیدشده بدون نیاز به اشتراک اضافی، قابل استفاده در آثار تجاری است.
قابلیت “تولید صدا” اسکریپتها را به روایتهای طبیعی تبدیل میکند و از مدلهای صوتی فایرفلای و مدلهای ElevenLabs پشتیبانی میکند. همچنین امکان تنظیم افکتهای صوتی از طریق تگهایی مانند گویایی و تلفظ را فراهم میآورد. “تولید افکت صوتی” نیز از دستورات متنی یا صداهای ضبطشده بهعنوان مرجع پشتیبانی کرده و افکتهای صوتی متناسب با تصویر، ریتم و اتمسفر را تولید میکند.
اکوسیستم گسترده مدلهای هوش مصنوعی در فایرفلای
همزمان، ادوبی به گسترش اکوسیستم مدلهای شخص ثالث فایرفلای ادامه میدهد و Gemini Omni Flash را اضافه کرده است که میتواند ویدئو، صدا و تصاویر را برای خلق محتوا ترکیب کند. پیش از این، فایرفلای مدلهای Runway Aleph2.0 و Kling2.0 را ادغام کرده بود و اکنون مجموعه مدلهای آن شامل مدلهایی از گوگل، Kling AI، Luma AI، OpenAI، Runway و خود ادوبی میشود. ادوبی با ادغام مدلهای متعدد و قابلیتهای صوتی-تصویری چندوجهی، در حال تکمیل گردش کار خلق محتوای یکپارچه با هوش مصنوعی فایرفلای است.