AudioPrism با کمک هوش مصنوعی میتواند یک آهنگ کامل را در کمتر از ۴۰ ثانیه به ترکهای جداگانه سازها و وکال تبدیل کند.
نرمافزار AudioPrism با استفاده از هوش مصنوعی میتواند یک فایل موسیقی کامل را تنها در چند ده ثانیه به بخشهای جداگانهای مانند وکال، بیس، درام و سایر سازها تقسیم کند. این فناوری میتواند برای نوازندگان، تنظیمکنندگان و افرادی که به دنبال تمرین با بخش خاصی از یک آهنگ هستند، کاربرد زیادی داشته باشد.
AudioPrism در حال حاضر برای ویندوز عرضه شده و قیمت اصلی آن ۷۹٫۹۹ دلار است، هرچند در زمان انتشار با قیمت ۵۹٫۹۹ دلار فروخته میشود. این نرمافزار علاوه بر جداسازی بخشهای مختلف موسیقی، امکان تبدیل ترکهای استخراجشده به فایل MIDI را نیز فراهم میکند و با ابزار آموزشی KeyPrism ارتباط دارد.
جداسازی سازها با کمک هوش مصنوعی
تشخیص و جداسازی وکال و سازهای مختلف از یک فایل صوتی فناوری جدیدی نیست، اما پیشرفت مدلهای هوش مصنوعی و یادگیری ماشین باعث شده این فرایند بسیار سریعتر و دقیقتر از گذشته انجام شود.
پیش از AudioPrism نیز پروژههایی مانند Spleeter از شرکت Deezer و Demucs از Meta امکان استخراج بخشهای مختلف یک آهنگ را فراهم کرده بودند. تفاوت اصلی در این میان، سرعت پردازش و کیفیت خروجی ابزارهای جدید است.
AudioPrism برای آزمایش عملکرد خود روی دو قطعه متفاوت بررسی شده است. نخستین آزمایش روی آهنگ Dreams از گروه Fleetwood Mac انجام شد؛ قطعهای استودیویی با کیفیت بالا که خط بیس آن نسبتاً واضح است.
این نرمافزار با استفاده از یک کارت گرافیک RTX ۵۰۷۰ Ti توانست آهنگ را در کمتر از ۴۰ ثانیه به چهار بخش جداگانه تقسیم کند. کیفیت ترک بیس نیز رضایتبخش بود و زمانی که بخشهای استخراجشده دوباره در Audacity روی یکدیگر قرار گرفتند، تفاوت محسوسی با فایل اصلی شنیده نشد.
عملکرد ضعیفتر در اجرای زنده
آزمایش دوم شرایط دشوارتری داشت. این بار اجرای زنده Red Rain از Peter Gabriel در آلبوم Secret World Live مورد استفاده قرار گرفت؛ قطعهای که به دلیل ترکیب چندین ساز، انعکاس صدا و فضای آکوستیکی اجرای زنده، چالش بیشتری برای الگوریتم جداسازی ایجاد میکند.
AudioPrism همچنان توانست بخش بیس را استخراج کند، اما کیفیت خروجی به اندازه آزمایش نخست نبود. صدای جداشده مقداری نویز و اعوجاج داشت و در برخی قسمتها حالتی تیز و غیرطبیعی پیدا میکرد.
با وجود این محدودیت، نتیجه برای بسیاری از کاربردهای معمول همچنان قابل استفاده است و نشان میدهد پردازش محلی موسیقی با مدلهای هوش مصنوعی میتواند در مدت کوتاهی نتیجهای نسبتاً دقیق ارائه دهد.
چرا AudioPrism هنوز کامل نیست؟
یکی از نقاط ضعف عجیب AudioPrism این است که با وجود امکان تولید ترکهای جداگانه، نرمافزار میکسر داخلی ندارد. بنابراین کاربر نمیتواند مستقیماً داخل برنامه صدای بیس را کاهش دهد، یک ساز را قطع کند یا فقط یک بخش مشخص را گوش دهد.
برای انجام چنین کارهایی باید فایلهای استخراجشده را به نرمافزار دیگری مانند Audacity منتقل کرد. این موضوع باعث میشود بخشی از مزیت سرعت و یکپارچگی فرایند از بین برود.
در مقابل، ابزار رایگان و متنبازی مانند StemKit امکان جداسازی ترکها و مدیریت آنها را در یک محیط واحد فراهم میکند و کاربر میتواند صدای هر بخش را بهصورت مستقل تنظیم یا پخش کند.
تبدیل صدای موسیقی به MIDI هنوز مشکل دارد
AudioPrism امکان تبدیل ترکهای جداشده به MIDI را نیز ارائه میدهد؛ قابلیتی که در تئوری میتواند برای نوازندگان بسیار جذاب باشد، زیرا امکان استخراج نتهای یک ساز از آهنگ و استفاده از آنها در نرمافزارهای موسیقی را فراهم میکند.
بااینحال، این قابلیت در آزمایشها عملکرد چندان دقیقی نداشت. تبدیل خط بیس نسبتاً تمیز آهنگ Dreams به MIDI نتوانست خروجی کاملاً منظم و قابل اتکایی تولید کند. هنگام پخش نتها در KeyPrism نیز مشکلاتی مانند لگ و اختلال مشاهده شد.
رابط کاربری AudioPrism نیز برای همه کاربران ایدهآل نیست. استفاده گسترده از پسزمینه متحرک، افکتهای بصری، ردپای نشانگر ماوس و عناصر گرافیکی متحرک میتواند هنگام کار با نرمافزار حواس کاربر را پرت کند و ظاهراً امکان غیرفعالکردن برخی از این جلوهها نیز وجود ندارد.
رقبای رایگان، انتخاب را دشوار میکنند
AudioPrism در بازاری فعالیت میکند که محصولات رایگان و قدرتمندی در آن حضور دارند. Ultimate Vocal Remover یکی از شناختهشدهترین گزینهها است که بهصورت رایگان و متنباز ارائه میشود و از مدلهایی مانند Demucs و MDX-Net برای جداسازی بخشهای مختلف موسیقی استفاده میکند.
Moises نیز امکانات گستردهتری برای کار با ترکهای استخراجشده دارد. این سرویس پس از جداسازی وکال و سازها، آنها را در یک میکسر قرار میدهد تا کاربر بتواند هر بخش را بهصورت مستقل تنظیم، قطع یا پخش کند. البته پردازش در Moises به سرویس ابری وابسته است.
از سوی دیگر، پردازش مستقیم روی کامپیوتر نیز دیگر ویژگی منحصربهفرد AudioPrism محسوب نمیشود. مدل Lyra از LALAL.AI میتواند جداسازی سازها را روی خود دستگاه انجام دهد و از طریق برنامه دسکتاپ و پلاگین VST در دسترس است؛ البته استفاده از قابلیت پردازش محلی آن به اشتراک Pro با هزینه ماهانه ۱۹٫۹۹ دلار نیاز دارد.
در مجموع، AudioPrism نشان میدهد هوش مصنوعی تا چه اندازه فرایند جداسازی سازها از یک آهنگ را سریع و ساده کرده است، اما نبود میکسر داخلی، محدودیت تبدیل به MIDI و حضور رقبای رایگان باعث میشود این نرمافزار هنوز انتخابی بدون رقیب برای علاقهمندان به تولید و تمرین موسیقی نباشد.
