AudioPrism با کمک هوش مصنوعی می‌تواند یک آهنگ کامل را در کمتر از ۴۰ ثانیه به ترک‌های جداگانه سازها و وکال تبدیل کند.

نرم‌افزار AudioPrism با استفاده از هوش مصنوعی می‌تواند یک فایل موسیقی کامل را تنها در چند ده ثانیه به بخش‌های جداگانه‌ای مانند وکال، بیس، درام و سایر سازها تقسیم کند. این فناوری می‌تواند برای نوازندگان، تنظیم‌کنندگان و افرادی که به دنبال تمرین با بخش خاصی از یک آهنگ هستند، کاربرد زیادی داشته باشد.

AudioPrism در حال حاضر برای ویندوز عرضه شده و قیمت اصلی آن ۷۹٫۹۹ دلار است، هرچند در زمان انتشار با قیمت ۵۹٫۹۹ دلار فروخته می‌شود. این نرم‌افزار علاوه بر جداسازی بخش‌های مختلف موسیقی، امکان تبدیل ترک‌های استخراج‌شده به فایل MIDI را نیز فراهم می‌کند و با ابزار آموزشی KeyPrism ارتباط دارد.

جداسازی سازها با کمک هوش مصنوعی

تشخیص و جداسازی وکال و سازهای مختلف از یک فایل صوتی فناوری جدیدی نیست، اما پیشرفت مدل‌های هوش مصنوعی و یادگیری ماشین باعث شده این فرایند بسیار سریع‌تر و دقیق‌تر از گذشته انجام شود.

پیش از AudioPrism نیز پروژه‌هایی مانند Spleeter از شرکت Deezer و Demucs از Meta امکان استخراج بخش‌های مختلف یک آهنگ را فراهم کرده بودند. تفاوت اصلی در این میان، سرعت پردازش و کیفیت خروجی ابزارهای جدید است.

AudioPrism برای آزمایش عملکرد خود روی دو قطعه متفاوت بررسی شده است. نخستین آزمایش روی آهنگ Dreams از گروه Fleetwood Mac انجام شد؛ قطعه‌ای استودیویی با کیفیت بالا که خط بیس آن نسبتاً واضح است.

این نرم‌افزار با استفاده از یک کارت گرافیک RTX ۵۰۷۰ Ti توانست آهنگ را در کمتر از ۴۰ ثانیه به چهار بخش جداگانه تقسیم کند. کیفیت ترک بیس نیز رضایت‌بخش بود و زمانی که بخش‌های استخراج‌شده دوباره در Audacity روی یکدیگر قرار گرفتند، تفاوت محسوسی با فایل اصلی شنیده نشد.

AudioPrism

عملکرد ضعیف‌تر در اجرای زنده

آزمایش دوم شرایط دشوارتری داشت. این بار اجرای زنده Red Rain از Peter Gabriel در آلبوم Secret World Live مورد استفاده قرار گرفت؛ قطعه‌ای که به دلیل ترکیب چندین ساز، انعکاس صدا و فضای آکوستیکی اجرای زنده، چالش بیشتری برای الگوریتم جداسازی ایجاد می‌کند.

AudioPrism همچنان توانست بخش بیس را استخراج کند، اما کیفیت خروجی به اندازه آزمایش نخست نبود. صدای جداشده مقداری نویز و اعوجاج داشت و در برخی قسمت‌ها حالتی تیز و غیرطبیعی پیدا می‌کرد.

با وجود این محدودیت، نتیجه برای بسیاری از کاربردهای معمول همچنان قابل استفاده است و نشان می‌دهد پردازش محلی موسیقی با مدل‌های هوش مصنوعی می‌تواند در مدت کوتاهی نتیجه‌ای نسبتاً دقیق ارائه دهد.

چرا AudioPrism هنوز کامل نیست؟

یکی از نقاط ضعف عجیب AudioPrism این است که با وجود امکان تولید ترک‌های جداگانه، نرم‌افزار میکسر داخلی ندارد. بنابراین کاربر نمی‌تواند مستقیماً داخل برنامه صدای بیس را کاهش دهد، یک ساز را قطع کند یا فقط یک بخش مشخص را گوش دهد.

برای انجام چنین کارهایی باید فایل‌های استخراج‌شده را به نرم‌افزار دیگری مانند Audacity منتقل کرد. این موضوع باعث می‌شود بخشی از مزیت سرعت و یکپارچگی فرایند از بین برود.

در مقابل، ابزار رایگان و متن‌بازی مانند StemKit امکان جداسازی ترک‌ها و مدیریت آن‌ها را در یک محیط واحد فراهم می‌کند و کاربر می‌تواند صدای هر بخش را به‌صورت مستقل تنظیم یا پخش کند.

تبدیل صدای موسیقی به MIDI هنوز مشکل دارد

AudioPrism امکان تبدیل ترک‌های جداشده به MIDI را نیز ارائه می‌دهد؛ قابلیتی که در تئوری می‌تواند برای نوازندگان بسیار جذاب باشد، زیرا امکان استخراج نت‌های یک ساز از آهنگ و استفاده از آن‌ها در نرم‌افزارهای موسیقی را فراهم می‌کند.

بااین‌حال، این قابلیت در آزمایش‌ها عملکرد چندان دقیقی نداشت. تبدیل خط بیس نسبتاً تمیز آهنگ Dreams به MIDI نتوانست خروجی کاملاً منظم و قابل اتکایی تولید کند. هنگام پخش نت‌ها در KeyPrism نیز مشکلاتی مانند لگ و اختلال مشاهده شد.

رابط کاربری AudioPrism نیز برای همه کاربران ایده‌آل نیست. استفاده گسترده از پس‌زمینه متحرک، افکت‌های بصری، ردپای نشانگر ماوس و عناصر گرافیکی متحرک می‌تواند هنگام کار با نرم‌افزار حواس کاربر را پرت کند و ظاهراً امکان غیرفعال‌کردن برخی از این جلوه‌ها نیز وجود ندارد.

رقبای رایگان، انتخاب را دشوار می‌کنند

AudioPrism در بازاری فعالیت می‌کند که محصولات رایگان و قدرتمندی در آن حضور دارند. Ultimate Vocal Remover یکی از شناخته‌شده‌ترین گزینه‌ها است که به‌صورت رایگان و متن‌باز ارائه می‌شود و از مدل‌هایی مانند Demucs و MDX-Net برای جداسازی بخش‌های مختلف موسیقی استفاده می‌کند.

Moises نیز امکانات گسترده‌تری برای کار با ترک‌های استخراج‌شده دارد. این سرویس پس از جداسازی وکال و سازها، آن‌ها را در یک میکسر قرار می‌دهد تا کاربر بتواند هر بخش را به‌صورت مستقل تنظیم، قطع یا پخش کند. البته پردازش در Moises به سرویس ابری وابسته است.

از سوی دیگر، پردازش مستقیم روی کامپیوتر نیز دیگر ویژگی منحصربه‌فرد AudioPrism محسوب نمی‌شود. مدل Lyra از LALAL.AI می‌تواند جداسازی سازها را روی خود دستگاه انجام دهد و از طریق برنامه دسکتاپ و پلاگین VST در دسترس است؛ البته استفاده از قابلیت پردازش محلی آن به اشتراک Pro با هزینه ماهانه ۱۹٫۹۹ دلار نیاز دارد.

در مجموع، AudioPrism نشان می‌دهد هوش مصنوعی تا چه اندازه فرایند جداسازی سازها از یک آهنگ را سریع و ساده کرده است، اما نبود میکسر داخلی، محدودیت تبدیل به MIDI و حضور رقبای رایگان باعث می‌شود این نرم‌افزار هنوز انتخابی بدون رقیب برای علاقه‌مندان به تولید و تمرین موسیقی نباشد.