این اپلیکیشن آهنگ را فقط در ۴۰ ثانیه به اجزای سازنده آن تقسیم میکند
اپلیکیشن AudioPrism با پردازش محلی روی GPU میتواند سازها و صدای خواننده را در کمتر از یک دقیقه از آهنگ جدا کند، اما محدودیتهایی هم دارد. به گزارش سرویس نرمافزار تکناک اگرچه در نگاه اول جدا کردن یک آهنگ کامل به اجزای سازنده آن چندان ضروری به نظر نمیرسد، ا…
خلاصه تحلیلی خبر
اپلیکیشن AudioPrism با پردازش محلی روی GPU میتواند سازها و صدای خواننده را در کمتر از یک دقیقه از آهنگ جدا کند، اما محدودیتهایی هم دارد. به گزارش سرویس نرمافزار تکناک اگرچه در نگاه اول جدا کردن یک آهنگ کامل به اجزای سازنده آن چندان ضروری به نظر نمیرسد، ا…
موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، AudioPrism، جداسازی، فناوری، کاربر
اپلیکیشن AudioPrism با پردازش محلی روی GPU میتواند سازها و صدای خواننده را در کمتر از یک دقیقه از آهنگ جدا کند، اما محدودیتهایی هم دارد.
به گزارشسرویس نرمافزارتکناکاگرچه در نگاه اول جدا کردن یک آهنگ کامل به اجزای سازنده آن چندان ضروری به نظر نمیرسد، اما این قابلیت برای نوازندگانی که قصد یادگیری بخشهای مشخص یک قطعه را دارند، اهمیت زیادی دارد. برای نمونه، یک نوازنده گیتار بیس میتواند با جدا کردن خط بیس جان مکوی در آهنگ Dreams از فلیتوود مک، این بخش را بهتنهایی تمرین کند و پس از یادگیری، با حذف بیس و پخش سایر سازها، همراه گروه بنوازد. تا همین چند سال پیش، چنین کاری بهسادگی امکانپذیر نبود. در بخش عمدهای از تاریخ موسیقی ضبطشده، میکس نهایی واقعا آخرین مرحله محسوب میشد. وقتی بیس، درام، گیتار و وکال در یک فایل استریو با یکدیگر ترکیب میشدند، بازیابی هرکدام از این اجزا تقریبا به دشواری استخراج فایل RAW از یک تصویر JPEG بود.
بیشتر بخوانیدتغییر طراحی لوگوی Apple Music در نسخههای بتا فاش شد
با پیشرفت فناوری، این محدودیت تا حد زیادی از بین رفته است. AudioPrism یک نرمافزار ویندوزی با قیمت پایه ۷۹.۹۹ دلار است که در حال حاضر با قیمت ۵۹.۹۹ دلار عرضه میشود. این برنامه میتواند فایلهای موسیقی نهایی را روی کامپیوتر کاربر پردازش کند و وکال، بیس، درام و سایر سازها را به ترکهای جداگانه تبدیل نماید. همچنین AudioPrism امکان تبدیل این بخشها به MIDI را فراهم میکند و ابزار آموزشی KeyPrism نیز به کاربران اجازه میدهد قطعات استخراجشده را تمرین کنند. در نتیجه، روی کاغذ اپلیکیشن AudioPrism تقریبا تمام قابلیتهایی را دارد که یک نوازنده برای تمرین بخشهای مختلف یک آهنگ به آن نیاز دارد. با وجود این، بررسی عملی نرمافزار نکته جالبی را نشان میدهد. AudioPrism در انجام کاری که زمانی غیرممکن به نظر میرسید، عملکرد بسیار خوبی دارد، اما در برخی قابلیتهای سادهتر با ضعفهای غیرمنتظرهای مواجه میشود.
۴۰ ثانیه از یک آهنگ تا ترکهای جداگانه
تلاش برای جداسازی اجزای موسیقی موضوع تازهای نیست. در سال ۲۰۱۳، نیو اطلس نرمافزار Riffstation را معرفی کرده بود؛ ابزاری که برای گیتاریستها طراحی شده بود و امکان جداسازی بخشهای مختلف یک آهنگ نهایی و پخش یا بیصدا کردن ساز مورد نظر را فراهم میکرد. فناوری جداسازی صدا در آن زمان بسیار ابتداییتر بود، اما کاربرد اصلی آن از همان ابتدا مشخص بود.
توسعه فناوری جداسازی منابع صوتی، دههها ادامه داشته و ظهور یادگیری ماشین تواناییهای این حوزه را به شکل چشمگیری افزایش داده است.Spleeterاز دیزر و Demucs از متا نقش مهمی در عمومیتر شدن فناوری جداسازی استمهای موسیقی مبتنی بر شبکههای عصبی داشتند. در همین مسیر، تیم پیتر جکسون نیز با فناوری MAL نمونه چشمگیری از قابلیتهای این فناوری ارائه کرد. MAL ابتدا برای ساخت مستند The Beatles: Get Back توسعه داده شد و بعدها برای جداسازی سازها از مسترهای چهارترکه در ریمیکس سال ۲۰۲۲ آلبوم Revolver مورد استفاده قرار گرفت. همچنین این فناوری امکان جداسازی صدای جان لنون از صدای پیانو در نسخه قدیمی آهنگ Now And Then را فراهم کرد.
حتما بخوانیدبهروزرسانی گوگل پلی پیدا کردن وسایل گمشده را آسانتر می کند
تبدیل فایل صوتی به MIDI نیز سابقهای طولانی دارد. برای مثال، Ableton بیش از یک دهه پیش در نسخه Live 9 امکان تبدیل ملودی، هارمونی و درام به MIDI را ارائه کرده بود. AudioPrism در واقع این دو مسیر را به یکدیگر متصل میکند. نرمافزار ابتدا آهنگ را به اجزای مستقل تقسیم میکند، سپس این اجزا را به نتهای قابل پردازش تبدیل مینماید و در نهایت امکان تمرین و یادگیری آنها را در اختیار کاربر قرار میدهد. یکی از جذابترین ویژگیهای AudioPrism نیز نحوه انجام پردازشهای سنگین آن است. محاسبات روی GPU کامپیوتر کاربر انجام میشوند و موسیقی نیازی به آپلود روی سرورهای ابری ندارد. در نتیجه، خبری از صف پردازش یا هزینههای وابسته به میزان استفاده از سرویس ابری نیست. این معماری علاوه بر مزیتهای مهم برای حریم خصوصی، باعث میشود فرایند جداسازی موسیقی با سرعت و تأخیر بسیار کمی انجام شود.
فناوری اپلیکیشن AudioPrism در جداسازی آهنگ
این نرمافزار در دو سناریوی کاملا متفاوت مورد آزمایش قرار گرفت. راهاندازی و استفاده از نرمافزار بسیار ساده است و کاربر تنها باید فایل صوتی مورد نظر را داخل برنامه بکشاند و رها کند. در آزمایش نخست، آهنگ Dreams از فلیتوود مک انتخاب شد؛ یک ضبط استودیویی بسیار تمیز که خط بیس جان مکوی در آن فضای صوتی مناسبی دارد. AudioPrism توانست این قطعه را روی کارت گرافیک RTX 5070 Ti در زمانی کمتر از مدت لازم برای بیان عبارت «تبدیل فوریه سریع» به چهار استم مستقل تقسیم کند. این سطح از جداسازی تا همین چند سال پیش میتوانست شبیه یک فناوری جادویی به نظر برسد. خط بیس با دقت بسیار خوبی استخراج شد. پس از انتقال هر چهار استم به Audacity و ترکیب دوباره آنها، مقایسه مستقیم با فایل اصلی نشان داد که تفاوت محسوسی میان نسخه بازسازیشده و ضبط اصلی وجود ندارد. نتیجه واقعا چشمگیر بود.
برای آزمایش سختتر جداسازی موسیقی در این اپلیکیشن، آهنگ Red Rain از آلبوم Secret World Live اثر پیتر گابریل انتخاب شد، که یک ضبط زنده پیچیده با حجم زیادی از صدای محیط، انعکاس و همپوشانی سازها است. در این شرایط، ترک بیس استخراجشده با آرتیفکتهای بیشتری همراه بود و کیفیتی تشدیدشده و تا حدی هیسدار داشت، اما همچنان کاملا قابل استفاده بود. کیفیت آن برای تمرین کافی به نظر میرسید و چند دقیقه پاکسازی میتوانست نتیجه را به سطح بسیار مطلوبی برساند. مشکل از جایی آغاز شد که مشخص شد AudioPrism پس از انجام بخش پیچیده کار، یک قابلیت ساده اما ضروری را ارائه نمیدهد و آن میکسر است. روند کاری یک نوازنده بسیار ساده است. هنگام یادگیری بخش مورد نظر، ساز باید بهتنهایی شنیده شود و پس از آن، همان ترک بیصدا شود تا نوازنده بتواند همراه سایر اعضای گروه بنوازد. همین منطق برای هر ساز دیگری نیز صادق است.
برای مطالعه بیشترابزار تشخیص دیپفیک به مایکروسافت Teams میآید
اما AudioPrism چنین امکانی را در اختیار کاربر نمیگذارد. در نتیجه، استمها باید به نرمافزار دیگری مانند Audacity منتقل شوند تا کاربر بتواند بیس را بهصورت دستی بیصدا کند. به این ترتیب، اپلیکیشن توانسته است عملیات پیچیده جداسازی یک ضبط نهایی را انجام دهد، اما برای سادهترین مرحله کاربردی آهنگ، کاربر را مجبور به ترک محیط برنامه میکند. این ضعف زمانی بیشتر به چشم میآید که گزینهای مانند StemKit وجود دارد؛ یک جداکننده استم مبتنی بر پردازش محلی و شتابدهی GPU که میکسر داخلی دارد. برای هر استم کنترل سطح صدا در نظر گرفته شده است و دکمههای بیصدا و پخش مستقل نیز مستقیما در برنامه قرار دارند. کاربر به Audacity نیازی ندارد و مهمتر از همه، StemKit رایگان و متنباز است.
نمونه دیگری نیز وجود دارد. نیو اطلس در ژانویه برنامه BandBox Trio جیبیال را بررسی کرده بود؛ نرمافزاری ۵۹۹ دلاری که از جداسازی استم مبتنی بر هوش مصنوعی برای کمک به نوازندگان استفاده میکند. کاربر میتواند سازهای مختلف را جدا یا بیصدا کند و همراه با بخشهای باقیمانده قطعه بنوازد. در این محصول، فناوری پیچیده در خدمت نیاز اصلی نوازنده قرار گرفته است، نه اینکه خود فناوری به هدف نهایی تبدیل شود. بخش تبدیل صدا به MIDI نیز نتوانست عملکرد مشابهی ارائه دهد. حتی زمانی که AudioPrism یک ترک بیس بسیار تمیز از Dreams را دریافت کرد، خروجیهای چندبخشی و غیرقابل پیشبینی تولید شد که برای رونویسی موسیقی چندان کاربردی نبود. قابلیت پخش نتها در KeyPrism نیز بارها با مکث و اختلال مواجه شد و ارزیابی دقیق زمانبندی و دقت آن را دشوار کرد.
رابط کاربری AudioPrism نیز وضعیت را بهتر نمیکند. ذرات نورانی، رد حرکت نشانگر ماوس، گرافیکهای ضرباندار و پسزمینهای شبیه حرکت در فضای فرازمینی، توجه کاربر را به خود جلب میکنند. گزینهای برای غیرفعال کردن این جلوهها وجود ندارد و حتی انیمیشن پسزمینه نیز به شکل یک حلقه نرم و یکپارچه اجرا نمیشود.
دیگر جداسازی استم بخش غیرممکن ماجرا نیست
اپلیکیشن AudioPrism در بازاری رقابتی قرار دارد که StemKit یکی از گزینههای قابل توجه است و Ultimate Vocal Remover نیز به عنوان یک ابزار رایگان و متنباز از فناوریهایی مانند Demucs و MDX-Net پشتیبانی میکند. Moises رویکردی نزدیکتر به نیاز واقعی نوازندگان دارد. ترکهای جداشده در یک میکسر قرار میگیرند و کاربر میتواند آنها را بیصدا، به صورت مستقل پخش یا تنظیم کند و در کنار آنها از ابزارهای تمرینی مختلف استفاده کند. البته Moises به پردازش ابری وابسته است و امکانات کاملتر آن در اختیار کاربران اشتراکی قرار میگیرد، بنابراین پردازش محلی ارائه نمیدهد. حتی مزیت پردازش محلی نیز دیگر در انحصار AudioPrism نیست. مدل Lyra از LALAL.AI میتواند جداسازی استم را روی دستگاه کاربر و از طریق برنامه دسکتاپ و افزونه VST انجام دهد. با وجود این، استفاده از پردازش محلی در این سرویس به اشتراک Pro با قیمت ماهانه ۱۹.۹۹ دلار نیاز دارد، در حالی که AudioPrism با پرداخت یکباره قابل تهیه است.
شاید اینجا بتوان به اصل ماجرا رسید. فناوری اکنون به نقطهای رسیده است که استخراج یک خط بیس قابل قبول از یک ضبط استریوی ۵۰ ساله، تنها در ۴۰ ثانیه و روی یک کامپیوتر خانگی، دیگر چالش اصلی محسوب نمیشود. چالش واقعی، ساخت تجربهای کاربردی پیرامون این قابلیت است. همین مسئله AudioPrism را تا حدی ناامیدکننده میکند. موتور جداسازی آهنگ این اپلیکیشن میتواند عملکرد خیرهکنندهای داشته باشد و پردازش کامل روی GPU کاربر نیز دقیقا همان ویژگی است که بسیاری از کاربران حرفهای به آن نیاز دارند. با وجود این، طراحی محصول بارها نشان میدهد که تمرکز اصلی روی نمایش تواناییهای فناوری بوده و روی نیازهای واقعی نوازنده نبوده است. یک نسخه ایدئال از AudioPrism میتوانست مزایای پرداخت یکباره، جداسازی محلی و دقیق، میکسر ساده با دکمههای پخش مستقل و بیصدا، رونویسی قابل اعتماد و رابط کاربری خلوت را در کنار هم قرار دهد. در چنین شرایطی، این نرمافزار میتوانست به یکی از بهترین ابزارهای تمرین موسیقی تبدیل شود. AudioPrism حالا بخش غیرممکن را حل کرده است. چیزی که هنوز کمبود آن احساس میشود، همان قابلیتهای سادهای است که باید استفاده روزمره از این فناوری را برای نوازندگان واقعا کاربردی کند.
نوشتهاین اپلیکیشن آهنگ را فقط در ۴۰ ثانیه به اجزای سازنده آن تقسیم میکنداولین بار درTechnoc. پدیدار شد.
برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.