کامپیوتر و

این اپلیکیشن آهنگ را فقط در ۴۰ ثانیه به اجزای سازنده‌ آن تقسیم می‌کند

اپلیکیشن AudioPrism با پردازش محلی روی GPU می‌تواند سازها و صدای خواننده را در کمتر از یک دقیقه از آهنگ جدا کند، اما محدودیت‌هایی هم دارد. به‌ گزارش سرویس نرم‌افزار تک‌ناک اگرچه در نگاه اول جدا کردن یک آهنگ کامل به اجزای سازنده آن چندان ضروری به نظر نمی‌رسد، ا…

9 دقیقه مطالعه
  • پشتیبانی شبکه
  • هوش مصنوعی
  • AudioPrism
  • جداسازی
  • فناوری
  • کاربر
  • آهنگ
  • بیس
این اپلیکیشن آهنگ را فقط در ۴۰ ثانیه به اجزای سازنده‌ آن تقسیم می‌کند

خلاصه تحلیلی خبر

اپلیکیشن AudioPrism با پردازش محلی روی GPU می‌تواند سازها و صدای خواننده را در کمتر از یک دقیقه از آهنگ جدا کند، اما محدودیت‌هایی هم دارد. به‌ گزارش سرویس نرم‌افزار تک‌ناک اگرچه در نگاه اول جدا کردن یک آهنگ کامل به اجزای سازنده آن چندان ضروری به نظر نمی‌رسد، ا…

موضوعات اصلی: پشتیبانی شبکه، هوش مصنوعی، AudioPrism، جداسازی، فناوری، کاربر

اپلیکیشن AudioPrism با پردازش محلی روی GPU می‌تواند سازها و صدای خواننده را در کمتر از یک دقیقه از آهنگ جدا کند، اما محدودیت‌هایی هم دارد.

به‌ گزارشسرویس نرم‌افزارتک‌ناکاگرچه در نگاه اول جدا کردن یک آهنگ کامل به اجزای سازنده آن چندان ضروری به نظر نمی‌رسد، اما این قابلیت برای نوازندگانی که قصد یادگیری بخش‌های مشخص یک قطعه را دارند، اهمیت زیادی دارد. برای نمونه، یک نوازنده گیتار بیس می‌تواند با جدا کردن خط بیس جان مک‌وی در آهنگ Dreams از فلیت‌وود مک، این بخش را به‌تنهایی تمرین کند و پس از یادگیری، با حذف بیس و پخش سایر سازها، همراه گروه بنوازد. تا همین چند سال پیش، چنین کاری به‌سادگی امکان‌پذیر نبود. در بخش عمده‌ای از تاریخ موسیقی ضبط‌شده، میکس نهایی واقعا آخرین مرحله محسوب می‌شد. وقتی بیس، درام، گیتار و وکال در یک فایل استریو با یکدیگر ترکیب می‌شدند، بازیابی هرکدام از این اجزا تقریبا به دشواری استخراج فایل RAW از یک تصویر JPEG بود.

بیشتر بخوانیدتغییر طراحی لوگوی Apple Music در نسخه‌های بتا فاش شد

با پیشرفت فناوری، این محدودیت تا حد زیادی از بین رفته است. AudioPrism یک نرم‌افزار ویندوزی با قیمت پایه ۷۹.۹۹ دلار است که در حال حاضر با قیمت ۵۹.۹۹ دلار عرضه می‌شود. این برنامه می‌تواند فایل‌های موسیقی نهایی را روی کامپیوتر کاربر پردازش کند و وکال، بیس، درام و سایر سازها را به ترک‌های جداگانه تبدیل نماید. همچنین AudioPrism امکان تبدیل این بخش‌ها به MIDI را فراهم می‌کند و ابزار آموزشی KeyPrism نیز به کاربران اجازه می‌دهد قطعات استخراج‌شده را تمرین کنند. در نتیجه، روی کاغذ اپلیکیشن AudioPrism تقریبا تمام قابلیت‌هایی را دارد که یک نوازنده برای تمرین بخش‌های مختلف یک آهنگ به آن نیاز دارد. با وجود این، بررسی عملی نرم‌افزار نکته‌ جالبی را نشان می‌دهد. AudioPrism در انجام کاری که زمانی غیرممکن به نظر می‌رسید، عملکرد بسیار خوبی دارد، اما در برخی قابلیت‌های ساده‌تر با ضعف‌های غیرمنتظره‌ای مواجه می‌شود.

۴۰ ثانیه از یک آهنگ تا ترک‌های جداگانه

تلاش برای جداسازی اجزای موسیقی موضوع تازه‌ای نیست. در سال ۲۰۱۳، نیو اطلس نرم‌افزار Riffstation را معرفی کرده بود؛ ابزاری که برای گیتاریست‌ها طراحی شده بود و امکان جداسازی بخش‌های مختلف یک آهنگ نهایی و پخش یا بی‌صدا کردن ساز مورد نظر را فراهم می‌کرد. فناوری جداسازی صدا در آن زمان بسیار ابتدایی‌تر بود، اما کاربرد اصلی آن از همان ابتدا مشخص بود.

توسعه فناوری جداسازی منابع صوتی، دهه‌ها ادامه داشته و ظهور یادگیری ماشین توانایی‌های این حوزه را به شکل چشمگیری افزایش داده است.Spleeterاز دیزر و Demucs از متا نقش مهمی در عمومی‌تر شدن فناوری جداسازی استم‌های موسیقی مبتنی بر شبکه‌های عصبی داشتند. در همین مسیر، تیم پیتر جکسون نیز با فناوری MAL نمونه‌ چشمگیری از قابلیت‌های این فناوری ارائه کرد. MAL ابتدا برای ساخت مستند The Beatles: Get Back توسعه داده شد و بعدها برای جداسازی سازها از مسترهای چهارترکه در ریمیکس سال ۲۰۲۲ آلبوم Revolver مورد استفاده قرار گرفت. همچنین این فناوری امکان جداسازی صدای جان لنون از صدای پیانو در نسخه قدیمی آهنگ Now And Then را فراهم کرد.

اپلیکیشن AudioPrism بخش‌های مختلف آهنگ را در ۴۰ ثانیه تفکیک می‌کند

حتما بخوانیدبه‌روزرسانی گوگل پلی پیدا کردن وسایل گمشده را آسان‌تر می‌ کند

تبدیل فایل صوتی به MIDI نیز سابقه‌ای طولانی دارد. برای مثال، Ableton بیش از یک دهه پیش در نسخه Live 9 امکان تبدیل ملودی، هارمونی و درام به MIDI را ارائه کرده بود. AudioPrism در واقع این دو مسیر را به یکدیگر متصل می‌کند. نرم‌افزار ابتدا آهنگ را به اجزای مستقل تقسیم می‌کند، سپس این اجزا را به نت‌های قابل پردازش تبدیل می‌نماید و در نهایت امکان تمرین و یادگیری آنها را در اختیار کاربر قرار می‌دهد. یکی از جذاب‌ترین ویژگی‌های AudioPrism نیز نحوه انجام پردازش‌های سنگین آن است. محاسبات روی GPU کامپیوتر کاربر انجام می‌شوند و موسیقی نیازی به آپلود روی سرورهای ابری ندارد. در نتیجه، خبری از صف پردازش یا هزینه‌های وابسته به میزان استفاده از سرویس ابری نیست. این معماری علاوه بر مزیت‌های مهم برای حریم خصوصی، باعث می‌شود فرایند جداسازی موسیقی با سرعت و تأخیر بسیار کمی انجام شود.

فناوری اپلیکیشن AudioPrism در جداسازی آهنگ

این نرم‌افزار در دو سناریوی کاملا متفاوت مورد آزمایش قرار گرفت. راه‌اندازی و استفاده از نرم‌افزار بسیار ساده است و کاربر تنها باید فایل صوتی مورد نظر را داخل برنامه بکشاند و رها کند. در آزمایش نخست، آهنگ Dreams از فلیت‌وود مک انتخاب شد؛ یک ضبط استودیویی بسیار تمیز که خط بیس جان مک‌وی در آن فضای صوتی مناسبی دارد. AudioPrism توانست این قطعه را روی کارت گرافیک RTX 5070 Ti در زمانی کمتر از مدت لازم برای بیان عبارت «تبدیل فوریه سریع» به چهار استم مستقل تقسیم کند. این سطح از جداسازی تا همین چند سال پیش می‌توانست شبیه یک فناوری جادویی به نظر برسد. خط بیس با دقت بسیار خوبی استخراج شد. پس از انتقال هر چهار استم به Audacity و ترکیب دوباره آنها، مقایسه مستقیم با فایل اصلی نشان داد که تفاوت محسوسی میان نسخه بازسازی‌شده و ضبط اصلی وجود ندارد. نتیجه واقعا چشمگیر بود.

برای آزمایش سخت‌تر جداسازی موسیقی در این اپلیکیشن، آهنگ Red Rain از آلبوم Secret World Live اثر پیتر گابریل انتخاب شد، که یک ضبط زنده پیچیده با حجم زیادی از صدای محیط، انعکاس و هم‌پوشانی سازها است. در این شرایط، ترک بیس استخراج‌شده با آرتیفکت‌های بیشتری همراه بود و کیفیتی تشدیدشده و تا حدی هیس‌دار داشت، اما همچنان کاملا قابل استفاده بود. کیفیت آن برای تمرین کافی به نظر می‌رسید و چند دقیقه پاک‌سازی می‌توانست نتیجه را به سطح بسیار مطلوبی برساند. مشکل از جایی آغاز شد که مشخص شد AudioPrism پس از انجام بخش پیچیده کار، یک قابلیت ساده اما ضروری را ارائه نمی‌دهد و آن میکسر است. روند کاری یک نوازنده بسیار ساده است. هنگام یادگیری بخش مورد نظر، ساز باید به‌تنهایی شنیده شود و پس از آن، همان ترک بی‌صدا شود تا نوازنده بتواند همراه سایر اعضای گروه بنوازد. همین منطق برای هر ساز دیگری نیز صادق است.

اپلیکیشن AudioPrism بخش‌های مختلف آهنگ را تفکیک می‌کند

برای مطالعه بیشترابزار تشخیص دیپ‌فیک به مایکروسافت Teams می‌آید

اما AudioPrism چنین امکانی را در اختیار کاربر نمی‌گذارد. در نتیجه، استم‌ها باید به نرم‌افزار دیگری مانند Audacity منتقل شوند تا کاربر بتواند بیس را به‌صورت دستی بی‌صدا کند. به این ترتیب، اپلیکیشن توانسته است عملیات پیچیده جداسازی یک ضبط نهایی را انجام دهد، اما برای ساده‌ترین مرحله کاربردی آهنگ، کاربر را مجبور به ترک محیط برنامه می‌کند. این ضعف زمانی بیشتر به چشم می‌آید که گزینه‌ای مانند StemKit وجود دارد؛ یک جداکننده استم مبتنی بر پردازش محلی و شتاب‌دهی GPU که میکسر داخلی دارد. برای هر استم کنترل سطح صدا در نظر گرفته شده است و دکمه‌های بی‌صدا و پخش مستقل نیز مستقیما در برنامه قرار دارند. کاربر به Audacity نیازی ندارد و مهم‌تر از همه، StemKit رایگان و متن‌باز است.

نمونه دیگری نیز وجود دارد. نیو اطلس در ژانویه برنامه BandBox Trio جی‌بی‌ال را بررسی کرده بود؛ نرم‌افزاری ۵۹۹ دلاری که از جداسازی استم مبتنی بر هوش مصنوعی برای کمک به نوازندگان استفاده می‌کند. کاربر می‌تواند سازهای مختلف را جدا یا بی‌صدا کند و همراه با بخش‌های باقی‌مانده قطعه بنوازد. در این محصول، فناوری پیچیده در خدمت نیاز اصلی نوازنده قرار گرفته است، نه اینکه خود فناوری به هدف نهایی تبدیل شود. بخش تبدیل صدا به MIDI نیز نتوانست عملکرد مشابهی ارائه دهد. حتی زمانی که AudioPrism یک ترک بیس بسیار تمیز از Dreams را دریافت کرد، خروجی‌های چندبخشی و غیرقابل پیش‌بینی تولید شد که برای رونویسی موسیقی چندان کاربردی نبود. قابلیت پخش نت‌ها در KeyPrism نیز بارها با مکث و اختلال مواجه شد و ارزیابی دقیق زمان‌بندی و دقت آن را دشوار کرد.

رابط کاربری AudioPrism نیز وضعیت را بهتر نمی‌کند. ذرات نورانی، رد حرکت نشانگر ماوس، گرافیک‌های ضربان‌دار و پس‌زمینه‌ای شبیه حرکت در فضای فرازمینی، توجه کاربر را به خود جلب می‌کنند. گزینه‌ای برای غیرفعال کردن این جلوه‌ها وجود ندارد و حتی انیمیشن پس‌زمینه نیز به شکل یک حلقه نرم و یکپارچه اجرا نمی‌شود.

دیگر جداسازی استم بخش غیرممکن ماجرا نیست

اپلیکیشن AudioPrism در بازاری رقابتی قرار دارد که StemKit یکی از گزینه‌های قابل توجه است و Ultimate Vocal Remover نیز به‌ عنوان یک ابزار رایگان و متن‌باز از فناوری‌هایی مانند Demucs و MDX-Net پشتیبانی می‌کند. Moises رویکردی نزدیک‌تر به نیاز واقعی نوازندگان دارد. ترک‌های جداشده در یک میکسر قرار می‌گیرند و کاربر می‌تواند آنها را بی‌صدا، به‌ صورت مستقل پخش یا تنظیم کند و در کنار آنها از ابزارهای تمرینی مختلف استفاده کند. البته Moises به پردازش ابری وابسته است و امکانات کامل‌تر آن در اختیار کاربران اشتراکی قرار می‌گیرد، بنابراین پردازش محلی ارائه نمی‌دهد. حتی مزیت پردازش محلی نیز دیگر در انحصار AudioPrism نیست. مدل Lyra از LALAL.AI می‌تواند جداسازی استم را روی دستگاه کاربر و از طریق برنامه دسکتاپ و افزونه VST انجام دهد. با وجود این، استفاده از پردازش محلی در این سرویس به اشتراک Pro با قیمت ماهانه ۱۹.۹۹ دلار نیاز دارد، در حالی که AudioPrism با پرداخت یک‌باره قابل تهیه است.

شاید اینجا بتوان به اصل ماجرا رسید. فناوری اکنون به نقطه‌ای رسیده است که استخراج یک خط بیس قابل قبول از یک ضبط استریوی ۵۰ ساله، تنها در ۴۰ ثانیه و روی یک کامپیوتر خانگی، دیگر چالش اصلی محسوب نمی‌شود. چالش واقعی، ساخت تجربه‌ای کاربردی پیرامون این قابلیت است. همین مسئله AudioPrism را تا حدی ناامیدکننده می‌کند. موتور جداسازی آهنگ این اپلیکیشن می‌تواند عملکرد خیره‌کننده‌ای داشته باشد و پردازش کامل روی GPU کاربر نیز دقیقا همان ویژگی‌ است که بسیاری از کاربران حرفه‌ای به آن نیاز دارند. با وجود این، طراحی محصول بارها نشان می‌دهد که تمرکز اصلی روی نمایش توانایی‌های فناوری بوده و روی نیازهای واقعی نوازنده نبوده است. یک نسخه ایدئال از AudioPrism می‌توانست مزایای پرداخت یک‌باره، جداسازی محلی و دقیق، میکسر ساده با دکمه‌های پخش مستقل و بی‌صدا، رونویسی قابل اعتماد و رابط کاربری خلوت را در کنار هم قرار دهد. در چنین شرایطی، این نرم‌افزار می‌توانست به یکی از بهترین ابزارهای تمرین موسیقی تبدیل شود. AudioPrism حالا بخش غیرممکن را حل کرده است. چیزی که هنوز کمبود آن احساس می‌شود، همان قابلیت‌های ساده‌ای است که باید استفاده روزمره از این فناوری را برای نوازندگان واقعا کاربردی کند.

نوشتهاین اپلیکیشن آهنگ را فقط در ۴۰ ثانیه به اجزای سازنده‌ آن تقسیم می‌کنداولین بار درTechnoc. پدیدار شد.

برای ارزیابی پایداری، امنیت و نگهداری این زیرساخت، راهنمای پشتیبانی شبکه را نیز مطالعه کنید.