إصلاح صوت الذكاء الاصطناعي — إصلاح الموسيقى التي تم إنشاؤها بواسطة الذكاء الاصطناعي
تستحق مقاطعك الصوتية من Suno وUdio ما هو أفضل. تعمل «Brizm Clinic» على إزالة التشويشات المعدنية، واستعادة الديناميكيات، وإعادة بناء الترددات المفقودة.
🏥 عيادة بريزمقم بإسقاط ملف الصوت الذي تم إنشاؤه بواسطة الذكاء الاصطناعي هنا أو انقر للتصفح
MP3، WAV، FLAC، OGG، M4A · حتى 15 دقيقة
تحليل الصوت...
يستعيد الترددات العالية التي يتم تخفيضها بواسطة مولدات الذكاء الاصطناعي
يستعيد الإيقاع السريع العابر الذي غالبًا ما تفتقر إليه آلات الإيقاع التي تعمل بالذكاء الاصطناعي
يزيل الضوضاء الخلفية التي تضيفها بعض أدوات الإنشاء القائمة على الذكاء الاصطناعي
AI Deep Repair — استعادة مدعومة بتقنية التعلم الآلي للموسيقى المُنتجة بواسطة الذكاء الاصطناعي
يعالج التشويش المعدني، والتشويه الشديد، والصوت المكتوم، والعيوب الاستريو، والثغرات الطيفية. ويتجاوز بكثير ما يمكن أن تحققه كل من «Brighten» و«Punch» و«Clean» بمفردها.
جاري المعالجة عبر Cloud Assist...
كيفية إصلاح صوت AI
- 1 قم بتحميل أي ملف صوتي تم إنشاؤه بواسطة الذكاء الاصطناعي — بتنسيقات MP3 أو WAV أو FLAC أو OGG أو M4A. يدعم Suno وUdio وStable Audio وMusicGen وغيرها.
- 2 قم بتشغيل خيارات «Brighten» و«Punch» و«Clean» لإصلاح عيوب معينة. قم بالمعاينة من خلال مقارنة A/B في الوقت الفعلي مع النسخة الأصلية.
- 3 تصدير الملف بتنسيق WAV أو MP3. يتم إجراء الإصلاح الفوري على جهازك. لإزالة التشوهات بشكل أعمق، استخدم ميزة «الإصلاح العميق بالذكاء الاصطناعي» عبر «Cloud Assist».
الأسئلة المتداولة
ما هي برامج إنشاء الموسيقى القائمة على الذكاء الاصطناعي التي يدعمها هذا البرنامج؟
لماذا تبدو مقاطع «Suno» و«Udio» مكتومة أو ذات صوت معدني؟
ما هي أنواع القطع الأثرية التي يتم ترميمها؟
ما الفرق بين «Brighten» و«Punch» و«Clean» و«AI Deep Repair»؟
ما الفرق بين هذا و«مُحسِّن الصوت»؟
هل يتم تحميل ملف الصوت الخاص بي على خادم؟
لماذا تحتوي الموسيقى التي يُنتجها الذكاء الاصطناعي على هذه العيوب؟
تشفير الفضاء الكامن يترك آثارًا
لا تنتج مولدات الموسيقى الحديثة القائمة على الذكاء الاصطناعي — مثل Suno وUdio وStable Audio وMusicGen — عينات صوتية بشكل مباشر. بل تنتج تسلسلاً مضغوطاً من الرموز أو المتجهات الكامنة التي يقوم «مفكك الترميز العصبي» بتحويلها مرة أخرى إلى شكل موجي. ويُعد «مفكك الترميز» مصدر معظم التشويشات التي تسمعها. ولضمان قابلية المعالجة على نطاق التدريب، تُبنى أجهزة فك التشفير عادةً على أساس برامج ترميز الصوت العصبية مثل EnCodec أو Descript Audio Codec؛ وهذه البرامج الترميزية نفسها تتسم بفقدان البيانات، وهي مصممة لضغط إشارة ستيريو بتردد 44.1 كيلوهرتز إلى بضعة كيلوبتات في الثانية. يتخلص برنامج الترميز من التفاصيل عالية التردد التي تزيد عن 14 كيلوهرتز تقريبًا، ويشوه معلومات الطور في النطاق المتوسط العلوي، ويُفقد الإشارات الاستريو الدقيقة التي لا تنجو من عملية الضغط.
ولهذا السبب تظهر نفس السمات في منتجات مختلف الموردين. النطاق العالي الباهت والمشوش قليلاً («لمعان الذكاء الاصطناعي»). والرنين المعدني في الأصوات الغنائية الممتدة. والنغمة الهشة والمتقطعة في صوت الصنج والهاي هات التي يولدها الذكاء الاصطناعي. والصورة الاستريو الضيقة حتى في المخرجات التي يُفترض أنها استريو. هذه ليست أخطاء في Suno أو Udio — بل هي خصائص خاصة بطبقة الترميز التي تعتمد عليها حاليًا جميع المولدات التجارية تقريبًا.
لماذا تفشل مكونات الماسترينغ التقليدية في هذه الحالة
تفترض سلاسل الماسترينغ القياسية أن الإدخال عبارة عن تسجيل صوتي بشري نقي يحتاج إلى صقل — مرشح «هاي شيلف» لإضفاء الحيوية، وضاغط «باص» لتوحيد الصوت، ومحدد مستوى الصوت. وعند تطبيقها على الصوت الذي تم إنشاؤه بواسطة الذكاء الاصطناعي، فإنها تعمل على تضخيم التشويشات بدلاً من إخفائها. فمرشح الترددات العالية فوق 12 كيلوهرتز يزيد من رنين الترميز بدلاً من استعادة الترددات العالية الحقيقية. كما أن ضاغط النطاق العريض يسحق الموجات العابرة المنهارة بالفعل بشكل أكبر. أما موسعات الصوت الاستريو على صورة صوتية أحادية منهارة، فهي تضيف فقط لون مرشح المشط. يقوم «Fix AI Audio» بعكس هذا المنطق: فهو يحدد نطاقات التردد المحددة والسمات المميزة في المجال الزمني للعيوب الناتجة عن وحدة فك الترميز ويعالجها، بدلاً من معالجة كل شيء بشكل موحد. إذا كنت لا تزال ترغب في إجراء الماسترينغ للملف الذي تم تنظيفه بعد ذلك، فقم بإرساله عبر Auto Master بعد ذلك.
كيف تعالج «بريزم» كل فئة من فئات الأخطاء المتعلقة بالذكاء الاصطناعي
Brighten — إعادة توليد التوافقيات فوق 14 كيلوهرتز
يقوم جهاز فك التشفير بقطع المحتوى فوق تردد 14 كيلوهرتز تقريبًا بشكل حاد. ولا يمكن لمرشح «هاي شيلف» عادي استعادة هذا المحتوى لأن الطاقة قد فُقدت. تقوم وظيفة «Brighten» بتوليد محتوى جديد عالي التردد من البنية التوافقية للترددات المتوسطة الموجودة — من خلال التشبع والتصفية ودمج محتوى مُصنَّع يتطابق مع نغمة الصوت في المصدر. والنتيجة هي إحساس بالانسيابية والحضور لم يكن موجودًا في ملف الإدخال. حرك شريط التمرير برفق؛ فالتشغيل المفرط لمُجدِّد الصوت يؤدي إلى ظهور هشاشة خاصة به.
Punch — الاستعادة المؤقتة في إيقاعات الذكاء الاصطناعي
تبدو مجموعات الطبول التي تُنتجها الذكاء الاصطناعي (AI) وكأنها تُقرع بضربات ضعيفة، وذلك لأن برنامج الترميز يُشوه الموجة العابرة الأولية. «Punch» هو أداة لتصميم الموجات العابرة تكتشف غلاف الهجوم في المحتوى الإيقاعي وتعيد بناء الحافة الأمامية. تستعيد أصوات الكيك ثقلها، وتستعيد أصوات السناير صوتها الحاد، وتتوقف أصوات الهاي هات عن أن تبدو كضوضاء ثابتة. وقد تمت معايرته ليتناسب مع الملامح العابرة المحددة للإيقاعات التي تم إنشاؤها بواسطة الذكاء الاصطناعي، والتي تختلف عن ملامح الإيقاعات المأخوذة من عينات، حيث تتميز بانحسار أبطأ للموجات العابرة.
نظيف — بوابة طيفية مضبوطة على مستوى الضوضاء الأساسي للذكاء الاصطناعي
تأتي معظم مسارات الذكاء الاصطناعي مصحوبة بخلفية خافتة من الضوضاء عريضة النطاق — والتي تنشأ جزئيًا عن تكمية برنامج الترميز، وجزئيًا عن عملية التوليد. ولا تستطيع بوابة الضوضاء القياسية التخلص منها لأن الضوضاء غير ثابتة. يستخدم Clean بوابة طيفية مُدرَّبة تتكيف مع مستوى الضوضاء الأساسي الخاص بالذكاء الاصطناعي وتقوم بكبته دون التأثير على المحتوى الموسيقي. استخدمه عندما يبدو الصمت بين العبارات الموسيقية مصحوبًا بضجيج خفيف.
"AI Deep Repair" — الأضرار الشديدة عبر "Cloud Assist"
عندما يكون تلف برنامج الترميز شديدًا — مثل التشويش الشديد، والانهيار الحاد للصوت الاستريو، والثغرات المسموعة في الطيف الصوتي — فإن قدرات الوحدات المدمجة في الجهاز تكون محدودة. تقوم ميزة «AI Deep Repair» بإرسال الملف إلى «Cloud Assist» وتشغيل نموذج عصبي أكبر بكثير تم تدريبه على أزواج من المقاطع الموسيقية النقية وتلك التي تدهورت جودتها بفعل الذكاء الاصطناعي. وهي تعالج المشكلات التي تتطلب سياقًا كاملاً للمقطع: إعادة بناء عرض الصوت الاستريو من الإشارات المخفية، واستعادة القمم المقطوعة عن طريق استقراء شكل الموجة، وسد الفجوات الطيفية بمحتوى معقول إحصائيًا. تتم معالجة الملفات وحذفها على الفور. لإصلاح الصوت بشكل أوسع يتجاوز المشكلات الخاصة بالذكاء الاصطناعي، تصفح مجموعة أدوات إصلاح الصوت.