بحث · The Verge ·

The Atlantic تكشف أغاني مستخدمة في تدريب الذكاء الاصطناعي

أنشأت The Atlantic قاعدة بيانات تكشف ملايين مقاطع الموسيقى المستخدمة لتدريب الذكاء الاصطناعي دون ترخيص الفنانين.

استناداً إلى تقرير The Verge — تحليل وصياغة دليلي

أنشأت مجلة The Atlantic قاعدة بيانات قابلة للبحث تكشف عن ملايين مقاطع الموسيقى التي كانت متاحة بحرية في مجموعات البيانات المستخدمة لتدريب نماذج الذكاء الاصطناعي—رغم عدم الحصول على ترخيص لهذا الاستخدام. تسلط التحقيق الضوء على فجوة حرجة في كيفية توريد بيانات تدريب الذكاء الاصطناعي: بينما كانت العديد من مجموعات البيانات تقنياً عامة، لم يوافق الفنانون على استخدام أعمالهم في تدريب الذكاء الاصطناعي.

الحجم مذهل. مليارات المقاطع من Spotify و YouTube وغيرها انتهت بها الحال في مجموعات التدريب بدون تعويض للفنانين. تتيح قاعدة البيانات للمستخدمين البحث باسم الفنان لمعرفة ما إذا تم تضمين أعمالهم بدون إذن، كاشفة عن مشكلة نظامية في كيفية وصول شركات الذكاء الاصطناعي إلى بيانات التدريب.

بالنسبة لصناعة الموسيقى، تعزز النتائج الدعوات لأطر ترخيص أوضح حول تدريب الذكاء الاصطناعي. يمثل النشر تحولاً نحو الشفافية—يُظهر الفجوة بين كيفية تخيل الذكاء الاصطناعي (مدرب على بيانات أخلاقية مرخصة) وكيفية بنائه فعلياً (ببيانات كانت الأرخص والأكثر توفراً).

أبرز النقاط

  • ملايين المقاطع الموسيقية استُخدمت بدون ترخيص
  • الفنانون لم يحصلوا على تعويض
  • يكشف نقص الشفافية في صناعة الذكاء الاصطناعي

ما أهمية ذلك

الشفافية في بيانات تدريب الذكاء الاصطناعي حاسمة مع تصعيد النزاعات القانونية. قاعدة البيانات تكشف الفجوة بين موافقة الفنانين وممارسات شركات الذكاء الاصطناعي.