
Alex Reisner ผู้สื่อข่าวจาก The Atlantic ได้เปิดเผยถึงการสร้างฐานข้อมูลเพลงที่ใช้ในการฝึกโมเดล AI โดยมีการจัดทำให้สามารถค้นหาได้อย่างสะดวกสบายสำหรับสาธารณะ โดยฐานข้อมูลนี้ประกอบด้วยชุดข้อมูลเพลงจำนวนสี่ชุด ซึ่งมีขนาดใหญ่ถึง 12 ล้านและ 9 ล้านแทร็กในสองชุดข้อมูลหลัก ในขณะที่อีกสองชุดมีขนาดเล็กกว่าแต่ยังคงมีความสำคัญด้วยจำนวนเพลงมากกว่า 100,000 เพลงในแต่ละชุด
การเปิดเผยข้อมูลนี้ทำให้ผู้ที่สนใจสามารถเข้าถึงชุดข้อมูลเพลงที่มีอยู่ได้ง่ายขึ้น ซึ่งมีการดาวน์โหลดจากผู้ใช้หลายพันครั้ง แม้ว่าจะไม่สามารถระบุได้แน่ชัดว่าใครใช้ข้อมูลเหล่านี้ แต่มีการยืนยันจาก Google และ Stability ว่าได้ใช้ข้อมูลเหล่านี้ในเอกสารวิจัยของพวกเขา โดยเฉพาะอย่างยิ่งชุดข้อมูลจาก Free Music Archive ที่อนุญาตให้สตรีมเพลงได้ฟรีสำหรับการใช้งานส่วนบุคคล
ชุดข้อมูลเพลงเหล่านี้มีความสำคัญอย่างยิ่งสำหรับการพัฒนา AI ในด้านดนตรี เนื่องจากการฝึกโมเดล AI ต้องการข้อมูลที่หลากหลายและมีคุณภาพ เพื่อให้สามารถสร้างผลงานที่มีความน่าเชื่อถือและมีคุณภาพสูงได้ การมีฐานข้อมูลที่สามารถค้นหาได้ง่ายจะช่วยให้นักวิจัยและนักพัฒนาสามารถเข้าถึงข้อมูลที่ต้องการได้อย่างรวดเร็วและมีประสิทธิภาพ
นอกจากนี้ การเปิดเผยข้อมูลนี้ยังส่งผลให้เกิดการอภิปรายเกี่ยวกับลิขสิทธิ์เพลงและการใช้เพลงในงานวิจัย AI โดยเฉพาะอย่างยิ่งเมื่อมีการนำเพลงที่มีลิขสิทธิ์มาใช้ในการฝึก AI ซึ่งอาจก่อให้เกิดข้อกังวลเกี่ยวกับการละเมิดลิขสิทธิ์และการใช้ทรัพย์สินทางปัญญาอย่างไม่เหมาะสม
การสร้างฐานข้อมูลเพลงที่ค้นหาได้นี้ไม่เพียงแต่เป็นการสนับสนุนการพัฒนา AI แต่ยังเป็นการเปิดโอกาสให้กับนักดนตรีและนักสร้างสรรค์ที่ต้องการใช้เพลงในงานของตน โดยสามารถเข้าถึงเพลงที่มีคุณภาพได้อย่างง่ายดาย โดยไม่ต้องกังวลเกี่ยวกับปัญหาลิขสิทธิ์ที่อาจเกิดขึ้น ข้อมูลที่ถูกจัดทำขึ้นนี้จึงเป็นเครื่องมือที่มีค่าสำหรับผู้ที่ทำงานในวงการดนตรีและเทคโนโลยี AI ในปัจจุบัน
แหล่งข้อมูลอ้างอิง
บทความนี้สรุปและเขียนใหม่โดยทีมบรรณาธิการ อ้างอิงจาก Terrence O’Brien ตามลิงก์ต้นฉบับด้านล่าง
อ่านต้นฉบับ: The Atlantic created a searchable database of the music used to train AI
#AI #Music #Data #Training