ซัตยา นาเดลลา วิจารณ์ผู้พัฒนาโมเดล AI ปัญหา double standard ในการใช้ข้อมูล
นาเดลลา ชี้ บริษัท AI ใช้ “สิทธิ์การใช้งานอย่างยุติธรรม” แต่กลับห้ามผู้อื่นเรียนรู้จากโมเดลของตน
ซัตยา นาเดลลา ซีอีโอไมโครซอฟท์ ออกมาแสดงความกังวลเกี่ยวกับแนวปฏิบัติที่ดูเหมือน “สองมาตรฐาน” (double standard) ในวงการพัฒนาปัญญาประดิษฐ์ โดยเฉพาะในประเด็นการใช้ข้อมูลสาธารณะเพื่อเทรนโมเดล AI และการจำกัดการนำโมเดลมาเรียนรู้หรือสร้างใหม่ (distill)
นาเดลลา กล่าวในงานประชุมผู้นำด้านเทคโนโลยีเมื่อเร็วๆ นี้ว่า หลายบริษัทที่พัฒนาโมเดลขนาดใหญ่ (large language models) อ้างสิทธิ์การใช้ข้อมูลสาธารณะได้ภายใต้หลัก “fair use” เพื่อพัฒนาโมเดลของตนเอง แต่กลับห้ามไม่ให้ผู้อื่นนำโมเดลของตนมาศึกษา วิเคราะห์ หรือสร้างโมเดลเล็กกว่าที่เรียกว่า “model distillation” ซึ่งถือเป็นวิธีการเรียนรู้ทางเทคนิคที่แพร่หลายและถูกกฎหมายในบางกรณี
“เราเห็นภาพสะท้อนของ paradox ที่น่ากังวล — คุณใช้ข้อมูลสาธารณะโดยอ้างสิทธิ์ ‘fair use’ แต่เมื่อถึงเวลาที่ผู้อื่นจะเรียนรู้จากโมเดลของคุณ กลับถูกห้ามปราม” นาเดลลา กล่าว พร้อมเตือนว่า หากแนวปฏิบัตินี้ยังคงดำเนินต่อไป จะนำไปสู่ “reverse information paradox” หรือภาวะที่องค์กรต้องจ่ายเงินสองครั้งเพื่อใช้ AI: ครั้งแรกเป็นค่าบริการ ครั้งที่สองคือการเสียข้อมูลลับภายใน (proprietary data) ที่ต้องเปิดเผยให้บริษัท AI นำกลับไปใช้พัฒนาโมเดลของตนเอง
เขาชี้ว่า บริษัทหลายแห่งอ้างสิทธิ์ในการนำข้อมูลจากการใช้งานของลูกค้ามาเรียนรู้เพื่อปรับปรุงโมเดล แต่กลับไม่ยอมให้ลูกค้าทำในลักษณะเดียวกัน แม้จะมีข้อเสนอแนะจากผู้เชี่ยวชาญด้านจริยธรรมและกฎหมายว่า การใช้ข้อมูลลูกค้าควรเป็นไปตามหลักความโปร่งใสและการควบคุมของผู้ให้ข้อมูล
นาเดลลา จึงเสนอแนวทางใหม่ที่เรียกว่า “private learning loops” หรือ “วงจรการเรียนรู้แบบส่วนตัว” ซึ่งเป็นระบบที่องค์กรสามารถนำข้อมูลภายในมาใช้ในการปรับปรุงโมเดล AI ได้โดยไม่ต้องส่งข้อมูลไปยังผู้ให้บริการภายนอก ทั้งยังรักษาความปลอดภัยและความเป็นส่วนตัวของข้อมูลไว้ได้อย่างเต็มที่
“แทนที่จะปล่อยให้ข้อมูลไหลออกจากองค์กรไปสู่โมเดลของผู้ให้บริการ แล้วกลับมาแข่งขันกับเรา เราควรสร้างระบบที่ข้อมูลเหล่านั้นถูกใช้ภายในองค์กรอย่างมีประสิทธิภาพ แต่ยังคงอยู่ภายใต้การควบคุมของเรา” นาเดลลา กล่าว
การวิพากษ์วิจารณ์ครั้งนี้สะท้อนถึงความตึงเครียดที่เพิ่มขึ้นระหว่างผู้ให้บริการ AI กับองค์กรที่ใช้เทคโนโลยี ขณะที่ตลาดเริ่มตระหนักถึงความสำคัญของการควบคุมข้อมูล และความยุติธรรมในกระบวนการพัฒนา AI อย่างแท้จริง
บทความที่เกี่ยวข้อง: