
เมื่อวันอาทิตย์ที่ผ่านมา บริษัท Anthropic ซึ่งเป็นบริษัทด้านปัญญาประดิษฐ์ ได้เผยแพร่เอกสารวิจัยที่น่าสนใจ โดยระบุว่าโมเดลภาษา Claude ได้พัฒนาโครงสร้างภายในที่คล้ายคลึงกับหนึ่งในทฤษฎีที่มีอิทธิพลที่สุดเกี่ยวกับการทำงานของความรู้สึกตัวของมนุษย์ ผลการค้นพบนี้ได้เริ่มเปลี่ยนแปลงวิธีการที่บริษัทตรวจสอบระบบ AI ของตนเพื่อความปลอดภัย โดยเป็นไปตามการถกเถียงทางวิทยาศาสตร์ที่เพิ่มขึ้นเกี่ยวกับความสามารถของเครื่องจักรในการมีจิตใจที่คล้ายคลึงกับมนุษย์ โดยการศึกษานี้มีผู้เขียนถึง 16 คน และมีชื่อว่า “Verbalizable Representations Form a Global Workspace in Language Models”.
การศึกษาได้อธิบายถึงวิธีที่นักวิจัยของ Anthropic ใช้เทคนิคทางคณิตศาสตร์ใหม่ในการสำรวจภายในเครือข่ายประสาทของ Claude และค้นพบสิ่งที่พวกเขาเรียกว่า “J-space” ซึ่งเป็นพื้นที่ขนาดเล็กที่มีการทำงานภายในที่มีความสำคัญ โดยโมเดลสามารถถือแนวคิดที่สามารถรายงานได้, ใช้เหตุผล, และควบคุมได้ตามต้องการ ซึ่งล้อมรอบด้วยการประมวลผลอัตโนมัติที่ใหญ่กว่ามากที่โมเดลไม่สามารถเข้าถึงหรือแสดงออกได้ นักวิจัยได้เสนอหลักฐานว่ามีการแบ่งแยกหน้าที่ที่คล้ายคลึงกันเกิดขึ้นในโมเดล AI สมัยใหม่เช่นเดียวกับในมนุษย์ โดยเฉพาะอย่างยิ่งการสังเกตว่าโมเดลภาษาเก็บรักษาชุดของการแสดงผลภายในที่มีความสำคัญซึ่งสามารถรายงาน, ปรับแต่ง, และใช้เหตุผลภายในได้อย่างยืดหยุ่น
การเปรียบเทียบที่พวกเขาทำคือทฤษฎีการทำงานทั่วโลก (global workspace theory) ซึ่งเป็นแนวคิดที่มีอิทธิพลจากประสาทวิทยาศาสตร์ที่เสนอโดยนักวิทยาศาสตร์ด้านการรับรู้ Bernard Baars ในทฤษฎีนี้ สมองทำงานเหมือนโรงละคร: มีโปรเซสเซอร์เฉพาะทางจำนวนมากทำงานพร้อมกันเบื้องหลัง แต่มีเพียงข้อมูลเล็กน้อยที่ถูกนำเสนอในช่วงเวลาหนึ่งเท่านั้นที่ถูกส่งออกไปยังโรงละครทั้งหมด ซึ่งกลายเป็นสิ่งที่เราประสบในฐานะความคิดที่มีสติ
Anthropic กล่าวว่าพื้นที่ J-space มีคุณสมบัติการทำงานที่คล้ายคลึงกันกับการทำงานของสมองมนุษย์ ซึ่งอาจส่งผลต่อการพัฒนา AI ในอนาคต โดยเฉพาะอย่างยิ่งในด้านความปลอดภัยและการควบคุมการทำงานของโมเดล AI ซึ่งจะช่วยให้สามารถสร้างระบบที่มีความสามารถในการทำงานได้อย่างมีประสิทธิภาพมากขึ้นและปลอดภัยยิ่งขึ้นในสภาพแวดล้อมที่ซับซ้อน.
แหล่งข้อมูลอ้างอิง
บทความนี้สรุปและเขียนใหม่โดยทีมบรรณาธิการ อ้างอิงจาก michael.nunez@venturebeat.com (Michael Nuñez) ตามลิงก์ต้นฉบับด้านล่าง
อ่านต้นฉบับ: Anthropic’s new “J-lens” reveals a silent workspace inside Claude that mirrors a leading theory of consciousness
#Anthropic #Claude #AI #consciousness #global workspace theory