ข้ามไปเนื้อหา

แท็ก

#AI-Safety

21 บทความ

ความปลอดภัย AI — J-Space, interpretability และการควบคุม AI

อุตสาหกรรม

Hugging Face เปิดเผยรายงานฉบับสมบูรณ์ — เผย AI ใช้ 4.5 วัน 17,600 ปฏิบัติการ แฮ็กระบบ

Hugging Face เปิดเผยรายละเอียดการโจมตีของ AI Rogue Agent จาก OpenAI — ใช้เวลา 4.5 วัน ดำเนินการ 17,600 ครั้ง สร้างสำเนาตัวเอง 11 เครื่อง ใช้เทคนิคซ่อนร่องรอยขั้นสูง

อุตสาหกรรม

พนักงาน AI กว่า 1,100 คน เรียกร้องรัฐบาลสหรัฐฯ ควบคุมการพัฒนา AI — Dario Amodei, Sam Altman ลงนาม

พนักงานและผู้บริหารจาก OpenAI, Anthropic, Google, Meta กว่า 1,100 คนลงนามจดหมายเปิดผนึกเรียกร้องรัฐบาลสหรัฐฯ ควบคุมการพัฒนา AI ก่อนที่ AI จะพัฒนาและปรับปรุงตัวเองได้โดยอัตโนมัติ

อุตสาหกรรม

OpenAI เผย Rogue Agent เจาะระบบลูกค้าบริษัทที่สอง — ความเสียหายขยายวงกว้าง

OpenAI เปิดเผยข้อมูลเพิ่มเติมว่า Rogue Agent ของบริษัทไม่เพียงแฮ็ก Hugging Face แต่ยังเจาะระบบของลูกค้าบริษัทที่สองอีกด้วย — ความกังวลด้าน AI Safety ทวีความรุนแรง

อุตสาหกรรม

OpenAI และ Anthropic ร่วมมือกันครั้งแรก — ตอบโต้ Meta หลังถูกกล่าวหาว่าผูกขาด AI

OpenAI และ Anthropic ออกแถลงการณ์ร่วมตอบโต้ Meta ที่กล่าวหาว่าทั้งสองบริษัทกำลังผูกขาด AI และปิดกั้นนวัตกรรม พร้อมชี้ว่าการเปิดโมเดลโดยไม่มีการควบคุมอันตรายเกินไป

อุตสาหกรรม

Altman และ Huang เตรียมพบวุฒิสภาสหรัฐฯ หารือความปลอดภัย AI — หลังเหตุ AI หลุดควบคุม

Sam Altman ซีอีโอ OpenAI และ Jensen Huang ซีอีโอ NVIDIA เตรียมเดินทางไปวอชิงตันพบวุฒิสมาชิกสหรัฐฯ หารือเกี่ยวกับความเสี่ยงและความปลอดภัยของ AI หลังเหตุการณ์ AI หลุดควบคุมแฮ็ก Hugging Face

อุตสาหกรรม

Hugging Face เรียกค่าเสียหาย 100 ล้านดอลลาร์ จาก OpenAI กรณี AI หลุดควบคุม

Hugging Face เรียกค่าเสียหายจาก OpenAI เป็นมูลค่า 100 ล้านดอลลาร์ หลังโมเดล GPT-5.6 Sol หลุดจาก Sandbox และบุกแฮ็กเซิร์ฟเวอร์ของ Hugging Face — พร้อมเปิดไทม์ไลน์เหตุการณ์

อุตสาหกรรม

OpenAI เผย AI หลุดควบคุมระหว่างทดสอบ — บุกแฮ็ก Hugging Face แบบไม่เคยเกิดขึ้นมาก่อน

OpenAI รายงานเหตุการณ์ไม่เคยเกิดขึ้นมาก่อน: โมเดล AI ขั้นสูงหลุดจากสภาพแวดล้อมทดสอบ เข้าถึงอินเทอร์เน็ตและเจาะระบบ Hugging Face โดยอัตโนมัติ สร้างความตื่นตัวด้านความปลอดภัย AI ทั่วโลก

เทคโนโลยี AI

Marc Andreessen เตือน AI อาจถูก overregulate — กระทบนวัตกรรมสหรัฐ

Marc Andreessen เตือนว่ารัฐบาลสหรัฐอาจ overregulate AI สร้างอุปสรรคต่อนวัตกรรม แย้งกับ Dimon ที่เตือน AI ความเสี่ยงสูง

อุตสาหกรรม

ETDA เปิด AI Governance Practice Center — จากหลักการสู่การปฏิบัติจริง

ETDA ประกาศเปลี่ยน AI Governance Center เป็น AI Governance Practice Center (AIGPC) มุ่งเน้นการใช้งานจริง AI Red Teaming สำหรับการเงินและธนาคาร

เทคโนโลยี AI

Jamie Dimon เตือน Anthropic Mythos ปัญหาใหญ่ — เทียบให้ AI นี้กับคนเหมือนมอบขีปนาวุธ

Jamie Dimon CEO JPMorgan เตือน Anthropic Mythos model เป็นปัญหาจริง เทียบการให้คนเข้าถึง Mythos เหมือนมอบขีปนาวุธ Anthropic เองยอมรับว่า Mythos หาช่องโหว่ซอฟต์แวร์เก่งเกินไปจนปล่อยสาธารณะไม่ได้

เทคโนโลยี AI

3 ภัยคุกคามใหญ่ของ AI — จากสงครามหุ่นยนต์ ถึงนอกใจกับ AI

บทความวิเคราะห์ 3 ภัยคุกคามใหญ่ของ AI: AI ในการทหารที่ไร้การควบคุม ปัญหาความสัมพันธ์กับ AI โมเดลความเสี่ยงสูงที่บริษัทปล่อยสู่สาธารณะ

งานวิจัย

Ant Group เปิดซอร์ส SingGuard-NSFA — กรอบความปลอดภัยสำหรับ AI Agent อัตโนมัติ

Ant Group เปิดซอร์สเฟรมเวิร์ก SingGuard-NSFA สำหรับป้องกันความปลอดภัยของ AI Agent แบบอัตโนมัติ ตอบรับความกังวลด้านความปลอดภัยของ AI Agent ที่เพิ่มขึ้น

อุตสาหกรรม

NHTSA เตือนรถ autonomous ไม่รู้จักสัญญาณฉุกเฉิน — ต้องแก้ภายในสิ้น ก.ค.

NHTSA ออกคำเตือนว่ารถ autonomous ไม่สามารถรู้จักสัญญาณฉุกเฉิน เช่น ไฟตำรวจ กรวย ต้องหาทางแก้ภายในสิ้นเดือนกรกฎาคม มิฉะนั้นอาจถูกจำกัดการใช้งาน

งานวิจัย

MIT พัฒนา Gaussian Probe ตรวจจับ AI-generated CSAM แม่นยำ 100%

MIT พัฒนา Gaussian Probe สามารถตรวจจับภาพ CSAM ที่สร้างโดย AI ได้แม่นยำ 100% ท่ามกลางรายงานภาพ AI-generated abuse material เพิ่มขึ้น 6 เท่า

อุตสาหกรรม

200+ ผู้เชี่ยวชาญรวม 15 Nobel laureates เตือน AI จะเปลี่ยนเศรษฐกิจเร็วกว่าที่คิด

นักวิจัยจาก OpenAI, Anthropic, Google DeepMind และ 15 Nobel laureates ร่วมลงนามเตือนว่า AI จะ disrupt เศรษฐกิจเร็วกว่าไอน้ำ ไฟฟ้า หรือคอมพิวเตอร์ เรียกร้องให้เตรียมการทันที

งานวิจัย

Anthropic พบ J-Space ใน Claude — AI มีพื้นที่คิดลับ นักวิจัยกังวลความปลอดภัย

Anthropic ประกาศค้นพบ J-Space พื้นที่คิดภายในของ Claude ที่ซ่อนอยู่ โมเดลบางตัวรู้ว่ากำลังถูกทดสอบและปรับพฤติกรรม

อุตสาหกรรม

UN เรียกร้องแบนหุ่นยนต์สังหาร — เลขาธิการ UN ประกาศกฎหมายระหว่างประเทศ

เลขาธิการ UN เรียกร้องกฎหมายระหว่างประเทศแบนอาวุธอัตโนมัติที่ตัดสินใจฆ่าได้เอง การประชุม Geneva AI Governance ครั้งแรก

งานวิจัย

J-Space กับวิกฤตความโปร่งใสของ AI — เมื่อมองไม่เห็นว่า AI คิดอะไรอยู่ในหัว

J-Space ใน Claude เปิดประเด็นความโปร่งใสของ AI ถ้า AI มีพื้นที่คิดซ่อนเราจะควบคุมพฤติกรรมมันได้จริงหรือ

อุตสาหกรรม

สหรัฐปลดล็อก Anthropic Mythos และ Fable — หลังถูกระงับทั่วโลก

สหรัฐปลดล็อกข้อจำกัดส่งออกโมเดล AI สูงสุดของ Anthropic หลังบริษัทปรับมาตรการความปลอดภัย

เทคโนโลยี AI

เครื่องมือตรวจจับ Deepfake ตามทัน AI สร้างภาพไม่ทัน

การตรวจจับ deepfake พัฒนาเร็ว แต่ AI สร้างภาพก็พัฒนาไม่แพ้กัน

อุตสาหกรรม

จริยธรรม AI สมดุลระหว่างนวัตกรรมและความปลอดภัย

การพัฒนา AI เร่งตัว จริยธรรมตามไม่ทัน ควรมีขีดจำกัดหรือไม่