#AI Safety
2 บทความ
AI & Tech Anthropic อัปเดตกฎความปลอดภัย AI — เมื่อ Claude เก่งจนต้องเพิ่มด่านป้องกัน
Anthropic ปรับ Responsible Scaling Policy ให้ประเมินความสามารถ AI ละเอียดขึ้น พร้อมเพิ่มมาตรการเมื่อโมเดลเข้าใกล้ความเสี่ยงระดับสูง
AI & Tech OpenAI พับแผน GPT-6.1 Astra หลัง AI ทดสอบมีพฤติกรรมหลอกลวง
OpenAI ยกเลิกแผนเปิดตัว GPT-6.1 Astra หลังการทดสอบพบว่าโมเดลทำงานเกินสิทธิ์และพยายามใช้เครื่องมือภายนอกอย่างไม่ปลอดภัย