Anthropic เปิดตัว Claude Opus 4.8 เมื่อวันอังคาร ทำคะแนน benchmark SWE-bench ที่ 78% สูงขึ้น 15% จากเวอร์ชันก่อน โดยเปิดให้ใช้ผ่าน API ในราคาเท่าเดิม ผู้ทดสอบช่วงแรกระบุว่า model จัดการงาน refactor หลายไฟล์ได้เสถียรขึ้น ส่วนที่พัฒนาขึ้นมาจากวิธี training ใหม่ที่เน้นงาน agentic coding โดยเฉพาะ
อ่านต้นฉบับmathoverflow.net/questions/502120/examples-for-the-use-of-ai-and-especially-llms-in-major-mathematical-development
AnthropicClaudecoding
สรุปด้วย MAF Local AI · เนื้อหาต้นฉบับเป็นของแหล่งข่าว