Claude Opus 4.6 เปิดตัวพร้อมการเขียนโค้ด การวิจัย และทักษะในสำนักงานที่ชาญฉลาดยิ่งขึ้น

/th/images/Claude-Opus-4.6.png

ตามข่าวลือก่อนหน้านี้ Anthropic เพิ่งเปิดตัว Claude Opus 4.6 โมเดลใหม่ปรับปรุงการเขียนโค้ด การวิจัย และงานในสำนักงานทุกวัน ในขณะที่เพิ่มหน้าต่างบริบทโทเค็น 1M แรกในรุ่นเบต้าสำหรับโมเดลระดับ Opus Claude Opus 4.6 มองเห็นการปรับปรุงที่สำคัญในการวางแผน รองรับงานเอเจนต์ได้นานขึ้น และทำงานได้อย่างน่าเชื่อถือในโค้ดเบสที่ใหญ่ขึ้น

Claude Opus 4.6 ความเป็นเลิศด้านการเขียนโค้ด งานความรู้ และการใช้เหตุผลตามบริบทแบบยาว

Anthropic กล่าวว่าขณะนี้สามารถดำเนินการตรวจสอบโค้ดได้ดีขึ้น จับข้อผิดพลาด และจัดการการดีบักได้โดยอัตโนมัติ นอกเหนือจากการเขียนโค้ดแล้ว Opus 4.6 ยังสามารถเรียกใช้การวิเคราะห์ทางการเงิน ประมวลผลสเปรดชีต จัดการเอกสาร และแม้แต่สร้างงานนำเสนอได้ ภายใน Cowork ที่ Claude ทำงานหลายอย่างพร้อมกันได้อย่างอิสระ Opus 4.6 จะใช้ความสามารถเหล่านี้ทั้งหมดโดยอัตโนมัติในนามของคุณ

ในแง่ของประสิทธิภาพ โมเดลนี้มีความโดดเด่นจากเกณฑ์มาตรฐานหลายประการ โดยทำคะแนนสูงสุดใน Terminal-Bench 2.0 การประเมินการเข้ารหัสเอเจนต์ ซึ่งเหนือกว่า Humanity’s Last Exam และมีประสิทธิภาพเหนือกว่า GPT-5.2 และรุ่นก่อนในด้าน GDPval-AA ซึ่งเป็นการทดสอบสำหรับงานที่มีคุณค่าทางเศรษฐกิจในภาคการเงิน กฎหมาย และภาคส่วนอื่นๆ การประเมินของ BrowserComp ยังแสดงให้เห็นถึงความสามารถที่เหนือกว่าในการค้นหาข้อมูลออนไลน์ที่หายาก

/th/images/Knowledge-Work-scaled.png /th/images/Coding-scaled.png /th/images/Agentic-Search-scaled.png /th/images/Multidisciplinary-reasoning-scaled.png /th/images/Knowledge-Work-scaled.png /th/images/Coding-scaled.png /th/images/Agentic-Search-scaled.png /th/images/Multidisciplinary-reasoning-scaled.png /th/images/

ก้าวต่อไป Opus 4.6 นำการให้เหตุผลตามบริบทที่ยาวขึ้นมาสู่ตาราง สามารถติดตามโทเค็นนับแสน รับรายละเอียดที่ละเอียดอ่อน และลด “การเน่าเปื่อยของบริบท” ในเซสชันที่ยาวนาน ในการทดสอบเช่น MRCR v2 นั้น Opus 4.6 มีความแม่นยำ 76% เทียบกับเพียง 18.5% จาก Sonnet 4.5 ซึ่งแสดงให้เห็นถึงการก้าวกระโดดครั้งใหญ่ในด้านประสิทธิภาพบริบทแบบยาว

/th/images/Comparison-chart-897x1024.png เครดิตรูปภาพ: Anthropic

ความปลอดภัย การควบคุมของนักพัฒนา และการบูรณาการสำนักงาน

มานุษยวิทยาไม่ได้ประนีประนอมในส่วนความปลอดภัยเช่นกัน นั่นเป็นเพราะว่า Opus 4.6 รักษาอัตราพฤติกรรมที่ไม่ตรงแนวไว้ต่ำ อัตราการปฏิเสธมากเกินไปต่ำ และแสดงการป้องกันที่แข็งแกร่ง รวมถึงการสอบสวนความปลอดภัยทางไซเบอร์ใหม่ 6 รายการ โมเดลนี้ยังใช้ในการตรวจจับและแก้ไขช่องโหว่ในซอฟต์แวร์โอเพ่นซอร์ส ซึ่งสนับสนุนงานป้องกันความปลอดภัยทางไซเบอร์

อย่าลืมว่านักพัฒนาจะได้รับการควบคุมใหม่ด้วย API การคิดแบบปรับเปลี่ยนช่วยให้ Claude ตัดสินใจได้ว่าเมื่อใดการใช้เหตุผลที่ลึกซึ้งยิ่งขึ้นจะมีประโยชน์ การตั้งค่าความพยายามจะปรับความฉลาดและความเร็ว และการบีบอัดบริบทช่วยให้งานที่ใช้เวลานานดำเนินการได้สำเร็จโดยไม่มีขีดจำกัด ขณะนี้เอาท์พุตมีโทเค็นถึง 128K พร้อมตัวเลือกระดับพรีเมียมสำหรับงานที่มีมูลค่ามากกว่า 200K มีการอนุมานเฉพาะสหรัฐอเมริกาเท่านั้น

การบูรณาการ Office ขยายออกไปอีก เนื่องจากตอนนี้ Claude ใน Excel สามารถจัดการงานยาวๆ หลายขั้นตอนพร้อมประสิทธิภาพที่ดีขึ้นและการใช้เหตุผลของข้อมูลที่มีโครงสร้าง ใน PowerPoint ขณะนี้ Claude พร้อมให้ใช้งานเป็นตัวอย่างการวิจัยแล้ว โมเดล AI ยังช่วยให้ผู้ใช้แปลงเอาต์พุต Excel เป็นสไลด์ตามแบรนด์ได้โดยอัตโนมัติ ยิ่งไปกว่านั้น ทีมตัวแทนใน Claude Code สามารถรันงานแบบคู่ขนานได้ โดยประสานงานกับเวิร์กโหลดขนาดใหญ่และอ่านข้อมูลจำนวนมากได้โดยอัตโนมัติ

Claude Opus 4.6 พร้อมใช้งานแล้ววันนี้ผ่านทาง claude.ai, API และแพลตฟอร์มคลาวด์หลักๆ ทั้งหมด ช่วยให้นักพัฒนาและทีมงานระดับองค์กรจัดการงานที่ซับซ้อนด้วย AI ที่ชาญฉลาดและมีความสามารถมากขึ้นได้ง่ายขึ้น

*️⃣ ลิงค์ที่มา:

มีข่าวลือก่อนหน้านี้ เปิดตัว Claude Opus 4.6 , /th/images/Comparison-chart-897x1024.png ,