Anthropic เปิดตัว Claude Opus 4.5 พร้อมการอัปเกรดครั้งใหญ่ในด้านการเขียนโค้ดและการใช้เหตุผล

/th/images/Anthropic-logo-feature-image.png

เอ็กซ์

ติดตั้งโดยคลิกดาวน์โหลดไฟล์

ข้อความจากพันธมิตรของเรา

แก้ไขข้อผิดพลาดระบบปฏิบัติการ Windows 11 ด้วย Fortec:

  • ดาวน์โหลด Fortec และติดตั้งลงบนพีซีของคุณ

  • เปิดเครื่องมือและเริ่มการสแกนเพื่อค้นหาไฟล์ที่เสียหายซึ่งเป็นสาเหตุของปัญหา

  • คลิกขวาที่ Start Repair เพื่อแก้ไขปัญหาที่ส่งผลต่อความปลอดภัยและประสิทธิภาพของคอมพิวเตอร์ของคุณ

ดาวน์โหลดเดี๋ยวนี้

0

ผู้อ่านในเดือนนี้ ได้เรตติ้ง 4.6 บน

ผู้อ่านดาวน์โหลด Fortect ในเดือนนี้ โดยได้คะแนน 4.6 บน TrustPilot

Anthropic ได้เปิดตัว Claude Opus 4.5 อย่างเป็นทางการ ซึ่งเป็นการอัปเกรดครั้งใหญ่ของโมเดล AI ระดับเรือธงที่เจาะลึกเข้าไปในวิศวกรรมซอฟต์แวร์จริง การวิจัย และเวิร์กโฟลว์หลายขั้นตอน ขณะนี้โมเดลดังกล่าวพร้อมใช้งานแล้วในแอป Claude, API และแพลตฟอร์มคลาวด์หลักๆ โดยกำหนดราคาไว้ที่ 5 ดอลลาร์/25 ดอลลาร์ต่อล้านโทเค็น

/th/images/7022a87aeb6eab1458d68412bc927306224ea9eb-3840x2160-1-1024x576.png รูปภาพ: มานุษยวิทยา

Anthropic กล่าวว่า Opus 4.5 นำเสนอประสิทธิภาพการเขียนโค้ดที่ดีที่สุดในบรรดาโมเดลชายแดนในปัจจุบัน โดยเป็นผู้นำใน SWE-bench Verified และยังมีคะแนนเหนือกว่าผู้สมัครที่เป็นมนุษย์ทุกคนในการสอบวิศวกรรมความยาว 2 ชั่วโมงของ Anthropic อีกด้วย ผู้ทดสอบในช่วงแรกยังรายงานด้วยว่าโมเดลนี้จัดการกับความคลุมเครือได้ดีขึ้น มีเหตุผลในการแลกเปลี่ยน และแก้ไขข้อบกพร่องของระบบหลายระบบด้วยการแจ้งเตือนที่น้อยลง

ไม่ใช่แค่การเขียนโค้ดที่ Claude Opus 4.5 มอบให้เท่านั้น การปรับปรุงครอบคลุมทั้งการใช้เหตุผล คณิตศาสตร์ งานหลายภาษา และการทำความเข้าใจการมองเห็น โดยนำหน้ารุ่นก่อนหน้าในชุดการวัดประสิทธิภาพหลายชุด โมเดลยังแสดงพฤติกรรมเอเจนต์ที่ชัดเจนยิ่งขึ้น ซึ่งมักจะค้นหาเส้นทางที่ถูกต้องแต่ไม่คาดคิดผ่านงานที่จำกัด

Anthropic ก็ไม่ประนีประนอมกับความปลอดภัยเช่นกัน ตามที่ Claude Opus 4.5 เป็นรุ่นที่สอดคล้องและแข็งแกร่งที่สุด โดยแสดงความต้านทานที่สูงกว่าต่อการโจมตีแบบฉีดทันทีที่รุนแรง บริษัทเน้นย้ำความคืบหน้าในการประเมิน “พฤติกรรมที่เกี่ยวข้อง” และการทดสอบความเครียดในวงกว้าง

นักพัฒนายังได้รับการควบคุมมากขึ้นผ่านพารามิเตอร์ความพยายามใหม่ ซึ่งช่วยให้ทีมเลือกระหว่างการตอบกลับที่รวดเร็ว มีประสิทธิภาพ หรือการให้เหตุผลที่ลึกซึ้งและรอบคอบมากขึ้น ด้วยความพยายามปานกลาง Opus 4.5 จะจับคู่ Sonnet 4.5 บน SWE-bench โดยมีโทเค็นน้อยกว่ามาก เมื่อใช้ความพยายามสูงสุด จะเหนือกว่า Sonnet 4.5 ในขณะที่ใช้โทเค็นเอาท์พุตต่ำกว่าครึ่งหนึ่ง

Anthropic กำลังเปิดตัวการอัพเกรดผลิตภัณฑ์เช่นกัน Claude Code ได้รับการปรับปรุงโหมดแผนและการรองรับเดสก์ท็อป ในขณะเดียวกัน Claude สำหรับ Chrome กำลังขยายไปยังผู้ใช้ Max และตอนนี้ Claude สำหรับ Excel เข้าถึงลูกค้า Max, Team และ Enterprise การแชทที่ยาวนานในแอป Claude ยังได้รับประโยชน์จากการสรุปบริบทอัตโนมัติเพื่อให้การสนทนาดำเนินไปอย่างต่อเนื่อง

*️⃣ ลิงค์ที่มา:

ดาวน์โหลดเดี๋ยวนี้ , TrustPilot , เปิดตัวอย่างเป็นทางการ , /th/images/7022a87aeb6eab1458d68412bc927306224ea9eb-3840x2160-1-1024x576.png ,