
OpenAI ได้ประกาศ GPT-5.4 ซึ่งบริษัทเรียกว่าเป็นโมเดลชายแดนที่มีความสามารถและมีประสิทธิภาพมากที่สุดสำหรับงานระดับมืออาชีพ รุ่นใหม่จะมาพร้อมกับหลายเวอร์ชันที่ออกแบบมาสำหรับปริมาณงานที่แตกต่างกัน รวมถึงรุ่นมาตรฐาน เวอร์ชันที่เน้นการใช้เหตุผลที่เรียกว่า GPT-5.4 Thinking และตัวเลือกประสิทธิภาพสูงที่มีป้ายกำกับว่า GPT-5.4 Pro
การประกาศยังเน้นถึงการอัพเกรดที่สำคัญภายใต้ประทุน สำหรับนักพัฒนา GPT-5.4 เวอร์ชัน API รองรับหน้าต่างบริบทที่มีขนาดใหญ่ถึง 1 ล้านโทเค็น ซึ่งเป็นความจุบริบทที่ใหญ่ที่สุดที่ OpenAI นำเสนอได้อย่างง่ายดาย บริษัทกล่าวว่าโมเดลใหม่สามารถแก้ไขปัญหาเดียวกันได้ในขณะที่ใช้โทเค็นน้อยกว่า GPT-5.2 อย่างมาก ซึ่งชี้ให้เห็นถึงประสิทธิภาพที่เพิ่มขึ้นอย่างน่าทึ่งสำหรับปริมาณงานขนาดใหญ่
เกณฑ์มาตรฐานแสดงให้เห็นถึงประโยชน์ที่สำคัญสำหรับงานด้านความรู้
OpenAI กล่าวว่า GPT-5.4 ให้ผลลัพธ์ที่ยอดเยี่ยมจากเกณฑ์การประเมินต่างๆ ที่เน้นไปที่งานในโลกแห่งความเป็นจริง มีรายงานว่าโมเดลดังกล่าวได้รับคะแนนสูงสุดเป็นประวัติการณ์ใน OSWorld-Verified และ WebArena Verified ซึ่งทั้งสองอย่างนี้วัดความสามารถในการโต้ตอบกับคอมพิวเตอร์ นอกจากนี้ยังได้คะแนน 83 เปอร์เซ็นต์จากเกณฑ์มาตรฐาน GDPval ของ OpenAI ซึ่งเป็นการทดสอบที่ออกแบบมาเพื่อวัดประสิทธิภาพในงานด้านความรู้
เครดิตรูปภาพ: OpenAI
ผลลัพธ์การวัดประสิทธิภาพอีกประการหนึ่งมาจากการประเมิน APEX-Agents ของ Mercor ซึ่งมุ่งเน้นไปที่ทักษะทางวิชาชีพในด้านต่างๆ เช่น การเงินและกฎหมาย เห็นได้ชัดว่า GPT-5.4 ยังทำงานได้ดีเป็นพิเศษเมื่อสร้างการส่งมอบที่มีรูปแบบยาว รวมถึงชุดสไลด์ แบบจำลองทางการเงิน และการวิเคราะห์ทางกฎหมาย
OpenAI ยังกล่าวอีกว่าโมเดลใหม่ช่วยเพิ่มความน่าเชื่อถือ เมื่อเทียบกับ GPT-5.2 แล้ว GPT-5.4 มีโอกาสในการกล่าวอ้างที่ไม่ถูกต้องน้อยลง 33 เปอร์เซ็นต์ ในขณะที่การตอบสนองโดยรวมมีแนวโน้มที่จะมีข้อผิดพลาดด้านข้อเท็จจริงน้อยกว่า 18 เปอร์เซ็นต์
นอกจากการเปิดตัวโมเดลแล้ว OpenAI ยังได้อัปเดตวิธีที่ GPT-5.4 API จัดการกับการเรียกเครื่องมือ โดยแนะนำระบบใหม่ที่เรียกว่า Tool Search แทนที่จะโหลดคำจำกัดความของเครื่องมือทุกชิ้นในพร้อมท์ของระบบ โมเดลสามารถดึงรายละเอียดเครื่องมือได้เมื่อจำเป็นเท่านั้น การเปลี่ยนแปลงนี้จะช่วยลดการใช้โทเค็นและสามารถทำให้ระบบขนาดใหญ่ทำงานได้เร็วและราคาถูกกว่า
*️⃣ ลิงค์ที่มา:
OpenAI,
ประกาศ GPT-5.4 ,
รองรับหน้าต่างบริบทขนาดใหญ่ถึง 1 ล้านโทเค็น ,
ให้ผลลัพธ์ที่แข็งแกร่งในการวัดประสิทธิภาพการประเมินหลายรายการ ,
,