OpenAI เปิดตัว GPT-5.4 ซึ่งเป็นโมเดลที่ \"มีความสามารถ\" มากที่สุดด้วยรุ่น Thinking และ Pro

/th/images/GPT-5.4_20260306_060907_0000.png

OpenAI ได้ประกาศ GPT-5.4 ซึ่งบริษัทเรียกว่าเป็นโมเดลชายแดนที่มีความสามารถและมีประสิทธิภาพมากที่สุดสำหรับงานระดับมืออาชีพ รุ่นใหม่จะมาพร้อมกับหลายเวอร์ชันที่ออกแบบมาสำหรับปริมาณงานที่แตกต่างกัน รวมถึงรุ่นมาตรฐาน เวอร์ชันที่เน้นการใช้เหตุผลที่เรียกว่า GPT-5.4 Thinking และตัวเลือกประสิทธิภาพสูงที่มีป้ายกำกับว่า GPT-5.4 Pro

การประกาศยังเน้นถึงการอัพเกรดที่สำคัญภายใต้ประทุน สำหรับนักพัฒนา GPT-5.4 เวอร์ชัน API รองรับหน้าต่างบริบทที่มีขนาดใหญ่ถึง 1 ล้านโทเค็น ซึ่งเป็นความจุบริบทที่ใหญ่ที่สุดที่ OpenAI นำเสนอได้อย่างง่ายดาย บริษัทกล่าวว่าโมเดลใหม่สามารถแก้ไขปัญหาเดียวกันได้ในขณะที่ใช้โทเค็นน้อยกว่า GPT-5.2 อย่างมาก ซึ่งชี้ให้เห็นถึงประสิทธิภาพที่เพิ่มขึ้นอย่างน่าทึ่งสำหรับปริมาณงานขนาดใหญ่

เกณฑ์มาตรฐานแสดงให้เห็นถึงประโยชน์ที่สำคัญสำหรับงานด้านความรู้

OpenAI กล่าวว่า GPT-5.4 ให้ผลลัพธ์ที่ยอดเยี่ยมจากเกณฑ์การประเมินต่างๆ ที่เน้นไปที่งานในโลกแห่งความเป็นจริง มีรายงานว่าโมเดลดังกล่าวได้รับคะแนนสูงสุดเป็นประวัติการณ์ใน OSWorld-Verified และ WebArena Verified ซึ่งทั้งสองอย่างนี้วัดความสามารถในการโต้ตอบกับคอมพิวเตอร์ นอกจากนี้ยังได้คะแนน 83 เปอร์เซ็นต์จากเกณฑ์มาตรฐาน GDPval ของ OpenAI ซึ่งเป็นการทดสอบที่ออกแบบมาเพื่อวัดประสิทธิภาพในงานด้านความรู้

/th/images/GPT-5.4-benchmarks-1024x569.jpg เครดิตรูปภาพ: OpenAI

ผลลัพธ์การวัดประสิทธิภาพอีกประการหนึ่งมาจากการประเมิน APEX-Agents ของ Mercor ซึ่งมุ่งเน้นไปที่ทักษะทางวิชาชีพในด้านต่างๆ เช่น การเงินและกฎหมาย เห็นได้ชัดว่า GPT-5.4 ยังทำงานได้ดีเป็นพิเศษเมื่อสร้างการส่งมอบที่มีรูปแบบยาว รวมถึงชุดสไลด์ แบบจำลองทางการเงิน และการวิเคราะห์ทางกฎหมาย

OpenAI ยังกล่าวอีกว่าโมเดลใหม่ช่วยเพิ่มความน่าเชื่อถือ เมื่อเทียบกับ GPT-5.2 แล้ว GPT-5.4 มีโอกาสในการกล่าวอ้างที่ไม่ถูกต้องน้อยลง 33 เปอร์เซ็นต์ ในขณะที่การตอบสนองโดยรวมมีแนวโน้มที่จะมีข้อผิดพลาดด้านข้อเท็จจริงน้อยกว่า 18 เปอร์เซ็นต์

นอกจากการเปิดตัวโมเดลแล้ว OpenAI ยังได้อัปเดตวิธีที่ GPT-5.4 API จัดการกับการเรียกเครื่องมือ โดยแนะนำระบบใหม่ที่เรียกว่า Tool Search แทนที่จะโหลดคำจำกัดความของเครื่องมือทุกชิ้นในพร้อมท์ของระบบ โมเดลสามารถดึงรายละเอียดเครื่องมือได้เมื่อจำเป็นเท่านั้น การเปลี่ยนแปลงนี้จะช่วยลดการใช้โทเค็นและสามารถทำให้ระบบขนาดใหญ่ทำงานได้เร็วและราคาถูกกว่า

*️⃣ ลิงค์ที่มา:

OpenAI, ประกาศ GPT-5.4 , รองรับหน้าต่างบริบทขนาดใหญ่ถึง 1 ล้านโทเค็น , ให้ผลลัพธ์ที่แข็งแกร่งในการวัดประสิทธิภาพการประเมินหลายรายการ , /th/images/GPT-5.4-benchmarks-1024x569.jpg ,