
NVIDIA รายงานรายรับทั้งปี 2568 อยู่ที่ 215.9 พันล้านดอลลาร์ ซึ่งรวมถึง 68.1 พันล้านดอลลาร์ในไตรมาสที่ 4 แม้ว่าจะเป็นปีที่ทำลายสถิติ แต่รายได้จากเกมลดลง 13% เนื่องจากการขาดแคลน DRAM อย่างต่อเนื่อง ซึ่งยังคงกดดันอุปทาน GPU
จากข้อมูลของ TechPowerUp นั้น NVIDIA ได้เริ่มจัดส่งตัวอย่างชั้นวาง Vera Rubin VR200 ให้กับลูกค้าเป็นครั้งแรก ซึ่งถือเป็นก้าวสำคัญในการเปิดตัวโครงสร้างพื้นฐาน AI รุ่นต่อไป
Vera Rubin VR200 เข้าสู่มือลูกค้ารายแรกๆ
NVIDIA ยืนยันว่าได้เริ่มจัดส่งตัวอย่างแร็ค Vera Rubin VR200 ให้กับลูกค้าที่ได้รับเลือกแล้ว การจัดส่งการผลิตจำนวนมากของระบบ Vera Rubin ทั้งหมดมีกำหนดในช่วงครึ่งหลังของปี 2569
แพลตฟอร์ม Vera Rubin ผสมผสาน Vera CPU, Rubin GPU, สวิตช์ NVLink 6, ConnectX-9 SuperNIC, BlueField-4 DPU และสวิตช์อีเธอร์เน็ต Spectrum-6 ให้เป็นสแต็กโครงสร้างพื้นฐาน AI แบบครบวงจร NVIDIA กล่าวว่าระบบได้รับการออกแบบมาเพื่อขับเคลื่อนโมเดล AI พารามิเตอร์ล้านล้านพารามิเตอร์ในขณะที่ปรับปรุงประสิทธิภาพเมื่อเทียบกับรุ่นก่อนหน้า
บริษัทอ้างว่า Rubin อาจต้องการเพียงหนึ่งในสี่ของจำนวน GPU เมื่อเทียบกับ Blackwell สำหรับปริมาณงานบางอย่าง และอาจลดต้นทุนการอนุมานได้มากถึง 10 เท่า
สถาปัตยกรรม Rubin และรายละเอียดประสิทธิภาพ
Rubin GPU แต่ละตัวให้การประมวลผล FP4 ประมาณ 50 PetaFLOPS ในขณะที่การกำหนดค่า Superchip สอง GPU มีประสิทธิภาพประมาณ 100 PetaFLOPS ของ FP4 GPU รวมชิปประมวลผลขนาดเรติเคิลสองตัวและสแต็กหน่วยความจำ HBM4 แปดสแต็ก ส่งผลให้ได้ HBM4 288 GB ต่อ GPU และประมาณ 576 GB ต่อ Superchip
Rubin ยังแนะนำการออกแบบถาดแบบโมดูลาร์แบบไม่มีสายเคเบิลซึ่งมีจุดมุ่งหมายเพื่อปรับปรุงความยืดหยุ่นและลดความซับซ้อนในการให้บริการเมื่อเทียบกับแพลตฟอร์ม Blackwell
Vera CPU และหน่วยความจำระบบ
Vera CPU มีคอร์ Armv9.2 “Olympus” แบบกำหนดเอง 88 คอร์ พร้อมด้วย 172 เธรด ระบบรองรับหน่วยความจำ LPDDR5X สูงสุด 1.5 TB ในรูปแบบ SOCAMM ทำให้สามารถใช้งานเวิร์กโหลด AI ขนาดใหญ่ที่มีแบนด์วิธสูงและเวลาแฝงต่ำ
NVIDIA คาดว่าจะมีการนำไปใช้อย่างมากจากผู้สร้างโมเดลระบบคลาวด์รายใหญ่ ในขณะที่บริษัทต่างๆ ยังคงปรับขนาดโมเดล AI รุ่นต่อไป
ชิป Feynman และซีพียูแล็ปท็อป ARM ใกล้จะมาถึงแล้ว
เมื่อมองไปข้างหน้า NVIDIA อาจเปิดตัวซิลิคอนเพิ่มเติมที่ GTC 2026 CEO Jensen Huang ได้บอกเป็นนัยว่าชิปที่ไม่เคยเห็นมาก่อนจะเปิดตัวในงานนี้ โดยมีรายงานทางอุตสาหกรรมชี้ไปที่โปรเซสเซอร์ Feynman AI ที่เป็นไปได้
ในขณะเดียวกัน NVIDIA กำลังเตรียมการกลับไปสู่ซีพียูแล็ปท็อปที่ใช้ชิป N1 ที่ใช้ ARM ซึ่งส่งสัญญาณถึงความทะเยอทะยานที่กว้างกว่า GPU และเครื่องเร่งความเร็วของศูนย์ข้อมูล
ด้วยรายรับที่สูงเป็นประวัติการณ์ การขยายโครงสร้างพื้นฐาน AI และสถาปัตยกรรมใหม่ที่อยู่ระหว่างการพัฒนา NVIDIA ยังคงเปลี่ยนจุดศูนย์ถ่วงไปสู่ AI แม้ว่ากลุ่มเกมจะเผชิญกับความท้าทายในการจัดหาในระยะสั้นก็ตาม
*️⃣ ลิงค์ที่มา:
รายได้จากการเล่นเกมลดลง 13% TechPowerUp ชิปที่ไม่เคยเห็นมาก่อนจะเปิดตัวในงาน โปรเซสเซอร์ Feynman AI ชิป N1 ที่ใช้ ARM