Nvidia เปิดเผยเบนช์มาร์กจากบุคคลที่สามครั้งแรกสำหรับแร็ก LPX ที่ใช้ LPU Groq 3 โดยแสดงผลราว ~3,400 tok/s ในการทดสอบ Gemma 4 31B ที่มีคอนเท็กซ์ 100k และวางกรอบว่าเป็นความได้เปรียบด้านความเร็วการทำอินเฟอเรนซ์อย่างมีนัยสำคัญเมื่อเทียบกับทางเลือกอื่น ๆ ผลลัพธ์ดังกล่าวช่วยยืนยันความถูกต้องของการเข้าซื้อกิจการ Groq ครั้งใหญ่ของ Nvidia และกลยุทธ์อินเฟอเรนซ์แบบผสมผสาน GPU+LPU ของบริษัท ซึ่งสนับสนุนความเชื่อมั่นต่อการสร้างความแตกต่างของแพลตฟอร์ม AI สำหรับดาต้าเซ็นเตอร์ แม้ยังมีคำถามเกี่ยวกับการสเกลไปสู่โมเดล MoE ขนาดใหญ่ขึ้นและรอบการรีเฟรชของคู่แข่ง
สินทรัพย์ที่ได้รับผลกระทบ
ข้อมูลเชิงลึกจาก AI · NCSKNVDA2USD/USDTข้อมูลเชิงลึกจาก AI
▲ ขาขึ้น
⚠️ ข้อความเชิงลึกนี้สร้างขึ้นโดย AI โดยอ้างอิงจากเนื้อหาข่าวเพื่อใช้เป็นข้อมูลอ้างอิงเท่านั้น ไม่ถือเป็นคำแนะนำในการลงทุนหรือสะท้อนทัศนะของ BingX การลงทุนมีความเสี่ยง โปรดซื้อขายด้วยความระมัดระวัง
Nvidia เปิดเผยผลเบนช์มาร์กชุดแรกของแร็ก LPX ที่ใช้ Groq 3 โดยระบุว่าให้ความเร็วที่เหนือกว่าอย่างมีนัยสำคัญ แม้ LPU แต่ละตัวมีหน่วยความจำเพียง 500 MB แต่โมเดลแบบ dense ขนาด 31B พารามิเตอร์สามารถบรรจุได้ครบในแร็กเดียว ซึ่งมีขนาดใกล้เคียงกับจำนวนพารามิเตอร์ที่ถูกใช้งานจริงของโมเดลขนาดใหญ่อย่าง DeepSeek V3 การเปิดเผยครั้งนี้ถูกมองว่าเป็นการตอกย้ำคุณค่าทางยุทธศาสตร์ของดีลเข้าซื้อเทคโนโลยี Groq มูลค่า 20B