lang
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
หน้าแรก
AI
OPRR
ด่วน
ความลึก
กิจกรรม
BlockBeats Pro
เพิ่มเติม
การเงิน
พิเศษ
ระบบนิเวศบล็อกเชน
รายการ
พอดแคสต์
ข้อมูล
BTC
$96,000
5.73%
ETH
$3,521.91
3.97%
HTX
$0.{5}2273
5.23%
SOL
$198.17
3.05%
BNB
$710
3.05%

แบล็คเวลล์ 100,000 ใบฝึกฝน GPT-6 แอสตร้า โมเดลใหญ่จีนขาดพลังคำนวณตรงไหน?

动察 Beating AI ข่าวด่วน ซีอีโอของ NVIDIA เปิดเผยเมื่อเช้านี้ว่า การฝึก GPT-6 Astra ใช้ GPU Grace Blackwell มากกว่า 100,000 ใบ โดยเชื่อมต่อเป็นคลัสเตอร์ความเร็วสูงผ่าน NVLink72 เขายังกล่าวอีกว่า GPU รุ่นถัดไปอีก 400,000 ใบกำลังจะออนไลน์ แต่ไม่ได้ระบุรุ่นหรือเจ้าของที่แน่ชัด


เมื่อใช้ Astra เป็นเกณฑ์มาตรฐาน พลังการประมวลผลที่เปิดเผยต่อสาธารณะของบริษัทโมเดลชั้นนำในจีนยังคงมีช่องว่างที่ชัดเจน ByteDance ใกล้เคียงที่สุดในขณะนี้ โดยปีนี้ได้เชื่อมต่อ B200 ประมาณ 36,000 ใบผ่านมาเลเซีย ชิป这批นี้เป็นรุ่น Blackwell เดียวกับ GB200 ที่ Astra ใช้ แต่การติดตั้งพลังการประมวลผลอยู่ต่างประเทศ เมื่อ ByteDance เปิดเผยคลัสเตอร์ภายในจีนต่อสาธารณะปีนี้ ส่วนใหญ่ยังคงใช้ H20 และ H800 ซึ่งเป็นเวอร์ชันพิเศษสำหรับจีนของสถาปัตยกรรม Hopper


Kimi เพิ่งถูกเปิดเผยว่าได้รับ GPU Hopper ประมาณ 20,000 ใบผ่าน Alibaba แหล่งข่าวจาก Bloomberg ระบุว่าเป็น H200 แต่ Alibaba ปฏิเสธข้อมูลเกี่ยวกับรุ่น H200 H200 เป็นรุ่น Hopper รุ่นก่อนหน้า ขณะที่ B200 อัปเกรดเป็น Blackwell แล้ว ส่วน GB200 ยังรวม Grace CPU และ Blackwell GPU เข้าด้วยกัน โดย NVL72 สามารถใส่ GPU 72 ใบในโดเมนเชื่อมต่อความเร็วสูงเดียวกัน


DeepSeek ยังไม่ได้เปิดเผยฮาร์ดแวร์การฝึกที่สมบูรณ์ของ V4 เอกสารถอดความจากการประชุมนักลงทุนของเหลียง เหวินเฟิงที่รั่วไหลออกมาระบุว่า บริษัทมีพลังการประมวลผลเทียบเท่า H ประมาณ 20,000 ใบในเดือนพฤษภาคม โดยส่วนใหญ่เพิ่งมาถึง และการจัดซื้อครั้งต่อไป "ส่วนใหญ่เป็น NVIDIA" กำลังการผลิต 950 ที่ Huawei ให้ DeepSeek อยู่ที่ประมาณ 16,000 ใบ เหลียง เหวินเฟิงกล่าวว่าชิปในประเทศ这批มีค่าเทียบเท่า GPU ซีรีส์ B ของ Nvidia ประมาณ 4,000 ใบ ซึ่งเพียงพอสำหรับการฝึกโมเดลรุ่นปัจจุบันเท่านั้น


และ Blackwell ที่ Astra ใช้ก็ไม่ใช่รุ่นล่าสุดของ Nvidia อีกต่อไป Vera Rubin เข้าสู่การผลิตเต็มรูปแบบแล้ว NVIDIA ประเมินว่า Rubin ใช้ GPU จำนวนน้อยลงในการฝึกโมเดล MoE ขนาดใหญ่ โดยลดลงได้ถึงหนึ่งในสี่ของ Blackwell


ในข้อมูลสาธารณะ ยังไม่มีบริษัทจีนรายใดเปิดเผยกรณีการใช้ GPU ขั้นสูงรุ่นเดียวกัน 100,000 ใบสำหรับการฝึกโมเดลครั้งเดียว ดังนั้นช่องว่างที่มองเห็นได้ต่อสาธารณะระหว่างบริษัท AI จีนและอเมริกาในตอนนี้ ไม่ได้เป็นเพียงเรื่องจำนวนการ์ด แต่เป็นเรื่องว่าสามารถเข้าถึงการ์ดรุ่นไหนได้ และสามารถรวมการ์ดจำนวนเท่าใดสำหรับโมเดลเดียวในครั้งเดียว

举报 แก้ไข/รายงาน
แก้ไข/รายงาน
ส่ง
เพิ่มคลัง
เห็นได้เฉพาะตัวเอง
สาธารณะ
บันทึก
เลือกคลัง
เพิ่มคลัง
ยกเลิก
เสร็จสิ้น