ชื่อบทความต้นฉบับ: "เส้นสังหารของโมเดลขนาดใหญ่จีน ถูกสังหารแล้ว"
ผู้เขียนต้นฉบับ: Sleepy
วันที่ 8 ตุลาคม Anthropic เปิดตัว Haiku 5.5 สำหรับคำขอสั้นที่ไม่เกิน 100,000 โทเค็น คิดค่าบริการต่อล้านโทเค็นที่ 0.1 ดอลลาร์สำหรับอินพุต และ 0.5 ดอลลาร์สำหรับเอาต์พุต เพียงหนึ่งในสิบของ Haiku 4.5 รุ่นก่อนหน้า
เช้าวันเดียวกัน Haseeb Qureshi หุ้นส่วนผู้จัดการของ Dragonfly โพสต์กราฟกระจายสองภาพของ Artificial Analysis บน X พร้อมคำบรรยายว่า
「If you want the cheapest LLMs, you should now buy American.」
(หากต้องการโมเดลขนาดใหญ่ที่ถูกที่สุด ตอนนี้ควรซื้อของอเมริกาแล้ว)

แกนนอนของกราฟกระจายคือค่าใช้จ่ายในการทำภารกิจมาตรฐานหนึ่งครั้ง แกนตั้งคือคะแนน เส้นประที่เชื่อมจุดที่เหมาะสมที่สุดทั้งหมด ในทางเศรษฐศาสตร์จุลภาคเรียกว่า พาเรโตฟรอนเทียร์ ทุกจุดบนเส้นหมายความว่า ด้วยต้นทุนที่เท่ากัน คุณไม่สามารถหาโมเดลที่ฉลาดกว่าได้
ในกราฟเดือนมิถุนายน ปลายที่ถูกที่สุดของเส้นประ คือ MiMo ของเสียวหมี่, DeepSeek V4 Pro, MiniMax-M3 และ GLM-5.2 ของจื้อผู่ เกือบทั้งหมดเป็นชื่อของโมเดลขนาดใหญ่จีน
พอถึงวันที่ 8 ตุลาคม ทั้งเส้นถูก Anthropic และ OpenAI เข้ายึดครอง โมเดลจีนเหลือเพียง MiMo ที่ยังเกาะขอบได้อย่าง勉强 ส่วน GLM-5.3-Flash ของจื้อผู่ และ DeepSeek V4.1 Flash ถูกผลักลงไปมุมขวาล่างของ Haiku 5.5 หมายความว่าเมื่อเทียบกันแล้ว พวกมันใช้จ่ายมากกว่า แต่ได้คะแนนต่ำกว่า
วันเดียวกันตลาดหุ้นฮ่องกงเปิด หุ้นแนวคิดโมเดลขนาดใหญ่ร่วงลงทันที เมื่อเวลา 10:26 น. MiniMax ขยายการลดลงถึง 10% จื้อผู่ร่วง 5.6% ช่วงเที่ยงดัชนี Hang Seng Tech ร่วง 1.93% สองดาวรุ่งโมเดลขนาดใหญ่Underperform ตลาดเกือบห้าเท่า
สองปีที่ผ่านมา โมเดลโอเพนซอร์สและโมเดลคุ้มค่าของจีน ได้เชื่อมเส้นสังหารให้ตลาดโมเดลขนาดใหญ่ทั่วโลกอย่างแน่นหนา ตราบใดที่กดราคาลงติดดิน โมเดลปิดของต่างประเทศในระดับเน้นปริมาณก็ยากที่จะดำรงอยู่ต่อไป บริษัทดาวเด่นในซิลิคอนแวลลีย์เข้าแถวเปลี่ยนท่อพื้นฐานเป็นโมเดลโอเพนซอร์สจีน
ตอนนี้ โต๊ะถูกพลิกแล้ว
เส้นตายการตัดราคา ถูกตัดราคาจนสิ้นซาก
เมื่อเดือนมีนาคม 2023 ตอนที่ GPT-4 เพิ่งเปิดตัว ราคาอย่างเป็นทางการของเวอร์ชันคอนเท็กซ์ 8K อยู่ที่ 30 ดอลลาร์ต่อล้านโทเคนอินพุต และ 60 ดอลลาร์สำหรับเอาต์พุต
ปัญญาประดิษฐ์หายากสุดขีด อุปทานถูกผูกขาดโดยกลุ่มทุนน้อยรายในซิลิคอนวัลเลย์ ราคาเป็นตลาดของผู้ขายอย่างสมบูรณ์ นั่นคือช่วงฮันนีมูนที่เชื่อว่า "สติปัญญาสามารถคิดราคาพรีเมียมแยกได้"
สิ่งที่ทำลายตำนานนี้คือทีมเทคนิคที่บ่มเพาะโดยกองทุนเฮดจ์ฟันด์เชิงปริมาณของจีน เมื่อวันที่ 6 พฤษภาคม 2024 DeepSeek เปิดตัว V2 พารามิเตอร์รวม 2.36 แสนล้าน แต่เปิดใช้งานเพียง 2.1 หมื่นล้านต่อโทเคน ด้วยสถาปัตยกรรม MLA และการตัดแต่งทางวิศวกรรมอย่างสุดขั้ว ทีมลด KV cache ลงถึง 93.3% และเพิ่มทรูพุตเป็น 5.76 เท่า กำลังประมวลผลที่ประหยัดได้ถูกแปลงเป็นราคาเชิงพาณิชย์โดยตรง ที่ 1 หยวนต่อล้านโทเคนอินพุต และ 2 หยวนสำหรับเอาต์พุต

บริษัทเทคยักษ์ใหญ่ในประเทศแทบจะถูกลากเข้าสู่สงครามราคาแบบบังคับ
วันที่ 15 พฤษภาคม ByteDance ผ่าน Volcano Engine เปิดตัว Doubao โดยโมเดลหลักให้ราคาองค์กรที่ 0.0008 หยวนต่อพันโทเคน อ้างว่าถูกกว่าค่าเฉลี่ยอุตสาหกรรม 99.3% วันที่ 21 พฤษภาคม Alibaba Cloud ประกาศลดราคา Tongyi Qianwen อย่างรุนแรง โดย Qwen-Long คิดราคาอินพุตเพียง 0.5 หยวนต่อล้านโทเคน หลังจากนั้นไม่กี่ชั่วโมง Baidu ประกาศให้โมเดลหลักสองรุ่นของ Wenxin ฟรีทันที
ถึงเดือนสิงหาคม DeepSeek นำเทคโนโลยีแคชฮาร์ดดิสก์มาใช้เพิ่มเติม โดยโทเคนอินพุตที่แคชฮิตคิดเพียง 0.1 หยวนต่อล้านโทเคน
ขณะนั้นที่ฝั่งตรงข้ามมหาสมุทร ยักษ์ใหญ่ไม่ได้ตามทั้งหมด ในเดือนกรกฎาคม 2024 OpenAI เปิดตัว GPT-4o mini โดยลดอินพุตเอาต์พุตเหลือ 0.15 ดอลลาร์และ 0.6 ดอลลาร์ แต่สี่เดือนต่อมา Anthropic เปิดตัว Claude 3.5 Haiku กลับตั้งราคาสูงกว่ารุ่นก่อนถึงสี่เท่า ตรรกะของ Dario Amodei ในตอนนั้นคือ โมเดลฉลาดขึ้น ราคาต้องสะท้อนความก้าวหน้าของสติปัญญา
สิ่งที่ทำให้ซิลิคอนวัลเลย์รู้สึกหนาวเย็นถึงกระดูกจริงๆ คือเดือนมกราคม 2025
DeepSeek-R1 เปิดตัวขึ้นมา ความสามารถในการอนุมานใกล้เคียง OpenAI o1 แต่อินพุตเอาต์พุตเพียง 2.19 ดอลลาร์ต่อล้านโทเคน ขณะที่ตอนนั้น o1 ตั้งราคาไว้ที่ 60 ดอลลาร์
เมื่อวันที่ 27 มกราคม มูลค่าตลาดของ NVIDIA หายไปเกือบ 589 พันล้านดอลลาร์ในวันเดียว สร้างสถิติใหม่ในประวัติศาสตร์ตลาดหุ้นสหรัฐฯ Marc Andreessen เรียกเหตุการณ์นี้ว่าเป็นช่วงเวลาสปุตนิกของวงการ AI ขณะที่ Satya Nadella ซีอีโอของ Microsoft แสดงความเห็นบนแพลตฟอร์มโซเชียลว่า Jevons Paradox กลับมาเกิดผลอีกครั้ง
เส้นแบ่งแห่งการสังหารจึงก่อตัวขึ้นนับจากนั้น
การเปิดน้ำหนักโมเดลทำให้ดาบเล่มนี้ยิ่งคมขึ้น เมื่อเผชิญกับโมเดลปิด ลูกค้าทำได้เพียงคำนวณเลขระหว่างตารางราคาผูกขาดไม่กี่รายการ แต่เมื่อน้ำหนักเปิดออก นักพัฒนาสามารถติดตั้งแบบส่วนตัวบนคลัสเตอร์ของตนเอง หรือรันโมเดลเดียวกันบนคลาวด์อนุมานของบุคคลที่สามรายใดก็ได้ เมื่อโมเดลเดียวกันมีผู้ให้บริการหลายราย และลูกค้ามีทางเลือกในการติดตั้งเองเพิ่มขึ้น พื้นที่สำหรับผู้ให้โมเดลในการรักษาส่วนต่างราคาสูงก็ลดลงตามไปด้วย
บริษัทสัญชาติอเมริกันกลุ่มหนึ่งข้ามแม่น้ำไปก่อนแล้ว
ในเดือนตุลาคม 2025 Brian Chesky ซีอีโอของ Airbnb เปิดเผยต่อสาธารณะว่า Agent บริการลูกค้าอัจฉริยะของบริษัทพึ่งพา Alibaba Qwen อย่างมาก ทั้งระบบจัดสรรโมเดล 13 ตัว แม้จะเชื่อมต่อกับเรือธงรุ่นล่าสุดของ OpenAI ด้วย แต่แทบไม่ถูกเรียกใช้ในสายการผลิตจริง เพราะมีทางเลือกอื่นที่คุ้มค่ากว่า
ในเดือนเดียวกัน Cognition เปิดตัว SWE-1.5 โดยอ้างว่าสร้างบน "ฐานรากโอเพนซอร์สชั้นนำของอุตสาหกรรม" ต่อมา Zhipu ยืนยันว่าฐานรากดังกล่าวคือ GLM-4.6
จากนั้น Martin Casado พาร์ตเนอร์ของ a16z เปิดเผยกับ The Economist ว่า ในบรรดาสตาร์ทอัพ AI สัญชาติอเมริกันที่นำสถาปัตยกรรมโมเดลโอเพนซอร์สมานำเสนอราว 80% ใช้ฐานรากจากจีน
ในเดือนมีนาคมปีนี้ โปรแกรมแก้ไขโค้ด Cursor เปิดตัว Composer 2 ตั้งราคาที่ 0.5 ดอลลาร์ต่ออินพุต 1 ล้านโทเคน และ 2.5 ดอลลาร์ต่อเอาต์พุต ทีมงานยอมรับในที่สุดว่าฐานรากปรับแต่งมาจาก Kimi K2.5 ของ Moonshot AI
นักพัฒนาใช้โค้ดและงบประมาณในการลงคะแนน รายงานที่ Mozilla เผยแพร่แสดงให้เห็นว่าส่วนแบ่งโทเคนของโมเดลเปิดน้ำหนักจากจีนบน OpenRouter เพิ่มขึ้นจากไม่ถึง 2% เมื่อปลายปี 2024 เป็นกว่า 45% ในเดือนเมษายน 2026

ในตำแหน่งทางนิเวศของการเน้นปริมาณและการเรียกใช้แบบมีโครงสร้าง โมเดลปิดที่หยิ่งผยองเคยไม่อาจตอบโต้ได้เลย
การสังหารคู่แข่งไม่ได้หมายความว่าตนเองจะใช้ชีวิตอย่างสง่างามเสมอไป
ในรายงานฉบับเดียวกันของ Mozilla ยังมีข้อมูลเปรียบเทียบอีกชุดหนึ่ง ระหว่างเดือนพฤษภาคมถึงกันยายน 2025 โมเดลเปิดคิดเป็นประมาณสองในสิบของการใช้งานโมเดลบนแพลตฟอร์ม OpenRouter แต่ได้รับรายได้ในชั้นโมเดลเพียงประมาณ 4% นี่เป็นตัวอย่างของแพลตฟอร์มในช่วงเวลาหนึ่ง ซึ่งไม่สามารถเป็นตัวแทนของตลาดโลกได้ แต่ช่องว่างระหว่างส่วนแบ่งการใช้งานกับส่วนแบ่งรายได้นั้นชัดเจนมากแล้ว

การสร้างมูลค่า ไม่เคยเท่ากับการคว้ามูลค่า
ในเดือนมกราคมปีนี้ ZhiPu และ MiniMax ต่างก็เคาะระฆังเข้าตลาดตามกัน จากนั้นผลประกอบการระหว่างกาลที่เปิดเผยออกมาทำให้外界ได้เห็นต้นทุนและขาดทุนที่อยู่เบื้องหลังการเติบโตของรายได้อย่างชัดเจน
ZhiPu มีรายได้ครึ่งปีแรก 954 ล้านหยวน โดยรายได้จากธุรกิจแพลตฟอร์มเปิดและ API อยู่ที่ 825 ล้านหยวน คิดเป็นสัดส่วนถึง 86.5% อัตรากำไรขั้นต้นของธุรกิจนี้พลิกจากติดลบเป็นบวก ขึ้นมาอยู่ที่ 24.6% แต่บริษัทยังคงบันทึกขาดทุนสุทธิประมาณ 2,072 ล้านหยวน ลดลง 12.1% เมื่อเทียบปีต่อปี การขาย token มากขึ้นเริ่มสร้างกำไรขั้นต้น แต่ยังห่างไกลจากการครอบคลุมค่าใช้จ่ายทั้งหมดของบริษัท
MiniMax มีรายได้ครึ่งปีแรกประมาณ 117 ล้านดอลลาร์สหรัฐ เติบโต 283.1% เมื่อเทียบปีต่อปี ขาดทุนสุทธิประมาณ 358 ล้านดอลลาร์สหรัฐ ลดลง 11% เมื่อเทียบปีต่อปี หลังหักค่าตอบแทนด้วยหุ้น การเปลี่ยนแปลงมูลค่ายุติธรรมของหนี้สินทางการเงิน และค่าใช้จ่ายในการเข้าตลาดแล้ว ขาดทุนสุทธิปรับปรุงอยู่ที่ประมาณ 293 ล้านดอลลาร์สหรัฐ ขยายตัว 111.2% เมื่อเทียบปีต่อปี
หลังเข้าตลาดแล้ว การเติบโตที่เกิดจากราคาต่ำต้องผ่านการทดสอบอีกชั้นหนึ่ง นั่นคือแต่ละครั้งที่เรียกใช้งานสามารถเหลือกำไรขั้นต้นได้เท่าไร และกำไรขั้นต้นเหล่านั้นสามารถครอบคลุมค่าใช้จ่ายด้านการวิจัยพัฒนาและการดำเนินงานได้มากน้อยเพียงใด รายได้เติบโตอย่างรวดเร็ว แต่ยังห่างไกลจากความสามารถทำกำไรโดยรวมของบริษัท
ปลายฤดูใบไม้ผลิปีนี้ คลื่น Agent ได้ผลักดันการใช้พลังประมวลผลไปถึงจุดวิกฤต
โครงการโอเพนซอร์ส OpenClaw swept ทั่วชุมชนนักพัฒนาโลก ถึงต้นเดือนมีนาคม การใช้ token สะสมบน OpenRouter ทะลุ 8.52 ล้านล้าน ครองอันดับหนึ่ง ภายในหนึ่งสัปดาห์กลางเดือนมีนาคม โมเดลจีนทำได้ 7.36 ล้านล้าน token ในสัปดาห์เดียว เพิ่มขึ้น 56.9% เมื่อเทียบสัปดาห์ต่อสัปดาห์
GLM-5 ที่เปิดตัวเมื่อวันที่ 12 กุมภาพันธ์เคยขึ้นอันดับหนึ่งของตารางการเรียกใช้งาน ความต้องการที่ทะลักเข้ามาได้ทะลวงโควต้าโครงสร้างพื้นฐานในพริบตา นักพัฒนาต่างประเทศและในประเทศเริ่มบ่นกันอย่างหนักว่า GLM Coding Plan มีความหน่วงระดับวินาทีและการจำกัดอัตราความถี่สูง นี่เป็นครั้งแรกที่ทีม AI ชั้นนำของจีนประกาศขอพลังประมวลผลอย่างเร่งด่วนต่อสาธารณะ
วันที่ 23 กุมภาพันธ์ ราคาหุ้น ZhiPu ร่วงลงเกือบ 23% ในวันเดียว มูลค่าตลาดหายไปกว่า 7 หมื่นล้านดอลลาร์ฮ่องกงภายในหนึ่งวัน
สิ่งที่ตามมาติดๆ คือการขึ้นราคาเชิงป้องกันรอบหนึ่ง
Zhipu ปรับขึ้นค่าบริการเมื่อเปิดตัว GLM-5 และราคาของ GLM-5-Turbo ในเดือนมีนาคมก็ปรับขึ้นอีก 20% โดยรวมแพงกว่ารุ่นก่อนหน้าเฉลี่ย 83%
DeepSeek เปิดตัว V4-Pro เมื่อวันที่ 24 เมษายน ซึ่งมีพารามิเตอร์รวม 1.6 ล้านล้าน และให้ส่วนลดสูงสุด 75% ทันทีที่เปิดตัว ไฟนี้ลุกลามไปยังคู่แข่งก่อน โดย MiniMax ร่วงติดต่อกันสองวันซื้อขายประมาณ 9% และ 10%
แต่พอถึงกลางเดือนสิงหาคม DeepSeek ก็เปลี่ยนไปใช้กลยุทธ์คิดค่าบริการตามช่วงเวลา โดย V4-Pro ในช่วงพีคเอาต์พุตพุ่งขึ้นเป็น 3.96 ดอลลาร์ต่อล้านโทเคน และต้นทุนการแคชที่ตรงเป้ามีต้นทุนเพิ่มขึ้นกว่า 12 เท่า
ในเดือนกรกฎาคม Moonshot เปิดตัว Kimi K3 โดยตั้งราคา API สูงขึ้นเป็น 3 ดอลลาร์ต่อล้านอินพุต และ 15 ดอลลาร์ต่อเอาต์พุต แพงกว่า K2.6 ถึงสามเท่าตัว
แต่ที่น่าแปลกคือ การขึ้นราคากลับไม่ได้ทำให้ลูกค้าหลุดมือไปอย่างรุนแรง
CEO ของ Zhipu อย่าง Zhang Peng เปิดเผยต่อสาธารณะว่า หลังจากปรับราคาขึ้น 83% ในไตรมาสแรก ปริมาณการเรียกใช้ API กลับพุ่งขึ้นถึง 400% ภายในสิ้นเดือนสิงหาคม รายได้ต่อปีของแพลตฟอร์ม MaaS ของ Zhipu พุ่งสูงถึง 1.6 พันล้านดอลลาร์ และอัตรากำไรขั้นต้นของธุรกิจ API พลิกเป็นบวกได้อย่างน่าอัศจรรย์ที่ 24.6%
ในช่วงหลายเดือนที่พลังประมวลผลมีความต้องการเกินอุปทาน ทีมโมเดลจีนได้สัมผัสกับอำนาจในการกำหนดราคาอันล้ำค่าที่หาได้ยากเป็นครั้งแรก
อย่างไรก็ตาม เส้นตัดขาดที่เคยทำให้ยักษ์ใหญ่ต่างประเทศนอนไม่หลับ ก็ถูกพวกมันเองดันให้สูงขึ้นโดยไม่รู้ตัวเช่นกัน
อีกฟากมหาสมุทรได้เปลี่ยนทิศทางกลยุทธ์เสร็จสิ้นในฤดูร้อน
ปลายเดือนมิถุนายน Anthropic เปิดตัว Sonnet 5 โดยตั้งราคาโปรโมชันเปิดตัวที่ 2 ดอลลาร์ต่อล้านอินพุต และ 10 ดอลลาร์ต่อเอาต์พุต ซึ่งเดิมประกาศชัดเจนว่าจะกลับไปเป็น 3 ดอลลาร์และ 15 ดอลลาร์ในเดือนกันยายน
พอถึงเดือนกรกฎาคม OpenAI เปิดตัวซีรีส์ GPT-5.6 และสามสัปดาห์ต่อมาก็เปิดสงครามสายฟ้าอย่างกระทันหัน โดยราคา Luna ลดลง 80% ฝั่งอินพุตตกลงเหลือ 0.2 ดอลลาร์ และฝั่งเอาต์พุตเหลือ 1.2 ดอลลาร์

OpenAI ให้เครดิตการลดราคาครั้งนี้กับวิศวกรรมพื้นฐานที่ถูกเขียนใหม่ทั้งหมด โดย GPU kernel ที่เขียนใหม่ช่วยลดต้นทุนการให้บริการแบบ end-to-end ลงได้ประมาณ 20% และโมเดลร่าง speculative decoding ที่ฝึกใหม่ช่วยเพิ่มความเร็วในการสร้าง吞吐 ได้มากกว่า 15%
วันที่ 10 สิงหาคม Anthropic ถอนประกาศขึ้นราคา และประกาศว่า Sonnet 5 จะล็อกราคาต่ำไว้อย่างถาวร
วันที่ 22 กันยายน Anthropic เปิดตัว Opus 5.5 โดยลดต้นทุนการใช้งานรวมลง 40% ในวันเดียวกัน OpenAI เปิดตัว GPT-6 Sol และ Luna โดย Luna ล็อกราคาเริ่มต้นไว้ที่อินพุต 0.1 ดอลลาร์ เอาต์พุต 0.5 ดอลลาร์ ต่อจากนั้นที่เปิดตัวตามมาคือ Haiku 5.5
สองปีก่อน Anthropic ที่เชื่อมั่นว่า "ความฉลาดต้องได้รับค่าพรีเมียมแยกต่างหาก" ได้ฉีกป้ายของตัวเองทิ้งด้วยมือตัวเอง
ตอนนี้สำนวนที่ใช้ตอนเปิดตัวโมเดลใหญ่ก็เปลี่ยนไปแล้ว ไม่ใช่การไล่เรียงชัยชนะเพียงเล็กน้อยบน MMLU อย่างเดียวอีกต่อไป พวกเขาเริ่มเน้นย้ำซ้ำ ๆ ถึงผลผลิตต่อหน่วยดอลลาร์ ความหน่วง และประสิทธิภาพทางวิศวกรรมของการใช้เหตุผลในแต่ละขั้น
และในขณะที่ Haiku 5.5 เปิดตัว Anthropic ประกาศแจกเครดิต API ให้ผู้ใช้แบบสมัครสมาชิกอย่างเต็มรูปแบบ ระดับ Max ได้รับฟรีเดือนละ 100 ถึง 200 ดอลลาร์ ผู้ใช้ระดับองค์กร Team ได้รับส่วนลดสูงสุด 500 ดอลลาร์
ท่านี้แทงเข้าจุดตายโดยตรง ส่วนลดบนตารางราคามีผลต่อการตัดสินใจเรียกใช้เพียงครั้งเดียว แต่เมื่อวิศวกรรมโค้ดและการจัดวาง Agent ของลูกค้าปรับให้เข้ากันเสร็จแล้ว กำแพงที่ขวางการย้ายระบบจะสูงราวกับกำแพงเมือง
ยักษ์ใหญ่สหรัฐฯ กล้าเปิดสงครามราคาครั้งนี้ เพราะอาศัยบ่อเงินที่ลึกจนหยั่งไม่ถึงและอภิสิทธิ์ในห่วงโซ่อุปทาน
รายได้ดำเนินงานแบบ annualized ของ Anthropic พุ่งจากประมาณ 9 พันล้านดอลลาร์ช่วงปลายปี 2025 ไปสู่กว่า 6.5 หมื่นล้านดอลลาร์ภายในสิ้นเดือนกรกฎาคมปีนี้ การระดมทุนมูลค่าสูงถึง 6.5 หมื่นล้านดอลลาร์ที่เสร็จสิ้นในเดือนพฤษภาคม ดันมูลค่าบริษัทขึ้นไปแตะ 9.65 แสนล้านดอลลาร์โดยตรง
ในด้านพลังประมวลผล Anthropic ประกาศในเดือนเมษายนว่าจะขยายความร่วมมือกับ Google และ Broadcom เพื่อให้ได้ความจุพลังประมวลผล TPU รุ่นถัดไประดับหลายกิกะวัตต์ คาดว่าจะเริ่มเปิดให้บริการต่อเนื่องตั้งแต่ปี 2027 เป็นต้นไป
ในทางตรงกันข้าม Zhipu ระดมทุนได้อย่างยากลำบากกว่า 7 หมื่นล้านดอลลาร์ฮ่องกงตลอดทั้งปีผ่านการจัดสรรหุ้นและการแปลงหุ้นกู้ เมื่อแปลงเป็นดอลลาร์สหรัฐฯ แล้ว ไม่ถึงหนึ่งในเจ็ดของกระสุนระดมทุนรอบเดียวของ Anthropic
คนที่จ่ายไหว ยังคงมีแต่ยักษ์ใหญ่ระดับซูเปอร์เท่านั้น
การชำระบัญชีในตลาดรองไม่เคยปรานีใคร
Zhipu เข้าจดทะเบียนในตลาดหุ้นฮ่องกงเมื่อวันที่ 8 มกราคม ที่ราคาเสนอขาย 116.2 ดอลลาร์ฮ่องกง ภาวะขาดแคลนพลังประมวลผลในฤดูใบไม้ผลิไม่อาจหยุดความคลั่งของฝ่ายซื้อ วันที่ 22 มิถุนายน ราคาหุ้นพุ่งขึ้นแตะ 2,980 ดอลลาร์ฮ่องกง มูลค่าตลาดเคยแตะเพดาน 1.33 ล้านล้านดอลลาร์ฮ่องกง
จากนั้นคือการร่วงลงอย่างยาวนาน
ในเดือนกรกฎาคม หุ้นที่ถูกจำกัดการขายครบกำหนดปลดล็อก การจัดสรรหุ้นสองรอบได้กดราคาเสนอขายเพิ่มทุนจาก 1,588 ดอลลาร์ฮ่องกงลงมาที่ 714 ดอลลาร์ฮ่องกง วันที่ 16 กรกฎาคม หนึ่งวันหลังจาก Kimi K3 เปิดตัว Zhihu ร่วงลง 28.48% ตลอดทั้งวัน วันที่ 22 กันยายน Opus 5.5 และ GPT-6 เปิดตัวพร้อมกัน Zhihu ร่วงลงอีกครั้งเกิน 10%
วันที่ 25 กันยายน Zhihu แตะจุดต่ำสุดระหว่างวันที่ 610.5 ดอลลาร์ฮ่องกง มูลค่าตลาดรวมหดตัวเหลือประมาณ 3 แสนล้านดอลลาร์ฮ่องกง ถอยกลับจากจุดสูงสุดในประวัติศาสตร์เกือบ 80%
เส้นทางของ MiniMax ก็เลวร้ายไม่แพ้กัน ร่วงลงจากจุดสูงสุด 1,330 ดอลลาร์ฮ่องกง ในวันปลดล็อกหุ้นร่วงหนัก 17.98% กลางเดือนกรกฎาคมปิดที่ 216 ดอลลาร์ฮ่องกง รายได้เกือบ 60% ในครึ่งปีแรกพึ่งพาลูกค้าต่างประเทศ และต่างประเทศก็คือสมรภูมิที่ถูกพายุลดราคาของยักษ์ใหญ่สหรัฐฯ ถล่มก่อนใคร
เกณฑ์การประเมินมูลค่าก็เริ่มตึงตัวขึ้นเช่นกัน ตามที่สื่ออ้างอิง ในรายงานวิจัยเดือนกันยายนของ Jefferies ได้ปรับลดตัวคูณประเมินมูลค่าจากรายได้คาดการณ์รายปี 2026 ที่สอดคล้องกับธุรกิจคลาวด์ของ Zhihu จาก 50 เท่าลงเหลือ 30 เท่า ลดลง 40%
โมเดลจีนเคยฉกชิงอาหารจากปากเสือของยักษ์ใหญ่ด้วยความคุ้มค่าระดับสุดขั้ว และตอนนี้ เส้นทางนี้ก็พิชิตได้แล้วที่อีกฟากมหาสมุทรเช่นกัน นักพัฒนามาเพราะถูก นักพัฒนาก็ย่อมจากไปเพราะถูกกว่า
วันที่ 25 สิงหาคม 2006 Jeff Barr นั่งอยู่ริมชายหาดอันร้อนระอุที่ Cabo San Lucas ประเทศเม็กซิโก พิมพ์บทความแนะนำ Amazon EC2 เวอร์ชันทดสอบ
ในตอนท้ายของคำอธิบายทางเทคนิค เขาได้เขียนตัวเลขที่ถูกจารึกไว้ในประวัติศาสตร์ธุรกิจ นั่นคือ นักพัฒนาเช่าเครื่องคอมพิวเตอร์เสมือนหนึ่งเครื่อง คิดค่าบริการ 0.1 ดอลลาร์ต่อชั่วโมง
เรื่องราวหลังจากนั้นใครๆ ก็รู้ AWS ลดราคาลงอย่างต่อเนื่องกว่า百余ครั้งในทศวรรษถัดมา ปี 2014 เพียงอัตราค่าบริการจัดเก็บ S3 ก็ลดลงครึ่งหนึ่ง 51%
คลาวด์คอมพิวติ้งไม่เคยสร้างอาณาจักรด้วยการขายพลังประมวลผลเดียวกันในราคาแพงขึ้นเรื่อยๆ ทุกกำไรส่วนเพิ่มที่ขูดรีดได้จากขนาด ชิปที่พัฒนาขึ้นเองในระดับพื้นฐาน และการดำเนินงานที่เหนือชั้น ถูกป้อนกลับสู่ตลาดปลายทางอย่างไม่ขาดสาย จึงดึงดูดนักพัฒนาได้มากขึ้น AWS ที่ลดราคาต่อเนื่องในที่สุดเติบโตเป็นวัวนมเงินสดที่มีรายได้ต่อปีเกือบ 1.3 แสนล้านดอลลาร์สหรัฐฯ และอัตรากำไรจากการดำเนินงานสูงถึง 35.4%

สงครามราคา คือกลยุทธ์ปิดล้อมสุดท้ายของผู้ผูกขาดจากขนาด
คนที่สามารถกดราคาโมเดลลงเหลือหนึ่งในสิบ เปิดตัวแล้ววางขายบนชั้นวางคลาวด์สาธารณะสามเจ้าใหญ่ทั่วโลกได้ทันทีในวันนี้ ไม่ได้แค่ขาย token แต่กำลังย่อย token ด้วย Anthropic ด้านหนึ่งล้างราคา API อย่างดุเดือด อีกด้านหนึ่งใช้พลังประมวลผลอนุมานมหาศาลป้อนกลับให้ Claude Code, Cowork และผลิตภัณฑ์ Agent แบบครบวงจรของตัวเอง
ทีมโมเดลขนาดใหญ่ของจีนยังไม่ยอมวางอาวุธ ในเดือนกันยายน DeepSeek ปรับลดค่าบริการซีรีส์ Flash อีกครั้ง เสี่ยวหมี่ดัน MiMo-Flash ไปสู่ขีดจำกัด 1 หยวนต่อล้านโทเค็น ขณะที่ Zhipu ก็ตั้งราคา GLM-5.3-Flash ให้อยู่ในช่วงกำไรบางเฉียบ แต่กฎของชิปบนโต๊ะพนันได้เปลี่ยนไปแล้ว
ราคาถูกเพียงอย่างเดียว ไม่ใช่คูน้ำป้องกันธุรกิจแบบเอกสิทธิ์อีกต่อไป
บนแผนภาพกระจายที่ Artificial Analysis อัปเดตแบบเรียลไทม์ ชื่อบริษัทจีนไม่ขาดหายไปแม้แต่รายเดียว GLM, DeepSeek, Kimi, Qwen, MiniMax ยังคงอยู่ครบ
เพียงแต่ตอนนี้ พวกมันลากเส้นตัดขาดนั้นไม่ได้อีกแล้ว



ลิงก์ต้นฉบับ
ยินดีต้อนรับสู่ชุมชนทางการของ BlockBeats:
กลุ่ม Telegram สมัครสมาชิก: https://t.me/theblockbeats
กลุ่ม Telegram พูดคุย: https://t.me/BlockBeats_App
บัญชี Twitter ทางการ: https://twitter.com/BlockBeatsAsia