โมเดลนิรนามเผา 26 ล้านล้านโทเคนในสี่วัน แล้วราคาก็ตามมาทีหลัง 24 เซนต์
20 สิงหาคม 2026 โมเดลที่ไม่มีชื่อแล็บ ไม่มีการ์ดโมเดล และไม่มีราคา ปรากฏบน OpenRouter ในชื่อ stealth/ox-alpha สี่วันต่อมา ผู้ใช้ OpenCode ดันโทเคนผ่านมันไปแล้ว 26 ล้านล้านโทเคน หกวันต่อมา Z.AI ออกมารับว่าเป็นของตน คือ GLM-5.3-Flash พารามิเตอร์รวม 320 พันล้าน สัญญาอนุญาต MIT ราคา 0.15 ดอลลาร์ต่อล้านโทเคนขาเข้า ทำไมแล็บถึงปล่อยโมเดลโดยไม่ใส่ชื่อตัวเอง ตัวเลขทราฟฟิกเหล่านั้นวัดอะไรกันแน่ และราคาผสม 24 เซนต์เปลี่ยนเศรษฐศาสตร์ของไปป์ไลน์เสียงอย่างไร
วันที่ 20 สิงหาคม 2026 มีโมเดลหนึ่งปรากฏบน OpenRouter ภายใต้สลัก stealth/ox-alpha ไม่มีชื่อแล็บกำกับ ไม่มีการ์ดโมเดล ไม่มีตารางเบนช์มาร์ก ไม่มีเธรดประกาศ ช่องราคาระบุว่า 0 ดอลลาร์ขาเข้า 0 ดอลลาร์ขาออก สิ่งที่มันมีคือหน้าต่างบริบท 1,048,576 โทเคน รับอินพุตทั้งข้อความ ภาพ และวิดีโอ พร้อมคำอธิบายบรรทัดเดียวเรื่องงานวิศวกรรมซอฟต์แวร์ระยะยาว
สี่วันต่อมา OpenCode แจ้งว่าผู้ใช้ของตนดันโทเคนผ่านมันไปแล้ว 26 ล้านล้านโทเคน
หกวันต่อมา Z.AI ยืนยันกับ Bloomberg ว่าโมเดลนี้เป็นของบริษัท ปล่อยน้ำหนักภายใต้สัญญาอนุญาต MIT และแนบราคามาด้วย สิบห้าเซนต์ต่อล้านโทเคนขาเข้า ห้าสิบเซนต์ต่อล้านโทเคนขาออก ชื่อของมันคือ GLM-5.3-Flash คำว่า "Flash" ในประโยคนั้นแบกน้ำหนักไว้มหาศาล และนั่นคือเหตุผลที่เราเขียนบทความนี้
นี่คือบทวิเคราะห์เชิงความเห็น ไม่ใช่ข่าวเปิดตัว สิ่งที่ตามมาคือไทม์ไลน์หกวันพร้อมตัวเลขทราฟฟิกและข้อสงวนที่จำเป็น ข้อถกเถียงว่าทำไมแล็บถึงปล่อยโมเดลโดยไม่ใส่ชื่อใครมากขึ้นเรื่อย ๆ สเปกและคะแนนจากผู้ประเมินอิสระหลังจากที่ตัวตนถูกเปิดเผยแล้ว รายการชัดเจนของข้ออ้างที่เรายืนยันไม่ได้ และการคำนวณอย่างละเอียดว่าราคาผสม 24 เซนต์ทำอะไรกับต้นทุนการประมวลผลเสียงพูด บทความนี้เป็นภาคต่อโดยตรงของบทเปรียบเทียบก่อนและหลังว่าด้วยการกลับมาของโมเดลรันในเครื่อง และชี้ไปทางเดียวกัน ราคาของปัญญาประดิษฐ์ที่ใช้งานได้จริงยังคงลดลง เร็วกว่าที่แผนพัฒนาผลิตภัณฑ์ส่วนใหญ่ตั้งสมมติฐานไว้
สรุปสั้น:
- ทราฟฟิกเป็นของจริงและทำสถิติใหม่ 26 ล้านล้านโทเคนบน OpenCode ในสี่วัน จากผู้ใช้ไม่ซ้ำ 327,000 ราย และ 11.6 ล้านล้านโทเคนบน OpenRouter ในสามวัน นับเป็นการเปิดตัวโมเดลที่ใหญ่ที่สุดในประวัติศาสตร์ของ OpenRouter เทียบกับสถิติเดิมที่ 4.4 ล้านล้าน
- ตัวตนได้รับการยืนยันจากแหล่งต้นทาง Z.AI แจ้ง Bloomberg เมื่อวันที่ 26 สิงหาคม 2026 ว่า Ox Alpha เป็นโมเดลในตระกูล GLM และหน้าเว็บของ OpenRouter เองก็ระบุแล้วว่าโมเดลลับตัวนี้ "พัฒนาและให้บริการโดย ZAI เปิดเผยว่าคือ ZAI GLM-5.3-Flash"
- ราคาคือประเด็นหลัก พารามิเตอร์รวม 320 พันล้าน โดยทำงานจริง 18 พันล้าน สัญญาอนุญาต MIT ราคา 0.15 ดอลลาร์ขาเข้าและ 0.50 ดอลลาร์ขาออกต่อล้านโทเคน คิดเป็นราคาผสม 0.24 ดอลลาร์ เทียบกับ 10.00 ดอลลาร์ของเรือธงแบบปิดเมื่อหกเดือนก่อน ซึ่งมันทำคะแนนนำอยู่ 12.1 คะแนนบน Intelligence Index ของ Artificial Analysis
เรื่องทั้งหมดตั้งแต่ต้นจนจบใช้เวลาไม่ถึงหนึ่งสัปดาห์ แหล่งข้อมูลอยู่ท้ายบทความ
หกวัน เรียงตามลำดับที่เกิดขึ้นจริง
20 สิงหาคม รายการโมเดลขึ้นบน OpenRouter พร้อมกับปรากฏใน OpenCode ซึ่งเป็นเอเจนต์เขียนโค้ดบนเทอร์มินัลแบบโอเพนซอร์สที่สร้างโดย Dax Raad โดย OpenCode โฆษณาว่าใช้ได้ฟรี แทบไม่จำกัดปริมาณ และไม่เก็บข้อมูลผ่านเส้นทางของตนเอง พร้อมระบุว่าจัดหากำลังให้บริการได้ถึง 100 ล้านล้านโทเคนต่อวัน
21 ถึง 24 สิงหาคม ปริมาณการใช้เพิ่มขึ้นทุกวันไม่มีเว้น เอนด์พอยต์กิจกรรมโมเดลของ OpenRouter บันทึกคำขอ 27.0 ล้านครั้งในวันที่ 21 สิงหาคม 54.4 ล้านครั้งในวันที่ 22 สิงหาคม (เพิ่มขึ้น 101.2 เปอร์เซ็นต์) 63.9 ล้านครั้งในวันที่ 23 สิงหาคม และ 70.3 ล้านครั้งในวันที่ 24 สิงหาคม
24 สิงหาคม OpenCode เผยตัวเลข 26 ล้านล้านโทเคนในสี่วันแรก จากผู้ใช้ไม่ซ้ำ 327,000 ราย และเซสชันที่เสร็จสมบูรณ์ 8,328,244 เซสชัน เฉลี่ย 3.2 ล้านโทเคนต่อเซสชัน และราว 25 เซสชันต่อผู้ใช้หนึ่งคน ตัวเลขนี้ทำให้ Ox Alpha ขึ้นอันดับสองในบรรดาโมเดลที่ OpenCode ติดตาม ตามหลัง DeepSeek V4 Flash ที่ 33 ล้านล้าน และนำหน้า MiMo-V2.5 ของ Xiaomi ที่ 12 ล้านล้าน ส่วน OpenRouter รายงานแยกต่างหากว่ามีโทเคน 11.6 ล้านล้านในสามวันเต็มแรก และเรียกมันว่าการเปิดตัวโมเดลที่ใหญ่ที่สุดในประวัติศาสตร์แพลตฟอร์ม ขณะที่เจ้าของสถิติเดิมทำได้ 4.4 ล้านล้านในกรอบเวลาเปิดตัวเดียวกัน
25 สิงหาคม API โมเดลของ OpenRouter ที่เรียงตามจำนวนโทเคนที่ประมวลผลในสัปดาห์ที่ผ่านมา จัดให้ Ox Alpha อยู่อันดับหนึ่งจาก 558 โมเดลที่ส่งกลับมา นอกแล็บแล้วยังไม่มีใครรู้ว่าใครสร้างมัน
26 สิงหาคม Z.AI ยืนยันกับ Bloomberg ว่า Ox Alpha คือโมเดลใหม่ในตระกูล GLM ของบริษัท น้ำหนักถูกปล่อยในคืนเดียวกันนั้น โพสต์เปิดตัวของบริษัทเองระบุว่าได้ทดสอบ GLM-5.3-Flash แบบนิรนามในชื่อ ox-alpha บน OpenCode และ OpenRouter "เพื่อรวบรวมความเห็นจากผู้ใช้" ส่วนหน้าโมเดลลับบน OpenRouter ก็ถูกแก้ไขเป็นว่าโมเดลนี้ "พัฒนาและให้บริการโดย ZAI เปิดเผยว่าคือ ZAI GLM-5.3-Flash"
ตัวเลขทราฟฟิกเป็นของจริง แต่ไม่ใช่คำตัดสินเรื่องคุณภาพ
ตรงนี้คือจุดที่รายงานข่าวส่วนใหญ่พลาด เราจึงขอระบุให้ชัดว่า 26 ล้านล้านโทเคนวัดอะไร
มันวัดปริมาณงานที่ไหลผ่านเอนด์พอยต์ฟรีที่มีหน้าต่างระดับล้านโทเคน ซึ่งถูกใช้โดยเอเจนต์เขียนโค้ดเป็นหลัก แดชบอร์ดของ OpenCode เองระบุว่าโทเคนขาเข้า 93 เปอร์เซ็นต์ถูกเสิร์ฟจากแคช นั่นคือบริบทของรีโพเดิม ที่ถูกอ่านซ้ำแล้วซ้ำอีกตลอดเซสชันยาว การจัดอันดับที่เรียงตามจำนวนโทเคนที่ประมวลผลย่อมมอบความได้เปรียบเชิงกลไกมหาศาลให้กับโมเดลใดก็ตามที่ฟรีและมีหน้าต่างใหญ่ เพราะโครงเอเจนต์จะป้อนบริบทซ้ำ เรียกเครื่องมือใหม่เมื่อล้มเหลว และส่งเอาต์พุตของเครื่องมือกลับเข้าไปในพรอมป์ต เซสชันยิ่งยาว ตัวเลขก็ยิ่งพองตามการออกแบบ
ตัวเลข 100 ล้านล้านโทเคนต่อวันก็ต้องได้รับการปฏิบัติแบบเดียวกัน นั่นคือ OpenCode อธิบายกำลังการให้บริการรวม ไม่ใช่ปริมาณที่ส่งมอบจริง และไม่ใช่โควตาต่อผู้ใช้ ปริมาณใช้งานจริงเฉลี่ยราว 6.5 ล้านล้านโทเคนต่อวันในสี่วันแรก หรือ 6.5 เปอร์เซ็นต์ของเพดานที่ประกาศไว้ นักวิเคราะห์ Teortaxes ตั้งข้อสังเกตว่าการสร้างโทเคน ขาออก 100 ล้านล้านต่อวันที่ความเร็ว 80 โทเคนต่อวินาที จะต้องใช้ทรัพยากรเทียบเท่า GPU ราว 580,000 ตัว ซึ่งเป็นตัวเลขประเภทที่ควรทำให้คุณถามก่อนว่าเขากำลังนับอะไรอยู่ ก่อนจะส่งต่อ
จำนวนคำขอรายวันจากเอนด์พอยต์กิจกรรมโมเดลของ OpenRouter สแนปช็อตแคชวันที่ 25 สิงหาคม 2026 แพลตฟอร์มอาจปรับแก้ค่าเหล่านี้ภายหลัง
แล้วทราฟฟิกนี้พิสูจน์อะไรจริง ๆ มันพิสูจน์ว่าโมเดลฟรีระดับแนวหน้าที่มีหน้าต่างล้านโทเคน เมื่อถูกวางลงในสองที่ที่เอเจนต์เขียนโค้ดอาศัยอยู่แล้ว จะทำให้อุปสงค์อิ่มตัวภายใน 24 ชั่วโมง นั่นคือผลลัพธ์ของช่องทางกระจาย และผลลัพธ์ของช่องทางกระจายก็คุ้มค่าแก่การศึกษาในตัวมันเอง แต่มันไม่ได้บอกอะไรเลยว่าโมเดลนี้ดีหรือไม่บนรีโพของคุณ
ทำไมแล็บทุกวันนี้ถึงปล่อยโมเดลโดยไม่ใส่ชื่อตัวเอง
ตรงนี้คือจุดหักเห และเราขอทำเครื่องหมายให้ชัด ทุกอย่างข้างบนคือการวัดผล ส่วนที่ตามมาคือการตีความของเรา
การปล่อยแบบนิรนามซื้อสามสิ่งให้แล็บ ซึ่งเป็นสิ่งที่ซื้อด้วยวิธีอื่นไม่ได้ เราขอเรียกชุดสามสิ่งนี้ว่า เงินปันผลจากการไร้ชื่อ
สิ่งแรกคือการประเมินที่สะอาด ทุกการเปิดตัวที่มีชื่อกำกับจะลงจอดในอคติที่มีอยู่ก่อน โมเดลจากแล็บจีนถูกให้คะแนนบนมาตร "ดีเกินคาดสำหรับโมเดลเปิด" ส่วนโมเดลจากแล็บแนวหน้าของสหรัฐถูกให้คะแนนบนมาตร "คุ้มกับราคาที่ขึ้นไหม" ถอดชื่อออก สิ่งเดียวที่เหลือให้นักพัฒนาตอบสนองก็คือเอาต์พุต การประเมินที่กลับมาระหว่างสัปดาห์นิรนามนั้นทำโดยคนที่ไม่รู้เลยว่ากำลังชมโมเดลของใครอยู่ ซึ่งเป็นสิ่งที่แพงที่สุดในการสร้างขึ้นในโลกการตลาด AI และถูกที่สุดถ้าได้มาด้วยการไม่พูดอะไรเลย
สิ่งที่สองคือวงล้อหมุน ความลึกลับ คือ แคมเปญ ไม่มีใครเขียนบทวิเคราะห์เชิงนิติวิทยาศาสตร์ให้กับการอัปเวอร์ชันตามปกติ แต่หนึ่งสัปดาห์ของการเทียบลายนิ้วมือโทเคไนเซอร์ การวิเคราะห์ชั้นการให้บริการ และการคาดเดา กลับผลิตปริมาณการรายงานมหาศาลที่แล็บไม่ต้องจ่ายเงินซื้อ จากนั้นการเปิดเผยตัวตนก็ลงจอดบนผู้ชมที่ลงทุนกับคำตอบไปแล้ว Z.AI ได้ความสนใจฟรีหนึ่งสัปดาห์ ตามด้วยวันเปิดตัวที่มีมุกจบติดมาในตัว
สิ่งที่สามคือข้อมูลการใช้งานในระดับที่เงินซื้อได้ยาก เซสชันเอเจนต์ที่ทำจนจบ 8.3 ล้านเซสชัน จากงานจริงที่รกและมีรูปทรงแบบโปรดักชัน นั่นคือชุดข้อมูลชุดหนึ่ง หน้าเว็บ OpenRouter ของ Ox Alpha ระบุว่าพรอมป์ตและคำตอบถูกผู้ให้บริการเก็บไว้ และ ไม่ ถูกนำไปใช้ฝึกโมเดล เดี๋ยวเราจะกลับมาที่ประเด็นนี้ แต่ลำพังการเก็บไว้ก็ให้รูปแบบความล้มเหลว การกระจายตัวของความหน่วง อัตราความผิดพลาดของการเรียกเครื่องมือ และเส้นโค้งการเสื่อมสมรรถนะบนบริบทยาว ครอบคลุมรีโพจริงหลายแสนแห่ง ชุดทดสอบภายในให้สิ่งเหล่านี้ไม่ได้
บรรทัดเรื่องเงื่อนไขข้อมูลนั้นควรมีหมายเหตุของตัวเอง เพราะมันเป็นสิ่งเดียวที่ผิดปกติอย่างแท้จริงในเรื่องนี้ จากรายการโมเดลลับสิบสี่รายการที่ OpenRouter เปิดมาตั้งแต่เดือนเมษายน 2025 มีสิบสามรายการที่ระบุข้อความทำนองว่า "พรอมป์ตและคำตอบจะถูกผู้ให้บริการบันทึกไว้ และอาจถูกใช้เพื่อปรับปรุงโมเดล" มีเพียง Ox Alpha ที่เขียนต่างออกไปว่า เก็บไว้ แต่ไม่ใช้ฝึกโมเดล คุณจะรู้สึกอุ่นใจกับข้อความนี้หรือไม่ ขึ้นอยู่กับว่าคุณให้น้ำหนักกับข้อความหนึ่งบรรทัดบนหน้าโมเดลของแพลตฟอร์มจัดเส้นทางมากแค่ไหน อย่างน้อยที่สุดมันคือการเลือกโดยตั้งใจ และเป็นครั้งแรกที่รายการโมเดลลับทำแบบนี้
ชื่อรหัสกลายเป็นแนวทางเฉพาะไปแล้ว
นี่ไม่ใช่กลยุทธ์ใหม่ มันคือรูปแบบที่มีประวัติได้รับการยืนยันจากแหล่งต้นทางถึงห้าครั้ง และการรู้ประวัตินี้คือสิ่งที่ทำให้คุณปรับเทียบกรณีถัดไปได้
| ชื่อรหัส | แท้จริงคือ | ผู้ยืนยัน | วันที่ | ระดับหลักฐาน |
|---|---|---|---|---|
| Quasar Alpha | GPT-4.1 สแนปช็อตก่อนเปิดตัวของ OpenAI | บล็อกของ OpenRouter เอง | 14/04/2025 | แหล่งต้นทาง |
| Optimus Alpha | GPT-4.1 สแนปช็อตที่ใกล้ตัวสุดท้ายกว่า | บล็อกของ OpenRouter เอง | 14/04/2025 | แหล่งต้นทาง |
| Horizon Alpha / Horizon Beta | เช็กพอยต์ยุคแรกของ GPT-5 | OpenRouter บทความ "GPT-5 is now live" | 07/08/2025 | แหล่งต้นทาง |
| Sonoma Dusk Alpha / Sonoma Sky Alpha | xAI Grok 4 Fast รุ่นไม่ใช้และใช้การให้เหตุผล | เป็นการอนุมานของชุมชนเท่านั้น | — | มีรายงาน ยังไม่ยืนยัน |
| Hunter Alpha / Healer Alpha | Xiaomi MiMo | ทีม MiMo ของ Xiaomi เอง | 18/03/2026 | แหล่งต้นทาง |
| Owl Alpha | Meituan LongCat-2.0-Preview | บล็อก Meituan และ @Meituan_LongCat | 30/06/2026 | แหล่งต้นทาง |
| Cypher Alpha / Aurora Alpha | ไม่เคยมีการเปิดเผย | — | — | ไม่มี |
| Ox Alpha | Z.AI GLM-5.3-Flash | Z.AI แจ้ง Bloomberg และหน้า OpenRouter ถูกแก้ไข | 26/08/2026 | แหล่งต้นทาง |
ตารางนี้ให้ข้อสรุปสองข้อ ข้อแรก เจ็ดจากสิบสามรายการในอดีตได้รับการยืนยันจากคำแถลงของแหล่งต้นทางในที่สุด ซึ่งเป็นอัตราการคลี่คลายที่ดีกว่าที่คำเล่าลือทั่วไปทำให้เข้าใจมาก และสามในจำนวนนั้นมาจาก แล็บ ไม่ใช่ OpenRouter นี่คือเหตุผลที่การรวบรวมซึ่งเฝ้าดูแค่บล็อกของ OpenRouter จึงนับขาดอยู่เสมอ ข้อสอง เวทีของแนวนี้ย้ายที่แล้ว แถวของปี 2025 คือ OpenAI และ xAI ส่วนแถวของปี 2026 คือ Xiaomi Meituan และ Z.AI แล็บจีนไม่ได้เป็นผู้คิดค้นการปล่อยโมเดลแบบลับ แต่เป็นผู้ทำให้มันกลายเป็นอุตสาหกรรม
สิ่งที่ถูกเปิดเผย พารามิเตอร์รวม 320 พันล้าน ทำงานจริง 18 พันล้าน สัญญาอนุญาต MIT
ทีนี้มาดูสเปก โดยดึงจากการ์ดโมเดลของ Z.AI เอง ไม่ใช่จากบทสรุปของใคร
ผู้เขียนบรรยาย GLM-5.3-Flash ว่าเป็น "โมเดลแรกในตระกูล GLM-5 ที่เป็นมัลติโมดัลโดยกำเนิด" ด้วย พารามิเตอร์รวม 320 พันล้านและพารามิเตอร์ที่ทำงานจริง 18 พันล้าน ในโครงสร้างแบบผสมผู้เชี่ยวชาญ ฝึกบนคลังข้อมูลมัลติโมดัลขนาด 30 ล้านล้านโทเคน สถาปัตยกรรมผสมผสาน sparse attention เข้ากับ linear attention เป็นครั้งแรกในตระกูลนี้ พร้อมเทคนิคที่เปเปอร์เรียกว่า Manifold-Constrained Hyper-Connections หน้าต่างบริบทอยู่ที่ 1,048,576 โทเคน และคำตอบครั้งเดียวยาวได้สูงสุด 131,072 โทเคน ความลึกของการให้เหตุผลเปิดออกมาเป็นพารามิเตอร์ reasoning_effort สามระดับคือ low high และ max โดยค่าเริ่มต้นคือ max ส่วนสัญญาอนุญาตคือ MIT ไม่ใช่สัญญาอนุญาตชุมชนที่ปรับแต่งเองพร้อมเงื่อนไขจำนวนผู้ใช้ แต่เป็น MIT จริง ๆ
คำกล่าวอ้างเรื่องความสามารถของ Z.AI เองควรถูกยกมาแบบตรงตัว เพราะมันสงวนท่าทีกว่าข่าวที่ห้อมล้อมมันมาก โมเดลนี้ "ทำได้เหนือกว่า GLM-5.2 ทั้งบนเบนช์มาร์กและภาระงานจริง ที่ราคาหนึ่งในสิบ ขณะที่ขยับเข้าใกล้ Claude Opus 4.8 บนเบนช์มาร์กด้านการเขียนโค้ดและเอเจนต์" เข้าใกล้ ไม่ใช่เอาชนะ
ในแง่การประเมินอิสระ Artificial Analysis ได้ทดสอบแล้ว GLM-5.3-Flash ทำได้ 57 คะแนนบน Artificial Analysis Intelligence Index เทียบกับค่ามัธยฐาน 29 คะแนนของโมเดลน้ำหนักเปิดที่เทียบเคียงกันได้ การรันชุดประเมินทั้งชุดมีค่าใช้จ่าย API รวม 138.02 ดอลลาร์ เราอ้างตัวเลขนี้เพราะมันคือข้อมูลชิ้นเดียวที่ซื่อสัตย์ที่สุดในบทความทั้งหมด เกี่ยวกับต้นทุนการใช้ปัญญาระดับใกล้แนวหน้าในวันนี้ การประเมินชุดเดียวกันยังชี้จุดอ่อนจริงสองข้อ ที่ความเร็ว 45 โทเคนขาออกต่อวินาที โมเดลนี้ถือว่าช้า และมันสร้างโทเคนไป 150 ล้านโทเคนเพื่อทำดัชนีให้จบ เทียบกับค่ามัธยฐาน 110 ล้าน นั่นแปลว่ามันเยิ่นเย้อ ความเยิ่นเย้อคือใบเรียกเก็บเงิน แม้ราคาต่อโทเคนจะน้อยก็ตาม
ข่าวจริง ๆ คือโมเดลระดับ Flash ทำได้ 57 คะแนน
วางตัวเลขเรียงกัน โดยใช้เกณฑ์ผสมขาเข้าต่อขาออก 3:1 แบบเดียวกับที่ Epoch AI ใช้เปรียบเทียบราคา
| Claude Opus 4.6 Max | Qwen3.8-27B | GLM-5.3-Flash | |
|---|---|---|---|
| วันเปิดตัว | 05/02/2026 | 14/08/2026 | 26/08/2026 |
| น้ำหนัก | ปิด | Apache 2.0 | MIT |
| Intelligence Index | 44.9 | 52.0 | 57 |
| ราคาต่อล้านโทเคนขาเข้า | 5.00 $ | 0.45 $ | 0.15 $ |
| ราคาต่อล้านโทเคนขาออก | 25.00 $ | 3.20 $ | 0.50 $ |
| ราคาผสม (3:1) | 10.00 $ | 1.09 $ | 0.24 $ |
ความยาวแท่งคือราคา ส่วนตัวเลขทางขวาของแต่ละแท่งคือคะแนนความฉลาด ข้อมูลจาก Artificial Analysis และ OpenRouter สืบค้นเมื่อ 31 สิงหาคม 2026
GLM-5.3-Flash ราคาถูกกว่าเรือธงแบบปิดของเดือนกุมภาพันธ์ 42 เท่า และทำคะแนนสูงกว่า 12.1 คะแนนบนดัชนีอิสระตัวเดียวกัน เมื่อเทียบกับโมเดลเปิดขนาด 27B ที่เราเขียนถึงเมื่อสิบวันก่อน มันถูกกว่า 4.6 เท่าและดีกว่า 5 คะแนน ช่องว่างทั้งสองนี้เปิดขึ้นภายในหกเดือน
นี่คือเส้นโค้งเดียวกับที่บทความ Qwen3.8 ของเราวัดจากอีกด้านหนึ่ง ชุดข้อมูลเกณฑ์คงที่ของ Epoch AI ซึ่งตรึงคะแนนเบนช์มาร์กไว้แล้วติดตามโมเดลที่ถูกที่สุดที่ทำคะแนนนั้นได้ พบว่าราคาของสมรรถนะระดับ GPT-4 ลดจาก 37.50 ดอลลาร์ต่อล้านโทเคนในเดือนมีนาคม 2023 เหลือ 0.18 ดอลลาร์ในเดือนกุมภาพันธ์ 2025 หรือถูกลง 208 เท่าใน 23 เดือน GLM-5.3-Flash คือหน้าตาของเส้นโค้งนั้นเมื่อมันไปถึงแนวหน้า ในปัจจุบัน แทนที่จะเป็นแนวหน้าเมื่อสามปีก่อน
และให้สังเกตระดับชั้นของมันด้วย นี่ไม่ใช่เรือธง คำว่า "Flash" ในระบบตั้งชื่อของทุกแล็บหมายถึงรุ่นน้องที่ถูก เร็ว และรองรับปริมาณมาก ของโมเดลที่พวกเขาอยากให้คุณประทับใจจริง ๆ ข้อเท็จจริงที่น่าสนใจไม่ใช่ว่าแล็บจีนออกโมเดลที่แข็งแกร่ง แต่คือรุ่น ราคาประหยัด ตอนนี้ใกล้แนวหน้ามากพอจนการทดสอบแบบเผชิญหน้าโดยไม่รู้ชื่อตลอดหนึ่งสัปดาห์ยังไม่ทำให้ความลับแตกทันที
สี่เรื่องที่เรายืนยันไม่ได้ และขอทำเครื่องหมายไว้
ความตื่นเต้นรอบการเปิดตัวครั้งนี้วิ่งนำหน้าหลักฐานในบางจุดที่เจาะจง ดังนี้
ข้ออ้างที่ว่า Ox Alpha "เหนือกว่า GPT-5.6" ในการทดสอบบริบทระดับล้านโทเคน มาจากบทความของบุคคลที่สาม ไม่ได้มาจากระเบียบวิธีที่เผยแพร่ให้เราตรวจสอบได้ อีกทั้งเป้าเปรียบเทียบของ Z.AI เองคือ Claude Opus 4.8 ไม่ใช่ GPT-5.6 ขอให้ถือว่าการเปรียบเทียบกับ GPT-5.6 เป็นข้ออ้างของชุมชนที่ยังไม่ได้รับการยืนยัน
คะแนน 80 เปอร์เซ็นต์ pass@1 บน DeepSWE ที่ถูกอ้างกันมาก ไม่สามารถเทียบกับตัวเลขเกิน 96 เปอร์เซ็นต์บน SWE-bench Verified ที่มักถูกวางไว้ข้าง ๆ กันในตารางเดียวกัน คนละโครงทดสอบ คนละชุดงาน คนละระดับความยาก ตารางใดก็ตามที่วางทั้งสองไว้ในแถวติดกัน กำลังสร้างการจัดอันดับที่ไม่มีอยู่จริง
ข้ออ้างของ Z.AI ว่าตลอดสัปดาห์ลับนั้นให้บริการบนตัวเร่งความเร็วสัญชาติจีน พร้อมประสิทธิภาพการให้บริการแบบครบวงจรที่ดีขึ้น 3 เท่า และต้นทุนต่อโทเคนเทียบเท่าฮาร์ดแวร์ NVIDIA เป็นคำแถลงของผู้ผลิตและยังไม่ผ่านการตรวจสอบโดยอิสระ หากเป็นจริงมันจะเป็นรายละเอียดที่สำคัญที่สุดในเรื่องนี้ แต่ ณ ตอนนี้มันคือข้ออ้างในเอกสารประชาสัมพันธ์
และช่วงทดลองใช้ฟรีคือการอุดหนุนราคา ไม่ใช่ระดับราคาจริง และมันจบไปแล้ว ราคาปัจจุบันคือ 0.15 และ 0.50 ดอลลาร์ พร้อมส่วนลดโปรโมชัน 50 เปอร์เซ็นต์ที่มีผลถึงเวลา 16:00 UTC ของวันที่ 9 กันยายน 2026 นั่นแปลว่าตัวเลขที่ซื่อสัตย์ในระยะยาวคือตัวเลขที่ไม่รวมส่วนลด และคุณควรตั้งงบประมาณจาก 0.15 / 0.50 ดอลลาร์ ไม่ใช่จากราคาของสัปดาห์นี้
24 เซนต์ทำอะไรกับไปป์ไลน์ที่ถอดเสียงการประชุม แปล และสรุป
ผลิตภัณฑ์ด้านเสียงพูดอ่อนไหวต่อราคาโทเคนเป็นพิเศษ เพราะมันสร้างบทถอดความแล้วอ่านบทนั้นซ้ำอีกหลายครั้ง ทุกขั้นตอนถัดไป ไม่ว่าจะเป็นการเกลาข้อความ การแปล การสรุป หรือการตอบคำถาม ล้วนนำข้อความเดิมกลับเข้าไปใหม่ นี่คือการคำนวณ พร้อมสมมติฐานวางไว้บนโต๊ะทั้งหมด
- เริ่มจากหน่วยงานจริงหนึ่งหน่วย การประชุมสองคนความยาว 60 นาที ที่ความเร็วราว 130 คำต่อนาที จะได้ราว 7,800 คำ เมื่อเพิ่มป้ายชื่อผู้พูดและเวลากำกับ ให้นับบทถอดความเป็น 12,000 โทเคน
- เพิ่มรอบการสรุป ป้อนบทถอดความทั้งฉบับเข้าไป แล้วรับบันทึกที่จัดโครงสร้างแล้วออกมา ขาเข้า 12,000 โทเคน ขาออกราว 800 โทเคน
- เพิ่มการแปลสดเป็นสามภาษาเป้าหมาย แต่ละรอบอ่านบทถอดความและเขียนออกมาในปริมาณใกล้เคียงกัน ขาเข้า 12,000 และขาออก 12,000 สามรอบ
- รวมทั้งการประชุม ขาเข้า 48,000 โทเคน และขาออก 36,800 โทเคน
- ตีราคาสองแบบ ที่ราคา 0.15 / 0.50 ดอลลาร์ของ GLM-5.3-Flash การประชุมนี้มีต้นทุน 2.6 เซนต์ ที่ราคา 5.00 / 25.00 ดอลลาร์ของ Claude Opus 4.6 การประชุมเดียวกันมีต้นทุน 1.16 ดอลลาร์
ส่วนต่าง 45 เท่าบนเสียงเพียงหนึ่งชั่วโมง ไม่ใช่การปรับแต่งรายการค่าใช้จ่ายบรรทัดเดียว มันคือความต่างระหว่างฟีเจอร์ที่คุณต้องคอยวัดปริมาณการใช้อย่างระมัดระวัง กับฟีเจอร์ที่คุณเปิดทิ้งไว้เป็นค่าเริ่มต้น ที่ราคา 1.16 ดอลลาร์ต่อการประชุม การแปลเป็นสามภาษาให้ผู้ใช้ทุกคนคือการตัดสินใจที่ต้องมีคนในฝ่ายการเงินอนุมัติ ที่ราคา 2.6 เซนต์ มันคือช่องติ๊กถูกช่องหนึ่ง
นี่คือส่วนของเรื่องนี้ที่จะอยู่ยืนกว่าชื่อรหัส การปล่อยแบบลับเป็นกลยุทธ์การตลาด และเป็นกลยุทธ์ที่ดีด้วย แต่ข้อเท็จจริงที่คงทนกว่าคือ ระดับราคาประหยัดในไลน์อัปของแล็บขนาดกลางวันนี้ให้ความฉลาด 57 คะแนนที่ราคาผสม 24 เซนต์ พร้อมสัญญาอนุญาต MIT แนบมา เพื่อให้คุณรันเองได้หากวันหนึ่งราคาขยับไปในทิศทางที่ผิด
บทสรุป แนวหน้าไม่ใช่ที่ที่ราคาน่าสนใจอีกต่อไป
ตลอดสามปี คำถามเรื่องการเลือกโมเดลคือ "คุณมีกำลังพอจะอยู่ใกล้แนวหน้าได้แค่ไหน" หกวันของ Ox Alpha ตอบคำถามอีกข้อหนึ่ง นั่นคือตอนนี้มีความสามารถมากแค่ไหนที่นั่งอยู่ ใต้ ระดับเรือธง ถูกตั้งราคาแบบสินค้าโภคภัณฑ์ และถูกปล่อยออกมาโดยแล็บที่มั่นใจพอจะทดสอบมันหลังถอดชื่อตัวเองออก
เงินปันผลจากการไร้ชื่อจะจ่ายก็ต่อเมื่อโมเดลดีพอจะรอดผ่านหนึ่งสัปดาห์ที่ไม่มีแบรนด์ Z.AI เก็บเงินปันผลนั้นไปแล้ว ชื่อรหัสถัดไปที่โผล่บนแพลตฟอร์มจัดเส้นทางก็สมควรได้รับการปฏิบัติแบบเดียวกับที่ Ox Alpha ได้รับ ลองรันมันบนงานของคุณเองก่อนที่ใครจะบอกคุณว่ามันเป็นของใคร เพราะตลอดสัปดาห์นั้น นั่นคือการประเมินที่ซื่อสัตย์เพียงหนึ่งเดียวที่ใครก็ตามจะได้รับ
Telli.sh อยู่ตรงไหนในเรื่องนี้: เส้นโค้งนี้คือเหตุผลที่เราสร้างไปป์ไลน์เสียงของเราบนชั้นผู้ให้บริการเอนจิน แทนที่จะสร้างรอบ API ของผู้ขายรายเดียว Telli.sh จัดเส้นทางการถอดความ การแปล และการสรุปผ่านเอนจินที่สลับเปลี่ยนได้ ดังนั้นทุกก้าวที่ลดลงบนเส้นโค้งราคานี้จึงมาถึงคุณในรูปของบันทึกที่ดีขึ้นในราคาเท่าเดิม ไม่ใช่ในรูปประกาศปรับราคา ส่วนที่ไม่มีการเปิดตัวโมเดลใดทำแทนให้ได้คืองานที่เหลือ การเก็บเสียงหนึ่งชั่วโมงให้ครบโดยไม่ตกหล่น การแยกผู้พูดออกจากกัน การแปลสดข้าม 15 ภาษา และการทิ้งบันทึกที่ไตรมาสหน้าคุณยังค้นเจอ
แหล่งข้อมูล
- หน้าโมเดล
stealth/ox-alphaบน OpenRouter — วันที่ขึ้นรายการ 20 สิงหาคม 2026 บริบทหนึ่งล้านโทเคน และข้อความที่เพิ่มเข้ามายืนยันว่าเป็น ZAI GLM-5.3-Flash สืบค้นเมื่อ 31 สิงหาคม 2026 - หน้าโมเดล
z-ai/glm-5.3-flashบน OpenRouter — ราคาปัจจุบันและช่วงส่วนลดโปรโมชันถึงวันที่ 9 กันยายน 2026 สืบค้นเมื่อ 31 สิงหาคม 2026 - การ์ดโมเดลบน Hugging Face, zai-org/GLM-5.3-Flash — พารามิเตอร์รวม 320 พันล้าน / ทำงานจริง 18 พันล้าน คลังข้อมูลมัลติโมดัล 30 ล้านล้านโทเคน สัญญาอนุญาต MIT ระดับของ
reasoning_effortและข้อความเรื่องการขยับเข้าใกล้ Claude Opus 4.8 - Ox Alpha นิรนามประมวลผล 26 ล้านล้านโทเคนบน OpenCode ทำลายสถิติการเปิดตัวของ OpenRouter — RuntimeWire, 26 สิงหาคม 2026 — 26 ล้านล้านโทเคน ผู้ใช้ 327,000 ราย 8,328,244 เซสชัน ตัวเลขแคช 93 เปอร์เซ็นต์ และสถิติ 11.6 ล้านล้านโทเคนของ OpenRouter
- การใช้งาน สเปก และหลักฐานเรื่องตัวตนของ Ox Alpha — LLM Rumors, 25 สิงหาคม 2026 — จำนวนคำขอรายวันและอันดับหนึ่งจาก 558 โมเดล
- โมเดลลับระดับแนวหน้า Ox Alpha ปรากฏบน OpenRouter และ OpenCode แบบใช้ฟรี — WinBuzzer, 24 สิงหาคม 2026 — ข้ออ้างเรื่องกำลัง 100 ล้านล้านโทเคนต่อวันและการประเมิน GPU ของ Teortaxes
- Z.AI ของจีนคือผู้สร้างโมเดลลับ Ox Alpha ที่สู้กับ DeepSeek — Bloomberg ผ่าน Yahoo Finance, 26 สิงหาคม 2026 — การยืนยันตัวตนจากแหล่งต้นทาง
- โมเดลลับที่เอาชนะ DeepSeek เป็นของ Zhipu — The Next Web — การรายงานการเปิดเผยตัวตนและคำมั่นเรื่องน้ำหนักเปิด
- โมเดลลับของ OpenRouter สุดท้ายแล้วเป็นของใคร — Digital Applied, 22 สิงหาคม 2026 — การสำรวจสิบสี่รายการ วันที่เปิดเผย ระดับหลักฐาน และการเทียบเงื่อนไขข้อมูล
- Artificial Analysis: การวิเคราะห์ความฉลาด สมรรถนะ และราคาของ GLM-5.3-Flash — Intelligence Index 57 ค่าใช้จ่ายในการประเมิน 138.02 ดอลลาร์ 45 โทเคนต่อวินาที และการสร้างโทเคน 150 ล้านโทเคน สืบค้นเมื่อ 31 สิงหาคม 2026
- Epoch AI, "LLM inference prices have fallen rapidly but unequally across tasks", 12 มีนาคม 2025 — บันไดราคาแบบเกณฑ์คงที่ที่อยู่เบื้องหลังตัวเลข 208 เท่า
- บทเปรียบเทียบก่อนและหลังของเราว่าด้วยการกลับมาของโมเดลรันในเครื่อง — ตัวเลขของ Qwen3.8-27B เส้นโค้งราคา และระยะเวลาไล่ตาม