
上周三深夜我那位做Agent工具的朋友發來一張截圖OpenRouter七日用量榜首冒出一個他不認識的模型——Ox Alpha開發者一欄就兩個字stealth。他第一反應是哪家在偷偷上分我讓他別急先去看分詞器指紋。結果我們慢了一步——GitHub上已經有一撥人在干同樣的事把同一段文本喂給不同模型數token切分規律。三條線一對嫌疑迅速收斂到一家中國公司。8月26日晚謎底揭曉智譜向彭博社確認Ox Alpha是GLM系列的最新一代原生多模態模型代號靈感來自近期上映的電影《牛來》。到認領那一刻這款模型在OpenRouter已經吃掉23.2萬億Token是第二名DeepSeek V4-Flash的兩倍多刷新了平臺單模型上線紀錄。這出AI圈盲盒營銷的故事值得拆開看看。盲盒發布為什么突然成了主流打法Ox Alpha不是第一個被匿著名發的大模型但規格明顯更激進104.86萬Token上下文窗口、單次最大輸出13.1萬Token、文本/圖片/視頻三種輸入全支持、工具調用和結構化輸出齊備。最狠的是預覽期完全免費——OpenCode直接宣布接近不限量的調用額度號稱日均100萬億Token服務容量。免費高規格身份成謎這三個要素組合在一起直接把全球開發者的好奇心點燃了。結果就是零營銷情況下六天內沖上榜首。Stripe CEO Patrick Collison親自下場測試在X上評價非常令人印象深刻。廠商為什么越來越愛盲盒發布三個原因第一匿名狀態下模型不會被原廠標簽左右開發者更愿意憑實測投票。第二OpenRouter這類平臺把用量做成了硬榜單誰沖第一誰就拿到全球開發者的注意力。第三免費自來水比一場發布會便宜太多。智譜敢匿名上線本質上就是把被全球開發者實測做成了產品發布的一部分。開源權重反超閉源這次不是口號是真賬單比Ox Alpha是誰更值得關注的是背后那條更粗的曲線。Vercel AI Gateway 8月24日的數據開源權重模型在平臺Token調用占比從4月的11%、6月的28.4%一路沖到8月22日的62%。四個月開源從陪跑變成主流量DeepSeek單家就吃下22.6%。更值得看的是收入側對比6月份開源模型承擔了Vercel 29%的Token用量支出卻只占4%——也就是說開源模型用更低成本完成了更多實際工作。Ramp的企業級數據進一步印證Anthropic Fable 5占企業Token用量6%支出占比卻達11.4%。最貴的模型正在撞上企業預算的天花板。反觀頭部閉源廠商的反應Anthropic取消原定的Sonnet 5漲價永久定在2/10美元OpenAI一個月內兩度降價GPT-5.6 Luna砍掉80%Gemini 3.7 Flash直接半價首發。這些動作背后是同一股壓力。智能溢價模式正在被開源生態一點點撬松。對普通開發者來說這三件事可以馬上看看第一選模型已經從押寶一家變成了按任務配模型。月請求量超1000萬的Vercel團隊平均同時用35個模型——便宜模型跑分類、摘要、批量任務前沿模型負責復雜推理。前提是你有一個統一的調用層去做分發而不是在業務代碼里硬寫死某一家API。第二價格波動正在變成常態路由層比以往更重要。8月17日DeepSeek漲價疊加峰谷定價最高漲幅1100%8月21日OpenAI又把GPT-5.6 Sol輸入輸出降到4/20美元Gemini 3.7 Flash的優惠期到2027年1月才結束。這節奏意味著月底賬單越來越難預測。所以越來越多團隊開始把按任務智能路由緩存命中批處理打包成基礎設施。EasyAPI做的事情就是讓普通團隊不用自己造網關一個Key接入所有主流模型按復雜度自動分發切換只改配置不碰業務代碼。無論是DeepSeek漲價、OpenAI降價還是牛來了這種新模型突然冒出來你都能在第一時間接入并按需切流量而不是跟著每一輪漲跌改代碼。第三Token本身正在變成新資產。武漢算力公共服務平臺3.0上線Token化計量與交易廣東落地全國首個Token貸中國電信宣布內外部日均Token消耗2萬億。這些都不是孤立信號——Token被納入數據要素體系、被寫進銀行授信、被算進運營商財報。一頭牛沖上榜首這件事表面是營銷事件實際是這股大勢的縮影誰能用更聰明的調度把模型送到開發者手里誰就在這場基礎設施重構里握住了位置。最后說回Ox Alpha這次盲盒事件最有意思的一點是智譜沒花一分錢發布會預算僅靠匿名上架免費策略就拿到了OpenRouter榜首和社區免費偵探。這種用調度層代替發布會的玩法和Stripe 80億美元買下OpenRouter、Hugging Face估值沖到130億美元背后是同一股邏輯——分發與路由的價值正在被重新定價。國內團隊想要抄這套打法門檻其實不高。用EasyAPI類輕量路由工具把多模型接入和按任務分發做成可觀測的標準件就能在每一次模型盲盒出現時第一時間接入并按需切流量。也有很多主流大模型可選Ox Alpha這件事告訴我們2026年的AI圈一個模型的口碑越來越不是發布會決定的而是開發者用真金白銀的Token調用量投出來的。你不需要迷信任何一家的最強大模型。你需要的是一個能在不同任務、不同預算、不同時間窗口里幫你把模型用得更聰明的調度層。模型廠商會繼續卷價格會繼續玩盲盒營銷會把單款模型的能力繼續頂高。但對絕大多數普通開發者來說真正的護城河不是押中哪一家而是把調用層這件看似不起眼的事做得足夠扎實而EasyAPI就是幫你把這件事做扎實的那個工具。