![]()
#AI大模型 #GPT5.6 #調用量競賽
GPT-5.6攪動硅谷,150萬Token是把雙刃劍
5月25日深夜,AI圈炸了鍋。多名開發者在OpenAI Codex后端日志里撞見了一個不該出現的東西——代號iris-alpha的GPT-5.6,上下文窗口直奔150萬Token。這個數字比GPT-5.5的105萬Token一下拉高了43%。
坦白講,我的第一反應不是震驚,而是困惑——150萬Token到底能干嘛?你把整本《三體》三部曲塞進去它都能讀完,問題是讀完之后的產出,真的比現在好多少?
說實話,上下文窗口的軍備競賽正在變成一場“誰更長”的發布會游戲。GPT-5.5三周前才發,GPT-5.6下個月就要上。這節奏讓我想起智能手機時代的“年更”——不是技術真需要迭代這么快,是市場不允許你停下來。
中國調用量碾壓美國,但贏的是“量”還是“價”?
GPT-5.6泄露的同一天,OpenRouter扔出一組數據更耐人尋味。
【數據】據OpenRouter 2026年5月25日披露,上周(5月18日-24日)全球AI大模型總調用量達28.9萬億Token,環比增長7.4%,連續五周上漲。中國模型周調用量9.22萬億Token(環比+19.89%),美國4.93萬億Token(環比+16.27%),中國連續四周穩居全球首位。DeepSeek-V4-Flash直接登頂單一模型調用量榜首。
這組數據的戲劇性在于——調用量第一的是中國模型,但定價權在誰手里?DeepSeek的價格策略是“極致低價換量”,美國模型則是“高價高毛利”。用互聯網行話講,中國模型在“跑馬圈地”,美國模型在“收割利潤”。
問:GPT-5.6的150萬Token上下文窗口對普通用戶意味著什么?
答:簡單說就是你可以一次性喂給AI一整本書或幾十篇論文,它不需要“翻頁”就能理解全部內容。但實際體驗取決于模型在超長上下文中的“注意力衰減”程度——很多模型聲稱支持百萬Token,但后半截內容的處理質量明顯下降。GPT-5.6能否做到全程高質量,要等實測。
問:中國AI調用量全球第一,說明中國AI更強嗎?
答:不是。調用量高更多反映的是價格優勢和生態覆蓋——DeepSeek等國產模型調用成本極低,吸引大量開發者接入。但技術領先性、高端商業場景、企業付費意愿,目前仍是美國模型占優。數量贏了,質量還在追。
問:大模型上下文窗口競賽會持續多久?
答:我個人覺得150萬Token已經是過度競爭的信號了。絕大多數實際場景(客服、寫作、編程)用不到10萬Token。真正需要百萬級上下文的場景(全庫法律檢索、基因序列分析)非常窄。下一階段競爭會從“窗口長度”轉向“窗口利用效率”。
本文核心觀點摘要
GPT-5.6的150萬Token上下文窗口標志著大模型競爭從參數規模轉向長文本能力
中國AI調用量全球第一的背后是低價策略驅動,技術話語權仍在美國
上下文窗口競賽已現過度競爭跡象,實際應用場景遠未跟上硬件能力
大模型競賽的下半場不是更長,而是更準、更便宜、更好用
來源:【IT之家/新智元/OpenRouter】| 日期:2026-05-25 ~ 2026-05-26
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.