作者|Chester
原創首發|藍字計劃
AI圈最近飄着一股極其魔幻的溫差。
新聞頭條裏,鋪天蓋地全是各大硅谷巨頭的“菩薩心腸”:API價格戰打得頭破血流,模型使用成本動輒被腰斬、膝蓋斬,原本昂貴的算力似乎一夜之間就跌成了白菜價。
然而,別以爲這是大模型公司善心大發了。
9月底,OpenAI重新開放了每月200美元的Pro訂閱。套餐失而復得,價格還是那個價格,各檔模型的Token額度卻比之前少了一半。哪怕是符合條件的老用戶,原有用量也只能保留到10月29日,隨後同樣難逃縮水的命運。
甚至有機構算了一筆賬。美國AI行業研究機構SemiAnalysis發現,在特定的Agent工作負載測試下,同樣花200美元買訂閱,使用GPT-6.1 Sol的OpenAI套餐,若按API價格折算實際額度,居然只有使用Opus 5.5的Claude套餐的五分之一左右。
這對一直續費200美元套餐的老用戶來說,簡直是晴天霹靂。每個月準時給OpenAI掏1400塊人民幣,到頭來不僅自己的套餐額度被砍半,跟競爭對手一比,到手的算力更是差了一大截。
偏偏這個時候,OpenAI又順勢推出了每月500美元的更高檔套餐,專門面向那些需要更多用量的用戶。原來的200美元不夠用了,想讓AI繼續踏實幫自己幹活,就得考慮再多掏300美元。
這不擺明了是在把人往500美元會員上趕?
連AI訂閱都開始玩起“殺熟”了,OpenAI到底想幹嘛?
AI真成了“白菜價”
實際上,OpenAI整出這樣的“殺熟”操作,也有它迫不得已的一面。一個現實的大背景是:如今連美國AI廠商,也頂不住壓力開始瘋狂卷價格了。
以最新發布的Claude Haiku 5.5爲例,Anthropic官方給出的API定價極其激進:當提示詞不超過10萬Token時,輸入每百萬Token僅需0.1美元,輸出每百萬Token僅需0.5美元。
跟上一代Haiku 4.5相比,降幅相當徹底:這一檔的輸入和輸出價格直接下調了90%。按Anthropic官方的說法,新模型的平均運行成本比上一代整體縮減了約75%。
更關鍵的是,Anthropic並沒有把這次降價限定在一個只能做簡單問答的殘血小模型上。Haiku 5.5具備1M Token的上下文窗口,最高支持128K輸出,官方還特別突出了它在代碼生成、工具調用、瀏覽器操作以及作爲子Agent時的實測表現。
Anthropic甚至明確指出了一個典型落地場景:讓Haiku 5.5充當主Agent身後的“子Agent”,去批量處理大量簡單繁瑣的雜活。對開發者而言,工作流裏的基礎環節顯然多了一個極具性價比的務實選項。
追溯到今年7月底,OpenAI同樣搞過一輪大幅調價。GPT-5.6 Luna的API輸入價格從每百萬Token 1美元直接砍至0.2美元,暴跌80%;Terra的輸入輸出價格也分別下調了20%。
OpenAI當時的口徑是:隨着模型推理效率提升,單位成本被有效攤薄,因而能夠進一步讓利降低API單價。
再往前看,DeepSeek此前幾輪價格調整已多次成爲行業焦點。2024年末到2025年初,DeepSeek憑借極低成本的模型和極具侵略性的API定價,把“AI模型到底應該賣多少錢”這個問題重新摔在了整個行業面前。
如今,美國頭部大廠也相繼入局。模型能力越來越強,調用單價卻越來越低,開發者自然樂意將更多業務交給AI去跑。
但對廠商來說,單次調用是便宜了,用戶砸過來的工作量卻成倍激增。尤其是Agent類應用,一項任務往往需要反復讀取資料、調取工具,再根據返回結果不斷推理。用戶表面上只發了一條指令,後臺的模型可能已經跑了幾十輪。
如果是通過API調用,這些消耗全都會一筆筆清晰地計入賬單。可訂閱用戶每個月交的只是固定包月費,用戶使喚AI幹的活越多,廠商背地裏承擔的運行成本就越高。
SemiAnalysis曾給出一組估算:訂閱業務只貢獻了Anthropic約10% 的收入,卻佔用了其超過40% 的推理算力。這筆賬雖然針對的是Anthropic,但也徹底挑明了AI會員模式面臨的真實成本壓力。
模型單價下降,絕不等於固定月費能長期兜住用戶無節制上漲的算力消耗。
這樣看來,OpenAI收緊原有額度、推出更貴套餐,背後控制成本、逼迫重度用戶加錢買單的意圖也就一目了然了。
但你真以爲,AI卷到白菜價,普通用戶就穩賺不賠了?
AI公司“偷工減料”,比你想象的狠
AI公司想少補貼一點,辦法可遠不止明面上漲價這一種。會員費可以紋絲不動,但裏面到底裝多少額度、不同模型怎麼扣算力,能暗箱操作的空間多得是。
美國AI行業研究機構SemiAnalysis最近就專門做了一次橫向對比,測了測OpenAI和Anthropic的訂閱服務究竟能讓用戶真正榨出多少算力。
它的測試邏輯很務實:研究人員先對不同訂閱套餐進行實測,統計用戶在特定周期內總共能消耗多少輸入、輸出和緩存Token,再統一按照各家模型對外的API官方單價折算成美元金額。這麼一來,即便訂閱方案沒有明碼標價每個Token多少錢,用戶實際喫到的算力價值,也有了直觀可比的客觀尺度。
測試結果相當懸殊。按SemiAnalysis的測算,在面向日常高頻使用的中檔模型上,Anthropic高級訂閱所能給出的API等價價值,最高達到了OpenAI的5倍以上。
當然,這個對比也有其局限性。不同模型的Token單價本就不同,API折算價值高,並不等同於實際體驗一定能好出5倍。但SemiAnalysis進一步拉出純粹的Token吞吐量對比後,兩家服務之間的額度差距依然十分刺眼。
9月底,OpenAI重新開放每月200美元的Pro訂閱時,新購入的用戶拿到的實際使用額度,已經明顯縮水。與此同時,他們推出了每月500美元的Pro 500套餐,專門面向那些需要更高頻調用的重度羣體。
OpenAI官方幫助頁面也坐實了這次變動:符合條件的老用戶只能把原有額度維持到10月29日,之後同樣會轉入縮水後的新方案。
更耐人尋味的是,新推出的500美元套餐,根據SemiAnalysis當時的實測,能提供的Astra使用量相比舊版200美元套餐只提升了約21%。多掏了足足300美元,換來的額度卻完全不成正比。
這意味着OpenAI正在暗中重構訂閱服務的邊界:每個月肯掏200美元,不再代表可以像以前那樣不限量調用模型;如果想要更充裕的額度和響應速度,用戶只能被推着去買更昂貴的套餐。
搞這種小動作的,還不止OpenAI一家。
今年5月,Anthropic曾將Claude Code部分套餐的5小時使用上限翻倍,並取消了高峯時段對Pro、Max用戶的額度限制。
但到了新一輪模型上線與調價期間,它又轉而通過調配不同模型之間的可用額度比例,暗中把控用戶實際消耗的總算力。
SemiAnalysis在實測中還發現,個別賬號之間甚至出現過多達20% 左右的額度差異;相關廠商隨後向其確認,這屬於小規模推行的A/B測試——盡管報告並未指名道姓點出這家廠商的具體名字。
這在本質上與大家常說的“大數據殺熟”如出一轍:賬單上的數字看似沒變,廠商卻能通過收緊調用頻次上限、暗調模型額度分配,乃至小範圍推行不同的限額策略,悄悄縮水用戶實際能夠調用的服務權益。
對日常偶爾問兩句的普通人來說,這些改動或許毫無察覺;但對每天重度依賴模型寫代碼、跑Agent自動化流程的重度用戶而言,額度松緊直接決定了手頭的生產力會不會半路撂挑子。
賬單上一分沒少扣,能使喚的算力卻無聲無息地縮水了。
問題是,爲什麼各大AI巨頭都在同一時間,步調一致地盯上了這些重度用戶燒掉的算力?
AI訂閱生意,也許沒有賺錢之日
一個根本原因是,這門看似風光的生意,到現在依然很難賺到錢。
據《金融時報》披露的公司內部材料,OpenAI預計在2026年至2030年間,累計現金支出將比收入多出2780億美元。哪怕收入一直在漲,也追不上往外花的錢。
Anthropic同樣面臨盈利質疑。2025年,它的年收入增長到約46億美元,經營虧損卻擴大到約80億美元。投資研究機構New Constructs在10月發布報告,只給它約1500億美元的估值,與外界傳聞其可能尋求的2萬億美元IPO估值相差甚遠。
這家機構質疑的焦點不無道理。收入漲得再快,這家公司到底什麼時候能真正賺到錢?
矛盾就在這裏。模型要持續升級,算力基建要不斷擴張,產品價格卻被競爭對手一路往下壓。大廠既要燒錢把模型做得更強,又得降價搶用戶。靠投資人的錢補貼,能先把生意做大,但很難一直持續下去。
尤其是訂閱模式。用戶每月交的錢是固定的,讓AI幹的活卻越來越多。偶爾閒聊兩句,和每天讓AI寫代碼、查資料、連續工作幾個小時,廠商承擔的推理成本差得很遠。
用戶覺得,既然掏了會員費,物盡其用當然天經地義;廠商卻得盤算,這份包月費夠不夠覆蓋實際消耗的算力。
直接漲會員費,廠商也有顧慮。同行還在打價格戰,用戶隨時可以轉投別家。到時候漲價還賺不了幾個錢,但卻把自己的老客戶給趕走了。
於是,月費不動、額度縮水,再推出更貴的套餐,就成了讓用戶多付錢的另一種辦法。
這才是是“殺熟”最讓人惱火的地方。
老用戶已經按原來的額度安排好了工作,每個月也一分不少地續費。結果價格沒變,額度卻少了一半。想讓手頭的工作繼續跑下去,要麼等額度恢復,要麼再次加錢。
相關閱讀
- 昇輝科技的“多事之秋”2026-10-10
- 暴跌20%、蘋果也崩盤,AI越火PC日子越難過2026-10-10
- 原創 機器人終於有人買了2026-10-09
- 今年的諾獎,AI和專家都猜錯了2026-10-09
- 原創 AI遊戲,大廠權力的遊戲2026-10-09