
後“龍蝦”時代,AI辦公賽道正在成爲巨頭們的“兵家必爭之地”。
今年8月以來,一個趨勢愈發明顯——各式“龍蝦類應用”正在告別羣雄割據的“戰國時代”。騰訊、阿裏、字節旗下當初由內部不同團隊“賽馬”推出的龍蝦應用,正在被逐漸集中至WorkBuddy、千問辦公、豆包工作這三個單一品牌。
這三款AI辦公應用“哪家強?”新京報貝殼財經記者從長線程報告撰寫、廣告視頻制作、漫畫生成、錄音總結等多個維度測試發現,三款應用不乏亮眼,但也不可避免地出錯。
其中,豆包工作僅憑一張耳機照片就制作出了大片即時感的廣告視頻,但3D模型生成任務“魔改”了實物照片;千問辦公在長程任務上輸出的報告內容最豐富,卻也“燒錢”到記者不得不充值救場;WorkBuddy開放程度最高,但也有“看走眼”的時候,生成漫畫時把自己的圖標錯認爲是一只“青綠色小豬臉”。
測試結果顯示,AI辦公應用雖然相較年初有所進步,但AI智能體的“幻覺”依舊存在,還沒有哪一款應用能夠實現全方位斷檔領先。
大廠集體“收兵”,三巨頭產品仍有生態壁壘
在兩三個月時間內,大廠們幾乎同步完成了組織與產品收攏。
阿裏最先拉開架勢。8月3日,千問辦公高調開啓公測,阿裏內部傳出消息,已經完成了悟空、MuleRun、QoderWork三支團隊的組織收攏,成立千問辦公事業部。貝殼財經記者注冊千問辦公後不久,就接到多次回訪電話以及短信、釘釘信息,可見阿裏方面對該產品用戶體驗的重視。
8月25日,字節發布豆包工作。在此之前,字節內部也完成了豆包、飛書、火山引擎團隊的合並。ArkClaw、TRAE、扣子、飛書OpenClaw等產品的團隊整體或部分並入豆包工作。9月15日,字節CEO梁汝波現身2026飛書未來無限大會暨豆包工作開工大會,爲飛書與豆包工作首次“合並”亮相站臺。
相比之下,騰訊“穩坐釣魚臺”。WorkBuddy是“龍蝦大戰”目前表現最亮眼的應用,馬化騰在2026Q2騰訊財報致辭中稱其實現了“突破性的用戶增長”。9月24日,騰訊正式關停了原本同WorkBuddy內部“賽馬”的QClaw,據悉QClaw產品中心的相關業務和團隊也已經調整至WorkBuddy所屬部門。
這一集體動作釋放了一個信號:國內大廠逐漸度過了多產品賽馬的探索期,開始收縮資源,爲自家生態尋找一個能夠穩定託底的產品。

從豆包工作、千問辦公、WorkBuddy界面來看,三者差異不大。截圖
貝殼財經記者在測試時發現了生態壁壘,如微信聊天框裏的圖片可以絲滑拖拽到WorkBuddy裏,但無法直接拖動到豆包工作和千問辦公中。在過去一個月,記者在和上述AI應用的產品經理溝通時,對方往往強調自家應用的聯動性,如釘釘之於千問辦公,飛書之於豆包工作,百度網盤之於百度搭子,這一定程度上意味着AI辦公應用目前仍然是大廠們各自生態的延續。
撰寫調研報告:豆包給報告畫插圖,千問寫了5萬字
今年9月起,新京報貝殼財經記者陸續對WorkBuddy、千問辦公、豆包工作三款AI辦公應用進行了一系列任務實測。其中,WorkBuddy執行任務時使用Hy4 preview模型,千問辦公使用Qwen3.87-Max模型,豆包工作使用豆包2.1 Lite0921新版模型,這些模型均爲騰訊、阿裏、字節旗下的最先進模型,確保執行任務的是大廠“原班人馬”。
爲了考驗智能體能力的長程任務,記者分別要求上述三款應用生成一份《2026年AI辦公賽道調研報告》。其中,豆包工作派出了4個“調研子代理”,20分46秒完成了報告撰寫,整體1萬字;WorkBuddy從工作區調取了記者此前工作的歷史記錄,“秒懂”任務,通過21分18秒完成了報告撰寫,整體2.5萬字;千問辦公則最爲嚴謹,在任務開始前以“單選+多選選擇題”的形式與記者確認交付形式、篇幅與深度、報告重心,最終任務過程花費了超過1個小時,成稿5萬字。

從左至右分別爲豆包工作、WorkBuddy、千問辦公生成的調研報告截圖。
從結果來看,三款AI均給出了符合要求的深度調研報告,包括詳細的數據分析、對照口徑以及信源清單等。形式上,豆包工作的報告外觀最爲美觀,不僅制作了表格,還有柱狀圖與能力雷達圖;WorkBuddy提供了不少獨特的觀察角度,比如“用戶不是在選最強AI,而是在選我已有的數據沉澱在哪裏”;而千問辦公則給出了最詳盡,內容最豐富的調研報告,涉及AI辦公應用的月活體量與其母體App存在兩個數量級的落差,以及詳細總結了各個大廠高管對AI辦公應用的態度等。
不過,這份字數最多的報告費用不低。對於該任務,豆包工作消耗了31.91token(詞元),WorkBuddy的消耗也在30token左右,使用贈送的額度就能覆蓋。相比之下,千問辦公的Qwen-3.8Max一口氣消耗了約1800token,幾乎是前者的60倍。由於token消耗過快,記者不得不臨時充值78元,購買一個月會員。
WorkBuddy漫畫生成認錯自家圖標,3D生成打了“翻身仗”
在多模態能力測試中,涉及漫畫、廣告海報、視頻、3D模型的生成能力。
貝殼財經記者將豆包工作、千問辦公、WorkBuddy的桌面圖標分別截圖發給上述AI應用,並輸入提示詞“設計一個漫畫,三個頂着上述圖標的小人在互相打架”。

從左至右分別爲豆包工作、千問辦公、WorkBuddy生成的調研報告截圖。
結果顯示,豆包工作生成了“頂着”圖標的漫畫圖,千問工作和WorkBuddy對記者的意圖理解更透徹,圖標直接化身人物,漫畫更爲形象。不過,WorkBuddy在其他兩家圖標生成無誤的情況下,“認錯”了自己的標志。記者復盤其思考過程發現,WorkBuddy形容自己的圖標是“青綠底白色小豬臉標”,可能因此造成了後續生圖的錯誤。
WorkBuddy生成漫畫的思考過程。截圖
測試中,記者升級了任務要求,通過拍攝一張普通的有線耳機照片,要求三家AI應用將其制作成具有蘋果風格的產品海報,並生成真人模特出鏡廣告片。
根據有線耳機照片生成的廣告海報,從左至右分別爲WorkBuddy、豆包工作、千問辦公生成。
結果顯示,無論是海報還是視頻,依託Seedance系列模型的豆包工作交付結果更有質感。此次測試中,三家AI應用生成的視頻效果存在明顯差異。WorkBuddy的真人模特動作自然,也有分鏡,整個視頻沒有聲音;千問辦公的視頻深諳“產品”是第一要務,鏡頭逐漸推向耳機,但缺少分鏡的變化感;豆包工作則既有光影變化,還有模特手持耳機、插耳機、戴耳機享受音樂的多層次分鏡,且配音不出戲,完成度最高。記者注意到,三個視頻出現同一個硬傷,可能是缺少有線耳機的素材,三款視頻生成的耳機均存在與實物不符的情況。
針對更加考驗能力的3D模型生成測試,貝殼財經記者上傳了四張不同角度的動漫少女手辦照片,要求“制作一個該手辦的3D模型,讓我可以通過瀏覽器直接通過鼠標拖動的方式全視角旋轉。”
左上角是原手辦照片,右上角爲WorkBuddy生成、左下角豆包工作生成、右下角千問辦公生成的3D模型。
豆包工作和千問辦公的3D模型把手辦形象直接壓縮成了粗糙畫風,其中,千問辦公的人物形象比豆包工作更簡陋。WorkBuddy則生成了與原手辦幾乎一樣的3D模型。而在選擇鏡頭的操控感上,豆包工作和WorkBuddy均很自然,千問辦公則出現了一定程度的遲滯感。
記者在實測中發現,當前AI應用能力較今年年初“龍蝦”爆火時明顯提升。面對執行任務時遇到的難題,如電腦環境缺少必需組件,此前“龍蝦”往往無法獨立解決,需求助用戶;而此次實測中,上述AI辦公應用在思考過程中展現出各種“花式解法”。
在一次問診錄音的轉寫任務中,豆包工作遭遇了安全軟件攔截網絡的情況,導致任務難以完成,在尋找解決辦法的過程中,它發現了WorkBuddy在更早前完成的轉錄素材。豆包工作決定“以現有轉錄內容爲基礎生成規範文檔並同步相關情況”。
豆包工作任務執行過程中網絡請求遭攔截情況下的決策過程。截圖
不過,隨着從“龍蝦”遍地到三強收兵,AI辦公賽道正逐漸走出“能不能用”的階段,但幻覺並未消失。在同質化任務下,生態遷移成本、token消耗量等都將成爲用戶選擇的隱性標準,而能力與成本的平衡將決定誰能留住重度用戶。
根據新京報貝殼財經記者從Xsignal獲得的數據,今年8月,AI辦公賽道APP+WEB用戶月活排名前三的應用分別爲WorkBuddy、百度搭子、扣子,這說明前述巨頭整合的效果在短期內尚未完全顯現,未來是“羣雄割據”“三國鼎立”還是有產品能“一統天下”,目前尚未可知。
2026年8月,AI辦公應用APP+WEB端月活躍用戶數量數據一覽。新京報貝殼財經記者 羅亦丹 制作 數據來源:Xsignal
新京報貝殼財經記者杜曉彤 任婉晴 制作 數據來源:Xsignal
記者聯系郵箱:luoyidan@xjbnews.com
新京報貝殼財經首席記者 羅亦丹
編輯 王進雨
相關閱讀
- 涉戒嚴事件 韓國大邱市長被求刑20年2026-10-01
- 中國隊包攬14屆亞運會全部100枚跳水金牌(高畫質大圖)2026-10-01
- 下半年來最強冷空氣來襲 大城市降溫日曆出爐2026-10-01
- 河北邯鄲一文保單位附近公主雕像遭兒童塗鴉,當地回應:系普通景觀設施,已派人清理2026-10-01
- 多景區緊急通知:國慶門票售罄;九寨溝:1日-5日售罄;稻城亞丁:5日前已約滿;故宮博物院:1日-6日約滿;三星堆博物館:1日2026-09-30