VentureBeat調查發現企業AI代理編排集中於模型平台,但多數部署仍只是聊天機器人外殼
重點速覽
- •Anthropic的Claude是40%受訪企業的主要代理編排平台,超過次近競爭對手Microsoft(18%)份額的兩倍以上。
- •儘管編排策略野心勃勃,71%的企業承認其已部署的代理中只有四分之一或更少是真正的多步驟編排工作流,其餘僅為單一提示的聊天機器人外殼。
- •供應商鎖定是企業對供應商駐留代理控制的最大顧慮,35%的受訪者如此表示,促使51%預期在2026年底前採用混合控制平面。
- •68%的受訪組織計劃在十二個月內採用、新增或更換其編排平台,代表VentureBeat追蹤的任何技術層中最高的轉換意圖。
- •超過四分之一的企業缺乏任何即時的程式化方法來在成本產生前阻止失控的代理token支出,凸顯財務管控在很大程度上仍是被動的。

企業AI代理編排——即協調多步驟工作流,串接模型呼叫、工具使用與自主決策——正快速向模型供應商平台集中,其中Anthropic的Claude以大幅優勢領先。根據VentureBeat Pulse Research針對101家企業的調查,受訪者表示他們選擇編排平台的主要原因在於底層模型的實力與吸引力,並主要以可靠的多步驟執行來評判成功與否。
然而,企業部署的現實遠遠落後於這一野心。大多數已部署的「代理」仍然是聊天機器人外殼,而非真正的編排工作流。企業也預期代理控制平面將刻意保持混合模式,以避免供應商鎖定,而對於token消耗的即時預算控制仍不常見。
本次VentureBeat Pulse Research調查從多個維度審視了企業代理編排:企業使用哪些平台、平台選擇的驅動因素為何、他們優先考量的成功指標是什麼、預期代理控制如何結構化、已部署的「代理」實際編排程度如何,以及他們對運行成本的控制有多嚴格。
核心發現是編排野心與編排現實之間存在顯著落差。企業正快速向主要模型平台集中。Anthropic的Claude是40%受訪者的主要平台,超過任何對手份額的兩倍以上,其次是Microsoft的18%和OpenAI的13%。平台選擇受到「模型引力」驅動——即與前沿基礎模型的原生對齊——21%的受訪者如此表示。成功以可靠的多步驟執行來衡量,任務完成可靠性為32%,多步驟工作流管理為28%。
然而,當被要求直接評估其產品組合時,71%的企業表示,其已部署的「代理」中只有四分之一或更少是真正的多步驟編排工作流,而非單一提示的聊天機器人外殼。僅有10%表示超過半數的已部署代理已跨過這一門檻。實際上,編排層的建設超前於它旨在管理的編排產品組合。
這一落差正在影響企業架構。到2026年底,51%的受訪者預期將採用混合控制平面,結合供應商原生能力與外部編排。僅有6%預期將控制權完全交給供應商管理的服務。供應商鎖定被35%的受訪者引用為企業最大的顧慮——如果代理控制權存在於模型供應商內部——這一顧慮與早期企業技術採用週期中廣為記錄的鎖定模式相呼應,包括雲端基礎設施和關聯式資料庫,在這些場景中,一旦工作負載與單一供應商深度整合,遷移成本便急劇上升。投資緊隨建設腳步:代理工作流工具以34%領先預期支出成長,其次是安全與權限執行的25%。財務管控仍落後於曲線,27%的企業表示他們沒有即時方式在帳單到達前阻止失控的代理。
方法論
VentureBeat作為其持續進行的Pulse Research系列的一部分進行了這項調查,本次工具聚焦於企業代理編排。回應被篩選為擁有100名或以上員工的組織,從2026年6月的單一調查波次中獲得101名受訪者。由於這是單一波次而非多月合併樣本,報告以橫截面方式呈現,不推斷月度間趨勢。
樣本分佈在企業規模區間中。擁有100–499名員工、2,500–9,999名員工、以及50,000名或以上員工的組織各佔樣本的21%。擁有10,000–49,999名員工和500–2,499名員工的組織各佔19%。
受訪者基礎資深且具採購決策影響力。產品和專案經理佔15%,CIO/CTO/CISO角色佔13%,顧問和顧問佔13%,另有資料、AI和工程總監及副總裁。「其他」職能佔18%。在採購權限方面,81%的受訪者是AI解方案的推薦者、影響者或最終決策者,其中66%為推薦者或影響者,15%為最終決策者。科技/軟體是最大的產業,佔44%,其次是金融服務的17%和醫療/生命科學的8%。
VentureBeat表示,101名受訪者的樣本規模足以有合理信心進行方向性解讀,同時指出該樣本仍為自選性質,並非機率樣本。
發現1:編排運行於模型供應商平台
Anthropic的Claude領先,開源框架仍處邊緣地位
VentureBeat詢問企業目前主要使用哪個代理編排平台。回應集中在主要模型供應商,尤其是Anthropic。
報告提醒應謹慎解讀這些數據。受訪者為自選性質,且問題要求選擇單一主要平台。因此,數字衡量的是在自選的AI活躍技術決策者群體中,哪個平台在每家企業的部署中領先。VentureBeat表示,這樣的樣本可能與支出加權的市場衡量指標存在實質差異,且每份VB Pulse調查都有各自的樣本和公司規模組合。因此,平台份額應被視為這一群體目前將主要編排序注下在何處的視角,而非市場份額。
模型平台主導了當前的部署格局。Anthropic、Microsoft、OpenAI、Google和Amazon合計佔約80%的部署,即101名受訪者中的81名。開源框架如LangChain/LangGraph(用於構建LLM驅動應用的開源工具包,在開發者社群中廣泛使用,但尚未將這種關注度轉化為企業生產份額)和自訂內部建構仍為個位數。Anthropic的40%份額,超過次一平台的兩倍以上,與第二項發現中描述的「模型引力」選擇邏輯一致:企業正在選擇附帶他們想要構建的模型的編排層。正如VentureBeat先前代理安全調查波次中的安全供應商一樣,在技術圈中定義品類的工具尚未成為企業部署集中的地方。一小部分3%表示他們根本沒有在進行編排。
受訪者對所使用平台的整體評分為5分中的3.94分(109人回答該評分問題)。「性價比」同樣為3.94分,而「實施便捷性」是最弱的分數,為3.85分。VentureBeat表示,這將編排置於其五項追蹤滿意度範圍的近底部,僅領先於評估工具。一個略低於5分中4分的評分,來自其中96%計劃在年內改變編排方法的用戶,暗示著暫時性的接受:平台足以應付當前使用,但還不夠好到可以停止尋找更好的方案。VentureBeat將此描述為企業更多是忍受而非喜愛的一層。
發現2:模型引力驅動平台選擇
基礎模型而非單純工具決定了平台選擇
當VentureBeat詢問什麼最能影響編排平台選擇時,最大的因素是底層模型的吸引力。靈活性和開發便捷性緊隨其後。
報告表示,模型引力領先從選擇面解釋了Anthropic的平台領先地位:企業傾向於選擇最接近他們已標準化的前沿模型的編排環境。但下一層回應使情況更為複雜。跨模型和工具的靈活性被17%引用,開發便捷性也為17%,顯示企業希望避免被平台選擇所困。這一顧慮預示了報告後文描述的鎖定風險。安全和權限為14%,總擁有成本為11%,構成了務實的採購邏輯。效能(包括延遲和記憶體)以4%排名最後,表明在這個採用階段,約束條件是模型適配性和可選擇性,而非原始速度。
發現3:目標是可靠的多步驟執行
企業以是否完成工作來評判編排
VentureBeat要求受訪者指出他們編排的主要成功指標。可靠性和多步驟工作流管理佔主導地位,開發者和使用者面向的指標則落後。
任務完成可靠性為32%,多步驟工作流管理為28%,兩者合計佔回應的59%,即101名受訪者中的60名。在企業看來,當編排能可靠地將任務帶過多個步驟到完成時,就算成功。開發者生產力為17%雖然重要但屬次要,與其在框架討論中的突出地位形成反差。終端使用者體驗為9%,是較小的顧慮,與編排主要被視為內部執行問題而非使用者體驗問題一致。
這種以可靠性為先的標準使「聊天機器人陷阱」發現尤為尖銳。企業將成功定義為可靠的多步驟執行,但大多數已部署的「代理」根本不做多步驟工作。
陷阱在公司規模上分佈不均。在較小企業中,77%表示其代理只有四分之一或更少執行真正的多步驟工作,而較大企業為62%。VentureBeat表示,較大企業在真正的多步驟部署方面明顯更為先進,而聊天機器人陷阱在方向上更像是一個中型市場的現象。
發現4:整合、投入生產、內部建構
三大策略動作在未來一年幾乎並列
VentureBeat詢問企業在未來12個月內預期其編排策略會有什麼重大變化。三個動作聚集在頂部,幾乎平均分配。
建構內部控制被25%引用,在一個框架上標準化被24%引用,將代理從沙盒移至生產被23%引用。VentureBeat表示,三者統計上無法區分,共同講述一個故事:企業正從實驗階段邁向營運整合。他們需要更少的框架、更多的生產暴露,以及對控制層更大的所有權。僅有4%預期不會改變。
對自訂內部控制平面的需求在結合發現1中描述的平台集中度來看尤為值得注意。企業正在向模型供應商平台標準化的同時,也計劃用自己擁有的控制邏輯來包裝它們——這正是報告在發現7中明確闡述的混合態勢。
發現5:近七成計劃更換,最大群體尚無候選名單
企業預期的策略變更與供應商動態相關。當被問及是否計劃在未來12個月內採用新的、額外的或替代的代理編排平台時,受訪者在此層的流動性高於VentureBeat追蹤的任何其他層。
當被問及正在考慮哪些平台時,處於變動中的受訪者最常見的回答是他們還沒有候選名單。這一群體佔所有受訪者的29%,是僅次於「不考慮更改」之後最大的單一回應。在具名的候選者中,OpenAI以16%領先,其次是LangChain/LangGraph的12%和Anthropic的7%。
報告指出,獨立框架在未來考慮中吸引了大約其當前使用份額兩倍的關注,這與VentureBeat安全追蹤器對專業供應商發現的模式相同。結合報告的集中度和鎖定發現來看,情況很清楚:主要模型平台供應商持有大約五分之四的當前主要使用量,供應商鎖定已成為最大顧慮,96%預期策略變更,買方現在展現出採取行動的意圖,但最大群體仍未決定。VentureBeat將代理堆疊中最集中的層描述為截至6月也最不穩定的層。
發現6:投資流向工作流工具
工具和權限領先支出計劃,監控落後
VentureBeat詢問明年哪項編排相關投資將成長最多。代理工作流工具排名第一,其次是安全和權限執行。
工作流工具以34%領先,是發現3中確定的可靠性和多步驟優先事項在預算面的體現。支出被導向可靠地連接步驟的機制。安全和權限執行為25%,擴展基礎設施為20%,緊隨其後——這些是將代理從沙盒環境推向生產所需的投資,即發現4中描述的策略轉變。監控和除錯吸引較小的11%,另有11%報告預算持平。
對工具、權限和擴展(而非純粹的可觀測性)的側重表明,企業支出是為了建構和強化編排,而非僅僅是監控它。
發現7:控制平面將是混合的,鎖定是原因
企業預期在供應商和自有層之間分配控制
VentureBeat詢問企業預期到2026年底代理的主要控制平面將存在於何處,以及如果控制權位於模型供應商平台內部,他們最擔心什麼。明顯多數預期將採用混合模式,而供應商鎖定是主要原因。
混合控制以大幅優勢成為主導預期,51%的受訪者如此表示。僅有6%預期將控制權完全交給供應商管理的服務。綜合來看,混合、自訂和外部抽象的選項——即每種至少將控制權部分保留在供應商之外架構——加總達88%,即101名受訪者中的89名。
原因直接出現在關於供應商駐留控制風險的回應中。供應商鎖定以35%領先,即101名受訪者中的35名,高於安全和權限限制的28%,以及跨模型和工具不靈活性的21%。VentureBeat表示,這一模式呼應了前一波調查中「不要信任模型自我監管」的態勢:企業會在供應商平台上建構,但拒絕完全受其治理。混合控制平面是他們最害怕的鎖定風險的架構性對沖。
6月份偏好混合控制平面的數據標誌著與先前快照的變化。在4月至5月的調查(145名受訪者)中,僅有34%預期混合控制平面,而12%預期將控制權完全交給供應商管理的服務。VentureBeat表示,這兩個快照尚未確立確認的縱向趨勢,但討論方向是明確的:趨向保留控制權。
鎖定也新近成為最大顧慮。在4月至5月的波次中,安全和權限限制以32%領先,鎖定以24%位居第二。到6月,兩者互換了位置。對供應商平台的擔憂似乎正從「能否被保護」演變為「能否被替換」。
發現8:聊天機器人陷阱——大多數「代理」尚非真正的代理
企業承認多數部署仍是聊天機器人外殼
VentureBeat要求企業誠實評估其產品組合:已部署的「代理」中,有多少是真正的多步驟編排工作流,而非簡單的單一提示聊天機器人外殼。回應是本次調查波次的決定性發現。
合併最低兩個區間,71%的企業,即101名受訪者中的72名,表示其已部署的「代理」中只有四分之一或更少是真正編排的。僅有10%,即101名受訪者中的10名,表示超過半數的已部署代理已跨過這一門檻。
這就是報告核心的落差。前述發現中記錄的野心——模型供應商平台、以可靠性為先的成功指標、生產部署、以及刻意的控制架構——遠遠超前於部署現實,後者仍然由以代理面貌呈現的單一提示助手所主導。VentureBeat將此描述為一張路線圖而非矛盾:平台、預算和策略之所以被建立,恰恰是因為編排產品組合仍然很薄。後續調查波次的開放性問題是,現實以多快的速度追趕上野心。
發現9:財務控制仍是被動的
僅有少數能在帳單到達前阻止失控的代理
最後,VentureBeat詢問企業如何對代理token消耗執行財務控制——即自主迴圈在任何人介入之前耗盡預算的風險。由於LLM推理按token計量——即模型作為輸入和輸出處理的文字片段——一個代理在無限制的情況下反覆呼叫,可在任何人類審查之前累積巨額成本。大多數企業依賴原生上限或事後監控,而即時的程式化控制仍是例外。
超過四分之一的企業,27%,表示他們沒有即時的程式化方式在預算失控的帳單到達前阻止代理;他們是事後從日誌中得知。另有32%完全依賴其主要平台內建的原生上限和限流,這種控制僅與供應商工具一樣好,且與發現7中描述的鎖定顧慮相關。建構自訂閘道的企業(23%)或利用跨模型路由來套利成本的企業(19%),是將token消耗視為需要確定性控制的工程問題的企業。
如同編排成熟度一樣,財務控制是營運現實落後於野心的領域。代理推向生產的速度快於其周圍成本控制平面的建設速度。
報告還指出了公司規模的差異。在2,500名員工以下的企業中,約三分之一(34%)僅對代理支出行使被動控制,而較大企業為20%。VentureBeat將這些數字描述為方向性的,但與聊天機器人陷阱的分化一致:中型市場在最低工具化預算上運行最不成熟的代理。
結論:編排層是真實的,但大多數代理尚未到位
擁有100名或以上員工的組織描述了一個快速整合但緩慢成熟的編排策略。至少目前,他們正在向模型供應商平台標準化,這些平台合計持有大約五分之四的主要使用量。他們選擇這些平台是因為底層模型的引力,並以可靠的多步驟執行來評判成功。投資正流向工作流工具和權限。策略聚焦於整合框架和將代理推向生產。預期的控制平面是刻意混合的,因為供應商鎖定是企業最恐懼的風險。
但這種標準化是暫時性的。68%計劃在12個月內採用新的、額外的或替代的編排平台,這是VentureBeat追蹤的任何技術層中最高的轉換意圖,而這些潛在變動者中最大的群體尚未確定候選名單。當前的集中度顯示的是企業今天所處的位置,不一定是他們打算留在的地方。
自我評估降低了野心的高度。71%表示其已部署的「代理」中只有四分之一或更少是真正編排的,僅有10%跨過了半數門檻,超過四分之一無法即時阻止失控的代理。編排層——包括平台、預算和控制架構——的建設超前於它旨在運營的編排產品組合。
VentureBeat表示,在6月單一波次中的101名受訪者,這些發現應被視為明確的方向性訊號,而非精確測量。企業在大約多數代理進行任何需要編排層的工作之前,就已決定了他們希望如何編排代理。後續波次的問題是,部署的現實是否能追趕上野心,以及——在近七成買方處於變動中且大多數尚未決定的情況下——最終穩定的堆疊會落在哪些平台上。
這些發現基於來自101名合格的企業受訪者(100名或以上員工的組織)的調查回應,取自2026年6月的單一波次。由於這是單一波次而非多月合併樣本,結果為方向性的而非已確認的趨勢。受訪者包括產品和專案經理、CIO、CTO和CISO、顧問和顧問,以及科技/軟體、金融服務、醫療和其他領域的資料、AI和工程總監及副總裁。