即時快訊
【專家觀點】AI 沒有殺死軟體業,而是正在重寫軟體:Agent 時代的 IT 產業大洗牌 佛州棕櫚灣市自主開發AI 應對數據風險與採購挑戰 科技巨頭紛祭API存取限制 AI代理戰爭掀新篇章 2027韓國消費趨勢出爐:「領航者」與「倦怠社會」成關鍵 聯準會新主席凱文·沃什首度升息 強硬獨立態度獲市場認可 美國股市第四季面臨多重逆風 聯準會緊縮與地緣政治添變數 美半導體龍頭應用材料攜手 Besi 強化先進封裝共建 AI 晶片生態 美國信貸市場浮現四大趨勢 銀行應對挑戰需借鏡 日立製作所成日本首例 加入Linux基金會「Tokenomics」推動人工智慧價值評估 美國基金押注中國AI模型ETF 專家點名台積電等亞洲巨頭受惠
圖/本報資料庫
科技生活

·a month ago·何映辰
#AI成本#Gartner#Context Engineering#AI代理#推論成本
圖/本報資料庫
圖/本報資料庫
商傳媒|何映辰/台北報導
摘要

高德納諮詢公司預計AI代理的推論成本到2028年將大幅增加,主因是AI模型在處理資訊時,其「Context Window」過載導致的效能下降與Token使用量暴增;為此,企業需要透過「Context Engineering」技術,有效管理AI模型接收的資訊,以降低成本並提升效能。

全球知名的資訊科技研究顧問公司高德納諮詢公司(Gartner)已預期,人工智慧(AI)代理的推論(Inference)成本將在2028年前顯著增加。這意味著AI模型實際運行、產生結果時所需的費用,恐將對企業帶來不小的壓力。

這些能夠自主執行任務的人工智慧程式,其效能與成本關鍵在於它們處理資訊的「Context Window」(上下文視窗),即AI模型單次互動能接收和處理的資訊量。根據 Towards AI 的共同創辦人兼技術長路易斯-弗朗索瓦·布沙爾(Louis-François Bouchard)的解釋,當 Context Window 被過多不相關的資料填滿時,會導致AI模型效能下降,此現象稱為「Context Rot」(上下文腐蝕)。

Context Rot 不僅影響AI代理的回應品質,也會推高AI模型處理資訊的基本單位——Token(權杖)的使用量,進而顯著增加營運成本。為此,業界正積極推動「Context Engineering」(上下文工程),其核心在於精確決定AI模型在每次互動中應接收哪些資訊,以期在模型品質與成本效益間取得平衡。

Context Engineering 涵蓋多項策略,旨在優化Context Window 的管理。其中,「Compaction」(壓縮)技術透過觀察截斷、選擇性保留、摘要與提示壓縮等方式,將Context Window 的資訊量最小化,僅保留最相關的內容。而「Offloading」(卸載)則是將上下文資料移出即時 Context Window 之外,例如使用 retrieve augmented generation(RAG,檢索增強生成)和 GraphRAG 等技術。

另一關鍵策略是「Caching」(快取),透過運用預先計算好的快取來大幅降低成本和延遲。當上下文內容僅是增加而非轉換時,快取能有效節省重複運算所需資源。然而,若對上下文進行摘要等修改,則可能破壞快取機制,導致需重新計算而抵消節省的效益。

此外,「Progressive Disclosure」(漸進式揭露)則強調僅在AI代理需要時才載入必要的元件,而非一次性載入所有指令,這有助於更有效地管理AI技能。早期的實驗顯示,在未經壓縮或修改的情況下,保留「完整歷史」資訊通常能在記憶回溯方面提供最佳結果,並且由於快取的效益,成本更低、速度更快。

綜合來看,Context Engineering 是一門整合壓縮、記憶體管理和技能優化的全面性學科。透過仔細規劃AI模型所接收的資訊,開發者能顯著提升AI代理的效能,同時降低營運成本並改善使用者體驗,這對於企業應對日益攀升的AI運算費用至關重要。


在 Google 搜尋的熱門報導中優先看到商傳媒
加入為 Google 偏好來源