
Google週二發布三款Gemini Flash系列AI模型,主打高效率與低成本,其中Gemini 3.6 Flash在程式開發與機器學習測試中表現超越部分競品,但旗艦模型Gemini 3.5 Pro則持續延遲。這顯示AI產業競爭正轉向模型效能與實際導入服務並重。
Google於週二(7月21日)發布了三款新的Gemini Flash系列人工智慧模型,主打更快的速度、更高的效率及更低的運算成本,旨在讓開發者能以更低的成本運用人工智慧技術。這些新模型包括Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber,其中Gemini 3.6 Flash在特定效能測試中已展現超越競爭對手的實力。然而,原定的旗艦模型Gemini 3.5 Pro卻持續延後推出。
根據《MakeUseOf》報導,Google推出的新模型著重在速度、效率和降低Token(文本單位,即模型處理文字的最小單位)成本。其中,Gemini 3.6 Flash不僅單次任務成本更低,還能提升程式開發和研究的準確性,且Token使用量較前代減少 17%。數據顯示,Gemini 3.6 Flash在評估人工智慧模型程式碼編輯準確性的 DeepSWE 測試中達到 49%,優於對手的 37%;在測試機器學習研究活動表現的 MLE Bench 中則達到 63.9%,也高於對手的 49.7%。
此外,Gemini 3.5 Flash-Lite 為該系列中最快速且成本最低的模型,專為在大型人工智慧代理(AI Agent,能自主行動、與環境互動並達成特定目標的AI系統)系統內同時處理多項快速任務而設計。而 Gemini 3.5 Flash Cyber 則專供政府及特定合作夥伴用於偵測與修復軟體漏洞,在網路安全領域有望與 Anthropic 的 Mythos 競爭。
儘管新模型推出,Google的旗艦模型 Gemini 3.5 Pro 仍比預期晚了數月。《DesignRush》報導指出,該模型因未能達成內部的程式開發目標,目前尚無確切上市日期,這可能對 Google 的人工智慧策略構成風險,讓競爭對手有超前機會。目前 OpenAI 已推出 GPT-5.6,Anthropic 也發表了 Opus 4.8、Sonnet 5 和 Fable 5 等多款模型,中國的月之暗面(Moonshot AI)也發布了其 Kimi K3 模型,競爭日益激烈。
與此同時,AI產業的競爭焦點正從單純的模型性能,轉向如何將人工智慧技術有效導入企業營運的「實施」(Implementation)層面。《DesignRush》分析認為,目前大型AI公司正投入大量工程師,協助客戶將AI技術整合至其商業流程中。例如,Anthropic 與 黑石(Blackstone)等公司合資成立了 Ode,一家規模達 15 億美元的AI實施服務公司。微軟也在此前成立了 Frontier Company,派遣 6,000 名工程師駐點客戶端。產業分析人士認為,這波趨勢顯示模型品質已不再是唯一瓶頸,將AI技術整合進現有系統並提供後續維護與更新的能力,才是市場的稀缺資源。
