AI
2 hours ago

#AI
#大型語言模型
#數據透明
#AI倫理
#使用者行為
商傳媒|葉安庭/綜合外電報導
摘要

有研究指出,Anthropic、OpenAI 等 AI 公司發布的產品使用報告數據不透明,外界難以得知 AI 的真實應用情況,這可能導致社會對 AI 的潛在風險與效益產生錯誤認知。

人工智慧(AI)技術日益普及,但外界對其真實應用情況的了解卻遠不如預期。一份由麻省理工學院媒體實驗室(MIT Media Lab)發布的研究指出,Anthropic、OpenAI 等主要 AI 公司,在發布其大型語言模型(LLM,指能理解並生成人類語言的複雜 AI 程式)產品(例如 Claude 和 ChatGPT)的使用報告時,往往只揭露部分數據,導致各界難以全面掌握 AI 在現實世界的運作與影響。

該研究的共同負責人、MIT Media Lab 博士 Shayne Longpre 指出,單一公司的報告無法呈現 AI 使用的全貌。史丹佛大學可信賴 AI 研究實驗室(Stanford Trustworthy AI Research (STAIR) Lab)電腦科學博士生 Anka Reuel 也表示,目前沒有獨立來源可以證實這些公司所發布的數據,這意味著許多關於 AI 效益與風險的重大決策,都是基於非常有限的資訊所做出的。

為彌補這項資訊落差,一項名為 AI Observatory 的平台整合了多方數據,分析了 2023 年至 2025 年間的 AI 使用模式。該平台匯總了來自 7 個真實世界數據集的 24,521 次對話,共計 85,633 輪對話(指使用者提出的問題及 AI 的相對應回答)。這些數據來自 5,000 名用戶,與包括 ChatGPT、Gemini、Claude 和 Grok 在內共 52 種不同的模型進行了互動。

研究發現,儘管 AI 公司會定期發布報告,但這些報告通常未能捕捉到各模型之間,甚至是同一模型內部使用上的細微差異。這種選擇性揭露的問題,使得社會大眾,包括 AI 研究者、科技觀察家以及關心 AI 倫理與應用的各界人士,難以建立對 AI 真實使用情況的全面認知,進而可能影響到未來 AI 治理和法規制定的準確性。