
輝達宣布向由前 OpenAI 首席科學家伊爾亞·蘇茨克維創立的 Safe Superintelligence Inc.(SSI)投資 50 億美元,SSI 預計本週推出其首個採用全新「Test-Time Training」技術的 AI 模型,該模型強調持續學習與內化知識,可能顛覆現有 AI 產業格局。
輝達(NVIDIA)近期宣布對由前 OpenAI 首席科學家伊爾亞·蘇茨克維(Ilya Sutskever)創立的 Safe Superintelligence Inc.(SSI)投入 50 億美元巨額資金。SSI 預計本週推出其首個大型人工智慧(AI)模型,此舉可能為 AI 產業帶來顛覆性的變革。
根據《Kucoin.com》報導,輝達在獲得 SSI 內部高度機密的研發成果後,決定進行這筆重大投資。這項合作不僅包含 50 億美元的資金,輝達還承諾在未來 12 個月內,將 SSI 的運算能力提升十倍,並給予 SSI 獨家使用下一代 Vera Rubin system 的權限。
SSI 的新模型採用一種稱為 Test-Time Training (TTT) 的全新架構。現行 AI 模型多半透過擴大上下文視窗(context window),讓模型能在處理新資訊時「攜帶更厚的作弊小抄」;然而,SSI 的模型在讀取資料時能「真正學習」,透過梯度更新改變其內部結構,形成「內化知識」。這意味著 SSI 的模型不再需要龐大的上下文視窗,能夠以更精煉、適應性強的方式運行,進而超越那些依賴巨量運算資源建立的龐大、僵化模型。
伊爾亞·蘇茨克維一直主張,預訓練(pre-training)的時代即將結束。他認為,業界對「通用人工智慧」(AGI)與「預訓練」存在誤解,真正的超人工智慧不應是一個記憶所有網路數據的龐然大物,而是一個「極其聰明、永無止盡好奇的 15 歲天才」,能夠像人類一樣持續從現實回饋中學習與演進。SSI 的策略是專注於「直取安全超智慧」,避免短期產品開發,將研究重點放在高效的持續學習(continual learning)與對齊(alignment)技術。
業界對 SSI 的新模型抱持高度期待。投資公司安德森·霍羅威茨(a16z)的合夥人 Martín Casado 暗示,他最近遇到「今年最重要的模型」。AI 觀察家 Dan Mcateer 更表示:「伊爾亞確實創造了超智慧,遊戲規則已被改變!」投資人 Gavin Baker 也曾透露,SSI 將在八月發布其模型。若 SSI 的模型真能實現「推論時訓練」(training during inference)及「即時權重更新」(real-time weight updates),現有依賴運算能力築起的護城河、以 Token 計費的商業模式,甚至關於開源模型權重的爭論,都可能面臨「維度降級」的影響。
