輝達(NVIDIA)近期宣布對由前 OpenAI 首席科學家伊爾亞·蘇茨克維(Ilya Sutskever)創立的 Safe Superintelligence Inc.(SSI)投入 50 億美元巨額資金。SSI 預計本週推出其首個大型人工智慧(AI)模型,此舉可能為 AI 產業帶來顛覆性的變革。
根據《Kucoin.com》報導,輝達在獲得 SSI 內部高度機密的研發成果後,決定進行這筆重大投資。這項合作不僅包含 50 億美元的資金,輝達還承諾在未來 12 個月內,將 SSI 的運算能力提升十倍,並給予 SSI 獨家使用下一代 Vera Rubin system 的權限。
SSI 的新模型採用一種稱為 Test-Time Training (TTT) 的全新架構。現行 AI 模型多半透過擴大上下文視窗(context window),讓模型能在處理新資訊時「攜帶更厚的作弊小抄」;然而,SSI 的模型在讀取資料時能「真正學習」,透過梯度更新改變其內部結構,形成「內化知識」。這意味著 SSI 的模型不再需要龐大的上下文視窗,能夠以更精煉、適應性強的方式運行,進而超越那些依賴巨量運算資源建立的龐大、僵化模型。
伊爾亞·蘇茨克維一直主張,預訓練(pre-training)的時代即將結束。他認為,業界對「通用人工智慧」(AGI)與「預訓練」存在誤解,真正的超人工智慧不應是一個記憶所有網路數據的龐然大物,而是一個「極其聰明、永無止盡好奇的 15 歲天才」,能夠像人類一樣持續從現實回饋中學習與演進。SSI 的策略是專注於「直取安全超智慧」,避免短期產品開發,將研究重點放在高效的持續學習(continual learning)與對齊(alignment)技術。
業界對 SSI 的新模型抱持高度期待。投資公司安德森·霍羅威茨(a16z)的合夥人 Martín Casado 暗示,他最近遇到「今年最重要的模型」。AI 觀察家 Dan Mcateer 更表示:「伊爾亞確實創造了超智慧,遊戲規則已被改變!」投資人 Gavin Baker 也曾透露,SSI 將在八月發布其模型。若 SSI 的模型真能實現「推論時訓練」(training during inference)及「即時權重更新」(real-time weight updates),現有依賴運算能力築起的護城河、以 Token 計費的商業模式,甚至關於開源模型權重的爭論,都可能面臨「維度降級」的影響。


