記者許若茵/編譯
Google與Google DeepMind研究人員宣布成立DeepMind Institute,旨在推動人工通用智慧(AGI)相關討論。該研究院由DeepMind共同創辦人Shane Legg、Google高階主管James Manyika,以及Google DeepMind董事長Demis Hassabis擔任主任,其中Legg兼任總編輯。

新成立的研究院希望呈現Google、Google DeepMind與全球更廣泛研究社群在AGI議題上的不同觀點。公告指出,各方「不會總是達成共識,而且隨著快速發展的前沿領域出現更多數據與資訊,他們可能會改變自己的想法」。
研究院首批發表的4篇文章涵蓋多項議題,包括管理AGI可能帶來的經濟衝擊所需的經濟政策、維持模型推理結果可供人類理解、促進人類繁榮的原則,以及評估前沿AI模型的框架。
其中一篇由DeepMind安全研究人員Rohin Shah與Anca Dragan撰寫的文章指出,AI透明度正在縮減,也就是人類能夠查看並檢驗模型逐步推理過程的空間正在縮小,但這並非不可避免。
他表示,隨著新型架構讓最強大的模型變得更難監控,開發者與監管機構應直接面對其中的安全取捨。這可能意味著限制「不透明序列深度」,也就是模型在沒有產生可讀推理軌跡的情況下,可以進行多少連續運算;或者要求開發者證明,透明度較低的系統仍能維持相同程度的可監控性。
在另一篇文章中,Hassabis提出成立由美國主導的前沿AI標準機構,用於評估最先進的AI模型。根據他的框架,開發者初期可以自願提交模型接受審查,最晚在模型發布前30天送交評估。待評估制度證明有效後,通過測試可能成為在美國部署前沿模型的必要條件。
該機構初期將與AI公司協商設計評估方式,但最終將發展出獨立且不公開的評估,也就是文章所稱的「保留測試」,以避免AI實驗室針對已知評估方式調整模型。Hassabis表示,如果情勢嚴重程度有所要求,這套框架可以「逐步提高強度」,甚至可能進一步包括前沿AI開發商協調放慢開發速度。
這些文章發布之際,AI產業的安全討論正從廣泛表達擔憂,逐漸轉向提出具體的資訊揭露、外部審查方案,以及當安全防護落後時採取協調放慢開發速度的措施。
本週隨著產業領袖支持Anthropic執行長Dario Amodei提出的讓前沿AI發展「放慢腳步」主張中的部分內容,這項轉變進一步加速。
資料來源:
![]()
—
本篇文章授權來源:科技島