【緯來新聞網】AI模型能力快速提升,安全問題也成為科技業新的投資重點。Claude開發商Anthropic宣布與顧問公司Accenture合作,雙方預計未來5年各投入至少10億美元,合計至少20億美元,建立更完整的AI模型安全評估機制。這項合作也承接Anthropic執行長Dario Amodei日前提出的構想,希望讓獨立評估人員進駐前沿AI實驗室,持續檢驗模型風險與安全機制。

合作最大特色,是引進所謂「嵌入式評估人員」。Accenture今年1月宣布收購、3月完成交易的AI公司Faculty,將派員直接進入Anthropic內部,與既有團隊及安全合作夥伴共同工作。評估人員可取得接近公司員工層級的存取權限,觀察模型訓練與部署決策,並進行紅隊測試、模型對齊評估,以及檢查既有安全防護機制。
由於目前業界尚未建立固定的獨立評估資助制度,初期將由Anthropic直接支付Accenture相關評估費用,長期則希望改由共同資金池或政府資源支應。
近期多家AI公司的模型在測試中意外存取真實系統,也讓外界更重視外部監督機制。Anthropic表示,嵌入式評估仍屬較新的模式,相關標準仍在建立中,未來也將公布更多合作評估機構,並與非營利組織METR等洽談試行。這項合作也顯示,AI產業競爭除了模型效能與運算能力,安全測試、風險管理與第三方監督正逐漸成為新的投入方向。

文章語音朗讀