
人工智能(AI)安全問題備受關注,Anthropic行政總裁阿莫戴呼籲,各家公司調整提升模型能力的速度。他提出一套三步驟架構,希望放慢發展腳步,爭取更多時間管理相關風險。
阿莫戴在社交平台發文,認為必須放慢提升AI模型能力的速度,他指即使速度變慢,進展仍將顯得很快,必須善用所爭取到的時間。
阿莫戴進一步澄清,他並非主張停止模型訓練或中止技術進步,而是希望企業能有充分時間讓AI模型對齊,意指引導AI系統的行為與目標,使其符合人類的意圖、價值觀及安全規範,並加強防護,讓第三方審查人員驗證這些步驟是否確實執行。
阿莫戴提出的三步驟架構之一,包括在前沿AI公司內設立常駐的第三方審查人員,賦予其使用相關工具和參與內部風險評估流程的權限。
阿莫戴說,隨著越來越多美國國會議員呼籲制定規範AI系統的新法律,AI公司應自發合作,建立標準。
這篇帖文發表前,Anthropic才剛發布一份威脅情報報告,闡述有多方人士曾利用其Claude AI模型從事武器開發、網路戰、監控以及詐騙等行為。