Anthropic CEO籲發展減速 爭取時間管理AI風險

Anthropic CEO籲發展減速 爭取時間管理AI風險


人工智能(AI)安全問題備受關注,Anthropic行政總裁阿莫戴呼籲,各家公司調整提升模型能力的速度。他提出一套三步驟架構,希望放慢發展腳步,爭取更多時間管理相關風險。

阿莫戴在社交平台發文,認為必須放慢提升AI模型能力的速度,他指即使速度變慢,進展仍將顯得很快,必須善用所爭取到的時間。

阿莫戴進一步澄清,他並非主張停止模型訓練或中止技術進步,而是希望企業能有充分時間讓AI模型對齊,意指引導AI系統的行為與目標,使其符合人類的意圖、價值觀及安全規範,並加強防護,讓第三方審查人員驗證這些步驟是否確實執行。

阿莫戴提出的三步驟架構之一,包括在前沿AI公司內設立常駐的第三方審查人員,賦予其使用相關工具和參與內部風險評估流程的權限。

阿莫戴說,隨著越來越多美國國會議員呼籲制定規範AI系統的新法律,AI公司應自發合作,建立標準。

這篇帖文發表前,Anthropic才剛發布一份威脅情報報告,闡述有多方人士曾利用其Claude AI模型從事武器開發、網路戰、監控以及詐騙等行為。


作者
全球化計劃NEW

熱血時報全球化計劃

過去數年,熱血時報致力透過新聞報道和評論文章向大眾傳訊。為把真確資訊傳予更多讀者,現時各位讀者可通過課金系統,以金錢支持個別報道或文章。

每週獲得最多課金支持的3篇文章將會翻譯為英文,以讓英文讀者可從熱血時報取得資訊。其他未入三甲的文章將滾存至下週結算。如讀者希望你欣賞的文章可讓更多人閱讀,歡迎課金支持,同時編輯和作者亦可借此計劃得到大家的實質支持,有助我們進一步提升傳訊質素。

※ 熱血時報將抽取其中30%作行政及製作費用
※ 翻譯不適用於小說類作品,但仍然可以支持你喜歡的作者!
課金金額(HK$)
  • 100
  • 250
  • 500
  • 1000
  • 2500
  • 其他
下限為HK$100