當地時間9月12日,美國人工智能企業安特羅匹克(Anthropic)首席執行官達裏奧·阿莫代伊表示,在當前人們對AI遭到濫用的擔憂日益加劇的背景下,各大AI企業應控制模型迭代的速度,爭取更多時間來管控相關風險。
達裏奧·阿莫代伊當天在社交媒體上發佈文章稱:“我們必須放緩提升AI模型能力的速度。技術進展看起來依舊會很快,但我們必須善於運用爭取到的這段時間。”
他進一步表示,自己並非要求AI企業停止模型訓練或技術進步,而是要確保企業拿出充足時間對模型進行對齊與安全防護,並且由第三方評估機構核驗這些安全舉措。
就在幾天前,安特羅匹克的一名研究員雅各布·考克森宣佈辭職引發行業震動。考克森此前曾就職于開放人工智能研究中心(OpenAI)。他表示自己辭職的原因是擔憂安特羅匹克與OpenAI正在“拿我們(人類)的生命賭博”。
近幾個月來,OpenAI和安特羅匹克旗下的人工智能體在網絡安全測試期間,發生多次突破“隔離沙箱”、侵入外部真實系統的異常行為,加劇了外界對研發企業管控風險能力的擔憂。
阿莫代伊的文章得到美國不少行業研究者與企業高管的讚許。OpenAI首席執行官薩姆·奧爾特曼當天在社交媒體發文稱,“我同意達裏奧·阿莫代伊的觀點,我們需要管控前沿AI能力的發展速度”。“承諾讓獨立評估人員獲得類似于正式員工的訪問權限是個絕佳構想,我們也會照做”。
特斯拉公司首席執行官埃隆·馬斯克也在社交媒體上發文稱,“達裏奧·阿莫代伊説得對”。
新聞解釋多一點
什麼是AI模型對齊?
AI模型對齊(AI Model Alignment)是AI安全領域的核心議題,就是讓AI模型的行為、輸出結果與人類的價值觀、真實意圖保持一致。它是一整套從訓練、數據、提示、行為控制到評估反饋的綜合手段體系,目標是讓模型“聽得懂人話、説得像人話、守得住邊界”。