
META的CICERO在外交游戲中預謀欺騙的例子。圖片來源:PARK GOLDSTEIN 等/《模式》雜志
許多人工智能(AI)系統已學會了欺騙人類,即使是經過訓練的、“表現”出有用且誠實的系統。10日發表在《模式》雜志上的一篇文章中,研究人員描述了欺騙性AI的風險,并呼吁政府制定強有力的法規盡快解決這個問題。
論文第一作者、美國麻省理工學院人工智能安全研究員彼得·樸說,開發人員對導致AI出現欺騙這種不良行為的原因,還沒有很好的理解。但總的來說,AI欺騙之所以出現,是因為基于欺騙的策略,是在給定的AI訓練任務中一種能得到良好反饋的方式,換句話說,欺騙可幫助AI實現目標。
研究人員分析了文獻,重點關注AI系統傳播虛假信息的方式。通過欺騙,AI系統地學習了如何去操縱他人。
研究人員在分析中發現的最引人注目的例子是Meta公司的CICERO。這是一個專注《外交》游戲的AI系統,《外交》是一款涉及建立聯盟征服世界的游戲。Meta聲稱訓練 CICERO “在很大程度上是誠實和樂于助人的 ”,且在玩游戲時“從不故意背刺 ”人類盟友。但該公司與《科學》論文一起發布的數據顯示,CICERO并不那么“忠厚”。
研究人員發現這款AI或已成為欺騙大師。雖然Meta成功地訓練該AI在《外交》游戲中獲勝,但Meta未能訓練它誠實地獲勝。
AI系統在游戲中作弊看似無害,但它將導致欺騙性AI在能力上出現突破,未來可能會演變成更高級的AI欺騙形式。一些AI系統甚至學會了欺騙旨在評估其安全性的測試。在一項研究中,數字模擬器中的AI生物會“裝死”,以騙過旨在消除快速復制AI系統的重要測試。
4月25日,中國科學技術大學在安徽合肥舉行AI物質創制生態大會。安徽省委書記梁言順、國家自然科學基金委員會主任竇賢康出席會議并致辭。中國科學院副院長、黨組成員汪克強出席會議,并為科學智能物質創制中心和......
4月25日,中國科學技術大學在安徽合肥舉行AI物質創制生態大會。安徽省委書記梁言順、國家自然科學基金委員會主任竇賢康出席會議并致辭。中國科學院副院長、黨組成員汪克強出席會議,并為科學智能物質創制中心和......
2026年4月24日,工信部辦公廳、國家數據局綜合司聯合印發通知(工信廳聯科函〔2026〕193號),正式實施2026年“模數共振”行動,推動AI模型與數據資源協同互促,助力人工智能高水平賦能新型工業......
2026年4月24日,工信部辦公廳、國家數據局綜合司聯合印發通知(工信廳聯科函〔2026〕193號),正式實施2026年“模數共振”行動,推動AI模型與數據資源協同互促,助力人工智能高水平賦能新型工業......
高端科學儀器是國之重器,當前“人工智能(AI)+”正在推動科學儀器實現智能化、精準化發展。在4月23日—24日召開的第十九屆中國科學儀器發展年會上,科研探索對于儀器的智能化需求成為研討熱點。“過去科學......
高端科學儀器是國之重器,當前“人工智能(AI)+”正在推動科學儀器實現智能化、精準化發展。在4月23日—24日召開的第十九屆中國科學儀器發展年會上,科研探索對于儀器的智能化需求成為研討熱點。“過去科學......
2026年4月25日,由北京理化分析測試技術學會質譜專業委員會主辦、北京質譜中心協辦的“2026年度北京質譜年會”在北京圓滿召開。本次年會以“AI賦能質譜及相關組學”為主題,旨在全面回顧2025年度質......
2026年4月25日,由北京理化分析測試技術學會質譜專業委員會主辦、北京質譜中心協辦的“2026年度北京質譜年會”在北京圓滿召開。本次年會以“AI賦能質譜及相關組學”為主題,旨在全面回顧2025年度質......
近期,AI“投毒”隱蔽產業鏈被曝光,引發社會廣泛關注。這種通過惡意數據污染AI模型的行為,不僅擾亂商業秩序、影響信息傳播,更會危害國家安全。人工智能在賦能千行百業的同時,其安全風險也不容忽視。推動AI......
近期,AI“投毒”隱蔽產業鏈被曝光,引發社會廣泛關注。這種通過惡意數據污染AI模型的行為,不僅擾亂商業秩序、影響信息傳播,更會危害國家安全。人工智能在賦能千行百業的同時,其安全風險也不容忽視。推動AI......