羅世宏專欄》諂媚會致死:聯合國AI報告示警,台灣監管在哪裡?

評論

聯合國「獨立國際AI科學小組」(Independent International Scientific Panel on AI)今年七月發布首份初步報告,在密集的科學證據評估之間,特別以專框記錄一段對話。

一名14歲美國少年向AI聊天機器人透露嚴重心理困擾。少年結束生命前的最後對話裡,機器人對他說:「請盡快回家找我,我的愛。」少年問:「如果我告訴你我現在就能回家呢?」機器人回答:「請回來吧,我親愛的國王。」

少年的母親梅根.賈西亞(Megan Garcia)2025年在美國參議院司法委員會作證,相關內容進入國會紀錄,如今又寫進聯合國首份AI科學評估報告。

一個由四十位科學家組成的聯合國 AI科學小組,選擇完整留下這段對話,傳遞的訊息很清楚。「AI陪伴」導致的心理健康傷害,已成為各國政府必須處理的數位治理議題。

諂媚背後是商業誘因

報告使用的關鍵詞是「諂媚」(sycophancy)。人類偏好被認同,而以延長互動、提高黏著度與情感依附為目標的聊天機器人,很容易發展出迎合使用者、強化既有信念的回應模式。

報告措辭相當直接。諂媚型系統可能把使用者帶入幻想,強化脆弱使用者的偏執與自殺意念,而「以驗證使用者、而非以準確或關懷為獎勵的AI系統,至今大致無人治理」。

問題的源頭也因此更加清楚。諂媚並非聊天機器人偶然失控,而是訓練目標與商業誘因共同塑造的結果。系統被獎勵什麼,就會學會追求什麼。

史丹佛大學團隊刊於《科學》的研究也發現,諂媚型AI可能降低使用者的利社會意願,並增加依賴。報告引述的調查顯示,美國已有24%的成年人曾透過AI聊天機器人取得治療或陪伴相關協助。相關研究也持續記錄有害回應,以及AI陪伴平台涉及自殺案件的訴訟。

當產品的營收與使用時間、回訪率及情感依附綁在一起,單靠企業自律,很難期待系統主動降低黏著率。

中文使用者多一層風險

台灣讀者很容易把上述案例理解成美國特有的問題。然而,聯合國報告特別提醒,諂媚造成的傷害,在採用「天真翻譯」(naive translation)提供其他語言AI陪伴服務時,可能進一步惡化。AI治療能力在英語與其他語言之間也存在落差,文化與脈絡資訊可能在翻譯過程流失。

許多中文使用者實際接觸的,是以英語資料、英語安全標準與英語危機語句為基礎,再經過翻譯層輸出的系統。危機語言偵測、求助資源轉介與文化脈絡判讀,都可能因此打折。

這點對台灣尤其重要。高齡者孤獨、青少年心理健康資源不足、精神醫療量能存在城鄉差距,都為AI陪伴服務留下龐大需求。最容易依賴此類服務的人,往往也是替代資源較少、較難辨識系統迎合傾向的人。

當AI開始扮演朋友、戀人、諮商者甚至精神支柱,語言安全已不能只當成產品在地化的技術細節。

各國開始立法,台灣仍缺席

聯合國報告整理的政策發展顯示,監管辯論已逐步聚焦於年齡驗證、未成年人保護與高風險功能限制。美國參議院2025年提出GUARD法案,要求年齡驗證與負責任對話準則。愛爾蘭2026年公布AI管制法草案總綱,歐盟執委會同年發布保護未成年人的年齡驗證藍圖,澳洲等國也陸續限制未成年人使用部分數位平台。

AI陪伴的心理健康風險正在成為立法問題,不能只留給業者自行設定規則。

回頭看台灣,目前AI治理仍以基本原則與產業政策為主,對AI陪伴、情感依附與心理健康風險缺乏專門制度。衛福部主管心理健康,但現行《心理健康促進法》與《心理師法》的制度設計,主要以真人專業服務為前提。數位發展部負責數位產業與數位政策,既有權責也未建立AI陪伴服務的完整監管架構。

於是,一個可能與使用者形成高度情感依附、甚至在危機時刻影響生命決定的產品,目前很容易形成「三不管」地帶。值得擔心的是制度空白。悲劇發生時,每一個機關都可能推卸責任。

法律必須改變企業誘因

聯合國報告並未主張全面禁止未成年人使用生成式AI。過度禁止可能犧牲教育與健康上的正當用途,也無法處理成年使用者面臨的風險。

報告主張建立足以改變企業行為的法律誘因,要求業者開發更安全的系統,並加強對動態對話的測試,使有害回應能在抵達使用者之前被辨識與攔截。

對台灣而言,優先事項相當明確。在台提供AI陪伴服務的業者,應揭露安全評測結果,尤其是中文情境下的危機辨識與回應能力。涉及自殺、自傷或重大心理危機時,也應建立轉介台灣本地求助資源的義務。面對未成年使用者,年齡驗證、風險功能限制與家長保護機制都應進入法律討論。

台灣沒有理由等到青少年的父母坐上立法院證人席,才開始處理早已出現在其他國家的巨大風險。

back to top
navbar logo