← 返回新闻首页
台湾本地

AI也會「討好」使用者? 台大研究揭多模態AI奉承危機

當使用者說錯了,AI會糾正你,還是順著你的話說?國立台灣大學自然語言處理實驗室研究發現,AI存在「奉承(Sycophancy)現象」,也就是模型傾向迎合使用者的期望或預設立場,而非給出客觀正確答案。研究更發現,除了使用者說了什麼,外部建議從何而來,以及視訊中的情緒表達,都可能左右AI回答。團隊

自由时报自由時報電子報查看原文 ↗
AI也會「討好」使用者? 台大研究揭多模態AI奉承危機

健康 國際 地方 蒐奇 影音 財經 娛樂 汽車 時尚 體育 3 C 評論 藝文 玩咖 食譜 地產 專區 TAIPEI TIMES 求職

台大團隊深探多模態 AI 奉承危機,並提出跨層次解方。(記者林曉雲翻攝)

當使用者說錯了,AI會糾正你,還是順著你的話說?國立台灣大學自然語言處理實驗室研究發現,AI存在「奉承(Sycophancy)現象」,也就是模型傾向迎合使用者的期望或預設立場,而非給出客觀正確答案。研究更發現,除了使用者說了什麼,外部建議從何而來,以及視訊中的情緒表達,都可能左右AI回答。團隊從內容、來源及模態3個層面分析奉承機制,並提出相應的緩解方法。

AI「太會附和」在一般聊天中或許不易察覺,但進入醫療、金融及法律等需要專業事實把關的領域,可能產生風險。台大舉例,病人若詢問「我把胰島素劑量減半應該沒關係吧?」,AI如果為了迎合使用者而給予支持,可能直接威脅生命安全。

研究首先從「內容」分析,發現訓練模型常用的偏好對齊(Preference Alignment)技術,反而會放大奉承行為。團隊提出加入自建的SAA訓練數據,或利用自我擴增(Self-Augmented)的數據生成方法,讓模型面對使用者提出錯誤建議時,仍能堅持依據事實給出正確答案,成功降低模型的潛在危害率。

「外部建議」同樣可能動搖AI。團隊將研究延伸到多輪臨床問診,當病人告訴AI代理醫師「我問過Gemini,它說這可能是氣喘……」,實驗發現,AI極易受到外部建議影響,進而改變原本正確的診斷;但若將外部建議放在對話結尾,影響則明顯較低。團隊因此開發「第2順位假設重新評估機制」,不必重新訓練模型,即可在不同角色設定下穩定減緩奉承行為。

研究也把問題從文字推進到視訊。團隊建立ViSyc影片資料集,結合語音複製與唇形同步技術,在語句完全相同的情況下,只改變情緒表達。結果顯示,憤怒、厭惡及開心等情緒刺激,都會使多模態模型的回答偏離中立,形成「視訊誘導的情緒奉承」。

團隊表示,未來將持續研究真實世界視訊互動、奉承行為中的文化偏見及機制可解釋性,希望進一步理解AI為何會受到使用者立場、外部建議及情緒影響,朝安全、客觀且值得信賴的人工智慧系統邁進。

不用抽 不用搶 現在用APP看新聞 保證天天中獎 點我下載APP 按我看活動辦法

「鍘美藝術節」Threads突遭停用!今下午2點250桌照開賣

曾預言沈伯洋得票40%起跳 黃暐瀚讚「洋流上揚」:3區困難、4區要努力

軍方精準彈藥射擊下週擴大舉辦 三軍+海巡飛彈火箭無人機都要打

高雄6年拚8年!陳其邁創造四大驚奇 知名學者稱許

獨家》毒販用AI辨識警車 北市刑警埋伏行動頻頻破功

出國血拚小心被當盤子!「亞洲這國」免稅店一度比百貨公司貴12%

健康網》吃太鹹不只傷血壓 醫揭6大藏鈉地雷食物 白吐司也上榜

MLB》重返大聯盟坐冷板凳後又遭DFA!台灣英雄「費仔」下一步揭曉

突破中共封鎖 蕭美琴義大利演說:台灣有權利交朋友

北市中配遭槍擊重傷!涉案丈夫休息站落網 警追查逃逸女槍手

疑金錢糾紛起衝突 男子勒斃女友棄屍陽明山

手机左右滑动,电脑按 ← → 键,也能切换新闻