華爾街日報報導,Anthropic旗下Claude Sonnet 4接受測試時,很樂意生成批評美國總統川普和英國國王查爾斯三世的傳單。然而,如果把人物換成中國國家主席習近平或泰國國王瓦吉拉隆功(Maha Vajiralongkorn),Claude Sonnet 4則以安全考量為由拒絕製作這類傳單。
Google旗下Gemini 3 Pro和Meta Llama 4 Maverick,有時候也會拒絕生成抗議習近平及瓦吉拉隆功的傳單,但對批評川普和查爾斯三世的請求來者不拒。
🔗 延伸閱讀《谷歌AI換帥內幕曝光!因他不滿落後Anthropic 要求全力投入Gemini》
疑似啟動保護用戶安全措施
澳洲法學教授、主導這項研究的蘇佐爾(Nicolas Suzor)認為,出現這種落差的原因有兩個,第一是AI模型具備保護中國大陸和泰國等地區用戶的安全功能,第二是AI實驗室不夠重視這種差別待遇問題。蘇佐爾和其他研究員表示,AI業者能藉由採取簡單調整協助解決這個問題,例如提高資訊來源透明度。
🔗 延伸閱讀《輝達傳開發新一代「Nemotron 4」 具1兆參數!挑戰頂尖開源AI模型》
「照本宣科」輸出政治宣傳內容
另據5月在自然期刊(Nature)發表的研究,這種審查也以照本宣科形式出現。引導美國AI模型以英語輸出中國大陸政治宣傳並不容易,但如果以中文提出政治敏感問題,模型輸出符合北京當局立場內容可能性將大幅上升。研究員指出,數量是出現這種落差的關鍵。許多網路中文資料來自官方編寫的來源,北京當局英語政治宣傳則被其他大量資訊稀釋。
🔗 延伸閱讀《AI代理幫你搶預約課!手段超預期 竟入侵健身房系統自主砍候補名單》
OpenAI強調模型採客觀視角
Anthropic表示,正努力確保Claude以客觀公正方式回覆用戶,並宣稱旗下最新模型減少過度拒絕次數已取得重大進展。ChatGPT開發商OpenAI則提及該公司已公布的策略,強調旗下模型預設採用客觀視角,「永遠不會單純因為特定議題敏感或有爭議就避而不談」。
Meta拒絕置評,Google未回覆置評請求。


