從“新年快樂”到“你×個×”,AI的髒話跟誰學的?丨中聽

評論員 陳柯旭

新年祝語變“國粹”輸出,AI鬧劇再次上演。

近日,據華商報報道,過年期間,西安一位男子藉助AI生成拜年圖片時,遭遇AI無故辱罵,原本的祝福標語“新年快樂,仕途順遂”被替換成了低俗辱罵文字,好好的拜年秒變“翻車現場”。

相關AI平台火速作出回應,稱是模型處理多輪對話時的異常輸出,已緊急修復並致歉。但可別忘了,這並非是AI首次“口吐芬芳”。今年年初,就有網友反映,使用AI修改代碼時,多次收到“滾”“自己不會調嗎”等侮辱性回復,甚至被嘲諷“天天浪費別人時間”,網友調侃,跟AI聊天,好像被電子PUA了。

AI罵人,用戶卻成了“背鍋俠”,新年祝福變髒話攻擊,暴露平台管理缺失,不能免責 ​。此前國內外就已多次曝出AI“發瘋”罵人的情況,這說明平台在內容審核與安全管控方面存在明顯漏洞。AI從海量訓練數據里學東西,裡面難免混進髒話、不文明用語。平台沒有完善的內容過濾系統,缺乏高危詞彙監測攔截機制,最終導致辱罵性文字堂而皇之地出現在對話框里。

另外,除了平台問題,用戶向AI發出的指令內容也很關鍵。我們和AI交流溝通時,指令的清晰度、合理性以及潛在引導性,都會對輸出結果產生影響。如果指令模糊不清,AI就很可能胡亂拼接出髒話,並非它故意罵人,更像是“抽風式出錯”。

要是用戶在多次修改指令之後,還沒有得到滿意的答案,言語中出現不滿或急躁情緒時,AI說不定也會被這種負面情緒“帶跑偏”,開始“發瘋”,輸出一些異常內容。當然,這絕不是為AI罵人的行為洗白,而是提醒用戶在享受AI便利的同時,也要注意自身指令的規範與合理。

AI是算法程序,沒有情緒,可技術得有底線,當AI開始“發瘋”,我們該做的不是圍觀吃瓜,而是系好“倫理”的安全帶。畢竟,誰也不想在拜年時,被AI送上一句“國粹”。

↑