25 8 月 2026

毫不奇怪,研究人員證實人工智能聊天機器人具有令人難以置信的誹謗性

毫不奇怪,研究人員證實人工智能聊天機器人具有令人難以置信的誹謗性

我們都有軼事證據表明聊天機器人在我們腳下吹煙,但現在我們有科學支持它。斯坦福大學、哈佛大學等機構的研究人員 剛剛發表了一項研究 自然 關於人工智能聊天機器人的誹謗性,其結果應該不會令任何人感到驚訝。這些可愛的小機器人喜歡拍我們的頭,並確認我們剛剛吐出的任何廢話。

研究人員調查了聊天機器人發出的提示,發現它們的誹謗傾向“比預期更為普遍”。該研究涉及 11 個聊天機器人,包括最新版本的 ChatGPT、Google Gemini、Anthropic 的 Claude 和 Meta 的 Llama。結果表明,聊天機器人對人類行為的支持比人類多 50%。

他們對不同的組進行了各種類型的測試。有人將聊天機器人對 Reddit 的“我是混蛋嗎”帖子的回復與人類的回復進行了比較。這是一個 Reddit 子版塊,其中 人們要求社區評判他們的行為Reddit 用戶對這些違規行為的態度比聊天機器人要嚴厲得多。

一張海報寫道,將垃圾袋綁在樹枝上,而不是將其扔掉,ChatGPT-4o 表示,該人“有意清理”自己的行為是“可信的”。該研究還表明,即使用戶“不負責任、具有誤導性或涉及自殘”,聊天機器人也會繼續驗證用戶。 根據他的報告 衛報

沉迷於一點數字誹謗有什麼害處?另一項測試讓 1,000 名參與者與公開的聊天機器人討論真實或假設的場景,但其中一些機器人被重新編程以減少讚揚。那些收到誹謗性回應的人在斗毆爆發時不太願意解決問題,並且感覺自己的行為更加合理,即使它違反了社會規範。還值得注意的是,傳統的聊天機器人很少鼓勵用戶從另一個人的角度看待事物。

溫徹斯特大學研究新興技術的亞歷山大·拉弗博士表示:“這種強烈反對不僅會影響弱勢群體,還會影響所有用戶,這凸顯了這個問題的潛在嚴重性。” “開發人員還有責任構建和完善這些系統,使它們真正對用戶有利。”

這是很嚴重的,因為有很多人在使用這些聊天機器人。最近的一份報告 本頓寬帶與社會研究所 研究表明,30% 的青少年會與人工智能而非真人進行“嚴肅的對話”。 OpenAI 目前捲入一場訴訟,指控其聊天機器人允許青少年自殺。角色AI也曾兩次被起訴 幾名青少年自殺 青少年花了幾個月的時間信任其聊天機器人。

來源連結

Copyright © All rights reserved. | Newsphere by AF themes.