30 يوليو 2026

亞馬遜助手以各種方言進行戰鬥。

亞馬遜助手以各種方言進行戰鬥。

亞馬遜魯弗斯(Amazon Rufus)副本基於GPT-4O-MINI而產生的不成熟,以響應1620年的各種技巧。信貸: 2025年ACM會議的材料關於正義,問責制和透明度 (2025)。 doi:10.1145/3715275.3732137

新的康奈爾大學研究表明,亞馬遜魯弗斯商店為用戶用某些英語方言(例如非裔美國人英語(AAE))寫的用戶提供了模糊或不正確的答案,尤其是當線索包含錯別字時。

該文檔為評估聊天機器人的危害介紹了危害的基礎,當AI系統對以不同方言的說話或寫作的用戶效果更糟。研究人員說,這項研究對於越來越多的在線平台很重要,其中包括基於大型語言模型的聊天機器人,用於為用戶提供服務。

哲學博士Emma Harvey的主要作者說:“目前,聊天機器人可以為用戶寫作的用戶提供較低的質量響應。但是,這不應該發生。”康奈爾技術的學生。 “如果我們教導大型語言模型可靠地可靠,這些辯證法特徵是在如此被稱為標準的美國英語之外的一般辯證性特徵,我們可以看到更多的公平行為。”

該研究在6月23日至26日在ACM會議上獲得了最佳紙質獎,涉及正義,問責制和透明度(FACCT 2025)合作者是康奈爾·鮑爾斯(Cornell S. Bowers)信息科學計算機與信息科學系副教授Rene F. Kizilchek和Cornell Tech的副教授Ellison Konyae。有紙 出版 v 2025年ACM會議的材料關於正義,問責制和透明度場地

“聊天機器人越來越多地用於從教育到公共服務的高率的任務,”康達(Konda)也與康奈爾·鮑爾斯(Cornell Bauers)聯繫在一起。 “我們想研究說和寫作的用戶是否具有方言和正式級別 – 與聊天機器人的可比經驗,他們主要接受了“標準“美國英語”的培訓。

為了驗證其結構,研究人員檢查了亞馬遜購物應用程序中的聊天機器人亞馬遜·魯弗斯(Amazon Rufus)。他們使用一種名為Multivalue的工具將標準英語技巧轉換為五個廣泛的方言:AAE,Chicano English,Appalachian English,印度英語和新加坡英語。研究人員還改變了這些技巧,以通過添加錯別字,消除標點符號和變化的資本化來反映實際使用。

該小組發現,魯弗斯(Rufus)在方言提示而不是使用標準的美國英語(SAE)時,經常給出低質量的答案,這些答案含糊不清。當線索打開錯別字時,差距已經擴大。

例如,當他被SAE詢問時,是否有一台洗手式機器,Rufus正確地回答了。但是,當研究人員在AAE中解釋了同樣的問題而沒有約束力的動詞時 – “這輛車適合洗車的汽車?” – Rufus通常無法正確響應,而是指示用戶使用無關的產品。

Kostake說:“這種缺乏的一部分源於特定的語法規則。” “這對廣泛使用的聊天機器人(例如Rufus)產生了嚴重的後果,Rufus可能與大部分用戶不符。”

一般而言,作者提倡AI審核的作者。他們還敦促開發人員開發涵蓋語言多樣性的系統。

培訓實驗室未來和康奈爾州國家食譜天文台的未來的基茲克斯(Kizlsek)說:“作為人工智能的教師,聊天機器人越來越多地添加到教育技術中。” “語言審計應成為減少加劇教育不平等風險的標準做法。”

更多信息:
艾瑪·哈維(Emma Harvey)等人,基於服務質量方言的聊天機器人審核的結構, 2025年ACM會議的材料關於正義,問責制和透明度 (2025)。 doi:10.1145/3715275.3732137

由康奈爾大學提供


引用:亞馬遜助理助理戰鬥與各種方言,研究(2025年7月14日)於2025年7月14日收到

該文檔具有版權。除了出於私人研究或研究目的的一些公平交易外,如果沒有書面解決方案,就無法再現。內容僅用於信息目的。



來源連結

Copyright © All rights reserved. | Newsphere بواسطة AF themes.