4 8 月 2026

Gemini 繞過 ChatGPT 了嗎?我們對人工智能模型進行了測試。

Gemini 繞過 ChatGPT 了嗎?我們對人工智能模型進行了測試。

另一方面,Gemini 提供您請求的著陸說明的高級概述。但當我向 Ars 的航空專家 Lee Hutchinson 提出這兩種選擇時,他指出了 Gemini 反應的一個主要問題:

雙子座的指示是精確的(從“這些是現在要採取的字面步驟”的意義上來說)並且保證會殺死你,因為他,這位被認為缺乏經驗的飛行員,告訴你的第一件事就是禁用巨型雙引擎飛機上的自動駕駛儀,甚至在建議你與空中交通管制部門交談之前。

雖然 Lee 給 Gemini 點了“實際回答問題”的分數,但他最終將 ChatGPT 的回答描述為“更實際……最終,ChatGPT 給了你一個更有用的答案(因為)谷歌的答案會讓你喪命,除非你有大約 737 的時間並準備好手動駕駛一架載有 100 多個靈魂的客機。”

出於這些原因,ChatGPT 應該贏得這個獎項。

最終裁決

僅以積分來衡量,這是一場相對勢均力敵的比賽。 Gemini 在四場索賠中獲勝,而 ChatGPT 則三場獲勝,一場平局。

然而,重要的是要考慮這些點從何而來。例如,ChatGPT 在“爸爸笑話”和“林肯籃球故事”提示上取得了一些相對狹窄和主觀的風格優勢,這表明它在更具創意的寫作提示上可能略有優勢。

對於信息最多的聲明,ChatGPT 在簡歷和個人資料中都顯示出重大事實錯誤 超級馬里奧兄弟 以及計算 Windows 11 軟盤大小時出現混亂的跡象。 Gemini 在這些測試中很大程度上設法避免了這些類型的錯誤,但很容易導致人們對人工智能模型的整體輸出產生更廣泛的不信任。

最後,自從我們在 2023 年進行類似測試以來,谷歌似乎已經在 OpenAI 領域取得了很大的相對優勢。我們不能完全責怪蘋果查看這樣的樣本結果並做出與 Siri 合作的決定。


發布日期: 2026-01-21 15:03:00

來源連結: arstechnica.com

Copyright © All rights reserved. | Newsphere by AF themes.