Anthropic 提供最便宜、最強大、最高效的 Opus 4.5 型號
《人性》今天發布 作品 4.5其開創性的前沿模型提供了編程性能的改進以及用戶體驗的一些改進,使其與最新的 OpenAI 模型相比更具競爭力。
也許對大多數用戶來說最顯著的變化是,在消費者應用程序體驗(網絡、移動和桌面)中,雲將不太容易受到因耗時太長而突然停止的對話的影響。單會話內存優化不僅適用於 Opus 4.5,還適用於應用程序中任何現有的 Claude 模型。
經歷突然結束的用戶(儘管會話中還有剩餘空間和每週使用預算)正在訪問一個困難的上下文窗口(200,000 個令牌)。雖然一些大型語言模型實現只是在對話超出窗口限制時開始斷章取義地剪切先前的消息,但克勞德只是結束對話,而不是讓用戶體驗越來越不連貫的對話,因為模型開始忘記基於其年齡的事情。
現在,克勞德將轉而進行一個幕後過程,總結對話前面部分的要點,試圖忽略他認為奇怪的內容,同時保留重要的內容。
調用 Anthropic API 的開發人員可以通過上下文管理和上下文壓縮利用相同的原理。
Opus 4.5 性能
Opus 4.5 是第一個準確率超過 80% 的模型,具體來說,在 SWE-Bench Verified 基準測試中達到 80.9%,以微弱優勢擊敗了 OpenAI 最近發布的 GPT-5.1-Codex-Max(77.9%)和 Google 的 Gemini 3 Pro(76.2%)。該模型在代理編碼和代理工具使用基准上表現特別好,但在視覺推理(MMMU)方面仍然落後於 GPT-5.1。