Quration Play

tech

2025年11月,Anthropic發布了新的旗艦模型,成為首個在SWE-bench Verified軟體工程基準測試中得分超過80%的AI系統。

Anthropic在2025年11月發布、突破SWE-bench 80%大關的模型是什麼?

Claude Opus 4.5
Claude Opus 4.5於2025年11月24日推出,在SWE-bench Verified上取得80.9%的分數,據報導在編碼任務上的token使用量比先前模型減少約一半。這款模型延續同年稍早推出的Sonnet 4.5與Haiku 4.5,完整了Anthropic的4.5模型系列。

正確答案是Claude Opus 4.5,Anthropic於2025年11月24日發布了這個模型,它成為首個在SWE-bench Verified基準測試中得分超過80%的AI模型,這項測試評估AI修復真實世界軟體錯誤的能力,該模型最終得分達到80.9%,而且據報導在完成類似的程式撰寫任務時,所使用的token數量大約只有先前模型的一半。

Claude Sonnet 5和Claude Haiku 5都是真實存在、能力出色的模型,但都不是在2025年11月達成這項基準里程碑的模型,身為家族中最大、能力最強的模型,是Opus率先突破80%這個門檻。

Opus 4.5的推出,完整補齊了Anthropic當年稍早陸續發布的Sonnet 4.5與Haiku 4.5,湊成完整的「4.5」系列模型,各自針對能力、速度與成本之間不同的平衡取捨而設計。

▶ Quration Play

tech

GPS實際上是如何計算裝置位置的?請問是哪個地區?谷歌在2025年3月發布的這個開放模型系列叫什麼?這款受大腦啟發的晶片大約能將AI系統的能耗降低多少?採用這種方式最重要的原因是什麼?這種數字識別碼稱為什麼?它的結構性原因是什麼?這款微軟晶片叫什麼名字?這款模型叫什麼名字?傳真機和電話,哪一個先被發明出來?誰被廣泛視為世界上第一位電腦程式設計師?網址開頭的「http」是哪幾個字的縮寫?

Quration — Quration Play