Haiku 5.5獨立評測43分:遥遙領先 GPT-6 Luna,但最高檔 Token 消耗超3倍
2026-10-09 01:03:33
幣界網消息,第三方評測機構 Artificial Analysis 公布 Haiku 5.5的測試結果,該模型在綜合智能指數中獲得43分,比上一代的17分提高26分,超過 GPT-6 Luna 的38分和 GLM-5.3 Flash 的42分,接近 Kimi K3 的44分。 Haiku 5.5在最高推理強度下每項評測任務平均輸出約16.2萬 Tokens,是 GPT-6 Luna 的3.2倍,预估單任務成本約0.21美元, Luna 為0.07美元。降低推理強度後, Haiku 5.5在高端獲得38分,平均每項任務輸出約5.5萬 Tokens,與 GPT-6 Luna 接近。在 AutomationBench-AA 自動化任務評測中, Haiku 5.5僅得35%,落後於 Luna 的53%。測試期間模型存在過度拒絕執行任務的問題, Anthropic 正在修復, Artificial Analysis 計劃重新測試。
來源:互聯網
本內容只為提供市場資訊,不構成投資建議。
關注HQYC官方帳號,及時關注最新動態









