Cohere 推出24亿個視覺小模型:文檔理解能力超過 Ministral 的33億個
2026-08-13 15:55:53
幣界網消息,Cohere 公開了目前自家最小的視覺語言模型 north micro vision,參數為 2.4B,採用 Apache 2.0 许可。該模型主要處理文檔、表格、圖表、截圖等內容,能夠直接處理原始比例和分辨率的圖片,無需先進行壓縮。在官方測試中,該模型的得分達到 92.1%,超過了 Ministral 33B 模型的 89.6% 以及 Gemma 4 E2B 的 73.2%。在視覺定位方面的得分為 73.2%,同樣高於 Ministral 和 Gemma。雖然它在文檔理解和視覺定位上表現優異,但並非同尺寸模型中的最強者,在多數通用視覺任務、OCR 以及多模態基準測試中,Qwen3.5-2B 仍然更強。
來源:互聯網
本內容只為提供市場資訊,不構成投資建議。
關注HQYC官方帳號,及時關注最新動態









