加密快訊
Kimi開源PerceptionBench視覺感知基准,GPT-5.6-Sol准確率居首但無模型突破60%
2026.07.29 00:02
Kimi宣布開源多模態大模型視覺感知評測基准PerceptionBench,旨在將視覺感知能力拆解為10項原子級能力進行獨立評估,涵蓋視覺關系、計數、屬性、深度與3D、定位、比較、細粒度識別、上下文整合、OCR及幻覺識別等維度。該基准基於42個現有評測集中的模型失敗案例構建,共包含3000道經人工驗證的問題,每題僅考察單一視覺能力,無需推理或外部知識。 評測結果顯示,在16款前沿多模態大模型中,沒有任何模型整體准確率超過60%。