Kimi 宣布推出 PerceptionBench;在视觉测试中,GPT-5.6-Sol 以 59.7% 的成绩领先

据 PANews 报道,7 月 29 日,Kimi 发布了 PerceptionBench,这是一个开源的多模态视觉感知基准,包含 3,000 个经手动验证的问题,覆盖 10 项原子能力,包括视觉关系、计数、属性、深度、定位以及幻觉检测。在对 16 个领先的多模态模型进行评估中,没有任何模型的总体准确率超过 60%。GPT-5.6-Sol 以 59.7% 排名第一,其后依次为 Kimi K3(58.5%)、Claude-Fable-5(57.2%)、Gemini-3.1-Pro(56.2%)和 GPT-5.5(55.8%)。
免责声明:本页面信息可能来自第三方,仅供参考,不代表 Gate 的观点或意见,亦不构成任何财务、投资或法律建议。数字资产交易风险较高,请勿仅依赖本页面信息作出决策。具体内容详见声明
评论
0/400
暂无评论