Kimi presenta PerceptionBench; GPT-5.6-Sol lidera con un 59,7% en pruebas de visión

Según PANews, el 29 de julio, Kimi presentó PerceptionBench, un banco de pruebas de percepción visual multimodal de código abierto con 3.000 preguntas verificadas manualmente que cubren 10 capacidades atómicas, incluidas relaciones visuales, conteo, atributos, profundidad, localización y detección de alucinaciones. Entre 16 modelos multimodales líderes evaluados, ninguno superó el 60% de precisión general. GPT-5.6-Sol obtuvo el primer lugar con 59,7%, seguido por Kimi K3 (58,5%), Claude-Fable-5 (57,2%), Gemini-3.1-Pro (56,2%) y GPT-5.5 (55,8%).
Aviso legal: La información en esta página puede provenir de fuentes de terceros y es solo para referencia. No representa las opiniones ni puntos de vista de Gate y no constituye asesoramiento financiero, de inversión ni legal. El comercio de activos virtuales implica un alto riesgo. No te bases únicamente en la información presentada en esta página para tomar decisiones. Para más detalles, consulta el Aviso legal.
Comentar
0/400
Sin comentarios