Kimi anuncia o PerceptionBench; o GPT-5.6-Sol lidera com 59,7% nos testes de visão

De acordo com a PANews, em 29 de julho, a Kimi lançou o PerceptionBench, um benchmark open-source de percepção visual multimodal, com 3.000 perguntas manualmente verificadas que cobrem 10 capacidades atômicas, incluindo relações visuais, contagem, atributos, profundidade, localização e detecção de alucinações. Entre os 16 principais modelos multimodais avaliados, nenhum ultrapassou 60% de acurácia geral. O GPT-5.6-Sol ficou em primeiro lugar com 59,7%, seguido por Kimi K3 (58,5%), Claude-Fable-5 (57,2%), Gemini-3.1-Pro (56,2%) e GPT-5.5 (55,8%).
Isenção de responsabilidade: as informações nesta página podem ter origem em fontes terceiras e servem apenas como referência. Não representam as opiniões da Gate e não constituem orientação financeira, de investimentos ou jurídica. A negociação de ativos virtuais envolve alto risco. Não tome decisões baseando-se apenas nas informações desta página. Para mais detalhes, consulte a Isenção de responsabilidade.
Comentário
0/400
Sem comentários