Kimi K3 alcança 1543 Elo no benchmark para profissionais da área branca, custa 10 vezes mais do que K2.6

De acordo com o benchmark AA-Briefcase atualizado da Artificial Analysis, o Kimi K3 atingiu 1543 pontos de Elo, ficando apenas atrás dos 1574 pontos do Claude Fable 5 e superando o GPT-5.6 Sol. O benchmark avalia os modelos em extração de informações, análise de documentos e geração de entregáveis em 91 tarefas confidenciais.

No entanto, os ganhos de desempenho do K3 vieram com custos significativamente mais altos: US$ 10,57 por tarefa, cerca de 10 vezes o do Kimi K2.6. O modelo teve uma média de 83 iterações e gerou 120.000 tokens por tarefa, levando 56,4 minutos para concluir — aproximadamente 2,5 vezes mais tempo que o Fable 5.

Isenção de responsabilidade: as informações nesta página podem ter origem em fontes terceiras e servem apenas como referência. Não representam as opiniões da Gate e não constituem orientação financeira, de investimentos ou jurídica. A negociação de ativos virtuais envolve alto risco. Não tome decisões baseando-se apenas nas informações desta página. Para mais detalhes, consulte a Isenção de responsabilidade.
Comentário
0/400
Sem comentários