Kimi K3 alcança 1543 Elo nos testes para profissionais e custa 10 vezes mais do que o K2.6.

De acordo com o benchmark AA-Briefcase atualizado da Artificial Analysis, o Kimi K3 atingiu 1543 pontos Elo, ficando apenas atrás dos 1574 pontos do Claude Fable 5 e ultrapassando o GPT-5.6 Sol. O benchmark avalia os modelos na extração de informação, na análise de documentos e na geração de entregáveis em 91 tarefas confidenciais.

No entanto, os ganhos de desempenho do K3 surgiram a um custo significativamente mais elevado: 10,57 dólares por tarefa, aproximadamente 10 vezes mais do que o Kimi K2.6. O modelo fez uma média de 83 iterações e gerou 120.000 tokens por tarefa, exigindo 56,4 minutos até à conclusão — cerca de 2,5 vezes mais do que o Fable 5.

Aviso legal: As informações contidas nesta página podem provir de fontes externas e têm caráter meramente informativo. Não refletem os pontos de vista nem as opiniões da Gate e não constituem qualquer tipo de aconselhamento financeiro, de investimento ou jurídico. A negociação de ativos virtuais envolve um risco elevado. Não se baseie exclusivamente nas informações contidas nesta página ao tomar decisões. Para mais detalhes, consulte o Aviso legal.
Comentar
0/400
Nenhum comentário