2,8 billones de parámetros. 1 millón de contexto de tokens. Multimodal nativo.


Kimi Delta Attention ofrece hasta 6,3x más rapidez en el decodificado en contextos de un millón de tokens, reduciendo la memoria del KV-cache en hasta un 75% en el proceso.
Attention Residuals ofrece aproximadamente un 25% más de eficiencia de entrenamiento con un coste computacional adicional de menos del 2%.
Diseñado para la codificación agentic de largo horizonte y flujos de trabajo autoevolutivos, manteniendo sesiones de ingeniería largas con una supervisión humana mínima.
Ver original
post-image
post-image
Esta página puede contener contenido de terceros, que se proporciona únicamente con fines informativos (sin garantías ni declaraciones) y no debe considerarse como un respaldo por parte de Gate a las opiniones expresadas ni como asesoramiento financiero o profesional. Consulte el Descargo de responsabilidad para obtener más detalles.
  • Recompensa
  • Comentar
  • Republicar
  • Compartir
Comentar
Añadir un comentario
Añadir un comentario
Sin comentarios
  • Fijado