Kimi K3 obtiene 1543 puntos Elo en el benchmark de cuello blanco; cuesta 10 veces más que K2.6

Según el benchmark AA-Briefcase actualizado de Artificial Analysis, Kimi K3 obtuvo 1543 puntos Elo, quedando solo por detrás de los 1574 de Claude Fable 5 y superando a GPT-5.6 Sol. El benchmark evalúa a los modelos en extracción de información, análisis de documentos y generación de entregables en 91 tareas confidenciales.

Sin embargo, las mejoras de rendimiento de K3 tuvieron costes significativamente más altos: 10,57 USD por tarea, aproximadamente 10 veces más que Kimi K2.6. El modelo promedió 83 iteraciones y generó 120.000 tokens por tarea, requiriendo 56,4 minutos para completarse, aproximadamente 2,5 veces más que Fable 5.

Aviso legal: La información en esta página puede provenir de fuentes de terceros y es solo para referencia. No representa las opiniones ni puntos de vista de Gate y no constituye asesoramiento financiero, de inversión ni legal. El comercio de activos virtuales implica un alto riesgo. No te bases únicamente en la información presentada en esta página para tomar decisiones. Para más detalles, consulta el Aviso legal.
Comentar
0/400
Sin comentarios