Kimi K3 scored 1543 Elo. The reported leader scored 1574. Kimi K2.6 scored 816, showing how quickly one generation can change the race.
Kimi K3 obtuvo 1543 puntos Elo. El líder reportado obtuvo 1574. Kimi K2.6 obtuvo 816, lo que muestra cuánto puede cambiar la carrera en una generación.
Elo measures competitive performance. Distillation transfers selected behavior. Open weights and H100-equivalents describe who can adapt models and supply their compute.
Elo mide rendimiento competitivo. La destilación transfiere conductas seleccionadas. Los pesos abiertos y los equivalentes de H100 describen quién puede adaptar modelos y aportar cómputo.
Kimi K3’s reported performance spans 5 coding tests. The highest score is 88.3 and the lowest is 42. Benchmark breadth matters, but independent replication remains essential.
El rendimiento reportado de Kimi K3 abarca 5 pruebas de código. La puntuación máxima es 88,3 y la mínima es 42. La amplitud importa, pero la réplica independiente sigue siendo esencial.
Moonshot reports 1 trillion total parameters for Kimi K2. Only 32 billion are active for a token. The model also used 15.5 trillion pretraining tokens.
Moonshot reporta 1 billón de parámetros totales para Kimi K2. Solo 32.000 millones están activos para un token. El modelo también usó 15,5 billones de tokens de preentrenamiento.
Moonshot describes Kimi K3 as a 2.8-trillion-parameter model. It adds native vision and a 1-million-token context window. Those specifications make version-specific comparisons essential.
Moonshot describe Kimi K3 como un modelo de 2,8 billones de parámetros. Añade visión nativa y un contexto de 1 millón de tokens. Esas especificaciones hacen esenciales las comparaciones por versión.
Imitation data can be surprisingly cheap to generate. Stanford reported 52,000 demonstrations for under US$500. That figure covers dataset generation, not full model development.
Los datos de imitación pueden ser sorprendentemente baratos. Stanford reportó 52.000 demostraciones por menos de US$500. La cifra cubre la generación del conjunto, no el desarrollo completo.
Berkeley evaluated imitation across 5 task categories. Conversational style transferred better than factual knowledge or unfamiliar-task performance. Copying answers is not the same as learning the rule.
Berkeley evaluó la imitación en 5 categorías de tareas. El estilo conversacional se transfirió mejor que el conocimiento factual o el rendimiento en tareas nuevas. Copiar respuestas no equivale a aprender la regla.
China’s private AI investment rose rapidly through 2021. It then fell below US$10 billion in both 2023 and 2024. The 2025 value recovered to US$10.4 billion.
La inversión privada de IA de China aumentó rápido hasta 2021. Después cayó por debajo de US$10.000 millones en 2023 y 2024. El valor de 2025 se recuperó hasta US$10.400 millones.
OpenAI announced a US$40 billion round in 2025. xAI announced US$12 billion across 2 rounds in 2024. Amazon’s Anthropic commitment reached US$8 billion.
OpenAI anunció una ronda de US$40.000 millones en 2025. xAI anunció US$12.000 millones en 2 rondas de 2024. El compromiso de Amazon con Anthropic llegó a US$8.000 millones.
The secondary report places US private AI investment at US$285.9 billion. It places China at US$12.4 billion. That creates a reported 23-fold gap.
El informe secundario sitúa la inversión privada estadounidense en US$285.900 millones. Sitúa la china en US$12.400 millones. Eso crea una brecha reportada de 23 veces.
China capitalized its national semiconductor funds at about CNY139 billion, CNY204 billion and CNY344 billion. The third fund is the largest. These funds support semiconductor capacity rather than only model laboratories.
China capitalizó sus fondos nacionales de semiconductores con unos CNY139.000 millones, CNY204.000 millones y CNY344.000 millones. El tercer fondo es el mayor. Estos fondos apoyan capacidad de semiconductores, no solo laboratorios de modelos.
China’s central and local government funds deployed US$912 billion over a decade. AI was one of several strategic industries included. Alibaba with Qwen operates inside this wider capital system, but the figure is not Qwen funding.
Los fondos de los gobiernos central y locales de China desplegaron US$912.000 millones durante una década. La IA fue una de varias industrias estratégicas incluidas. Alibaba con Qwen opera dentro de este sistema, pero la cifra no es financiación de Qwen.
The United States issued 3 major control packages, with 1 in 2022, 1 in 2023 and 1 in 2024. Repeated revision shows that enforcement is a moving system rather than one permanent rule.
Estados Unidos emitió 3 grandes paquetes de control, con 1 en 2022, 1 en 2023 y 1 en 2024. La revisión repetida muestra que el control es un sistema móvil, no una regla permanente.
Epoch AI estimates a median 660,000 diverted H100-equivalents through 2025. That equals roughly one-third of China’s estimated compute. The number is modeled rather than physically counted.
Epoch AI estima una mediana de 660.000 equivalentes de H100 desviados hasta 2025. Eso equivale a cerca de un tercio del cómputo estimado de China. La cifra es modelada, no contada físicamente.
Chinese regulators reportedly targeted state-funded data centers below 30% completion. Those projects were told to remove installed foreign chips or cancel planned purchases. For Seedance from TikTok, this changes infrastructure conditions without proving any product ranking.
Reguladores chinos habrían actuado sobre centros de datos públicos con menos de 30% de avance. Esos proyectos debían retirar chips extranjeros o cancelar compras previstas. Para Seedance de TikTok, esto cambia las condiciones de infraestructura sin demostrar ningún ranking de producto.
China’s manufacturing value added rose from US$625 billion in 2004 to US$4.82 trillion in 2025. The series peaked slightly higher in 2021. This physical base matters for servers, power equipment, robotics and electronics.
El valor añadido manufacturero de China subió de US$625.000 millones en 2004 a US$4,82 billones en 2025. La serie alcanzó un pico ligeramente mayor en 2021. Esta base física importa para servidores, equipos eléctricos, robótica y electrónica.
German manufacturing value added reached US$889.6 billion in 2025. It recovered from several earlier declines. The scale remains large but is less than one-fifth of China’s 2025 level.
El valor añadido manufacturero alemán llegó a US$889.600 millones en 2025. Se recuperó de varias caídas anteriores. La escala sigue siendo grande, pero es menor que una quinta parte del nivel chino de 2025.
India’s manufacturing value added rose from US$74.6 billion in 2000 to US$532.9 billion in 2025. The long rise survived several temporary reversals. Scale is growing faster than manufacturing’s share of the economy.
El valor añadido manufacturero de India subió de US$74.600 millones en 2000 a US$532.900 millones en 2025. El aumento sobrevivió a varios retrocesos temporales. La escala crece más rápido que el peso de la manufactura en la economía.
Japan’s series peaked near US$1.25 trillion in 2012. It fell to US$788.5 billion in 2024. Exchange-rate movements are an important part of this current-dollar decline.
La serie japonesa alcanzó cerca de US$1,25 billones en 2012. Cayó a US$788.500 millones en 2024. Los movimientos del tipo de cambio explican parte importante de esta caída en dólares corrientes.
Korean manufacturing value added rose from US$158.9 billion in 2000 to US$513.5 billion in 2025. The path includes cyclical setbacks. The long direction is still upward.
El valor añadido manufacturero de Corea subió de US$158.900 millones en 2000 a US$513.500 millones en 2025. La trayectoria incluye retrocesos cíclicos. La dirección de largo plazo sigue siendo ascendente.
China’s manufacturing share declined but stayed at 24.7% in 2025. Korea reached 27.4%. The United States was at 10.5% in its latest supplied year.
La participación manufacturera de China bajó, pero se mantuvo en 24,7% en 2025. Corea llegó a 27,4%. Estados Unidos estaba en 10,5% en su último año disponible.
China’s high-technology exports reached US$856.8 billion in 2024. Germany and the United States were near US$247 billion and US$233 billion. The physical technology race is far broader than model training.
Las exportaciones chinas de alta tecnología llegaron a US$856.800 millones en 2024. Alemania y Estados Unidos rondaron US$247.000 millones y US$233.000 millones. La carrera tecnológica física es mucho más amplia que el entrenamiento de modelos.
Workers and robotic equipment make the industrial system behind the AI race tangible.
Los trabajadores y los equipos robóticos hacen tangible el sistema industrial detrás de la carrera de la IA.
Google did not stop producing frontier systems. It released 3 major Gemini generations, Gemini 1.0, 1.5 and 2.0, across 2023 and 2024. Product leadership and technical participation are different questions.
Google no dejó de producir sistemas de frontera. Lanzó 3 grandes generaciones de Gemini, Gemini 1.0, 1.5 y 2.0, entre 2023 y 2024. El liderazgo de producto y la participación técnica son preguntas distintas.
Alphabet capital expenditure rose from US$31.5 billion in 2022 to US$52.5 billion in 2024. It announced US$75 billion for 2025. Spending alone does not guarantee developer or market leadership.
El gasto de capital de Alphabet subió de US$31.500 millones en 2022 a US$52.500 millones en 2024. Anunció US$75.000 millones para 2025. El gasto por sí solo no garantiza liderazgo entre desarrolladores o en el mercado.
Meta spent US$31.4 billion in 2022 and US$39.2 billion in 2024. It forecast US$64 billion to US$72 billion for 2025. Infrastructure scale does not prove durable monetization.
Meta gastó US$31.400 millones en 2022 y US$39.200 millones en 2024. Pronosticó entre US$64.000 millones y US$72.000 millones para 2025. La escala de infraestructura no demuestra monetización duradera.
Meta reported 350 million downloads in September 2024. The count reached 650 million in December and 1 billion in March 2025. Downloads prove reach, but not active use or revenue.
Meta reportó 350 millones de descargas en septiembre de 2024. El recuento llegó a 650 millones en diciembre y a 1.000 millones en marzo de 2025. Las descargas prueban alcance, no uso activo ni ingresos.
xAI announced a US$6 billion Series B. It followed with a US$6 billion Series C. Announced cumulative financing reached about US$12 billion during 2024.
xAI anunció una Serie B de US$6.000 millones. Después presentó una Serie C de US$6.000 millones. La financiación acumulada anunciada llegó a unos US$12.000 millones durante 2024.
Nvidia reported that Colossus reached 100,000 H100 GPUs in 122 days. xAI planned an expansion to 200,000 GPUs. Fast construction still does not guarantee the best model.
Nvidia reportó que Colossus llegó a 100.000 GPU H100 en 122 días. xAI planeó una expansión a 200.000 GPU. La construcción rápida no garantiza el mejor modelo.
Mistral’s announced rounds grew from €105 million to €600 million within 12 months. The company distributes some downloadable models and sells access to others. This hybrid strategy matters more than funding scale alone.
Las rondas anunciadas de Mistral crecieron de €105 millones a €600 millones en 12 meses. La empresa distribuye algunos modelos descargables y vende acceso a otros. Esta estrategia híbrida importa más que la escala financiera por sí sola.
Stanford counted 40 notable models from US institutions in 2024. China produced 15 and Europe 3. Model counts do not capture every research or industrial strength.
Stanford contó 40 modelos destacados de instituciones estadounidenses en 2024. China produjo 15 y Europa 3. Los recuentos no capturan todas las fortalezas científicas o industriales.
Korea reached 9,472 researchers per million people in 2023. Germany, Japan and France all exceeded 5,000. China rose rapidly but remained at 2,107.
Corea alcanzó 9.472 investigadores por millón de habitantes en 2023. Alemania, Japón y Francia superaron 5.000. China creció rápido, pero permaneció en 2.107.
DeepSeek-V3 disclosed US$5.576 million for final compute runs. Pretraining accounted for US$5.328 million. The total excludes data, staff, prior models and wider organizational development.
DeepSeek-V3 divulgó US$5,576 millones para ejecuciones finales de cómputo. El preentrenamiento representó US$5,328 millones. El total excluye datos, personal, modelos anteriores y desarrollo organizacional más amplio.
Nvidia fell about 17% on January 27, 2025. Broadcom fell 17.4% and the Nasdaq Composite 3.1%. Investors treated DeepSeek’s efficiency as a threat to incumbent economics.
Nvidia cayó cerca de 17% el 27 de enero de 2025. Broadcom cayó 17,4% y el Nasdaq Composite 3,1%. Los inversionistas trataron la eficiencia de DeepSeek como una amenaza para la economía de los líderes.
Qwen2.5 offers 7 dense-model sizes from 0.5 billion to 72 billion parameters. The wider Qwen ecosystem covers text, code, mathematics, vision and audio. Breadth supports adoption without proving leadership in every category.
Qwen2.5 ofrece 7 tamaños de modelos densos, de 0,5 a 72 mil millones de parámetros. El ecosistema más amplio cubre texto, código, matemáticas, visión y audio. La amplitud favorece la adopción sin demostrar liderazgo en cada categoría.
The IEA estimates data centers consumed about 415 TWh in 2024. It projects about 945 TWh in 2030. Power, cooling and construction can constrain model deployment.
La IEA estima que los centros de datos consumieron unos 415 TWh en 2024. Proyecta cerca de 945 TWh en 2030. La energía, la refrigeración y la construcción pueden limitar el despliegue.
Frontier training compute historically grew at about 4 times per year. The exact rate depends on the period and sample. Sustaining that pace pushes pressure onto chips, power and capital.
El cómputo de entrenamiento de frontera creció históricamente unas 4 veces al año. La tasa exacta depende del período y la muestra. Sostener ese ritmo presiona chips, energía y capital.
One scenario shrinks the open-versus-closed gap to 25. Another raises inference demand to 550. China’s open-weight release index reaches 190 in the same illustrative horizon.
Un escenario reduce la brecha entre modelos abiertos y cerrados a 25. Otro eleva la demanda de inferencia a 550. El índice chino de lanzamientos abiertos llega a 190 en el mismo horizonte ilustrativo.
The illustrative deployment share rises from 30% to 55%. That would make execution more important than model access alone. The values are scenario assumptions rather than measured outcomes.
La participación ilustrativa del despliegue sube de 30% a 55%. Eso haría que la ejecución importara más que el acceso al modelo por sí solo. Los valores son supuestos de escenario, no resultados medidos.
Una generación de Moonshot borró 727 puntos Elo de distancia. Las puntuaciones describen solo una capa del poder de la IA.
Hallazgos clave
DeepSeek-V3 reportó 5,576 millones de dólares de cómputo para ejecuciones finales, excluyendo costos más amplios de desarrollo. DeepSeek-AI
El 27 de enero de 2025, Nvidia cayó cerca de 17%, Broadcom 17,4% y el Nasdaq Composite 3,1%. Nasdaq
Epoch AI estima que, hasta 2025, se introdujeron clandestinamente en China unas 660.000 unidades equivalentes a H100, cerca de un tercio de su cómputo total. epochai.substack.com
El lanzamiento, arquitectura, licencia y benchmarks de Kimi K3 siguen sin verificar sin una publicación primaria fechada de Moonshot AI. Moonshot AI
Moonshot reporta que Kimi K2 tiene 1 billón de parámetros totales, 32.000 millones activos y 15,5 billones de tokens de preentrenamiento. Moonshot AI
OpenAI anunció una ronda de 40.000 millones en 2025, frente a 12.000 millones en dos rondas de xAI y 8.000 millones comprometidos por Amazon a Anthropic. OpenAI
Stanford reporta inversión privada de IA en 2024 de 109.100 millones en Estados Unidos, 9.300 millones en China y 4.500 millones en Reino Unido. Stanford HAI
Nvidia reportó que xAI construyó un clúster Colossus de 100.000 H100 en 122 días y planeó ampliarlo a 200.000 GPU. Nvidia
Stanford contó 40 modelos destacados de instituciones estadounidenses en 2024, frente a 15 de China y tres de Europa. Stanford HAI
Los claims de ranking, precio, resolución y duración de Seedance requieren verificación contra una versión exacta y fechada. ByteDance Seed
La IEA estima que los centros de datos consumieron unos 415 TWh en 2024 y proyecta aproximadamente 945 TWh en 2030. International Energy Agency
Epoch AI estima que el cómputo de entrenamiento de frontera creció históricamente cerca de cuatro veces al año, aunque depende del período y la muestra. Epoch AI
El argumento
Kimi K3 parece amplio, pero cada benchmark evalúa algo distinto.
El diseño disperso de Kimi K2 separa la escala total del cómputo activo.
Kimi K3 tiene 2,8 billones de parámetros y un contexto de 1 millón de tokens.
Stanford generó 52.000 demostraciones de Alpaca por menos de US$500.
En 5 categorías de tareas, la imitación transfirió el estilo con mayor fiabilidad que la factualidad.
La ventaja financiera estadounidense se amplió drásticamente después de 2024.
Esta investigación se publica en inglés y español. Read in English