Kimi K3 enters at 2.8 trillion parameters, more than 4 times DeepSeek-V3's total count. Yet DeepSeek reported that its 32 billion parameter distilled model beat V3 on several reasoning benchmarks. That tension defines this race: scale still matters, but transferring useful behavior can radically change the economics.
Kimi K3 llega con 2,8 billones de parámetros, más de 4 veces el total de DeepSeek-V3. Sin embargo, DeepSeek informó que su modelo destilado de 32.000 millones superó a V3 en varias pruebas de razonamiento. Esa tensión define la carrera: la escala importa, pero transferir comportamiento útil puede cambiar radicalmente la economía.
Parameter count describes scale, not intelligence by itself. Distillation can move useful behavior into smaller models. Open weights let outsiders build on a model directly. Frontier describes the leading capability zone, not a permanent title.
El número de parámetros describe escala, no inteligencia por sí solo. La destilación puede trasladar comportamiento útil a modelos menores. Los pesos abiertos permiten que terceros construyan directamente sobre un modelo. Frontera describe la zona de capacidad líder, no un título permanente.
Stanford counted 40 notable US models in 2024, compared with 15 from China and three from France. Counts do not prove equal quality, but they show the depth of the development pipeline. China is no longer represented by one surprising laboratory.
Stanford contó 40 modelos estadounidenses destacados en 2024, frente a 15 chinos y tres franceses. Los conteos no prueban igual calidad, pero muestran la profundidad del desarrollo. China ya no está representada por un solo laboratorio sorprendente.
The 2026 Stanford AI Index reportedly placed the best US-China model gap at 2.7%. In May 2023, the reported benchmark gaps ranged from 17.5 to 31.6 percentage points. Benchmarks cannot settle the whole race, but the direction is unmistakable: the measured gap narrowed sharply.
El Índice de IA 2026 de Stanford situó supuestamente la brecha entre los mejores modelos de EE. UU. y China en 2,7%. En mayo de 2023, las brechas comunicadas variaban entre 17,5 y 31,6 puntos porcentuales. Las pruebas no resuelven toda la carrera, pero la dirección es clara: la brecha medida se redujo con fuerza.
DeepSeek-R1 did not arrive as one fixed product. It published six distilled checkpoints from 1.5 billion to 70 billion parameters. That makes a frontier technique available across a 47-fold size range without requiring every user to run the original system.
DeepSeek-R1 no llegó como un producto único. Publicó seis versiones destiladas desde 1.500 millones hasta 70.000 millones de parámetros. Esto hace disponible una técnica de frontera en un rango de tamaño de 47 veces sin exigir que cada usuario ejecute el sistema original.
A model release can create more than users. It can create descendants. A March 2026 USCC report said Qwen had surpassed 100,000 derivatives on Hugging Face, giving Alibaba's ecosystem a distribution advantage that no single benchmark captures.
El lanzamiento de un modelo puede crear más que usuarios. Puede crear descendientes. Un informe de la USCC de marzo de 2026 indicó que Qwen había superado los 100.000 derivados en Hugging Face, dando al ecosistema de Alibaba una ventaja de distribución que ninguna prueba aislada captura.
The US response is not limited to model laboratories and datacenters. By July 2025, Commerce had provided incentive awards to 19 companies for 40 semiconductor-facility projects, according to GAO. The race is rebuilding physical capacity beneath the software layer.
La respuesta estadounidense no se limita a laboratorios de modelos y centros de datos. Hasta julio de 2025, Comercio había otorgado incentivos a 19 empresas para 40 proyectos de instalaciones de semiconductores, según la GAO. La carrera está reconstruyendo capacidad física bajo la capa de software.
The competition over models and infrastructure ultimately depends on access to physical chips.
La competencia por modelos e infraestructura depende en última instancia del acceso a chips físicos.
Private AI funding databases capture only part of China's support system. Stanford SCCEI says central and local government venture funds channeled $912 billion into strategic industries including AI over a decade. China also registered a third semiconductor Big Fund with 344 billion yuan in capital in 2024.
Las bases de inversión privada en IA capturan solo una parte del sistema chino. Stanford SCCEI señala que fondos de gobiernos centrales y locales canalizaron US$912.000 millones hacia industrias estratégicas, incluida la IA, durante una década. China también registró en 2024 un tercer Gran Fondo semiconductor con 344.000 millones de yuanes.
Strategic capital matters because the AI race rests on a broader semiconductor and manufacturing base.
El capital estratégico importa porque la carrera de la IA se apoya en una base más amplia de semiconductores y manufactura.
Japan remains the largest manufacturer in this group, but India has grown from $61 billion in 1990 to $595 billion in 2025. Germany ended 2025 at $704 billion, leaving a much narrower gap. South Korea also reached $547 billion, showing why the rest of Asia remains essential to the technology supply chain.
Japón sigue siendo el mayor fabricante de este grupo, pero India pasó de US$61.000 millones en 1990 a US$595.000 millones en 2025. Alemania terminó 2025 en US$704.000 millones, dejando una brecha mucho menor. Corea del Sur también alcanzó US$547.000 millones, mostrando por qué el resto de Asia sigue siendo esencial para la cadena tecnológica.
Manufacturing represented 24.7% of China's GDP in 2025 and 27.4% of South Korea's. Germany and Japan ended below 19%, while India stood at 13.5%. China has become more service-heavy over time, but its industrial base remains unusually deep for an economy of its scale.
La manufactura representó el 24,7% del PIB chino en 2025 y el 27,4% del surcoreano. Alemania y Japón terminaron por debajo del 19%, mientras India quedó en 13,5%. China se ha orientado más hacia los servicios, pero su base industrial sigue siendo inusualmente profunda para una economía de su escala.
China installed 276,288 industrial robots in 2023. That was 51% of the global total. This scale helps lower the cost of producing hardware and deploying automation, even though it cannot replace access to the most advanced chips.
China instaló 276.288 robots industriales en 2023. Eso representó el 51% del total mundial. Esta escala ayuda a reducir el costo de producir hardware y desplegar automatización, aunque no puede sustituir el acceso a los chips más avanzados.
UNIDO estimated that China's share of global manufacturing value added rose from roughly 19% in 2010 to about 31% in 2022. That industrial base can make AI hardware, robots and supporting equipment cheaper at scale. It still does not erase the frontier semiconductor bottleneck.
ONUDI estimó que la cuota china del valor agregado manufacturero mundial aumentó de cerca del 19% en 2010 a aproximadamente el 31% en 2022. Esa base industrial puede abaratar a escala hardware de IA, robots y equipos de apoyo. Aun así, no elimina el cuello de botella de semiconductores de frontera.
Meta said Llama downloads rose from 350 million in September 2024 to one billion by March 2025. Downloads are not the same as active users, but they reveal unusually rapid distribution. Open weights turn model adoption into infrastructure that outsiders can host and modify.
Meta afirmó que las descargas de Llama aumentaron de 350 millones en septiembre de 2024 a 1.000 millones en marzo de 2025. Las descargas no equivalen a usuarios activos, pero revelan una distribución muy rápida. Los pesos abiertos convierten la adopción en infraestructura que terceros pueden alojar y modificar.
Calling every large US laboratory a failure ignores different kinds of strength. xAI and Nvidia say the Colossus cluster deployed 100,000 H100 GPUs in 122 days. That does not prove model leadership, but it demonstrates extraordinary infrastructure execution.
Llamar fracaso a cada gran laboratorio estadounidense ignora distintos tipos de fortaleza. xAI y Nvidia afirman que el clúster Colossus desplegó 100.000 GPU H100 en 122 días. Eso no prueba liderazgo de modelos, pero demuestra una ejecución de infraestructura extraordinaria.
The frontier is concentrated, but Europe is not absent. Mistral's June 2024 financing reportedly valued the French company at about €5.8 billion roughly one year after its creation. Europe has fewer notable models, yet it can still produce highly valued frontier challengers.
La frontera está concentrada, pero Europa no está ausente. La financiación de Mistral de junio de 2024 valoró supuestamente la empresa francesa en unos €5.800 millones cerca de un año después de su creación. Europa tiene menos modelos destacados, pero aún puede producir rivales de frontera muy valorados.
China exported $857 billion of high-technology goods in 2024, compared with Germany's $247 billion. Germany remains a major industrial and technology supplier, but China's scale is more than 3 times larger on this measure. Model leadership rests on top of a much wider production system.
China exportó US$857.000 millones en bienes de alta tecnología en 2024, frente a US$247.000 millones de Alemania. Alemania sigue siendo un gran proveedor industrial y tecnológico, pero la escala china es más de 3 veces mayor en esta medida. El liderazgo de modelos descansa sobre un sistema productivo mucho más amplio.
Production strength becomes global reach through the physical infrastructure that moves manufactured goods.
La capacidad productiva se convierte en alcance global mediante la infraestructura física que mueve bienes manufacturados.
South Korea's electricity use rose from 2,462 kWh per person in 1990 to 11,350 in 2024. Over the same period, Britain fell to 4,195, while the US remained above 12,800. Datacenter growth will land on systems with very different demand histories and room for expansion.
El consumo eléctrico de Corea del Sur subió de 2.462 kWh por persona en 1990 a 11.350 en 2024. Durante el mismo período, Reino Unido cayó a 4.195, mientras EE. UU. se mantuvo por encima de 12.800. El crecimiento de centros de datos llegará a sistemas con historias de demanda y espacio de expansión muy distintos.
Stanford reported that inference cost at GPT-3.5-level benchmark performance fell more than 280-fold from November 2022 to October 2024. Falling cost spreads capability faster and makes smaller challengers more dangerous. It also expands usage, which can increase total electricity demand even when each query becomes cheaper.
Stanford informó que el costo de inferencia con rendimiento comparable a GPT-3.5 cayó más de 280 veces entre noviembre de 2022 y octubre de 2024. La caída del costo difunde capacidad más rápido y vuelve más peligrosos a los rivales pequeños. También expande el uso, lo que puede aumentar la demanda eléctrica total aunque cada consulta sea más barata.
Kimi K3 arrives as China closes the model gap, spreads open systems and builds industrial scale. The race is no longer a simple benchmark contest. Capital, chips, distillation, manufacturing and electricity increasingly decide who can sustain the frontier.
Key findings
Stanford reported that inference cost at GPT-3.5-level benchmark performance fell more than 280-fold from November 2022 to October 2024. tomshardware.com
Moonshot’s official blog introduces Kimi K3 as a 2.8-trillion-parameter model with native vision and a 1-million-token context window. kimi.com
Anthropic alleged that DeepSeek, Moonshot, and MiniMax generated over 16 million Claude exchanges through approximately 24,000 fraudulent accounts. anthropic.com
DeepSeek reported that R1-Distill-Qwen-32B beat DeepSeek-V3 on several listed reasoning benchmarks, but the comparison was developer-reported. llm-stats.com
Stargate announced up to $500 billion over four years, which was a commitment ceiling rather than completed spending. openai.com
xAI and Nvidia said Colossus deployed 100,000 H100 GPUs in 122 days, an involved-party claim requiring independent confirmation. supermicro.com
Stanford estimated 2024 private AI investment at $109.1 billion in the US, $9.3 billion in China, and $4.5 billion in Britain.
A further 5-fold to 50-fold inference-cost decline by 2028 is a scenario range, not an observed trend or forecast. arxiv.org
TNW reported that Stanford’s 2026 AI Index put the best US-China model performance gap at 2.7%, down from 17.5–31.6 percentage points in May 2023. thenextweb.com
Stanford SCCEI says Chinese central and local government VC funds channeled $912 billion into strategic industries including AI over the past decade. sccei.fsi.stanford.edu
DeepSeek-R1 published six Qwen or Llama distilled checkpoints ranging from 1.5 billion to 70 billion parameters. deepseekai.guide
Stanford estimated 2024 US private AI investment at $109.1 billion, compared with $9.3 billion in China.
The argument
Kimi K3 reaches 2.8 trillion parameters, more than 4 times DeepSeek-V3.
Stanford counted 40 notable US models, 15 Chinese models and three French models in 2024.
The reported US-China performance gap narrowed to 2.7% in the 2026 AI Index.
Qwen surpassed 100,000 derivatives, showing how open weights multiply an ecosystem.
Anthropic alleges three Chinese labs generated over 16 million Claude exchanges through about 24,000 fraudulent accounts.
US spending headlines mix a $500 billion ceiling, $80 billion plan and $433.9 billion equipment estimate.
Chinese government venture funds channeled $912 billion into strategic industries over a decade.
China installed 276,288 industrial robots in 2023, equal to 51% of the global total.
Inference cost at GPT-3.5-level performance fell more than 280-fold in under two years.
This research is published in English and Spanish. Ver en español
La investigación detrás de esta presentación
Kimi K3 llega mientras China reduce la brecha de modelos, difunde sistemas abiertos y construye escala industrial. La carrera ya no es una simple competencia de pruebas. El capital, los chips, la destilación, la manufactura y la electricidad deciden quién puede sostener la frontera.
Hallazgos clave
Stanford informó que el costo de inferencia con rendimiento comparable a GPT-3.5 cayó más de 280 veces entre noviembre de 2022 y octubre de 2024. tomshardware.com
El blog oficial de Moonshot presenta Kimi K3 como un modelo de 2,8 billones de parámetros, con visión nativa y una ventana de contexto de un millón de tokens. kimi.com
Anthropic afirmó que DeepSeek, Moonshot y MiniMax generaron más de 16 millones de intercambios con Claude mediante aproximadamente 24.000 cuentas fraudulentas. anthropic.com
DeepSeek informó que R1-Distill-Qwen-32B superó a DeepSeek-V3 en varias pruebas de razonamiento, pero la comparación fue comunicada por el desarrollador. llm-stats.com
Stargate anunció hasta 500.000 millones de dólares durante cuatro años, un máximo comprometido y no gasto ejecutado. openai.com
xAI y Nvidia afirmaron que Colossus desplegó 100.000 GPU H100 en 122 días, una afirmación de partes involucradas que requiere confirmación independiente. supermicro.com
Stanford estimó la inversión privada de 2024 en 109.100 millones de dólares en Estados Unidos, 9.300 millones en China y 4.500 millones en Reino Unido.
Otra caída del costo de inferencia entre 5 y 50 veces para 2028 es un rango de escenarios, no una tendencia observada ni un pronóstico. arxiv.org
TNW informó que el Índice de IA 2026 de Stanford situó la brecha entre los mejores modelos de EE. UU. y China en 2,7%, frente a 17,5–31,6 puntos en mayo de 2023. thenextweb.com
Stanford SCCEI señala que fondos de capital de riesgo de gobiernos chinos centrales y locales canalizaron US$912.000 millones hacia industrias estratégicas, incluida la IA, durante la última década. sccei.fsi.stanford.edu
DeepSeek-R1 publicó seis puntos destilados basados en Qwen o Llama, desde 1.500 millones hasta 70.000 millones de parámetros. deepseekai.guide
Stanford estimó la inversión privada estadounidense en IA de 2024 en 109.100 millones de dólares, frente a 9.300 millones en China.
El argumento
Kimi K3 alcanza 2,8 billones de parámetros, más de 4 veces DeepSeek-V3.
Stanford contó 40 modelos destacados de EE. UU., 15 chinos y tres franceses en 2024.
La brecha de rendimiento entre EE. UU. y China se redujo al 2,7% en el Índice de IA 2026.
Qwen superó los 100.000 derivados, mostrando cómo los pesos abiertos multiplican un ecosistema.
Anthropic afirma que tres laboratorios chinos generaron más de 16 millones de intercambios con Claude mediante unas 24.000 cuentas fraudulentas.
Los titulares de gasto estadounidense mezclan un máximo de US$500.000 millones, un plan de US$80.000 millones y una estimación de equipos de US$433.900 millones.
Los fondos públicos chinos canalizaron US$912.000 millones hacia industrias estratégicas durante una década.
China instaló 276.288 robots industriales en 2023, equivalentes al 51% del total mundial.
El costo de inferencia con rendimiento similar a GPT-3.5 cayó más de 280 veces en menos de dos años.
Esta investigación se publica en inglés y español. Read in English