The model race did not begin with chatbots. China entered it with an export machine already operating at extraordinary scale. Germany remains a major technology producer, yet China's 2024 high-tech exports were more than three times larger. Mistral proves Europe can still create valuable frontier companies, but it operates from a different industrial base.
La carrera de modelos no comenzó con los chatbots. China entró con una máquina exportadora que ya operaba a una escala extraordinaria. Alemania sigue siendo un gran productor tecnológico, pero las exportaciones chinas de 2024 fueron más de tres veces mayores. Mistral demuestra que Europa aún puede crear empresas valiosas de frontera, aunque opera desde una base industrial distinta.
These terms often collapse into one vague idea of model power. They should not. A huge model may be more expensive without being better, and open weights describe access rather than quality. Keeping the terms separate prevents one number from becoming the whole scoreboard.
Estos términos suelen mezclarse en una idea imprecisa de poder. No deberían. Un modelo enorme puede ser más costoso sin ser mejor, y los pesos abiertos describen acceso, no calidad. Separarlos evita que una cifra se convierta en todo el marcador.
Kimi K3 changes the scale of the Moonshot story. Moonshot’s official blog presents it as a 2.8-trillion-parameter model with native vision and a 1-million-token context window. DeepSeek distributed reasoning models across six much smaller sizes. These specifications do not prove Kimi is better. They show Chinese labs attacking both ends of the market.
Kimi K3 cambia la escala de la historia de Moonshot. El blog oficial de Moonshot lo presenta como un modelo de 2,8 billones de parámetros, con visión nativa y una ventana de contexto de un millón de tokens. DeepSeek distribuyó modelos de razonamiento en seis tamaños mucho menores. Estas especificaciones no demuestran que Kimi sea mejor. Muestran que los laboratorios chinos atacan ambos extremos del mercado.
The US still produces far more notable models. That advantage is real. Yet reporting on Stanford's 2026 index put the best-model gap at only 2.7%, after a much larger range in May 2023. China joined the leading pack without matching US release volume.
Estados Unidos todavía produce muchos más modelos destacados. Esa ventaja es real. Sin embargo, información sobre el índice de Stanford de 2026 situó la brecha entre los mejores modelos en solo 2,7%, después de un rango mucho mayor en mayo de 2023. China se unió al grupo líder sin igualar el volumen estadounidense.
Qwen's importance is no longer confined to Alibaba's own releases. A March 2026 USCC report said its ecosystem had passed 100,000 derivatives on Hugging Face. Every derivative can adapt the base model to another language, task or device. Open distribution turns one release into a much larger development network.
La importancia de Qwen ya no se limita a los lanzamientos de Alibaba. Un informe de la USCC de marzo de 2026 señaló que su ecosistema había superado 100.000 derivados en Hugging Face. Cada derivado puede adaptar el modelo base a otro idioma, tarea o dispositivo. La distribución abierta convierte un lanzamiento en una red de desarrollo mucho mayor.
Think of distillation as an apprentice studying worked examples. DeepSeek says a 32 billion parameter distilled model beat its much larger V3 system on several reasoning benchmarks. The size difference explains why the technique matters. The performance comparison still needs independent evaluation.
La destilación se parece a un aprendiz que estudia ejemplos resueltos. DeepSeek afirma que un modelo destilado de 32.000 millones de parámetros superó a su sistema V3, mucho mayor, en varias pruebas. La diferencia de tamaño explica por qué importa la técnica. La comparación aún necesita evaluación independiente.
This is where a standard training method becomes a commercial and security fight. Anthropic alleges that DeepSeek, Moonshot and MiniMax used fraudulent accounts to generate more than 16 million Claude exchanges. The allegation comes from an interested party. It does not by itself prove what behavior was transferred or which outputs became training data.
Aquí un método normal de entrenamiento se convierte en una disputa comercial y de seguridad. Anthropic afirma que DeepSeek, Moonshot y MiniMax usaron cuentas fraudulentas para generar más de 16 millones de intercambios con Claude. La acusación procede de una parte interesada. No demuestra por sí sola qué comportamiento se transfirió ni qué respuestas se usaron para entrenar.
ByteDance presented Seedance 1.0 in 2025 as a text-to-video and image-to-video system with multi-shot generation. On April 23, 2026, the White House dated NSTM-4 on adversarial distillation of American AI models. These are separate developments, not evidence that Seedance used distillation. Together they show the competition broadening across products and policy.
ByteDance presentó Seedance 1.0 en 2025 como un sistema de texto a video e imagen a video con generación de múltiples tomas. El 23 de abril de 2026, la Casa Blanca fechó NSTM-4 sobre la destilación adversaria de modelos estadounidenses. Son acontecimientos separados, no evidencia de que Seedance usara destilación. Juntos muestran cómo la competencia se amplía entre productos y política.
The largest US numbers cannot be added into one investment total. Microsoft planned about $80 billion for AI-enabled datacenters in fiscal 2025. Four hyperscalers purchased $433.9 billion of broader property and equipment through March 2026, while Stargate announced a $500 billion ceiling over four years. Semiconductor awards add another layer: 19 companies and 40 facility projects.
Las mayores cifras estadounidenses no pueden sumarse en un solo total. Microsoft planeó unos US$80.000 millones para centros de datos preparados para IA en su año fiscal 2025. Cuatro hiperescaladores compraron propiedades y equipos por US$433.900 millones hasta marzo de 2026, mientras Stargate anunció un máximo de US$500.000 millones durante cuatro años. Los incentivos para semiconductores añaden otra capa: 19 empresas y 40 proyectos.
The AI race ultimately depends on processors that can be manufactured, sold and moved.
La carrera de la IA depende en última instancia de procesadores que puedan fabricarse, venderse y trasladarse.
Export controls work more like tightening bottlenecks than an impermeable wall. Nvidia developed the A800 and H800 for China, but October 2023 controls later restricted both families. China responded with capital as well as engineering. Its third semiconductor Big Fund registered 344 billion yuan in 2024.
Los controles funcionan más como cuellos de botella que se estrechan que como un muro impermeable. Nvidia desarrolló A800 y H800 para China, pero los controles de octubre de 2023 restringieron después ambas familias. China respondió con capital además de ingeniería. Su tercer Gran Fondo semiconductor registró 344.000 millones de yuanes en 2024.
Export controls must operate across the sprawling infrastructure of global trade.
Los controles de exportación deben operar en la extensa infraestructura del comercio mundial.
Manufacturing became a smaller part of China's own economy, falling from about 32% to roughly 25% of GDP. At the same time, China expanded from about 19% to 31% of global manufacturing value added. The apparent contradiction is the point. China diversified without surrendering global factory scale.
La manufactura se convirtió en una parte menor de la economía china, al caer de cerca del 32% a alrededor del 25% del PIB. Al mismo tiempo, China pasó de aproximadamente el 19% al 31% del valor agregado manufacturero mundial. La aparente contradicción es el punto. China se diversificó sin perder escala fabril mundial.
China's model competition is inseparable from the industrial capacity beneath it.
La competencia china en modelos es inseparable de la capacidad industrial que la sustenta.
Germany and Japan remain major manufacturing economies, but factories account for a smaller share of each economy than 30 years ago. Japan moved from roughly 23% to 19% of GDP. Germany moved toward 18%. Industrial capability can remain large even while services take a greater share.
Alemania y Japón siguen siendo grandes economías manufactureras, pero las fábricas representan una parte menor de cada economía que hace 30 años. Japón pasó de cerca del 23% al 19% del PIB. Alemania se acercó al 18%. La capacidad industrial puede seguir siendo grande mientras los servicios ganan peso.
South Korea kept manufacturing near or above one quarter of GDP for the entire period. India's share moved in the opposite direction and ended near 13.5%. Both countries can contribute to the AI supply chain, but they enter with very different industrial structures. Korea's economy remains much more factory-intensive.
Corea del Sur mantuvo la manufactura cerca o por encima de una cuarta parte del PIB durante todo el periodo. La participación de India avanzó en sentido contrario y terminó cerca del 13,5%. Ambos países pueden contribuir a la cadena de IA, pero entran con estructuras industriales muy distintas. La economía coreana sigue siendo mucho más fabril.
Germany's manufacturing base grew over three decades and peaked in 2022. The following three years erased part of that gain. Europe is not absent from the industrial contest, but its largest manufacturing economy entered the latest AI buildout with weakening output. That matters for the supply chains surrounding computing infrastructure.
La base manufacturera alemana creció durante tres décadas y alcanzó un máximo en 2022. Los tres años siguientes borraron parte de ese avance. Europa no está ausente de la competencia industrial, pero su mayor economía manufacturera entró en la expansión reciente de la IA con una producción debilitada. Eso importa para las cadenas que rodean la infraestructura informática.
India's manufacturing output rose from about $61 billion in 1990 to $595 billion in 2025. Its manufacturing share of GDP declined, but the absolute base expanded dramatically. That distinction matters. A country can become less factory-heavy while still adding enormous industrial capacity.
La producción manufacturera de India subió de unos US$61.000 millones en 1990 a US$595.000 millones en 2025. Su participación manufacturera en el PIB cayó, pero la base absoluta creció de forma drástica. Esa diferencia importa. Un país puede depender menos de las fábricas y aun así añadir una enorme capacidad industrial.
Japan has not matched the US or China in notable frontier-model volume. Its manufacturing base tells another story. Output crossed $1 trillion in 2022 before declining to $935 billion in 2024. The AI race still depends on countries whose importance sits in components, equipment and production rather than model branding.
Japón no ha igualado a Estados Unidos o China en volumen de modelos destacados. Su base manufacturera cuenta otra historia. La producción superó US$1 billón en 2022 antes de caer a US$935.000 millones en 2024. La carrera de la IA aún depende de países cuya importancia está en componentes, equipos y producción, no en marcas de modelos.
South Korea raised manufacturing output from about $82 billion in 1990 to $547 billion in 2025. Unlike India, manufacturing also remained a large share of the economy. That combination makes Korea structurally important to AI hardware. Model leadership is concentrated, but the production system is not.
Corea del Sur elevó su producción manufacturera de unos US$82.000 millones en 1990 a US$547.000 millones en 2025. A diferencia de India, la manufactura también siguió representando una gran parte de la economía. Esa combinación hace que Corea sea estructuralmente importante para el hardware de IA. El liderazgo en modelos está concentrado, pero el sistema productivo no.
Meta's strength is not captured by one benchmark position. The company says Llama downloads rose from 350 million to 1 billion in six months. Open weights let developers run and adapt models across their own systems. That distribution is a different form of power from controlling a closed service.
La fortaleza de Meta no cabe en una sola posición de pruebas. La empresa afirma que las descargas de Llama subieron de 350 millones a 1.000 millones en seis meses. Los pesos abiertos permiten que desarrolladores ejecuten y adapten modelos en sus propios sistemas. Esa distribución es una forma de poder distinta al control de un servicio cerrado.
The animal behind the model's name gives the open-model contest a memorable visual shorthand.
El animal que da nombre al modelo ofrece una imagen memorable para la competencia de modelos abiertos.
China's model surge did not appear from nowhere. Resident patent applications rose from about 25,000 in 2000 to more than 1.4 million in 2021. Patent counts do not measure AI quality and say nothing about the merit of a distillation allegation. They do show the breadth of the innovation system around Chinese laboratories.
El avance chino en modelos no apareció de la nada. Las solicitudes de patentes de residentes subieron de unas 25.000 en 2000 a más de 1,4 millones en 2021. Las patentes no miden la calidad de la IA ni el mérito de una acusación de destilación. Sí muestran la amplitud del sistema innovador que rodea a los laboratorios chinos.
Germany and Britain transformed their electricity mix over 25 years. Both moved from single-digit renewable shares to more than half of generation. That does not create spare datacenter power automatically. It does change the emissions and infrastructure context for future AI demand.
Alemania y Reino Unido transformaron su mezcla eléctrica durante 25 años. Ambos pasaron de participaciones renovables de un dígito a más de la mitad de la generación. Eso no crea automáticamente electricidad disponible para centros de datos. Sí cambia el contexto de emisiones e infraestructura para la futura demanda de IA.
France roughly doubled renewable generation's share over 25 years. Even so, it remained near 26% in 2025, far below Germany and Britain. The difference matters because European AI infrastructure will not draw from one uniform grid. National power systems remain structurally distinct.
Francia duplicó aproximadamente la participación renovable durante 25 años. Aun así, quedó cerca del 26% en 2025, muy por debajo de Alemania y Reino Unido. La diferencia importa porque la infraestructura europea de IA no dependerá de una sola red uniforme. Los sistemas nacionales siguen siendo estructuralmente distintos.
China's renewable share rose from 16.6% in 2000 to 37.0% in 2025. The increase is large, but most generation still came from other sources. China's AI buildout therefore combines growing renewable capacity with a power system still in transition. Cheap manufacturing does not remove the electricity constraint.
La participación renovable de China subió del 16,6% en 2000 al 37,0% en 2025. El aumento es grande, pero la mayor parte de la generación aún procedía de otras fuentes. La expansión china de IA combina capacidad renovable creciente con un sistema eléctrico todavía en transición. La manufactura barata no elimina la restricción eléctrica.
Japan and South Korea both matter deeply to semiconductor supply chains. Their electricity transitions look very different. Japan reached 23.6% renewable generation in 2025, while Korea reached 10.4%. Hardware capability does not automatically come with the same power mix.
Japón y Corea del Sur son esenciales para las cadenas de semiconductores. Sus transiciones eléctricas son muy distintas. Japón alcanzó un 23,6% de generación renovable en 2025, mientras Corea llegó al 10,4%. La capacidad de hardware no trae automáticamente la misma mezcla eléctrica.
The US renewable share rose from 9.2% in 2000 to 25.6% in 2025. That is a major shift, but it leaves the country well behind Germany and Britain by this measure. America's capital advantage therefore meets an electricity system that must keep expanding and changing at once. Chips and datacenters are only part of the buildout.
La participación renovable estadounidense subió del 9,2% en 2000 al 25,6% en 2025. Es un cambio importante, pero deja al país muy por detrás de Alemania y Reino Unido en esta medida. La ventaja estadounidense de capital encuentra así un sistema eléctrico que debe crecer y transformarse al mismo tiempo. Los chips y centros de datos son solo una parte de la expansión.
Electricity use per person fell across all three European economies after earlier peaks. Britain experienced the sharpest decline, ending near 4,195 kWh in 2024. A large datacenter expansion would therefore arrive after years of shrinking demand per person. That creates a different planning challenge from a country accustomed to rapid power growth.
El consumo eléctrico por persona cayó en las tres economías europeas después de máximos anteriores. Reino Unido sufrió el descenso más fuerte y terminó cerca de 4.195 kWh en 2024. Una gran expansión de centros de datos llegaría después de años de menor demanda por persona. Eso crea un reto de planificación distinto al de un país acostumbrado al crecimiento rápido.
South Korea began far below Japan in electricity use per person. It crossed above Japan and reached 11,726 kWh in 2021. Japan peaked much earlier and trended lower afterward. Korea's hardware strength grew inside a power-intensive industrial system, which brings both capacity and energy pressure.
Corea del Sur comenzó muy por debajo de Japón en consumo eléctrico por persona. Después lo superó y alcanzó 11.726 kWh en 2021. Japón llegó a su máximo mucho antes y luego descendió. La fortaleza coreana en hardware creció dentro de un sistema industrial intensivo en electricidad, que aporta capacidad y presión energética.
US electricity use per person has been broadly flat since its 2005 peak. AI could change that pattern because inference became dramatically cheaper. Stanford reported a decline of more than 280-fold at GPT-3.5-level performance from November 2022 to October 2024. Lower unit cost can stimulate enough usage to raise total demand.
El consumo eléctrico por persona en Estados Unidos se mantuvo relativamente plano desde su máximo de 2005. La IA podría cambiar ese patrón porque la inferencia se abarató de forma drástica. Stanford informó una caída de más de 280 veces con rendimiento comparable a GPT-3.5 entre noviembre de 2022 y octubre de 2024. Un menor costo unitario puede estimular suficiente uso para elevar la demanda total.
The AI contest rests on an industrial gap worth hundreds of billions. Scale, access and performance are different dimensions of the race.
Key findings
Stanford reported that inference cost at GPT-3.5-level benchmark performance fell more than 280-fold from November 2022 to October 2024. tomshardware.com
Moonshot’s official blog introduces Kimi K3 as a 2.8-trillion-parameter model with native vision and a 1-million-token context window. kimi.com
Anthropic alleged that DeepSeek, Moonshot, and MiniMax generated over 16 million Claude exchanges through approximately 24,000 fraudulent accounts. anthropic.com
DeepSeek reported that R1-Distill-Qwen-32B beat DeepSeek-V3 on several listed reasoning benchmarks, but the comparison was developer-reported. llm-stats.com
Stargate announced up to $500 billion over four years, which was a commitment ceiling rather than completed spending. openai.com
xAI and Nvidia said Colossus deployed 100,000 H100 GPUs in 122 days, an involved-party claim requiring independent confirmation. supermicro.com
Stanford estimated 2024 private AI investment at $109.1 billion in the US, $9.3 billion in China, and $4.5 billion in Britain.
A further 5-fold to 50-fold inference-cost decline by 2028 is a scenario range, not an observed trend or forecast. arxiv.org
TNW reported that Stanford’s 2026 AI Index put the best US-China model performance gap at 2.7%, down from 17.5–31.6 percentage points in May 2023. thenextweb.com
On April 23, 2026, the White House OSTP dated NSTM-4, titled “Adversarial Distillation of American AI Models.” whitehouse.gov
Stanford SCCEI says Chinese central and local government VC funds channeled $912 billion into strategic industries including AI over the past decade. sccei.fsi.stanford.edu
DeepSeek-R1 published six Qwen or Llama distilled checkpoints ranging from 1.5 billion to 70 billion parameters. deepseekai.guide
The argument
Kimi K3 is officially presented at 2.8 trillion parameters, with native vision and a 1-million-token context window.
China joined the frontier before matching America's release volume.
Alibaba's Qwen ecosystem surpassed 100,000 derivatives by March 2026.
Distillation transfers selected behavior without recreating the teacher's entire scale.
Anthropic alleges 16 million exchanges came through about 24,000 fraudulent accounts.
Chinese competition expanded into video as distillation entered US security policy.
This research is published in English and Spanish. Ver en español
La investigación detrás de esta presentación
La carrera de la IA descansa sobre una brecha industrial de cientos de miles de millones. Escala, acceso y rendimiento son dimensiones distintas de la carrera.
Hallazgos clave
Stanford informó que el costo de inferencia con rendimiento comparable a GPT-3.5 cayó más de 280 veces entre noviembre de 2022 y octubre de 2024. tomshardware.com
El blog oficial de Moonshot presenta Kimi K3 como un modelo de 2,8 billones de parámetros, con visión nativa y una ventana de contexto de un millón de tokens. kimi.com
Anthropic afirmó que DeepSeek, Moonshot y MiniMax generaron más de 16 millones de intercambios con Claude mediante aproximadamente 24.000 cuentas fraudulentas. anthropic.com
DeepSeek informó que R1-Distill-Qwen-32B superó a DeepSeek-V3 en varias pruebas de razonamiento, pero la comparación fue comunicada por el desarrollador. llm-stats.com
Stargate anunció hasta 500.000 millones de dólares durante cuatro años, un máximo comprometido y no gasto ejecutado. openai.com
xAI y Nvidia afirmaron que Colossus desplegó 100.000 GPU H100 en 122 días, una afirmación de partes involucradas que requiere confirmación independiente. supermicro.com
Stanford estimó la inversión privada de 2024 en 109.100 millones de dólares en Estados Unidos, 9.300 millones en China y 4.500 millones en Reino Unido.
Otra caída del costo de inferencia entre 5 y 50 veces para 2028 es un rango de escenarios, no una tendencia observada ni un pronóstico. arxiv.org
TNW informó que el Índice de IA 2026 de Stanford situó la brecha entre los mejores modelos de EE. UU. y China en 2,7%, frente a 17,5–31,6 puntos en mayo de 2023. thenextweb.com
El 23 de abril de 2026, la OSTP de la Casa Blanca fechó el memorando NSTM-4, titulado “Adversarial Distillation of American AI Models”. whitehouse.gov
Stanford SCCEI señala que fondos de capital de riesgo de gobiernos chinos centrales y locales canalizaron US$912.000 millones hacia industrias estratégicas, incluida la IA, durante la última década. sccei.fsi.stanford.edu
DeepSeek-R1 publicó seis puntos destilados basados en Qwen o Llama, desde 1.500 millones hasta 70.000 millones de parámetros. deepseekai.guide
El argumento
Kimi K3 se presenta oficialmente con 2,8 billones de parámetros, visión nativa y una ventana de contexto de un millón de tokens.
China llegó a la frontera antes de igualar el volumen estadounidense.
El ecosistema Qwen de Alibaba superó 100.000 derivados en marzo de 2026.
La destilación transfiere comportamientos sin recrear toda la escala del maestro.
Anthropic alega 16 millones de intercambios mediante unas 24.000 cuentas fraudulentas.
La competencia china llegó al video mientras la destilación entraba en la política estadounidense.
Esta investigación se publica en inglés y español. Read in English