AlphaZero faced Stockfish across 100 published games and did not lose once. That is an extraordinary demonstration of superhuman performance. It also warns against confusing mastery of one formal game with superiority across human life.
AlphaZero se enfrentó a Stockfish en 100 partidas publicadas y no perdió ninguna. Es una demostración extraordinaria de rendimiento sobrehumano. También advierte contra confundir el dominio de un juego formal con superioridad en toda la vida humana.
AGI means broad, dependable performance. ASI means broad superiority. The evidence contains powerful examples of narrow excellence, but those examples do not automatically satisfy either larger definition.
La AGI significa rendimiento amplio y confiable. La ASI significa superioridad amplia. La evidencia incluye ejemplos poderosos de excelencia acotada, pero no cumplen automáticamente ninguna de esas definiciones mayores.
The best tested agent completed only 2.5% of 240 real freelance projects at acceptable quality. Real work combines unclear instructions, judgment, revision, and client expectations. Passing benchmark questions is not the same as completing the whole job.
El mejor agente evaluado completó solo el 2,5% de 240 proyectos reales con calidad aceptable. El trabajo real combina instrucciones ambiguas, criterio, revisiones y expectativas del cliente. Aprobar preguntas de benchmark no equivale a completar todo el trabajo.
Real-world evaluation is where impressive AI demonstrations meet the harder standard of dependable work.
La evaluación en el mundo real enfrenta las demostraciones impresionantes de IA con el estándar más exigente del trabajo fiable.
Established benchmarks reward familiar skills. Unfamiliar abstraction tests ask whether a system can discover a new rule from sparse examples. ARC-AGI reported a substantial gap against an estimated 85% human reference.
Las pruebas establecidas premian habilidades familiares. Las tareas de abstracción novedosa preguntan si un sistema puede descubrir una regla nueva con pocos ejemplos. ARC-AGI reportó una brecha importante frente a una referencia humana estimada del 85%.
AlphaGo swept Fan Hui 5 to 0 and beat Lee Sedol 4 to 1. Those matches established superhuman Go performance, not broad superintelligence. New research therefore probes society-level behavior on platforms hosting more than 2 million agents.
AlphaGo venció 5 a 0 a Fan Hui y 4 a 1 a Lee Sedol. Esos encuentros establecieron rendimiento sobrehumano en Go, no superinteligencia amplia. Por eso, nuevas investigaciones examinan comportamiento social en plataformas con más de 2 millones de agentes.
Selected landmark runs span roughly 10^18 to 10^25 FLOP. OpenAI separately estimated a 300,000-fold compute increase from 2012 to 2018. Yet Chinchilla beat Gopher with 4 times fewer parameters at approximately equal training compute.
Entrenamientos destacados abarcan aproximadamente de 10^18 a 10^25 FLOP. OpenAI estimó por separado un aumento de cómputo de 300.000 veces entre 2012 y 2018. Sin embargo, Chinchilla superó a Gopher con 4 veces menos parámetros y cómputo aproximadamente igual.
China's current-dollar GDP rose from about $1.2 trillion in 2000 to nearly $19.5 trillion in 2025. That scale creates room for sustained spending on research, infrastructure, and industrial capacity. It does not reveal how much will flow specifically into frontier AI.
El PIB de China en dólares corrientes subió de unos 1,2 billones en 2000 a casi 19,5 billones en 2025. Esa escala crea espacio para gasto sostenido en investigación, infraestructura y capacidad industrial. No revela cuánto fluirá específicamente hacia la IA de frontera.
China's capital formation peaked above 46% of GDP and remained about 40.5% in 2024. That is an unusually investment-heavy economic structure. Raw model compute is not destiny, but large physical systems are easier to build where capital formation is already high.
La formación de capital de China superó el 46% del PIB y se mantuvo cerca del 40,5% en 2024. Es una estructura económica muy intensiva en inversión. El cómputo bruto no determina el destino, pero los grandes sistemas físicos son más fáciles de construir donde la inversión ya es alta.
Nvidia's data-center revenue rose from $6.7 billion to $47.5 billion across 4 fiscal years. The sharpest jump came in fiscal 2024. On June 3, 2026, the European Commission proposed Chips Act 2.0 as Europe sought a stronger semiconductor base.
Los ingresos de centros de datos de Nvidia subieron de 6.700 millones a 47.500 millones de USD en 4 años fiscales. El mayor salto llegó en el año fiscal 2024. El 3 de junio de 2026, la Comisión Europea propuso la Ley de Chips 2.0 para fortalecer la base europea de semiconductores.
China's high-technology exports exceeded $850 billion in 2024 after peaking near $936 billion in 2021. That scale shows the industrial depth surrounding the semiconductor and AI race. It does not reveal the share attributable to advanced AI chips.
Las exportaciones de alta tecnología de China superaron 850.000 millones de USD en 2024 tras alcanzar casi 936.000 millones en 2021. Esa escala muestra la profundidad industrial que rodea la carrera de semiconductores e IA. No revela la proporción atribuible a chips avanzados de IA.
The semiconductor race depends on human coordination alongside factories, capital, and trade.
La carrera de los semiconductores depende de la coordinación humana, además de fábricas, capital y comercio.
Frontier development is becoming an industrial project. Stanford estimated training costs near $78 million for GPT-4 and $191 million for Gemini Ultra. Those estimates exclude broader development and infrastructure expenses.
El desarrollo de frontera se está convirtiendo en un proyecto industrial. Stanford estimó costos cercanos a 78 millones de USD para GPT-4 y 191 millones para Gemini Ultra. Esas estimaciones excluyen gastos más amplios de desarrollo e infraestructura.
Capital rushed into generative AI before the economics had settled. Stanford reported about $25.2 billion of private investment in 2023. That was nearly 9 times the 2022 amount.
El capital entró rápidamente en la IA generativa antes de que su economía se estabilizara. Stanford reportó unos 25.200 millones de USD de inversión privada en 2023. Fue casi 9 veces la cifra de 2022.
The IEA base case rises from 415 TWh in 2024 to 945 TWh in 2030. Berkeley Lab separately projects U.S. demand rising from 176 TWh in 2023 to 325-580 TWh in 2028. Utilization, efficiency, deployment, and local grid conditions determine the path.
El escenario base de la AIE sube de 415 TWh en 2024 a 945 TWh en 2030. Berkeley Lab proyecta por separado que la demanda estadounidense subirá de 176 TWh en 2023 a 325-580 TWh en 2028. La utilización, la eficiencia, el despliegue y las redes locales determinan la trayectoria.
Ireland's per-person electricity use recovered to 6,298 kWh in 2024. Sweden remained much higher at 12,226 kWh, but its long-run direction was downward. The same data-center load can therefore meet very different national demand histories.
El consumo eléctrico por persona de Irlanda se recuperó hasta 6.298 kWh en 2024. Suecia siguió mucho más arriba, con 12.226 kWh, pero su trayectoria de largo plazo fue descendente. La misma carga de centros de datos puede encontrar historias nacionales muy distintas.
Australia has reported up to 44 GW of data-center connection capacity granted or queried. That figure measures grid interest and permissions, not actual electricity draw. Confusing the two turns a planning queue into a false consumption forecast.
Australia ha reportado hasta 44 GW de capacidad de conexión otorgada o consultada para centros de datos. La cifra mide interés y permisos de red, no consumo eléctrico real. Confundirlos convierte una cola de planificación en un pronóstico falso de consumo.
The IMF estimates exposure at 60% of jobs in advanced economies, 40% in emerging markets, and 26% in low-income countries. Higher exposure can mean automation, assistance, or changed task design. It is not a forecast of job losses.
El FMI estima exposición en el 60% de los empleos de economías avanzadas, el 40% de mercados emergentes y el 26% de países de bajos ingresos. Una mayor exposición puede significar automatización, asistencia o rediseño de tareas. No es un pronóstico de pérdidas de empleo.
AI assistance raised productivity 14% on average among 5,179 support agents. Novice and lower-skilled workers gained 34%. ILO analysis similarly found task transformation more likely than the elimination of whole occupations.
La asistencia de IA elevó la productividad un 14% en promedio entre 5.179 agentes de soporte. Los trabajadores novatos y menos cualificados mejoraron un 34%. La OIT también consideró más probable transformar tareas que eliminar ocupaciones completas.
Internet use in Brazil rose from 2.9% in 2000 to 84.5% in 2024. That creates a far wider channel for AI services than existed 2 decades earlier. Connectivity enables exposure and adoption, but it does not guarantee equal skills or benefits.
El uso de internet en Brasil subió del 2,9% en 2000 al 84,5% en 2024. Eso crea un canal mucho más amplio para servicios de IA que el existente 2 décadas antes. La conectividad permite exposición y adopción, pero no garantiza habilidades ni beneficios iguales.
Brazil's gross tertiary enrollment rose from 43.8% in 2012 to 69.7% in 2024. That changes the human-capital base confronting AI adoption. It does not resolve when AGI will arrive, but it shows why labor outcomes cannot be forecast from technology alone.
La matrícula terciaria bruta de Brasil subió del 43,8% en 2012 al 69,7% en 2024. Eso cambia la base de capital humano que enfrenta la adopción de IA. No resuelve cuándo llegará la AGI, pero muestra por qué los resultados laborales no pueden pronosticarse solo desde la tecnología.
AlphaFold expanded from about 350,000 predicted protein structures to more than 200 million. Researchers can begin from a vastly larger map of possibilities. Prediction still does not replace experimental validation or produce a therapy by itself.
AlphaFold pasó de unas 350.000 estructuras de proteínas predichas a más de 200 millones. Los investigadores pueden comenzar con un mapa mucho mayor de posibilidades. La predicción todavía no reemplaza la validación experimental ni produce por sí sola una terapia.
GNoME reported 2.2 million predicted crystal structures. About 381,000 were predicted to be stable, compared with 48,000 previously known stable crystals. Laboratories still have to synthesize, test, and find uses for those candidates.
GNoME reportó 2,2 millones de estructuras cristalinas predichas. Unas 381.000 fueron consideradas estables, frente a 48.000 cristales estables conocidos anteriormente. Los laboratorios todavía deben sintetizar, probar y encontrar usos para esos candidatos.
China's R&D expenditure rose from 0.88% of GDP in 2000 to 2.58% in 2023. That long climb predates the current generative-AI boom. Frontier model counts capture outputs from a deeper and slower research system.
El gasto en I+D de China subió del 0,88% del PIB en 2000 al 2,58% en 2023. Ese ascenso comenzó mucho antes del auge actual de la IA generativa. Los conteos de modelos de frontera reflejan resultados de un sistema científico más profundo y lento.
China's scientific and technical journal output rose from about 53,000 articles in 2000 to about 933,000 in 2023. AI tools enter a scientific system already producing far more candidates, papers, and experiments. More output still does not guarantee validated breakthroughs.
La producción china de artículos científicos y técnicos subió de unos 53.000 en 2000 a unos 933.000 en 2023. Las herramientas de IA entran en un sistema que ya produce muchos más candidatos, artículos y experimentos. Una mayor producción todavía no garantiza avances validados.
China's researcher density rose from about 550 per million people in 2000 to 2,107 in 2023. The expansion was not smooth, but the long direction is unmistakable. Machine capability grows inside institutions built by an expanding human research workforce.
La densidad de investigadores de China subió de unos 550 por millón de habitantes en 2000 a 2.107 en 2023. La expansión no fue uniforme, pero la dirección de largo plazo es clara. La capacidad de las máquinas crece dentro de instituciones construidas por una fuerza científica humana en expansión.
Resident patent applications in China rose from about 25,000 in 2000 to more than 1.4 million in 2021. That expansion shows the scale of the surrounding invention system. Patent volume does not prove AGI or measure invention quality.
Las solicitudes de patentes de residentes en China subieron de unas 25.000 en 2000 a más de 1,4 millones en 2021. Esa expansión muestra la escala del sistema de invención que rodea a la IA. El volumen de patentes no demuestra AGI ni mide la calidad de la invención.
Stanford counted 61 notable models from U.S. institutions, compared with 21 from the European Union and 15 from China. The EU AI Act can impose penalties up to 7% of worldwide annual turnover for specified prohibited practices. Production is concentrated, but regulation remains jurisdictional.
Stanford contó 61 modelos destacados de instituciones estadounidenses, frente a 21 de la Unión Europea y 15 de China. La Ley de IA de la UE puede imponer sanciones de hasta el 7% de la facturación mundial anual por determinadas prácticas prohibidas. La producción está concentrada, pero la regulación sigue dividida por jurisdicciones.
As frontier-model production concentrates, superintelligence claims are becoming questions for public oversight.
A medida que se concentra la producción de modelos de frontera, las afirmaciones sobre la superinteligencia se convierten en asuntos de escrutinio público.
A survey of 2,778 researchers assigned 10% probability to broad machine superiority by 2027 and 50% by 2047. Those probabilities make the possibility hard to dismiss. Individual forecasts still ranged from near-term dates to the next century and beyond.
Una encuesta de 2.778 investigadores asignó una probabilidad del 10% a la superioridad amplia para 2027 y del 50% para 2047. Esas probabilidades hacen difícil ignorar la posibilidad. Los pronósticos individuales todavía iban desde fechas cercanas hasta el próximo siglo y más allá.
Ireland and India devote far larger shares of service exports to ICT than the United States, United Kingdom, or Singapore. China rose from 2.2% in 2000 to 19.1% in 2025. Open models can spread experimentation through a digital economy whose strengths do not mirror frontier-model geography.
Irlanda e India dedican proporciones mucho mayores de sus exportaciones de servicios a las TIC que Estados Unidos, Reino Unido o Singapur. China subió del 2,2% en 2000 al 19,1% en 2025. Los modelos abiertos pueden difundir experimentación por una economía digital cuyas fortalezas no reflejan la geografía de los modelos de frontera.
AI already dominates narrow games, expands scientific search, and changes work. Yet real projects, unfamiliar reasoning, infrastructure constraints, and uncertain forecasts reveal the distance between benchmark progress and dependable general intelligence.
GNoME reported 2.2 million predicted crystal structures, including approximately 381,000 candidates predicted to be stable. Nature
METR estimated that the software-task duration frontier agents complete with 50% reliability doubled approximately every seven months from 2019 to 2025. Model Evaluation and Threat Research
OpenAI estimated that compute in the largest training runs increased more than 300,000-fold from 2012 to 2018, doubling every 3.4 months. OpenAI
AlphaZero completed 100 published games against Stockfish without losing once.
The best tested agent completed only 2.5% of 240 real projects at client-acceptable quality.
Training compute expanded by 7 orders of magnitude, yet Chinchilla beat a model 4 times larger.
Estimated training costs reached $78 million for GPT-4 and $191 million for Gemini Ultra.
U.S. data-center demand could rise from 176 TWh in 2023 to 325-580 TWh in 2028.
AI assistance raised support-agent productivity 14% overall and 34% among novice workers.
AlphaFold expanded from about 350,000 predicted structures to more than 200 million.
Researchers assigned a 50% probability to broad machine superiority by 2047, but forecasts varied widely.
This research is published in English and Spanish. Ver en español
La investigación detrás de esta presentación
La IA ya domina juegos acotados, amplía la búsqueda científica y cambia el trabajo. Sin embargo, los proyectos reales, el razonamiento novedoso, las restricciones de infraestructura y los pronósticos inciertos revelan la distancia hasta una inteligencia general confiable.
GNoME reportó 2,2 millones de estructuras cristalinas predichas, incluidas aproximadamente 381.000 candidatas consideradas estables. Nature
METR estimó que la duración de tareas de software completadas con 50% de confiabilidad se duplicó aproximadamente cada siete meses entre 2019 y 2025. Model Evaluation and Threat Research
OpenAI estimó que el cómputo de los mayores entrenamientos aumentó más de 300.000 veces entre 2012 y 2018, duplicándose cada 3,4 meses. OpenAI
La AIE estimó 415 TWh de consumo eléctrico de centros de datos en 2024 y proyectó unos 945 TWh para 2030 en su escenario base. International Energy Agency
La AIE proyectó que los centros de datos podrían aportar casi la mitad del crecimiento de la demanda eléctrica estadounidense hasta 2030. International Energy Agency
Una encuesta de 2.778 investigadores asignó 10% de probabilidad a que las máquinas superaran a humanos en toda tarea para 2027 y 50% para 2047. arXiv
En 240 proyectos reales de Upwork, el mejor agente de IA evaluado completó solo el 2,5% con calidad aceptable para un cliente. mvidmar.substack.com
El precio de los modelos de frontera para alcanzar un nivel determinado de desempeño en benchmarks ha caído aproximadamente entre 5 y 10 veces por año. arxiv.org