This is the deck's central warning. In a ten-year panel of 3.2 million learning interactions, time spent on problems that could easily be entered into AI fell sharply after ChatGPT. High school students showed the largest decline at 31.3%. The assignment may still get finished, but much of the practice that builds independent ability has disappeared.
Esta es la advertencia central de la presentación. En un panel de diez años con 3,2 millones de interacciones de aprendizaje, el tiempo dedicado a problemas que podían introducirse fácilmente en la IA cayó con fuerza tras ChatGPT. Los estudiantes de secundaria mostraron la mayor caída, con 31,3%. La tarea puede terminarse, pero gran parte de la práctica que construye capacidad independiente ha desaparecido.
Less time would be good news if students learned just as much. They did not. On randomly assigned questions in supervised retention tests, the odds of answering correctly fell by a cumulative 25%. The efficiency story breaks when the student must perform alone.
Dedicar menos tiempo sería una buena noticia si los estudiantes aprendieran lo mismo. No fue así. En preguntas asignadas al azar dentro de pruebas supervisadas de retención, la probabilidad de responder correctamente cayó 25% de forma acumulada. La historia de eficiencia se rompe cuando el estudiante debe rendir solo.
Brown's welfare economics class averaged 96% on a take-home midterm, then 48.6% on an in-person final. Eighteen students dropped the course, nine skipped the final and 19 failed the class. That pattern made the case explosive because it resembles the broader research on performance disappearing when AI access is removed. But this was not a controlled experiment, and Brown's disciplinary process had not resolved individual allegations by the deck date.
La clase de economía del bienestar de Brown promedió 96% en un parcial para casa y después 48,6% en un final presencial. Dieciocho estudiantes abandonaron el curso, nueve faltaron al final y 19 reprobaron la asignatura. El patrón volvió explosivo el caso porque se parece a la investigación más amplia sobre ventajas que desaparecen al retirar la IA. Pero no fue un experimento controlado y el proceso disciplinario de Brown no había resuelto las acusaciones individuales en la fecha de esta presentación.
This campus became the setting for a question every school now faces. If a take-home score can be radically different from supervised performance, what exactly does the grade represent? Brown's case is disputed, but the trust problem is not. Assessment must now distinguish polished output from knowledge the student can explain and use alone.
Este campus se convirtió en el escenario de una pregunta que ahora afronta toda institución educativa. Si una nota obtenida en casa puede ser radicalmente distinta del desempeño supervisado, ¿qué representa exactamente la calificación? El caso de Brown está en disputa, pero el problema de confianza no. La evaluación debe distinguir entre un resultado pulido y el conocimiento que el estudiante puede explicar y usar sin ayuda.
The Brown case is one classroom. This working paper looked across more than 500,000 university grades. After ChatGPT, the share of A grades rose by 13 percentage points in courses with more writing and coding tasks exposed to AI. The increase was larger where homework carried more weight, which is consistent with AI replacing student work rather than broad learning gains.
El caso de Brown es una sola clase. Este estudio de trabajo analizó más de 500.000 calificaciones universitarias. Tras ChatGPT, la proporción de notas A aumentó 13 puntos porcentuales en cursos con más tareas de escritura y programación expuestas a IA. El aumento fue mayor cuando las tareas pesaban más, un patrón compatible con la sustitución del trabajo del estudiante y no con mejoras amplias del aprendizaje.
This randomized trial isolates the memory problem. Students could use ChatGPT freely while learning, but the real test came 45 days later without warning. The ChatGPT group scored 57.5%, compared with 68.5% for traditional study. Immediate ease did not become durable knowledge.
Este ensayo aleatorio aísla el problema de memoria. Los estudiantes podían usar ChatGPT libremente mientras aprendían, pero la prueba real llegó 45 días después y sin aviso. El grupo de ChatGPT obtuvo 57,5%, frente a 68,5% con el estudio tradicional. La facilidad inmediata no se convirtió en conocimiento duradero.
This high school field experiment tested two kinds of AI. A standard answer-giving interface improved practice performance, but students scored 17% lower than the no-AI group after access disappeared. A guarded tutor built around teacher-designed hints avoided that damage. The problem was not simply GPT-4. It was the behavior the interface encouraged.
Este experimento de campo en secundaria probó dos tipos de IA. Una interfaz estándar que daba respuestas mejoró el desempeño durante la práctica, pero los estudiantes obtuvieron 17% menos que el grupo sin IA cuando desapareció el acceso. Un tutor con límites y pistas diseñadas por docentes evitó ese daño. El problema no era simplemente GPT-4. Era la conducta que fomentaba la interfaz.
Among UK undergraduates, AI use for assessed work jumped from 53% to 88% in one year. In the United States, 86% of children ages 9 to 17 used AI, and 60% of students using it for homework expressed concern about school-related use. More than four in ten children also said no guardian had discussed AI safety with them. Adoption is no longer the future problem. Guidance is the lagging variable.
Entre universitarios británicos, el uso de IA en trabajos evaluados saltó de 53% a 88% en un año. En Estados Unidos, 86% de los menores de 9 a 17 años usaba IA, y 60% de los estudiantes que la empleaban para las tareas expresó preocupación por su uso escolar. Más de cuatro de cada diez menores también dijo que ningún tutor había hablado con ellos sobre seguridad en IA. La adopción ya no es el problema futuro. La orientación es la variable rezagada.
Teachers are not rejecting AI from the sidelines. Thirty-seven percent already used it in their work, and 57% said it helped write or improve lesson plans. Yet 72% worried that students could present AI-generated work as their own. The same tool that helps teachers prepare can make student performance harder to trust.
Los docentes no rechazan la IA desde fuera. El 37% ya la usaba en su trabajo y 57% dijo que ayudaba a escribir o mejorar planes de clase. Sin embargo, 72% temía que los estudiantes presentaran trabajos generados por IA como propios. La misma herramienta que ayuda a preparar clases puede volver más difícil confiar en el desempeño estudiantil.
The cognitive concern is broader than memory. Across 89 peer-reviewed studies, over-reliance appeared most often, in 33.7% of the literature. Reduced analytical autonomy appeared in 20.2%, and cognitive offloading in 18%. These are not prevalence rates among students. They show which risks repeatedly surfaced across a fragmented research base.
La preocupación cognitiva va más allá de la memoria. En 89 estudios revisados por pares, la dependencia excesiva apareció con mayor frecuencia, en 33,7% de la literatura. La menor autonomía analítica apareció en 20,2% y la descarga cognitiva en 18%. No son tasas de prevalencia entre estudiantes. Muestran qué riesgos surgieron repetidamente en una base de investigación fragmentada.
The research base is large but shallow. Stanford found more than 800 K-12 AI papers, yet only 20 strong studies could isolate whether AI changed outcomes. Detection is also fragile, and Brown reported no standardized method for alleged AI use. The practical answer is to collect evidence of how a student worked, reasoned and explained, rather than treating a detector score as a verdict.
La base de investigación es grande pero poco profunda. Stanford encontró más de 800 trabajos sobre IA escolar, pero solo 20 estudios sólidos podían aislar si la IA cambió los resultados. La detección también es frágil y Brown informó que no tenía un método uniforme para el supuesto uso de IA. La respuesta práctica es reunir pruebas de cómo trabajó, razonó y explicó el estudiante, en lugar de tratar la puntuación de un detector como veredicto.
One 2026 review combined 36 studies and 7,229 participants and found overall learning benefits, strongest in collaborative and blended teaching. A separate STEM review pooled 49 studies and found that the apparent overall benefit could largely reflect publication bias. These findings do not cancel each other out. They say that the average effect is unstable because tools, teaching methods and study quality differ dramatically.
Una revisión de 2026 combinó 36 estudios y 7.229 participantes y encontró beneficios generales, más fuertes en la enseñanza colaborativa y combinada. Otra revisión de STEM reunió 49 estudios y halló que el beneficio aparente podía reflejar en gran medida sesgo de publicación. Estos hallazgos no se anulan. Indican que el efecto promedio es inestable porque las herramientas, los métodos docentes y la calidad de los estudios difieren mucho.
The counter-evidence is strong enough to reject a blanket ban. In Harvard physics, 194 students using a carefully designed AI tutor achieved more than twice the learning gains of an active classroom. In Nigeria, a six-week guided program produced gains equivalent to 1.5 to 2 years of ordinary schooling. Both interventions were designed to teach, not merely to finish the task.
La evidencia contraria es suficientemente sólida para rechazar una prohibición total. En física de Harvard, 194 estudiantes que usaron un tutor de IA cuidadosamente diseñado lograron más del doble de avance que una clase activa. En Nigeria, un programa guiado de seis semanas produjo avances equivalentes a entre 1,5 y 2 años de escolarización habitual. Ambas intervenciones fueron diseñadas para enseñar, no solo para terminar la tarea.
The mobile-app precedent shows why engagement is seductive. Duolingo revenue rose from $162 million in 2020 to more than $1 billion in 2025, while Chegg's revenue peaked and then fell to $377 million. By early 2026, Duolingo had 56.5 million daily active users and 12.5 million paid subscribers. These are extraordinary product metrics, but they do not answer whether a learner can speak, reason or recall without the app.
El precedente de las aplicaciones móviles muestra por qué la participación resulta seductora. Los ingresos de Duolingo subieron de 162 millones USD en 2020 a más de 1.000 millones USD en 2025, mientras los de Chegg alcanzaron un pico y después cayeron a 377 millones USD. A comienzos de 2026, Duolingo tenía 56,5 millones de usuarios activos diarios y 12,5 millones de suscriptores de pago. Son métricas extraordinarias de producto, pero no responden si una persona puede hablar, razonar o recordar sin la aplicación.
PISA establishes the baseline, not an AI verdict. Between 2018 and 2022, OECD mathematics performance fell a record 15 points and reading fell 10. Across the decade from 2012 to 2022, 29 of 63 systems deteriorated in at least two subjects, while only six improved. These results predate widespread ChatGPT use, which means the learning crisis was already underway.
PISA establece la base, no un veredicto sobre la IA. Entre 2018 y 2022, el desempeño en matemáticas de la OCDE cayó un récord de 15 puntos y lectura cayó 10. Durante la década de 2012 a 2022, 29 de 63 sistemas empeoraron en al menos dos materias, mientras solo seis mejoraron. Estos resultados preceden el uso generalizado de ChatGPT, lo que significa que la crisis de aprendizaje ya estaba en marcha.
Gen Z uses AI while becoming more skeptical of it. Forty-two percent said AI made them anxious, 31% felt angry and only 18% felt hopeful. In a separate college survey, 16% said AI's potential impact had already caused them to change their major or field. Young people are not merely preparing for a moving job market. They are changing educational bets before the market's final shape is known.
La generación Z usa IA mientras se vuelve más escéptica. El 42% dijo que la IA le producía ansiedad, 31% sentía enojo y solo 18% esperanza. En otra encuesta universitaria, 16% dijo que el posible impacto de la IA ya le había llevado a cambiar de carrera o área. Los jóvenes no solo se preparan para un mercado laboral cambiante. Están modificando sus apuestas educativas antes de conocer su forma final.
The World Economic Forum's employer scenario projects 170 million jobs created and 92 million displaced by 2030. The stated balance is a net gain of 78 million jobs. That does not mean today's students are safe, because the new jobs may demand different skills, locations and credentials. The risk is a mismatch between what education certifies and what work begins to require.
El escenario empresarial del Foro Económico Mundial proyecta 170 millones de empleos creados y 92 millones desplazados para 2030. El balance declarado es una ganancia neta de 78 millones de puestos. Eso no significa que los estudiantes actuales estén seguros, porque los nuevos empleos pueden exigir habilidades, ubicaciones y credenciales distintas. El riesgo es un desajuste entre lo que certifica la educación y lo que empieza a exigir el trabajo.
The fastest-growing U.S. occupations are not a single AI monoculture. Wind technicians lead at 50%, followed by solar installers at 42% and nurse practitioners at 40%. Data science and information security are prominent, but so are care, health management and analytical roles. Education should build durable reasoning and domain knowledge alongside AI fluency.
Las ocupaciones de mayor crecimiento en Estados Unidos no forman un monocultivo de IA. Los técnicos eólicos lideran con 50%, seguidos por instaladores solares con 42% y enfermeros especialistas con 40%. La ciencia de datos y la seguridad informática son importantes, pero también lo son el cuidado, la gestión sanitaria y los puestos analíticos. La educación debe construir razonamiento duradero y conocimiento especializado junto con fluidez en IA.
The current labor market does not support an immediate job-apocalypse headline. OECD employment reached an all-time high of 670 million in May 2026, while unemployment stood at 4.9%. Yet youth unemployment was rising in some countries, and aggregate strength can hide entry-level weakness. The honest conclusion is uncertainty and uneven pressure, not collapse.
El mercado laboral actual no respalda un titular de apocalipsis laboral inmediato. El empleo de la OCDE alcanzó un máximo histórico de 670 millones en mayo de 2026, mientras el desempleo fue de 4,9%. Sin embargo, el desempleo juvenil aumentaba en algunos países y la fortaleza agregada puede ocultar debilidad en puestos iniciales. La conclusión honesta es incertidumbre y presión desigual, no derrumbe.
The policy window is shrinking. Frontier models gained 30 percentage points in one year on a benchmark designed to challenge expert-level AI. Better models can make tutoring more personal and feedback more useful. They can also make outsourced work harder to detect and easier to trust, which raises the cost of assessment systems that still reward only the final answer.
La ventana para actuar se está reduciendo. Los modelos de frontera ganaron 30 puntos porcentuales en un año en una prueba diseñada para desafiar a IA de nivel experto. Mejores modelos pueden volver la tutoría más personal y la retroalimentación más útil. También pueden hacer que el trabajo delegado sea más difícil de detectar y más fácil de creer, lo que eleva el costo de los sistemas de evaluación que todavía premian solo la respuesta final.
The useful classroom rule is simple enough to remember. In a study of 196 learners, students who generated ideas before consulting ChatGPT improved their later independent creativity. Mobile learning offers the same lesson: curriculum-aligned interactive apps can improve outcomes when they deliver structured practice. AI should enter after the student begins thinking, not before.
La regla útil para el aula es fácil de recordar. En un estudio con 196 participantes, quienes generaron ideas antes de consultar ChatGPT mejoraron su creatividad independiente posterior. El aprendizaje móvil ofrece la misma lección: las aplicaciones interactivas alineadas con el currículo pueden mejorar los resultados cuando ofrecen práctica estructurada. La IA debe entrar después de que el estudiante empiece a pensar, no antes.
The shortcut appeared first as missing practice, not merely faster work. On supervised retention questions, the odds of a correct answer fell 25%.
Key findings
After ChatGPT, study time on AI-susceptible math problems fell 31.3% among high schoolers, 26.9% among college students and 9.0% among middle schoolers. arXiv
On randomly assigned, supervised retention questions, the odds of answering correctly fell by a cumulative 25% after ChatGPT became available. arXiv
In Brown’s disputed cheating case, the class average fell from 96% on a take-home midterm to 48.6% on an in-person final. ThePrint
After Brown announced the supervised final, 18 students dropped the course, nine skipped the exam and 19 ultimately failed the class. Inside Higher Ed
Across more than 500,000 university grades, AI-exposed writing and coding courses recorded a 13-point rise in A grades after ChatGPT. University of California, Berkeley
In a randomized trial, unrestricted ChatGPT users scored 57.5% after 45 days, versus 68.5% for students who studied traditionally. Social Sciences & Humanities Open
Among UK undergraduates, use of generative AI for assessed work jumped from 53% in 2024 to 88% in 2025. Higher Education Policy Institute
In 2026, 86% of American children ages 9 to 17 used AI, nearly one-quarter daily, while over four in ten had never discussed AI safety with a guardian. Common Sense Media
Among U.S. students using AI for homework, 60% also worried about using AI for school-related purposes. RAND Corporation
In 2024, 37% of lower-secondary teachers used AI, while 72% feared students could present generated work as their own. European Commission
Across 89 studies, reported cognitive risks included over-reliance in 33.7%, reduced analytical independence in 20.2% and mental offloading in 18.0%. Frontiers in Psychology
The argument
Changing only the exam setting exposed a gulf between submitted performance and unaided performance.
The scandal was not only about cheating.
A grades rose 13 points in AI-exposed courses after ChatGPT.
A study aid became a cognitive crutch when the test arrived without warning.
When GPT gave away answers, later unaided grades fell 17%.
Students adopted AI before schools and families agreed on how it should be used.
This research is published in English and Spanish. Ver en español
La investigación detrás de esta presentación
El atajo apareció primero como práctica perdida, no solo como trabajo más rápido. En preguntas supervisadas de retención, la probabilidad de acertar cayó 25%.
Hallazgos clave
Tras ChatGPT, el tiempo dedicado a problemas matemáticos aptos para IA cayó 31,3% en secundaria, 26,9% en universidad y 9,0% en enseñanza media. arXiv
En preguntas de retención asignadas al azar y supervisadas, la probabilidad de responder correctamente cayó 25% de forma acumulada tras la llegada de ChatGPT. arXiv
En el caso controvertido de Brown, el promedio cayó de 96% en un parcial para casa a 48,6% en un final presencial. ThePrint
Tras anunciar Brown el final supervisado, 18 estudiantes abandonaron el curso, nueve faltaron al examen y 19 terminaron reprobando la asignatura. Inside Higher Ed
En más de 500.000 calificaciones universitarias, los cursos de escritura y programación expuestos a IA registraron 13 puntos más de notas A tras ChatGPT. University of California, Berkeley
En un ensayo aleatorio, quienes usaron ChatGPT sin restricciones obtuvieron 57,5% tras 45 días, frente a 68,5% con métodos tradicionales. Social Sciences & Humanities Open
En un experimento de matemáticas en secundaria, los alumnos con GPT-4 sin límites obtuvieron 17% menos al retirarse la IA que quienes nunca la tuvieron. Proceedings of the National Academy of Sciences
Entre universitarios británicos, el uso de IA generativa en trabajos evaluados saltó de 53% en 2024 a 88% en 2025. Higher Education Policy Institute
En 2026, 86% de los estadounidenses de 9 a 17 años usaba IA, casi una cuarta parte a diario, y más de cuatro de cada diez nunca habló de seguridad con un tutor. Common Sense Media
Entre los estudiantes estadounidenses que usaban IA para las tareas, 60% también se preocupaba por emplearla con fines escolares. RAND Corporation
En 2024, 37% de los docentes de secundaria inferior usó IA, mientras 72% temía que los alumnos presentaran trabajos generados como propios. European Commission
En 89 estudios, los riesgos cognitivos incluyeron dependencia excesiva en 33,7%, menor autonomía analítica en 20,2% y descarga mental en 18,0%. Frontiers in Psychology
El argumento
Cambiar el entorno del examen expuso un abismo entre el desempeño entregado y el desempeño sin ayuda.
El escándalo no trataba solo de fraude.
Las notas A subieron 13 puntos en cursos expuestos a IA tras ChatGPT.
Una ayuda de estudio se volvió muleta cognitiva cuando la prueba llegó sin aviso.
Cuando GPT entregaba respuestas, las notas posteriores sin ayuda cayeron 17%.
Los estudiantes adoptaron la IA antes de que escuelas y familias acordaran cómo usarla.
Esta investigación se publica en inglés y español. Read in English