This is the central warning. GPT-4 made practice performance look much better, especially with guided tutoring. But basic-chatbot users later performed 17% worse on the unaided exam, where the student had to supply the thinking. The comparison alone does not prove that AI caused the decline.
Esta es la advertencia central. GPT-4 hizo que el rendimiento de práctica pareciera mucho mejor, especialmente con tutoría guiada. Pero quienes usaron el chatbot básico rindieron después un 17% peor en el examen sin ayuda, donde el estudiante tenía que aportar el pensamiento. La comparación por sí sola no demuestra que la IA causara el descenso.
Short follow-ups can make AI look durable. In the 2026 experiment, 5.1 points of advantage remained after one week. A separate trial measured much later and found ChatGPT-assisted students retained 57.5%, against 68.5% under traditional study.
Los seguimientos cortos pueden hacer que la IA parezca duradera. En el experimento de 2026, permanecieron 5,1 puntos de ventaja después de una semana. Otro ensayo midió mucho más tarde y halló una retención del 57,5% con ChatGPT, frente al 68,5% con estudio tradicional.
The evidence does not support a simple brain-rot verdict. A 2026 review combined 35 experiments and 4,193 participants, finding generally positive learning effects. The important question is therefore which designs help and which replace effort.
La evidencia no respalda un veredicto simple de deterioro mental. Una revisión de 2026 combinó 35 experimentos y 4.193 participantes y encontró efectos generalmente positivos. La pregunta importante es qué diseños ayudan y cuáles sustituyen el esfuerzo.
The debate is often framed as technology against a stable school system. That stable baseline does not exist. Schools must integrate a powerful new tool while repairing older losses in mathematics, reading and attention.
El debate suele plantearse como tecnología frente a un sistema escolar estable. Esa base estable no existe. Las escuelas deben integrar una herramienta nueva y poderosa mientras reparan pérdidas anteriores en matemáticas, lectura y atención.
Three very different settings point in the same direction. Build the tool around teaching principles, give students guidance on productive use and keep educators in the loop. Across these trials, guided designs outperform answer-only use, with outcomes ranging from a 12-point passing gain to progress compared with 1.5-2 years of ordinary schooling.
Tres contextos muy distintos apuntan en la misma dirección. Hay que construir la herramienta alrededor de principios educativos, orientar su uso productivo y mantener a los docentes dentro del proceso. En estos ensayos, los diseños guiados superan el uso limitado a respuestas, con resultados que van desde 12 puntos más de aprobación hasta un progreso comparado con 1,5-2 años de escolaridad habitual.
The strongest gains did not come from replacing the teacher. One trial reported 16% and 7% more-likely outcomes for validated AI feedback. Another reported 4 and 9 percentage-point mastery gains when AI advised human tutors.
Los mayores avances no surgieron de sustituir al docente. Un ensayo informó resultados de 16% y 7% de mayor probabilidad con retroalimentación de IA validada. Otro informó ganancias de 4 y 9 puntos porcentuales cuando la IA asesoró a tutores humanos.
AI use in UK assessments jumped from 53% to 88% in one year. Swedish disciplinary cases rose even faster, from 237 to 851. Those measures do not capture the same behavior, so dramatic case growth cannot be read as a clean prevalence estimate.
El uso de IA en evaluaciones británicas saltó del 53% al 88% en un año. Los casos disciplinarios suecos crecieron aún más, de 237 a 851. Esas medidas no captan el mismo comportamiento, por lo que el crecimiento de casos no representa una estimación limpia de prevalencia.
A headline can say 56%, 48.6% or 25.6% and still refer loosely to student AI use. But these numbers measure different things in different populations. The Brown cheating figure is especially fragile because it is one professor’s inference, not an adjudicated university rate.
Un titular puede decir 56%, 48,6% o 25,6% y aun referirse de forma imprecisa al uso estudiantil de IA. Pero estas cifras miden cosas distintas en poblaciones diferentes. La cifra de trampa en Brown es especialmente frágil porque es la inferencia de un profesor, no una tasa universitaria sancionada.
The better detector achieved 0.69 accuracy, which still means a 31% benchmark error rate. Turnitin reached 0.61 accuracy, or 39% error. Both systems struggled with mixed human and AI authorship, so detector scores should not be treated as verdicts.
El mejor detector logró una exactitud de 0,69, lo que todavía implica una tasa de error de referencia del 31%. Turnitin alcanzó una exactitud de 0,61, es decir, un 39% de error. Ambos sistemas tuvieron dificultades con la autoría mixta, por lo que sus puntuaciones no deben tratarse como veredictos.
Schools are not deciding whether young people will encounter AI. Nearly two thirds of U.S. teens already use chatbots, and roughly three in ten use them daily. Education policy now shapes how they use the tool, not whether the tool exists.
Las escuelas no están decidiendo si los jóvenes encontrarán IA. Casi dos tercios de los adolescentes estadounidenses ya usan chatbots y cerca de tres de cada diez los usan a diario. La política educativa define ahora cómo usan la herramienta, no si la herramienta existe.
Once AI use becomes routine, the submitted essay is weak evidence of authorship. Reflective commentary, process logs and oral defenses expose the chain of thought and revision. The institution shifts from policing a text to verifying understanding.
Cuando el uso de IA se vuelve habitual, el ensayo entregado es una prueba débil de autoría. Los comentarios reflexivos, los registros del proceso y las defensas orales exponen la cadena de pensamiento y revisión. La institución deja de vigilar un texto y pasa a verificar la comprensión.
The timeline matters. OECD mathematics fell a record 15 points and reading fell 10 between 2018 and 2022, before mass access to ChatGPT. AI enters an education system that was already struggling, so it cannot explain the origin of the decline.
La cronología importa. Las matemáticas de la OCDE cayeron un récord de 15 puntos y la lectura bajó 10 entre 2018 y 2022, antes del acceso masivo a ChatGPT. La IA entra en un sistema educativo que ya tenía dificultades, por lo que no explica el origen del declive.
Singapore scored 575, 82 points above the Netherlands and 103 above the OECD average. The focused comparison makes the sourced gap to the typical OECD result clearer than a full leaderboard.
Singapur obtuvo 575 puntos, 82 por encima de Países Bajos y 103 por encima del promedio de la OCDE. La comparación enfocada hace más clara la brecha documentada frente al resultado típico de la OCDE que una clasificación completa.
GPT-3.5 already answered large portions of the PISA item set correctly. GPT-4 then reached 85% in reading and 84% in science. Assessment defenses based on one supposedly difficult subject can become obsolete within a single model generation.
GPT-3.5 ya respondía correctamente gran parte de las preguntas PISA. GPT-4 alcanzó después un 85% en lectura y un 84% en ciencias. Las defensas de evaluación basadas en una materia supuestamente difícil pueden quedar obsoletas en una sola generación del modelo.
Attention is already being allocated before generative AI enters the picture. Digital leisure takes 16% of weekday waking time, compared with 10% for homework. Schools are not adding AI to an empty schedule; they are competing for a scarce cognitive resource.
La atención ya está distribuida antes de que entre la IA generativa. El ocio digital ocupa el 16% del tiempo despierto entre semana, frente al 10% de los deberes. Las escuelas no añaden IA a una agenda vacía; compiten por un recurso cognitivo escaso.
Thirty percent of students report device distraction in most or every mathematics lesson. About one in four report distraction from classmates’ devices, and another one in four exceeds four daily hours of digital leisure outside school. The issue is not a single app; it is sustained pressure on attention.
El 30% de los estudiantes declara distracción por dispositivos en la mayoría o todas las clases de matemáticas. Cerca de uno de cada cuatro señala los dispositivos de compañeros y otro de cada cuatro supera cuatro horas diarias de ocio digital fuera de la escuela. El problema no es una sola aplicación; es la presión sostenida sobre la atención.
A screen is not one educational treatment. In Niger, phones supported an adult-education program rather than competing for attention, and mathematics performance remained higher seven months later. Purposeful design can turn the same device class into a learning aid.
Una pantalla no es un único tratamiento educativo. En Níger, los teléfonos apoyaron un programa de educación para adultos en vez de competir por la atención, y el rendimiento matemático siguió siendo mayor siete meses después. Un diseño deliberado puede convertir el mismo tipo de dispositivo en una ayuda educativa.
Young people can use AI heavily and still fear what it means for their future. Teen chatbot use reached 64%, while 47% of young people reported concern about AI’s economic effects. Familiarity and confidence are not the same thing.
Los jóvenes pueden usar mucho la IA y aun temer lo que significa para su futuro. El uso adolescente de chatbots alcanzó el 64%, mientras el 47% de los jóvenes declaró preocupación por los efectos económicos de la IA. La familiaridad y la confianza no son lo mismo.
The positive headline is 78 million net new jobs. The lived experience is much larger movement: 170 million created and 92 million displaced. Gross churn is 3.36 times the net gain, so workers can face intense disruption inside an expanding market.
El titular positivo es una ganancia neta de 78 millones de empleos. La experiencia real implica mucho más movimiento: 170 millones creados y 92 millones desplazados. La rotación bruta equivale a 3,36 veces la ganancia neta, por lo que puede haber una gran disrupción dentro de un mercado en expansión.
Employers expect 39% of core skills to change by 2030, making adaptability more valuable. But the OECD says fewer than 1% of workers need advanced AI skills. Mass education should build digital fluency, problem-solving, creativity and judgment rather than turn everyone into a model engineer.
Los empleadores esperan que cambie el 39% de las habilidades esenciales para 2030, lo que vuelve más valiosa la adaptabilidad. Pero la OCDE afirma que menos del 1% de los trabajadores necesita habilidades avanzadas de IA. La educación masiva debe desarrollar soltura digital, resolución de problemas, creatividad y criterio, no convertir a todos en ingenieros de modelos.
AI anxiety is arriving on top of a decline that began much earlier. Across nine of 11 comparable OECD countries, youth mental-health indicators worsened by an average 3% to 16% annually from 2012 to 2022. AI may amplify distress, but it does not explain where the longer deterioration began.
La ansiedad por la IA llega sobre un declive que comenzó mucho antes. En nueve de 11 países comparables de la OCDE, los indicadores de salud mental juvenil empeoraron en promedio entre un 3% y un 16% anual de 2012 a 2022. La IA puede amplificar el malestar, pero no explica dónde comenzó el deterioro prolongado.
The evidence does not argue for banning AI or surrendering to it. It argues for a protocol. Let AI expand guided practice, make students expose their reasoning and verify learning with unaided transfer. That is how the tool accelerates education without replacing the act of learning.
La evidencia no pide prohibir la IA ni rendirse ante ella. Pide un protocolo. Deje que la IA amplíe la práctica guiada, haga que el estudiante muestre su razonamiento y verifique el aprendizaje mediante transferencia sin ayuda. Así la herramienta acelera la educación sin sustituir el acto de aprender.
AI can carry a student uphill without making their own legs stronger. A one-week advantage survived, but a different 45-day trial favored traditional study by 11 points.
Key findings
GPT-4 raised practice grades 48% with a basic chatbot and 127% with guided tutoring, but basic-chatbot users later lost 17% on unaided exams. Proceedings of the National Academy of Sciences
On a surprise test 45 days later, ChatGPT-assisted students retained 57.5% of the material, versus 68.5% under traditional study. California State University, East Bay
A July 2026 experiment found AI added 6.7 points immediately and preserved a 5.1-point advantage one week later on unaided knowledge tests. Middlebury College
Across 35 experiments involving 4,193 participants, a 2026 review found ChatGPT generally improved learning, showing that harm is not universal. Humanities and Social Sciences Communications
A research-designed AI tutor produced more than twice the typical learning gain of an active-learning college class, while students spent less time. Scientific Reports
In Nigeria, six weeks of teacher-guided GPT-4 tutoring delivered learning gains described as 1.5 to 2 years of ordinary schooling. World Bank
Teaching students how to use an AI assistant for learning raised their chance of passing an econometrics course by 12 percentage points. IZA Institute of Labor Economics
Among lower-knowledge middle-school students, validated AI feedback made current corrections 16% more likely and next-problem success 7% more likely. Association for Computing Machinery
Tutor CoPilot raised math mastery by 4 points overall and 9 points for students taught by lower-rated tutors. Stanford University
The share of UK undergraduates using generative AI for assessments jumped from 53% in 2024 to 88% in 2025. Higher Education Policy Institute
A Brown economics professor suspected AI cheating by 48.6% of his class after comparing a take-home midterm with an in-person closed-book final. Inside Higher Ed
At the University of Limerick, 25.6% of surveyed students admitted using generative AI when it was not permitted. University of Limerick
The argument
Across 35 experiments, ChatGPT generally improved learning, so harm is not universal.
The useful AI is a spotter at the gym, not the machine lifting for the student.
Validated feedback and tutor assistance concentrated their largest benefits among learners receiving weaker support.
Disciplinary cases grew much faster than assessment use, but detection and reporting can drive that gap.
Regular use, suspected cheating and admitted prohibited use cannot be treated as one prevalence statistic.
Detector error is too large to support a high-stakes misconduct judgment by itself.
This research is published in English and Spanish. Ver en español
La investigación detrás de esta presentación
La IA puede llevar al estudiante cuesta arriba sin fortalecer sus propias piernas. Una ventaja sobrevivió una semana, pero otro ensayo a 45 días favoreció el estudio tradicional por 11 puntos.
Hallazgos clave
GPT-4 elevó las notas de práctica un 48% con un chatbot básico y un 127% con tutoría guiada, pero después redujo un 17% el examen sin ayuda. Proceedings of the National Academy of Sciences
En una prueba sorpresa 45 días después, quienes estudiaron con ChatGPT retuvieron el 57,5% del material, frente al 68,5% con métodos tradicionales. California State University, East Bay
Un experimento de julio de 2026 halló que la IA añadió 6,7 puntos de inmediato y conservó una ventaja de 5,1 puntos una semana después sin ayuda. Middlebury College
En 35 experimentos con 4.193 participantes, una revisión de 2026 concluyó que ChatGPT generalmente mejoró el aprendizaje, señal de que el daño no es universal. Humanities and Social Sciences Communications
Un tutor de IA diseñado con principios educativos produjo más del doble de aprendizaje típico que una clase universitaria activa, y los estudiantes emplearon menos tiempo. Scientific Reports
En Nigeria, seis semanas de tutoría con GPT-4 guiada por docentes produjeron avances equivalentes a entre 1,5 y 2 años de escolaridad habitual. World Bank
Enseñar a los estudiantes a usar un asistente de IA para aprender elevó en 12 puntos porcentuales su probabilidad de aprobar econometría. IZA Institute of Labor Economics
Entre alumnos de secundaria con menos conocimientos, la retroalimentación de IA validada aumentó un 16% las correcciones actuales y un 7% el éxito en el siguiente problema. Association for Computing Machinery
Tutor CoPilot elevó el dominio de matemáticas 4 puntos en general y 9 puntos entre estudiantes atendidos por tutores con menor calificación. Stanford University
La proporción de universitarios británicos que usaban IA generativa en evaluaciones saltó del 53% en 2024 al 88% en 2025. Higher Education Policy Institute
Un profesor de economía de Brown sospechó que el 48,6% de su clase usó IA para hacer trampa tras comparar exámenes en casa y presenciales. Inside Higher Ed
En la Universidad de Limerick, el 25,6% de los estudiantes encuestados admitió usar IA generativa cuando no estaba permitido. University of Limerick
El argumento
En 35 experimentos, ChatGPT mejoró en general el aprendizaje, así que el daño no es universal.
La IA útil ayuda en el gimnasio, no levanta el peso en lugar del estudiante.
La retroalimentación validada y el apoyo a tutores concentraron sus mayores beneficios entre quiénes recibían menos apoyo.
Los casos disciplinarios crecieron mucho más rápido que el uso en evaluaciones, pero la detección y la denuncia pueden explicar parte de la brecha.
El uso habitual, la sospecha de trampa y el uso prohibido admitido no forman una sola estadística de prevalencia.
El error de los detectores es demasiado grande para sostener por sí solo una decisión disciplinaria.
Esta investigación se publica en inglés y español. Read in English