Where AI training actually paysDónde la capacitación en IA realmente funciona · V7
34 slides · 28 min · 2026-08-04language
ENES
theme
LightDark
view
TalkTable
brand
HanademiPlatzi
The question is not who received AI training, but which verified workflows improved.
AI delivered more than 40% higher quality inside its frontier and a 19-point penalty outside it.
Train by role, pilot on real work, and scale only after net value survives review.
La pregunta no es quién recibió capacitación en IA, sino cuáles flujos de trabajo verificados mejoraron.
IA entregó más de 40% mayor calidad dentro de su frontera y una penalidad de 19 puntos fuera de ella.
Capacita por rol, pilotea en trabajo real y escala solo después de que el valor neto sobreviva la revisión.
This is the central tension in workplace AI. The same tool produced more than 40% higher quality on suitable tasks, then made consultants 19 percentage points less likely to be correct on an unsuitable task. Fluency did not reveal the boundary. Good training must.
Esta es la tensión central en IA empresarial. La misma herramienta produjo más de 40% mayor calidad en tareas adecuadas, luego hizo que consultores fueran 19 puntos porcentuales menos propensos a ser correctos en una tarea inadecuada. La fluidez no reveló la frontera. Una buena capacitación debe hacerlo.
Latin America is not one training market. The reported basic ICT gap moves from about 25% in Chile to 44% in Peru. ILIA reinforces the need for country-level diagnosis by assessing readiness, adoption, and governance across 19 countries. Employers should localize the foundation before teaching advanced tools.
América Latina no es un mercado de capacitación única. La brecha básica de TIC reportada va desde aproximadamente 25% en Chile a 44% en Perú. ILIA refuerza la necesidad de diagnóstico a nivel país al evaluar preparación, adopción y gobernanza en 19 países. Los empleadores deben localizar la base antes de enseñar herramientas avanzadas.
Exposure is much larger than full automation. Up to 38% of regional jobs may encounter generative AI, while the maximum estimate for automatable jobs is 5%. That gap is where employers should invest. Most value depends on redesigning tasks around people and tools.
La exposición es mucho mayor que la automatización completa. Hasta 38% de trabajos regionales pueden encontrar IA generativa, mientras la estimación máxima de trabajos automatizables es 5%. Esa brecha es donde los empleadores deben invertir. La mayoría del valor depende de rediseñar tareas alrededor de personas y herramientas.
The digital divide is an ROI constraint, not a social footnote. Between 7 million and 17 million regional workers could miss AI benefits because the required infrastructure is absent. A license has no value when workers cannot reliably reach the tool or company data. Access belongs in the training budget.
La brecha digital es una restricción de ROI, no una nota al pie social. Entre 7 millones y 17 millones de trabajadores regionales podrían perder beneficios de IA porque falta la infraestructura necesaria. Una licencia no tiene valor cuando los trabajadores no pueden acceder confiablemente a la herramienta o datos de la empresa. El acceso debe estar en el presupuesto de capacitación.
Enterprise adoption in Brazil remained early in 2023. Approximately 13% of surveyed enterprises reported using AI. That makes broad advanced training premature for many firms. The first step is often identifying usable data and a real workflow.
La adopción empresarial en Brasil se mantuvo en una etapa temprana en 2023. Aproximadamente el 13% de las empresas encuestadas reportó usar IA. Eso hace prematura la capacitación avanzada para muchas firmas. El primer paso suele ser identificar datos utilizables y un flujo de trabajo real.
The European benchmark shows adoption moving upward from very different bases. Portugal rose from 0.11 in 2021 to 1.12 in 2024. Sweden rose from 7.11 in 2024 to 10.97 in 2025. Training plans should follow measured local adoption rather than global enthusiasm.
El benchmark europeo muestra adopción moviéndose hacia arriba desde bases muy diferentes. Portugal subió de 0,11 en 2021 a 1,12 en 2024. Suecia subió de 7,11 en 2024 a 10,97 en 2025. Los planes de capacitación deben seguir la adopción local medida en lugar del entusiasmo global.
Formal training rates do not move together across the region. The latest supplied observations range from about 32% in Chile and Uruguay to 61% in Peru. Several countries also fell from earlier peaks. An AI program must fit the employer training system that already exists.
Las tasas de capacitación formal no se mueven juntas en la región. Las observaciones más recientes suministradas van de aproximadamente 32% en Chile y Uruguay a 61% en Perú. Varios países también cayeron de picos anteriores. Un programa de IA debe ajustarse al sistema de capacitación empresarial que ya existe.
European training indicators also split apart. The Netherlands ended at 14.1 after peaking in 2022, while Spain and France declined to nearly 5. Germany stayed close to 11. The lesson is not to copy Europe, but to treat training capacity as something that must be maintained.
Los indicadores de capacitación europeos también se divergieron. Los Países Bajos terminaron en 14,1 después de alcanzar su pico en 2022, mientras que España y Francia cayeron a casi 5. Alemania se mantuvo cerca de 11. La lección no es copiar Europa, sino tratar la capacidad de capacitación como algo que debe mantenerse.
AI assistance compressed the experience gap in customer support. Novice and lower-skilled agents improved about 34%, compared with 14% overall and little measured benefit for the most experienced group. Uniform training would miss that pattern. Novices need guided practice, while experts need harder workflows and stronger verification.
La asistencia de IA comprimió la brecha de experiencia en atención al cliente. Agentes novatos y menos especializados mejoraron alrededor de 34%, comparado con 14% en general y poco beneficio medible para el grupo más experimentado. Una capacitación uniforme perdería ese patrón. Los novatos necesitan práctica guiada, mientras que los expertos necesitan flujos de trabajo más desafiantes y verificación más rigurosa.
The largest modeled upside comes from pairing high routing coverage with novice-focused coaching, but the calculation is a transfer benchmark rather than a company forecast.
El mayor beneficio modelado surge al combinar una alta cobertura de direccionamiento con capacitación enfocada en principiantes, pero el cálculo es una referencia transferida y no un pronóstico empresarial.
The headline gains shrink as the evidence base grows, so employers should not budget from the 55.8% coding result without validating it on their own repositories.
Las ganancias destacadas disminuyen a medida que crece la base de evidencia, por lo que los empleadores no deberían presupuestar a partir del resultado de 55,8% en programación sin validarlo en sus propios repositorios.
Customer support offers volume, repetition, and observable outcomes. Klarna reported that its assistant handled 66% of chats and cut resolution time by 82%. Generali Poland reported automatic answers for 97% of queries. These are company claims, so pilots should reproduce the gains under local review.
La atención al cliente ofrece volumen, repetición y resultados observables. Klarna reportó que su asistente manejó 66% de los chats y redujo el tiempo de resolución en 82%. Generali Poland reportó respuestas automáticas para 97% de las consultas. Estos son reportes de casos de las empresas, así que los pilotos deben reproducir las ganancias bajo revisión local.
GOV.UK tested demand before treating an assistant as finished infrastructure. More than 10,000 users asked 26,000 questions across 2 pilots over 18 months. That sequence matters. Real questions reveal missing content, unsafe answers, and escalation needs better than a classroom demonstration.
GOV.UK evaluó la demanda antes de tratar un asistente como infraestructura finalizada. Más de 10.000 usuarios hicieron 26.000 preguntas en 2 pilotos durante 18 meses. Esa secuencia importa. Las preguntas reales revelan contenido faltante, respuestas inseguras y necesidades de escalamiento mejor que una demostración en clase.
Automation did not transfer responsibility away from the company. A tribunal held Air Canada responsible after its chatbot gave incorrect fare guidance, with C$812.02 in damages, interest, and fees. Customer-facing training must include escalation and ownership. The model never becomes the accountable employee.
La automatización no transfirió la responsabilidad lejos de la empresa. Un tribunal condenó a Air Canada después de que su chatbot dio orientación de tarifas incorrecta, con C$812,02 en daños, intereses y honorarios. La capacitación orientada al cliente debe incluir escalamiento y apropiación. El modelo nunca se convierte en el empleado responsable.
The writing experiment produced gains on both speed and quality. Participants completed the assigned work 40% faster, and independent ratings rose 18%. That is a stronger business case than counting prompts or course completions. The workflow and scoring method are what make the result actionable.
El experimento de escritura produjo ganancias en velocidad y calidad. Los participantes completaron el trabajo asignado 40% más rápido, y las calificaciones independientes subieron 18%. Ese es un caso comercial más sólido que contar prompts o finalizaciones de cursos. El flujo de trabajo y el método de puntuación son lo que hace el resultado accionable.
Inside the tested frontier, consultants completed 12.2% more tasks, worked 25.1% faster, and produced work rated more than 40% higher in quality. This is the kind of workflow worth training. It has a defined task, a control group, and observable output. The frontier warning still applies.
Dentro de la frontera probada, los consultores completaron 12,2% más tareas, trabajaron 25,1% más rápido y produjeron trabajo calificado más de 40% superior en calidad. Este es el tipo de flujo de trabajo que vale la pena capacitar. Tiene una tarea definida, un grupo control y un resultado observable. La advertencia de frontera sigue aplicando.
The same pattern appears in a central-bank setting. GPT-4o improved output quality by up to 44% and reduced completion time by 21%. The experiment strengthens the case for task-based training beyond commercial consulting. It does not justify unrestricted use across every bank function.
El mismo patrón aparece en un entorno de banco central. GPT-4o mejoró la calidad del resultado hasta 44% y redujo el tiempo de finalización en 21%. El experimento fortalece el caso de capacitación basada en tareas más allá de la consultoría comercial. No justifica el uso sin restricciones en todas las funciones del banco.
Public-sector AI training should begin with concrete service workflows inside accountable institutions.
La capacitación en IA del sector público debe comenzar con flujos de servicio concretos dentro de instituciones responsables.
Coding copilots can be spectacular on contained work and counterproductive in complex repositories. GitHub's experiment found a 55.8% speed gain on a defined task. Experienced open-source developers expected a 24% gain, then took 19% longer with AI. Verification and repository context can consume the apparent advantage.
Los copilots de codificación pueden ser espectaculares en trabajo contenido y contraproducentes en repositorios complejos. El experimento de GitHub encontró una ganancia de velocidad de 55,8% en una tarea definida. Desarrolladores experimentados de código abierto esperaban una ganancia de 24%, luego tardaron 19% más con IA. La verificación y el contexto del repositorio pueden consumir la aparente ventaja.
Las referencias de programación acotada pueden invertirse en repositorios reales, lo que hace que la verificación específica del repositorio sea más valiosa que la capacitación genérica en copilotos.
The reported gain changes sharply with the work. Support improved 14%, consulting speed 25.1%, writing time 40%, and contained coding speed 55.8%. These are not interchangeable benchmarks. Each workflow needs its own baseline, quality test, and review cost.
La ganancia reportada varía significativamente según el trabajo. Soporte mejoró 14%, velocidad de consultoría 25,1%, tiempo de redacción 40% y velocidad de codificación contenida 55,8%. Estos no son benchmarks intercambiables. Cada flujo de trabajo requiere su propia línea base, prueba de calidad y costo de revisión.
Document review becomes attractive when the source set is controlled and the work repeats at scale. JPMorgan said COiN addressed commercial-loan review previously estimated at 360,000 employee hours each year. That is a strong workflow hypothesis. Net savings still depend on review, errors, integration, and maintenance.
La revisión de documentos se vuelve atractiva cuando el conjunto de fuentes está controlado y el trabajo se repite a escala. JPMorgan indicó que COiN abordó la revisión de préstamos comerciales estimada previamente en 360.000 horas de empleados cada año. Esa es una hipótesis de flujo de trabajo sólida. Los ahorros netos siguen dependiendo de la revisión, errores, integración y mantenimiento.
Morgan Stanley reportó más del 98% de adopción entre equipos de asesores después de anclar su asistente en aproximadamente 100.000 documentos internos.
Document-assistant training should preserve explicit human checks because retrieval can still fail.
La capacitación con asistentes documentales debe mantener controles humanos explícitos porque la recuperación aún puede fallar.
Employees are not waiting for a company-wide procurement cycle. The survey found 75% of knowledge workers using AI, and 78% of users bringing tools not formally supplied by employers. That creates data and compliance risk before training begins. Employers should approve workflows and tools together.
Los empleados no esperan un ciclo de adquisición de empresa. La encuesta encontró que 75% de trabajadores del conocimiento usa IA, y 78% de usuarios traen herramientas no suministradas formalmente por empleadores. Eso crea riesgo de datos y cumplimiento antes de que comience la capacitación. Los empleadores deben aprobar flujos de trabajo y herramientas en conjunto.
The global training requirement is enormous. WEF estimates that 59% of workers will need training by 2030, while 11% may not receive what they need. The answer cannot be a generic prompt course delivered at scale. Training must connect to roles, workflows, and support after the class.
El requisito de capacitación global es enorme. El WEF estima que 59% de trabajadores necesitará capacitación para 2030, mientras que 11% puede no recibir lo que necesita. La respuesta no puede ser un curso genérico de IA entregado a escala. La capacitación debe conectar con roles, flujos de trabajo y apoyo después de la clase.
Employers are preparing for expansion and contraction at the same time. Some 85% plan to prioritize upskilling, while 41% anticipate workforce reductions where AI can automate tasks. Training cannot be sold as reassurance alone. It needs credible role redesign and transition plans.
Los empleadores se preparan simultáneamente para expansión y contracción. El 85% planea priorizar capacitación, mientras que el 41% anticipa reducciones de personal donde la IA puede automatizar tareas. La capacitación no puede venderse como mera tranquilidad. Requiere rediseño de roles creíble y planes de transición.
The regional estimates point toward collaboration rather than wholesale replacement. Up to 14% of jobs may be augmentable, compared with up to 5% automatable. That is roughly a 3-to-1 difference at the upper bounds. Training should prepare people to own the work around the model.
Las estimaciones regionales apuntan hacia colaboración en lugar de reemplazo masivo. Hasta el 14% de los empleos pueden aumentarse, comparado con hasta el 5% automatizable. Esa es aproximadamente una diferencia de 3 a 1 en los límites superiores. La capacitación debe preparar a las personas para ser dueñas del trabajo alrededor del modelo.
Organizational use rose from 33% in 2023 to about 71% in 2025. That momentum sits beside harsh warnings: RAND reported failure above 80%, while Gartner projected at least 30% abandonment after proof of concept by the end of 2025. These figures use different methods and are not one common failure rate. Together they show why adoption is a weak ROI metric.
El uso organizacional creció de 33% en 2023 a aproximadamente 71% en 2025. Ese impulso convive con advertencias severas: RAND reportó fracaso superior a 80%, mientras que Gartner proyectó al menos 30% de abandono después de prueba de concepto antes del final de 2025. Estas cifras usan métodos diferentes y no son una tasa de fracaso común. En conjunto demuestran por qué la adopción es una métrica débil de ROI.
The useful studies did not ask whether employees liked a course. They measured work from 444 writers, 758 consultants, and 5,179 support agents. Their outcomes included speed, quality, task completion, and resolved issues. Internal pilots should use the same operational discipline.
Los estudios útiles no preguntaron si a los empleados les gustó un curso. Midieron trabajo de 444 redactores, 758 consultores y 5.179 agentes de soporte. Sus resultados incluyeron velocidad, calidad, finalización de tareas y asuntos resueltos. Los pilotos internos deben usar la misma disciplina operativa.
The useful unit of training is a team practicing on a measurable workflow, not attendance alone.
La unidad útil de capacitación es un equipo que practica con un flujo medible, no solo la asistencia.
The first cycle should stay deliberately small. About 3 high-volume workflows leave enough capacity to set baselines, coach users, inspect failures, and calculate net value. Each pilot needs a business owner and a risk owner. Scale comes after the evidence, not before it.
El primer ciclo debe mantenerse deliberadamente pequeño. Unos 3 flujos de trabajo de alto volumen dejan capacidad suficiente para establecer líneas base, capacitar usuarios, inspeccionar fallos y calcular valor neto. Cada piloto necesita un propietario de negocio y un propietario de riesgo. La escalabilidad llega después de la evidencia, no antes.
Training must teach where AI works and when to stop trusting it. A regional curriculum will meet very different starting lines.
Key findings
On a task outside GPT-4's reliable frontier, AI-assisted consultants were 19 percentage points less likely to produce the correct answer. Harvard Business School
METR reported 16 experienced open-source developers took 19% longer with AI, despite predicting before work that AI would make them 24% faster. Model Evaluation and Threat Research
The consultant experiment found more than 40% higher quality inside AI's frontier but a 19-point correctness penalty on an outside-frontier task. Harvard Business School
The ILO and World Bank estimate that 7 million to 17 million regional workers could miss generative AI benefits because of inadequate digital infrastructure. World Bank and International Labour Organization
A study of 5,179 support agents found AI assistance increased resolved issues per hour by 14% on average and about 34% for novice workers. National Bureau of Economic Research
Klarna reported its assistant handled two-thirds of service chats, reduced repeat inquiries 25%, and cut average resolution time from 11 minutes to 2. Klarna
In a randomized experiment with 444 professionals, ChatGPT reduced completion time 40% and increased independently rated writing quality 18%. Science
Among 758 consultants, GPT-4 users completed 12.2% more tasks, worked 25.1% faster, and produced outputs rated more than 40% higher in quality. Harvard Business School
JPMorgan said COiN could review commercial-loan documents in seconds, addressing work previously estimated at 360,000 employee hours annually. JPMorgan Chase
AI assistance raised novice support-agent productivity about 34%, compared with 14% overall and little measured benefit for the most experienced workers. National Bureau of Economic Research
RAND reported that more than 80% of AI projects fail, roughly twice a commonly cited failure rate for non-AI technology projects. RAND Corporation
The argument
The near-term training problem is task redesign, not mass job replacement.
Tool training cannot overcome missing connectivity and access.
Only 13% of Brazilian firms used AI in 2023.
Adoption can rise quickly, but the starting point still shapes training demand.
Training capacity differs too much for one regional rollout model.
Even mature markets do not sustain digital training automatically.
This research is published in English and Spanish. Ver en español
La investigación detrás de esta presentación
La capacitación debe enseñar dónde funciona IA y cuándo dejar de confiar en ella. Un currículo regional enfrentará puntos de partida muy diferentes.
Hallazgos clave
On a task outside GPT-4's reliable frontier, AI-assisted consultants were 19 percentage points less likely to produce the correct answer. Harvard Business School
METR reported 16 experienced open-source developers took 19% longer with AI, despite predicting before work that AI would make them 24% faster. Model Evaluation and Threat Research
The consultant experiment found more than 40% higher quality inside AI's frontier but a 19-point correctness penalty on an outside-frontier task. Harvard Business School
The ILO and World Bank estimate that 7 million to 17 million regional workers could miss generative AI benefits because of inadequate digital infrastructure. World Bank and International Labour Organization
A study of 5,179 support agents found AI assistance increased resolved issues per hour by 14% on average and about 34% for novice workers. National Bureau of Economic Research
Klarna reported its assistant handled two-thirds of service chats, reduced repeat inquiries 25%, and cut average resolution time from 11 minutes to 2. Klarna
In a randomized experiment with 444 professionals, ChatGPT reduced completion time 40% and increased independently rated writing quality 18%. Science
Among 758 consultants, GPT-4 users completed 12.2% more tasks, worked 25.1% faster, and produced outputs rated more than 40% higher in quality. Harvard Business School
JPMorgan said COiN could review commercial-loan documents in seconds, addressing work previously estimated at 360,000 employee hours annually. JPMorgan Chase
AI assistance raised novice support-agent productivity about 34%, compared with 14% overall and little measured benefit for the most experienced workers. National Bureau of Economic Research
RAND reported that more than 80% of AI projects fail, roughly twice a commonly cited failure rate for non-AI technology projects. RAND Corporation
El argumento
El problema de capacitación a corto plazo es rediseño de tareas, no reemplazo masivo de empleos.
La capacitación en herramientas no puede superar conectividad y acceso faltantes.
Solo el 13% de las empresas brasileñas usó IA en 2023.
La adopción puede crecer rápido, pero el punto de partida sigue moldeando la demanda de capacitación.
La capacidad de capacitación difiere demasiado para un modelo de lanzamiento regional único.
Incluso los mercados maduros no sostienen la capacitación digital automáticamente.
Esta investigación se publica en inglés y español. Read in English