Hanademi

AI will not kill forms. It will hide them.

30 slides · 36 min · 1 minute ago language
ENES
theme
LightDark
view
DeckTableTalk
brand
HanademiPlatzi
AI will not kill forms. It willhide them.Made for Reynaldo Hernandez (ReyH), by Hanademi
La IA no eliminará losformularios. Los ocultará.Made for Reynaldo Hernandez (ReyH), by Hanademi
Document AI improved while forms stayednearly uniqueFUNSD field-understanding scores and VAREX document structure, reported benchmark values.Made for Reynaldo Hernandez (ReyH), by HanademiSources: Huang, Y., et al. (2022). LayoutLMv3: Pre-training for document AI. ACM Multimedia 2022.; arxiv.org.Field understanding60.392.1BERTLayoutLMv3Document structure1,7771,771DocumentsUnique schemas
The machine got much better at reading fields. LayoutLMv3 reached 92.1 F1 versus about 60.3 for BERT. But VAREX contains 1,771 unique schemas across 1,777 documents, so the harder problem is not just reading. It is handling what changes from case to case.
La IA documental mejoró mientras losformularios siguieron siendo casi únicosPuntuaciones de comprensión de campos FUNSD y estructura documental de VAREX, valores publicados debenchmarks.Made for Reynaldo Hernandez (ReyH), by HanademiFuentes: Huang, Y., et al. (2022). LayoutLMv3: Pre-training for document AI. ACM Multimedia 2022.; arxiv.org.Comprensión de campos60,392,1BERTLayoutLMv3Estructura documental1.7771.771DocumentosEsquemas únicos
La máquina mejoró mucho al leer campos. LayoutLMv3 alcanzó 92,1 F1 frente a aproximadamente 60,3 de BERT. Pero VAREX contiene 1.771 esquemas únicos en 1.777 documentos, así que el problema más difícil no es solo leer. Es manejar lo que cambia en cada caso.
The terms behind the argumentMade for Reynaldo Hernandez (ReyH), by HanademiCRMSoftware that stores customer interactions, opportunities, service cases and related records.ERPSoftware coordinating finance, purchasing, inventory, production, personnel and other coreprocesses.SchemaThe formal definition of a record's fields, allowed formats and relationships.HallucinationPlausible-looking AI output that is false or unsupported by the available evidence.Prompt injectionAn attack where untrusted content attempts to redirect an AI system's behavior.Straight-through processingAutomatic completion of a transaction without individual manualintervention when predefined controls pass.
6 technical terms carry much of the argument.
Los términos detrás del argumentoMade for Reynaldo Hernandez (ReyH), by HanademiCRMSoftware que almacena interacciones, oportunidades, casos de servicio y registrosrelacionados con clientes.ERPSoftware que coordina finanzas, compras, inventario, producción, personal y otros procesoscentrales.Esquema de datosLa definición formal de los campos, formatos permitidos y relaciones de unregistro.AlucinaciónSalida de IA aparentemente plausible, pero falsa o no respaldada por la evidenciadisponible.Inyección de instruccionesUn ataque donde contenido no confiable intenta redirigir elcomportamiento de un sistema de IA.Procesamiento directoFinalización automática de una transacción sin intervención manual individualcuando se superan controles predefinidos.
6 términos técnicos sostienen buena parte del argumento.
The American public spends 11.5 billionhours each year completing federal forms.That is the human cost before any automation begins. The opportunity is not merely fastertyping, but fewer hours spent translating life into administrative boxes.Sources: oes.gsa.gov.
Start with the burden. The American public spends 11.5 billion hours each year completing federal forms. That is a giant pool of human attention spent on structured input, before anyone asks whether every field needs to be visible.
La población de Estados Unidos dedica11.500 millones de horas cada año acompletar formularios federales.Ese es el costo humano antes de que empiece cualquier automatización. La oportunidadno es solo escribir más rápido, sino dedicar menos horas a traducir la vida en casillasadministrativas.Fuentes: oes.gsa.gov.
Empecemos por la carga. La población de Estados Unidos dedica 11.500 millones de horas cada año a completar formularios federales. Es una enorme cantidad de atención humana dedicada a introducir datos estructurados, antes de preguntar si cada campo debe estar visible.
Long or complicated checkouts wereblamed by 18% of surveyed abandoners.Baymard reports a 70.19% average cart-abandonment rate, but the 18% figure answers anarrower question: how many surveyed abandoners blamed checkout length orcomplexity.Sources: Baymard Institute. (2024). Cart abandonment rate statistics.; E-Commerce Cart & Checkout Usability Research.
Friction matters, but the denominator matters too. Baymard reports a 70.19% average abandonment rate, while 18% of surveyed abandoners blamed a checkout that was too long or complicated. That supports removing needless steps, not declaring every form obsolete.
El 18% de las personas encuestadas culpó aprocesos de pago largos o complicados.Baymard informa una tasa media de abandono del carrito del 70,19%, pero el 18%responde a una pregunta más concreta: cuántas personas encuestadas culparon a laduración o complejidad del proceso de pago.Fuentes: Baymard Institute. (2024). Cart abandonment rate statistics.; E-Commerce Cart & Checkout Usability Research.
La fricción importa, pero también importa el denominador. Baymard informa una tasa media de abandono del 70,19%, mientras el 18% de las personas encuestadas culpó a un proceso de pago demasiado largo o complicado. Eso respalda quitar pasos innecesarios, no declarar obsoleto todo formulario.
Adding one electronic signature boxgenerated an extra $1.59 million ingovernment payments.Some fields are not friction. The GSA case suggests that a visible checkpoint can recovermoney when it creates accountability at the right moment.Sources: oes.gsa.gov.
Here is the counterexample to field reduction. Adding an electronic signature box generated an extra $1.59 million in vendor payments to the government. The lesson is simple: remove repetition, but keep the fields that make responsibility visible.
Agregar una casilla de firma electrónicageneró US$1,59 millones adicionales enpagos al gobierno.Algunos campos no son fricción. El caso de la GSA sugiere que un control visible puederecuperar dinero cuando crea responsabilidad en el momento adecuado.Fuentes: oes.gsa.gov.
Este es el contraejemplo a reducir campos. Agregar una casilla de firma electrónica generó US$1,59 millones adicionales en pagos de proveedores al gobierno. La lección es sencilla: elimina la repetición, pero conserva los campos que hacen visible la responsabilidad.
Changing three income-reportingoptions did not meaningfully affectdigital SNAP completion.The controlled SNAP result weakens the idea that every form redesign changes behavior.Roughly half of exposed applicants selected hourly pay, but completion itself did notmeaningfully move.Sources: oes.gsa.gov.
Not every visible choice is the problem. In a controlled digital SNAP application, changing 3 income-reporting options did not meaningfully affect completion. Better interfaces should target real friction, not simply reduce the number of boxes.
Cambiar tres opciones para reportaringresos no afectó significativamente lafinalización digital de SNAP.El resultado controlado de SNAP debilita la idea de que todo rediseño cambia elcomportamiento. Cerca de la mitad de las personas expuestas eligió pago por hora, perola finalización no cambió de forma significativa.Fuentes: oes.gsa.gov.
No toda opción visible es el problema. En una solicitud digital de SNAP controlada, cambiar 3 opciones para reportar ingresos no afectó significativamente la finalización. Las mejores interfaces deben atacar la fricción real, no simplemente reducir el número de casillas.
Spain overtook Germany as e-commercepaths divergedEnterprise e-commerce sales indicator for the EU 27, Germany, Spain, France and Italy, 2010 to 2025.Made for Reynaldo Hernandez (ReyH), by HanademiSources: Eurostat. (n.d.). E-commerce sales of enterprises by NACE Rev. 2 activity [ISOC_EC_ESELN2]. Eurostat.Germany has no supplied observation for 2011, so that period is shown as a gap.01020201020132016201920222025EU 27GermanySpainFranceItalySpain first moved above Germanyin 2019.Spain peaked at 24.74 in 2023.The EU 27 ended 2025 at 15.24.Germany ended 2025 at 15.18.France ended 2025 at 12.21.Italy ended 2025 at 12.4.
The move away from forms will not happen on one shared timetable. Spain crossed Germany in 2019 and reached 24.74 in 2023, while Germany ended 2025 at 15.18. Italy rose steadily from 2.31 in 2010 to 12.4 in 2025, showing how different starting points shape digital adoption.
España superó a Alemania mientras divergían sustrayectorias de comercio electrónicoIndicador de ventas de comercio electrónico empresarial para la UE 27, Alemania, España, Francia eItalia, de 2010 a 2025.Made for Reynaldo Hernandez (ReyH), by HanademiFuentes: Eurostat. (n.d.). E-commerce sales of enterprises by NACE Rev. 2 activity [ISOC_EC_ESELN2]. Eurostat.No se proporcionó una observación de Alemania para 2011, por lo que ese periodo aparece como una brecha.01020201020132016201920222025UE 27AlemaniaEspañaFranciaItaliaEspaña pasó por primera vez porencima de Alemania en 2019.España alcanzó su máximo de24,74 en 2023.La UE 27 terminó 2025 en 15,24.Alemania terminó 2025 en 15,18.Francia terminó 2025 en 12,21.Italia terminó 2025 en 12,4.
El abandono de los formularios no ocurrirá según un único calendario. España cruzó a Alemania en 2019 y alcanzó 24,74 en 2023, mientras Alemania terminó 2025 en 15,18. Italia subió de forma constante desde 2,31 en 2010 hasta 12,4 en 2025, lo que muestra cómo los distintos puntos de partida influyen en la adopción digital.
Executive surveys put AI adoption at 71%McKinsey respondents reporting regular organizational generative-AI use, 2023 to 2024. This is arespondent survey, not economy-wide prevalence.Made for Reynaldo Hernandez (ReyH), by HanademiSources: McKinsey & Company. (2024). The state of AI in early 2024.; McKinsey & Company. (2025). The state ofAI: How organizations are rewiring to capture value.Reported regular organizational use among McKinsey respondents, not economy-wide business prevalence.UnitPercent of McKinsey respondents0%20%40%60%2023Early 2024Later 2024Later in 2024, the reported sharereached 71%.33%
Executive surveys describe a fast-moving adoption wave. The reported share rose from 33% in 2023 to 71% later in 2024. That momentum makes AI-mediated data entry plausible, while the survey design limits how far we can generalize.
Las encuestas ejecutivas sitúan la adopciónde IA en 71%Encuestados de McKinsey que declararon uso organizacional habitual de IA generativa, de 2023 a 2024. Esuna encuesta de participantes, no prevalencia de toda la economía.Made for Reynaldo Hernandez (ReyH), by HanademiFuentes: McKinsey & Company. (2024). The state of AI in early 2024.; McKinsey & Company. (2025). The state ofAI: How organizations are rewiring to capture value.Uso organizacional habitual declarado por encuestados de McKinsey, no prevalencia empresarial de toda la economía.UnidadPorcentaje de encuestados de McKinsey0 %20 %40 %60 %2023Inicio de 2024Finales de 2024A finales de 2024, la proporcióndeclarada alcanzó 71%.33 %
Las encuestas ejecutivas describen una ola de adopción rápida. La proporción declarada subió de 33% en 2023 a 71% a finales de 2024. Ese impulso hace plausible la captura de datos mediante IA, aunque el diseño de la encuesta limita cuánto podemos generalizar.
Adoption enters the workflowPeople gathered around a table view an application on a shared monitor.Sources: A/B test: Reducing form fields from 14 to 4 increased lead capture rate by 335% - MetriFi. metrifi.com.
Adoption becomes operational when teams work together around the applications already in front of them.
La adopción entra en el flujo de trabajoVarias personas reunidas alrededor de una mesa observan una aplicación en un monitor compartido.Fuentes: A/B test: Reducing form fields from 14 to 4 increased lead capture rate by 335% - MetriFi. metrifi.com.
La adopción se vuelve operativa cuando los equipos trabajan juntos alrededor de las aplicaciones que ya tienen delante.
Korea’s AI Voucher Programme supportedmore than 1,000 projects since 2020.Evaluations also indicated positive effects on employment, sales and firm performance,but the supplied claim does not provide effect sizes.Sources: oecd.org.
Adoption does not happen only through enthusiastic executives. Korea used vouchers to bring AI into smaller firms, supporting more than 1,000 projects since 2020. The evaluations point to positive effects, but the supplied evidence does not quantify them.
Sources
El Programa de Vales de IA de Coreaapoyó más de 1.000 proyectos desde 2020.Las evaluaciones también señalaron efectos positivos en empleo, ventas y desempeñoempresarial, pero la afirmación suministrada no proporciona magnitudes.Fuentes: oecd.org.
La adopción no ocurre solo mediante ejecutivos entusiastas. Corea utilizó vales para llevar la IA a empresas más pequeñas y apoyó más de 1.000 proyectos desde 2020. Las evaluaciones señalan efectos positivos, pero la evidencia suministrada no los cuantifica.
Fuentes
85% reported a positive experience, with 30to 60-plus minutes saved daily.The 2025 North Carolina Treasurer pilot reported a positive participant experience. Italso reported average ChatGPT time savings ranging from 30 to more than 60 minutesdaily, a separate measure that is not combined with the share.Sources: static.carahsoft.com.
The pilot offers a human-scale signal of value. 85% of participants reported a positive experience. The same pilot reported saving 30 to more than 60 minutes per day, but that time figure is a separate result and not a conversion of the 85%.
El 85% informó una experienciapositiva, con un ahorro diario de 30 amás de 60 minutos.El piloto de 2025 del Tesoro de Carolina del Norte informó una experiencia positiva entreparticipantes. También informó ahorros promedio de tiempo con ChatGPT de 30 a más de60 minutos diarios, una medida separada que no se combina con la proporción.Fuentes: static.carahsoft.com.
El piloto ofrece una señal concreta de valor para las personas. El 85% de los participantes informó una experiencia positiva. El mismo piloto informó un ahorro de 30 a más de 60 minutos al día, pero esa cifra es un resultado separado y no una conversión del 85%.
Electronic invoices still hit a processingwallShare of invoices among 204 surveyed accounts-payable organizations in 2025, from electronic arrival tostraight-through processing.Made for Reynaldo Hernandez (ReyH), by HanademiSources: imagetotable.ai.Survey of 204 accounts-payable organizations in 2025.UnitPercent of invoicesArrived electronically · 51.4%Straight-through processing · 35.4%
This is the ERP warning hidden inside the AI promise. 51.4% of invoices arrived electronically, but only 35.4% passed straight through. The missing step is not typing alone, it is the review needed when records do not fit the rules.
Las facturas electrónicas aún chocan conuna barrera de procesamientoProporción de facturas entre 204 organizaciones de cuentas por pagar encuestadas en 2025, desde lallegada electrónica hasta el procesamiento sin intervención.Made for Reynaldo Hernandez (ReyH), by HanademiFuentes: imagetotable.ai.Encuesta de 204 organizaciones de cuentas por pagar en 2025.UnidadPorcentaje de facturasLlegaron electrónicamente · 51,4 %Procesamiento sin intervención · 35,4 %
Esta es la advertencia de ERP escondida dentro de la promesa de la IA. El 51,4% de las facturas llegó electrónicamente, pero solo el 35,4% pasó sin intervención. El paso que falta no es solo teclear, sino revisar los registros que no encajan en las reglas.
The bottleneck still looks manualPrinted financial documents are arranged with a calculator and pen on a table.Sources: imagetotable.ai.
The processing wall becomes tangible when financial work still involves documents, calculators, and manual handling.
El cuello de botella aún parece manualDocumentos financieros impresos están dispuestos con una calculadora y un bolígrafo sobre unamesa.Fuentes: imagetotable.ai.
El muro de procesamiento se vuelve tangible cuando el trabajo financiero aún implica documentos, calculadoras y manejo manual.
Invoice review fell from 240 minutes to 12More than 200 daily invoices at a Hanoi distributor, measured as supervised processing time before andafter Document AI.Made for Reynaldo Hernandez (ReyH), by HanademiSources: trobz.ai.More than 200 daily invoices at a Hanoi distributor; processing remained supervised.UnitMinutes of supervised processingBefore Document AI240With Document AI1220x
This is the practical promise of replacing a form with extraction. The distributor still reviews the work, but the repetitive path shrinks from 4 staff-hours to 12 minutes. AI changes the task from typing fields to checking proposed records.
Sources
La revisión de facturas cayó de 240minutos a 12Más de 200 facturas diarias en un distribuidor de Hanói, medidas como tiempo de procesamientosupervisado antes y después de Document AI.Made for Reynaldo Hernandez (ReyH), by HanademiFuentes: trobz.ai.Más de 200 facturas diarias en un distribuidor de Hanói; el procesamiento siguió siendo supervisado.UnidadMinutos de procesamiento supervisadoAntes de Document AI240Con Document AI1220x
Esta es la promesa práctica de sustituir un formulario por extracción. El distribuidor todavía revisa el trabajo, pero el recorrido repetitivo se reduce de 4 horas-persona a 12 minutos. La IA cambia la tarea de escribir campos a revisar registros propuestos.
Fuentes
One deployed case cut weekly entry from40 hours to 2 to 3 hours of review.The deployed form-automation case also reported 99.1% sampled accuracy. This is aninterested-party case result, so it demonstrates a possible operating model rather than auniversal benchmark.Sources: kalviumlabs.ai.
The important shift is not that work disappears. In this deployed case, weekly manual entry fell from 40 hours to 2 to 3 hours of review, while sampled accuracy reached 99.1%. The human role moves toward checking exceptions.
Un caso desplegado redujo lacaptura semanal de 40 horas a 2 a3 horas de revisión.El caso desplegado de automatización de formularios también informó una precisión del99,1% en la muestra. Es un resultado de una parte interesada, por lo que demuestra unmodelo operativo posible, no un punto de referencia universal.Fuentes: kalviumlabs.ai.
El cambio importante no es que el trabajo desaparezca. En este caso desplegado, la captura manual semanal bajó de 40 horas a 2 a 3 horas de revisión, mientras la precisión de la muestra llegó al 99,1%. El papel humano pasa a revisar excepciones.
The workstation remainsSeveral computers and connected peripherals occupy an office desk.Sources: oes.gsa.gov.
When data entry becomes review, the interface may change while the workstation remains.
La estación de trabajo permaneceVarios ordenadores y periféricos conectados ocupan un escritorio de oficina.Fuentes: oes.gsa.gov.
Cuando la introducción de datos se convierte en revisión, la interfaz puede cambiar aunque la estación de trabajo permanezca.
At 50,000 monthly documents, reportedmanual staffing fell 75%.Pransform reported a 75% reduction in manual staffing at 50,000 monthly documents. Italso reported more than 90% straight-through processing, showing that volume andvalidation can move work away from manual entry.Sources: number7ai.com.
At high volume, the staffing effect becomes hard to ignore. Pransform reported 75% lower manual staffing for 50,000 monthly documents. It also reported more than 90% straight-through processing, but both figures come from the provider case study.
Con 50.000 documentos mensuales, elpersonal manual informado cayó un 75%.Pransform informó una reducción del 75% del personal manual con 50.000 documentosmensuales. También informó más del 90% de procesamiento directo, lo que muestra queel volumen y la validación pueden alejar el trabajo de la captura manual.Fuentes: number7ai.com.
Con un volumen alto, el efecto sobre el personal resulta difícil de ignorar. Pransform informó un 75% menos de personal manual para 50.000 documentos mensuales. También informó más del 90% de procesamiento directo, pero ambas cifras proceden del caso del proveedor.
India’s multilingual voice program reachedabout 5 million users in 31 days.India’s Listen at Scale program reported roughly 5 million users across healthcare,agriculture and governance. Voice can replace branching questionnaires for routineaccess, but the claim does not establish universal language or accessibility performance.Note: a derived analysis was removed from this slide during quality checks.Sources: waps.l3s.uni-hannover.de.
The form does not have to be replaced by another screen. India’s multilingual Listen at Scale program reported about 5 million users in 31 days. That is a powerful reach signal, while access still depends on language, connectivity and user needs.
El programa de voz multilingüe deIndia llegó a unos 5 millones deusuarios en 31 días.El programa Listen at Scale de India informó unos 5 millones de usuarios en salud,agricultura y gobierno. La voz puede sustituir cuestionarios ramificados para el accesorutinario, pero la afirmación no demuestra un rendimiento universal por idioma oaccesibilidad. Nota: un análisis derivado se retiró de esta diapositiva durante el controlde calidad.Fuentes: waps.l3s.uni-hannover.de.
El formulario no tiene que ser sustituido por otra pantalla. El programa multilingüe Listen at Scale de India informó unos 5 millones de usuarios en 31 días. Es una señal potente de alcance, aunque el acceso todavía depende del idioma, la conectividad y las necesidades de cada persona.
Agents still trail humans on complex webtasksTask success on realistic multi-step WebArena tasks, comparing an early GPT-4 agent with humans.Made for Reynaldo Hernandez (ReyH), by HanademiSources: Zhou, S., et al. (2024). WebArena: A realistic web environment for building autonomous agents. ICLR 2024.Safeguarded benchmark context: realistic multi-step web tasks, comparing an early GPT-4 agent with humans.UnitTask success0%25%50%75%100%14.4%Early GPT-4 agent78.2%HumansHuman result
This is the brake on the full no-form future. An early GPT-4 agent succeeded on 14.4% of realistic multi-step WebArena tasks, compared with 78.2% for humans. Agents can operate software, but consequential records still need review and limits.
Los agentes todavía quedan atrás en tareasweb complejasÉxito en tareas web realistas de varios pasos de WebArena, comparando un agente GPT-4 temprano conpersonas.Made for Reynaldo Hernandez (ReyH), by HanademiFuentes: Zhou, S., et al. (2024). WebArena: A realistic web environment for building autonomous agents. ICLR 2024.Contexto de referencia protegido: tareas web realistas de varios pasos, comparando un agente GPT-4 temprano con personas.UnidadÉxito en tareas0 %25 %50 %75 %100 %14,4 %Agente GPT-4 temprano78,2 %PersonasResultado humano
Este es el freno al futuro sin formularios. Un agente GPT-4 temprano tuvo éxito en el 14,4% de las tareas web realistas de varios pasos de WebArena, frente al 78,2% de las personas. Los agentes pueden operar software, pero los registros importantes todavía necesitan revisión y límites.
A 2024 study reported legal hallucinationrates from 69% to 88%.The 2024 study measured general-purpose models on selected verifiable legal questions.The range is a warning about task and test scope, not a universal rate for every legaluse.Sources: Dahl, M., Magesh, V., Suzgun, M., & Ho, D. E. (2024). Large legal fictions.
The deeper lesson is not that every AI answer is wrong. It is that high-stakes answers need structured validation. A 2024 study reported legal hallucination rates from 69% to 88% on selected verifiable questions, making review part of the interface.
Un estudio de 2024 informó tasas dealucinación jurídica del 69% al 88%.El estudio de 2024 midió modelos generales en preguntas jurídicas verificablesseleccionadas. El intervalo advierte sobre el alcance de la tarea y la prueba, no es unatasa universal para todo uso jurídico.Fuentes: Dahl, M., Magesh, V., Suzgun, M., & Ho, D. E. (2024). Large legal fictions.
La lección más profunda no es que toda respuesta de IA sea incorrecta. Es que las respuestas de alto riesgo necesitan validación estructurada. Un estudio de 2024 informó tasas de alucinación jurídica del 69% al 88% en preguntas verificables seleccionadas, por lo que la revisión forma parte de la interfaz.
AI intake raises the cost of failureIBM's average breach cost and Verizon's human-element share, reported for 2020-2024.Made for Reynaldo Hernandez (ReyH), by HanademiSources: IBM. (2024). Cost of a data breach report 2024.; Verizon. (2024). Data Breach Investigations Report 2024.UnitUSD millions and percentAverage breach cost$3.9$4.920202024Human element in breaches82%68%20222024
AI-mediated intake can touch more systems and more records than a person filling one form. IBM's estimate puts the average breach cost at $4.88 million in 2024, up from $3.86 million in 2020. Verizon's measure also shows that people remain part of the security story, even as the share fell to 68%.
La captura con IA eleva el coste del falloCoste medio de filtración de IBM y proporción del componente humano de Verizon, reportados entre 2020 y2024.Made for Reynaldo Hernandez (ReyH), by HanademiFuentes: IBM. (2024). Cost of a data breach report 2024.; Verizon. (2024). Data Breach Investigations Report 2024.UnidadMillones de USD y porcentajeCoste medio de una filtración$3,9$4,920202024Componente humano en filtraciones82 %68 %20222024
La captura mediada por IA puede tocar más sistemas y registros que una persona rellenando un formulario. La estimación de IBM sitúa el coste medio de una filtración en 4,88 millones de dólares en 2024, frente a 3,86 millones en 2020. La medida de Verizon también muestra que las personas siguen formando parte de la seguridad, aunque la proporción bajó al 68%.
Prompt injection ranks first among LLMrisksOWASP's 2025 ranking of major risks for applications using large language models.Made for Reynaldo Hernandez (ReyH), by HanademiSources: OWASP Foundation. (2025). OWASP Top 10 for LLM applications.Values are ordinal positions, not risk scores or probabilities.UnitRisk-list position0241Prompt injection2Sensitivedisclosure3Supply chain4Data poisoning5Output handlingHighest position
Giving an AI access to records also gives attackers a new place to aim. OWASP ranks prompt injection first among its 5 major listed risks for LLM applications. The key point is priority, not a numerical probability: the system must treat instructions as an attack surface.
La inyección de instrucciones ocupa elprimer lugar entre los riesgos de los LLMClasificación de OWASP de 2025 sobre los principales riesgos para aplicaciones con modelos lingüísticos.Made for Reynaldo Hernandez (ReyH), by HanademiFuentes: OWASP Foundation. (2025). OWASP Top 10 for LLM applications.Los valores son posiciones ordinales, no puntuaciones de riesgo ni probabilidades.UnidadPosición en la lista de riesgos0241Inyección deinstrucciones2Divulgaciónsensible3Cadena desuministro4Envenenamiento dedatos5Gestión de salidasPosición más alta
Dar acceso a una IA a los registros también ofrece a los atacantes un nuevo punto de entrada. OWASP sitúa la inyección de instrucciones en el primer lugar de sus 5 riesgos principales para aplicaciones con LLM. La idea clave es la prioridad, no una probabilidad numérica: el sistema debe tratar las instrucciones como una superficie de ataque.
Internet access expanded but remainsincompleteIndividuals using the Internet as a share of the world population, 2005-2025.Made for Reynaldo Hernandez (ReyH), by HanademiSources: World Bank. (n.d.). Individuals using the Internet (% of population) [IT.NET.USER.ZS]. World Bank Open Data.UnitPercent of world population0%20%40%60%2005200820112014201720202023Acceleration begins73.6% used the Internet in 2025.15.6%73.6%
The addressable audience for a digital interface has grown dramatically. But the line ends at 73.6%, not 100%. That makes connectivity a design constraint, not a footnote, especially when AI is presented as the default doorway into a system.
El acceso a Internet creció, pero siguesiendo incompletoPersonas que usan Internet como proporción de la población mundial, 2005-2025.Made for Reynaldo Hernandez (ReyH), by HanademiFuentes: World Bank. (n.d.). Individuals using the Internet (% of population) [IT.NET.USER.ZS]. World Bank OpenData.UnidadPorcentaje de la población mundial0 %20 %40 %60 %2005200820112014201720202023Comienza laaceleraciónEl 73,6% usó Internet en 2025.15,6 %73,6 %
La audiencia potencial de una interfaz digital ha crecido mucho. Pero la línea termina en 73,6%, no en 100%. Eso convierte la conectividad en una condición de diseño, no en una nota al pie, especialmente cuando la IA se presenta como la puerta de entrada predeterminada a un sistema.
The hidden form still needs a networkNetwork cables connect to ports on a panel of electronic equipment.Sources: The CRM Stops Being a Read-Only Destination for AI Agents – SalesTech Edition. salestechedition.com.
AI can hide the form, but it cannot hide the infrastructure required to reach it.
El formulario oculto aún necesita una redCables de red se conectan a los puertos de un panel de equipos electrónicos.Fuentes: The CRM Stops Being a Read-Only Destination for AI Agents – SalesTech Edition. salestechedition.com.
La IA puede ocultar el formulario, pero no la infraestructura necesaria para acceder a él.
Digital skills diverged across EuropeEurostat's digital-skills level measure for the EU 27, Germany, Spain, France and Italy, 2021-2025.Made for Reynaldo Hernandez (ReyH), by HanademiSources: Eurostat. (n.d.). Individuals' level of digital skills (from 2021 onwards) [ISOC_SK_DSKL_I21]. Eurostat.UnitDigital skills level024202120232025EU 27GermanySpainFranceItalyFrance reached 0.89 in 2023before falling to 0.71.Italy peaked at 3.97 in 2023.
Connectivity is only the first gate. Eurostat's digital-skills measure moves differently across these 5 series. Italy reaches 3.97 in 2023, while France is at 0.71 in 2025, so a conversational interface cannot assume the same skills or support needs everywhere.
Las competencias digitales divergieron enEuropaMedida de nivel de competencias digitales de Eurostat para la UE 27, Alemania, España, Francia e Italia,2021-2025.Made for Reynaldo Hernandez (ReyH), by HanademiFuentes: Eurostat. (n.d.). Individuals' level of digital skills (from 2021 onwards) [ISOC_SK_DSKL_I21]. Eurostat.UnidadNivel de competencias digitales024202120232025UE 27AlemaniaEspañaFranciaItaliaFrancia llegó a 0,89 en 2023antes de bajar a 0,71.Italia alcanzó un máximo de 3,97en 2023.
La conectividad es solo la primera barrera. La medida de competencias digitales de Eurostat se mueve de forma distinta en estas 5 series. Italia llega a 3,97 en 2023, mientras Francia está en 0,71 en 2025, así que una interfaz conversacional no puede suponer las mismas competencias ni necesidades de apoyo en todas partes.
A study of 5,179 support agentsfound AI assistance increasedissues resolved per hour…Trend shape came from model memory and was not independently verified; the latestfigure is shown instead of the series. Note: a derived analysis was removed from thisslide during quality checks.Sources: Brynjolfsson, E., Li, D., & Raymond, L. R. (2025). Generative AI at work. The Quarterly Journal of Economics. · Brynjolfsson, E., Li, D., &Raymond, L. R. (2023). Generative AI at work. Working Paper 31161. · Generative AI at Work | Stanford Institute for Economic Policy ....
A study of 5,179 support agents found AI assistance increased issues resolved per hour… Trend shape came from model memory and was not independently verified; the latest figure is shown instead of the series. Note: a derived analysis was removed from this slide during quality checks.
Un estudio de 5.179 agentes de soportehalló que la asistencia con IA aumentó…La forma de la tendencia venía de memoria del modelo y no se verificó de formaindependiente; se muestra la última cifra en lugar de la serie. Nota: un análisis derivadose retiró de esta diapositiva durante el control de calidad.Fuentes: Brynjolfsson, E., Li, D., & Raymond, L. R. (2025). Generative AI at work. The Quarterly Journal of Economics. · Brynjolfsson, E., Li, D., &Raymond, L. R. (2023). Generative AI at work. Working Paper 31161. · Generative AI at Work | Stanford Institute for Economic Policy ....
Un estudio de 5.179 agentes de soporte halló que la asistencia con IA aumentó… La forma de la tendencia venía de memoria del modelo y no se verificó de forma independiente; se muestra la última cifra en lugar de la serie. Nota: un análisis derivado se retiró de esta diapositiva durante el control de calidad.
On an intentionally difficult outside-frontiertask, AI-assisted consultants wereapproximately 19 percentage points less…Trend shape came from model memory and was not independently verified; the latestfigure is shown instead of the series. Note: a derived analysis was removed from thisslide during quality checks.Sources: Dell'Acqua, F., et al. (2023). Navigating the jagged technological frontier. Working Paper 24-013. · What is the jagged AI frontier?.
On an intentionally difficult outside-frontier task, AI-assisted consultants were approximately 19 percentage points less… Trend shape came from model memory and was not independently verified; the latest figure is shown instead of the series. Note: a derived analysis was removed from this slide during quality checks.
En una tarea difícil situada fuera de lafrontera, los consultores asistidos por IA…La forma de la tendencia venía de memoria del modelo y no se verificó de formaindependiente; se muestra la última cifra en lugar de la serie. Nota: un análisis derivadose retiró de esta diapositiva durante el control de calidad.Fuentes: Dell'Acqua, F., et al. (2023). Navigating the jagged technological frontier. Working Paper 24-013. · What is the jagged AI frontier?.
En una tarea difícil situada fuera de la frontera, los consultores asistidos por IA… La forma de la tendencia venía de memoria del modelo y no se verificó de forma independiente; se muestra la última cifra en lugar de la serie. Nota: un análisis derivado se retiró de esta diapositiva durante el control de calidad.
Employed information and communicationstechnology (ICT) specialists in EuropeanUnion - 27 countries (from…Note: a derived analysis was removed from this slide during quality checks.Sources: Eurostat. (n.d.). Employed information and communications technology (ICT) specialists [ISOC_SKS_ITSPT]. Eurostat.
Employed information and communications technology (ICT) specialists in European Union - 27 countries (from… Note: a derived analysis was removed from this slide during quality checks.
Employed information and communicationstechnology (ICT) specialists en EuropeanUnion - 27 countries (from…Nota: un análisis derivado se retiró de esta diapositiva durante el control de calidad.Fuentes: Eurostat. (n.d.). Employed information and communications technology (ICT) specialists [ISOC_SKS_ITSPT]. Eurostat.
Employed information and communications technology (ICT) specialists en European Union - 27 countries (from… Nota: un análisis derivado se retiró de esta diapositiva durante el control de calidad.
The EU AI Act entered into force on 1August 2024 and phases major…Trend shape came from model memory and was not independently verified; the latestfigure is shown instead of the series. Note: a derived analysis was removed from thisslide during quality checks.Sources: European Union. (2024). Regulation (EU) 2024/1689. · European Commission. (2024). AI Act enters into force. · Timeline for theImplementation of the EU AI Act.
The EU AI Act entered into force on 1 August 2024 and phases major… Trend shape came from model memory and was not independently verified; the latest figure is shown instead of the series. Note: a derived analysis was removed from this slide during quality checks.
La Ley de IA de la UE entró en vigorel 1 de agosto…La forma de la tendencia venía de memoria del modelo y no se verificó de formaindependiente; se muestra la última cifra en lugar de la serie. Nota: un análisis derivadose retiró de esta diapositiva durante el control de calidad.Fuentes: European Union. (2024). Regulation (EU) 2024/1689. · European Commission. (2024). AI Act enters into force. · Timeline for theImplementation of the EU AI Act.
La Ley de IA de la UE entró en vigor el 1 de agosto… La forma de la tendencia venía de memoria del modelo y no se verificó de forma independiente; se muestra la última cifra en lugar de la serie. Nota: un análisis derivado se retiró de esta diapositiva durante el control de calidad.
In summaryMade for Reynaldo Hernandez (ReyH), by HanademiSources: Dahl, M., Magesh, V., Suzgun, M., & Ho, D. E. (2024). Large legal fictions.; oes.gsa.gov.; Zhou, S., et al. (2024). WebArena: A realistic webenvironment for building autonomous agents. ICLR 2024.; kalviumlabs.ai.; trobz.ai.; imagetotable.ai.A 2024 study reported legal hallucination rates of 69% to 88% for general-purpose models on selected verifiable legal questions.The American public spends approximately 11.5 billion hours annually completing federal forms, according to GSA’s digital-forms evaluation.WebArena reported about 14.4% task success for an early GPT-4 agent versus 78.2% for humans on realistic multi-step web tasks.One deployed form-automation case reduced weekly manual entry from 40 hours to 2–3 hours of review while sampled accuracy reached 99.1%.A Hanoi distributor’s Document AI pipeline reduced supervised processing of more than 200 daily invoices from four staff-hours to 12 minutes.Among 204 accounts-payable organizations surveyed in 2025, 51.4% of invoices arrived electronically but only 35.4%achieved straight-through processing.
The value of the research is not only what each source knew, but what became visible when their evidence was combined.
En resumenMade for Reynaldo Hernandez (ReyH), by HanademiFuentes: Dahl, M., Magesh, V., Suzgun, M., & Ho, D. E. (2024). Large legal fictions.; oes.gsa.gov.; Zhou, S., et al. (2024). WebArena: A realistic webenvironment for building autonomous agents. ICLR 2024.; kalviumlabs.ai.; trobz.ai.; imagetotable.ai.Un estudio de 2024 informó tasas de alucinación jurídica del 69% al 88% para modelos generales en preguntas jurídicasverificables seleccionadas.La población de Estados Unidos dedica aproximadamente 11.500 millones de horas al año a completar formulariosfederales, según la evaluación de formularios digitales de la GSA.WebArena informó aproximadamente un 14,4% de éxito para un agente temprano con GPT-4 frente al 78,2% humano en tareas web de varios pasos.Un caso de automatización de formularios redujo la captura manual semanal de 40 horas a 2–3 horas de revisión yalcanzó 99,1% de precisión en la muestra auditada.Un distribuidor de Hanói redujo con Document AI el procesamiento supervisado de más de 200 facturas diarias, de cuatrohoras de trabajo a 12 minutos.Entre 204 organizaciones de cuentas por pagar encuestadas en 2025, el 51,4% de las facturas llegó electrónicamente,pero solo el 35,4% se procesó sin intervención.
El valor de la investigación no está solo en cada fuente, sino en lo que apareció al combinar sus evidencias.

The research behind this deck

AI can replace repetitive typing with conversation and extraction, but structured records, validation and human review remain. The winning interface removes routine fields while preserving explicit controls for consequential decisions.

Key findings

The argument

This research is published in English and Spanish. Ver en español

La investigación detrás de esta presentación

La IA puede sustituir la captura repetitiva por conversación y extracción, pero permanecen los registros estructurados, la validación y la revisión humana. La interfaz ganadora elimina campos rutinarios y conserva controles explícitos para decisiones importantes.

Hallazgos clave

El argumento

Esta investigación se publica en inglés y español. Read in English