Industrial AI needs a control towerLa IA industrial necesita una torre de control · V7
27 slides · 20 min · 2026-08-07language
ENES
theme
LightDark
view
TalkTable
brand
HanademiPlatzi
The question is not whether AI can optimize a plant, but how much authority it should receive.
An alarm flood reached about 26 alarms per minute when operators most needed clarity.
Keep deterministic control and independent safety beneath a governed AI orchestration layer.
La pregunta no es si la IA puede optimizar una planta, sino cuánta autoridad debe recibir.
Una inundación alcanzó unas 26 alarmas por minuto cuando los operadores más necesitaban claridad.
Mantenga el control determinista y la seguridad independiente bajo una capa de orquestación gobernada.
The operators did not lack data. They faced 275 alarms in 10.7 minutes, about 26 every minute. That rate was about 26 times the level characterized as unacceptable. Real-time orchestration must reduce the flood to the few decisions that still matter.
A los operadores no les faltaban datos. Enfrentaron 275 alarmas en 10,7 minutos, unas 26 por minuto. Esa tasa fue cerca de 26 veces el nivel caracterizado como inaceptable. La orquestación en tiempo real debe reducir la inundación a las pocas decisiones que todavía importan.
Industrial AI sits inside an existing control architecture. A DCS runs basic control, while separate safety functions protect the plant. PUE describes one energy measure, and the AI RMF supplies a governance vocabulary. Keeping these roles distinct prevents a useful model from becoming uncontrolled authority.
La IA industrial se integra en una arquitectura existente de control. Un DCS ejecuta el control básico, mientras funciones separadas protegen la planta. PUE describe una medida energética y el AI RMF aporta un lenguaje de gobernanza. Mantener estos roles separados evita que un modelo útil se convierta en una autoridad sin control.
The incident compressed more than four hours of an unacceptable alarm load into less than eleven minutes.
The warning line is reached quickly. EEMUA characterizes about 6 alarms an hour as acceptable, 12 as manageable, 30 as demanding and 60 or more as unacceptable. Counts still cannot reveal whether an alarm is timely, understandable or actionable. The orchestrator must improve quality as well as volume.
La línea de advertencia se alcanza rápidamente. EEMUA caracteriza unas 6 alarmas por hora como aceptables, 12 como manejables, 30 como exigentes y 60 o más como inaceptables. El conteo todavía no revela si una alarma es oportuna, comprensible o accionable. El orquestador debe mejorar la calidad y el volumen.
This is the promise that draws industry toward AI control. Google reported up to 40% less cooling energy and a 15% reduction in overall PUE overhead. The result came from Google’s own data-center case. Different plants, climates, equipment and safety constraints may produce different outcomes.
Esta es la promesa que atrae a la industria hacia el control con IA. Google reportó hasta 40% menos energía de refrigeración y una reducción de 15% en la sobrecarga PUE. El resultado procede del caso de centros de datos de Google. Otras plantas, climas, equipos y restricciones de seguridad pueden producir resultados distintos.
The field grounds the central constraint that optimization must reflect the physical system it serves.
El campo sitúa la restricción central de que la optimización debe reflejar el sistema físico al que sirve.
Industrial AI does not produce one standard benefit. Among 42 early Korean adopters, productivity rose 30.1% and defects fell 15.5%. Sawaco reported 7% lower power use and 15% lower chemical consumption. Korea’s AI Voucher Programme has supported more than 1,000 projects since 2020.
La IA industrial no produce un beneficio estándar. Entre 42 primeros adoptantes coreanos, la productividad aumentó 30,1% y los defectos bajaron 15,5%. Sawaco reportó 7% menos electricidad y 15% menos consumo de químicos. El Programa de Vales de IA de Corea ha apoyado más de 1.000 proyectos desde 2020.
Industrial AI is not an abstract software layer. It reads physical equipment, influences operating choices and changes resource use. Sawaco’s case connects the algorithm to the plant where its recommendations matter. That physical connection is why authority and fallback behavior must be explicit.
La IA industrial no es una capa abstracta de software. Lee equipos físicos, influye en decisiones operativas y cambia el uso de recursos. El caso de Sawaco conecta el algoritmo con la planta donde importan sus recomendaciones. Esa conexión física exige autoridad y respaldo explícitos.
Tennessee Eastman creates a repeatable industrial control problem. It includes 21 labeled fault scenarios across 41 measured and 11 manipulated variables. A model trained on those scenarios resembles a mechanic who practiced on one engine model. Research also warns that artificial laboratory defects can hide production degradation.
Tennessee Eastman crea un problema repetible de control industrial. Incluye 21 escenarios de falla etiquetados entre 41 variables medidas y 11 manipuladas. Un modelo entrenado con esos escenarios se parece a un mecánico que practicó con un solo motor. La investigación también advierte que los defectos artificiales de laboratorio pueden ocultar degradación en producción.
A one-for-one display of process data would exceed the cognitive reference before alarms, predictions or procedures are added, making prioritization part of the control architecture.
Una presentación directa de los datos del proceso superaría la referencia cognitiva antes de añadir alarmas, predicciones o procedimientos, por lo que la priorización forma parte de la arquitectura de control.
This combinatorial stress test shows why labeled single faults cannot validate coverage of novel combinations, even before engineering screens out impossible cases.
Esta prueba combinatoria muestra por qué las fallas individuales etiquetadas no validan la cobertura de combinaciones nuevas, incluso antes de descartar los casos físicamente imposibles.
Safety integrity is not a decorative certification. The minimum risk-reduction factor rises from 10 at SIL 1 to 10,000 at SIL 4. Each step raises the required protection by another order of magnitude. AI can optimize, but it should not quietly inherit safety authority.
La integridad de seguridad no es una certificación decorativa. El factor mínimo de reducción aumenta de 10 en SIL 1 a 10.000 en SIL 4. Cada paso eleva la protección exigida en otro orden de magnitud. La IA puede optimizar, pero no debe heredar silenciosamente autoridad de seguridad.
IEC 61508 defines four safety-integrity levels. Higher levels require lower dangerous-failure probabilities and stronger assurance. The label alone does not make a system safe. The architecture, evidence and independent protection must justify the level.
IEC 61508 define cuatro niveles de integridad de seguridad. Los niveles superiores exigen menor probabilidad de falla peligrosa y mayor garantía. La etiqueta por sí sola no hace seguro a un sistema. La arquitectura, la evidencia y la protección independiente deben justificar el nivel.
More models do not automatically create a better system. In this clinical workload, orchestrated agents retained 65.3% accuracy at 80 tasks, while one agent fell to 16.6%. That supports coordination, not unlimited centralization. Communications, execution, credentials and safe fallback paths must remain separated.
Más modelos no crean automáticamente un sistema mejor. En esta carga clínica, los agentes orquestados conservaron 65,3% de precisión con 80 tareas, mientras un agente cayó a 16,6%. Eso apoya la coordinación, no una centralización ilimitada. Comunicaciones, ejecución, credenciales y rutas seguras de respaldo deben permanecer separadas.
The clinical benchmark does not prove industrial performance, but it quantifies how orchestration can slow degradation as workload moves far beyond a four-chunk human reference.
El banco de pruebas clínico no demuestra el rendimiento industrial, pero cuantifica cómo la orquestación puede frenar la degradación cuando la carga supera ampliamente la referencia humana de cuatro unidades.
NIST organizes AI risk management into four functions. Govern defines accountability, Map establishes context, Measure tests behavior and Manage acts on risk. These are continuing functions, not four gates passed once. Industrial orchestration needs the full cycle before and after receiving authority.
NIST organiza la gestión de riesgos de IA en cuatro funciones. Gobernar define responsabilidad, Mapear establece contexto, Medir prueba el comportamiento y Gestionar actúa sobre el riesgo. Son funciones continuas, no cuatro puertas que se cruzan una sola vez. La orquestación industrial necesita el ciclo completo antes y después de recibir autoridad.
A display is not a cosmetic layer placed on top of control. NUREG-0700 reviews displays together with interaction, alarms, procedures and workplace design. More colors, symbols or predictions can make performance worse when meanings are crowded or inconsistent. Interface quality must be tested as part of the whole system.
Una pantalla no es una capa cosmética sobre el control. NUREG-0700 revisa las pantallas junto con interacción, alarmas, procedimientos y diseño del lugar de trabajo. Más colores, símbolos o predicciones pueden empeorar el desempeño cuando sus significados están saturados o son inconsistentes. La calidad de la interfaz debe probarse como parte del sistema completo.
The 2005 BP Texas City explosion killed 15 people, injured about 180 and led the CSB to issue 26 recommendations. These are separate reported counts, not evidence that interface design alone caused the explosion. The investigation points to displays, alarms, procedures and management as a connected safety system.
La explosión de BP Texas City de 2005 mató a 15 personas, hirió a unas 180 y llevó al CSB a emitir 26 recomendaciones. Son cifras reportadas separadas, no evidencia de que el diseño de la interfaz causara por sí solo la explosión. La investigación apunta a pantallas, alarmas, procedimientos y gestión como un sistema de seguridad conectado.
IBM’s reported average breach cost rose from $4.24 million in 2021 to $4.88 million in 2024. Industrial AI adds dependencies to an already costly risk environment. Total isolation is not a complete answer because dependable AI still needs data exchange, monitoring and controlled updates. Connectivity must be deliberate and reversible.
El costo medio por brecha reportado por IBM aumentó de $4,24 millones en 2021 a $4,88 millones en 2024. La IA industrial añade dependencias a un entorno de riesgo ya costoso. El aislamiento total no es una respuesta completa porque una IA confiable todavía necesita intercambio de datos, monitorización y actualizaciones controladas. La conectividad debe ser deliberada y reversible.
Governance does not end when a model passes acceptance testing. For specified prohibited practices, the EU AI Act permits a maximum fine of €35 million or 7% of worldwide annual turnover. Other violation categories carry lower turnover caps. Responsibility must be designed into the operating model.
La gobernanza no termina cuando un modelo supera la aceptación. Para determinadas prácticas prohibidas, la Ley de IA de la UE permite una multa máxima de €35 millones o 7% de la facturación mundial anual. Otras categorías tienen límites menores. La responsabilidad debe diseñarse dentro del modelo operativo.
Assurance should begin before operational authority expands. Australia’s Digital Transformation Agency piloted a government AI assurance framework from September through November 2024. The pilot included an impact-assessment tool. It is public-sector evidence, but the discipline transfers: test the governance system as well as the model.
El aseguramiento debe comenzar antes de ampliar la autoridad operativa. La Agencia de Transformación Digital de Australia piloteó un marco gubernamental de aseguramiento de IA entre septiembre y noviembre de 2024. El piloto incluyó una herramienta de evaluación de impactos. Es evidencia del sector público, pero la disciplina se transfiere: pruebe el sistema de gobernanza además del modelo.
A sensor reading has little meaning without process context. At a Latin American sugar manufacturer, operators select setpoints for hundreds of assets across five processes. A change in one area can affect downstream operations. The orchestrator must understand those dependencies before recommending action.
Una lectura de sensor tiene poco significado sin contexto del proceso. En una azucarera latinoamericana, los operadores eligen consignas para cientos de activos entre cinco procesos. Un cambio en un área puede afectar operaciones aguas abajo. El orquestador debe comprender esas dependencias antes de recomendar una acción.
Prioritization changes behavior when people can perceive it quickly. A retrospective pre-post study across four hospitals found lower response time after the highest-priority alarms became perceptually distinct. The setting was healthcare, not a control room. The operating lesson is direct: urgency must be visible before the decision window closes.
La priorización cambia el comportamiento cuando las personas pueden percibirla con rapidez. Un estudio retrospectivo antes-después en cuatro hospitales encontró menor tiempo de respuesta después de diferenciar perceptualmente las alarmas prioritarias. El entorno fue sanitario, no una sala de control. La lección operativa es directa: la urgencia debe ser visible antes de que cierre la ventana de decisión.
Fast decisions are not always the right decisions. About 25% of medical calls to Washington, DC’s 911 system could be treated in primary or urgent care instead of emergency services. The industrial analogy is routing, not medicine. An orchestrator should distinguish the appropriate path before acting faster.
Las decisiones rápidas no siempre son las decisiones correctas. Cerca del 25% de las llamadas médicas al 911 de Washington, DC, podría atenderse en servicios primarios o urgentes en vez de emergencias. La analogía industrial es el enrutamiento, no la medicina. Un orquestador debe distinguir la ruta apropiada antes de actuar más rápido.
The Milford Haven investigation reported 275 alarms in 10.7 minutes, about 26 per minute, before the explosion. That dedicated finding makes the operational warning explicit. The remaining evidence shows that productivity gains, orchestration, regulatory exposure and breach costs must be governed in their own contexts.
La investigación de Milford Haven informó 275 alarmas en 10,7 minutos, unas 26 por minuto, antes de la explosión. Ese hallazgo dedicado hace explícita la advertencia operativa. La evidencia restante muestra que las mejoras de productividad, la orquestación, la exposición regulatoria y los costos de brechas deben gobernarse en sus propios contextos.
El número total de filas oculta una densidad dimensional modesta, lo que limita lo que esta distribución puede demostrar por sí sola sobre la robustez del modelo.
Urgent information became noise when operators most needed a clear decision. These terms separate optimization, basic control, safety and governance.
Key findings
The Milford Haven investigation reported 275 alarms in the final 10.7 minutes before the explosion, averaging about 26 per minute. UK Health and Safety Executive
Bainbridge argued that automation can leave humans handling rare emergencies while reducing the routine practice needed to manage them. Automatica
The EU AI Act permits a maximum fine of €35 million or 7% of worldwide annual turnover for specified prohibited-practice violations. European Union
Automation can reduce operator situation awareness and manual recovery performance, although training and appropriate authority allocation can mitigate the effect. Automatica
Across clinical workloads of 5–80 tasks, orchestrated multi-agent accuracy declined from 90.6% to 65.3%, versus 73.1% to 16.6% for one agent. preview-www.nature.com
Google reported up to 40% less cooling energy and a 15% reduction in overall PUE overhead after applying DeepMind control. Google DeepMind
A benchmark limited to 21 labeled faults cannot establish performance on unknown failures, maintenance changes, sensor aging or novel fault combinations. Computers & Chemical Engineering
For high-demand or continuous operation, IEC 61508 SIL bands correspond to risk-reduction ranges of 10 to 100 through 10,000 to 100,000. International Electrotechnical Commission
A centralized orchestrator can create a common-cause failure unless communications, execution, credentials and safe fallback paths are separated. International Electrotechnical Commission
Among 42 early adopters in South Korea’s AI Factory initiative, average productivity rose 30.1% and defect rates fell 15.5%. m.ajupress.com
The argument
Useful orchestration prioritizes alarms instead of merely counting or displaying them.
AI can optimize a bounded objective, but one case cannot guarantee universal savings.
The winning objective changes by plant, even when both projects use AI.
Every model eventually acts through equipment, sensors and operators.
Benchmark accuracy measures known cases, not resilience to unfamiliar plant conditions.
AI authority must shrink as the consequence of dangerous failure grows.
This research is published in English and Spanish. Ver en español
La investigación detrás de esta presentación
La información urgente se volvió ruido cuando los operadores necesitaban una decisión clara. Estos términos separan optimización, control básico, seguridad y gobernanza.
Hallazgos clave
La investigación de Milford Haven informó 275 alarmas en los últimos 10,7 minutos antes de la explosión, unas 26 por minuto. UK Health and Safety Executive
Bainbridge argumentó que la automatización puede dejar a las personas las emergencias raras mientras reduce la práctica necesaria para gestionarlas. Automatica
La Ley de IA de la UE permite una multa máxima de 35 millones de euros o 7% de la facturación mundial por determinadas prácticas prohibidas. European Union
La automatización puede reducir la conciencia situacional y la recuperación manual del operador, aunque capacitación y autoridad apropiada pueden mitigar el efecto. Automatica
En cargas clínicas de 5 a 80 tareas, la precisión multiagente orquestada bajó de 90,6% a 65,3%, frente a 73,1% a 16,6% con un solo agente. preview-www.nature.com
Google informó hasta 40% menos energía de refrigeración y una reducción de 15% en la sobrecarga PUE tras aplicar control de DeepMind. Google DeepMind
Una referencia limitada a 21 fallas etiquetadas no establece desempeño ante fallas desconocidas, mantenimiento, envejecimiento de sensores o combinaciones nuevas. Computers & Chemical Engineering
Para operación continua o de alta demanda, las bandas SIL de IEC 61508 corresponden a reducciones de riesgo desde 10 a 100 hasta 10.000 a 100.000. International Electrotechnical Commission
Un orquestador centralizado puede crear una falla de causa común si no se separan comunicaciones, ejecución, credenciales y rutas seguras de respaldo. International Electrotechnical Commission
Entre 42 adoptantes iniciales de la iniciativa AI Factory de Corea del Sur, la productividad promedio aumentó 30,1% y los defectos disminuyeron 15,5%. m.ajupress.com
El argumento
Una orquestación útil prioriza alarmas en lugar de limitarse a contarlas o mostrarlas.
La IA puede optimizar un objetivo limitado, pero un caso no garantiza ahorros universales.
El objetivo ganador cambia según la planta, aunque ambos proyectos usen IA.
Todo modelo termina actuando mediante equipos, sensores y operadores.
La precisión de referencia mide casos conocidos, no resistencia ante condiciones desconocidas.
La autoridad de la IA debe reducirse cuando crece la consecuencia de una falla peligrosa.
Esta investigación se publica en inglés y español. Read in English