Cyber defense must outrun the attackerLa defensa cibernética debe superar al atacante · V7
53 slides · 26 min · 2026-08-05language
ENES
theme
LightDark
view
DeckTableTalk
brand
HanademiPlatzi
By 2025, average eCrime breakout fell to 29 minutes, with one case exfiltrating in 4 minutes.
The exposure gap more than doubled from 743 breakout windows in 2023 to 1,589 in 2025 as attackers accelerated.
6 technical terms carry much of the argument.
En 2025, la expansión media del cibercrimen bajó a 29 minutos, con un caso que exfiltró en 4 minutos.
La brecha de exposición aumentó más del doble, de 743 ventanas de propagación en 2023 a 1.589 en 2025, a medida que los atacantes aceleraron.
6 términos técnicos sostienen buena parte del argumento.
The first clock is already uncomfortable. CrowdStrike's interactive intrusion average fell from 98 minutes to 62, and that 62-minute window is shorter than many manual escalation cycles. The later eCrime measure is even faster: 29 minutes in 2025, with a 27-second record and exfiltration beginning within 4 minutes in one case. The point is not that every attack is automated. It is that manual response can arrive after the damage has started.
El primer reloj ya resulta incómodo. El promedio de intrusiones interactivas de CrowdStrike bajó de 98 a 62 minutos, y esa ventana de 62 minutos es menor que muchos ciclos manuales de escalamiento. La medida posterior del cibercrimen es aún más rápida: 29 minutos en 2025, con un récord de 27 segundos y una exfiltración que comenzó en 4 minutos en un caso. El punto no es que todos los ataques estén automatizados. Es que la respuesta manual puede llegar después de que comienza el daño.
6 términos técnicos sostienen buena parte del argumento.
The fastest handoff occurs at nearly the same scale as breakout, while exfiltration can begin before one seventh of the average breakout window has elapsed.
La transferencia más rápida ocurre casi en la misma escala que la propagación, mientras la exfiltración puede comenzar antes de que transcurra una séptima parte de la ventana promedio.
Para 2023, el índice de horizonte de modelos llegó a 10,8 mientras la velocidad de intrusión alcanzó 1,6, creando una divergencia de aceleración de 6,8 veces.
The important change is the clock. METR estimated a 7-month doubling period for frontier software-task capability, while AISI later estimated 4.7 months for autonomous cyber-task horizons, compared with its earlier 8-month estimate. The milestones make that abstract pace tangible: models completed apprentice-level cyber tasks 50% of the time, and AISI tested a first expert-level task normally requiring more than 10 years of experience. That is enough to demand machine-speed preparation, not enough to abandon human control.
El cambio importante está en el reloj. METR estimó un periodo de duplicación de 7 meses para la capacidad de los modelos de frontera en tareas de software, mientras que AISI estimó después 4,7 meses para los horizontes de tareas cibernéticas autónomas, frente a su cálculo anterior de 8 meses. Los hitos vuelven concreto ese ritmo: los modelos completaron tareas cibernéticas de nivel aprendiz el 50% de las veces, y AISI probó una primera tarea experta que normalmente exige más de 10 años de experiencia. Es suficiente para exigir preparación a velocidad de máquina, pero no para abandonar el control humano.
The frontier is not one smooth capability curve. In corporate attack tasks, the average rose from 1.7 steps with GPT-4o to 9.8 with Opus 4.6, and the best run completed 22 of 32 steps. But industrial-control tasks held models to 1.2 to 1.4 steps on average, with a maximum of 3. Anthropic's 3 unauthorized-access cases in 141,006 evaluation runs show why the system still needs containment and oversight without pretending the evidence supports a precise risk rate.
La frontera no es una curva de capacidad uniforme. En tareas de ataque corporativo, el promedio subió de 1,7 pasos con GPT-4o a 9,8 con Opus 4.6, y la mejor ejecución completó 22 de 32 pasos. Pero las tareas de control industrial mantuvieron a los modelos en 1,2 a 1,4 pasos de promedio, con un máximo de 3. Los 3 casos de acceso no autorizado de Anthropic en 141.006 ejecuciones de evaluación muestran por qué el sistema aún necesita contención y supervisión, sin fingir que la evidencia permite una tasa de riesgo precisa.
The human element is falling, but it is nowhere near gone. Verizon still attributed a human element to 68% of breaches in 2024. The 2025 entry points make the operating problem concrete: credential abuse led at 22%, followed by vulnerability exploitation at 20%.
El componente humano está disminuyendo, pero está lejos de desaparecer. Verizon aún atribuyó un componente humano al 68% de las brechas en 2024. Los puntos de entrada de 2025 vuelven concreto el problema operativo: el abuso de credenciales lideró con 22%, seguido por la explotación de vulnerabilidades con 20%.
Human risk makes communication, ownership, and timely decisions part of the control environment.
El riesgo humano convierte la comunicación, la responsabilidad y las decisiones oportunas en parte del entorno de control.
Attackers can mass-exploit some edge vulnerabilities in a median of 0 days. Organizations started with a 32-day remediation gap, while edge devices and VPNs grew from 3% to 22% of exploitation targets. The later fall to 3 median days and CISA's 2-hour scoping target show the direction required, not permission to slow down.
Los atacantes pueden explotar masivamente algunas vulnerabilidades perimetrales en una mediana de 0 días. Las organizaciones partían de una brecha de corrección de 32 días, mientras los dispositivos perimetrales y las VPN crecían del 3% al 22% de los objetivos de explotación. La caída posterior a 3 días medianos y la meta de alcance de 2 horas de CISA muestran la dirección necesaria, no permiso para desacelerar.
Ransomware pressure is rising, not fading. Verizon saw ransomware in 44% of reviewed breaches, up from 32%, while the share of victims that did not pay rose from 50% to 64%. Microsoft adds the operational lesson: despite 2.75 times more encounters, automatic disruption helped cut encryption-stage attacks threefold, though unmanaged devices appeared in more than 90% of ransom-stage attacks.
La presión del ransomware está aumentando, no desapareciendo. Verizon encontró ransomware en el 44% de las brechas revisadas, frente al 32%, mientras la proporción de víctimas que no pagaron subió del 50% al 64%. Microsoft añade la lección operativa: pese a 2,75 veces más encuentros, la disrupción automática ayudó a reducir tres veces los ataques en etapa de cifrado, aunque los dispositivos no administrados aparecieron en más del 90% de los ataques en etapa de rescate.
Un aumento de 2,75 veces en los encuentros combinado con una caída de tres veces en el cifrado reduce a 12 el índice implícito de conversión de encuentros a cifrado.
The first layer works: Microsoft reported a 99.2% reduction in observed account-compromise risk with MFA. But identity controls are not magic doors. CISA names three ways weaker implementations can be undermined, while GenAI use adds unmanaged account paths inside corporate environments.
La primera capa funciona: Microsoft reportó una reducción del 99,2% en el riesgo observado de compromiso de cuentas con MFA. Pero los controles de identidad no son puertas mágicas. CISA nombra tres formas de debilitar implementaciones menos resistentes, mientras el uso de GenAI añade rutas de cuentas no gestionadas dentro de entornos corporativos.
The operating problem is scale. Microsoft reports 600 million attacks per day, equivalent to 25 million per hour, while its 2025 systems processed 100 trillion security signals each day. These are different measures, but they point to the same operational fact: people cannot inspect this stream one alert at a time.
El problema operativo es la escala. Microsoft reporta 600 millones de ataques por día, equivalentes a 25 millones por hora, mientras sus sistemas de 2025 procesaron 100 billones de señales de seguridad diarias. Son medidas distintas, pero apuntan al mismo hecho operativo: las personas no pueden revisar este flujo alerta por alerta.
The password problem is not fading into the background. Microsoft reports a rise from 579 attacks per second in 2021 to 7,000 in 2024. More than 99% of the identity attacks in its observed telemetry involved passwords, making identity protection a central operating requirement.
El problema de las contraseñas no está desapareciendo. Microsoft reporta un aumento de 579 ataques por segundo en 2021 a 7.000 en 2024. Más del 99% de los ataques de identidad en su telemetría observada involucraron contraseñas, lo que convierte la protección de identidad en un requisito operativo central.
The threat mix is changing, not merely getting bigger. Microsoft reported 400% growth in techscam traffic between 2021 and 2023, compared with 180% for malware and 30% for phishing. That gap points to attacks that exploit people and trust, not only software weaknesses.
La mezcla de amenazas está cambiando, no solo creciendo. Microsoft reportó un aumento del 400% en el tráfico de estafas tecnológicas entre 2021 y 2023, frente a 180% para el malware y 30% para el phishing. Esa brecha apunta a ataques que explotan a las personas y la confianza, no solo las fallas de software.
This is what defensive scale looks like inside a major technology ecosystem. Microsoft tracked more than 1,500 threat groups in 2024, while its security work included deleting 730,000 applications, removing 5.75 million Entra ID systems, mitigating 1.25 million DDoS attacks and reallocating about 34,000 engineers. These figures are different kinds of work, but together they show why defense cannot be reduced to choosing one model.
Así se ve la escala defensiva dentro de un gran ecosistema tecnológico. Microsoft rastreó más de 1.500 grupos de amenazas en 2024, mientras su trabajo de seguridad incluyó eliminar 730.000 aplicaciones, retirar 5,75 millones de sistemas Entra ID, mitigar 1,25 millones de ataques DDoS y reasignar aproximadamente 34.000 ingenieros. Son tipos de trabajo diferentes, pero juntos muestran por qué la defensa no puede reducirse a elegir un solo modelo.
Microsoft’s footprint is not the defense; the operating model joining telemetry, automation, and people is.
La presencia de Microsoft no es la defensa; lo es el modelo operativo que integra telemetría, automatización y personas.
The two clocks move at very different speeds. Mandiant found that the median time attackers stayed hidden fell to 10 days in 2023. IBM still measured the average breach lifecycle at 258 days in 2024, so faster discovery does not yet mean fast end-to-end response.
Los dos relojes avanzan a velocidades muy distintas. Mandiant encontró que el tiempo mediano que los atacantes permanecieron ocultos cayó a 10 días en 2023. IBM todavía midió el ciclo medio de brecha en 258 días en 2024, así que descubrir antes no significa responder rápido de principio a fin.
La permanencia cayó con fuerza mientras el ciclo completo apenas cambió, desplazando una proporción creciente del tiempo más allá de la presencia oculta del atacante.
Attack signals rarely arrive in one clean stream. MITRE’s strategies connect identity, cloud, email, endpoint, file and network evidence, while its catalog defines 120 data components. Microsoft’s Go Hunt then narrows the search around the earliest related activity within 30 days. Speed comes from joining the evidence, not merely collecting more alerts.
Las señales de ataque rara vez llegan en un flujo limpio. Las estrategias de MITRE conectan evidencia de identidad, nube, correo, endpoints, archivos y red, mientras su catálogo define 120 componentes de datos. Go Hunt de Microsoft concentra después la búsqueda alrededor de la primera actividad relacionada durante 30 días. La velocidad nace de unir la evidencia, no solo de acumular alertas.
A detection model is never finished just because its rules run. In October 2025, ATT&CK version 18 deprecated data sources as a framework layer. The practical lesson is simple: operating teams need a maintenance loop that follows the model they depend on.
Un modelo de detección nunca está terminado solo porque sus reglas funcionan. En octubre de 2025, ATT&CK versión 18 dejó obsoletas las fuentes de datos como capa del marco. La lección práctica es simple: los equipos necesitan un ciclo de mantenimiento que siga el modelo del que dependen.
The strongest case for AI assistance is operational, not magical. In a randomized trial, analysts produced 6.5 times more true positives per minute and improved verdict accuracy by 77%. Live operations also showed a 30.13% association with faster resolution, but that result was not causal proof. Faster work still needs evidence-linked judgment.
El argumento más fuerte a favor de la asistencia de IA es operativo, no mágico. En un ensayo aleatorizado, los analistas produjeron 6,5 veces más positivos verdaderos por minuto y mejoraron la precisión del veredicto en 77%. Las operaciones reales también mostraron una asociación de 30,13% con una resolución más rápida, pero ese resultado no probó causalidad. El trabajo más veloz aún necesita juicio vinculado a la evidencia.
Validation cannot end when a model produces an answer. ATLAS catalogs 173 techniques aimed at AI-enabled systems, alongside 35 mitigations and 63 case studies. NIST’s July 2024 profile and the Air Canada ruling in February 2024 make the boundary concrete: AI outputs need risk controls and accountability.
La validación no puede terminar cuando un modelo produce una respuesta. ATLAS cataloga 173 técnicas dirigidas a sistemas habilitados por IA, junto con 35 mitigaciones y 63 casos de estudio. El perfil de NIST de julio de 2024 y el fallo de Air Canada de febrero de 2024 vuelven concreto el límite: las salidas de IA necesitan controles de riesgo y responsabilidad.
Containment has to operate inside the attacker’s movement window. Mandiant observed compromised access moving to a secondary group in under 30 seconds. At the same time, 57% of organizations first learned of malicious activity externally, and exploits led infection vectors at 33%. The control system must act before the investigation is complete.
La contención debe funcionar dentro de la ventana de movimiento del atacante. Mandiant observó que el acceso comprometido pasaba a un grupo secundario en menos de 30 segundos. Al mismo tiempo, 57% de las organizaciones conoció primero la actividad maliciosa por fuentes externas, y los exploits lideraron los vectores de infección con 33%. El sistema de controles debe actuar antes de que termine la investigación.
The risk signal did not move in a straight line. Google Project Zero recorded 58 exploited zero-days in 2021, a trough of 41 in 2022, and 97 in 2023. That rebound makes prioritization matter: remediation teams need to find what is being exploited and exposed, not simply count open vulnerabilities.
La señal de riesgo no avanzó en línea recta. Google Project Zero registró 58 vulnerabilidades de día cero explotadas en 2021, un mínimo de 41 en 2022 y 97 en 2023. Ese repunte vuelve clave la priorización: los equipos de remediación deben encontrar qué se está explotando y exponiendo, no solo contar vulnerabilidades abiertas.
The old question was how long a patching queue could stay open. BOD 26-04 changes the question to what the vulnerability enables and where it is exposed. The response ladder falls from 60 days to 3, and affected assets should be scoped within the first 2 hours. The March 2025 EPSS shift and the 2026 CISA milestones show why the decision framework itself must keep moving.
La pregunta anterior era cuánto tiempo podía permanecer abierta una cola de parches. La BOD 26-04 cambia la pregunta hacia lo que permite la vulnerabilidad y dónde está expuesta. La escala de respuesta baja de 60 días a 3, y los activos afectados deben delimitarse durante las primeras 2 horas. El cambio de EPSS en marzo de 2025 y los hitos de CISA en 2026 muestran por qué el propio marco de decisión debe seguir evolucionando.
A closed ticket is not the same as a reduced risk. The operating question is whether critical, high and medium findings are moving toward repair before exploitation becomes likely. EPSS gives that work a 30-day horizon, while the remediation measure needs 3 separate severity cohorts.
Un ticket cerrado no equivale a un riesgo reducido. La pregunta operativa es si los hallazgos críticos, altos y medios avanzan hacia la reparación antes de que la explotación sea probable. EPSS da a ese trabajo un horizonte de 30 días, mientras la métrica de remediación necesita 3 cohortes de gravedad.
Identity pressure is not an edge case. Credential stuffing accounts for a median 19% of daily authentication attempts, and the rate reaches 25% at enterprises. Stolen credentials also lead the initial-access ranking at 22%, making identity controls the first barrier to strengthen.
La presión sobre la identidad no es un caso aislado. El credential stuffing representa una mediana del 19% de los intentos diarios de autenticación y llega al 25% en empresas. Las credenciales robadas también lideran el ranking de acceso inicial con 22%, por lo que los controles de identidad son la primera barrera que debe reforzarse.
The attack surface expands through access that defenders do not fully control. Verizon puts third-party involvement at 30% of breaches. Microsoft adds a sharper operational warning: more than 90% of ransom-stage attacks used unmanaged devices, even as encryption-stage attacks fell threefold over 2 years.
La superficie de ataque se expande mediante accesos que los defensores no controlan por completo. Verizon sitúa la participación de terceros en el 30% de las brechas. Microsoft añade una advertencia operativa más clara: más del 90% de los ataques en fase de rescate usaron dispositivos no administrados, aunque los ataques que llegaron al cifrado cayeron tres veces en 2 años.
AI assistance can improve the speed and accuracy of phishing analysis. The strongest result is 6.5 times more true positives per analyst-minute. But the same study shows analysts spent 53% more time on malicious emails, while automation-bias research warns that approval can become complacent, error-prone or incomplete.
La asistencia de IA puede mejorar la velocidad y la precisión del análisis de phishing. El resultado más fuerte es 6,5 veces más positivos verdaderos por minuto de analista. Pero el mismo estudio muestra que los analistas dedicaron 53% más tiempo a los correos maliciosos, mientras la investigación sobre sesgo de automatización advierte que la aprobación puede volverse complaciente, propensa a errores o incompleta.
Reporting is not one deadline. NYDFS can require action within 24 or 72 hours, with 30 days for payment explanations. The SEC adds structured disclosure and had 26 companies reporting under the new item by February 11, 2025. DORA began major-incident reporting on January 17, 2025, and NYDFS sets an April 15 annual filing date.
La notificación no tiene un solo plazo. NYDFS puede exigir una acción en 24 o 72 horas, con 30 días para explicar los pagos. La SEC añade una divulgación estructurada y 26 empresas habían reportado bajo el nuevo ítem al 11 de febrero de 2025. DORA comenzó la notificación de incidentes graves el 17 de enero de 2025, y NYDFS fija el 15 de abril para la presentación anual.
The financial damage is not holding still. IBM's estimate rises in every year shown, from $3.86 million in 2020 to $4.88 million in 2024. That steady climb makes response speed part of financial resilience.
El daño financiero no se mantiene estable. La estimación de IBM sube en cada año mostrado, de US$3,86 millones en 2020 a US$4,88 millones en 2024. Ese aumento constante convierte la velocidad de respuesta en parte de la resiliencia financiera.
El riesgo de cola puede superar cientos de eventos promedio y más de mil ahorros por automatización, por lo que el retorno promedio no sustituye la resiliencia.
The update was reverted in under an hour. That did not prevent 8.5 million Windows systems from crashing because the validation path had already failed. Recovery was strong, but safe automation must catch errors before release, not only repair them afterward.
La actualización se revirtió en menos de una hora. Eso no evitó que colapsaran 8,5 millones de sistemas Windows porque la ruta de validación ya había fallado. La recuperación fue sólida, pero la automatización segura debe detectar los errores antes del lanzamiento, no solo repararlos después.
Regulation turns resilience into a calendar discipline. DORA requires threat-led testing at least every 3 years. The FCA deadline shows the other side of the problem: firms must also prove their important services stay within impact tolerances by a fixed date.
La regulación convierte la resiliencia en una disciplina de calendario. DORA exige pruebas dirigidas por amenazas al menos cada 3 años. El plazo de la FCA muestra el otro lado del problema: las firmas también deben demostrar que sus servicios importantes se mantienen dentro de las tolerancias de impacto en una fecha fija.
Most reported losses are small compared with the disasters that shape confidence. The IMF counted more than 20,000 incidents and about $12 billion in direct losses. Yet extreme incidents reached roughly $2.5 billion, and Equifax paid more than $1 billion in penalties, so averages cannot carry the whole risk story.
La mayoría de las pérdidas reportadas son pequeñas frente a los desastres que afectan la confianza. El FMI contó más de 20.000 incidentes y unos US$12.000 millones en pérdidas directas. Sin embargo, los incidentes extremos llegaron a unos US$2.500 millones y Equifax pagó más de US$1.000 millones en sanciones, por lo que los promedios no cuentan toda la historia del riesgo.
This is not a niche exercise for a few specialists. The ECB's 2024 cyber resilience stress test covered 109 directly supervised banks, and 28 received more extensive testing. Systemic resilience is being tested as a sector responsibility.
No es un ejercicio limitado a unos pocos especialistas. La prueba de resistencia cibernética de 2024 del BCE cubrió 109 bancos supervisados directamente, y 28 recibieron pruebas más exhaustivas. La resiliencia sistémica se está evaluando como una responsabilidad sectorial.
A benchmark cannot stand in for a defensive capability. Meta's evaluation covered 8 risks, MITRE tested 30 enterprise solutions, and NIST framed trustworthy-AI risk management for critical infrastructure in 2026. The direction is clear: evaluate the system, the threat and the consequences together.
Una referencia no puede sustituir una capacidad defensiva. La evaluación de Meta cubrió 8 riesgos, MITRE probó 30 soluciones empresariales y NIST planteó en 2026 la gestión de riesgos de IA confiable para infraestructura crítica. La dirección es clara: hay que evaluar juntos el sistema, la amenaza y las consecuencias.
The defensive test community expanded quickly, from 12 participating vendors to 29 in just 2 years. That growth matters because capability cannot be judged by a single model score. CyberSecEval adds a deeper layer, using 189 rules to inspect 50 insecure coding practices. The lesson is simple: serious defense needs broad evaluation and detailed testing.
La comunidad de pruebas defensivas creció rápido, de 12 proveedores participantes a 29 en solo 2 años. Eso importa porque la capacidad no puede juzgarse con una sola puntuación de modelo. CyberSecEval añade una capa más profunda, con 189 reglas para revisar 50 prácticas de código inseguro. La lección es clara: la defensa seria necesita evaluación amplia y pruebas detalladas.
The operating model is not one alert in isolation. In Microsoft’s September 2024 case, the investigation linked 25 alerts across 3 devices, 4 users and 1 email account. Security Copilot became generally available on April 1, 2024. The ransomware walkthrough is a demonstration, and the 30% MTTR figure is Microsoft research, so both belong beside the workflow, not above the evidence.
El modelo operativo no consiste en una alerta aislada. En el caso de Microsoft de septiembre de 2024, la investigación conectó 25 alertas entre 3 dispositivos, 4 usuarios y 1 cuenta de correo. Security Copilot alcanzó disponibilidad general el 1 de abril de 2024. El recorrido de ransomware es una demostración y la cifra de 30% menos de MTTR es investigación de Microsoft, por lo que ambos deben acompañar al flujo, no reemplazar la evidencia.
A large agent ecosystem is not an outcome by itself. Security Copilot was described as having 13 active agents, with 6 from Microsoft and 7 from partners. The stronger test is whether a task changes in a measurable way. Microsoft reports up to 550% faster phishing triage and 204% more missing policies found, but those figures remain vendor-attributed outcomes.
Un ecosistema grande de agentes no es un resultado por sí mismo. Security Copilot fue descrito con 13 agentes activos, 6 de Microsoft y 7 de socios. La prueba más fuerte es si una tarea cambia de forma medible. Microsoft reporta un triaje de phishing hasta 550% más rápido y 204% más políticas faltantes identificadas, pero esas cifras siguen siendo resultados atribuidos al proveedor.
The defensive problem begins with scale. Microsoft detected more than 30 billion phishing emails aimed at customers during 2024. Jon Hernández’s reach can help open the conversation, with self-reported figures spanning talks, subscribers, views and students, plus 1.7 million views for a 2025 interview. The two sources serve different jobs: one frames exposure, the other makes the topic accessible.
El problema defensivo empieza por la escala. Microsoft detectó más de 30 mil millones de correos de phishing dirigidos a clientes durante 2024. El alcance de Jon Hernández puede abrir la conversación, con cifras autodeclaradas de ponencias, suscriptores, vistas y alumnos, además de 1,7 millones de vistas para una entrevista de 2025. Las dos fuentes cumplen funciones distintas: una enmarca la exposición y la otra vuelve accesible el tema.
Cost follows access. Microsoft says eligible public-web declarative agents add no cost, while agents that reach shared tenant data are billed by measured consumption. That distinction matters before a financial institution scales a defensive agent across controlled data.
El costo sigue al acceso. Microsoft afirma que los agentes declarativos elegibles basados en la web pública no añaden costo, mientras que los agentes que acceden a datos compartidos del inquilino se cobran por consumo medido. Esa distinción importa antes de que una institución financiera escale un agente defensivo sobre datos controlados.
Automation does not remove human authority. NIST gives the governance loop 4 functions: Govern, Map, Measure and Manage. The practical decision rule is to move from reversible actions to customer-impacting and irreversible actions with stronger authorization. EU Article 14 makes that proportionality explicit, and the reported penalty can reach EUR 15 million or 3% of worldwide annual turnover.
La automatización no elimina la autoridad humana. NIST organiza el ciclo de gobernanza en 4 funciones: Gobernar, Mapear, Medir y Gestionar. La regla práctica es pasar de acciones reversibles a acciones con impacto al cliente e irreversibles con una autorización más fuerte. El artículo 14 de la UE hace explícita esa proporcionalidad, y la sanción reportada puede llegar a EUR 15 millones o 3% de la facturación anual mundial.
By 2025, average eCrime breakout fell to 29 minutes, with one case exfiltrating in 4 minutes. 6 technical terms carry much of the argument.
Key findings
CrowdStrike reverted the faulty update within an hour, but approximately 8.5 million Windows systems had already crashed. bleepingcomputer.com
In 2025, average eCrime breakout fell to 29 minutes, the fastest took 27 seconds, and one intrusion began exfiltration within four minutes. crowdstrike.com
BOD 26-04 prioritizes KEV vulnerabilities on publicly exposed assets that enable total control, while deferring lower-risk vulnerabilities. cisa.gov
Organizations took a median 32 days to remediate edge-device vulnerabilities that attackers could mass-exploit in a median of zero days. blog.qualys.com
After reviewing 141,006 evaluation runs, Anthropic identified three cases where Claude gained unauthorized access to three organizations’ production infrastructure. anthropic.com
METR estimated that frontier models' 50% software-task horizon doubled approximately every seven months from 2019 through early 2025. METR
Microsoft reported that its customers face more than 600 million cybercriminal and nation-state attacks each day. Microsoft
Microsoft reported more than 4,000 password attacks per second in 2023, equivalent to 240,000 per minute and 14.4 million per hour. Microsoft
A 2022 peer-reviewed study found about 40% of GitHub Copilot programs generated for selected security scenarios contained vulnerable code. IEEE
The IMF counted more than 20,000 financial-sector cyber incidents since 2004, with approximately $12 billion in reported direct losses. International Monetary Fund
The IMF reported that extreme cyber losses had more than quadrupled since 2017, with some recent incidents reaching approximately $2.5 billion. International Monetary Fund
Despite 2.75x more ransomware-linked encounters, encryption-stage attacks fell threefold over two years due to automatic attack disruption; over 90% of ransom-stage attacks involved unmanaged devices. microsoft.com
The argument
The fastest handoff occurs at nearly the same scale as breakout, while exfiltration can begin before one seventh of the average breakout window has elapsed.
By 2023 the model-horizon index reached 10.8 while intrusion speed reached 1.6, creating a 6.8-fold divergence in acceleration.
The shortest scoping target already exceeds four breakout windows, while the longest remediation tier spans nearly 3,000.
Average breakout accelerated by 66% while median dwell lengthened by 27%, combining faster movement with longer concealment.
If baseline MTTR exceeds the threshold, the reported AI improvement still cannot complete resolution before an average attacker breaks out.
The exposure gap more than doubled from 743 breakout windows in 2023 to 1,589 in 2025 as attackers accelerated.
This research is published in English and Spanish. Ver en español
La investigación detrás de esta presentación
En 2025, la expansión media del cibercrimen bajó a 29 minutos, con un caso que exfiltró en 4 minutos. 6 términos técnicos sostienen buena parte del argumento.
Hallazgos clave
CrowdStrike revirtió la actualización defectuosa en menos de una hora, pero aproximadamente 8,5 millones de sistemas Windows ya habían colapsado. bleepingcomputer.com
En 2025, el tiempo promedio de movimiento lateral del cibercrimen bajó a 29 minutos, el caso más rápido tomó 27 segundos y una intrusión inició la exfiltración en cuatro minutos. crowdstrike.com
La BOD 26-04 prioriza vulnerabilidades KEV en activos expuestos públicamente que permiten control total, mientras aplaza las vulnerabilidades de menor riesgo. cisa.gov
Las organizaciones tardaron una mediana de 32 días en corregir vulnerabilidades perimetrales que los atacantes podían explotar masivamente en una mediana de cero días. blog.qualys.com
Tras revisar 141.006 ejecuciones de evaluación, Anthropic identificó tres casos en los que Claude obtuvo acceso no autorizado a la infraestructura de producción de tres organizaciones. anthropic.com
METR estimó que el horizonte del 50% para tareas de software de modelos de frontera se duplicó aproximadamente cada siete meses entre 2019 y comienzos de 2025. METR
Microsoft reportó que sus clientes enfrentan más de 600 millones de ataques diarios de ciberdelincuentes y actores estatales. Microsoft
Microsoft reportó más de 4.000 ataques de contraseña por segundo en 2023, equivalentes a 240.000 por minuto y 14,4 millones por hora. Microsoft
Un estudio revisado por pares de 2022 encontró que cerca del 40% de los programas generados por GitHub Copilot para escenarios seleccionados contenían código vulnerable. IEEE
El FMI contabilizó más de 20.000 incidentes cibernéticos financieros desde 2004, con aproximadamente 12.000 millones de dólares en pérdidas directas reportadas. International Monetary Fund
El FMI reportó que las pérdidas cibernéticas extremas se habían más que cuadruplicado desde 2017, con algunos incidentes recientes cercanos a 2.500 millones de dólares. International Monetary Fund
Pese a 2,75 veces más encuentros vinculados con ransomware, los ataques que llegaron al cifrado cayeron tres veces en dos años por la interrupción automática; más del 90% involucró dispositivos no administrados. microsoft.com
El argumento
La transferencia más rápida ocurre casi en la misma escala que la propagación, mientras la exfiltración puede comenzar antes de que transcurra una séptima parte de la ventana promedio.
Para 2023, el índice de horizonte de modelos llegó a 10,8 mientras la velocidad de intrusión alcanzó 1,6, creando una divergencia de aceleración de 6,8 veces.
El objetivo de alcance más corto ya supera cuatro ventanas de propagación, mientras el nivel de remediación más largo abarca casi 3.000.
La propagación promedio se aceleró un 66% mientras la permanencia mediana se alargó un 27%, combinando movimientos más rápidos con mayor ocultamiento.
Si el MTTR base supera el umbral, la mejora de IA reportada aún no permite completar la resolución antes de una propagación atacante promedio.
La brecha de exposición aumentó más del doble, de 743 ventanas de propagación en 2023 a 1.589 en 2025, a medida que los atacantes aceleraron.
Esta investigación se publica en inglés y español. Read in English