This is the central warning for predictive care. The original algorithm used spending as a proxy for health need and selected 17.7% of Black patients for added care. Correcting that proxy raised selection to 46.5%. Model design can change who receives help before anyone debates model complexity.
Esta es la advertencia central para la atención predictiva. El algoritmo original usó el gasto como sustituto de la necesidad y seleccionó al 17,7% de los pacientes negros para atención adicional. Corregir ese indicador elevó la selección al 46,5%. El diseño puede cambiar quién recibe ayuda antes de debatir la complejidad del modelo.
5 términos técnicos sostienen buena parte del argumento.
The United States trend is not a brief spike. CDC data show the age-adjusted rate rose from 10.4 per 100,000 in 2000 to 14.3 in 2022. The plotted series also rises across most of 2000-2021, despite short reversals.
La tendencia estadounidense no es un pico breve. Los datos de los CDC muestran que la tasa ajustada por edad subió de 10,4 por 100.000 en 2000 a 14,3 en 2022. La serie graficada también aumenta durante la mayor parte de 2000-2021, pese a breves retrocesos.
Longitudinal records can concentrate risk sharply. One outpatient model placed 43% of later attempts inside the highest-risk 5% of visits, an 8.6 times concentration over untargeted selection. A separate electronic-record study reported discrimination near 0.84 at 7 days. These results support ranking, not certainty about any individual.
Los registros longitudinales pueden concentrar el riesgo con fuerza. Un modelo ambulatorio situó el 43% de los intentos posteriores dentro del 5% de visitas de mayor riesgo, una concentración 8,6 veces superior a una selección no dirigida. Otro estudio de registros electrónicos informó una discriminación cercana a 0,84 a 7 días. Estos resultados apoyan la priorización, no la certeza sobre una persona.
Clinical data offers a short film of people who use connected services. It offers no footage of people who never enter that system. A systematic review estimated that only about 31% of suicide decedents had contacted mental-health services in the prior year. Coverage is therefore a separate problem from model accuracy.
Los datos clínicos ofrecen una película corta de quienes usan servicios conectados. No ofrecen imágenes de quienes nunca entran en ese sistema. Una revisión sistemática estimó que solo cerca del 31% de las personas fallecidas por suicidio había contactado servicios de salud mental el año anterior. La cobertura es un problema distinto de la exactitud.
Risk concentration can look impressive while still leaving a difficult operational question. In Army psychiatric hospitalizations, the highest-risk 5% contained 52.9% of suicides over the following 12 months. That horizon may support long-term follow-up, but it does not automatically define what should happen this week. Prediction becomes actionable only when the response fits the clock.
La concentración del riesgo puede parecer impresionante y aun dejar una pregunta operativa difícil. En hospitalizaciones psiquiátricas militares, el 5% de mayor riesgo concentró el 52,9% de los suicidios durante los 12 meses siguientes. Ese horizonte puede apoyar un seguimiento prolongado, pero no define automáticamente qué hacer esta semana. La predicción se vuelve accionable cuando la respuesta encaja con el plazo.
Disaster response offers a useful analogy for clinical prediction. Start Ready activated 55 hours before Typhoon Doksuri made landfall, yet it reached 252 households before landfall and 4,634 afterward. The warning existed, but most delivery still came later. Behavioral health systems face the same gap between knowing and acting.
La respuesta ante desastres ofrece una analogía útil para la predicción clínica. Start Ready se activó 55 horas antes del impacto del tifón Doksuri, pero atendió a 252 hogares antes y a 4.634 después. La alerta existía, pero la mayor parte de la ayuda llegó más tarde. Los sistemas de salud conductual enfrentan la misma distancia entre saber y actuar.
A warning creates value only when people can translate lead time into action.
Una alerta solo genera valor cuando las personas pueden convertir el tiempo de anticipación en acción.
A forecast horizon is not useful merely because it is measurable. CERES says existing famine-warning systems offer 30 to 45 actionable days, while food positioning, logistics, and emergency funding require 60 to 90 days. The response clock is longer than the warning clock. Behavioral health models should start with the intervention deadline and work backward.
Un horizonte de pronóstico no es útil solo porque pueda medirse. CERES afirma que los sistemas existentes de alerta de hambruna ofrecen entre 30 y 45 días útiles, mientras que alimentos, logística y financiamiento de emergencia requieren entre 60 y 90 días. El reloj de la respuesta es más largo que el de la alerta. Los modelos de salud conductual deben partir del plazo de intervención y trabajar hacia atrás.
Prediction is not the treatment. Effective care is what turns an earlier signal into better outcomes. The table keeps each source's entity and value distinct.
La predicción no es el tratamiento. La atención eficaz es lo que convierte una señal temprana en mejores resultados. La tabla mantiene separadas la entidad y el valor de cada fuente.
Thresholds are workload decisions, not merely statistical settings. In a population of 1 million, a 1% threshold creates 10,000 reviews and a 20% threshold creates 200,000. Even the 5% threshold creates 50,000 cases. A deployment plan must price the human work before switching on alerts.
Los umbrales son decisiones de carga laboral, no simples ajustes estadísticos. En una población de 1 millón, un umbral del 1% crea 10.000 revisiones y uno del 20% crea 200.000. Incluso el umbral del 5% genera 50.000 casos. Un plan de despliegue debe calcular el trabajo humano antes de activar alertas.
Base rates change what an alert means. In this 10,000-person simulation, the model finds 80 true cases but generates 1,980 false alerts. Only 3.9% of positive alerts are true. A model can rank risk usefully while still overwhelming staff or harming people through unnecessary escalation.
La frecuencia de base cambia lo que significa una alerta. En esta simulación de 10.000 personas, el modelo encuentra 80 casos verdaderos, pero genera 1.980 alertas falsas. Solo el 3,9% de las alertas positivas es verdadero. Un modelo puede ordenar bien el riesgo y aun saturar al personal o causar daños mediante una escalada innecesaria.
Digital access is not a behavioral health service record, but it illustrates why connected systems have uneven reach. Hanademi calculated the United Kingdom share minus Japan's share across 25 aligned years. The difference moved above and below zero before reaching 9.93 percentage points in 2024. A model tied to connected services inherits the boundaries of its local access environment.
El acceso digital no es un registro de servicios de salud conductual, pero ilustra por qué los sistemas conectados tienen un alcance desigual. Hanademi calculó la proporción del Reino Unido menos la de Japón durante 25 años alineados. La diferencia pasó por encima y por debajo de cero antes de alcanzar 9,93 puntos porcentuales en 2024. Un modelo ligado a servicios conectados hereda los límites de su entorno local de acceso.
Linked behavioral data depends on infrastructure, but infrastructure differs sharply across countries. Hanademi calculated Germany's secure-server rate minus the United Kingdom's across 15 aligned years. The difference peaked at about 92,642 per million in 2023 and remained 83,719 in 2024. This does not measure privacy quality, but it warns against assuming identical deployment conditions.
Los datos conductuales vinculados dependen de infraestructura, pero esa infraestructura difiere mucho entre países. Hanademi calculó la tasa alemana de servidores seguros menos la del Reino Unido durante 15 años alineados. La diferencia alcanzó cerca de 92.642 por millón en 2023 y se mantuvo en 83.719 en 2024. Esto no mide la calidad de la privacidad, pero advierte contra suponer condiciones de despliegue idénticas.
The safest model is not the one with the most impressive retrospective score. It is the one whose purpose, users, errors, workload, and interventions remain visible after deployment. NIST organizes that work around 4 recurring functions: govern, map, measure, and manage. Clinical judgment stays in control only when evidence and options remain reviewable.
El modelo más seguro no es el que tiene la puntuación retrospectiva más impresionante. Es aquel cuyo propósito, usuarios, errores, carga laboral e intervenciones siguen siendo visibles después del despliegue. El NIST organiza ese trabajo en 4 funciones recurrentes: gobernar, mapear, medir y gestionar. El juicio clínico conserva el control solo cuando la evidencia y las opciones siguen siendo revisables.
A biased target can deny care even when the model appears accurate. CDC data show the age-adjusted US suicide rate rose from 10.4 per 100,000 in 2000 to 14.3 in 2022.
Key findings
A meta-analysis covering 50 years found that traditional suicide risk factors predicted only slightly better than chance and had not improved materially. Psychological Bulletin
WHO reported roughly 1.4 mental-health workers per 100,000 people in low-income countries, compared with more than 60 in high-income countries. World Health Organization
At 1 percent prevalence, 80 percent sensitivity and specificity produce 80 true alerts, 1,980 false alerts, and 3.9 percent positive predictive value. BMJ
Correcting a cost-based health-risk proxy increased Black patients selected for additional care from 17.7 percent to 46.5 percent. Science
Individuals using the Internet: the gap between United Kingdom and Japan reached 10 % of population in 2024. World Bank Open Data
Secure Internet servers: the gap between Germany and United Kingdom reached 83719 per 1 million people in 2024. World Bank Open Data
A systematic review estimated that only about 31 percent of suicide decedents contacted mental-health services during the preceding year. BMC Health Services Research
Across 71 comparable clinical prediction studies, machine learning showed no systematic performance advantage over logistic regression. Journal of Clinical Epidemiology
In Army psychiatric hospitalizations, the highest-risk 5 percent contained 52.9 percent of suicides occurring during the following 12 months. JAMA Psychiatry
Accurate risk prediction alone does not demonstrate reductions in attempts, hospitalization, injury, coercive intervention, or mortality. BMJ
Capturing 43 percent of attempts in the highest-risk 5 percent represents 8.6 times the concentration expected from untargeted selection. American Journal of Psychiatry
Among 81 non-randomized deep-learning imaging studies, only nine were prospective and six tested performance in real-world clinical settings. BMJ
The argument
Service histories can turn a broad population into a smaller outreach queue.
Only about 31% of suicide decedents had contacted mental-health services during the preceding year.
Three source-specific findings point in the same direction: more complexity does not guarantee better prediction.
A useful forecast must name both the outcome and its response window.
Lead time has value only when operations can use it.
Warnings offer 30-45 days, while the response requires 60-90.
This research is published in English and Spanish. Ver en español
La investigación detrás de esta presentación
Un objetivo sesgado puede negar atención aunque el modelo parezca exacto. Los datos de los CDC muestran que la tasa estadounidense ajustada por edad subió de 10,4 por 100.000 en 2000 a 14,3 en 2022.
Hallazgos clave
Un metaanálisis de 50 años encontró que los factores tradicionales de riesgo suicida predijeron apenas mejor que el azar y no mejoraron sustancialmente. Psychological Bulletin
La OMS informó alrededor de 1,4 trabajadores de salud mental por 100.000 habitantes en países de ingreso bajo, frente a más de 60 en los ricos. World Health Organization
Con prevalencia de 1 por ciento y sensibilidad y especificidad de 80 por ciento se producen 80 alertas verdaderas, 1.980 falsas y valor predictivo de 3,9 por ciento. BMJ
Corregir un indicador de riesgo basado en costos aumentó los pacientes negros seleccionados para atención adicional de 17,7 a 46,5 por ciento. Science
Individuals using the Internet: la brecha entre United Kingdom y Japan alcanzó 10 % of population en 2024. World Bank Open Data
Secure Internet servers: la brecha entre Germany y United Kingdom alcanzó 83719 per 1 million people en 2024. World Bank Open Data
Una revisión sistemática estimó que solo alrededor de 31 por ciento de quienes murieron por suicidio contactó servicios de salud mental el año anterior. BMC Health Services Research
En 71 estudios clínicos comparables, el aprendizaje automático no mostró una ventaja sistemática sobre la regresión logística. Journal of Clinical Epidemiology
En hospitalizaciones psiquiátricas militares, el 5 por ciento de mayor riesgo concentró 52,9 por ciento de los suicidios durante los 12 meses siguientes. JAMA Psychiatry
Una predicción exacta por sí sola no demuestra reducciones en intentos, hospitalización, lesiones, intervenciones coercitivas o mortalidad. BMJ
Capturar 43 por ciento de los intentos en el 5 por ciento de mayor riesgo representa 8,6 veces la concentración esperada sin selección. American Journal of Psychiatry
Entre 81 estudios no aleatorizados de aprendizaje profundo en imágenes, solo nueve fueron prospectivos y seis probaron entornos clínicos reales. BMJ
El argumento
Los historiales de atención pueden convertir una población amplia en una cola menor de contacto.
Solo cerca del 31% de quienes murieron por suicidio había contactado servicios de salud mental el año anterior.
Tres hallazgos de fuentes distintas apuntan en la misma dirección: más complejidad no garantiza una mejor predicción.
Un pronóstico útil debe definir el resultado y su ventana de respuesta.
El tiempo de anticipación solo vale cuando la operación puede aprovecharlo.
Las alertas ofrecen 30-45 días, pero la respuesta requiere 60-90.
Esta investigación se publica en inglés y español. Read in English