Trust and Safety earns its keepConfianza y Seguridad se gana su lugar · V7
28 slides · 23 min · 2026-08-06language
ENES
theme
LightDark
view
DeckTableTalk
brand
HanademiPlatzi
Payment trust matters, but it cannot rescue an expensive or inconvenient offer.
GAO estimates annual federal fraud losses at $233B to $521B.
One Yelp star was associated with a 7% midpoint revenue gain.
La confianza en el pago importa, pero no rescata una oferta cara o incómoda.
La GAO estima pérdidas federales anuales de US$233.000M a US$521.000M.
Una estrella en Yelp se asoció con un punto medio de 7% más ingresos.
Payment distrust consistently affects about 1 in 5 abandoned checkouts. Yet excessive costs remained much larger, reaching 48% in the earlier finding and 39% in 2025. Delivery, forced accounts, and complexity also competed with trust. Safety protects conversion best when pricing, delivery, and product teams improve the rest of the purchase.
La desconfianza en el pago afecta de forma constante cerca de 1 de cada 5 abandonos. Sin embargo, los costos excesivos fueron mucho mayores, con 48% en el hallazgo anterior y 39% en 2025. La entrega, las cuentas obligatorias y la complejidad también compitieron con la confianza. Seguridad protege mejor la conversión cuando precios, entregas y producto mejoran el resto de la compra.
5 términos técnicos sostienen buena parte del argumento.
Baymard's synthesis of 49 studies estimated that 70.2% of online carts are abandoned. That creates a large conversion pool, but it does not make every abandoned cart recoverable. Distrust is only one reason among costs, delivery, accounts, and usability. Trust and Safety should claim only the portion its interventions can measure.
La síntesis de 49 estudios de Baymard estimó que 70,2% de los carritos en línea se abandonan. Esto crea una gran oportunidad de conversión, pero no vuelve recuperable cada carrito. La desconfianza es solo un motivo entre costos, entrega, cuentas y facilidad de uso. Confianza y Seguridad debe atribuirse solo la parte que sus intervenciones puedan medir.
Aplicada de forma secuencial, la tasa de desconfianza del 18% equivale a 12,6 carritos por cada 100. Los motivos pueden solaparse y no representan ventas recuperables.
Reported consumer fraud losses rose from $3.3 billion in 2020 to more than $10 billion in 2023. That scale makes prevention a plausible margin lever. But FTC reports are unverified complaints, not a representative survey or company savings forecast. The business case must begin with losses a specific product can prevent.
Las pérdidas por fraude reportadas subieron de US$3.300 millones en 2020 a más de US$10.000 millones en 2023. Esa escala convierte la prevención en una posible palanca de margen. Pero las denuncias ante la FTC no son una encuesta representativa ni un pronóstico de ahorro empresarial. El argumento debe comenzar con pérdidas que un producto concreto pueda prevenir.
The GAO estimated that the US federal government loses between $233 billion and $521 billion to fraud each year. The range spans different programs and risk environments, so it is not a company savings estimate. It does show why prevention can carry enormous economic value. Each organization still needs its own loss baseline and control test.
La GAO estimó que el gobierno federal estadounidense pierde entre US$233.000 millones y US$521.000 millones por fraude cada año. El rango abarca programas y entornos de riesgo distintos, por lo que no es una estimación de ahorro empresarial. Sí muestra por qué la prevención puede tener un enorme valor económico. Cada organización necesita su propia base de pérdidas y su propia prueba de controles.
TAG reported invalid traffic of 0.87% in certified channels against an 8.18% industry benchmark. It described that gap as an 89% reduction. This is the shape a direct advertising return should take: less money reaching invalid inventory. Because TAG promotes certification, advertisers should reproduce the result with independent campaign data.
TAG reportó 0,87% de tráfico inválido en canales certificados frente a un referente sectorial de 8,18%. Describió esa diferencia como una reducción de 89%. Esta es la forma que debería adoptar un rendimiento publicitario directo: menos dinero destinado a inventario inválido. Como TAG promueve la certificación, los anunciantes deben reproducir el resultado con datos independientes.
The channel-rate comparison implies 89.4% prevented versus 69% in modeled losses. The scopes differ, so the rates should not be monetized one for one.
La comparación de tasas en canales implica un 89,4% evitado frente al 69% de las pérdidas modelizadas. Los alcances difieren, por lo que las tasas no deben monetizarse de forma equivalente.
A DoubleVerify case study reported saving about 14% of one technology company's APAC media spend. That is a direct commercial claim, not a general attitude survey. But the customer is unnamed and the evidence comes from the vendor selling the control. Treat it as a testable benchmark, not a guaranteed return.
Un caso de DoubleVerify reportó un ahorro cercano al 14% del gasto publicitario en Asia-Pacífico de una tecnológica. Es una afirmación comercial directa, no una encuesta general de actitudes. Pero el cliente no está identificado y la evidencia proviene del proveedor que vende el control. Debe tratarse como un referente comprobable, no como un rendimiento garantizado.
Fake-review controls do not create the same value for every stakeholder. The UK assessment projected £1.838 billion in social value but negative £1.846 billion in business value. It also estimated £48 million in annual business costs. Trust and Safety can improve a market while still requiring a hard internal return test.
Los controles contra reseñas falsas no crean el mismo valor para todos. La evaluación británica proyectó £1.838 millones de valor social, pero un valor empresarial negativo de £1.846 millones. También estimó £48 millones en costos empresariales anuales. Confianza y Seguridad puede mejorar un mercado y aun así necesitar una prueba interna rigurosa de rendimiento.
Reviews are not merely engagement content. For independent restaurants, a one-star Yelp increase was associated with 5% to 9% higher revenue, a 7% midpoint. That gives review integrity a plausible route to seller economics. The result is an association in one market, not proof that every moderation investment produces the same return.
Las reseñas no son solo contenido para generar interacción. Para restaurantes independientes, una estrella adicional en Yelp se asoció con ingresos entre 5% y 9% mayores, con un punto medio de 7%. Esto ofrece una ruta plausible desde la integridad de reseñas hasta la economía del vendedor. Es una asociación en un mercado, no una prueba de que toda inversión en moderación produzca el mismo rendimiento.
Spiegel found that purchase likelihood generally peaked between 4.0 and 4.7 stars rather than at a perfect 5.0. Buyers appear to value credibility, not polished perfection. That gives review enforcement a second commercial role beyond removing false claims. It preserves the imperfect signal that makes genuine reviews believable.
Spiegel encontró que la probabilidad de compra generalmente alcanzó su máximo entre 4,0 y 4,7 estrellas, no en un 5,0 perfecto. Los compradores parecen valorar la credibilidad, no la perfección pulida. Esto da a la aplicación de reglas sobre reseñas una segunda función comercial. Preserva la señal imperfecta que vuelve creíbles las opiniones auténticas.
After Reddit banned two hate communities, participating users who stayed used at least 80% fewer studied hate terms. That is evidence that targeted moderation changed measured behavior on the original platform. The result does not measure revenue or platform-wide retention.
Tras prohibir Reddit dos comunidades de odio, los usuarios participantes que permanecieron usaron al menos 80% menos términos de odio estudiados. Es evidencia de que la moderación focalizada cambió la conducta medida en la plataforma original. El resultado no mide ingresos ni retención general.
Airbnb reported fewer party incidents under two different control programs. Its Australian risk-scoring pilot coincided with a 35% decline, while the global party-ban period produced a 55% year-over-year decline in reports. The repeated direction strengthens the operational signal. Pandemic travel changes and company-controlled reporting prevent a clean causal or profit claim.
Airbnb reportó menos incidentes bajo dos programas de control. Su piloto australiano de puntuación de riesgo coincidió con una caída de 35%, mientras el período de prohibición global produjo una caída interanual de 55% en denuncias. La dirección repetida refuerza la señal operativa. Los cambios de viaje durante la pandemia y los datos controlados por la empresa impiden una conclusión causal o económica limpia.
Airbnb said its controls blocked or redirected risky attempts from more than 50,000 people across 15 US cities. Dallas alone accounted for 7,000 in the supplied city breakdown. Airbnb also suspended more than 6,600 guests in 2021 for violating the party prohibition. The missing number is the value of legitimate bookings blocked by mistake.
Airbnb afirmó que sus controles bloquearon o redirigieron intentos riesgosos de más de 50.000 personas en 15 ciudades estadounidenses. Dallas representó 7.000 en el desglose disponible. Airbnb también suspendió a más de 6.600 huéspedes en 2021 por infringir la prohibición. Falta el valor de las reservas legítimas bloqueadas por error.
Airbnb moved from a $4.59 billion net loss in 2020 to positive net income from 2022 onward. Its temporary global party ban began during the loss year, and reported party incidents later declined. The sequence shows that strict marketplace controls can coexist with commercial recovery. It does not isolate the ban's contribution from travel demand, costs, or the pandemic.
Airbnb pasó de una pérdida neta de US$4.590 millones en 2020 a beneficios desde 2022. Su prohibición global temporal de fiestas comenzó durante el año de pérdidas y los incidentes reportados disminuyeron después. La secuencia muestra que controles estrictos pueden coexistir con una recuperación comercial. No aísla la contribución de la prohibición frente a la demanda de viajes, los costos o la pandemia.
From 2021 to 2023, party incidents fell from 9.0 to 3.5 per 10,000 reservations while net income moved from a $0.35 billion loss to a $4.79 billion profit. This is coexistence, not a causal estimate.
De 2021 a 2023, los incidentes por fiestas bajaron de 9,0 a 3,5 por cada 10.000 reservas, mientras el beneficio neto pasó de una pérdida de 0,35 mil millones de USD a una ganancia de 4,79 mil millones. Es coexistencia, no una estimación causal.
CMS recorded about €72 million in annual GDPR fines in 2019 and approximately €2.1 billion in 2023. The endpoints show how large realized enforcement totals can become. The annual path was volatile, so this is not a smooth growth forecast. Compliance budgets should use expected exposure, not extrapolate one exceptional year.
CMS registró unos €72 millones en multas anuales del RGPD en 2019 y aproximadamente €2.100 millones en 2023. Los puntos muestran el tamaño que pueden alcanzar las sanciones realizadas. La trayectoria anual fue volátil, por lo que no es un pronóstico de crecimiento continuo. Los presupuestos deben usar exposición esperada, no extrapolar un año excepcional.
Prominent penalties include €1.2 billion against Meta, €746 million against Amazon, and €405 million concerning Instagram. These are realized enforcement outcomes, not hypothetical statutory ceilings. They justify investment in prevention at large platforms. Each company must still model its own probability and exposure rather than budget from headline cases alone.
Entre las multas destacadas figuran €1.200 millones contra Meta, €746 millones contra Amazon y €405 millones relativos a Instagram. Son resultados reales de aplicación, no límites legales hipotéticos. Justifican invertir en prevención en grandes plataformas. Cada empresa debe modelar su propia probabilidad y exposición, no presupuestar solo a partir de casos llamativos.
Regulatory exposure can scale with the company rather than with the incident. Maximum penalties reach 4% under the EU privacy law, 6% under the EU Digital Services Act, and 10% under the UK Online Safety Act. That makes safety capability financially material at scale. A sound budget still uses probability-weighted exposure, not the maximum possible fine.
La exposición regulatoria puede crecer con la empresa y no solo con el incidente. Las sanciones máximas alcanzan 4% bajo la ley europea de privacidad, 6% bajo la Ley de Servicios Digitales y 10% bajo la ley británica. Esto vuelve financieramente relevante la capacidad de seguridad. Un presupuesto sólido usa exposición ponderada por probabilidad, no la multa máxima posible.
Meta expanded its reported safety workforce from about 10,000 people in 2017 to 40,000 in 2021. It also said it invested more than $13 billion in safety and security between 2016 and September 2021. Net income later reached $62.36 billion in 2024 and $60.46 billion in 2025. Safety clearly coexisted with commercial scale, but the disclosures do not prove it caused the profits.
Meta amplió su personal de seguridad reportado de unas 10.000 personas en 2017 a 40.000 en 2021. También afirmó haber invertido más de US$13.000 millones entre 2016 y septiembre de 2021. El beneficio neto llegó después a US$62.360 millones en 2024 y US$60.460 millones en 2025. La seguridad coexistió con la escala comercial, pero las divulgaciones no prueban que causara los beneficios.
Edelman's 2019 survey found that 81% considered brand trust important or decisive when buying. That makes trust commercially relevant before a customer reaches checkout. But trust is built by product quality, service, pricing, privacy, and safety together. A Trust and Safety team cannot claim the whole 81% as its return.
La encuesta de Edelman de 2019 encontró que 81% consideraba la confianza de marca importante o decisiva al comprar. Esto vuelve comercialmente relevante la confianza antes del pago. Pero la confianza se construye con calidad, servicio, precios, privacidad y seguridad. Un equipo de Confianza y Seguridad no puede atribuirse todo ese 81%.
PwC found that 32% would leave a favored brand after one bad experience. After several bad experiences, the share reached 59%. Safety failures can become part of that cumulative damage, especially when customers face fraud, harassment, or failed appeals. The survey still cannot separate safety from every other part of the experience.
PwC encontró que 32% abandonaría una marca favorita después de una mala experiencia. Tras varias malas experiencias, la proporción llegó a 59%. Las fallas de seguridad pueden sumarse a ese daño, sobre todo ante fraude, acoso o apelaciones fallidas. La encuesta no puede separar la seguridad de todas las demás partes de la experiencia.
Meta estimated hate-speech prevalence fell from about 0.075% of views in late 2020 to roughly 0.01% in late 2023. It also reported proactive detection rising from 23.6% in late 2017 to above 95% around 2020. These metrics suggest stronger detection and lower measured exposure. A profit dashboard must also track appeals, false positives, missed abuse, and unequal error rates.
Meta estimó que la prevalencia de lenguaje de odio cayó de cerca de 0,075% de las visualizaciones a finales de 2020 a aproximadamente 0,01% a finales de 2023. También reportó que la detección proactiva subió de 23,6% a más de 95% alrededor de 2020. Las métricas sugieren mejor detección y menor exposición medida. Un tablero económico también debe seguir apelaciones, falsos positivos, abuso omitido y errores desiguales.
Automation reduces handling costs only when its errors stay controlled. NIST found that many face-recognition algorithms had false-positive rates 10 to 100 times higher for Asian and African American faces than for white faces. A system can improve average throughput while creating severe losses for specific customers. Profit measurement must price false positives, successful appeals, and unequal error rates.
La automatización reduce costos solo cuando controla sus errores. NIST encontró que muchos algoritmos de reconocimiento facial tenían tasas de falsos positivos entre 10 y 100 veces mayores para rostros asiáticos y afroamericanos que para rostros blancos. Un sistema puede mejorar el rendimiento medio mientras genera pérdidas graves para clientes concretos. La medición económica debe valorar falsos positivos, apelaciones exitosas y errores desiguales.
A higher statutory maximum makes the same fine relevant at lower turnover. This is a counterfactual comparison because the statutes and offenses are not interchangeable.
Un máximo legal más alto hace que la misma sanción sea relevante con una facturación menor. Es una comparación contrafactual porque las leyes y las infracciones no son intercambiables.
Payment trust matters, but it cannot rescue an expensive or inconvenient offer. Trust improvements compete inside a checkout journey that already loses 70.2% of carts.
Key findings
NIST found many face-recognition algorithms had false-positive rates 10 to 100 times higher for Asian and African American faces than for white faces. National Institute of Standards and Technology
NewsGuard estimated $2.6 billion in annual programmatic advertising reached misinformation publishers, but this was modeled spending rather than demonstrated advertiser loss. newsguardtech.com
Spiegel reported five reviews raised purchase likelihood 270% overall, with effects near 190% for cheaper products and 380% for more expensive products. Spiegel Research Center at Northwestern University
After Reddit banned two hate communities, participating users who remained reduced their use of studied hate-speech terms by at least 80%. Association for Computing Machinery
CMS recorded annual GDPR fines rising from about €72 million in 2019 to approximately €2.1 billion in 2023, with substantial volatility between years. CMS Legal Services
Prominent GDPR penalties include €1.2 billion against Meta, €746 million against Amazon, and €405 million concerning Instagram. European Data Protection Board
Accenture estimated 54% of sampled companies suffered material trust incidents associated with roughly $180 billion in foregone revenue, a modeled rather than audited loss. newsroom.accenture.com
Meta estimated Facebook hate-speech prevalence fell from about 0.075% of views in late 2020 to roughly 0.01% in late 2023. Meta
Facebook's reported proactive hate-speech detection rose from 23.6% in late 2017 to above 95% around 2020, then fluctuated near that level. Meta
Frontier Economics estimated the UK APP reimbursement policy reduced fraud losses by £73 million and APP scams by nearly 35,000 annually. psr.org.uk
The UK’s 2023 fake-review impact assessment projected £1.838 billion in social NPV but −£1.846 billion in business NPV and £48 million in annual business costs. assets.publishing.service.gov.uk
Reported US consumer fraud losses rose from $3.3 billion in 2020 to more than $10.0 billion in 2023. Federal Trade Commission
The argument
The loss pool is enormous, but complaint totals are not attainable company savings.
GAO estimates annual federal fraud losses at $233B to $521B.
Advertising controls can protect spend, but the benchmark comes from their promoter.
The claimed 14% saving is material, but the customer and denominator remain undisclosed.
Safer markets can create public value while imposing real company costs.
One Yelp star was associated with a 7% midpoint revenue gain.
This research is published in English and Spanish. Ver en español
La investigación detrás de esta presentación
La confianza en el pago importa, pero no rescata una oferta cara o incómoda. Las mejoras de confianza compiten dentro de un pago que ya pierde 70,2% de los carritos.
Hallazgos clave
NIST encontró que muchos algoritmos tenían falsos positivos entre 10 y 100 veces mayores para rostros asiáticos y afroamericanos que para rostros blancos. National Institute of Standards and Technology
NewsGuard estimó que US$2.600 millones anuales en publicidad programática llegaron a editores de desinformación, pero era gasto modelado y no pérdida demostrada. newsguardtech.com
Tras prohibir Reddit dos comunidades de odio, los usuarios que permanecieron redujeron al menos 80% el uso de los términos estudiados. Association for Computing Machinery
CMS registró multas anuales del RGPD desde unos €72 millones en 2019 hasta aproximadamente €2.100 millones en 2023, con fuerte volatilidad interanual. CMS Legal Services
Entre las multas destacadas del RGPD figuran €1.200 millones contra Meta, €746 millones contra Amazon y €405 millones relativos a Instagram. European Data Protection Board
Accenture estimó que 54% de las empresas sufrió incidentes materiales de confianza asociados con unos US$180.000 millones no obtenidos, una pérdida modelada y no auditada. newsroom.accenture.com
Meta estimó que la prevalencia de lenguaje de odio cayó de cerca de 0,075% de visualizaciones a finales de 2020 a aproximadamente 0,01% en 2023. Meta
La detección proactiva reportada por Facebook aumentó de 23,6% a finales de 2017 a más de 95% alrededor de 2020, y luego fluctuó cerca. Meta
Frontier Economics estimó que la política británica de reembolso por fraude APP redujo las pérdidas en £73 millones y los casos en casi 35.000 al año. psr.org.uk
La evaluación británica de 2023 sobre reseñas falsas proyectó £1.838 millones de valor social neto, pero −£1.846 millones para empresas y £48 millones de costo empresarial anual. assets.publishing.service.gov.uk
Las pérdidas estadounidenses por fraude reportadas aumentaron de US$3.300 millones en 2020 a más de US$10.000 millones en 2023. Federal Trade Commission
El argumento
La pérdida es enorme, pero las denuncias no equivalen a ahorros empresariales alcanzables.
La GAO estima pérdidas federales anuales de US$233.000M a US$521.000M.
Los controles pueden proteger gasto, pero el referente proviene de su promotor.
El ahorro afirmado del 14% es importante, pero faltan el cliente y el denominador.
Los mercados más seguros pueden crear valor público e imponer costos empresariales.
Una estrella en Yelp se asoció con un punto medio de 7% más ingresos.
Esta investigación se publica en inglés y español. Read in English