Hanademi

What 100 milliseconds is really worth

19 slides · $3.23 · 17 min · 1 minute ago language
ENES
theme
LightDark
view
DeckTableTalk
brand
HanademiPlatzi
What 100 milliseconds is reallyworthMade for Freddy Vega, by Hanademi
Cuánto valen realmente 100milisegundosMade for Freddy Vega, by Hanademi
Mobile pages made users wait 22 secondsGoogle's 2017 average full-load time against 0.1-, 1-, and 3-second reference points. Log scale: everygridline is ×10.Made for Freddy Vega, by HanademiSources: New Industry Benchmarks for Mobile Page Speed – The AMP Blog.Unitseconds0.1110100Immediate responseContinuity boundaryAbandonment reference2017 full-load averageThe 2017 average reached 22seconds.0.1
The business case starts with a contradiction. Google reported a 22-second average full-load time for mobile landing pages in 2017. It also reported that 53% of visits left pages taking more than 3 seconds. The market was missing basic responsiveness by seconds, not perfection by milliseconds.
Las páginas móviles hacían esperar 22segundosPromedio de carga completa de Google en 2017 frente a referencias de 0,1, 1 y 3 segundos. Escalalogarítmica: cada línea es ×10.Made for Freddy Vega, by HanademiFuentes: New Industry Benchmarks for Mobile Page Speed – The AMP Blog.Unidadsegundos0,1110100Respuesta inmediataLímite de continuidadPromedio de carga de 2017El promedio de 2017 llegó a 22segundos.0,1
El caso de negocio comienza con una contradicción. Google informó un promedio de 22 segundos para la carga completa de páginas móviles en 2017. También informó que el 53% de las visitas abandonaba páginas que tardaban más de 3 segundos. El mercado fallaba la respuesta básica por segundos, no la perfección por milisegundos.
Four terms worth knowingMade for Freddy Vega, by HanademiHCIThe study and design of how people use computers.LatencyThe delay between an action and the system's response.RAILGoogle's model for response, animation, idle work, and loading.INPA measure of how quickly a page visibly responds.
The deck uses 4 technical terms repeatedly. HCI studies the relationship between people and computers. Latency is the delay people experience. RAIL and INP turn that human problem into measurable engineering budgets.
Cuatro términos que conviene conocerMade for Freddy Vega, by HanademiHCIEl estudio y diseño de cómo las personas usan computadoras.LatenciaLa demora entre una acción y la respuesta del sistema.RAILModelo de Google para respuesta, animación, trabajo inactivo y carga.INPUna medida de cuán rápido responde visualmente una página.
La presentación usa 4 términos técnicos de forma repetida. HCI estudia la relación entre personas y computadoras. La latencia es la demora que experimentan. RAIL e INP convierten ese problema humano en presupuestos técnicos medibles.
Every touch starts a clockA person's finger touches a tablet screen.Sources: Online program screens applicants needing public assistance | RTI. rti.org.
A visible touch grounds the coming thresholds in the moment users expect a response.
Cada toque inicia un relojEl dedo de una persona toca la pantalla de una tableta.Fuentes: Online program screens applicants needing public assistance | RTI. rti.org.
Un toque visible sitúa los próximos umbrales en el momento en que los usuarios esperan una respuesta.
The waiting experience changes at 0.1, 1,and 10 secondsClassic HCI response-time heuristics for immediacy, thought continuity, and attention retention.Made for Freddy Vega, by HanademiSources: Response Time Limits: Article by Jakob Nielsen.Unitseconds10Attention retention1Thought continuity0.1Immediate response
The classic thresholds describe 3 different experiences. Around 0.1 seconds, an action can feel immediate. Around 1 second, people notice waiting but can preserve their train of thought. Around 10 seconds, retaining attention becomes the design problem.
La experiencia de espera cambia a los 0,1,1 y 10 segundosHeurísticas clásicas de HCI para inmediatez, continuidad mental y conservación de la atención.Made for Freddy Vega, by HanademiFuentes: Response Time Limits: Article by Jakob Nielsen.Unidadsegundos10Conservación de atención1Continuidad mental0,1Respuesta inmediata
Los umbrales clásicos describen 3 experiencias distintas. Cerca de 0,1 segundos, una acción puede sentirse inmediata. Cerca de 1 segundo, las personas notan la espera, pero pueden conservar el hilo mental. Cerca de 10 segundos, conservar la atención se convierte en el problema de diseño.
Human perception does not stop at exactly100 msApproximate perceptual-cycle range in the Model Human Processor, milliseconds.Made for Freddy Vega, by HanademiSources: Reading 10: More Efficiency.Unitmilliseconds05010015020050Fast cycle100Typical cycle200Slow cycleTypical cycle
The human model itself argues against false precision. It used a typical perceptual cycle near 100 ms, with an approximate range from 50 to 200 ms. That makes 100 ms a useful engineering anchor. It does not make it a universal biological cliff.
La percepción humana no se detieneexactamente en 100 msRango aproximado del ciclo perceptivo en el Modelo de Procesador Humano, milisegundos.Made for Freddy Vega, by HanademiFuentes: Reading 10: More Efficiency.Unidadmilisegundos05010015020050Ciclo rápido100Ciclo típico200Ciclo lentoCiclo típico
El propio modelo humano contradice la falsa precisión. Usó un ciclo perceptivo típico cercano a 100 ms, con un rango aproximado de 50 a 200 ms. Eso convierte 100 ms en una referencia técnica útil. No lo convierte en un precipicio biológico universal.
Visual design dominated credibilityjudgmentsShare of 2,684 coded website-credibility comments mentioning each factor, percent.Made for Freddy Vega, by HanademiSources: How do users evaluate the credibility of Web sites?.Unitpercent of commentsVisual design46.1%Information structure28.5%Information focus25.1%Company motive15.5%
Trust is not a stopwatch result. In 2,684 coded comments, visual design appeared in 46.1%, well ahead of information structure and focus. A fast interface can still look careless, confusing, or self-serving. The evidence does not support claiming that 100 ms independently creates trust.
El diseño visual dominó los juicios decredibilidadPorcentaje de 2.684 comentarios codificados sobre credibilidad web que mencionó cada factor.Made for Freddy Vega, by HanademiFuentes: How do users evaluate the credibility of Web sites?.Unidadporcentaje de comentariosDiseño visual46,1 %Estructura informativa28,5 %Enfoque informativo25,1 %Motivo empresarial15,5 %
La confianza no es el resultado de un cronómetro. En 2.684 comentarios codificados, el diseño visual apareció en el 46,1%, por delante de la estructura y el enfoque informativos. Una interfaz rápida todavía puede parecer descuidada, confusa o interesada. La evidencia no permite afirmar que 100 ms crea confianza por sí solo.
Interaction stayed robust with 20-seconddelays in a controlled LLM experiment.The result concerns time to first token in the studied LLM tasks. It does not imply that 20seconds is harmless for direct manipulation, search, or checkout.Sources: dl.acm.org.
This is the counterexample the 100 ms slogan needs. A controlled LLM experiment tested first-token delays of 2, 9, and 20 seconds. Interaction behavior remained robust across those conditions, although task type changed prompting. Waiting can be acceptable when the task and feedback set the right expectation.
La interacción se mantuvo estable condemoras de 20 segundos en un experimentocontrolado con un LLM.El resultado se refiere al tiempo hasta el primer token en las tareas estudiadas con unLLM. No implica que 20 segundos sea inocuo para manipulación directa, búsqueda opago.Fuentes: dl.acm.org.
Este es el contraejemplo que necesita el lema de 100 ms. Un experimento controlado con un LLM probó demoras al primer token de 2, 9 y 20 segundos. La conducta se mantuvo estable entre esas condiciones, aunque el tipo de tarea cambió los prompts. La espera puede ser aceptable cuando la tarea y la retroalimentación crean la expectativa correcta.
Amazon reportedly lost 1% of sales foreach added 100 ms.The supplied citation is a secondary discussion of Amazon's reported internal result.Sources: Every 100ms of latency costs Amazon 1% of profit.
This is the statistic that launched many performance decks. Amazon is widely reported to have found a 1% sales loss for each additional 100 ms. The public record does not expose the underlying response curve or uncertainty. Use the number as influential internal evidence, not a universal planning law.
Amazon habría perdido un 1% de ventas porcada 100 ms adicionales.La cita suministrada es una discusión secundaria del resultado interno reportado porAmazon.Fuentes: Every 100ms of latency costs Amazon 1% of profit.
Esta es la cifra que lanzó muchas presentaciones sobre rendimiento. Se informa ampliamente que Amazon halló una pérdida de ventas del 1% por cada 100 ms adicionales. El registro público no revela la curva de respuesta ni la incertidumbre subyacentes. Usa la cifra como evidencia interna influyente, no como una ley universal de planificación.
Google found 400 ms cut searches by 0.6%Approximate reduction in searches per user after Google added artificial result latency.Made for Freddy Vega, by HanademiSources: Speed Matters for Google Web Search.Unitpercent fewer searches100 ms0.2%400 ms0.6%
Google's controlled delay experiment gives the business case firmer ground. Adding 100 to 400 ms reduced searches per user by roughly 0.2% to 0.6%. That is much smaller than the slogans often repeated in sales decks. At search scale, however, a small movement can still matter.
Google halló que 400 ms redujo lasbúsquedas un 0,6%Reducción aproximada de búsquedas por usuario después de que Google añadiera latencia artificial.Made for Freddy Vega, by HanademiFuentes: Speed Matters for Google Web Search.Unidadporcentaje menos de búsquedas100 ms0,2 %400 ms0,6 %
El experimento controlado de Google da una base más firme al caso de negocio. Añadir entre 100 y 400 ms redujo las búsquedas por usuario aproximadamente entre 0,2% y 0,6%. Es mucho menos que los lemas repetidos en presentaciones comerciales. Sin embargo, a escala de búsqueda, un movimiento pequeño todavía puede importar.
Google login added 350 ms versus Bing's100 msReported query latency penalty for logged-in users in a U.S. v. Google trial exhibit.Made for Freddy Vega, by HanademiSources: justice.gov.UnitmillisecondsGoogle350Bing1003.5x
Latency is not only a page-loading problem. A trial exhibit reported a 350 ms login penalty for Google queries, compared with about 100 ms for Bing. That extra system work sits directly in the interaction path. The practical target depends on the complete path, not just the visible button.
Iniciar sesión añadió 350 ms en Googlefrente a 100 ms en BingPenalización reportada de latencia en consultas para usuarios con sesión iniciada en una prueba de EstadosUnidos contra Google.Made for Freddy Vega, by HanademiFuentes: justice.gov.UnidadmilisegundosGoogle350Bing1003,5x
La latencia no es solo un problema de carga de páginas. Una prueba judicial reportó una penalización de 350 ms por iniciar sesión en consultas de Google, frente a unos 100 ms en Bing. Ese trabajo adicional del sistema está directamente en la ruta de interacción. El objetivo práctico depende de la ruta completa, no solo del botón visible.
Bounce risk rose sharply once waitingreached secondsModeled increase in mobile bounce probability relative to a 1-second load, percent.Made for Freddy Vega, by HanademiSources: Google neural-net (Think with Google, 2018): mobile load 1→3s = +32% bounce probability; 1→5s = +90%;1→10s = +123% | Candid Creative.Unitpercent higher bounce probability1 second0%3 seconds32%5 seconds90%6 seconds106%10 seconds123%
The curve changes the scale of the conversation. Google modeled bounce probability as 32% higher at 3 seconds and 123% higher at 10 seconds. These are not 100 ms effects. They show that preventing multi-second failure can matter more than polishing an already fast interaction.
El riesgo de rebote subió con fuerza cuandola espera llegó a segundosAumento modelado de la probabilidad de rebote móvil frente a una carga de 1 segundo, porcentaje.Made for Freddy Vega, by HanademiFuentes: Google neural-net (Think with Google, 2018): mobile load 1→3s = +32% bounce probability; 1→5s = +90%;1→10s = +123% | Candid Creative.Unidadporcentaje mayor de probabilidad de rebote1 segundo0 %3 segundos32 %5 segundos90 %6 segundos106 %10 segundos123 %
La curva cambia la escala de la conversación. Google modeló la probabilidad de rebote como 32% mayor a 3 segundos y 123% mayor a 10 segundos. Estos no son efectos de 100 ms. Muestran que evitar fallos de varios segundos puede importar más que pulir una interacción que ya es rápida.
Speed shaped both abandonment and loyaltySelected responses from Akamai's 2009 retail-performance survey, percent of respondents.Made for Freddy Vega, by HanademiSources: Ecommerce Web Page Response Times.Unitpercent of respondents52%Speed affects loyalty47%Expect 2 seconds40%Leave after 3 seconds
Akamai's survey captures expectations rather than a causal experiment. Nearly half expected retail pages within 2 seconds, and 40% said they would leave after 3 seconds. Another 52% said speed affected loyalty. The findings explain why latency can matter commercially, but not the revenue created by a specific improvement.
La velocidad influyó en el abandono y lalealtadRespuestas seleccionadas de la encuesta de rendimiento minorista de Akamai de 2009, porcentaje deencuestados.Made for Freddy Vega, by HanademiFuentes: Ecommerce Web Page Response Times.Unidadporcentaje de encuestados52 %Velocidad afecta lealtad47 %Esperan 2 segundos40 %Abandonan tras 3 segundos
La encuesta de Akamai capta expectativas, no un experimento causal. Casi la mitad esperaba páginas minoristas en 2 segundos y el 40% dijo que abandonaría después de 3 segundos. Otro 52% afirmó que la velocidad afectaba la lealtad. Los resultados explican por qué la latencia puede importar comercialmente, pero no los ingresos creados por una mejora específica.
Deloitte linked 100 ms faster with 8.4% to10.1% gainsOutcome changes associated with a 100 ms mobile speed improvement across Deloitte's 37-brandobservational sample.Made for Freddy Vega, by HanademiSources: Deloitte/Google "Milliseconds Make Millions" (2020): 0.1s improvement → 8.4% retail conversion lift, 10.1%travel | Candid Creative.; Milliseconds Make Millions.Unitpercent outcome increaseRetail conversion8.4%Retail order value9.2%Travel conversion10.1%Luxury page views8.6%
Deloitte reported striking associations around the 100 ms unit. Travel conversion rose 10.1%, retail order value 9.2%, luxury page views 8.6%, and retail conversion 8.4%. But the study observed 37 brands rather than assigning latency experimentally. These are useful priors for deciding what to test, not guaranteed returns.
Deloitte relacionó 100 ms menos conmejoras de 8,4% a 10,1%Cambios de resultados asociados con una mejora móvil de 100 ms en la muestra observacional de 37marcas de Deloitte.Made for Freddy Vega, by HanademiFuentes: Deloitte/Google "Milliseconds Make Millions" (2020): 0.1s improvement → 8.4% retail conversion lift,10.1% travel | Candid Creative.; Milliseconds Make Millions.Unidadporcentaje de aumento del resultadoConversión minorista8,4 %Valor del pedido9,2 %Conversión turística10,1 %Páginas vistas de lujo8,6 %
Deloitte informó asociaciones llamativas alrededor de la unidad de 100 ms. La conversión turística subió 10,1%, el valor del pedido minorista 9,2%, las páginas vistas de lujo 8,6% y la conversión minorista 8,4%. Pero el estudio observó 37 marcas en vez de asignar latencia experimentalmente. Son referencias útiles para decidir qué probar, no retornos garantizados.
Even 10 ms may hurt accuracy, score, andexperience in competitive CS:GO.The result concerns competitive CS:GO performance and may not generalize to strategicgames or ordinary application tasks.Sources: web.cs.wpi.edu.
Games reveal why one threshold cannot fit every interaction. In a study with more than 40 participants, even 10 ms of network latency could reduce accuracy, score, and perceived quality. The effect also varied by weapon. Continuous aiming behaves more like catching a ball than submitting a form.
Incluso 10 ms puede afectar precisión,puntaje y experiencia en CS:GO competitivo.El resultado se refiere al rendimiento competitivo en CS:GO y puede no trasladarse ajuegos estratégicos o tareas comunes de aplicaciones.Fuentes: web.cs.wpi.edu.
Los videojuegos revelan por qué un umbral no sirve para toda interacción. En un estudio con más de 40 participantes, incluso 10 ms de latencia de red podía reducir precisión, puntaje y calidad percibida. El efecto también varió según el arma. Apuntar de forma continua se parece más a atrapar una pelota que a enviar un formulario.
RAIL gives each kind of work a differentclockGoogle RAIL performance budgets for an animation frame, response, and key loading work, milliseconds.Made for Freddy Vega, by HanademiSources: Measure performance with the RAIL model | Articles.Unitmilliseconds05001K16Animation frame100Response1,000Key loadResponse budget
RAIL turns one speed slogan into separate engineering budgets. Animation frames get about 16 ms, responses about 100 ms, and key loading work about 1 second. The thresholds differ by more than 60 times. Teams must optimize the clock attached to the user's actual task.
RAIL asigna un reloj distinto a cada tipo detrabajoPresupuestos de Google RAIL para un fotograma, respuesta y trabajo clave de carga, milisegundos.Made for Freddy Vega, by HanademiFuentes: Measure performance with the RAIL model | Articles.Unidadmilisegundos05001K16Fotograma100Respuesta1.000Carga clavePresupuesto de respuesta
RAIL convierte un lema de velocidad en presupuestos técnicos separados. Los fotogramas reciben unos 16 ms, las respuestas unos 100 ms y el trabajo clave de carga cerca de 1 segundo. Los umbrales difieren por más de 60 veces. Los equipos deben optimizar el reloj ligado a la tarea real del usuario.
Modern interaction quality allows up to 200msCore Web Vitals INP boundaries for good, needs-improvement, and 1-second interaction response,milliseconds.Made for Freddy Vega, by HanademiSources: Optimize Interaction to Next Paint.Unitmilliseconds05001K200Good boundary500Needs improvement1,000One-second interactionGood INP boundary
Modern field guidance keeps the logic of quick feedback but relaxes the literal 100 ms line. INP classifies interaction as good at 200 ms or less, intermediate through 500 ms, and poor above 500 ms. That does not make 200 ms ideal for every task. It shows that production quality uses practical boundaries rather than one biological cutoff.
La calidad moderna de interacción admitehasta 200 msLímites de INP en Core Web Vitals para respuesta buena, mejorable y de 1 segundo, milisegundos.Made for Freddy Vega, by HanademiFuentes: Optimize Interaction to Next Paint.Unidadmilisegundos05001K200Límite bueno500Necesita mejorar1.000Interacción de 1 segundoLímite bueno de INP
La guía moderna de campo conserva la lógica de respuesta rápida, pero flexibiliza la línea literal de 100 ms. INP clasifica la interacción como buena hasta 200 ms, intermedia hasta 500 ms y deficiente por encima de 500 ms. Eso no convierte 200 ms en el ideal para toda tarea. Muestra que la calidad en producción usa límites prácticos, no un único corte biológico.
Cold starts get 5 seconds before Androidcalls them excessiveAndroid thresholds for excessive application startup by startup state, seconds.Made for Freddy Vega, by HanademiSources: Android Startup Optimization: Cold Start Guide | Medium.Unitseconds5Cold start2Warm start1.5Hot start
Application startup has its own clock. Android has flagged about 1.5 seconds as excessive for hot starts, 2 seconds for warm starts, and 5 seconds for cold starts. Those budgets are far above the direct-response target. Performance work must identify which clock the user is actually experiencing.
Los inicios en frío reciben 5 segundos antes de queAndroid los considere excesivosUmbrales de Android para inicio excesivo de aplicaciones según el estado de inicio, segundos.Made for Freddy Vega, by HanademiFuentes: Android Startup Optimization: Cold Start Guide | Medium.Unidadsegundos5Inicio en frío2Inicio tibio1,5Inicio en caliente
El inicio de una aplicación tiene su propio reloj. Android ha señalado como excesivos unos 1,5 segundos para inicios en caliente, 2 segundos para inicios tibios y 5 segundos para inicios en frío. Esos presupuestos están muy por encima del objetivo de respuesta directa. El trabajo de rendimiento debe identificar qué reloj experimenta realmente el usuario.
A 37-brand sample cannot set everycompany's return on 100 ms.A defensible decision connects measured local outcome lift with contribution margin. Itdoes not multiply revenue by a borrowed headline coefficient.Sources: Milliseconds Make Millions.
The business case should end where the evidence is strongest. Published studies can establish plausible effect sizes and identify dangerous thresholds. They cannot know your traffic mix, baseline speed, contribution margin, or user task. Use them to size an experiment, then let local outcomes set the investment decision.
Una muestra de 37 marcas no puede fijar elretorno de cada empresa por 100 ms.Una decisión defendible conecta la mejora local medida con el margen de contribución. Nomultiplica los ingresos por un coeficiente principal prestado.Fuentes: Milliseconds Make Millions.
El caso de negocio debe terminar donde la evidencia es más sólida. Los estudios publicados pueden establecer efectos plausibles e identificar umbrales peligrosos. No conocen tu mezcla de tráfico, velocidad inicial, margen de contribución ni tarea del usuario. Úsalos para dimensionar un experimento y deja que los resultados locales definan la inversión.
In summaryMade for Freddy Vega, by HanademiSources: Every 100ms of latency costs Amazon 1% of profit.; Google neural-net (Think with Google, 2018): mobile load 1→3s = +32% bounce probability;1→5s = +90%; 1→10s = +123% | Candid Creative.; Deloitte/Google "Milliseconds Make Millions" (2020): 0.1s improvement → 8.4% retail conversion lift,10.1% travel | Candid Creative.; Optimize Interaction to Next Paint.; dl.acm.org.; web.cs.wpi.edu.Amazon is widely reported to have found that each additional 100 milliseconds of latency reduced sales by approximately 1 percent.Google modeled mobile bounce probability as 32 percent higher at 3 seconds, 90 percent at 5, 106 percent at 6, and 123 percent at 10.Deloitte associated each 100 milliseconds faster with retail order value rising 9.2 percent and luxury page views per session rising 8.6 percent.Core Web Vitals classifies Interaction to Next Paint as good at 200 milliseconds or less, intermediate through 500, and poor above 500.A controlled LLM experiment found interaction behavior robust across time-to-first-token latencies of 2, 9, and 20seconds, although task type affected prompting.A 40-plus-person CS:GO study reported that even 10 milliseconds of network latency may reduce accuracy, score, andquality of experience, with weapon-specific differences.
The value of the research is not only what each source knew, but what became visible when their evidence was combined.
En resumenMade for Freddy Vega, by HanademiFuentes: Every 100ms of latency costs Amazon 1% of profit.; Google neural-net (Think with Google, 2018): mobile load 1→3s = +32% bounce probability;1→5s = +90%; 1→10s = +123% | Candid Creative.; Deloitte/Google "Milliseconds Make Millions" (2020): 0.1s improvement → 8.4% retail conversion lift,10.1% travel | Candid Creative.; Optimize Interaction to Next Paint.; dl.acm.org.; web.cs.wpi.edu.Se informa ampliamente que Amazon encontró que cada 100 milisegundos adicionales de latencia reducían las ventasaproximadamente un 1 por ciento.Google modeló la probabilidad de rebote como 32 por ciento mayor a 3 segundos, 90 a 5, 106 a 6 y 123 a 10.Deloitte asoció cada mejora de 100 milisegundos con un valor de pedido minorista 9,2 por ciento mayor y 8,6 por ciento más páginas de lujo.Core Web Vitals clasifica Interaction to Next Paint como bueno hasta 200 milisegundos, intermedio hasta 500 y deficiente por encima de 500.Un experimento controlado con un LLM halló conductas de interacción estables con latencias al primer token de 2, 9 y 20segundos, aunque el tipo de tarea afectó los prompts.Un estudio de CS:GO con más de 40 participantes reportó que incluso 10 milisegundos de latencia de red pueden reducirprecisión, puntaje y experiencia, con diferencias según el arma.
El valor de la investigación no está solo en cada fuente, sino en lo que apareció al combinar sus evidencias.

The research behind this deck

Speed matters, but not through one universal coefficient. The evidence supports distinct thresholds for perception, interaction, loading, and commercial outcomes, with local experiments needed to turn milliseconds into credible financial returns.

Key findings

The argument

This research is published in English and Spanish. Ver en español

La investigación detrás de esta presentación

La velocidad importa, pero no mediante un coeficiente universal. La evidencia respalda umbrales distintos para percepción, interacción, carga y resultados comerciales, y exige experimentos locales para convertir milisegundos en retornos financieros creíbles.

Hallazgos clave

El argumento

Esta investigación se publica en inglés y español. Read in English