MTTR: tiempo medio de reparación
¿Qué es el MTTR (tiempo medio de reparación)?
El MTTR, o tiempo medio de reparación, mide cuánto se tarda en promedio en devolver a operación un activo descompuesto. El reloj arranca cuando se detecta la falla y se detiene cuando el equipo vuelve a funcionar por completo. Si el MTTR de una máquina de producción es de 6 horas, son 6 horas de capacidad perdida cada vez que se descompone.
El MTTR es una de las métricas de mantenimiento más prácticas porque se traduce directamente en costo de paro. Una máquina con excelente confiabilidad (MTBF alto) pero pésima reparabilidad (MTTR alto) sigue causando problemas operativos serios. El MTTR dice qué tan bueno es su equipo de trabajo recuperándose de las fallas, no solo previniéndolas.
Una distinción importante: a veces se usa MTTR para decir «tiempo medio de recuperación» o «tiempo medio de respuesta». Aquí nos quedamos con la definición de mantenimiento: el tiempo promedio desde que se detecta la falla hasta que el servicio queda restablecido por completo. La taxonomía formal para registrar tiempos de reparación y eventos de falla está definida en la ISO 14224:2016.
Cómo se calcula el MTTR
Fórmula básica
MTTR = tiempo total de reparación / número de reparaciones
El «tiempo de reparación» incluye todo, desde el momento en que se nota la falla hasta que el activo está de vuelta en operación normal.
Ejemplos de cálculo
Caso simple: Una banda transportadora falló 5 veces el año pasado. Tiempo total dedicado a reparaciones: 35 horas. MTTR = 35 / 5 = 7 horas por reparación
Promedio de flota: Su flota de 20 montacargas tuvo 40 eventos de reparación este trimestre. Tiempo combinado de reparación: 120 horas. MTTR de flota = 120 / 40 = 3 horas por reparación
Usar el MTTR para estimar el paro anual: Si un activo tiene un MTBF de 1,000 horas y un MTTR de 8 horas, y opera 4,000 horas al año:
- Fallas esperadas por año: 4,000 / 1,000 = 4
- Paro anual esperado: 4 × 8 = 32 horas al año
Qué incluye el MTTR
El reloj de la reparación cubre toda la secuencia, no solo el tiempo con la llave en la mano:
La línea de tiempo del MTTR
| Fase | Descripción | % típico del MTTR | Qué la determina |
|---|---|---|---|
| Detección | Darse cuenta de que ocurrió la falla | 5–15% | Sistemas de monitoreo, atención del operador |
| Respuesta | Llevar a un técnico hasta el activo | 10–25% | Personal disponible, distancias, programación |
| Diagnóstico | Identificar la causa raíz | 15–30% | Pericia del técnico, documentación, instrumentos |
| Consecución de repuestos | Conseguir las refacciones | 0–40% | Inventario de repuestos, tiempos de entrega del proveedor |
| Ejecución de la reparación | Hacer el trabajo en sí | 20–35% | Pericia del técnico, herramienta disponible, complejidad |
| Pruebas y validación | Verificar que quedó bien | 5–10% | Procedimientos de prueba, requisitos de calidad |
La sorpresa para la mayoría de las organizaciones: la reparación en sí suele ser menos de un tercio del MTTR total. El resto es espera. Esperar a que alguien note la falla, esperar al técnico, esperar los repuestos.
Esto importa porque significa que las mejoras de MTTR vienen muchas veces de la logística y del proceso, no de mejores manos técnicas.
Variantes del MTTR: ¿qué está midiendo exactamente?
Las siglas MTTR se usan para varias métricas parecidas pero distintas. Deje claro cuál está siguiendo:
| Variante | Nombre completo | El reloj arranca | El reloj se detiene | Incluye |
|---|---|---|---|---|
| MTTR (reparación) | Tiempo medio de reparación | Cuando empieza el trabajo de reparación | Cuando el activo funciona | Diagnóstico + reparación + pruebas |
| MTTR (recuperación) | Tiempo medio de recuperación | Cuando ocurre la falla | Cuando el activo vuelve a producción | Todo, incluidas detección y respuesta |
| MTTA | Tiempo medio de acuse | Cuando ocurre la falla | Cuando alguien empieza a atender | Solo detección y respuesta |
| MTTRS | Tiempo medio de restablecimiento del servicio | Cuando ocurre la falla | Cuando el servicio queda restablecido (puede ser con respaldo) | Todo el tiempo, admite soluciones provisionales |
Recomendación: use el «tiempo medio de recuperación» como métrica principal, porque captura la experiencia completa del paro. Pero siga también los componentes por separado (tiempo de respuesta, espera de repuestos, tiempo de trabajo efectivo) para ver dónde sí se puede mejorar.
Disponibilidad del activo: MTBF y MTTR juntos
El objetivo final de seguir el MTBF y el MTTR es calcular la disponibilidad, es decir, el porcentaje del tiempo en que el activo está operativo.
Disponibilidad = MTBF / (MTBF + MTTR)
| Escenario | MTBF | MTTR | Disponibilidad | Interpretación |
|---|---|---|---|---|
| Confiable, reparación rápida | 2,000 h | 4 h | 99.8% | El mejor caso: falla poco y se repara rápido |
| Confiable, reparación lenta | 2,000 h | 48 h | 97.7% | Buena confiabilidad echada a perder por reparaciones lentas |
| Poco confiable, reparación rápida | 200 h | 2 h | 99.0% | Se descompone seguido pero se recupera rápido |
| Poco confiable, reparación lenta | 200 h | 24 h | 89.3% | El peor caso: paros frecuentes y largos |
La conclusión clave: bajar el MTTR de 48 a 4 horas en una máquina confiable (MTBF 2,000) sube la disponibilidad 2.1 puntos porcentuales. La misma mejora en una máquina poco confiable (MTBF 200) la sube 9.7 puntos. Las mejoras de MTTR rinden más en el equipo que falla seguido.
Quién necesita el MTTR y cada cuándo
- Jefes de mantenimiento, cada semana o cada mes. Siguen el desempeño del equipo, ubican el cuello de botella (¿es el diagnóstico? ¿la espera de repuestos? ¿el tiempo de respuesta?) y fijan metas de mejora.
- Jefes de operaciones, cada mes. Entienden cuánta capacidad de producción se pierde en reparaciones y planean capacidad de respaldo alrededor del equipo con MTTR alto.
- Responsables de TI, por incidente. Siguen tiempos de resolución de servidores, equipo de red y equipo de cómputo del personal contra los acuerdos de nivel de servicio.
- Responsables de mantenimiento de inmuebles, cada mes. Vigilan la capacidad de respuesta en aire acondicionado, elevadores y sistemas de seguridad, todo lo que afecta a quien ocupa el edificio.
- Áreas de finanzas, cada trimestre. Calculan el costo del paro. Si MTTR × costo de paro por hora × fallas por año da un número grande, eso justifica invertir en reparar más rápido.
- Compras, al decidir una adquisición. Un equipo difícil de reparar (refacciones propietarias, herramienta especializada) va a tener MTTR alto sin importar qué tan confiable sea. La reparabilidad debe pesar en la decisión de compra.
Ejemplos reales
Ejemplo 1: reducir el MTTR en un centro de distribución
Un centro de distribución tenía 12 sistemas de bandas transportadoras. MTTR promedio: 4.2 horas. Con un promedio de 8 fallas al mes, eran 33.6 horas de paro mensual, a un costo aproximado de US$ 2,800 por hora en capacidad perdida.
Desglose del MTTR:
| Fase | Tiempo promedio | % del MTTR |
|---|---|---|
| Detección | 18 min | 7% |
| Respuesta (llegada del técnico) | 52 min | 21% |
| Diagnóstico | 48 min | 19% |
| Consecución de repuestos | 72 min | 29% |
| Reparación | 45 min | 18% |
| Pruebas | 17 min | 7% |
| Total | 252 min (4.2 h) | 100% |
Los dos mayores desperdicios: el tiempo de respuesta (52 min, porque los técnicos estaban en un solo punto y tenían que trasladarse) y la consecución de repuestos (72 min, porque las refacciones comunes no se guardaban en sitio).
Cambios aplicados:
- Un técnico apostado en cada extremo del centro durante los turnos pico (tiempo de respuesta: 52 → 12 min)
- Kits de repuestos en cada tramo de banda con las 15 refacciones que más fallan (tiempo de repuestos: 72 → 8 min)
- Sensores IoT de vibración para detectar fallas de baleros antes del paro total (tiempo de detección: 18 → 5 min en fallas previstas)
Resultados:
- El MTTR bajó de 4.2 a 1.4 horas (67% menos)
- Paro mensual: de 33.6 a 11.2 horas
- Ahorro anual: aproximadamente US$ 752,000 en capacidad recuperada
- Inversión: US$ 95,000 (kits de repuestos, sensores, ajuste de personal)
- Recuperación: 7 semanas
Ejemplo 2: optimizar el MTTR en una mesa de ayuda de TI
Una organización de 800 empleados midió el MTTR de las fallas de laptops y equipo de escritorio:
Antes:
- MTTR promedio en fallas de hardware: 18 horas (contando esperas de un día para otro)
- MTTR promedio en fallas de software: 6 horas
- Paro total de TI al mes: unas 280 horas-persona
- Pérdida de productividad estimada: US$ 14,000 al mes
Causas del MTTR alto:
- No había equipos de reemplazo (el empleado esperaba la reparación)
- Los tickets se atendían por orden de llegada, no por urgencia
- Muchos casos exigían visita presencial pudiendo resolverse en remoto
- No había procedimientos de diagnóstico estándar: cada técnico atacaba el problema a su manera
Cambios aplicados:
- Una reserva de 25 laptops preconfiguradas para cambio inmediato mientras se repara la que falló
- Ruteo de tickets por prioridad (usuarios de dirección y de procesos críticos primero)
- Herramientas de administración remota para las fallas de software
- Guías de diagnóstico estandarizadas para los 20 problemas más comunes
Resultados:
- MTTR de hardware (visto por el usuario): de 18 horas a 45 minutos gracias al cambio inmediato
- MTTR de software: de 6 horas a 1.5 horas
- Pérdida mensual de productividad: de US$ 14,000 a US$ 3,200
- Satisfacción con el soporte de TI: de 3.1/5 a 4.4/5
Errores comunes
- Medir solo el tiempo con la herramienta en la mano. Si solo registra lo que dura la reparación en sí, se pierde entre el 60 y el 70% del paro real. La detección, la respuesta y la espera de repuestos suelen pesar más.
- No desglosar el MTTR por fases. «Nuestro MTTR es de 6 horas» sirve, pero no dice qué hacer. «Nuestro MTTR es de 6 horas: 2 esperando repuestos, 1.5 esperando técnico, 1.5 de diagnóstico y 1 de reparación» dice exactamente dónde mejorar.
- Promediar todos los tipos de activo juntos. Un MTTR que mezcla servidores, vehículos y mobiliario no significa nada. Calcúlelo por clase de activo y por nivel de criticidad.
- Tratar todas las fallas igual. Reponer un interruptor botado en 10 minutos y rehacer una caja de engranes en 40 horas son eventos distintos. Conviene seguir el MTTR por gravedad de la falla.
- No ligar el MTTR al costo. Un MTTR de 4 horas no dice nada sin contexto. Cuatro horas de paro en un activo de US$ 50 por hora son US$ 200. En una línea de producción de US$ 5,000 por hora, son US$ 20,000. Priorice donde el impacto financiero sea mayor.
- Reparar más rápido y olvidarse de prevenir. Reparar rápido es bueno; reparar menos veces es mejor. Toda reducción de MTTR debe ir junto a iniciativas de mejora del MTBF.
Cómo reducir el MTTR
- Tenga los repuestos críticos en sitio. Es la mejora de MTTR más grande en la mayoría de las organizaciones. Si la refacción está en el anaquel, se ahorran horas o días de espera. Use puntos de reorden para que los repuestos críticos se repongan solos.
- Ponga monitoreo y diagnóstico remoto. Los sensores IoT y las herramientas de acceso remoto permiten que el técnico diagnostique antes de llegar, y a veces que resuelva sin ir. Eso recorta muchísimo el diagnóstico y la respuesta.
- Estandarice los procedimientos de reparación. Documente los pasos de diagnóstico y reparación de las fallas comunes. Cuando todos los técnicos siguen el mismo proceso probado, se acaba el ensayo y error.
- Forme a más de una persona por equipo crítico. Si solo uno sabe reparar el centro de maquinado y anda de vacaciones, su MTTR incluye el vuelo de regreso. Asegure al menos dos personas por tipo de activo crítico.
- Deje la herramienta cerca. Carros de herramienta junto al activo, instrumentos de diagnóstico cerca de las máquinas que atienden, equipo de protección listo en la estación. Mejoras logísticas pequeñas que se suman.
- Use órdenes de trabajo con el contexto completo del activo. Cuando el técnico abre la orden y ve el historial de reparaciones, el manual, la lista de repuestos y los modos de falla conocidos, arranca de inmediato en vez de investigar primero.
- Arme un programa de reemplazo inmediato para los activos críticos. Donde el MTTR pega directo en la productividad de la gente (laptops, celulares, vehículos), conviene una reserva de equipos preconfigurados: se cambia en el momento y se repara sin prisa.
Buenas prácticas
- Mida el MTTR por fase, no solo en total. Registre por separado detección, respuesta, diagnóstico, espera de repuestos, reparación y pruebas. No se puede mejorar lo que no se ve.
- Fije metas de MTTR según la criticidad. Un equipo crítico de producción quizá necesite una meta de 2 horas; el proyector de una sala de juntas puede vivir con 48. No aplique un mismo estándar a todo.
- Revise los incidentes de MTTR largo. Toda reparación que tarde bastante más que el promedio merece una revisión: qué causó la demora y cómo evitarla la próxima vez.
- Compárese primero consigo mismo. Contraste el MTTR entre turnos, sedes y técnicos dentro de su propia organización. La variación interna suele ser mayor de lo que uno cree y más fácil de corregir.
- Automatice el registro de tiempos. Use un sistema de órdenes de trabajo que marque cada fase por sí solo. El registro manual no es confiable y siempre tiende a subreportar.
- Reporte la tendencia del MTTR cada mes. Muestre la tendencia junto al valor absoluto: un MTTR de 4 horas que lleva seis meses bajando cuenta una historia muy distinta a uno de 4 horas que va subiendo.
Términos relacionados
- Tiempo medio entre fallas (MTBF). La métrica de confiabilidad que lo acompaña; juntas determinan la disponibilidad del activo
- Mantenimiento preventivo. Reduce la frecuencia de las fallas que hay que reparar
- Mantenimiento predictivo. Anticipa la falla y permite reparaciones planeadas, con MTTR más bajo
- Orden de trabajo. El documento operativo que registra cada reparación y su línea de tiempo
- Punto de reorden. Mantener los repuestos en existencia es la forma número uno de eliminar la espera de refacciones
- Monitoreo IoT de activos. El monitoreo remoto recorta el tiempo de detección y de diagnóstico
- Costo total de propiedad. El tiempo y la frecuencia de reparación pesan fuerte en el costo de vida del activo
Arregle la logística, no solo la reparación
El MTTR dice qué tan rápido se recupera su organización de una falla de equipo, y dónde se atora. Cada hora que se le quita al MTTR es una hora recuperada de producción, de servicio o de productividad de la gente. La manera más efectiva de bajarlo no siempre es reparar más rápido: es eliminar las esperas. Esperar a que se detecte, esperar a que alguien responda, esperar los repuestos. Arregle la logística y los tiempos de reparación se acomodan casi solos.
Medir el MTTR con UNIO24
UNIO24 marca la hora en cada etapa del proceso de reparación: cuándo se reportó la falla, cuándo se asignó el técnico, cuándo empezó el trabajo y cuándo volvió el activo a servicio. Con eso el MTTR sale calculado con el desglose completo por fases. Vea qué parte del ciclo se lleva más tiempo, compare tiempos de respuesta entre equipos y sedes, y siga su mejora a lo largo del tiempo. Cada orden de trabajo se vuelve un dato que ayuda a reparar más rápido la siguiente vez.