The project manager must become a player-coachEl gerente de proyecto debe convertirse en jugador-entrenador · V7
34 slides · 19 min · 2026-08-10language
ENES
theme
LightDark
view
TalkTable
brand
HanademiPlatzi
The real question is not whether managers code, but whether they improve delivery enough to justify their cost.
Experienced maintainers completed real repository tasks 19% slower with early-2025 AI tools.
Small teams need a technical player-coach who verifies AI, protects focus, and shares knowledge.
La pregunta real no es si los gerentes programan, sino si mejoran la entrega lo suficiente para justificar su costo.
Los mantenedores experimentados completaron tareas reales del repositorio 19% más lentamente con herramientas de IA de principios de 2025.
Los equipos pequeños necesitan un jugador-entrenador técnico que verifique la IA, proteja el enfoque y comparta conocimiento.
These developers knew their repositories and expected AI to save about one-quarter of their time. Even after the work, they still believed it had helped. Measurement reversed that belief: completion took 19% longer. Small teams therefore need technical judgment and real delivery data, not confidence alone.
Estos desarrolladores conocían sus repositorios y esperaban que la IA ahorrara aproximadamente una cuarta parte de su tiempo. Incluso después del trabajo, seguían creyendo que había ayudado. La medición invirtió esa creencia: la finalización tomó 19% más tiempo. Los equipos pequeños por lo tanto necesitan juicio técnico y datos reales de entrega, no solo confianza.
With two developers, the bounded Copilot result leaves 0.37 developer-cost equivalents after paying the manager. The GPT-4 benchmark leaves -0.24 and the METR result leaves -1.13.
Con dos desarrolladores, el resultado acotado de Copilot deja 0,37 equivalentes de coste de desarrollador tras pagar al gestor. El referente de GPT-4 deja -0,24 y el resultado de METR deja -1,13.
This is the strongest clean evidence for coding acceleration. Copilot reduced average completion time from 161.2 to 71.2 minutes, a 55.8% reduction. A UK government trial separately reported 28 working days saved per coder annually. Neither result measures complete project delivery.
Esta es la evidencia más sólida y limpia de aceleración en código. Copilot redujo el tiempo promedio de finalización de 161,2 a 71,2 minutos, una reducción del 55,8%. Un ensayo del gobierno británico reportó por separado 28 días hábiles ahorrados por programador anualmente. Ningún resultado mide la entrega completa del proyecto.
The consultants did not gain in just one dimension. They completed 12.2% more tasks, worked 25.1% faster, and produced over 40% higher-quality results. That is a real productivity bundle. The condition is decisive: these were tasks the model could handle well.
Los consultores no ganaron en una sola dimensión. Completaron 12,2% más tareas, trabajaron 25,1% más rápido y produjeron resultados de más de 40% de mayor calidad. Ese es un paquete de productividad real. La condición es decisiva: estas eran tareas que el modelo podía manejar bien.
The frontier is jagged, not a smooth line from easy to hard. On suitable work, quality rose by over 40%. On an outside-frontier task, AI users were 19 percentage points less likely to be correct. Someone must recognize which situation the team is in.
La frontera es irregular, no una línea suave de fácil a difícil. En trabajo adecuado, la calidad subió más de 40%. En tareas fuera de la frontera, los usuarios de IA fueron 19 puntos porcentuales menos propensos a ser correctos. Alguien debe reconocer en cuál situación está el equipo.
The reported associations favor work around the code. Documentation improved 7.5%, while code quality and review speed improved by just over 3%. That pattern suggests AI can strengthen the information layer around delivery. The figures remain low-confidence because live verification was unavailable.
Las asociaciones reportadas favorecen trabajo alrededor del código. La documentación mejoró 7,5%, mientras que la calidad de código y velocidad de revisión mejoraron poco más de 3%. Ese patrón sugiere que IA puede fortalecer la capa de información alrededor de la entrega. Las cifras siguen siendo de baja confianza porque verificación activa no estuvo disponible.
The positive documentation result did not carry through the delivery system. Throughput was 1.5% lower and stability was 7.2% lower. This is association, not proof of causation. It still warns small teams not to mistake faster production for healthier delivery.
El resultado positivo en documentación no se trasladó a través del sistema de entrega. El rendimiento fue 1,5% menor y la estabilidad fue 7,2% menor. Esta es asociación, no prueba de causalidad. Aun así advierte a equipos pequeños no confundir producción más rápida con entrega más sana.
Below-average performers improved about 43% on suitable tasks, compared with 17% for stronger performers. Meanwhile, 82% of people learning to code were using or planning to use AI. In an Australian government trial, confidence reached 75% among people receiving at least 3 forms of training, 28 points above those receiving 1. The junior pipeline needs coaching, not unattended automation.
Los desempeños por debajo del promedio mejoraron alrededor del 43% en tareas apropiadas, comparado con 17% para desempeños más fuertes. Mientras tanto, el 82% de personas aprendiendo a programar usaban o planeaban usar IA. En un ensayo del gobierno australiano, la confianza alcanzó 75% entre personas recibiendo al menos 3 formas de entrenamiento, 28 puntos por encima de las que recibieron 1. El pipeline junior necesita coaching, no automatización sin supervisión.
Anthropic classified 57% of observed occupational use as augmentation and 43% as automation. Computer and mathematical work represented an estimated 37.2% of occupational conversations in the initial dataset. Exposure is real, especially in technical work. Yet the observed pattern favors people working with AI over complete delegation.
Anthropic clasificó el 57% del uso ocupacional observado como aumento de capacidades y el 43% como automatización. El trabajo informático y matemático representó aproximadamente el 37,2% de las conversaciones ocupacionales en el conjunto de datos inicial. La exposición es real, especialmente en el trabajo técnico. Sin embargo, el patrón observado favorece a las personas que trabajan con IA sobre la delegación completa.
The estimate says 80% of US workers have at least some task exposure. Only 19% cross the much higher threshold of half their tasks. Exposure therefore signals job redesign before it proves job extinction. Small-team roles should be decomposed into automatable and human-accountability work.
La estimación indica que el 80% de los trabajadores estadounidenses tienen al menos cierta exposición de tareas. Solo el 19% cruza el umbral mucho más alto del 50% de sus tareas. La exposición señala rediseño de trabajo antes de que compruebe extinción de empleo. Los roles de equipos pequeños deben descomponerse en trabajo automatizable y trabajo de responsabilidad humana.
Pennsylvania gave more than 175 employees access to ChatGPT, and 136 provided direct feedback. Some 48% of participants had never used ChatGPT before. Adoption therefore required learning and observation, not merely access. A small-team lead must watch how people use the tool instead of assuming competence.
Pennsylvania dio acceso a ChatGPT a más de 175 empleados, y 136 proporcionaron retroalimentación directa. Aproximadamente el 48% de participantes nunca había usado ChatGPT antes. La adopción requirió aprendizaje y observación, no simplemente acceso. Un líder de equipo pequeño debe observar cómo la gente usa la herramienta en lugar de asumir competencia.
The player-coach question starts with how much scarce engineering capacity a small team can afford.
La cuestión del jugador-entrenador comienza con cuánta capacidad de ingeniería escasa puede costear un equipo pequeño.
The project-management median was $98,580. The programmer median was $99,700, almost the same. A software developer cost more at $132,270. For a team of only 1 to 5 developers, a coordination-only role must remove a very large delivery burden to pay back its salary.
La mediana de gestión de proyectos fue $98,580. La mediana de programador fue $99,700, casi igual. Un desarrollador de software costó más con $132,270. Para un equipo de solo 1 a 5 desarrolladores, un rol de solo coordinación debe eliminar una carga de entrega muy grande para recuperar su salario.
Per 100 current roles, projected growth adds $2.38 million in developer median pay, $0.69 million in project manager pay, and removes $1.00 million in programmer pay.
Por cada 100 puestos actuales, el crecimiento proyectado añade 2,38 millones de dólares de sueldo mediano de desarrolladores, 0,69 millones de gestores de proyectos y elimina 1,00 millón de programadores.
The turnover threshold rises to $3.29 million at the 3% tier and $9.86 million at the 1% tier, showing how quickly AI governance exposure can exceed one manager's annual pay.
El umbral de facturación sube a 3,29 millones de dólares en el nivel del 3% y a 9,86 millones en el del 1%, lo que muestra la rapidez con la que la exposición por gobernanza de IA puede superar el sueldo anual de un gestor.
Team size transforms the economics. One manager equals 74.5% of one developer's median pay. Across 5 developers, the same salary equals 14.9% of their combined pay. The coordination burden must be unusually severe before that first ratio makes sense.
El tamaño del equipo transforma la economía. Un gerente equivale al 74,5% de la mediana salarial de un desarrollador. En 5 desarrolladores, el mismo salario equivale al 14,9% de su nómina combinada. La carga de coordinación debe ser inusualmente severa antes de que esa primera proporción tenga sentido.
Even perfect recovery of the quantified minimum covers only 18.5% of a PM with one developer and 92.6% with five, leaving the smallest teams furthest from cost recovery.
Incluso recuperar por completo el mínimo cuantificado cubre solo el 18,5% de un gestor con un desarrollador y el 92,6% con cinco, por lo que los equipos más pequeños quedan más lejos de recuperar el coste.
A coordination-only manager carries the full illustrative 74.5% premium. If half the role becomes productive coding, the noncoding premium falls to 37.3%. At 75% coding, it falls to 18.6%. This is a scenario, not an observed productivity study, but it clarifies why hybrid work matters most in tiny teams.
Un gerente solo de coordinación carga la prima ilustrativa completa de 74,5%. Si la mitad del rol se vuelve codificación productiva, la prima de no codificación cae a 37,3%. Con 75% de codificación, cae a 18,6%. Este es un escenario, no un estudio de productividad observado, pero aclara por qué el trabajo híbrido importa más en equipos muy pequeños.
Scrum defines 3 core accountabilities and says the team is typically 10 people or fewer. Developers themselves plan the Sprint, adapt daily, maintain quality, and hold one another accountable. The supplied evidence also found no dedicated project-manager role in the core Scrum, Kanban Guide, or Shape Up models. The work remains, but the title is optional.
Scrum define 3 responsabilidades centrales y dice que el equipo típicamente tiene 10 personas o menos. Los Desarrolladores mismos planifican el Sprint, se adaptan diariamente, mantienen la calidad y se hacen mutuamente responsables. La evidencia proporcionada tampoco encontró un rol dedicado de gerente de proyecto en los modelos Scrum, Kanban Guide o Shape Up. El trabajo permanece, pero el título es opcional.
When coordination is distributed, management must protect focus and support the people doing the work.
Cuando la coordinación se distribuye, la gestión debe proteger la concentración y apoyar a quienes hacen el trabajo.
Some 68% of surveyed people said they lacked enough uninterrupted focus. In the same report, sampled Microsoft 365 users spent 57% of measured work time communicating and 43% creating. A useful player-coach protects creation time. The role fails when it becomes another source of meetings and interruptions.
Aproximadamente el 68% de personas encuestadas dijeron que carecían de suficiente enfoque ininterrumpido. En el mismo informe, usuarios muestreados de Microsoft 365 pasaron 57% del tiempo de trabajo medido comunicándose y 43% creando. Un jugador-coach útil protege el tiempo de creación. El rol falla cuando se convierte en otra fuente de reuniones e interrupciones.
Atlassian reported that 69% of developers lost at least 8 hours each week to inefficiencies. Only 20% of leaders believed the loss was that large. The gap is not another reason for reporting overhead. It is a reason to remove technical debt, blocked access, unclear decisions, and interruptions.
Atlassian reportó que el 69% de los desarrolladores perdió al menos 8 horas cada semana en ineficiencias. Solo el 20% de los líderes creyó que la pérdida era tan grande. La brecha no es otra razón para reportar overhead. Es una razón para eliminar deuda técnica, acceso bloqueado, decisiones poco claras e interrupciones.
Project Aristotle placed psychological safety first among 5 reported team factors. Dependability and clarity followed. Project Oxygen separately placed technical expertise eighth in its original list of 8 effective-manager behaviors. A player-coach needs technical credibility, but code alone does not create a healthy team.
Project Aristotle posicionó la seguridad psicológica primero entre 5 factores de equipo reportados. La confiabilidad y claridad siguieron. Project Oxygen posicionó por separado la experiencia técnica en octavo lugar en su lista original de 8 comportamientos efectivos de gerentes. Un player-coach necesita credibilidad técnica, pero el código solo no crea un equipo saludable.
Gallup estimated that managers account for at least 70% of engagement-score variance across business units. That is much larger than the remaining 30%. The estimate is old and low-confidence for this specific thesis. It still makes one point clear: eliminating a title does not eliminate the need for leadership behavior.
Gallup estimó que los gerentes representan al menos el 70% de la varianza de scores de engagement entre unidades de negocio. Esto es mucho mayor que el 30% restante. La estimación es antigua y tiene baja confianza para esta tesis específica. Aun así deja un punto claro: eliminar un título no elimina la necesidad de comportamiento de liderazgo.
Researchers generated 1,689 Copilot programs across 89 security scenarios and judged about 40% vulnerable. Separately, only 43% of surveyed developers trusted AI-tool accuracy. Another 31% distrusted it, while 26% were neutral or uncertain. Small teams need review rules that do not depend on confidence alone.
Los investigadores generaron 1.689 programas de Copilot en 89 escenarios de seguridad y juzgaron aproximadamente 40% como vulnerables. Por separado, solo 43% de desarrolladores encuestados confiaban en la precisión de herramientas de IA. Otro 31% desconfiaba, mientras 26% eran neutral o inciertos. Los equipos pequeños necesitan reglas de revisión que no dependan solo de la confianza.
The experiment included 47 participants and documented both an AI-assisted condition and security-sensitive tasks. Its reported combination of weaker output and greater confidence is a warning to verify both the code and the certainty around it.
El experimento incluyó 47 participantes y documentó una condición asistida por IA y tareas sensibles a la seguridad. Su combinación reportada de resultados más débiles y mayor confianza advierte que hay que verificar tanto el código como la certeza que lo rodea.
DORA's largest reported gap was recovery time at 2,604 times. Deployment frequency differed by 208 times and lead time by 106 times. DORA measures delivery outcomes rather than code volume, while SPACE warns that no single metric captures developer productivity. The surviving role should own this broader scorecard.
La mayor brecha reportada por DORA fue el tiempo de recuperación con 2.604 veces. La frecuencia de despliegue difirió 208 veces y el tiempo de cambio 106 veces. DORA mide resultados de entrega en lugar de volumen de código, mientras que SPACE advierte que ninguna métrica única captura la productividad de desarrolladores. El rol superviviente debe poseer este scorecard más amplio.
Software developers lead the projection at 18% growth. Project-management specialists still grow 7%. Computer programmers decline 10%. The likely shift is toward software work and hybrid skills, not the disappearance of every management responsibility.
Los desarrolladores de software lideran la proyección con crecimiento de 18%. Los especialistas en gestión de proyectos aún crecen 7%. Los programadores de computadoras disminuyen 10%. El cambio probable es hacia trabajo de software y habilidades híbridas, no la desaparición de toda responsabilidad de gestión.
Development and testing roles lead with roughly 140,100 annual openings. Project-management specialists still have about 77,000. Programmers trail at 6,400. A separate employer survey also expected project managers to contribute net job growth through 2030, so the evidence rejects literal erasure.
Los roles de desarrollo y pruebas lideran con aproximadamente 140.100 aperturas anuales. Los especialistas en gestión de proyectos aún tienen cerca de 77.000. Los programadores quedan atrás con 6.400. Una encuesta de empleadores separada también esperaba que los gerentes de proyecto contribuyeran al crecimiento neto de empleo hasta 2030, así que la evidencia rechaza borrado literal.
The largest EU AI Act fine tier reaches 7% of worldwide annual turnover. NIST organizes AI risk work into Govern, Map, Measure, and Manage. ISO/IEC 42001 adds an auditable management-system structure. AI therefore creates management work, but small teams benefit when its owner understands the technical system being governed.
El máximo de la Ley de IA de la UE llega a 7% de la facturación anual mundial. NIST organiza el trabajo de riesgo de IA en Govern, Map, Measure y Manage. ISO/IEC 42001 añade una estructura de sistema de gestión auditable. IA, por lo tanto, crea trabajo de gestión, pero equipos pequeños se benefician cuando su propietario entiende el sistema técnico siendo gobernado.
As AI enters civic workflows, accountability work persists even without a dedicated governance role.
A medida que la IA entra en los flujos de trabajo cívicos, la labor de rendición de cuentas persiste incluso sin un rol dedicado de gobernanza.
NIST organizes AI risk work into 4 functions: Govern, Map, Measure, and Manage. ISO/IEC 42001:2023 adds an organizational management system with 3 listed governance areas. Together, they define work and accountability, not a mandatory job title. The residual takeaway belongs in the appendix: small teams can distribute these responsibilities across existing roles.
NIST organiza el trabajo de riesgo de IA en 4 funciones: Gobernar, Mapear, Medir y Gestionar. ISO/IEC 42001:2023 añade un sistema organizacional de gestión con 3 áreas de gobernanza indicadas. En conjunto, definen trabajo y responsabilidad, no un puesto obligatorio. La conclusión residual pertenece al apéndice: los equipos pequeños pueden distribuir estas responsabilidades entre funciones existentes.
One unavailable person removes 20% of a 5-person team's headcount, twice the impact in a 10-person team. A study of 133 popular GitHub projects found 65% had a truck factor of 2 or fewer key developers. Small repositories were reported as more concentrated than larger ones. Combining engineering and management can save payroll, but it can also create a single point of failure.
Una persona no disponible elimina el 20% del personal de un equipo de 5 personas, el doble del impacto en un equipo de 10. Un estudio de 133 proyectos populares en GitHub encontró que el 65% tenía un truck factor de 2 o menos desarrolladores clave. Los repositorios pequeños reportaron mayor concentración que los grandes. Combinar ingeniería y gestión puede ahorrar nómina, pero también puede crear un único punto de fallo.
The 43-point expectation error makes self-reported AI speed a dangerous delivery metric. AI can erase task time without proving it can run a project.
Key findings
METR reported that 16 experienced maintainers completed 246 real repository tasks 19% slower when allowed to use early-2025 AI tools. METR
METR developers expected AI to reduce task time 24%, but measured completion was 19% slower, producing a 43-percentage-point expectation error. METR
The same DORA study associated a 25% AI-adoption increase with 1.5% lower delivery throughput and 7.2% lower delivery stability. Google Cloud DORA
On a task outside GPT-4's capability frontier, AI-assisted consultants were 19 percentage points less likely to produce the correct answer. Harvard Business School
Atlassian reported 69% of developers lost at least eight weekly hours to inefficiencies, while only 20% of leaders believed the loss was that large. Atlassian
Google's original Project Oxygen list placed technical expertise eighth among eight observed behaviors associated with effective managers. Google re:Work
Researchers generated 1,689 Copilot programs across 89 security scenarios and judged approximately 40% of generated programs vulnerable. IEEE
A 47-person experiment found AI-assisted participants produced less secure code and were more likely to believe their answers were secure. Association for Computing Machinery
DORA's 2019 survey classified elite performers as deploying 208 times more frequently, with 106 times faster lead time and 2,604 times faster recovery than low performers. Google Cloud DORA
The EU AI Act establishes maximum turnover-based fine tiers of 7%, 3%, and 1% for different categories of infringement. European Union
In the BCG experiment, below-average performers improved about 43% on suitable tasks, compared with roughly 17% for above-average performers. Harvard Business School
Developer forecasts during and after the study indicated changes in task time of -24 percent and -20 percent when AI was allowed, whereas the observed result was 19 percent, showing that AI did not accelerate this developer sample as expected. Measuring the Impact of Early-2025 AI on Experienced Open ... - METR
The argument
AI is powerful when the task sits inside its capability frontier.
The same tool can raise quality or quietly reduce correctness.
AI's clearest reported gain was better documentation, not raw delivery.
Better artifacts do not automatically become more reliable delivery.
AI can narrow skill gaps, but supervision and training remain essential.
Observed AI use still looks more like collaboration than job replacement.
This research is published in English and Spanish. Ver en español
La investigación detrás de esta presentación
El error de expectativa de 43 puntos hace que la velocidad de IA autorreportada sea una métrica de entrega peligrosa. La IA puede eliminar tiempo de tarea sin probar que puede ejecutar un proyecto.
Hallazgos clave
METR reported that 16 experienced maintainers completed 246 real repository tasks 19% slower when allowed to use early-2025 AI tools. METR
METR developers expected AI to reduce task time 24%, but measured completion was 19% slower, producing a 43-percentage-point expectation error. METR
The same DORA study associated a 25% AI-adoption increase with 1.5% lower delivery throughput and 7.2% lower delivery stability. Google Cloud DORA
On a task outside GPT-4's capability frontier, AI-assisted consultants were 19 percentage points less likely to produce the correct answer. Harvard Business School
Atlassian reported 69% of developers lost at least eight weekly hours to inefficiencies, while only 20% of leaders believed the loss was that large. Atlassian
Google's original Project Oxygen list placed technical expertise eighth among eight observed behaviors associated with effective managers. Google re:Work
Researchers generated 1,689 Copilot programs across 89 security scenarios and judged approximately 40% of generated programs vulnerable. IEEE
A 47-person experiment found AI-assisted participants produced less secure code and were more likely to believe their answers were secure. Association for Computing Machinery
DORA's 2019 survey classified elite performers as deploying 208 times more frequently, with 106 times faster lead time and 2,604 times faster recovery than low performers. Google Cloud DORA
The EU AI Act establishes maximum turnover-based fine tiers of 7%, 3%, and 1% for different categories of infringement. European Union
In the BCG experiment, below-average performers improved about 43% on suitable tasks, compared with roughly 17% for above-average performers. Harvard Business School
Las previsiones de los desarrolladores durante y después del estudio indicaron cambios en el tiempo de las tareas de -24 por ciento y -20 por ciento cuando se permitió usar IA, mientras que el resultado observado fue de 19 por ciento, lo que muestra que la IA no aceleró a esta muestra de desarrolladores como se esperaba. Measuring the Impact of Early-2025 AI on Experienced Open ... - METR
El argumento
La IA es poderosa cuando la tarea está dentro de su frontera de capacidad.
La misma herramienta puede elevar la calidad o reducir silenciosamente la corrección.
La ganancia más clara reportada de IA fue mejor documentación, no entrega bruta.
Artefactos mejores no se vuelven automáticamente entrega más confiable.
La IA puede reducir brechas de habilidades, pero la supervisión y el entrenamiento siguen siendo esenciales.
El uso de IA observado sigue viéndose más como colaboración que como reemplazo de empleo.
Esta investigación se publica en inglés y español. Read in English