El fin del vibe coding y la paradoja de la IA: por qué los desarrolladores son un 19% más lentos (pero se sienten más rápidos)
A principios de 2025, el científico de la computación Andrej Karpathy acuñó un término que definió el mercado tecnológico durante más de un año: el vibe coding. La premisa era seductora: el desarrollador ya no necesitaba escribir sintaxis; bastaba con lanzar la intención (la vibe) en el prompt de un LLM y aceptar el código generado. El propio Karpathy, al acuñar el término, ya advertía que esto servía para prototipos de fin de semana, no para sistemas de producción. El mercado, en gran parte, ignoró la advertencia.
Una encuesta de Fastly a casi 800 desarrolladores profesionales, citada por CodeRabbit, muestra cuánto avanzó esta práctica pese a la advertencia original: cerca de un tercio de los desarrolladores senior afirma que hoy la mitad del código que entregan ya es generado por IA, frente a solo el 13% entre los junior.
Pero las "vibes" chocaron con la realidad corporativa. Lo que empezó como un milagro de productividad para proyectos de fin de semana se transformó en una crisis silenciosa dentro del SDLC (Ciclo de Vida de Desarrollo de Software).
La ilusión de la autonomía cobró su precio: no estamos programando más rápido. Solo estamos generando más deuda técnica en menos tiempo. Y los datos que lo demuestran son incómodos.
1. La paradoja del vibe coding: la ilusión de la velocidad
Uno de los estudios más rigurosos sobre el impacto real de la IA en la ingeniería fue realizado por METR (Model Evaluation and Threat Research). El experimento reunió a 16 desarrolladores experimentados, cada uno trabajando en repositorios open source grandes y maduros que ya conocían a fondo: proyectos con un promedio de más de 1 millón de líneas de código y 22 mil estrellas en GitHub. En total, se completaron 246 tareas reales (corrección de bugs, features y refactorizaciones), cada una cronometrada tanto con como sin el uso de herramientas de IA.
El resultado fue un golpe para la industria: con el uso irrestricto de herramientas de IA, estos desarrolladores experimentados fueron 19% más lentos al completar sus tareas.
Pero el dato más inquietante no fue la lentitud, sino la disonancia cognitiva. Antes de la prueba, los desarrolladores predijeron que la IA los haría un 24% más rápidos. Al final del estudio, ya cronometrados y comprobadamente más lentos, seguían creyendo que habían sido un 20% más rápidos.
La ingeniería de software fue diagnosticada con un sesgo cognitivo relevante. Los desarrolladores sienten la euforia de ver 200 líneas de código aparecer en pantalla en tres segundos. Pero no contabilizan las horas dedicadas a leer, refactorizar, probar y depurar las alucinaciones arquitectónicas que la máquina introdujo horas después.
2. La crisis de calidad y el "Shadow AI Development"
El problema del vibe coding no es la generación de código, sino la externalización del entendimiento arquitectónico. Cuando aceptas un bloque de código sin escribirlo, nunca construyes el modelo mental de cómo funciona realmente. Si falla en producción a las 3 de la madrugada, no sabes cómo arreglarlo.
Los datos de calidad acompañan la caída de velocidad. Un análisis propio de CodeRabbit sobre pull requests encontró que el código coescrito con IA contiene 1,7 veces más bugs y problemas en general, y 1,4 veces más problemas críticos que el código escrito solo por humanos. La misma encuesta de Fastly citada arriba refuerza el panorama: casi el 30% de los desarrolladores senior reporta que el tiempo dedicado a revisar y corregir lo que generó la IA anula la mayor parte de la ganancia inicial de velocidad.
En la capa de seguridad, el panorama es aún más duro. El Informe de Seguridad de Código GenAI de Veracode, que evaluó más de 100 modelos de lenguaje en Java, Python, JavaScript y C#, encontró que el 45% de las muestras de código generadas por IA fallaron en pruebas de seguridad vinculadas a categorías del OWASP Top-10, con Cross-Site Scripting como el caso más grave: los modelos fallaron en mitigarlo en el 86% de los casos relevantes. El estudio trajo una advertencia aún peor: los modelos más nuevos escribían código más funcional, pero no más seguro. La tasa de fallos de seguridad se mantuvo prácticamente estable, sin importar el tamaño o la generación del modelo.
Esto alimenta lo que los especialistas en seguridad ya llaman Shadow AI Development: desarrolladores que usan herramientas locales para inyectar lógica generada por máquina directamente en los repositorios de la empresa, sorteando la arquitectura oficial. Rápido, pulido y peligrosamente frágil.
3. De la autonomía sin control a la Ingeniería Agéntica
La luna de miel del vibe coding, al menos para aplicaciones serias, se está reduciendo. Existe una diferencia brutal entre los dos modelos:
- Vibe coding es que el desarrollador use un prompt libre en Cursor o ChatGPT para generar una función y pegarla en el sistema. No hay límites, no hay auditoría, no hay barrera de contexto. Es caótico. Y, como el propio Karpathy reconoció desde el principio, fue pensado así a propósito, para prototipos desechables, no para producción.
- Ingeniería Agéntica es un pipeline. El agente no escribe código suelto; opera dentro de un entorno orquestado (ADLC). Lee los requisitos, genera la hipótesis, somete su propio razonamiento a una evaluación sistémica (LLM-as-a-judge) y sigue las políticas de seguridad de la empresa.
La orquestación es el antídoto contra la ilusión
El error de muchas empresas a lo largo de 2025 fue tratar la inteligencia artificial como un "autocompletado glorificado", ignorando que los modelos agénticos toman decisiones lógicas encadenadas.
Para que la adopción de la IA no deje a los equipos un 19% más lentos y a los repositorios con casi la mitad del código fallando en pruebas de seguridad, el liderazgo técnico necesita imponer Gobernanza de Ejecución.
Las herramientas agénticas no pueden operar sueltas en la terminal de cada programador. Necesitan pasar por una Plataforma de Orquestación Agéntica, una capa que:
- Delimita el contexto: el agente solo recibe la arquitectura pertinente a esa tarea, reduciendo el espacio para alucinaciones.
- Gobierna el código: el código no va al merge sin pasar por un pipeline de validación donde otro agente (QA/Sec) estresa la lógica generada.
- Mide el ROI real: sustituye la "sensación" de velocidad por métricas reales de Lead Time, combatiendo la paradoja de productividad que documentó METR.
La inteligencia artificial todavía va a revolucionar la forma en que se hace el software. Pero la revolución no vendrá de desarrolladores conversando de forma desestructurada con chatbots. La verdadera revolución vendrá de la ingeniería orquestada, gobernada y auditable.
El vibe se acabó. Ahora empieza la ingeniería de verdad.
Referencias
- METR: Measuring the impact of early-2025 AI on experienced open-source developer productivity (Julio de 2025). El experimento controlado con 16 desarrolladores experimentados en repositorios open source maduros, que midió una desaceleración real del 19% pese a la percepción subjetiva de ganancia de productividad.
- METR: Paper completo (PDF) (Julio de 2025). Metodología detallada del estudio, incluyendo las 246 tareas evaluadas y el diseño experimental aleatorizado.
- CodeRabbit Blog: A semantic history: how the term 'vibe coding' went from a tweet to prod (Marzo de 2026). Presenta la investigación propia de CodeRabbit sobre bugs en código generado por IA y cita la encuesta de Fastly a desarrolladores profesionales.
- Veracode: 2025 GenAI Code Security Report (2025). Evaluó más de 100 LLMs en cuatro lenguajes y encontró una tasa de fallo de seguridad del 45% vinculada al OWASP Top-10.
- DevAgents OS Blog: La nueva frontera de la IA agéntica no es la autonomía. Es la operación gobernada.
_Publicado el 10 de agosto de 2026_