Un pipeline de QA con agentes dentro del repositorio del cliente
Punto de partida
El cliente desarrolla casi exclusivamente con IA y puso en duda que todavía hiciera falta un aseguramiento de calidad externo. Propusimos construir la capa de calidad no al lado de los agentes, sino con ellos.
Lo que surgió de ahí
El catálogo de casos de prueba vive como archivos en el Git del cliente. La IA lo mantiene en el mismo merge request que el código — sin herramienta de gestión de pruebas, sin licencia. En la CI hay una compuerta que nadie puede esquivar: bloquea en la rama principal, antes del despliegue. Cambiar el contenido de un caso ya aceptado exige una aprobación humana. Los ciclos de reparación están limitados a tres, y ante la sospecha de un defecto del producto el agente se detiene en lugar de reparar.
Herramientas
Playwright · TypeScript · GitLab CI · Claude Code · Coder
Cifras
165casos en el catálogo, como archivos en el Git del cliente
162pruebas de Playwright generadas a partir de ellos
9,4 minhasta que la CI dice si el estado aguanta — toda la suite activa, una tras otra
sinherramienta de gestión de pruebas — el catálogo vive en el Git del cliente
El paso de CI bloquea, no solo avisa: en la rama principal, antes del despliegue. Y el paso de IA tiene que ganarse el sitio — la mecánica de rutas pura, sin IA, alcanza precisión 0,78 y exhaustividad 0,88. Esa es la vara. Si el agente no la supera, se va.
Estrategia de pruebas y una regresión para Android e iOS — de cero al pipeline
Punto de partida
Un equipo Scrum con una aplicación de salud en Android e iOS. Hasta entonces se probaba a mano antes de cada release. El encargo: estrategia de pruebas y automatización desde cero.
Lo que surgió de ahí
Primero la estrategia de pruebas, después la ejecución: automatización de interfaz para ambas plataformas desde cero, contra dispositivos reales vía BrowserStack, más las pruebas de API por detrás — y todo enganchado al pipeline de Bitbucket, con notificaciones al equipo. La regresión corre en cada merge a la rama principal y una vez por día. Empezamos de forma clásica, a mano; hoy construimos de forma agéntica con Claude Code: los agentes diseñan, revisan y amplían los casos de prueba, y a la automatización misma la mejoramos del mismo modo. Además, acompañamiento en gestión de pruebas para el personal interno de QA.
KfW — banco público de desarrollo de Alemania, Berlín · 09/2023 – 12/2025
KfW
Una estrategia de pruebas viable bajo supervisión bancaria — y en parte implementada por nosotros
Punto de partida
Unas 150 personas reunidas en un programa para construir un componente de CI/CD compartido — el pipeline por el que hoy despliegan partes relevantes de todo el banco. A eso se suman una arquitectura deliberadamente compleja, muchísimos entornos y circuitos de aprobación que bajo BAIT y MaRisk no admiten atajos.
Lo que surgió de ahí
Nuestro encargo fue la estrategia de pruebas para ese componente — una que funcionara de verdad bajo esas exigencias y no solo sobre el papel. La implementamos en parte nosotros mismos: asumimos la gestión de pruebas, pusimos a prueba e introdujimos herramientas, capacitamos al personal en automatización de pruebas y llevamos buena parte de la coordinación entre las áreas del banco.
Regulación
BAIT y MaRisk hasta su derogación, DORA desde su entrada en aplicación en enero de 2025. Participación en el Agile Release Train.
Herramientas
Robot Framework · Cypress · Playwright · Testcontainers · Azure Test Plans · HP ALM · GitLab
Cifras
150personas en el programa, organizadas según SAFe
3marcos que el pipeline tenía que cumplir: BAIT, MaRisk y después DORA
Cuatro niveles, un solo montaje de pruebas: firmware, dispositivo, app, asistente de voz
Punto de partida
Un dispositivo IoT nuevo para la cocina, junto con una aplicación móvil y una integración con Alexa.
Lo que surgió de ahí
Probamos el dispositivo como un sistema y no por partes: firmware grabado en el dispositivo de prueba, sensores de gestos, micrófonos y parlantes verificados a nivel embebido, la aplicación en Android e iOS, el backend que está detrás y la integración de voz que se monta encima. Planificamos, escribimos y ejecutamos pruebas de extremo a extremo sobre aplicación, dispositivo y backend, además de la automatización del lado móvil y una estrategia de pruebas para la ampliación posterior.
Hardware de sim racing, Landshut · 07/2022 – 12/2023
Fanatec / Endor AG
Tienda en línea, ERP y gestión de activos digitales en un mismo proyecto
Punto de partida
Fanatec es uno de los principales proveedores internacionales de hardware profesional de sim racing. Allí se implantaron al mismo tiempo un ERP a medida, una tienda en línea nueva y un sistema de gestión de activos digitales, a cargo de tres proveedores con más de setenta personas que tenían que entregar juntas. En la empresa no había ninguna práctica de pruebas ni de automatización.
Lo que surgió de ahí
Construimos planes de prueba, procesos y automatización desde cero y verificamos las entregas de los proveedores externos antes de darlas por aceptadas. La automatización de front-end abarcaba tienda en línea, back office, ERP y gestión de activos digitales en entornos de integración y staging separados, además de una simulación de carga para el Black Friday.
Herramientas
Katalon Studio mit TestOps · Java · Gradle · Postman · TestRail
Cifras
3sistemas en una misma cadena: tienda, ERP, gestión de activos digitales
70+personas de tres proveedores que tenían que entregar juntas