Framework de Evaluación LLM
Evaluación automatizada de respuestas LLM, precisión RAG y alucinaciones
Automatización E2E, API y rendimiento — cada uno con pipelines CI/CD y reportes en vivo.
Frameworks de evaluación LLM, benchmarks de alucinaciones y red teaming de seguridad con Promptfoo
Evaluación automatizada de respuestas LLM, precisión RAG y alucinaciones
Escaneo de vulnerabilidades LLM, pruebas de jailbreak y red teaming con Promptfoo
Automatización multi-navegador con Playwright y Cypress BDD
Suite cross-browser en TypeScript apuntando a saucedemo.com
Specs tipados con comandos reutilizables y reportes Mochawesome
Feature files Gherkin con step definitions en JavaScript
Validación de schemas OpenAPI y pruebas de contrato orientadas al consumidor con Pact
Validación automatizada de contratos API y schemas OpenAPI / Swagger
Pruebas de contrato orientadas al consumidor para microservicios con Pact
Pruebas de carga k6, validación de API con Supertest y colecciones Postman
Pruebas de Rendimiento & Carga
Pruebas de API
Colecciones de API
Suites de prueba Selenium Java desarrolladas con JUnit 5 y proveedora de datos TestNG
Arquitectura POM limpia con runner JUnit 5 y reportes Allure
Matriz @DataProvider cubriendo las 5 cuentas de saucedemo