Regression testing for AI agents. Golden baselines, CI/CD, LangGraph, CrewAI, OpenAI, Claude.
The open-source behavior regression gate for AI agents. Think Playwright, but for tool-calling and multi-turn AI agents. Your agent can still return and be wrong. A model or provider update can change tool choice, skip a clarification, or degrade output quality without changing your code or breaking a health check. EvalView catches those silent regressions before users do — and gives you the loop…
Inferido de los transportes que declara este listado (stdio). Que un cliente no aparezca aquí no significa que se haya descartado: simplemente Forge no puede confirmarlo.
La verificación confirma la identidad del publicador (la propiedad del repo), no la seguridad del código. El análisis de seguridad cubre los CVE conocidos y los scripts de instalación sospechosos.
Forge leyó 0 archivos de código de tarball del paquete publicado y no encontró ningún registro de herramientas MCP. La extracción se basa en patrones sobre el código publicado: un servidor que construye su lista de herramientas en tiempo de ejecución, o que solo publica código empaquetado o minificado, no registra nada que esto pueda ver. Tómalo como «no detectado», no como «no expone ninguna».
The open-source behavior regression gate for AI agents. Think Playwright, but for tool-calling and multi-turn AI agents. Your agent can still return and be wrong. A model or provider update can change tool choice, skip a clarification, or degrade output quality without changing your code or breaking a health check. EvalView catches those silent regressions before users do — and gives you the loop to investigate them, grade the confidence, and broadcast the verdict to your team. You don't need…
El resolutor de dependencias de Forge solo lee metadatos de npm, así que este paquete de PyPI no tiene árbol resuelto. Es una carencia de cobertura, no un certificado de buena salud.