Regression testing for AI agents. Golden baselines, CI/CD, LangGraph, CrewAI, OpenAI, Claude.
The open-source behavior regression gate for AI agents. Think Playwright, but for tool-calling and multi-turn AI agents. Your agent can still return and be wrong. A model or provider update can change tool choice, skip a clarification, or degrade output quality without changing your code or breaking a health check. EvalView catches those silent regressions before users do — and gives you the loop…
Déduit des transports déclarés par cette annonce (stdio). Un client absent de cette liste n’est pas écarté pour autant — c’est simplement quelque chose que Forge ne peut pas confirmer.
La vérification confirme l’identité de l’éditeur (la propriété du dépôt), pas la sûreté du code. L’analyse de sécurité couvre les CVE connues et les scripts d’installation suspects.
Forge a lu 0 fichiers sources de l’archive du paquet publié et n’a trouvé aucun enregistrement d’outil MCP. L’extraction repose sur des motifs appliqués au code livré : un serveur qui construit sa liste d’outils à l’exécution, ou qui ne livre que du code empaqueté ou minifié, n’enregistre rien de visible ici. À lire comme « non détecté », pas comme « n’en expose aucun ».
The open-source behavior regression gate for AI agents. Think Playwright, but for tool-calling and multi-turn AI agents. Your agent can still return and be wrong. A model or provider update can change tool choice, skip a clarification, or degrade output quality without changing your code or breaking a health check. EvalView catches those silent regressions before users do — and gives you the loop to investigate them, grade the confidence, and broadcast the verdict to your team. You don't need…
Le résolveur de Forge ne lit que les métadonnées npm : ce paquet PyPI n'a donc pas d'arbre résolu. C'est une lacune de couverture, pas un satisfecit.