io.github.hidai25/evalview-mcp

MCPcomunidad
v0.6.0io.github.hidai25UnknownActualizado hace 4 mGitHub

Regression testing for AI agents. Golden baselines, CI/CD, LangGraph, CrewAI, OpenAI, Claude.

The open-source behavior regression gate for AI agents. Think Playwright, but for tool-calling and multi-turn AI agents. Your agent can still return and be wrong. A model or provider update can change tool choice, skip a clarification, or degrade output quality without changing your code or breaking a health check. EvalView catches those silent regressions before users do — and gives you the loop…

Funciona en
ClaudeCursorCopilotGemini

Inferido de los transportes que declara este listado (stdio). Que un cliente no aparezca aquí no significa que se haya descartado: simplemente Forge no puede confirmarlo.

Indexado automáticamente desde fuentes públicas. Aún sin verificar por su desarrollador en Forge.Reclamar este listado →
hace 4 mÚltima actualización
Paquete
Autorio.github.hidai25
LicenciaUnknown
Versión0.6.0
Fuentemcp-registry
Estado de confianza
F
10/100No fiable
Listado en el índice de Forge+10/10
Identidad del publicador verificada+0/30
Publicador: ejecuta `forge publish` desde el repo para reclamar la propiedad
Verificación de dominio+0/10
Ahora mismo no está disponible para este tipo de listado: hoy la comprobación de dominio solo se ejecuta para paquetes publicados en npm, así que esta fila todavía no se puede conseguir aquí, sea lo que sea lo que haya alojado en el dominio.
Análisis de inyección de prompts · no ejecutado+0/30
Aún sin analizar: el archivo del repositorio se analiza en la próxima ejecución del cron
Análisis de ofuscación / exfiltración · no ejecutado+0/20
Aún sin analizar: el archivo del repositorio se analiza en la próxima ejecución del cron
Pégalo en Claude Code, Cursor o cualquier asistente de IA para corregir todas las carencias
EstadoIndexado por la comunidad
PublicadorSin verificar
FirmaSin firmar
Dominio
Procedencia
DependenciasSin auditar
Superficie de herramientas
Análisis de seguridadNo ejecutado
EvaluacionesNinguna
Indexado13 jun 2026

La verificación confirma la identidad del publicador (la propiedad del repo), no la seguridad del código. El análisis de seguridad cubre los CVE conocidos y los scripts de instalación sospechosos.

Herramientas

Aún sin analizar

Forge no tiene ningún análisis registrado de esta entrada, así que no tiene ninguna observación de su superficie de herramientas. Eso es ausencia de pruebas, no prueba de que no exponga ninguna herramienta.

Acerca de

The open-source behavior regression gate for AI agents. Think Playwright, but for tool-calling and multi-turn AI agents. Your agent can still return and be wrong. A model or provider update can change tool choice, skip a clarification, or degrade output quality without changing your code or breaking a health check. EvalView catches those silent regressions before users do — and gives you the loop to investigate them, grade the confidence, and broadcast the verdict to your team. You don't need…

Palabras clave
mcp
Alternativas
Comparando superficies de herramientas…