Measure whether your AI agrees with itself using statistical consensus metrics.
One command. Find out if your AI agrees with itself. []( [](./LICENSE.md) []() ConKurrence measures whether multiple AI models produce consistent outputs on your evaluation tasks — using the same psychometric methods trusted in clinical research (Fleiss' κ, Kendall's W, bootstrap confidence intervals). Stop guessing whether your golden dataset is reliable. Know statistically. You now know is…
Déduit des transports déclarés par cette annonce (stdio). Un client absent de cette liste n’est pas écarté pour autant — c’est simplement quelque chose que Forge ne peut pas confirmer.
La vérification confirme l’identité de l’éditeur (la propriété du dépôt), pas la sûreté du code. L’analyse de sécurité couvre les CVE connues et les scripts d’installation suspects.
Forge n’a aucune analyse enregistrée pour cette entrée et n’a donc aucune observation de sa surface d’outils. C’est une absence de preuve, pas la preuve qu’elle n’expose aucun outil.
One command. Find out if your AI agrees with itself. []( [](./LICENSE.md) []() ConKurrence measures whether multiple AI models produce consistent outputs on your evaluation tasks — using the same psychometric methods trusted in clinical research (Fleiss' κ, Kendall's W, bootstrap confidence intervals). Stop guessing whether your golden dataset is reliable. Know statistically. You now know is reliable, needs review, and should be redesigned before trusting it. Your golden dataset has a hidden…