acl-experiments

SKILLFlujo de trabajocomunidad
v0.0.0brycewang-stanfordMITActualizado hace 12 dFuente →

Use when designing or auditing experiments for an ACL paper, covering tuned LLM baselines, multi-dataset and multilingual evaluation, statistical significance and variance, human evaluation with agreement reporting, contamination and prompt-sensitivity controls, ablations, and error-analysis expecta

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
993Estrellas del repo
1Clientes
1Formatos
hace 12 dÚltima actualización
Skill
Autorbrycewang-stanford
Versión0.0.0
LicenciaMIT
CategoríaFlujo de trabajo
Formatosskill.md
PromptAbrir (ver la pestaña Prompt)
Compatibilidad
Claude✓ Compatible
Cursor
Copilot
ChatGPT
Gemini
Acerca de

Use when designing or auditing experiments for an ACL paper, covering tuned LLM baselines, multi-dataset and multilingual evaluation, statistical significance and variance, human evaluation with agreement reporting, contamination and prompt-sensitivity controls, ablations, and error-analysis expectations in NLP reviewing.

Palabras clave
skillclaude