acl-experiments

SKILLWorkflowCommunity
v0.0.0brycewang-stanfordMITAktualisiert vor 12 TQuelle →

Use when designing or auditing experiments for an ACL paper, covering tuned LLM baselines, multi-dataset and multilingual evaluation, statistical significance and variance, human evaluation with agreement reporting, contamination and prompt-sensitivity controls, ablations, and error-analysis expecta

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
993Repo-Sterne
1Clients
1Formate
vor 12 TLetzte Aktualisierung
Skill
Autorbrycewang-stanford
Version0.0.0
LizenzMIT
KategorieWorkflow
Formateskill.md
PromptÖffnen (siehe Tab „Prompt“)
Kompatibilität
Claude✓ Unterstützt
Cursor
Copilot
ChatGPT
Gemini
Über

Use when designing or auditing experiments for an ACL paper, covering tuned LLM baselines, multi-dataset and multilingual evaluation, statistical significance and variance, human evaluation with agreement reporting, contamination and prompt-sensitivity controls, ablations, and error-analysis expectations in NLP reviewing.

Schlagwörter
skillclaude