acl-experiments

SKILLFlusso di lavorocommunity
v0.0.0brycewang-stanfordMITAggiornato 12 g faFonte →

Use when designing or auditing experiments for an ACL paper, covering tuned LLM baselines, multi-dataset and multilingual evaluation, statistical significance and variance, human evaluation with agreement reporting, contamination and prompt-sensitivity controls, ablations, and error-analysis expecta

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
993Stelle del repo
1Client
1Formati
12 g faUltimo aggiornamento
Skill
Autorebrycewang-stanford
Versione0.0.0
LicenzaMIT
CategoriaFlusso di lavoro
Formatiskill.md
PromptApri (vedi la scheda Prompt)
Compatibilità
Claude✓ Supportato
Cursor
Copilot
ChatGPT
Gemini
Descrizione

Use when designing or auditing experiments for an ACL paper, covering tuned LLM baselines, multi-dataset and multilingual evaluation, statistical significance and variance, human evaluation with agreement reporting, contamination and prompt-sensitivity controls, ablations, and error-analysis expectations in NLP reviewing.

Parole chiave
skillclaude