cost-latency-optimization-desk

SKILLFlujo de trabajocomunidad
v0.0.0MadewellRDAGPL-3.0Actualizado hace 6 dFuente →

optimize AI system cost and latency using model routing, caching, prompt compression, context pruning, batching, streaming, parallelism, retrieval tuning, and fallback tiers while preserving quality and safety gates.

Community-submitted skill. Not yet reviewed by the Forge team. Full prompt content may not be available.Request review →
2Estrellas del repo
1Clientes
1Formatos
hace 6 dÚltima actualización
Skill
AutorMadewellRD
Versión0.0.0
LicenciaAGPL-3.0
CategoríaFlujo de trabajo
Formatosskill.md
PromptNo publicado
Compatibilidad
Claude✓ Compatible
Cursor
Copilot
ChatGPT
Gemini
Acerca de

optimize AI system cost and latency using model routing, caching, prompt compression, context pruning, batching, streaming, parallelism, retrieval tuning, and fallback tiers while preserving quality and safety gates.

Palabras clave
skillclaude