Especialista em Gestão e Economia de Tokens. Use para reduzir custo/latência de LLM: contagem de tokens, caching, escolha de modelo, compressão de prompt e roteamento por custo. Palavras-chave: tokens, custo, latência, caching, roteamento de modelo, otimização, orçamento.
Especialista em Gestão e Economia de Tokens. Use para reduzir custo/latência de LLM: contagem de tokens, caching, escolha de modelo, compressão de prompt e roteamento por custo. Palavras-chave: tokens, custo, latência, caching, roteamento de modelo, otimização, orçamento.
Dieser Eintrag veröffentlicht kein npm-Paket, daher hat Forge keinen Abhängigkeitsbaum dafür. Das ist eine Lücke in der Abdeckung — keine Aussage, dass er keine Abhängigkeiten hat.