MCP
Vllm Mlx
OpenAI and Anthropic compatible server for Apple Silicon. Run LLMs and vision-language models (Llama, Qwen-VL, LLaVA) with continuous batching, MCP tool calling, and multimodal support. Native MLX backend, 400+ tok/s. Works with Claude Code.
Rivendica questo annuncio
Collega il tuo account GitHub per dimostrare che possiedi o mantieni questo annuncio. Verifichiamo l’accesso al repo automaticamente — la maggior parte dei publisher viene confermata in pochi secondi.
1Collega GitHub
2Invia la tua rivendicazione
3Verifica automatica, oppure esame entro 48 h