A high-performance LLM inference server optimized for Apple Silicon that provides continuous batching and SSD caching, manageable via a macOS menu bar app.
Esta página se muestra en inglés. Una traducción al español está en curso.
Jul 27, 2026·1 min de lectura
oMLX — LLM Inference Server with Continuous Batching for Apple Silicon
A high-performance LLM inference server optimized for Apple Silicon that provides continuous batching and SSD caching, manageable via a macOS menu bar app.
Listo para agents
Instalación lista para agent
Este activo puede instalarse después de elegir el runtime, revisar el plan y ejecutar el comando correspondiente.
Native · 98/100Política: permitir
Superficie agent
Cualquier agent MCP/CLI
Tipo
Skill
Instalación
Single
Confianza
Confianza: New
Entrada
SKILL.md
Comando de instalación directa
npx -y tokrepo@latest install 39d63ff2-8999-11f1-9bc6-00163e2b0d79 --target codexEjecutar después de confirmar el plan con dry-run.
Discusión
Inicia sesión para unirte a la discusión.
Aún no hay comentarios. Sé el primero en compartir tus ideas.