Esta página se muestra en inglés. Una traducción al español está en curso.
Jul 27, 2026·1 min de lectura

oMLX — LLM Inference Server with Continuous Batching for Apple Silicon

A high-performance LLM inference server optimized for Apple Silicon that provides continuous batching and SSD caching, manageable via a macOS menu bar app.

Listo para agents

Instalación lista para agent

Este activo puede instalarse después de elegir el runtime, revisar el plan y ejecutar el comando correspondiente.

Native · 98/100Política: permitir
Superficie agent
Cualquier agent MCP/CLI
Tipo
Skill
Instalación
Single
Confianza
Confianza: New
Entrada
SKILL.md
Comando de instalación directa
npx -y tokrepo@latest install 39d63ff2-8999-11f1-9bc6-00163e2b0d79 --target codex

Ejecutar después de confirmar el plan con dry-run.

A high-performance LLM inference server optimized for Apple Silicon that provides continuous batching and SSD caching, manageable via a macOS menu bar app.

Discusión

Inicia sesión para unirte a la discusión.
Aún no hay comentarios. Sé el primero en compartir tus ideas.