
OVM es una herramienta ligera en CLI/TUI y un servidor de inferencia de alto rendimiento diseñado para simplificar la descarga, gestión y ejecución de Modelos de Lenguaje Grande (LLMs) en local, aprovechando al máximo la aceleración de hardware mediante el toolkit Intel® OpenVINO™ GenAI.
A diferencia de la mayoría de herramientas optimizadas exclusivamente para GPUs NVIDIA (CUDA) o chips Apple Silicon, OVM está diseñado para extraer el máximo rendimiento de los millones de procesadores con gráficas integradas Intel Iris Xe, GPUs dedicadas Intel Arc y procesadores Intel Core Ultra. Permite transformar portátiles, mini-PCs y servidores edge en potentes nodos de inferencia local sin configuraciones complejas.
/v1): Funciona como sustituto directo (drop-in replacement) para herramientas como Continue.dev, Open WebUI, AnythingLLM, Chatbox o librerías como LangChain.| Componente | Tecnología | Rol en el Proyecto |
|---|---|---|
| Motor de Inferencia | Intel® OpenVINO™ GenAI | Compilación y ejecución acelerada en hardware Intel. |
| Capa de Servicio API | FastAPI + Uvicorn | Endpoints asíncronos (/v1/chat/completions, /v1/models). |
| Interfaz de Usuario | Rich & TUI interactiva | Menús interactivos, paneles y chat interactivo en consola. |
| Formato de Modelos | OpenVINO IR (INT4) | Representación intermedia cuantizada de baja memoria. |
| Distribución | Bash / Python venv | Script de instalación automática para Linux. |
El gestor incluye soporte directo para descarga y despliegue rápido de pesos optimizados en INT4:
# 1. Clonar el repositorio
git clone https://github.com/xtoxico/openvino-model-manager.git
cd openvino-model-manager
# 2. Ejecutar instalador automático
./install.sh
# 3. Lanzar interfaz
ovm
Una vez levantado el servidor local en http://127.0.0.1:8000/v1, cualquier cliente compatible con la API de OpenAI puede conectarse directamente.