¿Cómo agrego y descargo un modelo de IA?
Abra el panel de Ajustes de la aplicación y seleccione la pestaña Modelos. Haga clic en "+" para crear un perfil. Puede introducir un ID de repositorio de Hugging Face (por ejemplo, mlx-community/Qwen2.5-1.5B-Instruct-4bit) o seleccionar una carpeta local de pesos en su Mac. Haga clic en "Crear perfil" y cárguelo desde el menú flotante de la barra de menús.
¿Por qué la aplicación requiere acceso a la red?
LocalModel Bridge funciona 100% fuera de línea. El acceso de red de cliente solo se utiliza para consultar y descargar pesos de modelos desde el Hub de Hugging Face. El acceso de red de servidor se utiliza únicamente para alojar el servidor HTTP local compatible con OpenAI en el puerto elegido (por ejemplo, 8080) en su propia máquina (localhost).
¿Cómo realizo consultas a los modelos a través de Atajos?
LocalModel Bridge se integra de forma nativa con la aplicación Atajos (Shortcuts) de macOS. Abra Atajos, cree un nuevo flujo de trabajo y busque "LocalModelBridge" en la biblioteca de acciones. La acción principal "Consultar el modelo local" acepta un prompt y devuelve la respuesta de texto generada por el modelo en ejecución.
¿Cómo funciona el servidor API local?
En la pestaña General de Ajustes, puede activar "Habilitar servidor API HTTP local". Esto expone una API de completado compatible con OpenAI en http://localhost:8080/v1/chat/completions, lo que permite a las herramientas de desarrollo de terceros (como el editor Cursor) consultar sus modelos locales.
¿Cómo gestiona la aplicación la RAM de mi Mac?
Los modelos de lenguaje generativo (LLM) ocupan una cantidad significativa de RAM. Para evitar la ralentización del sistema, LocalModel Bridge descarga automáticamente los modelos de la memoria unificada de Apple Silicon tras un periodo de inactividad configurable y purga la caché de Metal del sistema.