Comment puis-je ajouter et télécharger un modèle IA ?
Allez dans les Réglages de l'application, onglet Modèles. Cliquez sur "+" pour ajouter un profil. Vous pouvez y renseigner un identifiant de dépôt public Hugging Face (par exemple mlx-community/Qwen2.5-1.5B-Instruct-4bit) ou sélectionner un répertoire local contenant les poids au format MLX. Cliquez ensuite sur "Créer le profil" puis chargez le modèle depuis le menu de la barre des menus.
Pourquoi l'application a-t-elle besoin d'un accès réseau ?
LocalModel Bridge fonctionne de manière autonome et hors-ligne. L'accès réseau client est utilisé uniquement lorsque vous demandez explicitement le téléchargement de modèles du Hugging Face Hub. L'accès réseau serveur sert uniquement à héberger le serveur HTTP compatible OpenAI sur le port local choisi (ex: 8080) sur votre propre machine (localhost).
Comment interroger le modèle via l'application Raccourcis ?
LocalModel Bridge s'intègre nativement à l'application Raccourcis de macOS. Ouvrez Raccourcis, créez un nouveau raccourci, et recherchez "LocalModelBridge" dans la bibliothèque d'actions. L'action principale "Interroger le modèle local" prend votre prompt en entrée et retourne le texte généré par le modèle en cours d'exécution.
Comment fonctionne le serveur API local ?
Dans l'onglet Général des Réglages, vous pouvez activer le serveur HTTP local. Une fois activé, il expose une API compatible avec les spécifications de complétion d'OpenAI sur http://localhost:8080/v1/chat/completions. Cela vous permet d'intégrer vos modèles locaux dans vos outils de développement tiers (comme l'éditeur Cursor).
Comment l'application gère-t-elle la RAM de mon Mac ?
Les modèles de langage (LLM) chargent d'importantes données en mémoire vive (RAM). Pour préserver les performances de votre Mac, LocalModel Bridge décharge automatiquement les modèles de la mémoire unifiée après un délai d'inactivité configurable et purge le cache Metal de macOS.