Wie füge ich ein KI-Modell hinzu und lade es herunter?
Öffnen Sie die Einstellungen der App und wählen Sie den Tab „Modelle“ (Models). Klicken Sie auf das „+“ Symbol, um ein Profil zu erstellen. Sie können eine Hugging Face Repository-ID eingeben (z. B. mlx-community/Qwen2.5-1.5B-Instruct-4bit) oder einen lokalen Gewichtungsordner auf Ihrem Mac auswählen. Klicken Sie auf „Profil erstellen“ und laden Sie es über das Statusmenü in der Menüleiste.
Warum benötigt die Anwendung Netzwerkzugriff?
LocalModel Bridge arbeitet standardmäßig 100 % offline. Der Client-Netzwerkzugriff wird ausschließlich verwendet, um Modellgewichtungen vom Hugging Face Hub abzufragen und herunterzuladen. Der Server-Netzwerkzugriff dient ausschließlich dem Hosten des lokalen OpenAI-kompatiblen HTTP-Servers auf einem ausgewählten Port (z. B. 8080) auf Ihrer eigenen Maschine (localhost).
Wie frage ich Modelle über die Kurzbefehle-App ab?
LocalModel Bridge integriert sich nativ in die Apple Kurzbefehle-App (Shortcuts) unter macOS. Öffnen Sie die Kurzbefehle-App, erstellen Sie einen neuen Kurzbefehl und suchen Sie in der Aktionsbibliothek nach „LocalModelBridge“. Die Hauptaktion „Lokales Modell abfragen“ akzeptiert einen Prompt und gibt den vom laufenden Modell generierten Text zurück.
Wie funktioniert der lokale API-Server?
Im Allgemein-Tab (General) der Einstellungen können Sie „Lokalen HTTP-API-Server aktivieren“ einschalten. Dadurch wird eine OpenAI-kompatible Completion-API unter http://localhost:8080/v1/chat/completions bereitgestellt, so dass Entwicklungstools (wie z. B. der Cursor-Editor) Ihre lokalen Modelle abfragen können.
Wie verwaltet die App den RAM meines Mac?
Generative Sprachmodelle (LLMs) belegen erheblichen Arbeitsspeicher (RAM). Um Systemverlangsamungen zu vermeiden, entlädt LocalModel Bridge Modelle nach einer konfigurierbaren Inaktivitätsdauer automatisch aus dem gemeinsamen Apple-Silicon-Speicher und leert den Metal-Cache.