Der Referenzleitfaden · 16 Kapitel · inklusive Assets · Updates für immer

Ihr Mac auf Hochtouren
für lokale KI

Hinweis: Die Kits (PDF und Online-Bereich) sind auf Französisch verfasst. Kauf und Zahlung erfolgen auf QuelLLM.fr.

Das Mac-Kit : DER maßgebliche Leitfaden, um lokale KI auf Apple Silicon voll auszuschöpfen — vereinheitlichter Speicher, MLX im Vergleich zu GGUF, das richtige Modell für IHREN Chip (M1 bis M5/M6) und alles, was macOS zusätzlich bietet. Für einen gerade erst gekauften Mac ebenso wie für einen Mac von 2020, dessen Leistung noch nie voll ausgeschöpft wurde.

Kit erhalten — 24 €

24 € · Einmalzahlung · lebenslange Updates inklusive

✓ Sofortiger Zugriff (online + PDF) ✓ Sichere Zahlung über Stripe ✓ Fortlaufend aktualisierte Ausgabe (lebenslange Updates)

Die 16 Kapitel ansehen →

Was ist das Mac-Kit?

Das Mac-Set ist ein Referenzhandbuch mit 16 Kapiteln, 21 Asset-Dateien und lebenslangem Zugang zu einem Online-Bereich. Es richtet sich an Nutzer von Macs mit Apple Silicon (Chips von M1 bis M5/M6, 8 bis 512 GB gemeinsam genutzter Speicher) und orientiert sich an drei Referenzprofilen vom MacBook Air mit 16 GB bis zum Mac Studio mit 64 GB. Ergebnis: ein erstes LLM mit Metal-Beschleunigung in weniger als einer Stunde, anschließend die volle Nutzung des gemeinsam genutzten Speichers und von MLX.

  • 16 Kapitel und 21 Asset-Dateien: Haupttabelle, launchd-Skripte, Kurzbefehle.
  • Deckt die Chips M1 bis M5/M6 mit 8 bis 512 GB gemeinsamem Arbeitsspeicher ab.
  • Referenzkonfigurationen: MacBook Air M2 16 GB, Mac mini M4 24 GB, Studio 64 GB.
  • Abgedeckte Tools: LM Studio (MLX), Ollama, Open WebUI und mlx-lm.
  • Erstes LLM mit aktiver Metal-Beschleunigung in weniger als einer Stunde zum Laufen gebracht.
  • 24 € als einmalige Zahlung, lebenslange Updates inklusive.
Cover des Mac-Kits – Mac

✓ Für Sie, wenn…

Sie besitzen einen Mac mit Apple Silicon (MacBook Air/Pro, Mac mini, Mac Studio, iMac – Chip M1 bis M5/M6) und möchten verstehen und nutzen, was ihn für lokale KI auszeichnet: seinen vereinheitlichten Speicher, MLX, das richtige Modell für Ihren konkreten Chip und die tatsächliche Leistung – ob Sie gerade erst anfangen oder bereits Ollama/LM Studio betreiben, ohne sicher zu sein, dass Sie das Maximum herausholen.

✗ Nicht für Sie, wenn…

Sie nutzen einen PC oder Linux (dafür gibt es das lokale KI-Kit für mehrere Betriebssysteme) oder suchen einen Copiloten, der in Ihrem Editor programmiert (dafür gibt es das lokale Copilot-Kit, mit nur einem Verweis auf Xcode in diesem Kit und keinesfalls einem eigenen Kapitel dazu).

24 € Einmalige Zahlung · lebenslange Updates inklusive Exklusiv für Mac — Apple Silicon (M1 bis M5/M6), 8 bis 512 GB an gemeinsamem Speicher abgedeckt.

Warum Sie sich darauf verlassen können

Verfasst und gepflegt wird dieser Guide von dem Team von QuelLLM.fr — 253 indexierte Modelle, 341 Anleitungen, jeden Morgen aktualisiert — das auch das ganze Jahr über KI-Plattformen im Produktivbetrieb betreibt (RegulIA, IAPRO). Jeder Befehl, jedes Modell, jede Version und jeder Preis in diesem Leitfaden wird zum Zeitpunkt der jeweiligen Ausgabe anhand der offiziellen Quelle (Apple, Ollama, LM Studio, Hugging Face) überprüft und bei jeder Ausgabe erneut auf den Maschinenkonfigurationen geprüft, die wir selbst verwenden. Was Sie lesen, ist kompakt, überprüft und direkt auf den Punkt gebracht. Keine Zusammenstellung zufällig gefundener Tutorials. Wer steckt hinter QuelLLM →

Das Problem

Ein Mac mit Apple Silicon ist nicht nur ein PC mit einem Logo für lokale KI: einheitlicher Speicher, der mit der GPU geteilt wird, MLX im Vergleich zu GGUF und ein standardmäßiges Speicherlimit, das sich mit dem nötigen Wissen anheben lässt – die meisten Anleitungen behandeln Ihren Mac wie jeden anderen Rechner, und Sie nutzen nur die Hälfte seiner Kapazität.

Die Informationen zum Mac sind bereits vorhanden, verteilt auf 21 kostenlose Leitfäden auf der Website — einen pro Gerät, einen für MLX und einen für den gemeinsamen Arbeitsspeicher. Das Set ist DIE Referenzmethode: die Tabelle der Modelle nach Chip UND RAM-Stufe an einem Ort, die launchd- und Kurzbefehle-Skripte zum direkten Einfügen, die Methode zum Messen Ihrer eigenen Performance – keine Sammlung von Tutorials, die Sie selbst abgleichen müssen.

MLX natif im Vergleich zu GGUF auf Ihrem Mac

Dasselbe Modell, zwei Formate – die Entscheidung, die in den bestehenden kostenlosen Leitfäden am schlechtesten erklärt wird. Der ehrliche Vergleich:

MLX (Apple)GGUF (llama.cpp/Ollama)
Von Grund auf für vereinheitlichten Speicher konzipiertJaKompatibel, nicht nativ
Verfügbarkeit der ModelleEin guter Teil, aber nicht allesNahezu die Gesamtheit
Multi-OS-Kompatibilität (PC, Linux)Nein — ausschließlich Apple SiliconJa
Wechsel zu LM StudioEine GUI-EinstellungEine GUI-Einstellung
Kommandozeile (mlx-lm)Optional, zur VertiefungNative Ollama-CLI

Das Toolkit erklärt, in welchen Fällen MLX einen echten Vorteil bietet und in welchen Fällen GGUF weiterhin die richtige Wahl ist (Modell nicht in MLX verfügbar, Bedarf an Kompatibilität mit mehreren Betriebssystemen) – kein Dogma, sondern eine Methode.

Was Sie erhalten

Tools: LM Studio (MLX), Ollama, Open WebUI, mlx-lm. Ausschließlich für Macs mit Apple Silicon, 0 €/Monat nach der Installation.

Die 16 Kapitel des Kits

Von dem ersten 100 % Metal-LLM innerhalb einer Stunde bis zum Verkaufspreis 2026. Kein Sprung überschritten: Jeder Abschnitt verweist auf die folgenden.

Teil 1 — Der Mac, eine besondere Architektur für die lokale KI
  • Ihr erster LLM, zu 100 % mit Metal, in einer Stunde
  • Unified Memory: Was sich dadurch wirklich ändert (und wie Sie das GPU-Speicherlimit erzwingen)
  • MLX oder GGUF: Was wählen und wann spielt das eine Rolle?
  • Die Referenztabelle: Welches Modell für WELCHEN Chip und wie viel RAM
Teil 2 — Installieren, Konfigurieren, Messen
  • Quantisierung und langer Kontext: das tatsächliche Speicherbudget berechnen
  • Leistung in der Praxis: Tokens pro Sekunde, Prefill, Wärmeentwicklung, Akku
  • Ollama als Dienst: automatischer Start, Netzwerk, Logs (launchd)
  • Open WebUI auf Mac: Docker Desktop, OrbStack oder nativ
Teil 3 — Was man damit auf einem Mac macht
  • Lokale Bildverarbeitung, nativ durch Metal beschleunigt
  • Französische und englische Modelle: Was wirklich gut auf Apple Silicon funktioniert
  • Kurzbefehle, Automator, Spotlight: lokale KI in macOS
  • Ihr Mac mini als KI-Server für das ganze Haus
Teil 4 — Zuverlässiger machen, auswählen, langfristig nutzen
  • Datenschutz: iCloud, Spotlight, Telemetrie — was wirklich lokal bleibt
  • Wenn es auf dem Mac nicht funktioniert: Metal, Speicher, Swap
  • Welchen Mac 2026 für lokale KI kaufen?
  • Diese Edition ist veraltet — und danach?

Fortlaufend aktualisierte Ausgabe: Jede Aktualisierung erweitert dieses Inhaltsverzeichnis (datiertes Update-Log, Kap. 16) — Sie müssen die nächste Version nicht erneut kaufen.

Ihr erster LLM, zu 100 % mit Metal, in eine Stunde, schrittweise

Ob Sie bei null anfangen oder bereits ein Tool installiert haben, der Leitfaden begleitet Sie Schritt für Schritt bis zu einem konkreten Ergebnis:

1 · LM Studio oder Ollama

2 Befehle, wenn Sie bei null anfangen (Verweis auf das vollständige Kit für lokale KI), andernfalls geht es direkt weiter.

2 · Prüfen Sie, ob Metal läuft

Die Aktivitätsanzeige (Registerkarte GPU) muss zeigen, dass die GPU arbeitet — ohne unbemerkten Rückfall auf die CPU.

3 · Das passende Modell für Ihren Chip

Die Tabelle in Kapitel 4 zeigt Ihnen, welche Option zu Ihrem Chip und Ihrem Unified Memory passt — Sie müssen nicht raten.

4 · Weitere Schritte

Gemeinsamer Arbeitsspeicher, MLX, launchd, Kurzbefehle — all das wird in den folgenden Kapiteln behandelt.

24 €
Einmalzahlung · lebenslange Updates inklusive
Einmal kaufen und deinen Mac voll ausnutzen – heute und mit jeder neuen Generation von Apple-Chips. Danach dauerhaft 0 €/Monat.
  • Lebenslanger Zugang zum Online-Bereich: 16 stets aktuelle Kapitel (vollständiges Inhaltsverzeichnis weiter oben)
  • Der PDF-Leitfaden + die 21 Asset-Dateien (Mastertabelle, Skripte für launchd/Kurzbefehle, Checklisten) zum Herunterladen
  • Die 3 Referenzprofile (Air, mini, Studio) und der Entscheidungsbaum zur Fehlerbehebung bei Metal, Speicher und Swap
  • Alle zukünftigen Ausgaben, lebenslang – sie erscheinen in Ihrem Bereich
  • Sofortiger Zugriff nach Zahlung, Zugangscode per E-Mail gesendet
Alle Anwendungsfälle, ein Kauf

8 verfügbare Kits plus zukünftige Kits. PDFs, Assets und Online-Bereich, lebenslange Updates.

Alle Kits auswählen — 49 € →
Ich nehme das Kit — 24 €

Sichere Zahlung über Stripe. PDF-Rechnung wird automatisch versendet · Umsatzsteuer nicht anwendbar gemäß Art. 293 B des CGI.

Ich nehme das Kit — 24 €

La ungeschönte Wahrheit

Ein Mac mit Apple Silicon hat echte Stärken für lokale KI – und echte Grenzen, die keine Tabelle mit Chipdaten beseitigen kann. Ein Referenzleitfaden schuldet Ihnen diesen ehrlichen Überblick:

Der Mac gewinntmit der GPU geteilter vereinheitlichter Speicher (kein separater VRAM, der überdimensioniert werden müsste) · leiser Betrieb und geringer Energieverbrauch · MLX auf die Architektur zugeschnitten · das gesamte macOS steht zur Verfügung (Kurzbefehle, launchd, Spotlight)
Wo es haktnicht alle Modelle sind im MLX-Format verfügbar · der Arbeitsspeicher lässt sich nach dem Kauf nicht erweitern (anders als bei einer dedizierten GPU-Karte) · tatsächliche thermische Drosselung auf einem MacBook ohne Lüfter bei kontinuierlicher Generierung

Am Ende können Sie Folgendes:

Ausgabe vivante — wie alle QuelLLM-Kits

„Lebenslange Updates“ ist kein Slogan: Die Apple-Hardware ändert sich zweimal im Jahr, MLX entwickelt sich schnell weiter – das Kit hält für Sie mit dem Ökosystem Schritt, ohne dass Sie erneut etwas bezahlen müssen.

CHANGELOG.md — im Paket enthalten

v2026.09 (aktuelle Ausgabe) — erste Ausgabe des Kits: 16 Kapitel, 3 Referenzkonfigurationen (MacBook Air M2 16 GB, Mac mini M4 24 GB, Mac Studio M4 Max 64 GB), 21 Asset-Dateien, zentrale Zuordnungstabelle GB→Modell nach Chip.

Die kommenden Ausgaben (neue Apple-Chips, neue Modelle, die Weiterentwicklung von MLX) werden hier mit Datum ergänzt und stehen Ihnen in Ihrem persönlichen Bereich zur Verfügung, ohne dass Sie erneut bezahlen müssen.

Häufige Fragen

Wie unterscheidet sich das von dem lokalen KI-Kit?

Das lokale KI-Kit installiert Ihnen einen privaten KI-Assistenten auf einem Mac ODER einem PC und richtet sich an ein breites Publikum mit unterschiedlichen Betriebssystemen – es bleibt bewusst allgemein. Dieses Kit setzt voraus, dass bereits ein Mac zum Einsatz kommt, und behandelt alles, was spezifisch für Apple Silicon ist, im Detail: den vereinheitlichten Speicher und dessen GPU-Limit, MLX im Vergleich zu GGUF, die Modelltabelle nach Chip UND RAM-Stufe (M1 bis M5/M6, 8 bis 512 GB), die Methode zur Messung Ihrer eigenen tatsächlichen Leistung und die zusätzlichen Möglichkeiten von macOS (Kurzbefehle, launchd, Spotlight, Apple Intelligence). Die beiden Kits ergänzen sich und überschneiden sich nicht.

Funktioniert das nur auf Macs mit Apple Silicon?

Ja, ausschließlich — ein Mac mit einem Chip von M1 bis M5/M6 (MacBook Air, MacBook Pro, Mac mini, Mac Studio, iMac). Ein Intel-Mac hat weder vereinheitlichten Arbeitsspeicher noch MLX; der Großteil des Kits ist darauf nicht anwendbar. Wenn Sie einen PC nutzen (oder noch nicht wissen, welchen Mac Sie kaufen sollen), beginnen Sie mit dem Kit für lokale KI oder mit Kapitel 15 dieses Kits (Entscheidungsmatrix für den Kauf, ohne Händlerlink).

Muss man Entwickler sein, um dieses Kit zu nutzen?

Nein. Das Kit setzt voraus, dass Sie eine App installieren und eine Datei per Drag-and-drop verschieben können – Terminalbefehle (gemeinsamer Speicher in Kap. 2, launchd in Kap. 7) werden bei ihrem ersten Auftreten erklärt; ihre Kenntnis wird nie vorausgesetzt. Manche Abschnitte gehen über das Niveau für ein breites Publikum hinaus (mlx-lm in der Kommandozeile) – immer als „weiterführend“ beschrieben, niemals als Voraussetzung für die Fortsetzung.

Wie lange dauert es, bis ein Ergebnis vorliegt?

Ihr erstes LLM mit aktivierter Metal-Beschleunigung in weniger als einer Stunde — ob Sie bei null anfangen (2 Befehle, Verweis auf das lokale KI-Kit für die vollständige Installation) oder bereits LM Studio/Ollama haben und nur prüfen möchten, ob tatsächlich Metal zum Einsatz kommt und nicht unbemerkt auf die CPU zurückgegriffen wird.

Wie unterscheidet sich das von den kostenlosen Mac-Guides auf der Website?

Die kostenlosen Anleitungen von QuelLLM.fr behandeln jeden Rechner oder jedes Thema einzeln (eine Anleitung pro Mac, MLX vs. llama.cpp auf der einen Seite, Speicheroptimierung auf der anderen). Das Set bündelt den gesamten Ablauf und liefert eine Tabelle der Modelle nach Chip × RAM, die keine einzelne Anleitung aktuell und vollständig bietet, sowie fertige Skripte für launchd und Kurzbefehle zum Einfügen. Außerdem wird es angesichts der Apple-Hardware, die sich zweimal im Jahr ändert, lebenslang aktuell gehalten — bezahlt werden die Zusammenstellung und die Materialien, nicht die reinen Informationen.

Ist es nach der Installation wirklich kostenlos?

Ja: Das Modell läuft auf Ihrem Rechner, für 0 €/Monat, ohne Konto und ohne Limits. Das Kit selbst (Anleitung + Assets + lebenslanger Zugang zum Online-Bereich) ist ein einmaliger Kauf.

Kann ich wirklich einen KI-Server mit meinem Mac mini aufbauen?

Ja, Kapitel 12 behandelt genau das: den Ruhezustand verhindern, Ollama als echten Dienst betreiben (launchd, Kap. 7), der auch nach einem Neustart läuft, und von den anderen Geräten im Haushalt darauf zugreifen – mit einer ehrlichen Darstellung der Möglichkeiten für den Fernzugriff (ein persönliches VPN wie Tailscale), ohne dies als Sicherheitscheckliste für Unternehmen auszugeben.

Bleiben meine Gespräche und meine Modelle auf meinem Mac privat?

Das ist das Prinzip des lokalen Betriebs – sobald das Modell geladen ist, werden keine Daten mehr nach außen übertragen. Kapitel 13 geht über die allgemeine Checkliste hinaus: Es prüft gezielt, dass iCloud Drive Ihren Ordner mit Modellen oder Gesprächen nicht unbemerkt synchronisiert, und was Spotlight im Umfeld dieser Ordner indexiert.

Wie wird es bereitgestellt, und wie lange haben Sie Zugriff darauf?

Sofortiger Zugriff nach der Zahlung: lebenslanger Zugang zu Ihrem Online-Bereich (immer mit der neuesten Ausgabe) + das PDF und die ZIP-Datei mit den Assets zum Herunterladen, die Sie dauerhaft behalten können. Künftige Updates (neue Apple-Chips, neue Modelle) erscheinen in Ihrem Bereich, ohne dass Sie erneut bezahlen müssen.

Kann ich eine Rechnung erhalten?

Ja, automatisch. Sobald die Zahlung (Stripe) erfolgt ist, erhalten Sie per E-Mail Ihre Stripe-Quittung und Ihre PDF-Rechnung auf den Namen von Falcon Consulting (Herausgeber von QuelLLM) an Ihre angegebenen Kontaktdaten – geben Sie im vorgesehenen Feld zum Zeitpunkt der Zahlung Ihr Unternehmen oder Ihre SIREN-Nummer an. Keine Mehrwertsteuer, Art. 293 B des CGI.

Und wenn ich mehrere QuelLLM-Kits möchte?

Das Bundle „Alle Kits, lebenslang“ umfasst alle aktuellen und zukünftigen Kits für 49 €. Wenn Sie bereits ein Kit für 24 € gekauft haben, kostet das Upgrade auf das Bundle 25 €, nicht 49 € — der Coupon wird automatisch angewendet.

Was ist MLX auf dem Mac?

MLX ist Apples Framework für Berechnungen, das von Anfang an für den gemeinsamen Speicher der Apple-Silicon-Chips konzipiert wurde – im Gegensatz zu GGUF (llama.cpp/Ollama), das zwar kompatibel, aber nicht nativ ist. Das Mac-Kit erklärt, in welchen Fällen MLX einen echten Leistungsgewinn bringt und wann GGUF weiterhin die richtige Wahl ist (Modell nicht für MLX verfügbar, Nutzung unter mehreren Betriebssystemen erforderlich).

Funktioniert Ollama auf dem Mac gut?

Ja, nativ und mit der Metal-Beschleunigung der GPU – neben LM Studio ist Ollama einer der beiden möglichen Wege, ein LLM auf Apple Silicon auszuführen. Das Mac-Kit geht über die Basisinstallation hinaus: überprüfen, ob Metal tatsächlich genutzt wird (ohne unbemerkt auf die CPU auszuweichen), und Ollama über launchd als echten Dienst betreiben.

Welches KI-Modell sollten Sie auf dem Mac wählen?

Das hängt von Ihrem Chip und Ihrem gemeinsamen Arbeitsspeicher ab, nicht von einer allgemeingültigen Regel – für einen Mac mit 16 GB kommt nicht dasselbe Modell infrage wie für einen Mac Studio mit 64 GB. Das Mac-Kit bietet eine Referenztabelle, die jeden Chip (M1 bis M5/M6) und jede RAM-Stufe dem passenden Modell und Format (MLX oder GGUF) zuordnet.

Nutzen Sie Ihren Mac voll aus.

Der Referenzleitfaden – von Ihrem ersten LLM mit Metal-Beschleunigung bis zum KI-Server für die Familie auf Ihrem Mac mini: gemeinsamer Speicher, MLX, das passende Modell für Ihren Chip. Heute, nicht „irgendwann“.

Kit erhalten — 24 €