Mittelstufe 12 Min.LM Studio

LM Studio Bionic: Was ist das und wozu dient es ?

LM Studio Bionic ist die Agent-Anwendung, die LM Studio im Juli 2026 aus ihrer klassischen App getrennt hat. Während LM Studio „Historie“ sich auf Chat und API-Server konzentriert, bietet Bionic Agent-Projekte (Code und Work), Dokumentanalyse (PDF, Tabellenkalkulation, Word) sowie einen sprachbasierten Tastatur-Transkriptions-Modus Voxtral mit 100 % lokaler Transkription. Dieser Leitfaden beschreibt die App, erklärt, was auf Ihrem Gerät bleibt und was möglicherweise in den Cloud übergeht, sowie die wichtigsten Einstellungen.

Von Mohamed Meguedmi·Aktualisierung 2026-09-05·Unter Windows, macOS und Linux getestet
i
Kurz gesagt
LM Studio Bionic ist die Agent-App, die LM Studio im Juli 2026 aus der klassischen App ausgegliedert hat. · Sie ergänzt Code-Projekte (Entwicklung) und Work-Projekte (Analyse von PDF-, Excel- und Word-Dokumenten) sowie eine Voxtral-Spracheingabetastatur mit 100 % lokaler Transkription. · Ein Modell mit 7B bis 14B in Q4_K_M reicht aus, um den Agenten zu steuern (etwa 5 bis 9 GB VRAM). · Der device-Modus hält alles lokal; der cloud-Modus verlagert die Inferenz nach außen, wobei Daten das Gerät verlassen – vor der Verarbeitung sensibler Inhalte prüfen.

#Was ist LM Studio Bionic?

Bionic ist eine separate Anwendung, die vom selben Team wie LM Studio herausgegeben wird. Statt die bestehende Chat-App mit Agentenfunktionen zu überladen, hat sich der Anbieter für ein eigenständiges Produkt entschieden, bei dem „Dinge erledigen“ statt „diskutieren“ im Mittelpunkt steht. Die Idee: ein lokaler Agent, der Ihre Dateien lesen, Code in einem Projekt schreiben und einen dauerhaften Arbeitskontext beibehalten kann, ohne Ihre Daten standardmäßig an einen Drittanbieter zu senden.

Konkret bezeichnet das Stichwort lm studio bionic diese Agenten-App: Sie öffnen ein Projekt, geben ihr eine Aufgabe (einen Ordner mit PDFs analysieren, einen Codeabschnitt refaktorieren, eine Tabelle zusammenfassen), und das lokale Modell führt Schritte aus, indem es das Lesen von Dateien, Schlussfolgern und Schreiben miteinander verknüpft. Die Inferenz-Engine bleibt dieselbe, die Sie aus LM Studio kennen (llama.cpp / MLX unter der Haube), mit Ihren bereits heruntergeladenen GGUF- oder MLX-Modellen.

i
Separate App, gemeinsame Engine
Bionic ersetzt LM Studio nicht. Beide Apps können nebeneinander genutzt werden und teilen sich denselben Modellordner. Sie laden Ihre GGUF-Dateien weiterhin im klassischen LM Studio herunter; Bionic verwendet sie für seine agentischen Aufgaben.

#Bionic vs. klassisches LM Studio: Was ist der Unterschied?

Das Kit für lokale Agenten

Sie haben gerade einen Agenten im lokalen Betrieb gesehen. Das Kit für lokale Agenten zeigt Ihnen, wie Sie einen Agenten bauen, der tatsächlich handelt (Kap. 1), wie Sie ihm Grenzen setzen, bevor Sie ihn auf Ihre Dateien loslassen (Kap. 4), und wie Sie messen, ob er zuverlässig ist oder nur diesen Eindruck erweckt (Kap. 14).

  • Lebenslanger Online-Zugang
  • PDF + Dateien
  • Erstattung binnen 30 Tagen

Das häufigste Missverständnis besteht darin, Bionic für ein einfaches Update von LM Studio zu halten. Es handelt sich um zwei Apps mit unterschiedlichen Zielen. So können Sie entscheiden, welche für Sie passt.

LM Studio klassisch
Lokaler Chat, Verwaltung und Download von Modellen (GGUF/MLX von Hugging Face), OpenAI-kompatibler Server, MCP-Unterstützung. Das ist Ihr Modellhub und Ihr Inferenzserver.
Bionic
Agenten-App: persistente Projekte (Code und Work), Dokumentanalyse, Sprachtastatur Voxtral, Ausführung mehrstufiger Aufgaben. Auf Arbeitsergebnisse ausgerichtet, nicht auf Gespräche.
Gemeinsamkeit
Dasselbe Team, dieselbe lokale Inferenz-Engine, dieselbe Modellbibliothek. Sie können ein Modell über LM Studio bereitstellen und in Bionic arbeiten.
Wann welches verwenden
LM Studio zum Chatten, zum Testen eines Modells oder zum Bereitstellen einer API. Bionic, wenn Sie möchten, dass ein Agent Ihre Dateien liest und ein konkretes Ergebnis erzeugt.
→
Der richtige Ansatz
Wenn Sie sagen: „Ich möchte einem Modell Fragen stellen“, bleiben Sie bei der klassischen Version von LM Studio. Wenn Sie sagen: „Ich möchte, dass es mit MEINEN Dokumenten oder MEINEM Code arbeitet“, ist Bionic die richtige Wahl.

#Voraussetzungen und Installation

Bionic läuft auf den gleichen Plattformen wie LM Studio (Windows, macOS Apple Silicon, Linux). Die Hardware-Anforderungen hängen vor allem vom Modell ab, das Sie lokal ausführen, um den Agenten zu steuern.

Empfohlenes Modell für den Agenten
Ein Instruct-Modell mit 7B bis 14B Parametern in Q4_K_M reicht für die meisten Aufgaben aus. Rechnen Sie mit etwa 5 GB VRAM für ein 7B-Modell und etwa 9 GB für ein 14B-Modell.
Für anspruchsvolle Programmieraufgaben
Ein 32B-Modell (≈19 GB in Q4) oder ein MoE-Modell wie Qwen3 Coder liefert deutlich bessere Ergebnisse beim Schlussfolgern über mehrere Dateien hinweg.
Hardware zur Orientierung
RTX 3060 mit 12 GB oder RTX 4070 mit 12 GB für 7B- bis 14B-Modelle; RTX 4090 mit 24 GB oder Mac M4 Pro (24–48 GB gemeinsamer Speicher) für Modelle ab 32B.
Sprachtranskription
Die Voxtral-Tastatur läuft lokal mit einem kleinen Speech-to-Text-Modell; planen Sie dafür einige hundert MB bis 1–2 GB zusätzlichen Arbeitsspeicher ein.
  1. 01
    1. Bionic herunterladen
    Rufen Sie die offizielle Website von LM Studio (lmstudio.ai) auf und laden Sie den Bionic-Installer für Ihr Betriebssystem herunter. Dies ist ein separater Download, unabhängig von der klassischen App LM Studio.
  2. 02
    2. Den Pfad zu Ihren Modellen angeben
    Beim ersten Start erkennt Bionic den Modellordner von LM Studio. Wenn Sie bei null anfangen, laden Sie zunächst ein Instruct-Modell im klassischen LM Studio herunter und starten Sie Bionic anschließend erneut.
  3. 03
    3. Agent-Modell auswählen
    Wählen Sie in den Einstellungen von Bionic das lokale Modell aus, das die Projekte steuern soll. Beginnen Sie mit einem 7B–14B-Modell in Q4_K_M, um zu prüfen, ob alles läuft, bevor Sie zu leistungsfähigeren Modellen wechseln.
  4. 04
    4. Den Modus device überprüfen
    Belassen Sie die Inferenz standardmäßig im Modus device (lokal), um zu 100 % offline zu bleiben. Weiter unten erläutern wir device im Vergleich zu cloud genauer.

#Code-Projekte vs. Work-Projekte

Das Herzstück von Bionic sind die Projekte. Ein Projekt bündelt einen dauerhaft gespeicherten Arbeitskontext: Dateien, einen Aufgabenverlauf und ein an die Art der Arbeit angepasstes Verhalten des Agenten. Bionic unterscheidet zwei Kategorien.

Code-Projekt
Für die Softwareentwicklung konzipiert: Der Agent liest eine Codebasis, versteht die Verzeichnisstruktur, erstellt und ändert Dateien und führt Refactoring- oder Generierungsaufgaben aus. Das ist das lokale Gegenstück zu einem Coding-Agenten, ohne Ihr Repository in die Cloud zu senden.
Projekt Work
Auf Büroarbeit und Analyse ausgerichtet: Der Agent verarbeitet Dokumente (PDF, Word, Tabellenkalkulationen), erstellt Zusammenfassungen, extrahiert Daten und verfasst zusammenführende Darstellungen. Ideal für die laufende Informationsrecherche, die Vorbereitung von Dossiers oder die Analyse von Dokumenten.
Persistenter Kontext
Jedes Projekt behält seinen Verlauf und die zugehörigen Dateien. Sie können Bionic schließen und dort weitermachen, wo Sie aufgehört haben, ohne den Kontext bei jeder Sitzung erneut bereitstellen zu müssen.

Die Unterscheidung zwischen Code und Work ist nicht nur ästhetischer Natur: Sie verändert die Werkzeuge, die der Agent verwenden darf, und die Art, wie er seine Antworten strukturiert. Ein Code-Projekt legt den Schwerpunkt auf die Bearbeitung von Dateien und die Ausführung; ein Work-Projekt auf das Lesen, die Extraktion und das Verfassen von Texten.

→
Ein Projekt = ein Ziel
Vermeiden Sie ein Projekt, in dem alles zusammengeworfen wird. Ein Projekt pro Codebasis oder Dokumentenordner hält den Kontext sauber und verbessert die Relevanz der Ergebnisse des Agenten deutlich, besonders bei einem lokalen Modell von überschaubarer Größe.

#Dokumenten-, PDF- und Tabellenanalyse

Das ist der Vorteil von Work-Projekten. Sie ziehen Dateien in das Projekt, und der Agent liest sie, um Ihre Anfragen zu beantworten. Bionic unterstützt von Haus aus mehrere gängige Office-Dateiformate.

PDF
Extraktion des Textes (und der Struktur, wenn sie sauber aufgebaut ist), um mehrere Dokumente zusammenzufassen, Fragen dazu zu stellen oder sie zu vergleichen.
Tabellenkalkulationen
Lesen von Excel- oder CSV-Dateien: Der Agent kann die Spalten beschreiben, einfache Aggregationen berechnen, Abweichungen erkennen oder eine zahlenbasierte Zusammenfassung erstellen.
Word-Dokumente / Text
Zusammenfassungen, Umformulierungen, Extraktion von Schlüsselinformationen, Formatierung von Notizen.

Die Verarbeitung erfolgt durch das lokale Modell: Ihre Dokumente verlassen den Rechner nicht, solange Sie im Modus device bleiben. Das ist der wesentliche Unterschied zu einem Cloud-Assistenten – ein vertrauliches Dossier (Verträge, Personaldaten, Gesundheitsdaten) kann ohne Datenabfluss analysiert werden.

!
Auf das Kontextfenster achten
Eine große PDF-Datei oder eine umfangreiche Tabellenkalkulationsdatei kann das Kontextfenster eines 7B-Modells überschreiten. Wenn die Antworten inkonsistent werden, teilen Sie das Dokument auf, vergrößern Sie das Kontextfenster des Modells oder wechseln Sie zu einem Modell mit einem größeren Kontextfenster. Die Qualität der Analyse hängt direkt vom gewählten lokalen Modell ab.

#Sprachtastatur Voxtral: lokale Sprachtranskription

Bionic integriert eine Spracheingabetastatur auf Basis von Voxtral, einem lokal ausgeführten Spracherkennungsmodell. Sie diktieren Ihre Anfrage, die auf Ihrem Rechner in Text umgewandelt und anschließend an den Agenten gesendet wird. Es werden keine Audiodaten an einen Online-Transkriptionsdienst gesendet.

100 % lokal
Die Transkription erfolgt mit dem in den Speicher geladenen Voxtral-Modell. Ihre Stimme wird über keinen Server übertragen, sodass die Transkription auch für sensible Inhalte oder in einer Umgebung ohne Netzwerkverbindung genutzt werden kann.
Anwendungsfälle
Dem Agenten eine lange Anweisung diktieren, Sprachnotizen in einem Work-Projekt aufnehmen, eine Programmieraufgabe beschreiben, ohne die Hände von der physischen Tastatur zu nehmen.
Sprachen
Voxtral unterstützt unter anderem Französisch und Englisch; die Qualität hängt vom installierten Transkriptionsmodell und Ihrem Mikrofon ab.
i
Voxtral ≠ das Chat-Modell
Voxtral wandelt ausschließlich Sprache in Text um. Anschließend verarbeitet Ihr Agentenmodell (das von Ihnen gewählte 7B-/14B-/32B-Modell) den transkribierten Text. Beide Modelle befinden sich gleichzeitig im Speicher — berücksichtigen Sie das bei Ihrem VRAM-Budget.

#Device-Modus vs. Cloud-Modus: Was lokal bleibt

Bionic bietet zwei Inferenzmodi. Diese Einstellung zu verstehen ist am wichtigsten, um die Kontrolle über Ihre Daten zu behalten.

Geräte-Modus (lokale Nutzung)
Die Inferenz läuft auf Ihrem Rechner mit Ihren GGUF/MLX-Modellen. Nichts verlässt Ihren Rechner: weder Ihre Dateien noch Ihre Prompts noch Ihre Stimme. Diesen Modus sollten Sie für Self-Hosting im strengen Sinne bevorzugen.
Cloud-Modus
Die Inferenz wird auf eine entfernte Maschine verschoben, was nützlich ist, um Modelle zu betreiben, die zu groß für Ihr Hardware-Setup sind. Praktisch, aber Ihre Daten verlassen dann die Maschine – daher nur für nicht sensible Inhalte geeignet.
Projektbezogene Auswahl
Sie können ein vertrauliches Work-Projekt im Modus „device“ und ein weniger sensibles Code-Projekt im Modus „cloud“ belassen, wenn Sie ein leistungsfähigeres Modell benötigen. Prüfen Sie den aktiven Modus, bevor Sie sensible Dokumente laden.
!
Prüfen Sie den Modus, bevor Sie sensible Daten verwenden
Der Cloud-Modus verändert die Datenschutzlage. Bevor Sie einen Vertrag oder personenbezogene Daten in ein Projekt einfügen, stellen Sie sicher, dass Sie tatsächlich im Device-Modus sind. Dies ist die einzige Garantie, dass nichts online geht.

#Einstellungen, die zählen und lokale Abdrücke

Einige Parameter machen den Unterschied zwischen einem langsamen, frustrierenden Agenten und einem Agenten, der schnell reagiert und zuverlässig arbeitet.

Agent-Modell
Die wichtigste Entscheidung. Ist das Modell zu klein, verliert sich der Agent bei mehrstufigen Aufgaben; ist es zu groß, läuft er langsam. Ein 14B-Modell in Q4_K_M bietet für den Einstieg einen guten Kompromiss.
Kontextgröße
Erhöhen Sie sie, wenn Sie lange Dokumente analysieren, aber achten Sie auf den VRAM – ein größerer Kontext verbraucht mehr Speicher.
Quantization
Q4_K_M für ein ausgewogenes Verhältnis zwischen Geschwindigkeit und Qualität, Q5_K_M oder Q8_0, wenn Sie genügend VRAM haben und bei Code eine höhere Genauigkeit wünschen.
GPU-Offloading
Verlagern Sie für mehr Geschwindigkeit möglichst viele Schichten auf die GPU. Wenn das Modell nicht vollständig in den GPU-Speicher passt, wählen Sie eine niedrigere Quantisierungsstufe oder ein kleineres Modell, statt alles auf die CPU auszulagern.

Was lokal bleibt: Im Modus device läuft die gesamte Verarbeitungskette — Voxtral-Transkription, Lesen Ihrer Dateien, Inferenz des Agenten — auf Ihrem Rechner. Bionic bleibt dem Ansatz von LM Studio treu: Ihre Modelle, Ihre Daten, Ihre Hardware.


#Fehlerbehebung

Bionic sieht meine Modelle nicht
Stellen Sie sicher, dass das Modellordner auf den von LM Studio angegebenen Ordner zeigt. Laden Sie mindestens ein instruct-Modell im LM Studio klassischen Format herunter und starten Sie Bionic neu.
Der Agent ist sehr langsam
Das Modell ist zu groß für Ihren VRAM: Es wird auf die CPU ausgelagert. Wählen Sie eine kleinere Modellgröße (32B → 14B) oder eine niedrigere Quantisierungsstufe (Q8 → Q4_K_M).
Inkonsistente Antworten bei einem großen Dokument
Das Dokument ist länger als das Kontextfenster. Teilen Sie es auf, erhöhen Sie die Kontextlänge oder wählen Sie ein Modell mit einem größeren Kontextfenster.
Die Spracheingabe wird nicht gestartet
Prüfen Sie die Mikrofonberechtigungen des Betriebssystems und stellen Sie sicher, dass das Voxtral-Modell installiert ist. Die lokale Transkription benötigt zusätzlich zu dem vom Agentenmodell belegten Speicher freien Speicher.
Zweifel an der Vertraulichkeit
Öffnen Sie die Einstellungen und vergewissern Sie sich, dass der Modus device aktiv ist. Im Cloud-Modus werden Prompts und Dateien an entfernte Server gesendet.

#Weiterführende Informationen

Bionic baut auf dem Ökosystem von LM Studio auf. Diese Anleitungen ergänzen die ersten Schritte und helfen Ihnen, das passende Modell zur Steuerung Ihrer Agenten auszuwählen.

Gut mit LM Studio starten
„LM Studio im Jahr 2026: vollständiges Tutorial“ — die klassische App installieren, Modelle herunterladen und die GPU konfigurieren, als unverzichtbare Grundlage vor Bionic.
Quantisierung wählen
„Die Quantisierung wählen (Q4, Q5, Q8, FP16)“ — um den Kompromiss zwischen Geschwindigkeit und Qualität Ihres Agentenmodells einzustellen.
Lokales RAG
„Lokales RAG mit LM Studio: mit Ihren Dokumenten chatten“ – um die Dokumentenanalyse über Work-Projekte hinaus zu vertiefen.
Hat Ihnen dieser Guide geholfen?

Haben Sie Feedback, einen Fehler entdeckt oder möchten Sie etwas präzisieren? Geben Sie uns Bescheid – so wird der Guide für alle besser.