Mittelstufe 13 minPrompting

Systeme beherrschen prompts

Direkte Antwort

Ein Systemprompt ist eine Nachricht mit der Rolle „system“, die vor Ihrer ersten Frage die Identität, die Aufgabe, die Regeln, den Stil und das Ausgabeformat eines LLM festlegt. Zum Verfassen: fünf kurze Blöcke, überprüfbare Anweisungen im Imperativ und ein Test mit einigen Fangfragen. Er beansprucht Platz im Kontext und ist kein Tresor: Hinterlegen Sie darin keine Geheimnisse.

Ein Systemprompt ist das Briefing, das das Modell vor der ersten Frage erhält. Gut formuliert macht er ein lokales LLM konsistent und vorhersehbar; schlecht formuliert verschwendet er Kontext und widerspricht sich selbst. Sie lernen, ihn zu strukturieren, in Ollama, LM Studio oder über eine API einzurichten, ihn systematisch zu testen und seine Grenzen zu kennen, insbesondere hinsichtlich der Vertraulichkeit.

Von Mohamed Meguedmi·Aktualisierung 2026-09-30·Unter Windows, macOS und Linux getestet

#Was ist ein System-Prompt und wie schreibt man ihn?

Ein System-Prompt ist die Nachricht mit der Rolle „system“, die am Anfang der Unterhaltung steht: Er legt die Identität des Modells, seine Aufgabe, seine Regeln, seinen Stil und das Format seiner Antworten fest, bevor Sie die erste Frage stellen. Das Modell liest ihn bei jeder Gesprächsrunde erneut, ebenso wie den Gesprächsverlauf. Verwenden Sie beim Schreiben fünf kurze Blöcke (Identität, Aufgabe, verbindliche Regeln, Stil, Ausgabeformat), formulieren Sie überprüfbare Anweisungen im Imperativ und testen Sie ihn anschließend mit einigen Fangfragen. Ein System-Prompt steuert das Verhalten; er ist weder eine Sicherheitsbarriere noch ein Tresor für Ihre Geheimnisse und beansprucht einen Teil des Kontextfensters Ihres lokalen Modells. Dieser Leitfaden erläutert jeden Punkt mit Beispielen, die Sie direkt in Ollama, LM Studio oder eine OpenAI-kompatible API einfügen können.

Ein LLM erhält in der Regel drei Arten von Nachrichten: system (der dauerhafte Rahmen), user (das, was Sie eingeben) und assistant (das, was es bereits geantwortet hat). Der Chat-Client sendet bei jeder Anfrage die gesamte Unterhaltung erneut an das Modell, einschließlich der system-Nachricht. Dadurch entsteht während der Sitzung der Eindruck einer stabilen „Persönlichkeit“.

i
Analogie
Ein Systemprompt ist für ein LLM das, was eine Stellenbeschreibung für eine Zeitarbeitskraft ist. Ohne diese Orientierung gibt es sein Bestes. Mit ihr weiß es, was von ihm erwartet wird, was ihm untersagt ist und in welcher Form es seine Arbeit abliefern soll.

Die Modellanbieter beschreiben denselben Einsatz. Die Dokumentation von Anthropic erklärt, dass eine Rolle im System-Prompt das Verhalten und den Ton des Modells gezielt ausrichtet und dass bereits ein einziger Satz einen Unterschied machen kann. Das Prinzip gilt auch für lokale Modelle: Die dauerhafte Anweisung gehört in die system-Nachricht, die aktuelle Frage in die user-Nachricht.

#Was ein guter System-Prompt wirklich verändert

Das Kit Lokale KI

Ihr privates, kostenloses ChatGPT auf Ihrem Rechner in einer Stunde – mit LM Studio, Ollama, Open WebUI und Ihren Dokumenten, ganz ohne Cloud.

  • Lebenslanger Online-Zugang
  • PDF + Dateien
  • Lebenslange Updates
Konsistenter Ton
Ein Assistent, der in der ersten Nachricht duzt und in der zweiten siezt, verrät einen fehlenden oder zu vagen Systemprompt. Die Anrede einmal festzulegen verhindert solche Abweichungen.
Stabilere Vorgaben
Verbote („keine Emojis“) und Vorgaben („Quelle nennen“) werden zuverlässiger eingehalten, wenn sie im System-Prompt festgelegt werden, statt sie während der Interaktion immer wieder zu wiederholen. Ihre Einhaltung ist jedoch nie garantiert: Je kleiner das Modell, desto genauer müssen Sie prüfen.
Weniger Wiederholungen
Wenn Sie bei jeder Frage „Antworte in formellem Französisch“ eingeben, hinterlegen Sie diese Anweisung einmal im System-Prompt. So vergessen Sie sie seltener und müssen weniger tippen.
Aufgabenbereich
„Behandle nur das französische Arbeitsrecht“ reduziert thematische Abschweifungen, schließt sie aber niemals mit Sicherheit aus.

Was der System-Prompt nicht tut: Er fügt dem Modell kein Wissen hinzu und ersetzt weder ein im Gespräch bereitgestelltes Dokument noch ein RAG. Wenn sich das Modell auf Ihre Verträge stützen soll, liefert die Dokumentensuche die Fakten; der System-Prompt legt lediglich fest, wie diese verwendet und zitiert werden sollen.

#Was es kostet: Platz im Kontextfenster

Der Systemprompt ist nicht kostenlos: Seine Tokens belegen das Kontextfenster zusammen mit dem Gesprächsverlauf, Ihren Dokumenten und der noch zu erzeugenden Antwort. Auf einem lokalen Rechner ist dieses Fenster oft kleiner, als man denkt. Die Seite „Context length“ in der Ollama-Dokumentation gibt ein standardmäßiges Kontextfenster von etwa 4.000 Tokens („4k“) bei weniger als 24 GiB VRAM an, 32.000 zwischen 24 und 48 GiB und 256.000 darüber. Ein Prompt mit 400 Tokens beansprucht daher fast 10 % von 4.096 Tokens, noch vor dem ersten Austausch.

Die Rechnung ist einfach: verfügbare Fenstergröße = gesamte Fenstergröße − Tokens des System-Prompts − Tokens der erwarteten Antwort. Bei 4.096 Tokens, einem System-Prompt mit 400 Tokens und einer Antwort mit 800 Tokens bleiben 2.896 Tokens für den Gesprächsverlauf und die Dokumente übrig. Wenn der Austausch länger wird, füllt sich das Fenster und ältere Inhalte passen möglicherweise nicht mehr hinein: ein weiterer Grund, das Briefing informationsreich statt lang zu halten.

Es gibt einen zweiten, durch die Forschung dokumentierten Effekt: In der Studie „Lost in the Middle“ (Liu et al., 2023) ist die Leistung oft besser, wenn sich die relevante Information am Anfang oder am Ende des Kontexts befindet, und schlechter, wenn sie in der Mitte steht – selbst bei Modellen, die mit langem Kontext beworben werden. Praktische Konsequenz: Platzieren Sie die wichtigsten Regeln am Anfang Ihres Systemprompts und wiederholen Sie die entscheidende Vorgabe in der letzten Zeile, wenn Sie feststellen, dass Vorgaben vergessen werden.

→
Die Fenstergröße bei Bedarf erhöhen
Wenn Ihr System-Prompt mehr als einige hundert Tokens umfasst oder Sie Dokumente anhängen, vergrößern Sie das Kontextfenster, statt blind zu kürzen: mit PARAMETER num_ctx in einem Modelfile oder der Variablen OLLAMA_CONTEXT_LENGTH beim Start des Servers. Ein größeres Kontextfenster benötigt mehr Grafikspeicher; der Leitfaden zum Kontextfenster erläutert die Abwägung.

#Struktur eines soliden Systemprompts in fünf Blöcken

Ein guter Systemprompt passt in fünf kurze Blöcke. Sie müssen keinen Roman schreiben: Jeder zusätzliche Satz verbraucht Kontext und erhöht das Risiko widersprüchlicher Anweisungen. Die Tabelle fasst zusammen, was jeder Block enthält und welcher Fehler dabei am häufigsten vorkommt.

Die fünf Blöcke eines Systemprompts
BlockFrage, auf die er antwortetBeispielHäufiger Fehler
IdentitätWer ist das Modell?„Du bist Lex, juristischer Assistent im französischen Arbeitsrecht.“Eine schmeichelhafte Identität („weltweiter Experte“) ohne klar umrissenen Aufgabenbereich
AufgabeWas soll es tun, für wen?„Du hilfst einem Personalleiter, seine Pflichten zu verstehen und Schreiben zu verfassen.“Zu breite Aufgabe: „Hilfe zu allem“
Verbindliche RegelnWas macht er immer oder niemals?„Zitieren Sie den betreffenden Artikel des Code du travail.“Zehn Regeln gleicher Priorität, wobei zwei sich widersprechen
StilWie drückt es sich aus?„Kurze Sätze, leicht verständlicher Wortschatz.“Vage Adjektive („professionell“) ohne Beispiel
AusgabeformatIn welcher Form gibt er die Antwort zurück?„Standardmäßig: ein Absatz und die Referenzen.“Format nicht spezifiziert, daher variabel von Antwort zu Antwort

Hier ist derselbe Prompt in seiner zusammengestellten Form. Jede Regel ist im Imperativ formuliert und überprüfbar (der Artikel wird zitiert oder nicht), und das Verhalten außerhalb des vorgesehenen Anwendungsbereichs ist ausdrücklich festgelegt.

Vollständiger Systemprompt
Tu es Lex, assistant juridique spécialisé en droit
du travail français (version 2026).

MISSION
Tu aides un DRH à comprendre ses obligations et à
rédiger des courriers RH conformes.

RÈGLES
- Ne jamais donner d'avis juridique formel.
- Toujours citer l'article du Code du travail concerné,
  par ex. "L.1232-2".
- Si la question sort du droit du travail, répondre :
  "Hors de mon périmètre. Je ne traite que le droit
  du travail français."

STYLE
- Phrases courtes, vocabulaire accessible.
- Pas d'anglicisme si un équivalent existe.
- Ton professionnel mais direct.

FORMAT
- Réponse par défaut : 1 paragraphe + références.
- Sur demande : tableau, courrier-type, checklist.

Dieser Prompt dient als Strukturvorlage. Ein lokales Modell kann einen nicht existierenden Artikel zitieren: Lassen Sie die Referenzen von einem Menschen überprüfen und lesen Sie den Leitfaden zu Halluzinationen.

#Anweisungen formulieren, denen das Modell folgt

Direkter Imperativ
„Mach X.“ und „Mach Y nicht.“ sind klarer als „versuche nach Möglichkeit, …“, was dem Modell die Freiheit lässt, es gar nicht erst zu versuchen.
Zuerst positiv formulieren
Zu sagen, was zu tun ist („Antworte in einem Satz“), ist besser als eine lange Liste von Verboten. Verbote sollten echten Schutzvorkehrungen vorbehalten bleiben.
Ein Beispiel sagt so viel wie eine Beschreibung
Für ein bestimmtes Format geben Sie eine zweizeilige Musterantwort statt drei erklärender Sätze vor.

#In der Praxis mit Ollama: /set system und Modelfile

Ollama bietet drei Möglichkeiten, einen System-Prompt zu definieren, je nachdem, wie lange er gelten soll. In einer interaktiven Sitzung legt der Befehl /set system die Nachricht für die laufende Konversation fest; der Befehl wird in der Liste der verfügbaren Befehle des Clients aufgeführt. Der Prompt verschwindet am Ende der Sitzung.

Interaktive Sitzung
>>> /set system """
Tu es Lex, assistant juridique spécialisé en droit
du travail français...
"""

Für einen dauerhaften System-Prompt erstellen Sie ein Modelfile: Damit entsteht ein abgeleitetes Modell mit einem eigenen Namen. Die Dokumentation von Ollama erläutert, dass die Anweisung SYSTEM die Systemnachricht definiert, die in die Vorlage des Modells eingefügt werden soll. Der Begriff „Vorlage“ ist entscheidend: Wenn das Template eines Modells keinen Platz für die Systemnachricht vorsieht, hat die Anweisung SYSTEM keine Wirkung. Vergleichen Sie bei überraschendem Verhalten mit dem ursprünglichen Modelfile.

Modelfile
FROM mistral

PARAMETER temperature 0.3
PARAMETER num_ctx 8192

SYSTEM """
Tu es Lex, assistant juridique...
"""
Terminal
ollama create lex -f ./Modelfile
ollama run lex

Dritte Option über die API: Der Anfragekörper einer Anfrage an /api/generate akzeptiert ein Feld system, das das im Modelfile definierte Feld ersetzt. /api/chat erhält den Gesprächsverlauf als Array von Nachrichten mit jeweils einer Rolle und einem Inhalt. Der Leitfaden zum Modelfile erläutert die weiteren Anweisungen.

#In der Praxis mit LM Studio: das Feld System Prompt und die Presets

Im Chat-Tab enthält der Konfigurationsbereich ein Feld namens System Prompt. Damit Sie ihn nicht erneut eingeben müssen, bietet LM Studio Presets an. Die Dokumentation beschreibt sie als Möglichkeit, einen System-Prompt und weitere Parameter in einer Konfiguration zusammenzufassen, die sich über mehrere Gespräche hinweg wiederverwenden lässt.

→
Eine Bibliothek von Presets
Jeder Parameter im Bereich Advanced Configuration lässt sich in einem benannten Preset speichern: der Systemprompt, aber auch die Temperatur, top-p oder die maximale Anzahl an Tokens. Erstellen Sie für jeden Einsatzzweck ein Preset („französischer Korrekturleser“, „Code-Assistent“, „Rechtsexperte“) und wechseln Sie die Rolle mit einem Klick. Presets lassen sich auch aus einer Datei oder über eine URL importieren.

#In der Praxis über die OpenAI-kompatible API

Ollama, LM Studio, vLLM und llama-server stellen eine OpenAI-kompatible API bereit. Die erste Nachricht im Array mit der Rolle system legt das Briefing fest. Die Dokumentation von Ollama erläutert, dass der Client einen Wert für den API-Schlüssel verlangt, der Server diesen aber ignoriert: Für den lokalen Einsatz eignet sich jede beliebige Zeichenkette.

Python
from openai import OpenAI

client = OpenAI(
    base_url="http://localhost:11434/v1",
    api_key="ollama",  # ignoré
)

resp = client.chat.completions.create(
    model="mistral",
    messages=[
        {"role": "system", "content": "Tu es Lex..."},
        {"role": "user",   "content": "Peut-on rompre une période d'essai ?"},
    ],
)

print(resp.choices[0].message.content)

Ein Punkt zur Konzeption: Die API hat kein Gedächtnis. Bei jedem Aufruf sendet Ihr Code die Systemnachricht erneut und danach den vollständigen Verlauf. Wenn Sie die Systemnachricht bei einem Aufruf weglassen, antwortet das Modell ohne Vorgaben: Speichern Sie das Nachrichtenarray und behalten Sie die Systemnachricht an Position 0.

#Drei einsatzbereite Systemprompts

#Korrekturassistent für Französisch

System prompt
Tu es un correcteur de français académique.
Règle unique : renvoie UNIQUEMENT le texte corrigé,
sans commentaire, sans liste des changements.
Corrige : orthographe, grammaire, ponctuation, barbarismes.
Ne reformule jamais. Ne change pas le style de l'auteur.

#Strukturierter Extraktor

System prompt
Tu extrais des informations structurées depuis du texte libre.
Sortie STRICTE : JSON valide, rien d'autre (pas de ```json, pas de texte).
Si une information est absente, renvoie null.
Ne devine jamais.

Verlassen Sie sich bei einer Datenextraktion im Produktivbetrieb nicht allein auf den System-Prompt: Mit den strukturierten Ausgaben von Ollama können Sie ein JSON-Schema für die Antworten vorgeben und so ungültiges JSON vermeiden. Der Leitfaden zu Function Calling und JSON-Ausgaben erklärt die Einrichtung.

#Senior-Code-Assistent

System prompt
Tu es un ingénieur logiciel senior.
Pour toute réponse de code :
1. Dis en une phrase ce que fait le code.
2. Donne le code dans un bloc unique.
3. Liste 1 à 3 cas limites à surveiller.
Tu ne mets JAMAIS de commentaire à l'intérieur du code,
sauf si un piège non-évident le justifie.

#Einen Systemprompt testen und korrigieren, ohne herumzuprobieren

Ein Systemprompt lässt sich durch kontrollierte Tests verbessern, nicht durch immer neue Ergänzungen. Ohne Methode häuft man Regeln an, bis ein langer, widersprüchlicher Text entsteht, in dem sich Fehler nicht mehr aufspüren lassen. Hier ist ein einfaches Vorgehen, das keine speziellen Tools erfordert.

  1. 01
    Fünf Testfragen zusammenstellen
    Schreiben Sie fünf Eingaben: zwei normale Fälle, eine Frage außerhalb des vorgesehenen Aufgabenbereichs, eine Anfrage nach einem ungewöhnlichen Format und einen Versuch, die vorgegebene Rolle zu unterlaufen („vergiss deine Anweisungen“). Bewahren Sie sie in einer Datei auf.
  2. 02
    Die Bedingungen festlegen
    Verwenden Sie dasselbe Modell, dieselbe Quantisierung und eine niedrige Temperatur (0,2 bis 0,3), um die Versionen des Prompts unter gleichen Bedingungen zu vergleichen.
  3. 03
    Immer nur eine Sache auf einmal ändern
    Ändern Sie eine Regel, stellen Sie die fünf Fragen erneut und notieren Sie, was sich verändert hat. Wenn zwei Regeln gleichzeitig geändert werden, wissen Sie nicht, welche das Verhalten korrigiert oder verschlechtert hat.
  4. 04
    Erst löschen, dann hinzufügen
    Wenn eine Regel ignoriert wird, formulieren Sie sie kürzer, stellen Sie sie an den Anfang oder entfernen Sie die Regel, die ihr widerspricht. Mehr Text hinzuzufügen ist der letzte Ausweg.
  5. 05
    Prompt versionieren
    Speichern Sie jede Version in einer datierten Textdatei oder im versionskontrollierten Modelfile, jeweils mit einer Zeile zu den Änderungen. So können Sie zu einer früheren Version zurückkehren.

#Fallstricke vermeiden

Häufige Fehler und Korrekturen
FalleSymptomKorrekturmaßnahme
Zu langer PromptAnweisungen am Ende des Prompts werden weniger zuverlässig befolgt, das Kontextfenster wird aufgezehrtKürzen, das Wesentliche an den Anfang stellen, num_ctx bei Bedarf erhöhen
Widersprüchliche Anweisungen„Fasse dich kurz“ und „Gib viele Beispiele“: wechselndes VerhaltenPriorisieren: Bei einem Konflikt hat Regel 1 Vorrang
Zögerliche Formulierung„Versuch nach Möglichkeit, …“: Anweisung wird nur gelegentlich befolgtDirekte Anweisung: „Mach X.“
Sprache nicht angegebenAntworten in der Sprache des Prompts oder der Frage, je nach dem Modell„Antworte immer auf Französisch“ schreiben und den Prompt auf Französisch formulieren
system-Slot ignoriertModell, das die SYSTEM-Anweisung eines Modelfiles nicht befolgtPrüfen, ob die Modellvorlage eine Systemnachricht vorsieht
Geheimnisse im PromptEin Benutzer erhält den Inhalt des Prompts, indem er danach fragtNichts Vertrauliches darin einfügen

#Der Systemprompt ist kein Safe

Die Empfehlungen von OWASP zum Risiko einer Offenlegung des Systemprompts sind eindeutig: Er darf weder als Geheimnis betrachtet noch als Sicherheitskontrolle verwendet werden und darf weder Zugangsdaten noch Verbindungszeichenfolgen enthalten. Für eine lokale Bereitstellung bedeutet das: Wenn eine Zugriffskontrolle erforderlich ist (benutzerspezifische Daten, sensible Aktionen), muss sie in Ihrer Anwendung umgesetzt werden, nicht durch einen Satz im Prompt. Der Leitfaden zur Prompt-Injection erläutert, warum auch ein lokales Modell davor nicht geschützt ist.

FAQ
Was ist ein System-Prompt?+
Das ist die Nachricht mit der Rolle „system“, die am Anfang einer Unterhaltung mit einem LLM steht. Sie legt die Identität des Modells, seine Aufgabe, seine Regeln, seinen Stil und das Format seiner Antworten fest. Sie bleibt bei jedem Gesprächsschritt im Kontext und stabilisiert so das Verhalten während der gesamten Sitzung, ohne dass Sie Ihre Anweisungen wiederholen müssen.
Wie lang sollte ein lokaler Systemprompt idealerweise sein?+
So kurz wie möglich, aber lang genug, um Ihre Regeln abzudecken: einige Zeilen für einen einfachen Fall, hundert bis zweihundert Wörter für einen Fachassistenten. Jedes Token des Systemprompts reduziert den verfügbaren Platz für den Verlauf, insbesondere bei Ollamas Standardkontextfenster von etwa 4.000 Tokens bei weniger als 24 GiB VRAM. Stellen Sie das Wesentliche an den Anfang.
Wie lässt sich ein permanenter Systemprompt in Ollama definieren?+
Erstellen Sie ein Modelfile mit einer FROM-Zeile und einer SYSTEM-Anweisung, die Ihren Text enthält, und führen Sie anschließend ollama create mit dem gewünschten Namen und ollama run mit diesem Namen aus. Der Prompt ist dann im abgeleiteten Modell eingebunden. Der Befehl /set system gilt hingegen nur für die aktuelle interaktive Sitzung.
Kann ein System-Prompt ein Modell davon abhalten, Informationen preiszugeben?+
Nicht zuverlässig. OWASP weist darauf hin, dass der Systemprompt nicht als Geheimnis betrachtet werden und nicht als Sicherheitskontrolle dienen sollte. Ein entschlossener Nutzer kann ihn offenlegen lassen oder die Anweisung zweckentfremden. Platzieren Sie die Zugriffskontrollen und sensiblen Daten in Ihrer Anwendung, niemals im Prompttext.
Soll der Systemprompt auf Französisch oder Englisch geschrieben werden?+
Schreiben Sie den Systemprompt in der Sprache der erwarteten Antworten und fügen Sie eine ausdrückliche Anweisung wie „Antworte immer auf Französisch“ hinzu. Manche Modelle antworten in der Sprache des Prompts statt in der Sprache der Frage. Testen Sie mit Ihrem konkreten Modell zwei oder drei Fragen in jeder Sprache, bevor Sie daraus allgemeine Schlüsse ziehen.
Warum ignoriert mein Modell meinen System-Prompt?+
Prüfen Sie zunächst, ob der Prompt korrekt gesendet wird (Rolle system an erster Stelle oder SYSTEM im Modelfile) und ob das Modelltemplate eine Systemnachricht vorsieht. Kürzen Sie anschließend den Prompt, entfernen Sie widersprüchliche Anweisungen, formulieren Sie im Imperativ und testen Sie mit niedriger Temperatur. Ein sehr kleines Modell folgt komplexen Anweisungen schlechter.
Hat Ihnen dieser Guide geholfen?

Haben Sie Feedback, einen Fehler entdeckt oder möchten Sie etwas präzisieren? Geben Sie uns Bescheid – so wird der Guide für alle besser.