Bestes Open-Source-LLM für mehrsprachige Übersetzungen

Ein Open-Source-LLM für Übersetzungen leistungsstark ohne Abhängigkeit von einer proprietären API ist zu einem konkreten Anliegen für Teams geworden, die große Mengen multilingualer Inhalte (Verträge, Kundensupport, technische Dokumentation) verarbeiten. Im Gegensatz zu einer cloudbasierten API, die pro Token berechnet wird, bietet ein lokal gehosteter open-weight-Modell vollständigen Datenkontrolle und einen festeren, volumenunabhängigen Kostenrahmen. Dieser Artikel untersucht die allgemein verwendbaren Modelle aus dem Katalog, die am besten zur Übersetzung geeignet sind, die notwendige Hardwarekonfiguration sowie die Rolle spezialisierter Modelle wie Aya 32B oder Madlad-400 in diesem Bereich.

Warum ein Open-Weights-Modell für die Übersetzung wählen?

Die Übersetzung sensibler Dokumente (aus den Bereichen Recht, Personalwesen und Medizin) wirft ein Vertraulichkeitsproblem auf, sobald der Text über die API eines Drittanbieters übertragen wird. Ein lokal ausgeführtes Modell unter Verwendung von llama.cpp, vLLM oder Ollama eliminiert diesen Netzwerktransit: Die Dateien bleiben auf der Unternehmensinfrastruktur. Dieser detaillierte Ansatz wird in unserem Leitfaden über die Übersetzung von Dokumenten mit einem lokalen LLM und in dem Leitfaden zum multilingualer Kundensupport.

Der zweite Vorteil liegt in der Lizenz. Die meisten aktuellen mehrsprachigen Modelle im Katalog werden unter Apache 2.0 oder MIT veröffentlicht, was eine kommerzielle Nutzung ohne Lizenzgebühren erlaubt — ein Punkt, der vor jedem Einsatz im Produktivbetrieb überprüft werden muss.

Vielseitige mehrsprachige Modelle bevorzugen

Die großen Mixture-of-Experts-Modelle, die 2025–2026 veröffentlicht wurden, unterstützen dank ihrer massiv mehrsprachigen Trainingskorpora in der Regel mehrere Dutzend Sprachen von Haus aus. Zu den Optionen im Katalog gehören:

Bei langen Texten (Verträgen, technischen Handbüchern) ist die Wahl eines großen Kontextfensters ebenso wichtig wie die Modellgröße: Bei mehr als 100.000 Tokens passt das gesamte Dokument in eine einzige Anfrage, ohne es manuell aufzuteilen. Dadurch bleibt die terminologische Konsistenz erhalten.

Spezialmodelle für die Übersetzung: Aya 32B und Madlad-400

Neben den Allzweckmodellen im Katalog sind zwei Modellfamilien speziell für die mehrsprachige Übersetzung konzipiert und tauchen häufig in Vergleichen auf: Aya 32B (Aya-Expanse-Familie von Cohere, ausgelegt auf die Abdeckung von mehr als 20 Sprachen) und Madlad-400 (auf einem Korpus trainiert, der über 400 Sprachen abdeckt). Diese Modelle sind nicht im Hauptkatalog von quelllm.fr enthalten und ihre genauen Spezifikationen (VRAM pro Quantisierung, Tokens pro Sekunde) müssen einzeln je nach getesteter Variante bestätigt werden.

Zur Einordnung von Aya 32B gegenüber vergleichbaren Allzweckmodellen siehe unseren Vergleich Aya Expanse 32B vs Qwen 2.5 32B sowie die leichtere Version Aya Expanse 8B vs Llama 3 8B. In der Praxis erzielt ein spezialisiertes Modell wie Aya besonders gute Ergebnisse bei Sprachen, für die nur wenige Trainingsdaten verfügbar sind, während ein großes Allzweckmodell wie Qwen 3.5 oder Mistral Large 3 für gemischte Inhalte (Übersetzung + Umformulierung + Zusammenfassung in derselben Pipeline) vielseitiger bleibt.

Hardwarekonfiguration und Quantisierung

Die Wahl der Quantisierung bestimmt direkt den benötigten VRAM:

Für einen Arbeitsplatzrechner mit einer einzigen GPU mit 24 GB oder 32 GB kommen nur kompakte Modelle wie Mistral Small 4 in Q4-Quantisierung infrage; Modelle mit mehr als 200 Milliarden Parametern benötigen einen Cluster oder einen Mac mit viel vereinheitlichtem Speicher. Unser Leitfaden zur europäischen Mehrsprachigkeit und unsere Auswahl von französischsprachige Modelle erläutern die Abwägungen zwischen VRAM-Bedarf und Qualität für weniger leistungsstarke Konfigurationen im Detail.

Der Durchsatz in Tokens pro Sekunde hängt stark von der GPU, der Kontextlänge und der gleichzeitig anfallenden Last ab; ohne Messung auf der Zielhardware muss dieser Wert noch bestätigt werden, statt ihn vorab zu schätzen.

Konkrete Anwendungsfälle

FAQ

F: Welches Open-Source-LLM eignet sich am besten für Übersetzungen in großen Mengen?

Für ein hohes Volumen bei vorhandener Hardware bieten Qwen 3.5 397B-A17B oder Mistral Large 3 675B eine gute mehrsprachige Abdeckung unter der Apache-2.0-Lizenz. Für eine bescheidenere Infrastruktur bleibt Mistral Small 4 (119B, VRAM Q4 ~72 GB) die zugänglichste Option im Katalog.

F: Ist Aya 32B besser als die allgemeinen Modelle im Katalog?

Bei Sprachen, die in allgemeinen Korpora wenig vertreten sind, kann Aya 32B bessere Ergebnisse erzielen. Bei gängigen Sprachpaaren (Englisch–Französisch, Englisch–Chinesisch) sind Allzweckmodelle wie Qwen 3.5 oder GLM 5.3 Flash oft konkurrenzfähig und bieten einen längeren Kontext. Siehe den Vergleich Aya Expanse 32B vs Qwen 2.5 32B.

F: Ist Madlad-400 für den Einsatz in Unternehmen geeignet?

Madlad-400 zielt auf eine sehr breite Sprachabdeckung (mehr als 400 Sprachen) ab, was für Nischenanwendungen nützlich ist. Die genauen VRAM-Angaben je Quantisierung müssen abhängig von der verwendeten Variante noch bestätigt werden; das Modell ist nicht im Hauptkatalog dieses Vergleichs enthalten.

F: Ist eine dedizierte GPU erforderlich, um ein Übersetzungs-LLM lokal auszuführen?

Das hängt von der Größe des gewählten Modells ab. Ein kompaktes Modell wie Mistral Small 4 in Q4 passt auf eine GPU mit 24–32 GB oder einen Mac mit ausreichend gemeinsamem Arbeitsspeicher. Modelle mit mehr als 300B Parametern erfordern mehrere GPUs oder einen Rechner mit viel gemeinsamem Arbeitsspeicher.

F: Welche Lizenz sollte für kommerziellen Einsatz gewählt werden?

Apache 2.0 oder MIT bevorzugen, da diese Lizenzen weder Lizenzgebühren noch Einschränkungen der kommerziellen Nutzung vorsehen — das gilt in diesem Vergleich für Qwen 3.5, Mistral Large 3, GLM 5.3 Flash und DeepSeek V3.2. Vor der Bereitstellung stets die genaue Lizenz auf der Modellseite prüfen.

F: Wie kann die Qualität der Übersetzung vor der Auswahl eines Modells gemessen werden?

Auf einem repräsentativen Stichprobe aus dem Bereich (Verträge, Support-Tickets, Dokumentation) testen, anstatt ausschließlich auf allgemeine Benchmarks wie MMLU zu vertrauen. Auch dieOpen LLM Leaderboard für eine erste Einschätzung des allgemeinen Leistungsniveaus vor einem Test im jeweiligen Fachgebiet.

Fazit

Wählen Sie ein Open-Source-LLM für Übersetzungen hängt vor allem vom zu verarbeitenden Volumen und der verfügbaren Hardware ab: Generalistische Modelle wie Qwen 3.5, Mistral Large 3 oder GLM 5.3 Flash decken unter permissiven Lizenzen die meisten Anwendungsfälle ab, während spezialisierte Modelle wie Aya 32B oder Madlad-400 für Sprachen mit wenigen verfügbaren Sprachressourcen weiterhin relevant sind. Um diese Wahl auf Ihre Hardwarekonfiguration abzustimmen, verwenden Sie den Konfigurator oder erkunden Sie den gesamten Katalog.

Das Hardware-Setup für die lokale Ausführung eines LLM

Um diese Modelle komfortabel lokal auszuführen, benötigt man RTX 5070 Ti bietet ein hervorragendes Preis-Leistungs-Verhältnis. Vergleichen Sie die Preise:

Darty RTX 5070 Ti →Amazon RTX 5070 Ti →

Affiliate-Links — QuelLLM kann bei Käufen eine Provision erhalten, ohne dass Ihnen Mehrkosten entstehen. Als Amazon-Partner verdient QuelLLM an qualifizierten Käufen.

Artikel veröffentlicht und aktualisiert am von Mohamed Meguedmi · Quelle der Daten: /api/models.json · Lizenz für den Inhalt: CC BY 4.0.

Möchten Sie einen Fehler oder eine Aktualisierung melden? Mitwirken.