Open-Source-KI
Was sind die besten Open Source LLMs - und wie wählt man aus?
Open Source oder Open Weight: der entscheidende Unterschied
Viele als Open Source vermarktete Modelle geben nur die trainierten Gewichte frei, nicht aber Trainingsdaten und Trainingscode. Präziser spricht man dann von Open-Weight-Modellen: Sie können sie herunterladen, ausführen und feinjustieren, aber nicht vollständig reproduzieren. Echte, OSI-konforme Offenheit mit offenen Daten und Code ist seltener.
Für die Praxis zählt vor allem die Lizenz. Sie entscheidet, ob Sie ein Modell kommerziell nutzen, weitergeben und die Ausgaben verwenden dürfen. Offene Gewichte sind der Schlüssel zu Datenhoheit und lokalem Betrieb - unabhängig davon, wie vollständig offen der Rest des Modells ist.
Die wichtigsten offenen Modellfamilien im Überblick
Die folgende Übersicht ordnet bekannte Familien ein. Fähigkeiten und Versionen ändern sich schnell - prüfen Sie stets die aktuelle Generation und Lizenz beim Anbieter.
- Llama (Meta): grosses Ökosystem, Open-Weight mit eigener Community-Lizenz und Nutzungsbedingungen - kein klassisches Open Source.
- Mistral / Mixtral (Mistral AI, Frankreich): mehrere Modelle unter Apache 2.0, europäischer Anbieter, teils Mixture-of-Experts-Architektur.
- Qwen (Alibaba): breites Grössenspektrum, viele Varianten unter Apache 2.0, meist starke Mehrsprachigkeit.
- DeepSeek: Gewichte teils unter MIT-Lizenz, mit auf Schlussfolgern ausgerichteten Varianten.
- Gemma (Google): kompakte, effiziente Modelle als Open-Weight unter eigener Gemma-Lizenz.
- Phi (Microsoft): kleine Modelle unter MIT-Lizenz, oft stark im Verhältnis zur Grösse.
- OLMo (Allen Institute for AI): vollständig offen inklusive Trainingsdaten, unter Apache 2.0 - ein Referenzpunkt für echte Offenheit.
- Apertus (ETH Zürich, EPFL, CSCS): das vollständig offene, mehrsprachige Schweizer Modell - mehr dazu weiter unten.
- Weitere: Falcon (TII), Command (Cohere), GLM (Zhipu) und laufend neue Modelle erweitern das Feld.
Lizenzen richtig lesen
Der Begriff Open Source wird uneinheitlich verwendet. Prüfen Sie vor dem produktiven Einsatz immer den konkreten Lizenztext - besonders bei kommerzieller Nutzung.
- Permissive OSI-Lizenzen (Apache 2.0, MIT): breite kommerzielle Nutzung, Weitergabe und Anpassung meist erlaubt.
- Eigene Community-/Open-Weight-Lizenzen (z. B. Llama, Gemma): Nutzung erlaubt, aber mit Bedingungen und teils Nutzungsbeschränkungen.
- Reine Forschungslizenzen: keine kommerzielle Nutzung erlaubt.
- Immer klären: kommerzielle Nutzung, Weitergabe, Rechte an den Ausgaben, Namensnennung und Marken.
- Offene Gewichte bedeuten nicht offene Trainingsdaten - beides ist getrennt zu bewerten.
Wie Sie das richtige Modell wählen
Statt nach dem vermeintlich besten Modell zu suchen, sollten Sie vom Anwendungsfall her denken. Diese Kriterien helfen bei einer fundierten, neutralen Auswahl.
- Anwendungsfall: Chat, Programmierung, Extraktion, Zusammenfassung oder RAG stellen unterschiedliche Anforderungen.
- Sprachqualität: prüfen Sie Deutsch, Französisch, Italienisch und bei Bedarf Schweizerdeutsch anhand eigener Beispiele.
- Modellgrösse und Hardware: grössere Modelle brauchen mehr VRAM; Quantisierung senkt den Bedarf.
- Lizenz und kommerzielle Bedingungen: passen sie zu Ihrem Geschäftsmodell?
- Betrieb: lokal/On-Premise für Datenhoheit oder verwaltetes Hosting für weniger Aufwand.
- Anpassbarkeit: Möglichkeit zu Fine-Tuning, Prompting und Werkzeug-Anbindung.
- Governance und Pflege: Update-Kadenz, Sicherheit, Dokumentation und Community-Support.
Lokal betreiben: Hardware, Werkzeuge und Datenschutz
Ein zentraler Vorteil offener Gewichte ist der lokale Betrieb. Kleine, quantisierte Modelle laufen bereits auf einem gut ausgestatteten Laptop; grössere Modelle brauchen eine GPU oder einen Server.
- Werkzeuge: Ollama, llama.cpp, LM Studio, vLLM und die Hugging-Face-Bibliotheken erleichtern Download und Betrieb.
- Quantisierung (etwa 4-bit, GGUF-Format) reduziert Speicherbedarf bei meist geringem Qualitätsverlust.
- Datenhoheit: Bei lokalem Betrieb verlassen die Daten Ihre Infrastruktur nicht - ein starkes Argument für den Schutz sensibler Informationen.
- Compliance: On-Premise oder Schweizer Hosting erleichtert die Einhaltung des revDSG, da keine unnötige Übermittlung ins Ausland erfolgt.
Schweizer und europäische Perspektive
Mit Apertus existiert ein vollständig offenes, mehrsprachiges Sprachmodell aus der Schweiz, entwickelt von ETH Zürich, EPFL und dem Supercomputing-Zentrum CSCS und auf dem Alps-Supercomputer trainiert. Es steht für digitale Souveränität und Transparenz - Gewichte, Trainingsdaten und Methodik sind offengelegt.
- EU AI Act: Für frei lizenzierte, quelloffene GPAI-Modelle gelten Erleichterungen, aber nicht bei systemischem Risiko; Pflichten wie eine Zusammenfassung der Trainingsdaten und die Achtung des Urheberrechts bleiben bestehen. Der Rechtsakt wirkt extraterritorial.
- revDSG und EDÖB: Offene Gewichte helfen, Personendaten in der Schweiz zu halten und Bearbeitungen transparent zu dokumentieren.
- Anbieterunabhängigkeit: Offene Modelle verringern Lock-in-Risiken und erhöhen die Kontrolle über Roadmap und Kosten.
Häufige Fragen
Was ist der Unterschied zwischen Open Source und Open Weight bei LLMs?
Open Weight bedeutet, dass die trainierten Gewichte frei verfügbar sind - Sie können das Modell herunterladen, ausführen und anpassen. Vollständig Open Source umfasst zusätzlich offene Trainingsdaten und Code, sodass sich das Modell reproduzieren lässt. Viele bekannte Modelle sind Open Weight, aber nicht vollständig quelloffen.
Welches ist das beste Open Source LLM?
Es gibt kein pauschal bestes Modell. Die richtige Wahl hängt vom Anwendungsfall, der Sprachqualität für Ihre Sprachen, der Lizenz, der verfügbaren Hardware und Ihren Datenschutzanforderungen ab. Testen Sie zwei bis drei Kandidaten mit eigenen, realistischen Beispielen statt sich auf allgemeine Ranglisten zu verlassen.
Darf ich Open-Source-LLMs kommerziell nutzen?
Das hängt von der Lizenz ab. Modelle unter Apache 2.0 oder MIT erlauben in der Regel breite kommerzielle Nutzung. Eigene Community-Lizenzen (etwa bei Llama oder Gemma) erlauben kommerzielle Nutzung meist ebenfalls, jedoch mit Bedingungen. Reine Forschungslizenzen schliessen kommerzielle Nutzung aus. Prüfen Sie stets den konkreten Lizenztext.
Welche Hardware brauche ich, um ein LLM lokal zu betreiben?
Kleine, quantisierte Modelle laufen bereits auf einem gut ausgestatteten Laptop mit ausreichend Arbeitsspeicher. Mittlere und grosse Modelle profitieren stark von einer GPU mit genügend VRAM oder von einem Server. Quantisierung senkt den Speicherbedarf deutlich; Werkzeuge wie Ollama oder LM Studio erleichtern den Einstieg.
Sind offene LLMs mit dem EU AI Act und dem revDSG vereinbar?
Offene Modelle sind grundsätzlich vereinbar, entbinden aber nicht von den Pflichten. Der EU AI Act sieht für frei lizenzierte, quelloffene GPAI-Modelle Erleichterungen vor, jedoch nicht bei systemischem Risiko; eine Zusammenfassung der Trainingsdaten und die Achtung des Urheberrechts bleiben verlangt. Unter dem revDSG ist der lokale Betrieb ein Vorteil, da Personendaten in der Schweiz bleiben können.
Gibt es ein Schweizer Open-Source-LLM?
Ja. Apertus ist ein vollständig offenes, mehrsprachiges Sprachmodell aus der Schweiz, entwickelt von ETH Zürich, EPFL und dem Supercomputing-Zentrum CSCS und auf dem Alps-Supercomputer trainiert. Gewichte, Trainingsdaten und Methodik sind offengelegt, was es zu einem Referenzpunkt für digitale Souveränität und Transparenz macht.
Begriffe im Glossar
Praktische KI für Ihr Unternehmen
Von der Idee zur Umsetzung – wir zeigen Ihnen, was in Ihrem Fall konkret möglich ist.
Demo anfordern