Local & Open Source

Lokale KI und Open Source: Was bedeutet Datenhoheit für Schweizer Unternehmen?

Was bedeutet lokale KI und Open Source?

Zwei Achsen werden oft verwechselt. Die erste ist der Betriebsort: Wird ein KI-Modell über die API eines Anbieters in dessen Cloud genutzt, oder läuft es lokal – auf einem Server im eigenen Rechenzentrum, auf einer Workstation oder in einer privaten, vom Unternehmen kontrollierten Cloud-Instanz? Die zweite Achse ist die Offenheit des Modells: Sind die Gewichte öffentlich herunterladbar oder bleiben sie geschlossen hinter einem Dienst?

Lokale KI Open Source verbindet beide: ein Modell mit offen verfügbaren Gewichten, das im eigenen Verantwortungsbereich läuft. Damit verlassen die verarbeiteten Daten die kontrollierte Umgebung nicht – der zentrale Unterschied zu einem reinen Cloud-Dienst.

Warum Datenhoheit für Schweizer Unternehmen zählt

Datenhoheit heisst, jederzeit zu wissen und zu bestimmen, wo Daten verarbeitet werden, wer Zugriff hat und nach welchen Regeln. Bei geschlossenen Cloud-Diensten liegt ein Teil dieser Kontrolle beim Anbieter und fällt häufig unter ausländisches Recht. Lokaler Betrieb verschiebt die Kontrolle zurück ins Unternehmen.

  • revDSG/nFADP: Das revidierte Datenschutzgesetz verlangt Transparenz, Zweckbindung und dokumentierte Bearbeitung von Personendaten; die EDÖB beaufsichtigt die Einhaltung.
  • Berufs- und Amtsgeheimnisse: Anwälte, Ärzte, Banken und Treuhänder unterliegen besonderen Schweigepflichten (u. a. Art. 321 StGB, Bankkundengeheimnis) – ein Datenabfluss an Dritte kann strafbar sein.
  • EU AI Act: Die EU-Regulierung wirkt extraterritorial und kann Schweizer Firmen betreffen, die in den EU-Markt liefern; sie ergänzt das Datenschutzrecht um risikobasierte Pflichten.
  • Datenresidenz und Auftragsbearbeitung: Bei Cloud-Diensten braucht es Verträge, geeignete Garantien für Auslandtransfers und Klarheit über Subunternehmer – beim lokalen Betrieb entfallen diese Transfers weitgehend.

Lokal, Cloud oder hybrid – der Vergleich

Es gibt kein pauschal richtiges Modell. Cloud-KI überzeugt bei Startgeschwindigkeit und Zugang zu den stärksten Frontier-Modellen; lokale KI überzeugt bei Datenhoheit, planbaren Kosten und Unabhängigkeit. Viele Schweizer Unternehmen fahren hybrid: sensible Fälle lokal, unkritische Aufgaben in der Cloud.

  • Datenhoheit: lokal am höchsten (Daten bleiben intern), Cloud abhängig von Vertrag und Standort, hybrid je nach Datenklasse steuerbar.
  • Kostenprofil: Cloud ist variabel pro Nutzung, lokal erfordert Anfangsinvestition mit danach planbaren Betriebskosten – Wirtschaftlichkeit hängt vom Volumen ab.
  • Leistung: Die stärksten geschlossenen Frontier-Modelle liegen bei komplexen Aufgaben oft vorn; gute offene Modelle reichen für viele Fachaufgaben bereits aus.
  • Aufwand: Cloud minimiert Betriebsaufwand, lokal verlangt Kompetenz für Hardware, Betrieb und Updates.

Open Source vs. Open Weight – der Lizenz-Unterschied

Der Begriff Open Source wird bei KI oft unpräzise verwendet. Vollständig offen ist ein Modell, dessen Gewichte, Trainingscode und idealerweise Trainingsdaten unter einer freien Lizenz stehen. Häufiger sind Open-Weight-Modelle: Die Gewichte sind herunterladbar, aber Trainingsdaten oder -code bleiben unter Verschluss, und die Lizenz kann Einschränkungen enthalten – etwa Nutzungslimits oder Bedingungen für sehr grosse Anbieter.

  • Permissive Lizenzen (z. B. Apache 2.0, MIT): breite kommerzielle Nutzung, wenige Auflagen – rechtlich am einfachsten für Unternehmen.
  • Community-/Custom-Lizenzen: kommerziell nutzbar, aber mit Bedingungen – Lizenztext prüfen, bevor ein Modell produktiv geht.
  • Vollständige Offenheit erhöht Nachvollziehbarkeit und Auditierbarkeit – relevant für regulierte Branchen und die Dokumentationspflichten des EU AI Act.

Modelle und Werkzeuge für den lokalen Betrieb

Das ökosystem offener Modelle ist gross und ändert sich schnell. Bekannte Familien mit offenen Gewichten sind unter anderem Llama (Meta), Mistral und Mixtral (Mistral AI), Qwen (Alibaba), Gemma (Google) und DeepSeek. Aus der Schweiz stammt Apertus, ein offen entwickeltes, mehrsprachiges Sprachmodell von ETH Zürich, EPFL und dem Supercomputing-Zentrum CSCS – ein Beispiel für souverän und transparent gebaute KI.

Zum Betrieb dienen ausgereifte, quelloffene Werkzeuge. Für den Einstieg und Einzelplätze eignen sich Ollama, LM Studio oder GPT4All; für produktive, skalierbare Dienste kommen llama.cpp und vLLM zum Einsatz. Modelle werden meist über Hugging Face bezogen; Quantisierung reduziert den Speicherbedarf, damit auch kleinere Hardware genügt.

Hardware, Kosten und Aufwand realistisch einschätzen

Der Ressourcenbedarf richtet sich nach der Modellgrösse und der gewünschten Geschwindigkeit. Kleinere Modelle laufen bereits auf einer gut ausgestatteten Workstation; grössere brauchen dedizierte GPUs mit viel Videospeicher (VRAM). Entscheidend ist der Anwendungsfall: Ein Assistent für einige Fachpersonen stellt andere Anforderungen als ein hausweiter Dienst.

Für die Wirtschaftlichkeit zählt die Gesamtkostenbetrachtung über mehrere Jahre: Hardware oder private Cloud, Strom, Betrieb, Wartung und Personal gegen die laufenden Nutzungsgebühren eines Cloud-Dienstes. Konkrete Preise sind volatil – prüfen Sie die aktuellen Angaben der jeweiligen Anbieter und rechnen Sie mit Ihrem eigenen Volumen.

So entscheiden Sie – und wie es weitergeht

Beginnen Sie bei den Daten, nicht bei der Technik: Klassifizieren Sie Anwendungsfälle nach Sensibilität und regulatorischer Last. Fälle mit Personendaten, Berufsgeheimnis oder Geschäftsgeheimnissen sprechen für lokalen Betrieb; unkritische, öffentliche Aufgaben können günstig in der Cloud laufen. Starten Sie klein mit einem klar umrissenen Pilotfall und einer messbaren Erwartung.

  • Spoke: Selbst-Hosting konkret – Ollama, llama.cpp und vLLM im Vergleich für den produktiven Einsatz.
  • Spoke: Offene Modelle auswählen – Lizenzen, Grössen und Sprachfähigkeit für Deutsch, Französisch und Italienisch.
  • Spoke: revDSG-konforme KI-Architektur – RAG auf internen Dokumenten ohne Datenabfluss.

In diesem Themenbereich

Häufige Fragen

Ist lokale KI günstiger als Cloud-KI?

Es kommt auf das Volumen an. Lokale KI erfordert eine Anfangsinvestition in Hardware oder eine private Cloud, danach sind die Betriebskosten planbar. Bei hoher, konstanter Nutzung kann sie sich rechnen; bei sporadischem Bedarf ist Cloud oft günstiger. Rechnen Sie die Gesamtkosten über mehrere Jahre mit Ihrem eigenen Volumen.

Sind offene Modelle so gut wie GPT oder Claude?

Für viele Fachaufgaben – Zusammenfassen, Extrahieren, Klassifizieren, Antworten auf internen Dokumenten – reichen gute offene Modelle heute aus. Bei den anspruchsvollsten Aufgaben liegen die stärksten geschlossenen Frontier-Modelle oft noch vorn. Entscheidend ist, das Modell am konkreten Anwendungsfall zu testen statt an allgemeinen Ranglisten.

Was ist der Unterschied zwischen Open Source und Open Weight?

Vollständig Open Source bedeutet, dass Gewichte, Trainingscode und idealerweise Trainingsdaten offen und frei lizenziert sind. Open Weight bedeutet nur, dass die Modellgewichte herunterladbar sind – Daten und Code können geschlossen bleiben und die Lizenz Einschränkungen enthalten. Prüfen Sie immer den konkreten Lizenztext.

Welche Hardware brauche ich für lokale KI?

Das hängt von Modellgrösse und Geschwindigkeit ab. Kleinere, quantisierte Modelle laufen auf einer guten Workstation; grössere Modelle oder viele gleichzeitige Nutzer brauchen dedizierte GPUs mit ausreichend VRAM. Beginnen Sie mit einem Pilot auf vorhandener Hardware und skalieren Sie erst, wenn der Nutzen belegt ist.

Ist lokale KI automatisch revDSG-konform?

Nein. Lokaler Betrieb reduziert Datentransfers und erleichtert die Kontrolle, ersetzt aber nicht die Pflichten aus dem revDSG: Rechtsgrundlage, Transparenz, Zweckbindung, Datensicherheit und gegebenenfalls eine Datenschutz-Folgenabschätzung bleiben bestehen. Datenhoheit ist eine gute Grundlage, aber Governance und Dokumentation müssen Sie weiterhin sicherstellen.

Was ist Apertus?

Apertus ist ein offen entwickeltes, mehrsprachiges Sprachmodell aus der Schweiz, getragen von ETH Zürich, EPFL und dem nationalen Supercomputing-Zentrum CSCS. Es steht für transparent gebaute, souveräne KI und ist ein Beispiel dafür, dass leistungsfähige offene Modelle auch im europäischen Raum entstehen. Details und Verfügbarkeit entnehmen Sie den offiziellen Projektquellen.

Begriffe im Glossar

Praktische KI für Ihr Unternehmen

Von der Idee zur Umsetzung – wir zeigen Ihnen, was in Ihrem Fall konkret möglich ist.

Demo anfordern