KI-Modelle vergleichen
Open-weightGeprüft 2026-08-11

Open-weight Modellprofil · OpenAI

gpt-oss-20b lokal nutzen: zuerst die Grenze zwischen Gewichten und API verstehen.

gpt-oss-20b ist OpenAIs kompaktere Open-weight-Reasoning-Variante. Sie kann eine überzeugende Wahl für kontrollierte lokale Text-Workflows sein. Sie ist aber weder ein ChatGPT-Plan noch ein OpenAI-API-Modell. Wer diese drei Dinge vermischt, plant Kosten und Betrieb falsch.

Lizenz
Apache 2.0
Kontext
128K Tokens
Modalitäten
Text
Parameter
21B gesamt, 3,6B aktiv pro Token

Was die Lizenz praktisch bedeutet

OpenAI veröffentlicht gpt-oss-20b unter Apache 2.0, ergänzt durch die gpt-oss-Nutzungspolitik. Es ist ein Open-weight-Modell und kein Modell der OpenAI API.

Open source, open-weight und kein API-Preis sind unterschiedliche Aussagen. Prüfe die verlinkten Bedingungen sowie Daten-, Hosting- und Compliance-Anforderungen vor einem Produktstart.

Kosten und Betrieb

Eingabe / 1 Mio.
Kein OpenAI-API-Preis
Ausgabe / 1 Mio.
Kein OpenAI-API-Preis

gpt-oss ist weder in der OpenAI API noch in ChatGPT verfügbar. Tokenkosten entstehen nur über eigene Infrastruktur oder einen externen Hosting-Anbieter.

Aktuelle Provider-Quelle prüfen

Was du mit gpt-oss-20b tatsächlich bekommst

Du erhältst offene Gewichte unter Apache 2.0 sowie eine Nutzungspolitik. Das Modell ist für Text, Tool-Nutzung, Function Calling und strukturierte Ausgaben vorgesehen, wenn die gewählte Runtime diese Fähigkeiten korrekt unterstützt. Es ist nicht im OpenAI API- oder ChatGPT-Angebot enthalten. Für lokale und private Prototypen kann das ein Vorteil sein, weil du den Ausführungsort selbst bestimmst. Dafür übernimmst du aber Download, Betrieb, Updates, Sicherheit und Leistungsplanung.

16GB bedeutet machbar, nicht grenzenlos schnell

OpenAI nennt für die native MXFP4-Version von gpt-oss-20b eine Ausführung mit 16GB Speicher. Das ist eine hilfreiche Untergrenze für einen ersten Test. Es sagt nichts Verlässliches über Durchsatz, lange Kontexte, mehrere parallele Nutzer oder deinen konkreten Runtime-Overhead aus. Miss daher Speicherverbrauch, Antwortzeit und Qualitätsverlust mit deinen echten Prompts. Die 120B-Variante ist eine andere Infrastrukturklasse und kein bloßes Upgrade für denselben Rechner.

Kosten: keine OpenAI-API-Preise, aber echte Betriebskosten

Für gpt-oss-20b gibt es keinen OpenAI-API-Tokenpreis, weil das Modell nicht über diese API angeboten wird. Selbstbetrieb verursacht trotzdem Kosten durch Hardware, Strom, Speicher, Monitoring, Ausfallsicherheit und deine Arbeitszeit. Drittanbieter können eigene tokenbasierte Preise aufrufen. Behandle einen lokalen Modellserver deshalb wie eine kleine Produktionskomponente, nicht wie einen kostenlosen Download.

Lokale Realität und erster Test

OpenAI gibt an, dass die native MXFP4-Version mit 16GB Speicher laufen kann. Das macht sie zu einer zugänglicheren aktuellen Reasoning-Option für lokalen oder Edge-Betrieb.

  • Installiere zuerst eine unterstützte Runtime wie Ollama, vLLM, llama.cpp oder Transformers.
  • Nutze das offizielle Setup-Material und prüfe, ob deine Runtime das native Format unterstützt.
  • Teste Promptlänge und gleichzeitige Anfragen getrennt, bevor du eine Leistungszusage ableitest.
vLLMOllamallama.cppTransformers

Wo es passt

  • Lokales Text-Reasoning für vertrauliche Prototypen und klar abgegrenzte Arbeitsabläufe.
  • On-device- oder Edge-Services, bei denen Ausführungsort und Lizenz wichtig sind.
  • Experimente mit Werkzeugaufrufen und strukturierten Antworten über eine kompatible Runtime.

Wo es nicht passt

Nicht passend für Bild- oder Audioaufgaben, für Menschen, die einen verwalteten ChatGPT-Dienst erwarten, oder für Teams ohne Bereitschaft zum Betrieb eigener Modellsoftware.

Weiter vergleichen

Verwandte Entscheidungen

Alle Modelle ansehen
Redaktioneller Hinweis: Diese Seite ist eine datierte Entscheidungshilfe, kein Benchmark-Ranking und kein Ersatz für Rechts-, Sicherheits- oder Infrastrukturprüfung. Modell- und Preisangaben können sich nach 2026-08-11 ändern. Öffne die Primärquellen, bevor du Budget oder Kundendaten bindest.