- Eine lokale Ollama-Installation verfügt über keinen API-Schlüssel. Der Server unter
http://localhost:11434akzeptiert jede Anfrage ohne Authentifizierung – absichtlich. - Falls ein OpenAI-kompatibler Client einen Schlüssel verlangt, geben Sie einfach eine beliebige nicht-leere Zeichenkette ein –
ollamaist die übliche Konvention. Der Wert wird niemals überprüft. - Ein echter Ollama-API-Schlüssel existiert ausschließlich für Ollama Cloud, der in Ihrem ollama.com-Konto erstellt und als
Bearer-Token übermittelt wird. - Um eine lokale Instanz abzusichern, platzieren Sie einen Reverse-Proxy mit Authentifizierung davor. Exponieren Sie den Port 11434 niemals direkt im Internet.
Eine lokale Ollama-Installation verfügt weder über einen API-Schlüssel noch über eine integrierte Möglichkeit, einen solchen festzulegen. Der HTTP-Server, den sie unter http://localhost:11434 ausführt, beantwortet jede Anfrage, die ihn erreicht. Nutzer, die nach einem „Ollama-API-Schlüssel“ suchen, benötigen in der Regel eines von drei Dingen: etwas, das in das zwingende Schlüsselfeld einer Client-Anwendung eingegeben werden kann; eine Möglichkeit, eine Instanz abzusichern, auf die andere Rechner zugreifen können; oder einen Schlüssel für Ollamas gehosteten Cloud-Service – den einzigen Ort, an dem ein echter Schlüssel existiert. Dieser Leitfaden behandelt alle drei Fälle.
- Warum Ollama lokal ohne Authentifizierung ausgeliefert wird
- Was in das API-Schlüsselfeld OpenAI-kompatibler Clients einzugeben ist
- Hinzufügen echter Authentifizierung mittels eines Reverse-Proxys
- Ändern der Adresse, an der Ollama lauscht: Windows, macOS, Linux
- Ollama Cloud: Wo ein echter API-Schlüssel gilt
- Die eigentliche Gefahr: Eine nicht authentifizierte Instanz im Internet
- Häufig gestellte Fragen
Warum Ollama lokal ohne Authentifizierung ausgeliefert wird
Standardmäßig bindet Ollama an die Loopback-Adresse 127.0.0.1 auf Port 11434. Nur Prozesse auf demselben Rechner können eine Verbindung herstellen; ein API-Schlüssel würde daher lediglich zusätzlichen Aufwand ohne echten Sicherheitsgewinn bringen: Jedes lokale Programm, das eine Schlüsseldatei lesen könnte, könnte genauso gut direkt die API aufrufen. Dies ist dasselbe Vertrauensmodell, das von den meisten lokalen Entwicklungsservern verwendet wird.
Die Folge: Es gibt keinen OLLAMA_API_KEY Variable, ohne Schlüssel-Flag und ohne Passwortoption irgendwo in der Konfiguration. Zum Zeitpunkt dieser Abfassung verfügt der lokale Ollama-Server über überhaupt keine integrierte Authentifizierungsmethode – die Absicherung einer über das Netzwerk erreichbaren Instanz liegt in Ihrer Verantwortung; dies wird weiter unten behandelt. Falls Sie sich noch in der Einrichtungsphase befinden, beginnen Sie mit unserem Ollama-Installationsanleitung oder dem umfassenderen Kompletter Ollama-Leitfaden.
Was in das API-Schlüsselfeld OpenAI-kompatibler Clients einzugeben ist
Ollama stellt OpenAI-kompatible Endpunkte unter /v1zur Verfügung, weshalb Chat-Benutzeroberflächen, Programmierassistenten und die offiziellen OpenAI-SDKs problemlos mit ihm kommunizieren können. Diese SDKs weigern sich jedoch, einen Client zu erstellen, wenn kein nicht-leerer API-Schlüssel angegeben ist – diese Prüfung erfolgt clientseitig, noch bevor eine Anfrage gesendet wird. Ollama ignoriert den resultierenden Authorization Header vollständig, sodass jeder beliebige String funktioniert. Üblich ist die Verwendung von ollama.
| Einstellung | Wert für lokalen Ollama |
|---|---|
| Basis-URL | http://localhost:11434/v1 |
| API-Schlüssel | Jeder nicht-leere String, z. B. ollama |
| Modell | Ein von Ihnen heruntergeladener Tag, z. B. llama3.2 |
Python mit dem offiziellen OpenAI-SDK:
from openai import OpenAI
client = OpenAI(
base_url="http://localhost:11434/v1",
api_key="ollama", # vom SDK erforderlich, von Ollama ignoriert
)
response = client.chat.completions.create(
model="llama3.2",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)JavaScript / TypeScript:
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "http://localhost:11434/v1",
apiKey: "ollama",
});
const response = await client.chat.completions.create({
model: "llama3.2",
messages: [{ role: "user", content: "Hello" }],
});
console.log(response.choices[0].message.content);Das Modell muss bereits heruntergeladen sein (ollama pull llama3.2), andernfalls schlägt die Anfrage mit einem „Modell nicht gefunden“-Fehler fehl. Falls Sie unsicher sind, was Sie ausführen sollen, werfen Sie einen Blick auf unsere Empfehlungen für die Beste lokale Modelle für Ollama.
Hinzufügen echter Authentifizierung mittels eines Reverse-Proxys
Da Ollama Schlüssel selbst nicht überprüfen kann, besteht das Standardverfahren darin, Ollama standardmäßig an die Loopback-Schnittstelle zu binden und einen Reverse-Proxy davorzuschalten. Der Proxy beendet TLS, prüft ein Token und leitet gültige Anfragen an 127.0.0.1:11434weiter. Eine minimale nginx-Konfiguration, die ein Bearer-Token voraussetzt:
server {
listen 443 ssl;
server_name ollama.example.com;
# ssl_certificate und ssl_certificate_key-Zeilen wurden weggelassen
location / {
if ($http_authorization != "Bearer YOUR-LONG-RANDOM-TOKEN") {
return 401;
}
proxy_pass http://127.0.0.1:11434;
proxy_set_header Host $host;
proxy_read_timeout 600s;
}
}Zwei Details sind entscheidend: Generieren Sie das Token am besten mit einem Befehl wie openssl rand -hex 32 , statt es sich selbst auszudenken. Und das lange proxy_read_timeout ist bewusst gewählt: Bei gestreamten Generierungen können mehrere Minuten vergehen, und die standardmäßigen Proxy-Timeouts würden sie sonst mitten in der Antwort abbrechen.
Der elegante Teil: Die OpenAI-SDKs senden den Schlüssel bereits im Format Authorization: Bearer . Richten Sie Ihren Client auf https://ollama.example.com/v1aus, setzen Sie den API-Schlüssel auf das echte Token – und das zuvor ignorierte Schlüsselfeld wird zur echten Authentifizierung, ohne dass Änderungen am Client nötig sind. Caddy und Traefik können dieselbe Header-Prüfung oder HTTP-Basic-Authentifizierung mit nur wenigen Zeilen eigener Konfiguration erzwingen; falls Sie bereits eines dieser Tools einsetzen, verwenden Sie es lieber, anstatt nginx zusätzlich einzuführen.
Ändern der Adresse, an der Ollama lauscht: Windows, macOS, Linux
Ein Proxy auf demselben Rechner erfordert keinerlei Änderungen an Ollama. Falls jedoch andere Rechner Ollama direkt erreichen müssen – etwa ein Proxy auf einem anderen Host, Docker-Container oder Clients im LAN – setzen Sie OLLAMA_HOST=0.0.0.0 , damit Ollama auf allen Schnittstellen lauscht. Wie Sie dies konfigurieren, hängt von Ihrer Plattform ab.
Windows
Beenden Sie Ollama über das Symbol in der Windows-Taskleiste. Öffnen Sie die Einstellungen, suchen Sie nach „Umgebungsvariablen“ und wählen Sie „Umgebungsvariablen für Ihr Konto bearbeiten“. Fügen Sie eine Variable namens OLLAMA_HOST mit dem Wert 0.0.0.0hinzu, speichern Sie die Änderung und starten Sie Ollama neu.
macOS
Neuere Desktop-Versionen enthalten in der Ollama-Anwendung selbst einen Einstellungsschalter, um den Dienst im Netzwerk verfügbar zu machen – prüfen Sie daher zunächst die App-Einstellungen. Bei älteren Installationen führen Sie launchctl setenv OLLAMA_HOST "0.0.0.0" aus und starten die Ollama-Anwendung neu.
Linux
Für den systemd-Service, der durch das offizielle Installationsskript installiert wurde, führen Sie sudo systemctl edit ollama.service aus und fügen Folgendes hinzu:
[Service]
Environment="OLLAMA_HOST=0.0.0.0"Führen Sie anschließend sudo systemctl daemon-reload && sudo systemctl restart ollama.
aus. Eine Warnung, bevor Sie diesen Schalter umlegen: 0.0.0.0 auf einem Rechner mit einer öffentlichen IP-Adresse macht Ihre GPU zu einer öffentlichen Ressource. Sperren Sie Port 11434 per Firewall so, dass nur die Hosts darauf zugreifen können, die dies tatsächlich benötigen.
Ollama Cloud: Wo ein echter API-Schlüssel gilt
Ollama Cloud führt Modelle aus, die für die meisten lokalen Hardwarekonfigurationen zu groß sind, auf eigenen GPUs im Rechenzentrum von Ollama. Dies ist der einzige Teil des Ökosystems, der echte API-Schlüssel bietet. Es gibt zwei Zugangswege.
Über die lokale CLI. Ausführen ollama signin , um Ihr ollama.com-Konto zu verbinden, und führen Sie dann cloudbasierte Modelle über deren Cloud-Tags aus – zum Zeitpunkt dieser Abfassung beispielsweise ollama run gpt-oss:120b-cloud. Die Anfragen werden Ihrem Konto zugeordnet; eine manuelle Handhabung von Schlüsseln ist nicht erforderlich.
Direkt über HTTPS. Erstellen Sie im Abschnitt „API-Schlüssel“ der Kontoeinstellungen auf ollama.com einen API-Schlüssel und übermitteln Sie ihn als Bearer-Token. Die gehostete API spiegelt die lokale API wider, wobei https://ollama.com die Basis-URL anstelle von localhost:11434:
curl https://ollama.com/api/chat
-H "Authorization: Bearer $OLLAMA_API_KEY"
-d '{
"model": "gpt-oss:120b",
"messages": [{"role": "user", "content": "Hello"}],
"stream": false
}'Die Auswahl der Cloud-Modelle, die verfügbaren Endpunkte und die Limits der einzelnen Tarife ändern sich im Laufe der Zeit. Daher gilt die offizielle Cloud-Dokumentation von Ollama als maßgebliche Quelle für aktuelle Modellnamen und Kontingente. Wenn Sie entscheiden müssen, ob gehostete Inferenz oder lokale Hardware für Ihre Workload besser geeignet ist, liefert unser Rechner zur Break-even-Analyse zwischen Self-Hosting und API-Nutzung konkrete Zahlen dazu und der VRAM-Rechner zeigt Ihnen, ob ein bestimmtes Modell überhaupt auf Ihre GPU passt.
Die eigentliche Gefahr: Eine nicht authentifizierte Instanz im Internet
Die eigentliche Sicherheitsproblematik rund um den Ollama-API-Schlüssel ist nicht die Platzhalterzeichenfolge in Ihrem Python-Skript – sondern vielmehr die Tausende von Ollama-Servern, die bei weltweiten Internet-Scans regelmäßig ungeschützt auf Port 11434 lauschen. Jeder, der Ihren Server findet, kann kostenlos Inferenzberechnungen auf Ihrer GPU durchführen, Ihre Modelle über /api/tags, auflisten, beliebig viele Modelle herunterladen, bis Ihre Festplatte voll ist, oder sie löschen. Und jede zukünftige Server-Sicherheitslücke wird ohne Anmeldeinformationen ausnutzbar: CVE-2024-37032, eine Remote-Code-Ausführungs-Schwachstelle, die 2024 behoben wurde, ist hierfür ein Präzedenzfall.
- Belassen Sie die Standardeinstellung
127.0.0.1bind, es sei denn, etwas erfordert tatsächlich einen Remote-Zugriff. - Für persönlichen Remote-Zugriff bevorzugen Sie stattdessen einen SSH-Tunnel (
ssh -N -L 11434:127.0.0.1:11434 benutzer@server) oder ein VPN wie WireGuard oder Tailscale, anstatt den Port freizugeben. - Falls der Zugriff öffentlich erforderlich ist, stellen Sie einen authentifizierenden, TLS-terminierenden Reverse-Proxy voran, wie oben gezeigt.
- Halten Sie Ollama stets auf dem neuesten Stand, damit bekannte Sicherheitslücken behoben bleiben.
Häufig gestellte Fragen
Benötigt Ollama einen API-Schlüssel?
Nein. Ein lokaler Ollama-Server verfügt über keine Authentifizierung und bietet auch keine Möglichkeit, diese zu aktivieren. Die einzigen echten Ollama-API-Schlüssel sind für Ollama Cloud bestimmt und werden in Ihrem ollama.com-Konto erstellt.
Was muss ich in das vom Client geforderte Feld für den API-Schlüssel eingeben?
Eine beliebige nicht-leere Zeichenfolge – ollama ist hierbei die Konvention. Diese Anforderung ist rein clientseitig; Ollama verwirft den Header einfach. Falls Sie einen authentifizierenden Reverse-Proxy vor Ollama eingesetzt haben, geben Sie stattdessen dessen tatsächliches Token ein, da OpenAI-kompatible Clients den Schlüssel als Bearer-Token senden, das der Proxy überprüfen kann.
Kann ich Ollama selbst dazu zwingen, einen API-Schlüssel zu verlangen?
Zum jetzigen Zeitpunkt nicht. Es gibt weder eine Umgebungsvariable, noch ein Flag oder eine Konfigurationsoption, die eine Authentifizierung auf dem lokalen Server aktiviert – trotz langjähriger Nutzeranfragen in diese Richtung. Die etablierte Lösung ist der Einsatz eines Reverse-Proxys vor dem Server.
Wie erhalte ich einen Ollama-Cloud-API-Schlüssel?
Erstellen Sie ein Konto auf ollama.com und generieren Sie dort im Abschnitt „API-Schlüssel“ Ihrer Kontoeinstellungen einen Schlüssel. Senden Sie ihn als Authorization: Bearer mit Anfragen an https://ollama.com. Für die CLI-Nutzung verknüpft ollama signin Ihren Rechner automatisch mit Ihrem Konto, ohne dass Sie den Schlüssel manuell verwalten müssen.
Warum löst das OpenAI-SDK bereits vor dem Versenden einer Anfrage einen Authentifizierungsfehler aus?
Das SDK prüft beim Erstellen des Clients, ob ein API-Schlüssel vorhanden ist; ein leerer oder fehlender Schlüssel führt daher bereits lokal zum Fehler – obwohl Ollama dies gar nicht beachten würde. Legen Sie api_key="ollama" (oder eine beliebige Zeichenfolge) fest und stellen Sie sicher, dass die Basis-URL mit /v1.
Ist es sicher, Ollama in meinem Heimnetzwerk freizugeben?
Auf einem vertrauenswürdigen Heim-LAN hinter NAT ist die Freigabe von Ollama mit OLLAMA_HOST=0.0.0.0 eine gängige und sinnvolle Konfiguration. Stellen Sie sicher, dass Ihr Router Port 11434 nicht an diesen Rechner weiterleitet, und bedenken Sie, dass jedes Gerät im Netzwerk – einschließlich der Smartphones von Gästen – dann Ihre Modelle nutzen und verwalten kann.

