„Fehler im Nachrichtenstrom“ erscheint, wenn die Verbindung, über die ChatGPT seine Antwort Stück für Stück ausliefert, abbricht, bevor die Antwort vollständig ist. An Ihrer Eingabe liegt es so gut wie nie: Ursache sind fast immer eine Überlastung auf OpenAI-Seite, eine instabile Leitung, eine Browser-Erweiterung oder ein zu lang gewordener Chat. Ein Regenerieren der Antwort behebt die Mehrzahl der Fälle — und wenn nicht, sagt Ihnen ein einziger Blick auf die Statusseite, ob das Problem überhaupt bei Ihnen liegt.
Die Fehlermeldung
Fehler im Nachrichtenstrom
(Gleiche Störung, andere Formulierungen: „Streaming unterbrochen.
Warte auf die vollständige Nachricht", „Hmm...da ist wohl etwas
schiefgelaufen." Symptom ist immer dasselbe — die Antwort bleibt
mitten im Satz stehen und wird nie fertig.)Ursachen und Abhilfe auf einen Blick
| Ursache | Abhilfe |
|---|---|
| Überlastung oder Störung auf OpenAI-Seite. Trifft alle Tarife gleichzeitig, auch Plus und Pro, und ist die wahrscheinlichste Ursache, wenn der Fehler im Minutentakt wiederkehrt. | status.openai.com prüfen. Während einer Störung ändert keine Einstellung auf Ihrer Seite etwas — abwarten ist die Lösung. |
| Instabile Verbindung: Wechsel zwischen WLAN und Mobilfunk, VPN oder Firmen-Proxy, schwacher Empfang. Streaming hält eine einzige lange Verbindung offen und reißt dort ab, wo ein normaler Seitenaufruf noch durchkommt. | VPN oder Proxy abschalten und über eine andere Leitung erneut versuchen (WLAN ⇄ Mobilfunk). |
| Browser-Umgebung: eine Erweiterung, die in die Seite eingreift, ein veralteter Cache oder eine abgelaufene Sitzung. | Im privaten Fenster erneut versuchen. Funktioniert es dort, liegt es an einer Erweiterung oder am Cache — Erweiterungen deaktivieren, Websitedaten löschen, neu anmelden. |
| Der Chat ist zu lang oder die Anhänge zu groß. Jeder Zug schickt den gesamten Verlauf erneut mit, die Generierung dauert länger und bricht eher ab. | Die wichtigsten Punkte in einen neuen Chat übernehmen. Große Dateien aufteilen statt komplett anzuhängen. |
Die drei Handgriffe für die ersten 90 Sekunden
Antwort neu generieren → Seite neu laden (in der App vollständig beenden und neu starten) → abmelden und wieder anmelden. Ein einmalig abgerissener Stream ist mit einem dieser drei Schritte erledigt, und einmalig ist der Normalfall. Bricht es dagegen jedes Mal an derselben Stelle ab, ist das ein Hinweis darauf, dass eine der konkreten Ursachen unten vorliegt und kein Zufall.
Zuerst klären, ob es überhaupt an Ihnen liegt
Das ist der Schritt, den die übrigen Anleitungen überspringen, und der die meiste Zeit spart. status.openai.com öffnen. Steht dort eine laufende Störung, hilft keine lokale Einstellung und Warten ist die einzige Lösung. Steht dort nichts, liegt die Ursache bei Ihnen und der nächste Schritt grenzt sie ein. Wer diesen Check vor dem Herumstellen macht, verbringt keine zwanzig Minuten mit Cache-Löschen während eines Ausfalls.
Die lokale Ursache von außen nach innen eingrenzen
In dieser Reihenfolge vorgehen, denn jede Stufe schließt alles darüber aus: (1) VPN und Proxy abschalten; (2) privates Fenster öffnen — das entfernt Erweiterungen und Cache in einem Zug; (3) anderer Browser oder anderes Gerät; (4) Netz wechseln. Die Stufe, ab der es wieder läuft, ist die Ursache. Tritt der Fehler nur in langen Chats auf, ist keine der vier schuld — dann die Kernpunkte in einen neuen Chat übernehmen.
Für Entwickler: derselbe Abbruch an der API
Bei einem Aufruf mit stream: true erscheint dieselbe Störung als Server-Sent-Events-Verbindung, die ohne finish_reason endet. Der HTTP-Status ist 200 — beim Senden der Header war ja alles in Ordnung —, eine reine Statuscode-Prüfung erkennt den Abbruch also nicht; unter Last kommen zusätzlich 429 und 529 overloaded_error. Drei Dinge machen das überlebbar: (1) einen ohne finish_reason beendeten Stream als wiederholbar behandeln, nicht als fertige Antwort; (2) bei 429, 500 und 529 mit exponentiellem Backoff plus Jitter erneut versuchen; (3) hinter einem Proxy dessen Idle-Timeout prüfen und Response-Buffering abschalten — ein puffernder Proxy macht aus einem funktionierenden Stream eine lange Blockade. Zum Eingrenzen zuerst ohne Proxy streamen:
# Direkt streamen, kein Proxy dazwischen, und beobachten, wo es abbricht.
curl -N https://api.kunavo.com/v1/chat/completions \
-H "Authorization: Bearer $KUNAVO_API_KEY" \
-H "content-type: application/json" \
-d '{"model":"claude-sonnet-4-6","stream":true,
"max_tokens":300,
"messages":[{"role":"user","content":"Zähle langsam von 1 bis 20"}]}'Wenn Sie über Kunavo aufrufen
Kunavo ist ein AI-API-Gateway und behandelt abgerissene Streams als Betriebszustand, nicht als Ausnahme. Sind für ein Modell mehrere Upstream-Kanäle konfiguriert und schlägt der erste Versuch fehl, wird dieselbe Anfrage innerhalb desselben Aufrufs über einen anderen Kanal wiederholt — eine vorübergehende Störung oben wird damit zu einem etwas langsameren Erfolg statt zu einem Fehler. Fehlgeschlagene Anfragen werden nie abgerechnet. Weil GPT, Claude und Gemini über einen einzigen Schlüssel erreichbar sind, genügt bei einem überlasteten Modell ein anderer Modellname statt einer zweiten Integration. Das Retry- und Backoff-Muster für den Streaming-Fall steht ausgeschrieben in LLM API streaming errors.
Häufige Fragen
Ist „Fehler im Nachrichtenstrom“ mein Fehler?
Praktisch nie. Die Meldung besagt, dass die Verbindung, die die Antwort transportiert, unterbrochen wurde, bevor die Antwort fertig war. Ihre Eingabe löst das nicht aus. Ursachen sind Last auf OpenAI-Seite, eine instabile Leitung, eine Browser-Erweiterung oder abgelaufene Sitzung, oder ein Chat, der so lang geworden ist, dass Antworten in ein Timeout laufen.
Was tun, wenn Neu-Generieren nicht hilft?
Zuerst status.openai.com prüfen — während einer Störung hilft nichts Lokales. Liegt keine Störung vor, die Seite in einem privaten Fenster über ein anderes Netz öffnen: dieser eine Test entfernt Erweiterungen, Cache und Ihre gewohnte Leitung gleichzeitig. Läuft es dort, alles einzeln wieder zuschalten, bis es erneut bricht. Bricht es überall und nur in einem einzigen langen Chat, die Kernpunkte in einen neuen Chat übernehmen.
Tritt das auch bei anderen KI-Chats auf?
Die Formulierung stammt von ChatGPT, aber jeder Assistent, der Antworten streamt, kann genauso abreißen. Claude zeigt eine Meldung darüber, dass die Antwort nicht vollständig erzeugt werden konnte; beim direkten API-Aufruf erscheint es als SSE-Stream, der ohne finish_reason endet, oder unter Last als 529 overloaded_error.
Warum passiert das in langen Unterhaltungen häufiger?
Jeder Zug schickt den gesamten Verlauf erneut mit, eine lange Unterhaltung bedeutet also eine längere Generierung auf einer einzigen offenen Verbindung. Je länger diese Verbindung offen steht, desto mehr Gelegenheiten hat ein Proxy-Timeout, ein Netzwechsel oder ein Aussetzer oben, sie zu zerreißen. Ein frischer Chat mit einer Zusammenfassung des Wesentlichen bringt meist mehr als jede Browser-Einstellung.
Verwandte Anleitungen
- LLM streaming errors — SSE cutoffs, hanging streams and missing usage
- Claude API 529 overloaded_error — was der Fehler heißt und wie Sie ihn aussitzen
- Gemini API Preise 2026 — Tarife pro Modell, rund 70% unter Googles Liste
Die vollständige Fehlersemantik steht in der Fehlerreferenz; einen Schlüssel bekommen Sie in einer Minute über Konto anlegen und die Authentifizierungs-Dokumentation.