Voltar aos guias
Troubleshooting·15 de setembro de 2026·6 min de leitura

“Erro no fluxo de mensagens” no ChatGPT — causas e como resolver

“Erro no fluxo de mensagens” aparece quando a conexão pela qual o ChatGPT entrega a resposta aos poucos cai antes de a resposta terminar. Quase nunca é culpa do que você escreveu: as causas de sempre são sobrecarga do lado da OpenAI, um link instável, uma extensão do navegador ou uma conversa que ficou longa demais. Regerar a resposta resolve a maioria dos casos; quando não resolve, uma única checagem diz se o problema é seu.

“Erro no fluxo de mensagens” aparece quando a conexão pela qual o ChatGPT entrega a resposta aos poucos cai antes de a resposta terminar. Quase nunca é culpa do que você escreveu: as causas de sempre são sobrecarga do lado da OpenAI, um link instável, uma extensão do navegador ou uma conversa que ficou longa demais. Regerar a resposta resolve a maioria dos casos; quando não resolve, uma única checagem diz se o problema é seu.

O erro

exibido na conversa do ChatGPT
Erro no fluxo de mensagens

(A mesma falha com outras redações: “Transmissão interrompida.
 Aguardando a mensagem completa”, “Hmm...parece que algo deu
 errado.” O sintoma é o mesmo — a resposta para no meio e nunca
 termina.)

Causas e correções em resumo

CausaCorreção
Sobrecarga ou incidente do lado da OpenAI. Atinge todos os planos ao mesmo tempo, Plus e Pro inclusive, e é a causa mais provável quando o erro se repete a cada poucos minutos.Confira status.openai.com. Durante um incidente, nada do que você mudar por aqui altera o resultado — esperar é a solução.
Conexão instável: troca entre Wi-Fi e dados, VPN ou proxy corporativo, sinal móvel fraco. O streaming segura uma única conexão aberta por muito tempo, então quebra onde um carregamento de página comum passaria.Desligue a VPN ou o proxy e tente de novo por outro link (Wi-Fi ⇄ dados móveis).
Ambiente do navegador: uma extensão que se injeta na página, cache velho ou sessão expirada.Tente de novo numa janela anônima. Se funcionar ali, a causa é extensão ou cache — desative extensões, limpe os dados do site, entre de novo.
A conversa está longa demais ou os anexos pesados demais. Cada turno reenvia o histórico inteiro, então a geração demora mais e cai com mais facilidade.Leve os pontos principais para um chat novo. Divida arquivos grandes em vez de anexá-los inteiros.

Os três gestos dos primeiros 90 segundos

Regerar a resposta → recarregar a página (no celular, fechar o aplicativo por completo e abrir de novo) → sair da conta e entrar de novo. Uma queda pontual é resolvida por um desses três, e pontual é o caso normal. Se, em vez disso, parar exatamente no mesmo ponto toda vez, isso é sinal de que uma das causas específicas abaixo está agindo, e não um acaso.

Decidir primeiro se o problema é seu

Esta é a etapa que as outras listas de solução pulam, e a que mais economiza tempo. Abra status.openai.com. Se houver um incidente em andamento, nenhum ajuste local muda nada e esperar é a única saída. Se não houver nada listado, a causa é local e a etapa seguinte a delimita. Fazer essa checagem antes de mexer em configurações evita passar vinte minutos limpando cache durante uma queda.

Isolar a causa local de fora para dentro

Siga nesta ordem, porque cada camada descarta tudo o que está acima: (1) desligar VPN e proxy; (2) abrir uma janela anônima — isso remove extensões e cache de uma vez só; (3) testar outro navegador ou outro aparelho; (4) trocar de rede. A camada a partir da qual volta a funcionar é a causa. Se o erro só aparece em conversas longas, nenhuma das quatro é a culpada: leve o essencial para um chat novo.

Para desenvolvedores: a mesma queda na API

Chamando a API com stream: true, essa mesma falha chega como uma conexão Server-Sent Events que termina sem finish_reason. O status HTTP é 200 — estava tudo bem quando os cabeçalhos foram enviados —, então checar só o código de status não pega; sob carga aparecem ainda 429 e 529 overloaded_error. Três coisas tornam isso sobrevivível: (1) tratar um stream que terminou sem finish_reason como passível de nova tentativa, não como resposta completa; (2) repetir 429, 500 e 529 com backoff exponencial mais jitter; (3) se houver proxy no caminho, verificar o idle timeout dele e desligar o buffering de respostas — um proxy que bufferiza transforma um stream que funciona num travamento longo. Para delimitar, transmita primeiro sem proxy:

stream-test.sh
# Transmitir direto, sem proxy no caminho, e ver onde para.
curl -N https://api.kunavo.com/v1/chat/completions \
  -H "Authorization: Bearer $KUNAVO_API_KEY" \
  -H "content-type: application/json" \
  -d '{"model":"claude-sonnet-4-6","stream":true,
       "max_tokens":300,
       "messages":[{"role":"user","content":"conte devagar de 1 a 20"}]}'

Se você chama pela Kunavo

A Kunavo é um gateway de API de IA, e um stream interrompido lá é um estado previsto de operação, não uma exceção. Quando um modelo tem mais de um canal de origem configurado e a primeira tentativa falha, a requisição é repetida por outro canal dentro da mesma chamada — um problema passageiro lá em cima vira um sucesso um pouco mais lento em vez de um erro. Requisições que falham nunca são cobradas. Como GPT, Claude e Gemini são alcançáveis com uma única chave, contornar um modelo sobrecarregado é trocar o nome do modelo, não a integração. O padrão de repetição e backoff para o caso do streaming está detalhado em LLM API streaming errors.

Perguntas frequentes

“Erro no fluxo de mensagens” é culpa minha?

Quase nunca. A mensagem diz que a conexão que levava a resposta foi cortada antes de ela terminar. O que você escreveu não provoca isso. As causas são carga do lado da OpenAI, uma rede instável, uma extensão do navegador ou sessão expirada, ou uma conversa que ficou longa a ponto de as respostas estourarem o tempo.

E se regerar não resolver?

Confira primeiro status.openai.com — durante um incidente, nada local ajuda. Se não houver incidente, abra uma janela anônima em outra rede: esse único teste remove extensões, cache e o seu link de sempre de uma vez. Se funcionar ali, recoloque cada peça até quebrar de novo. Se falhar em tudo e só numa conversa longa, leve o essencial para um chat novo.

Acontece com outras IAs também?

A redação é do ChatGPT, mas qualquer assistente que entregue respostas em streaming pode cair do mesmo jeito. O Claude mostra uma mensagem dizendo que não conseguiu gerar a resposta completa; numa chamada direta à API isso aparece como um fluxo SSE que termina sem finish_reason, ou sob carga como um 529 overloaded_error.

Por que acontece mais em conversas longas?

Cada turno reenvia o fio inteiro, então uma conversa longa significa uma geração mais longa sustentada por uma única conexão aberta. Quanto mais tempo essa conexão fica aberta, mais chances um timeout de proxy, uma troca de rede ou um soluço lá em cima têm de rompê-la. Começar um chat novo com um resumo do que importa costuma render mais do que qualquer ajuste de navegador.

Guias relacionados

A semântica completa dos erros está na referência de erros; para obter uma chave, basta criar uma conta e seguir a documentação de autenticação.