
Estudos
09 de set. de 2026
Os 10 segundos de silêncio — quando o modelo pensa e devolve o nada
Chamada LLM termina em 200 OK com content vazio, a fila segue e ninguém reclama. Diagnóstico: reasoning models gastam o budget de tokens pensando e sobra zero pra resposta. Os consertos: teto de tokens com margem e parser que aceita SSE sujo.
Continuar lendo →
