Chat sem botão de enviar: o modelo responde enquanto você digita
O experimento inverte a interface padrão de LLM disparando streaming a cada pausa de 350ms, um padrão de UX que times de produto podem copiar para reduzir latência percebida. Também levanta a conta óbvia: mais chamadas abortadas significam mais tokens queimados, algo relevante para quem opera com câmbio desfavorável.
