Status

Como estão os sistemas da Pegasus

Se alguma coisa parou de responder do seu lado, comece por aqui. Esta página mostra o estado de cada parte da plataforma, o que mudou na sua conta nas últimas semanas e o histórico dos incidentes que já aconteceram — inclusive os feios.

Sistemas operando normalmentePágina revisada em 6 de outubro de 2026. Não é monitoramento automático: é o que quem opera a plataforma conferiu e assinou.
  • Motor de IAO endereço que a sua chave usa: /v1/messages e a geração de imagem.Operacional
    último incidente: 5 de outubro
    30 dias atrás93,3% sem incidentehoje
  • Painel e chaveEntrar, ver o consumo, copiar e rotacionar a sua chave.Operacional
    30 dias atrás100,0% sem incidentehoje
  • Compra e liberaçãoCheckout por Pix, confirmação do pagamento e abertura da conta.Operacional
    último incidente: 9 de setembro
    30 dias atrás96,7% sem incidentehoje
  • SiteAs páginas públicas, incluindo esta.Operacional
    30 dias atrás100,0% sem incidentehoje
OperandoInstávelFora do arCada traço é um dia. Mais verde, mais operação.

Tempo de resposta dos modelos

Medimos cada modelo da suíte com uma chamada real, igual à sua. Última medição: 06/10 às 21h.

  • Pegasus Ultrarespondendo, porém mais devagar que o normal60,7 smais lento
    30 dias atrás43% dos dias medidos sem lentidãohoje
  • Pegasus Thinkingrespondendo, porém mais devagar que o normal60,7 smais lento
    30 dias atrás71% dos dias medidos sem lentidãohoje
  • Pegasus Speedrespondendo, porém mais devagar que o normal60,7 smais lento
    30 dias atrás71% dos dias medidos sem lentidãohoje

O tempo é o da resposta completa de uma pergunta curta com uso de ferramenta. Pedidos maiores levam mais — o que esta tabela mostra é se o motor está no ritmo dele.

O que mudou para você

Manutenções e melhorias que já valem na sua conta, sem você precisar fazer nada.

  1. Melhoria5 de outubro
    Conversa grande demais recebe um aviso claro, em vez de ficar tentando

    Quando uma mensagem sozinha passa do limite de 1 milhão de tokens, ou quando o modelo falha seguidas vezes numa conversa muito grande, a Pegasus responde dizendo o que fazer — dividir o arquivo, resumir com /compact ou começar de novo com /clear — e avisa o aplicativo para não repetir sozinho. Antes, ele podia passar muitos minutos resumindo e reenviando a mesma conversa.

  2. Melhoria5 de outubro
    1M de tokens de contexto nos modos Ultra, Thinking e Speed

    Projetos e conversas grandes cabem inteiros: até 1 milhão de tokens. Para usar, refaça a configuração pelo passo a passo do painel — é ele que avisa o aplicativo de que a janela grande existe. Quando a conversa passar do limite, o aplicativo resume as mensagens antigas sozinho e continua, em vez de receber "servidor ocupado" e tentar de novo.

  3. Melhoria5 de outubro
    Kimi K3 passa a responder primeiro

    Ultra, Thinking e Speed começam pelo Kimi K3. Se ele estiver ocupado ou devolver uma resposta inválida, o GLM 5.3 assume na hora, antes de qualquer coisa aparecer na sua tela. O Flash ganhou um modelo próprio, mais rápido, para as tarefas de bastidor.

  4. Melhoria2 de outubro
    A suíte passa para o próximo modelo sem você pedir

    Quando o modelo que ia atender está ocupado, lento para começar ou encerra sem escrever, o próximo da suíte assume na hora — antes de qualquer coisa aparecer na sua tela. Você continua vendo uma resposta só, e a troca não interrompe o que estava sendo escrito.

  5. Melhoria2 de outubro
    Resposta interrompida chega até onde deu, em vez de virar erro

    Se a conexão com o modelo cair com a resposta pela metade, você fica com o texto que já tinha saído e a mensagem é encerrada marcada como incompleta — dá para pedir a continuação. Antes o trecho era descartado e a ferramenta tentava tudo de novo.

  6. Manutenção10 de setembro
    Manutenção programada no motor

    Janela das 18h às 22h, no horário de São Paulo, concluída. O motor seguiu atendendo durante toda a janela e nenhuma requisição foi recusada por causa dela.

  7. Melhoria26 de agosto
    Contexto repetido passou a ser reaproveitado por uma hora

    Antes o reaproveitamento durava cinco minutos. Em sessão longa — o dia inteiro no mesmo projeto — isso reduz bastante o que cada requisição consome da sua franquia.

Está com problema e não vê nada aqui?

Então provavelmente é um caso isolado, e a gente quer saber. Traga o horário aproximado e a mensagem de erro que apareceu — com os dois, a resposta vem na primeira ida e volta.

Quem já é cliente vê o consumo de cada requisição — inclusive as que deram erro — em Painel · Consumo.

Chamar no WhatsApp