Como estão os sistemas da Pegasus
Se alguma coisa parou de responder do seu lado, comece por aqui. Esta página mostra o estado de cada parte da plataforma, o que mudou na sua conta nas últimas semanas e o histórico dos incidentes que já aconteceram — inclusive os feios.
- Motor de IAO endereço que a sua chave usa: /v1/messages e a geração de imagem.Operacionalúltimo incidente: 5 de outubro30 dias atrás93,3% sem incidentehoje
- Painel e chaveEntrar, ver o consumo, copiar e rotacionar a sua chave.Operacional30 dias atrás100,0% sem incidentehoje
- Compra e liberaçãoCheckout por Pix, confirmação do pagamento e abertura da conta.Operacionalúltimo incidente: 9 de setembro30 dias atrás96,7% sem incidentehoje
- SiteAs páginas públicas, incluindo esta.Operacional30 dias atrás100,0% sem incidentehoje
- Respostas em branco em parte das conversas5 de outubro
Em parte das conversas — principalmente as que tinham um print ou uma imagem colada, e nos horários de mais procura — o aplicativo recebia uma resposta vazia e parava sem dizer nada. Acontecia quando o modelo principal estava ocupado e os modelos de reserva recusavam o pedido sem avisar direito, então a suíte não sabia que precisava trocar. Corrigido na noite de 05/10: a suíte agora percebe essa recusa e troca de modelo na hora; os modelos que não leem imagem recebem um aviso no lugar dela e respondem normalmente; e, se mesmo assim nenhuma resposta ficar pronta a tempo, o aplicativo recebe o motivo e tenta de novo sozinho, em vez de uma resposta em branco.
corrigido em 05/10 - "Janela de contexto cheia" com projetos grandes, mesmo com 1M ligado2 de outubro
Quem abria um projeto grande via o aplicativo avisar que a janela de contexto estava cheia e resumir a conversa a toda hora, mesmo com a opção de 1M ligada. Eram duas coisas somadas: o aplicativo tratava os nossos modelos como janela de 200 mil tokens, porque o passo a passo não dizia a ele que a janela grande existia, e o nosso servidor recusava conversas acima de uns 250 mil tokens. Corrigido em 05/10: o motor aceita conversas de até 1M de tokens, e o passo a passo do painel agora configura o aplicativo para usar a janela grande.
corrigido em 05/10 - Respostas travando no meio, e "servidor ocupado" sem motivo2 de outubro
Algumas respostas paravam de ser escritas no meio, e outras devolviam "servidor ocupado" ou ficavam com o cursor piscando sem fim. Eram três coisas somadas: um limite interno de espera que cortava a resposta enquanto ela ainda estava sendo escrita, um modelo que podia encerrar sem escrever nada e, nesse caso, não era substituído pelo seguinte, e nenhum teto para o caso de o fornecedor abrir a conexão e emudecer. Os três foram corrigidos no mesmo dia: a espera agora vale só até a resposta começar, a suíte troca de modelo sozinha quando um deles não responde, e silêncio prolongado encerra a mensagem com o que já foi escrito em vez de deixar você esperando.
corrigido no mesmo dia - Planos Max e Enterprise não geravam Pix9 de setembro
A conta do provedor de Pix tinha teto de R$ 150 por cobrança, então só o Pro passava. A tela ainda culpava o e-mail digitado, o que não ajudava ninguém. Trocamos de provedor no mesmo dia e os três planos voltaram a vender.
corrigido no mesmo dia - Compra recusada por espaço no e-mail9 de setembro
Um espaço invisível acrescentado pelo teclado do celular fazia o checkout recusar e-mails corretos. O campo passou a aparar as pontas nos dois lados.
corrigido no mesmo dia - Motor respondendo 50320 de agosto
Uma versão antiga do serviço ficou no ar depois de um deploy que não subiu. Todas as chamadas foram recusadas até o deploy ser refeito.
algumas horas
Tempo de resposta dos modelos
Medimos cada modelo da suíte com uma chamada real, igual à sua. Última medição: 06/10 às 21h.
- Pegasus Ultrarespondendo, porém mais devagar que o normal60,7 smais lento30 dias atrás43% dos dias medidos sem lentidãohoje
- Pegasus Thinkingrespondendo, porém mais devagar que o normal60,7 smais lento30 dias atrás71% dos dias medidos sem lentidãohoje
- Pegasus Speedrespondendo, porém mais devagar que o normal60,7 smais lento30 dias atrás71% dos dias medidos sem lentidãohoje
O tempo é o da resposta completa de uma pergunta curta com uso de ferramenta. Pedidos maiores levam mais — o que esta tabela mostra é se o motor está no ritmo dele.
O que mudou para você
Manutenções e melhorias que já valem na sua conta, sem você precisar fazer nada.
- Melhoria5 de outubroConversa grande demais recebe um aviso claro, em vez de ficar tentando
Quando uma mensagem sozinha passa do limite de 1 milhão de tokens, ou quando o modelo falha seguidas vezes numa conversa muito grande, a Pegasus responde dizendo o que fazer — dividir o arquivo, resumir com /compact ou começar de novo com /clear — e avisa o aplicativo para não repetir sozinho. Antes, ele podia passar muitos minutos resumindo e reenviando a mesma conversa.
- Melhoria5 de outubro1M de tokens de contexto nos modos Ultra, Thinking e Speed
Projetos e conversas grandes cabem inteiros: até 1 milhão de tokens. Para usar, refaça a configuração pelo passo a passo do painel — é ele que avisa o aplicativo de que a janela grande existe. Quando a conversa passar do limite, o aplicativo resume as mensagens antigas sozinho e continua, em vez de receber "servidor ocupado" e tentar de novo.
- Melhoria5 de outubroKimi K3 passa a responder primeiro
Ultra, Thinking e Speed começam pelo Kimi K3. Se ele estiver ocupado ou devolver uma resposta inválida, o GLM 5.3 assume na hora, antes de qualquer coisa aparecer na sua tela. O Flash ganhou um modelo próprio, mais rápido, para as tarefas de bastidor.
- Melhoria2 de outubroA suíte passa para o próximo modelo sem você pedir
Quando o modelo que ia atender está ocupado, lento para começar ou encerra sem escrever, o próximo da suíte assume na hora — antes de qualquer coisa aparecer na sua tela. Você continua vendo uma resposta só, e a troca não interrompe o que estava sendo escrito.
- Melhoria2 de outubroResposta interrompida chega até onde deu, em vez de virar erro
Se a conexão com o modelo cair com a resposta pela metade, você fica com o texto que já tinha saído e a mensagem é encerrada marcada como incompleta — dá para pedir a continuação. Antes o trecho era descartado e a ferramenta tentava tudo de novo.
- Manutenção10 de setembroManutenção programada no motor
Janela das 18h às 22h, no horário de São Paulo, concluída. O motor seguiu atendendo durante toda a janela e nenhuma requisição foi recusada por causa dela.
- Melhoria26 de agostoContexto repetido passou a ser reaproveitado por uma hora
Antes o reaproveitamento durava cinco minutos. Em sessão longa — o dia inteiro no mesmo projeto — isso reduz bastante o que cada requisição consome da sua franquia.
Está com problema e não vê nada aqui?
Então provavelmente é um caso isolado, e a gente quer saber. Traga o horário aproximado e a mensagem de erro que apareceu — com os dois, a resposta vem na primeira ida e volta.
Quem já é cliente vê o consumo de cada requisição — inclusive as que deram erro — em Painel · Consumo.