Pular para o conteúdo principal

Limite de requisições de IA

A aba AI request ceiling da tela Sistema. Ela controla a velocidade máxima com que as requisições pagas ao provedor de IA podem ser feitas, para que uma única pessoa — ou uma tela fora de controle — não consuma o orçamento do mês inteiro em uma tarde.

A contagem é feita por conta, não por endereço de rede: tudo isso acontece após o login, portanto o endereço não identifica ninguém. Acima do limite, a requisição é recusada com uma mensagem informando quando tentar novamente, e nenhum valor é cobrado por ela.

Requisições por minuto

Requests per minute per account é o limite em si: um número inteiro maior ou igual a zero. O valor padrão é 120, bem acima do uso comum — para ter uma ideia da escala, «traduzir para todos os idiomas» envia cerca de seis requisições ao mesmo tempo, a geração de imagens em massa chega a aproximadamente seis por minuto, e um lote de avaliações de loja gera de oito a vinte e quatro por minuto.

Zero desativa o limite — as requisições deixam de ser contadas. Qualquer valor que não seja um número inteiro de 0 ou mais é recusado com Enter a whole number of 0 or more (zero switches the ceiling off)..

Uma alteração entra em vigor na próxima requisição; não é necessário reiniciar.

O que o limite cobre

What the ceiling covers tem duas opções:

  • Every paid request — todas as requisições pagas. Este é o valor padrão.
  • Push campaigns only — somente campanhas push.

A opção padrão «todas as requisições pagas» é intencional: as campanhas push não são o único destino do dinheiro, e um limite que cubra apenas elas deixaria o caminho mais caro — o assistente — sem controle.

O limite atua no único ponto pelo qual toda requisição de IA passa, e não em telas individuais. Por isso, ele também cobre as requisições feitas pelas próprias ferramentas do assistente, e não apenas as feitas por uma pessoa ao pressionar um botão.

O que fica fora do limite

Dois caminhos não são limitados, cada um por seu próprio motivo:

  • A análise agendada de criativos. Nenhuma pessoa está por trás dela, e ela regula o próprio ritmo a cada execução. Os custos dela ainda aparecem na visão geral de gastos com IA.
  • A transformação de texto em vetores para busca por significado. Essa é uma camada separada com sua própria configuração — veja Busca semântica. Por padrão, os vetores são calculados neste servidor e nada é pago externamente, portanto isso não aparece nem no limite nem no registro de gastos.

A transcrição de uma mensagem de voz, por outro lado, está dentro do limite: ela é contabilizada para quem enviou a mensagem, sob o mesmo teto que todo o restante. Quando não é possível associar o remetente a uma conta, o reconhecimento na nuvem é recusado e essa mensagem não recebe transcrição; o motor executado neste servidor não custa nada, portanto nessa posição ele transcreve mesmo assim.

Pressione Salvar para salvar ambas as configurações ao mesmo tempo. Pressionar sem nenhuma alteração responde com Sem alterações.

Próximos passos