Referência rápida dos modos de cobrança
Um guia de comparação rápida para escolher entre os modos de faturamento Preenchimentos do usuário e Uso por modelo.Comparação Rápida
Quando usar cada modo
Modo de conclusão do usuário
Escolha isto quando:- ✅ Você quer custos fixos e previsíveis
- ✅ Você está dentro dos limites de licença existentes
- ✅ Você está construindo ferramentas internas
- ✅ Você deseja usar as alocações de cotas existentes
- ✅ Você precisa de um gerenciamento de custos simples
- Chatbots internos
- Desenvolvimento e testes
- Aplicações de baixo volume
- Projetos com orçamento fixo
Uso por modo de modelo
Escolha isto quando:- ✅ Você precisa de rastreamento detalhado de custos
- ✅ Você usa modelos caros com frequência
- ✅ Você deseja pagar apenas pelo uso real
- ✅ Você precisa de análises granulares de uso
- ✅ Você tem requisitos de alto volume
- Aplicações de produção
- Serviços de IA de alto volume
- Projetos sensíveis ao custo
- Aplicações multimodelos
Uso da API
Ao usar a API externa com modos de faturamento:Limites de taxa
Limites de taxa padrão
- Solicitações por minuto: 60 (configurável)
- Solicitações por hora: 1.000 (configurável)
- Limites diários: 100 solicitações (configuráveis)
- Limites mensais: 10.000 solicitações (configuráveis)
Limites Específicos do Modo de Faturamento
- Conclusões do usuário: com base na cota de licença
- Uso por modelo: limites adicionais baseados em dólares
Integração de políticas SMLTP
Ambos os modos de cobrança oferecem suporte à aplicação da política SMLTP:Exemplo de configuração SMLTP
Exemplos de configuração
Configuração de conclusões do usuário
Uso por configuração de modelo
Cenários de erro
Erros de conclusão do usuário
Uso por erros de modelo
Guia de migração
Das conclusões do usuário ao uso por modelo
-
Ativar uso por modelo para o usuário
-
Atualizar configuração da chave API
-
Monitore o uso e os custos
- Rastrear o uso de tokens
- Monitorar gastos mensais
- Ajuste os limites conforme necessário
Do uso por modelo às conclusões do usuário
-
Verifique se o usuário tem cota suficiente
- Verifique o nível de licença
- Verifique os limites mensais
-
Atualizar configuração da chave API
-
Monitore o uso da conclusão
- Acompanhar contagens de conclusão
- Garantir que o comportamento de fallback funcione
Estimativa de custos
Custos de conclusão do usuário
- Custo fixo: com base no nível de licença
- Sem custos adicionais: além da licença existente
- Previsível: igual ao uso da interface web
Custos de uso por modelo
- Custo variável: com base no uso do token
- Preços específicos do modelo: taxas diferentes por modelo
- Exemplos de custos:
- GPT-5.1: aplica-se o preço do provedor
- Claude Sonnet 4.6: aplica-se o preço do fornecedor
- GPT-5 Nano: aplica-se o preço do provedor
Dicas de monitoramento
Monitoramento de conclusões do usuário
- Acompanhe contagens de conclusão diariamente
- Monitorar o consumo de cotas
- Definir alertas para limites próximos
- Revise os padrões de uso mensalmente
Uso por monitoramento de modelo
- Acompanhe o uso e os custos do token
- Monitorar gastos mensais
- Definir alertas de limite em dólares
- Revise o detalhamento dos custos por modelo
Considerações de segurança
Ambos os modos
- Use restrições de IP para aplicativos confidenciais
- Gire as chaves de API regularmente
- Monitore atividades incomuns
- Implementar tratamento adequado de erros
Uso por modelo específico
- Definir limites de dólares apropriados
- Monitore picos de custos
- Revise os padrões de uso do modelo
- Rastreie o uso de modelos caros
Recursos de suporte
Documentação
- Visão geral dos modos de faturamento
- Limites e Cotas - Entenda os limites da plataforma
Painel de administração
- Seção APIs: Criar e gerenciar chaves de API
- Seção Usuários: Habilitar uso por modelo
Problemas comuns
- O uso por modelo não funciona: verifique as permissões do usuário
- Cota excedida: Habilite o uso por modelo ou aumente os limites
- Picos de custos: analise o uso do modelo e defina limites
- Erros de autenticação: verifique a chave e as permissões da API

