Alterações no Modelo OpenAI - Guia de Custos e Utilização
- Introdução
- Relação Custo/Precisão
- Níveis de Custo dos Modelos (Do Mais Alto Ao Mais Baixo)
- Acessível
- Caro
- Ultra Caro (Não Exposto)
- Modelos Obsoletos
- Por Que Está Sendo Descontinuado?
- Modelos de Transcrição (Transcrição PABX)
- APIs de EndPoint de Gravação de Chamadas Utilizadas
- Modelos
- Modelos de Texto e Análise (Análise PABX)
- Resumo/Sentimento APIs de EndPoint Utilizadas
- Modelos
- Modelos Em Tempo Real (Chamadas Ao Vivo e Agentes de IA)
- Terminal de Chamadas
- Modelos
- Terminal de Texto
- Modelos
Introdução
Este guia explica a gama de modelos OpenAI disponíveis, seus custos associados e como cada um deve ser usado para chamadas PABX, transcrição, análise e agentes de IA. Os principais objetivos deste guia podem ser resumidos da seguinte forma:
- Reduzir os custos operacionais
- Padronizar os padrões
- Tornar a seleção de modelos previsível e explicável
Para usuários que desejam comparar os modelos e preços da OpenAI com mais detalhes, a OpenAI fornece uma página de referência oficial:https://developers.openai.com/api/docs/models
Relação Custo/Precisão
Modelos menores são mais baratos e menos precisos.
- “nano” < “mini” < base < versionado < pro
Essa regra se aplica a todas as famílias de modelos da OpenAI.
Níveis de Custo dos Modelos (Do Mais Alto Ao Mais Baixo)
Acessível
Esses modelos são seguros para cargas de trabalho PABX de alto volume, como resumos de chamadas, análise de sentimentos e notas de CRM.
Modelo | Nível de Custo | Uso Pretendido |
gpt-5-nano | Mais Baixo | Volume extremamente alto, tarefas simples |
gpt-4.1-nano | Muito Baixo | Compatibilidade com versões anteriores |
gpt-5-mini | Baixo | Modelo padrão – melhor custo/benefício |
gpt-5 | Médio | Melhor raciocínio quando necessário |
O gpt-5-mini é definido como padrão, pois oferece a melhor relação qualidade/custo.
Caro
Esses modelos só devem ser usados quando for explicitamente necessária uma maior precisão ou raciocínio.
Modelo | Nível de Custo | Observações |
gpt-5.1 | Alto | Resumos avançados, auditorias de Controle de Qualidade |
gpt-5.2 | Muito alto | Apenas análises de alto valor |
Ultra Caro (Não Exposto)
Esses modelos podem gerar custos muito altos e, no momento, não estão expostos.
Modelo | Nível de Custo |
gpt-5-pro | Muito Alto |
gpt-5.2-pro | Muito Alto |
Observação: esses modelos podem ser disponibilizados no futuro, caso os preços se tornem mais acessíveis.
Modelos Obsoletos
Os modelos a seguir estão sendo descontinuados pela OpenAI, que está investindo em arquiteturas mais novas e eficientes. Eles já começaram a ser removidos do ChatGPT e serão descontinuados nos próximos meses:
- gpt-4o
- gpt-4o-mini
- gpt-4-turbo
- gpt-4.1
- gpt-4.1-mini
- O4-mini
Referência: https://openai.com/index/retiring-gpt-4o-and-older-models/
Por Que Está Sendo Descontinuado?
- Arquitetura mais antiga
- Custo/desempenho pior do que o GPT-5-mini
- Mais caro para a mesma qualidade de saída
Modelos de Transcrição (Transcrição PABX)
Devido a essas mudanças, agora exibimos a seleção de modelos em: Sistema → Integrações → Transcrição → OpenAI.
Isso permite que os Administradores escolham o modelo de transcrição que melhor se adapta aos seus requisitos de custo e qualidade.
APIs de EndPoint de Gravação de Chamadas Utilizadas
- v1/audio/transcrições
- v1/audio/traduções
Modelos
Modelo | Nível de Custo | Utilização Prevista |
whisper-1 | Mais barato | Padrão para gravação em massa de chamadas |
gpt-4o-mini-transcribe | Médio | Melhor formatação |
gpt-4o-transcribe | Mais alta | A mais alta qualidade de transcrição |
O Whisper continua sendo a opção mais econômica para transcrição PABX.
Modelos de Texto e Análise (Análise PABX)
Resumo/Sentimento APIs de EndPoint Utilizadas
- v1/chat/completions
Modelos
- gpt-5-mini (padrão)
- gpt-5.2 (Caro)
- gpt-5.1 (Caro)
- gpt-5
- gpt-5-nano
- gpt-4.1-nano
- gpt4o (Compatibilidade com versões anteriores)
- gpt4mini (Compatibilidade com versões anteriores)
Modelos Em Tempo Real (Chamadas Ao Vivo e Agentes de IA)
Terminal de Chamadas
- v1/realtime
Modelos
Modelo | Nível de Custo |
gpt-realtime-mini | Mais Baixo |
gpt-realtime | Mais Alto |
Os modelos em tempo real são sempre mais caros do que os modelos de texto, por isso também adicionamos o mini.
Terminal de Texto
- v1/responses
Modelos
- gpt-5-mini (padrão)
- gpt-5.2 (Caro)
- gpt-5.1 (Caro)
- gpt-5
- gpt-5-nano
- gpt-4.1-nano
- gpt4o (Compatibilidade com versões anteriores)
- gpt4mini (Compatibilidade com versões anteriores)
Última atualização
Este documento foi atualizado pela última vez em 3 de fevereiro de 2026
