Lançamentos de modelos de IA de setembro de 2026: GPT-6, Claude Opus 5.5, Gemini 3.8, DeepSeek, Qwen e GLM
Por ChatGBot · 29 de setembro de 2026
Setembro de 2026 se tornou um dos meses mais movimentados que o mundo da IA já viu, com mais de 20 novos modelos lançados em um período de duas semanas e uma verdadeira guerra de preços estourando. Veja aqui o que de fato foi lançado, quanto custa e por que isso importa se você usa esses modelos todos os dias.
Every top AI in one app
GPT, Claude, DeepSeek, Qwen and GLM — one subscription.
Try ChatGBot →O Claude Opus 5.5 lidera a fronteira
Em 22 de setembro, a Anthropic lançou o Claude Opus 5.5, o primeiro modelo da família Claude 5.5. Ele custa US$ 4 por milhão de tokens de entrada e US$ 20 por milhão de tokens de saída, cerca de 20% abaixo do Opus 5, com a entrada em cache caindo para US$ 0,20. A Anthropic diz que ele supera o modelo de ponta anterior em benchmarks com agentes, tornando as cargas de trabalho típicas cerca de 40% mais baratas de executar. O Sonnet 5.5 e o Haiku 5.5 são esperados nas semanas seguintes. Se você quer o contexto, veja nosso guia sobre o Claude Opus e os modelos Claude explicados.
A OpenAI responde com GPT-6 Sol e GPT-6 Luna
Cerca de noventa minutos depois da Anthropic, a OpenAI lançou dois novos níveis do GPT-6. O GPT-6 Sol (US$ 2 / US$ 10 por milhão de tokens) mira trabalhos mais pesados, como programação, enquanto o GPT-6 Luna (US$ 0,10 / US$ 0,50) foi feito para tarefas de alto volume, como resumir documentos e extrair dados. O Luna estabelece um novo piso de preço para o mercado geral. Esse lançamento foi menos sobre liderar o ranking e mais sobre custo por tarefa. É novo por aqui? Comece com o que é o GPT-4o.
DeepSeek, Qwen e GLM mantêm a pressão
- DeepSeek V4.1-Flash (10 de set.): US$ 0,30 / US$ 1,20 no pico e US$ 0,15 / US$ 0,60 fora do pico, com uma redução de 4x no cache KV para cargas de trabalho com agentes. Veja se o DeepSeek é gratuito.
- Qwen3.8 Max Prime (Alibaba, 23 de set.): US$ 4 / US$ 12 por milhão de tokens, no topo da linha Qwen. Mais em o que é o Qwen.
- GLM-5.3-Flash (Z.ai): um preço de tabela de US$ 0,15 / US$ 0,50, uma das opções capazes mais baratas por aí. Contexto em o que é o GLM AI.
O Google lança o Gemini 3.8 Flash
O Google também esteve ocupado. Em 2 de setembro, lançou o Gemini 3.8 Flash, seu terceiro modelo Flash em seis semanas, com preço de US$ 0,75 / US$ 3,75 por milhão de tokens até o fim de 2026, antes de a tarifa dobrar em 1º de janeiro de 2027. Ele lida com texto, imagens, áudio, vídeo e PDF com uma janela de contexto de 1 milhão de tokens, e é ajustado para programação de longo prazo e agentes autônomos. O Google o lançou junto com uma variante de segurança restrita chamada 3.8 Flash Cyber, e diz que ele supera o próprio 3.7 Flash em todas as frentes, superando por pouco o Claude Opus 5 em alguns benchmarks. E vem mais por aí: o Google confirmou que o Gemini 4, seu próximo modelo de ponta, já está em pós-treinamento e é esperado antes do fim de 2026, com foco em programação e agentes de longo prazo. Mais contexto em nosso guia do chatbot Gemini.
O que isso significa para você: uma guerra de preços de verdade
O destaque de setembro de 2026 não é um único vencedor, são os preços em queda. Com o GPT-6 Luna a US$ 0,10 por milhão de tokens e opções fortes do DeepSeek, Qwen e GLM, a diferença entre modelos premium e econômicos agora é sobre custo por tarefa, e não sobre capacidade bruta. A jogada inteligente não é mais escolher um modelo e torcer para que ele sirva em todo trabalho. É combinar o modelo com a tarefa: um modelo de fronteira como o Claude Opus 5.5 ou o GPT-6 Sol para raciocínio e programação difíceis, e um modelo barato e rápido para resumos e trabalho em massa.
Use todos os novos modelos em um só lugar
Você não deveria precisar de cinco assinaturas e cinco logins para acompanhar um mês como este. O ChatGBot oferece GPT, Claude, DeepSeek, Qwen e GLM em um único app, para que você possa trocar de modelo no meio do chat e sempre recorrer ao certo. É esse o objetivo: menos malabarismo, uma só conta, todos os melhores modelos.
Perguntas frequentes
Qual é o modelo Claude mais recente? O Claude Opus 5.5, lançado em 22 de setembro de 2026, é o mais recente e o primeiro da família Claude 5.5, com o Sonnet 5.5 e o Haiku 5.5 esperados em breve.
O que são o GPT-6 Sol e o Luna? São dois níveis do GPT-6 da OpenAI. O Sol é ajustado para trabalhos complexos, como programação, e o Luna é um nível de baixo custo para tarefas de alto volume.
Qual novo modelo é o mais barato? O GPT-6 Luna, a US$ 0,10 por milhão de tokens de entrada, estabeleceu um novo piso de preço para o mercado geral em setembro de 2026, com o GLM e o DeepSeek logo atrás.
Posso usar todos eles em um só app? Sim. O ChatGBot permite usar GPT, Claude, DeepSeek, Qwen e GLM juntos em uma única assinatura.