OpenAI lança GPT-6.1 Sol com cache 50% mais barato na API

A OpenAI lançou o GPT-6.1 Sol no DevDay de 29 de setembro e cortou pela metade o preço do contexto reaproveitado na API. O input em cache caiu de US$ 0,20 para US$ 0,10 por milhão de tokens, enquanto entrada e saída seguem em US$ 2 e US$ 10, e o modelo já está no ChatGPT Work, no Codex e na API, mas ainda não no Chat. Para quem roda agentes com instruções longas ou consulta o mesmo documento várias vezes, a economia vem de trocar o model-id, sem mexer no preço de entrada e saída.

Por Lívia, Staff

setembro 30, 2026

GPT-6.1 Sol: arte oficial da OpenAI para o novo modelo, com um sol entre estrelas

A OpenAI lançou na terça-feira, 29 de setembro de 2026, durante o DevDay 2026, o GPT-6.1 Sol, uma atualização do GPT-6 Sol voltada a programação com agentes, uso de computador e trabalho profissional. Para quem já paga ChatGPT ou usa a API no Brasil, a mudança concreta está no custo de contexto reaproveitado: o input em cache caiu para US$ 0,10 por milhão de tokens, metade dos US$ 0,20 do GPT-6 Sol, conforme o post oficial da OpenAI de 29 de setembro e a página de preços da API.

Os preços de entrada e de saída não mudaram em relação ao GPT-6 Sol. Segundo a tabela da OpenAI consultada em 30 de setembro de 2026, o novo modelo custa US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, os mesmos valores da versão lançada uma semana antes.

O modelo ficou disponível no mesmo dia para assinantes Plus, Pro, Business, Enterprise e Edu no ChatGPT Work e no Codex, e para desenvolvedores na API com o identificador gpt-6.1-sol. A OpenAI informou que ele ainda não está no Chat, a conversa tradicional do ChatGPT. O post não traz dados sobre desempenho em português nem restrições específicas por país.

O que o GPT-6.1 Sol muda no preço da API

A OpenAI apresentou o GPT-6.1 Sol como um modelo que chega perto do GPT-6 Astra, seu modelo mais capaz, cobrando um quinto do preço padrão de entrada e saída do Astra. A conta confere com a tabela oficial: o Astra custa US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de saída, contra US$ 2 e US$ 10 do Sol, segundo a página de preços da OpenAI consultada em 30 de setembro de 2026.

Token é a unidade em que o modelo lê e escreve texto, algo como um pedaço de palavra. A cobrança separa o que entra (pergunta, documentos, histórico) do que sai (a resposta).

O cached input funciona como um desconto para o que se repete. Quando um aplicativo manda sempre o mesmo início de conversa, como instruções fixas ou um manual longo, a OpenAI guarda esse trecho e cobra menos para relê-lo. No GPT-6.1 Sol, esse trecho custa US$ 0,10 por milhão de tokens, 95% abaixo do input padrão de US$ 2, segundo a OpenAI.

A documentação do modelo detalha o resto da conta. Gravar algo no cache custa US$ 2,50 por milhão de tokens (1,25 vez o input sem cache), e prompts com mais de 272 mil tokens de entrada pagam o dobro nas taxas de input e de cache e 1,5 vez na saída, sobre o pedido inteiro, conforme a página do GPT-6.1 Sol na documentação da API.

Os modos Batch e Flex, que trocam velocidade por economia, custam 50% menos que o padrão: US$ 1 por milhão de tokens de entrada, US$ 0,05 em cache e US$ 5 de saída, segundo a tabela de preços da OpenAI de 30 de setembro de 2026. O modo Fast custa o dobro do padrão, e o processamento regional (residência de dados) acrescenta 10% onde está disponível.

Disponibilidade no ChatGPT, no Codex e na API

No ChatGPT, o GPT-6.1 Sol entrou apenas no ChatGPT Work e no Codex, a ferramenta de programação da empresa. A OpenAI escreveu no post que o modelo “is not yet available in Chat”, sem dar data para a chegada à conversa comum. O post também não cita os planos Free e Go.

Na API, o model-id é gpt-6.1-sol. O model-id é o nome exato que o desenvolvedor escreve no código para escolher o modelo, como o código de um produto na prateleira. A documentação lista o nível gratuito da API como não suportado, e os limites começam em 500 requisições e 500 mil tokens por minuto no Tier 1, chegando a 15 mil requisições e 40 milhões de tokens por minuto no Tier 5.

Segundo a documentação, o modelo aceita texto e imagem na entrada e responde apenas em texto, sem áudio nem vídeo. A janela de contexto é de 1.050.000 tokens, com até 128 mil tokens de saída e data de corte de conhecimento em 30 de abril de 2026. Esses números não aparecem no post de lançamento, apenas na página técnica do modelo.

A OpenAI recomenda a Responses API para quem usa ferramentas. A Chat Completions funciona, mas sem chamada de ferramentas, e o fine-tuning não é suportado, de acordo com a documentação. O esforço de raciocínio vai de low a max, com medium como padrão, e os níveis none e minimal não existem neste modelo.

Para o Brasil, a informação disponível é indireta. O país consta da lista geral de países atendidos pela API, mas o anúncio não trata de disponibilidade por país para o GPT-6.1 Sol. A documentação cita residência de dados nos Estados Unidos e na União Europeia, sem opção no Brasil, e informa que o modo Fast não funciona com residência na UE.

Desempenho, segundo a OpenAI

Todos os resultados abaixo foram divulgados pela própria OpenAI e não passaram por verificação independente do ias.news. A empresa ressalvou que as avaliações rodaram em ambiente de pesquisa ou via API, o que pode gerar respostas um pouco diferentes das do ChatGPT em produção, e que os números de concorrentes vieram de relatórios públicos.

Em programação, a OpenAI afirmou que o GPT-6.1 Sol empatou com o GPT-6 Astra no DeepSWE v1.1, teste de engenharia de software em bases de código reais, a cerca de um quinto do custo. Segundo a companhia, o novo modelo superou em 6,4 pontos percentuais a melhor marca do GPT-6 Sol no mesmo teste, com esforço de raciocínio e custo menores.

No GDP.pdf, que mede respostas a perguntas profissionais sobre PDFs complexos com tabelas e gráficos, a OpenAI informou que o GPT-6.1 Sol pontuou acima do Opus 5.5, da Anthropic, a menos da metade do custo por tarefa. A empresa disse ainda que o modelo se aproximou do Astra a cerca de um quinto do custo por tarefa.

No AutomationBench, que avalia fluxos de trabalho empresariais em várias etapas, a OpenAI relatou vantagem de 2,2 pontos percentuais sobre o Opus 5.5 em esforço médio, a cerca de um terço do custo. Em relação ao GPT-6 Sol na mesma configuração, o ganho informado foi de 4,8 pontos.

Em uso de computador, a companhia afirmou que o GPT-6.1 Sol superou o GPT-6 Sol em 7 pontos percentuais no conjunto offline do OSWorld 2.0, em esforço máximo, a menos da metade do custo. Segundo a OpenAI, o modelo ficou a 2,1 pontos da nota do Astra, a cerca de um sétimo do custo por tarefa.

Em pesquisa científica, a OpenAI disse que o novo Sol mais que dobrou a pontuação do GPT-6 Sol no Terminal-Bench Science 0.1. A empresa informou custo médio de US$ 5,47 por tarefa no esforço máximo, contra US$ 23,21 do Opus 5.5 e US$ 23,80 do Astra. A própria OpenAI reconheceu que o Astra continua com a maior nota do teste, 68,1%, e deve ser usado nas tarefas científicas mais difíceis.

Em factualidade, a companhia relatou queda na parcela de respostas com erro de 11,4% para 7,7% em esforço baixo, redução de cerca de 32% frente ao GPT-6 Sol, e taxa de erro a até 1,9 ponto do Astra. O teste usou conversas anonimizadas do ChatGPT em que usuários já tinham apontado erros, e a OpenAI avisou que esses casos difíceis não representam o uso comum.

Segurança e alinhamento

A OpenAI afirmou que o GPT-6.1 Sol melhorou nas avaliações de alinhamento em relação ao GPT-6 Sol, aproximando-se do Astra. Segundo a empresa, o modelo ficou mais transparente sobre as próprias limitações e mais confiável ao respeitar restrições explícitas do usuário durante tarefas com agentes.

Num teste em que a ferramenta de busca do agente está quebrada de propósito, o modelo deixou de avisar o usuário em 2,1% dos casos, informou a OpenAI. O GPT-6 Sol falhou em 4,9%, o Astra em 1,5% e o GPT-6 Luna em 28,7%, em esforço máximo e com tarefas escolhidas para provocar falhas.

A companhia disse não ter observado tentativas de contornar o revisor automático de segurança, mesmo resultado do Astra e do GPT-6 Sol. Os detalhes estão num adendo ao system card do modelo, citado no post.

Ultrafast e Astra são produtos separados

O GPT-6.1 Sol Ultrafast ainda não está disponível. No post, a OpenAI disse que a versão chega “in the coming days”, com geração de tokens até 8 vezes mais rápida que a velocidade padrão no Codex. O resumo oficial do DevDay 2026 tratou o lançamento como “coming soon” e citou, para o nível Ultrafast em geral, até 300 tokens por segundo no Codex e até 6 vezes mais velocidade na API.

A OpenAI não publicou preço do GPT-6.1 Sol Ultrafast. Na tabela de 30 de setembro de 2026, o único modelo com preço Ultrafast é o GPT-6 Astra, a US$ 60 por milhão de tokens de entrada e US$ 300 por milhão de saída, seis vezes o preço padrão do Astra.

O GPT-6 Astra Ultrafast já funciona, segundo o resumo do DevDay, na API e no ChatGPT Work e no Codex para os planos Pro 500 e Enterprise. O Pro 500 é um novo plano anunciado no mesmo evento, com cota 25 vezes maior que a do Plus. Na API, a documentação do modo Ultrafast diz que a versão do Astra está aberta a todos os usuários com limites baixos de uso.

Os benchmarks descritos acima valem para o GPT-6.1 Sol padrão. A OpenAI não divulgou resultados de qualidade para a versão Ultrafast, e as comparações com o Astra se referem ao Astra padrão, não ao Astra Ultrafast.

A sequência de lançamentos da OpenAI

O GPT-6.1 Sol chegou uma semana depois do GPT-6 Sol e do GPT-6 Luna, lançados em 22 de setembro de 2026, como o ias.news mostrou na reportagem sobre o GPT-6 Sol e Luna. Naquela ocasião, a OpenAI cortou pela metade os preços em relação à geração 5.6, e o Sol passou a custar os mesmos US$ 2 e US$ 10 por milhão de tokens mantidos agora.

O modelo foi um dos mais de 20 anúncios do DevDay 2026, segundo a OpenAI. O evento também trouxe os dots, agentes que ficam ativos o tempo todo, o Codex rodando na nuvem, a Agents API com uso de computador e o plano Pro 500.

A apresentação completa foi transmitida no canal oficial da OpenAI no YouTube.

Keynote do DevDay 2026, de 29 de setembro, em que a OpenAI apresentou o GPT-6.1 Sol e os demais anúncios do evento. Vídeo: OpenAI/YouTube.

O que não foi divulgado

O post de lançamento não informa a qualidade do modelo em português, nem traz benchmark em outros idiomas. Também não detalha disponibilidade por país além da lista geral da plataforma, e não diz quando o modelo chega ao Chat nem se chegará aos planos Free e Go.

A OpenAI também não publicou o preço do GPT-6.1 Sol Ultrafast nem a data exata de lançamento dessa versão. As notas absolutas de vários benchmarks aparecem apenas em gráficos, e o texto do post informa sobretudo diferenças em pontos percentuais e custo relativo.

O que muda na prática para quem usa ChatGPT e API

Quem assina Plus, Pro, Business, Enterprise ou Edu já pode escolher o GPT-6.1 Sol no ChatGPT Work e no Codex. Quem usa só o Chat continua sem acesso ao modelo, e quem está no Free ou no Go não recebeu nenhuma menção no anúncio.

Para desenvolvedores, a troca exige mudar o model-id para gpt-6.1-sol. Como entrada e saída custam o mesmo que no GPT-6 Sol, a economia aparece em aplicações que reaproveitam contexto, como agentes com instruções longas e fixas ou sistemas que consultam o mesmo documento várias vezes. Nesses casos, cada milhão de tokens em cache cai de US$ 0,20 para US$ 0,10, segundo a tabela da OpenAI de 30 de setembro de 2026.

A cobrança continua em dólar, e o custo final em reais depende do câmbio e dos impostos de cada contratante. Antes de migrar um produto em português, a recomendação é testar o modelo com as próprias tarefas, já que a OpenAI não divulgou medição nesse idioma. Para tarefas científicas mais difíceis, a própria empresa segue indicando o Astra.