A OpenAI anunciou nesta quarta-feira, 1º de outubro, o GPT-6.1 Sol, um modelo intermediário que se posiciona entre o GPT-6 Sol e o topo de linha GPT-6 Astra. O novo modelo promete desempenho próximo ao Astra em tarefas de agentes, workflows profissionais e uso de computador, mas com custo até 80% menor.

Ganhos de desempenho nas tarefas-chave

Segundo a OpenAI, o GPT-6.1 Sol apresenta avanços claros em benchmarks práticos. No DeepSWE v1.1, avaliação de engenharia de software em código real, iguala o desempenho do GPT-6 Astra, superando o GPT-6 Sol em 6,4 pontos percentuais e mantendo custos significativamente mais baixos. No GDP.pdf, que mede a precisão em consultas sobre PDFs complexos de áreas como finanças e saúde, o modelo supera o Claude Opus 5.5 com fallback e chega próximo do Astra, mas por menos da metade do custo por tarefa.

Em AutomationBench, que testa agentes em workflows de negócios com múltiplas etapas, o GPT-6.1 Sol marca 2,2 pontos acima do Opus 5.5 e 4,8 pontos acima do GPT-6 Sol, novamente com economia relevante. No OSWorld 2.0, a diferença para o Astra cai para apenas 2,1 pontos percentuais, mas o custo por tarefa é cerca de um sétimo do modelo topo de linha.

Para tarefas científicas, no Terminal-Bench Science 0.1, o GPT-6.1 Sol mais que dobra o desempenho do GPT-6 Sol ao custo de US$ 5,47 por tarefa, contra mais de US$ 23 dos rivais Opus 5.5 e Astra. O Astra ainda lidera em acurácia, mas a diferença de preço é marcante.

Redução de custos e caching agressivo

O diferencial do GPT-6.1 Sol está no preço: US$ 2 por milhão de tokens para inputs e outputs padrão, mas com caching de input a US$ 0,10 por milhão — 95% menos que o input standard e metade do custo de caching do GPT-6 Sol. Isso viabiliza agentes que reutilizam contexto sem penalizar o orçamento.

A OpenAI destaca que, para desenvolvedores, o modelo permite construir agentes mais sofisticados e workflows que demandam contexto persistente, sem o impacto financeiro das versões premium. O acesso está disponível via API como gpt-6.1-sol e, para usuários finais, nas modalidades Plus, Pro, Business, Enterprise e Edu do ChatGPT Work e Codex.

Segurança e factualidade

Em avaliações internas de alinhamento, o GPT-6.1 Sol apresenta melhorias em relação ao GPT-6 Sol, aproximando-se do Astra. O modelo é mais transparente quanto a limitações e mostra maior confiabilidade ao respeitar restrições de uso e intenções declaradas pelo usuário. No quesito factualidade, a taxa de respostas com erro caiu de 11,4% para 7,7% nos prompts mais difíceis, uma redução de cerca de 32%. Em todas as faixas de esforço de raciocínio, a distância para o Astra ficou em menos de 1,9 ponto percentual.

Por que importa

O GPT-6.1 Sol chega como alternativa pragmática para times e empresas que precisam de desempenho próximo ao topo, mas não podem pagar o preço do Astra. Os ganhos em engenharia de software, workflows automatizados e tarefas de leitura técnica ampliam o espectro de uso para agentes autônomos e aplicações complexas. O corte agressivo de preços com caching reposiciona o custo-benefício em favor de desenvolvedores e empresas, especialmente em cenários de uso intensivo de contexto.

A OpenAI, ao colocar o 6.1 Sol no mercado, pressiona concorrentes como Anthropic e Google a responderem não só em qualidade, mas também em política de preços e caching. Para o mercado brasileiro, onde o custo de tokens ainda é barreira real em projetos de produção, o 6.1 Sol pode ser o modelo que viabiliza automação de processos e agentes de workflow sem comprometer orçamento.

Tags
  • #openai
  • #gpt-6
  • #gpt-6.1-sol
  • #api
  • #llm