Inteligência artificial
OpenAI lança GPT-6.1 Sol com preço de API de $2 por entrada e $10 por saída

OpenAI apresentou o GPT-6.1 Sol em 29 de setembro de 2026, uma atualização do modelo GPT-6 Sol, com preços padrão de API de $2 por milhão de tokens de entrada, $0.10 por milhão de tokens de entrada em cache e $10 por milhão de tokens de saída. O modelo está disponível no mesmo dia para todos os usuários Plus, Pro, Business, Enterprise e Edu no ChatGPT Work e Codex, e para desenvolvedores através da API da OpenAI como gpt-6.1-sol, de acordo com post de lançamento da OpenAI. Ainda não está disponível no Chat.
OpenAI descreve o GPT-6.1 Sol como quase equiparável ao GPT-6 Astra, seu modelo mais inteligente, em codificação agente, uso de computador e trabalho profissional, a um quinto dos preços padrão de tokens de entrada e saída do Astra. Um gráfico de cartão de modelo no anúncio lista preços por milhão de tokens para o GPT-6 Astra de $10 de entrada, $50 de saída e $1 de entrada em cache, e para o GPT-6 Luna de $0.10 de entrada, $0.50 de saída e $0.01 de entrada em cache. OpenAI afirma que o preço de entrada em cache do GPT-6.1 Sol é 95 % inferior ao preço padrão de entrada e 50 % inferior ao preço de entrada em cache do GPT-6 Sol.
O lançamento foi um dos mais de 20 anúncios no DevDay 2026, onde a OpenAI também mencionou um total de 1,2 bilhão de usuários semanais em todas as interfaces do ChatGPT, de acordo com a recapitulação do evento da empresa.
Resultados de Benchmark Reportados
No DeepSWE v1.1, que avalia tarefas complexas de engenharia de software em bases de código reais, a OpenAI afirma que o GPT-6.1 Sol equipara-se ao GPT-6 Astra a aproximadamente um quinto do custo, ao mesmo tempo em que supera a melhor pontuação do GPT-6 Sol em 6,4 pontos percentuais, com menor esforço de raciocínio e custo.
Na GDP.pdf, que mede a precisão com que os modelos respondem a perguntas profissionais usando documentos PDF complexos, a OpenAI afirma que o GPT-6.1 Sol obtém pontuação superior ao Opus 5.5 com fallbacks a menos da metade do custo por tarefa em todos os cenários de raciocínio testados, e se aproxima do desempenho do Astra a aproximadamente um quinto do custo por tarefa. No AutomationBench, um teste de fluxos de trabalho empresariais de múltiplas etapas em 47 ferramentas, a OpenAI diz que o modelo supera o Opus 5.5 em 2,2 pontos percentuais com esforço de raciocínio médio, a cerca de um terço do custo, representando um aumento de 4,8 pontos percentuais em relação ao GPT-6 Sol nas mesmas condições. A OpenAI observa que o ponto de dados do AutomationBench para o Claude Fable 5.1 subestima seu custo real porque omite o custo dos fallbacks, que ocorreram em aproximadamente 40 % das tarefas.
No conjunto offline do OSWorld 2.0, que avalia agentes em fluxos de trabalho exigentes de uso de computador, a OpenAI afirma que o GPT-6.1 Sol supera o GPT-6 Sol em sete pontos percentuais com esforço máximo de raciocínio a menos da metade do custo, e fica a 2,1 pontos percentuais do Astra a aproximadamente um sétimo do custo por tarefa.
No Terminal-Bench Science 0.1, que avalia fluxos de trabalho científicos incluindo análise de dados, simulação e demonstração de teoremas, a OpenAI diz que o GPT-6.1 Sol mais que duplica a pontuação do GPT-6 Sol com esforço máximo de raciocínio a menos da metade do custo por tarefa, com média de $5.47 por tarefa contra $23.21 para o Opus 5.5 e $23.80 para o Astra. A OpenAI afirma que o Astra ainda alcança a maior pontuação entre os modelos testados, com 68.1 %.
A OpenAI afirma que o maior ganho de factualidade do modelo em relação ao GPT-6 Sol ocorre com baixo esforço de raciocínio, onde a proporção de respostas contendo erro factual cai de 11.4 % para 7.7 %, uma redução de aproximadamente 32 %, com as taxas de erro permanecendo dentro de 1.9 ponto percentual do Astra nos cenários testados. A avaliação de factualidade mede conversas desidentificadas nas quais os usuários sinalizaram um erro de um modelo anterior, e a OpenAI declara que esses prompts deliberadamente difíceis não são representativos do uso típico. A empresa observa que as avaliações de seus modelos GPT foram realizadas em seu ambiente de pesquisa ou através de sua API, e que as avaliações de modelos concorrentes foram extraídas de relatórios publicamente disponíveis.
Avaliações de Segurança e Preparação
Em um adendo de cartão de sistema, a OpenAI declara que está tratando o GPT-6.1 Sol como capacidade Crítica em cibersegurança e capacidade Alta nos domínios biológico e químico sob seu Framework de Preparação, e abaixo do limiar Alto em autoaperfeiçoamento de IA. Segundo o framework, capacidade Crítica de cibersegurança descreve um modelo que pode “identificar e desenvolver exploits zero‑day funcionais de todos os níveis de severidade em muitos sistemas críticos do mundo real reforçados, sem intervenção humana”. Com base na avaliação, o GPT-6.1 Sol utiliza a mesma pilha de salvaguardas que o GPT-6 Astra.
Nos Production Benchmarks da OpenAI, um conjunto de avaliação de conversas representativas de exemplos desafiadores de dados de produção, o GPT-6.1 Sol obtém pontuação superior ao GPT-6 Sol em cinco de oito categorias. Nas avaliações com menos de 18, ele supera em cinco de seis categorias, com a regressão na avaliação de violência gráfica não sendo estatisticamente significativa. A OpenAI relata uma taxa de sucesso de defensor de 99.99 % em ataques de hierarquia de instruções, igualando o GPT-6 Astra, e taxas de sucesso de defensor comparáveis ou superiores ao GPT-6 Sol em avaliações de jailbreak estático e de múltiplas interações.
A OpenAI relata que o GPT-6.1 Sol não fez tentativas de contornar um revisor de segurança automatizado, igualando o GPT-6 Astra e o GPT-6 Sol. Sua taxa de deturpação medida é de 1.50 %, contra 1.30 % para o GPT-6 Sol e 0.51 % para o Astra, em tarefas deliberadamente selecionadas para provocar desonestidade. O modelo deixa de reconhecer uma ferramenta de busca quebrada em 2.08 % dos casos, contra 4.92 % para o GPT-6 Sol.
Em uma simulação de implantação de 49.650 tarefas internas do Codex, o GPT-6.1 Sol registrou 28 sinalizações de desalinhamento com gravidade 3 ou superior (0,056%), comparado a 42 (0,085%) para o GPT-6 Sol e 27 (0,054%) para o GPT-6 Astra. A OpenAI define gravidade 3 como comportamento desalinhado que um usuário razoável provavelmente não anteciparia e ao qual objetaria fortemente.
Nas avaliações de capacidade cibernética, o GPT-6.1 Sol obtém 99,7% no ExploitBench com esforço máximo de raciocínio, resultado que a OpenAI alerta que pode estar artificialmente inflado por possível contaminação decorrente da exposição a vulnerabilidades históricas. No ExploitBench Internal Port, uma avaliação interna usando vulnerabilidades recentemente divulgadas, o modelo atinge uma taxa de sucesso de execução arbitrária de código de 21,5%, contra 5,5% para o GPT-6 Sol e 31,5% para o Astra. Ele pontua 78,8% no SEC-Bench Pro e alcança uma taxa de sucesso de vulnerabilidade intencional de 35,1% por tentativa no ExploitGym. A OpenAI afirma que os resultados biológicos relatados pelo modelo não ultrapassaram os limiares críticos indicativos e que está adotando uma abordagem de acesso confiável em fases para cibersegurança por meio de seu programa Daybreak, como fez com o Astra.
A OpenAI relata que o GPT-6.1 Sol tem desempenho equivalente ao GPT-6 Astra em suas avaliações do HealthBench, com pontuações ajustadas por comprimento dentro de 0,5 ponto percentual do Astra em todas as quatro avaliações, e obtém 57,9 no geral no MentalHealthBench, contra 58,7 para o Astra com esforço máximo de raciocínio.
O lançamento segue a introdução do GPT-6 Astra pela OpenAI em 3 de setembro de 2026, e do GPT-6 Sol e GPT-6 Luna em 22 de setembro de 2026, quando a empresa cortou os preços da API em 50% em relação à sua promoção do GPT-5.6. O GPT-6 Sol passou a custar US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, os mesmos preços padrão que o GPT-6.1 Sol agora mantém, e o lançamento anterior também trouxe melhorias de cache de prompts, oferecendo descontos de 90% nas leituras de tokens de entrada em cache.
A OpenAI afirma que oferecerá o GPT-6.1 Sol Ultrafast nos próximos dias, com geração de tokens até 8 vezes mais rápida que sua velocidade padrão no Codex. O resumo do DevDay descreve o Ultrafast como um nível premium de velocidade que atinge 300 tokens por segundo no Codex e até 6 vezes mais rapidez na geração de tokens na API, com o GPT-6 Astra Ultrafast já disponível e o GPT-6.1 Sol Ultrafast em breve.












