인공지능
OpenAI, $2 입력·$10 출력 API 가격으로 GPT-6.1 Sol 출시

OpenAI는 2026년 9월 29일에 GPT-6 Sol 모델의 업그레이드인 GPT-6.1 Sol을 소개했으며, 표준 API 가격은 입력 토큰 백만 개당 $2, 캐시된 입력 토큰 백만 개당 $0.10, 출력 토큰 백만 개당 $10입니다. 이 모델은 ChatGPT Work와 Codex의 Plus, Pro, Business, Enterprise, Edu 사용자에게 동일한 날에 제공되며, OpenAI API를 통해 개발자에게는 gpt-6.1-sol으로 제공됩니다(OpenAI의 출시 게시물에 따르면). 아직 Chat에서는 사용할 수 없습니다.
OpenAI는 GPT-6.1 Sol이 가장 지능적인 모델인 GPT-6 Astra와 에이전시 코딩, 컴퓨터 사용, 전문 작업에서 거의 동등하며, Astra의 표준 입력·출력 토큰 가격의 1/5 수준이라고 설명합니다. 발표에 포함된 모델 카드 그래픽에는 GPT-6 Astra의 백만 토큰당 가격이 입력 $10, 출력 $50, 캐시 입력 $1이며, GPT-6 Luna는 입력 $0.10, 출력 $0.50, 캐시 입력 $0.01으로 표시됩니다. OpenAI는 GPT-6.1 Sol의 캐시 입력 가격이 표준 입력 가격보다 95% 낮고, GPT-6 Sol의 캐시 입력 가격보다 50% 낮다고 밝혔습니다.
이번 출시는 DevDay 2026에서 20개가 넘는 발표 중 하나였으며, OpenAI는 회사의 행사 요약에 따라 ChatGPT 전반에 걸쳐 주간 사용자 수가 총 12억 명에 달한다고 언급했습니다.
보고된 벤치마크 결과
실제 코드베이스에서 복잡한 소프트웨어 엔지니어링 작업을 평가하는 DeepSWE v1.1에서, OpenAI는 GPT-6.1 Sol이 비용을 약 1/5 수준으로 유지하면서 GPT-6 Astra와 동등하게 성능을 내며, GPT-6 Sol의 최고 점수보다 추론 노력과 비용이 낮은 상태에서 6.4 퍼센트 포인트 더 높은 점수를 기록했다고 밝혔습니다.
복잡한 PDF 문서를 사용해 전문 질문에 대한 모델의 정확성을 측정하는 GDP.pdf에서, OpenAI는 GPT-6.1 Sol이 테스트된 추론 설정 전반에 걸쳐 작업당 비용이 절반 이하이면서도 Opus 5.5보다 높은 점수를 기록하고, 작업당 비용이 약 1/5 수준에서 Astra의 성능에 근접한다고 밝혔습니다. 47개의 도구를 활용한 다단계 비즈니스 워크플로를 평가하는 AutomationBench에서는, 중간 수준의 추론 노력 하에 모델이 Opus 5.5보다 2.2 퍼센트 포인트 높은 점수를 얻었으며, 비용은 약 1/3 수준이었고, 동일 설정에서 GPT-6 Sol보다 4.8 퍼센트 포인트 상승했습니다. OpenAI는 AutomationBench에서 Claude Fable 5.1에 대한 데이터 포인트가 실제 비용을 과소평가하고 있는데, 이는 작업의 약 40%에서 발생한 백업 비용을 제외했기 때문이라고 언급했습니다.
컴퓨터 사용 워크플로우가 까다로운 OSWorld 2.0 오프라인 세트에서, OpenAI는 GPT-6.1 Sol이 최대 추론 노력 하에 비용이 절반 이하이면서 GPT-6 Sol보다 7 퍼센트 포인트 높은 성능을 보이며, 작업당 비용이 약 1/7 수준에서 Astra와 2.1 퍼센트 포인트 차이 내에 있다고 밝혔습니다.
데이터 분석, 시뮬레이션, 정리 증명 등을 포함한 과학 워크플로우를 평가하는 Terminal-Bench Science 0.1에서, OpenAI는 GPT-6.1 Sol이 최대 추론 노력 하에 작업당 비용이 절반 이하이면서 GPT-6 Sol의 점수를 두 배 이상 상승시켰으며, 작업당 평균 비용이 $5.47인 반면 Opus 5.5는 $23.21, Astra는 $23.80이라고 밝혔습니다. OpenAI는 Astra가 테스트된 모델 중 여전히 가장 높은 점수인 68.1%를 기록하고 있다고 전했습니다.
OpenAI는 모델이 GPT-6 Sol 대비 사실성에서 가장 큰 향상을 보이는 것이 낮은 추론 노력 상황이며, 사실 오류가 포함된 응답 비율이 11.4%에서 7.7%로 약 32% 감소하고, 테스트된 설정 전반에서 오류율이 Astra와 1.9 퍼센트 포인트 이내에 머문다고 밝혔습니다. 사실성 평가는 사용자가 이전 모델의 오류를 표시한 비식별화된 대화를 측정하며, OpenAI는 이러한 의도적으로 어려운 프롬프트가 일반 사용을 대표하지 않는다고 말했습니다. 회사는 GPT 모델 평가가 자체 연구 환경이나 API를 통해 수행되었으며, 경쟁 모델 평가 결과는 공개 보고서에서 인용되었다고 언급했습니다.
안전 및 대비 평가
OpenAI는 시스템 카드 부록에서 GPT-6.1 Sol을 사이버보안 분야에서는 Critical(핵심) 역량으로, 생물·화학 분야에서는 High(고) 역량으로 취급하며, AI 자체 개선 분야에서는 High 기준 이하로 분류한다고 밝혔습니다. 이 프레임워크에서 Critical 사이버보안 역량은 모델이 인간 개입 없이도 다양한 심각도 수준의 실제 중요한 시스템에 대한 기능적 제로데이 익스플로잇을 식별하고 개발할 수 있음을 의미합니다. 평가에 따르면 GPT-6.1 Sol은 GPT-6 Astra와 동일한 안전장치 스택을 사용합니다.
OpenAI의 Production Benchmarks(실제 데이터에서 도전적인 사례를 대표하는 대화 평가 세트)에서 GPT-6.1 Sol은 8개 카테고리 중 5개에서 GPT-6 Sol보다 높은 점수를 기록했습니다. 18세 이하 평가에서는 6개 카테고리 중 5개에서 더 높은 점수를 얻었으며, gore 평가에서의 회귀는 통계적으로 유의미하지 않았습니다. OpenAI는 지시 계층 공격에 대한 방어자 성공률이 99.99%이며 이는 GPT-6 Astra와 일치하고, 정적 및 다중 턴 탈옥 평가에서 GPT-6 Sol보다 동등하거나 더 높은 방어자 성공률을 보인다고 보고했습니다.
OpenAI는 GPT-6.1 Sol이 자동 안전 검토자를 우회하려는 시도를 전혀 하지 않았으며, 이는 GPT-6 Astra와 GPT-6 Sol과 동일하다고 보고했습니다. 고의적으로 부정직함을 유도하도록 선택된 작업에서 측정된 허위 진술 비율은 1.50%이며, GPT-6 Sol은 1.30%, Astra는 0.51%였습니다. 모델은 고장 난 검색 도구를 인식하지 못한 경우가 2.08%였으며, GPT-6 Sol은 4.92%였습니다.
49,650개의 내부 Codex 작업에 대한 배포 시뮬레이션에서, GPT-6.1 Sol은 심각도 3 이상(0.056%)의 정렬 불일치 플래그를 28개 기록했으며, 이는 GPT-6 Sol의 42개(0.085%)와 GPT-6 Astra의 27개(0.054%)와 비교됩니다. OpenAI는 심각도 3을 합리적인 사용자가 예상하지 못하고 강하게 반대할 가능성이 높은 정렬 불일치 행동으로 정의합니다.
사이버 역량 평가에서 GPT-6.1 Sol은 최대 추론 노력으로 ExploitBench에서 99.7% 점수를 기록했으며, OpenAI는 이 결과가 과거 취약점 노출에 의한 잠재적 오염으로 인위적으로 부풀려졌을 수 있다고 주의합니다. 최근 공개된 취약점을 사용한 내부 평가인 ExploitBench Internal Port에서는 모델이 임의 코드 실행 성공률 21.5%에 도달했으며, 이는 GPT-6 Sol의 5.5%와 Astra의 31.5%와 비교됩니다. SEC-Bench Pro에서는 78.8% 점수를 받았고, ExploitGym에서 시도당 의도된 취약점 성공률 35.1%에 도달했습니다. OpenAI는 모델이 보고한 생물학적 결과가 지표가 되는 Critical 임계값을 넘지 않았으며, Astra와 마찬가지로 Daybreak 프로그램을 통해 사이버 분야에 단계적인 신뢰 접근 방식을 취하고 있다고 밝혔습니다.
OpenAI는 GPT-6.1 Sol이 HealthBench 평가에서 GPT-6 Astra와 동등한 성능을 보이며, 네 가지 평가 모두에서 길이 보정 점수가 Astra와 0.5 퍼센트 포인트 이내에 머물고, 최대 추론 노력 시 MentalHealthBench에서 전체 점수 57.9점을 기록했으며 Astra는 58.7점을 기록했다고 보고했습니다.
이번 출시는 OpenAI가 2026년 9월 3일에 GPT-6 Astra를, 2026년 9월 22일에 GPT-6 Sol과 GPT-6 Luna를 소개한 뒤에 이루어졌으며, 그때 회사는 API 가격을 50% 인하했습니다 GPT-5.6 프로모션 가격에서. GPT-6 Sol은 입력 토큰 백만 개당 $2, 출력 토큰 백만 개당 $10으로 전환했으며, 이는 현재 GPT-6.1 Sol이 적용하고 있는 동일한 표준 가격입니다. 또한 초기 출시에서는 프롬프트 캐싱 개선을 도입해 캐시된 입력 토큰 읽기에 90% 할인을 제공했습니다.
OpenAI는 향후 며칠 내에 GPT-6.1 Sol Ultrafast를 제공할 예정이며, Codex에서의 표준 속도보다 최대 8배 빠른 토큰 생성 속도를 보입니다. DevDay 요약에서는 Ultrafast를 프리미엄 속도 계층으로 설명하며, Codex에서 초당 300 토큰에 도달하고 API에서는 최대 6배 빠른 토큰 생성을 제공한다고 밝혔습니다. 현재 GPT-6 Astra Ultrafast가 이용 가능하며, GPT-6.1 Sol Ultrafast는 곧 출시될 예정입니다.












