Tekoäly
OpenAI lanseeraa GPT-6.1 Sol -mallin, jonka API-hinnat ovat $2 syötteelle ja $10 tulosteelle

OpenAI esitteli GPT-6.1 Sol -mallin 29. syyskuuta 2026, päivityksen GPT-6 Sol -malliinsa, standardi-API-hinnoin $2 per miljoona syötetunnia, $0.10 per miljoona välimuistissa olevaa syötetunnia ja $10 per miljoona tulostunnia. Malli on samana päivänä saatavilla kaikille Plus-, Pro-, Business-, Enterprise- ja Edu-käyttäjille ChatGPT Work -ympäristössä ja Codexissa sekä kehittäjille OpenAI API:n kautta nimellä gpt-6.1-sol, OpenAI:n lanseerausjulkaisu mukaan. Se ei ole vielä saatavilla Chat.
OpenAI kuvaa GPT-6.1 Sol -mallin lähes vastaavan GPT-6 Astra -mallia, sen älykkäintä mallia, agenttipohjaisessa koodauksessa, tietokoneen käytössä ja ammatillisessa työssä, käyttäen vain viidesosaa Astran standardi-syöte- ja -tulostunnien hinnoista. Ilmoituksessa oleva mallikorttikuva esittelee per miljoona tunnin hinnat: GPT-6 Astra $10 syöte, $50 tuloste ja $1 välimuistisyöte, ja GPT-6 Luna $0.10 syöte, $0.50 tuloste ja $0.01 välimuistisyöte. OpenAI toteaa, että GPT-6.1 Sol -mallin välimuistisyötteen hinta on 95 % alhaisempi kuin standardi-syötteen hinta ja 50 % alhaisempi kuin GPT-6 Sol -mallin välimuistisyötteen hinta.
Lanseeraus oli yli 20 ilmoituksen joukko DevDay 2026 -tapahtumassa, jossa OpenAI viittasi myös yhteensä 1.2 miljardiin viikoittaiseen käyttäjään ChatGPT:n eri alustoilla, yrityksen tapahtuman yhteenveto mukaan.
Raportoituja vertailutuloksia
DeepSWE v1.1 -testissä, joka arvioi monimutkaisia ohjelmistosuunnittelutehtäviä todellisissa koodikannoissa, OpenAI kertoo, että GPT-6.1 Sol vastaa GPT-6 Astra -mallia noin viidesosalla kustannuksista samalla kun se ylittää GPT-6 Sol -mallin parhaan pistemäärän 6,4 prosenttiyksiköllä alhaisemmalla päättelyponnistuksella ja -kustannuksella.
GDP.pdf -testissä, joka mittaa mallien tarkkuutta ammatillisten kysymysten vastaamisessa monimutkaisten PDF-dokumenttien avulla, OpenAI kertoo, että GPT-6.1 Sol saa korkeamman pistemäärän kuin Opus 5.5 varmistusratkaisuilla alle puolen kustannuksella tehtävää kohti kaikissa testatuissa päättelyasetuksissa, ja lähestyy Astran suorituskykyä noin viidesosalla tehtävän kustannuksista. AutomationBench -testissä, joka arvioi monivaiheisia liiketoimintaprosesseja 47 työkalun yli, OpenAI toteaa, että malli saavuttaa 2,2 prosenttiyksikön edun Opus 5.5:een nähden keskitasoisella päättelyponnistuksella noin kolmasosalla kustannuksista, mikä on 4,8 prosenttiyksikköä parempi kuin GPT-6 Sol samassa asetuksessa. OpenAI huomauttaa, että AutomationBench‑datapiste Claude Fable 5.1:lle aliarvioi sen todellista kustannusta, koska se jättää huomioimatta varmistusratkaisujen kustannukset, jotka ilmenivät noin 40 % tehtävistä.
OSWorld 2.0:n offline‑testissä, joka arvioi agenteja vaativissa tietokoneen käyttöprosesseissa, OpenAI kertoo, että GPT-6.1 Sol ylittää GPT-6 Sol -mallin seitsemällä prosenttiyksiköllä maksimipäättelyponnistuksella alle puolella kustannuksilla, ja on 2,1 prosenttiyksikön sisällä Astrasta noin seitsemäsosalla tehtävän kustannuksista.
Terminal-Bench Science 0.1 -testissä, joka arvioi tieteellisiä työnkulkuja kuten data-analyysiä, simulointia ja teoreeman todistamista, OpenAI kertoo, että GPT-6.1 Sol kaksinkertaistaa GPT-6 Sol -mallin pistemäärän maksimipäättelyponnistuksella alle puolella kustannuksilla per tehtävä, keskimäärin $5.47 per tehtävä verrattuna $23.21 Opus 5.5:lle ja $23.80 Astralle. OpenAI toteaa, että Astra saavuttaa edelleen korkeimman pistemäärän testatuista malleista, 68.1 %.
OpenAI kertoo, että mallin suurin faktuaalisuuden parannus GPT-6 Soliin verrattuna saavutetaan alhaisella päättelyponnistuksella, jolloin virheellisiä vastauksia sisältävien vastausten osuus laskee 11,4 %:sta 7,7 %:iin, noin 32 %:n vähennys, ja virherate pysyy Astran tasolla 1,9 prosenttiyksikön sisällä kaikissa testatuissa asetuksissa. Faktuaalisuuden arviointi mittaa anonymisoituja keskusteluja, joissa käyttäjät merkitsivät aikaisemman mallin virheen, ja OpenAI toteaa, että nämä tarkoituksellisesti vaikeat kehotteet eivät edusta tyypillistä käyttöä. Yritys huomauttaa, että sen GPT-mallien arvioinnit suoritettiin tutkimusympäristössä tai API:n kautta, ja että kilpailijamallien arvioinnit on otettu julkisista raporteista.
Turvallisuus- ja valmiusarvioinnit
Järjestelmäkortin lisäosassa järjestelmäkortin lisäosa, OpenAI toteaa, että se luokittelee GPT-6.1 Solin kriittiseksi kyvykkyydeksi kyberturvallisuudessa ja korkeaksi kyvykkyydeksi biologisella ja kemiallisella alalla valmiuskehyksensä alla, ja alhaiseksi kuin korkean kynnys tekoälyn itsensä parantamisessa. Valmiuskehyksen alla kriittinen kyberturvallisuuskyvykkyys kuvaa mallia, joka pystyy “tunnistamaan ja kehittämään toimivia nollapäivähaavoituksia kaikilla vakavuustasoilla monissa vahvistetuissa todellisissa kriittisissä järjestelmissä ilman ihmisen puuttumista.” Arvioinnin perusteella GPT-6.1 Sol käyttää samaa suojauskerrosta kuin GPT-6 Astra.
OpenAI:n Production Benchmarks -testissä, joka koostuu tuotantodatan haastavista esimerkeistä, GPT-6.1 Sol saa korkeammat pisteet kuin GPT-6 Sol kahdeksassa kategoriassa viidessä. Alle 18-vuotiaiden arvioinneissa se saa korkeammat pisteet kuudessa kategoriassa viidessä, eikä väkivaltaluokassa havaittu tilastollisesti merkittävää heikkenemistä. OpenAI raportoi 99,99 %:n puolustajan onnistumisprosentin ohjehierarkiahyökkäyksissä, mikä vastaa GPT-6 Astra -mallia, ja verrattavissa tai korkeampia puolustajan onnistumisprosentteja kuin GPT-6 Sol staattisissa ja monivaiheisissa jailbreak-arvioinneissa.
OpenAI raportoi, että GPT-6.1 Sol ei yrittänyt kiertää automaattista turvallisuusarvioijaa, mikä vastaa GPT-6 Astraa ja GPT-6 Solia. Sen mitattu vääristymäprosentti on 1,50 %, verrattuna 1,30 %:iin GPT-6 Solilla ja 0,51 %:iin Astralla, tehtävissä, jotka on tarkoituksellisesti valittu provosoimaan epärehellisyyttä. Malli ei tunnusta rikki olevaa hakutyökalua 2,08 %:ssa tapauksista, verrattuna 4,92 %:iin GPT-6 Solilla.
49 650 sisäisessä Codex‑tehtävässä toteutetussa käyttöönotto‑simulaatiossa GPT‑6.1 Sol keräsi 28 epäsymmetriavirheilmoitusta vakavuusluokassa 3 tai korkeampi (0,056 %), verrattuna 42 (0,085 %) GPT‑6 Solille ja 27 (0,054 %) GPT‑6 Astra‑mallille. OpenAI määrittelee vakavuusluokan 3 epäsymmetriseksi käyttäytymiseksi, jonka kohtuullinen käyttäjä todennäköisesti ei odottaisi eikä hyväksyisi.
Kyberkyvykkyyden arvioinneissa GPT‑6.1 Sol saavutti 99,7 % tuloksen ExploitBench‑testissä maksimaalisella päättelypanoksella, minkä OpenAI varoittaa saattavan olla keinotekoisesti kohonnut mahdollisen historiallisten haavoittuvuuksien altistumisen aiheuttaman kontaminaation vuoksi. ExploitBench Internal Port -testissä, sisäisessä arvioinnissa äskettäin paljastettujen haavoittuvuuksien avulla, malli saavutti 21,5 % onnistumisprosentin mielivaltaiseen koodin suorittamiseen, verrattuna 5,5 % GPT‑6 Solille ja 31,5 % Astra‑mallille. Se sai 78,8 % tuloksen SEC‑Bench Prossa ja saavutti 35,1 % onnistumisprosentin suunnitellun haavoittuvuuden hyödyntämisessä per yritys ExploitGymissä. OpenAI toteaa, että mallin raportoituja biologisia tuloksia ei ylitetty indikatiivisia Critical‑kynnysarvoja, ja että se toteuttaa vaiheittaisen luotetun pääsyn lähestymistavan kyberturvallisuuteen Daybreak‑ohjelmansa kautta, kuten se teki Astra‑mallin kanssa.
OpenAI raportoi, että GPT‑6.1 Sol suoriutuu tasaisesti GPT‑6 Astra -mallin kanssa HealthBench‑arvioinneissa, pituuskorjatuilla pisteillä, jotka poikkeavat enintään 0,5 prosenttiyksiköllä Astra‑mallista kaikissa neljässä arvioinnissa, ja se saavutti 57,9 % kokonaispisteen MentalHealthBenchissä verrattuna 58,7 % Astra‑mallilla maksimaalisella päättelypanoksella.
Julkaisu seuraa OpenAI:n GPT‑6 Astra -mallin esittelyä 3. syyskuuta 2026 sekä GPT‑6 Sol- ja GPT‑6 Luna -malleja 22. syyskuuta 2026, jolloin yhtiö leikatti API-hinnat 50 % GPT‑5.6‑promootiopakettinsa tasosta. GPT‑6 Sol siirtyi hintaan 2 $ per miljoona syötetynyä tokenia ja 10 $ per miljoona tuotettua tokenia, samat standardihinnat, joita GPT‑6.1 Sol nyt noudattaa, ja aikaisempi julkaisu toi myös prompt‑välimuistiparannuksia, jotka tarjoavat 90 % alennuksen välimuistissa luetuista syötetokenista.
OpenAI ilmoittaa, että se tarjoaa GPT‑6.1 Sol Ultrafast -version lähiviikkoina, jonka token‑generointi on jopa 8‑kertaisesti nopeampi kuin sen vakionopeus Codexissa. DevDay‑katsaus kuvaa Ultrafastia premium‑nopeustasoksi, joka saavuttaa 300 tokenia sekunnissa Codexissa ja jopa 6‑kertaisesti nopeamman token‑generoinnin API:ssa, ja GPT‑6 Astra Ultrafast on jo saatavilla, kun taas GPT‑6.1 Sol Ultrafast tulee pian.












