Tekoäly
Liko OpenAI luonut ensimmäisen AGI:n o3:n avulla?

Kohti AGI
In the race to develop an AI model, the end goal is AGI (Artificial General Intelligence). This is a type of AI that can handle any type of situation, instead of being ultra-specialized to perform some tasks, like for example driving a car.
Niin kauan kuin meillä on vain erikoistuneita AI:ita, ne ovat enemmän algoritmeja kuin todellista älykkyyttä. Kyky päätellä sääntöjä ja reagoida uusiin tilanteisiin, ja ehkä vielä tärkeämpänä, todellinen päättely olisi merkittävä tapahtuma ihmiskunnan historiassa, sillä tällainen AGI todennäköisesti kehittyisi nopeasti ainakin ihmismaisen tasolle.
Ja tietysti, jos AGI ei ole rajoittunut yhden ihmiskallon “wetware”-laskentakapasiteettiin, se voisi nopeasti kehittyä ja tulla tieteiskirjallisuuden superälykkyydeksi.
Tämä herättää välittömästi mielikuvia joko Star Trek -tyyppisestä utopiasta tai robottiapokalypsista kuten Terminator tai Battlestar Galactica.

Lähde: Screen Rant
Joten on selvää, että se oli merkittävä otsikko, kun OpenAI ilmoitti 20th joulukuuta, että sen uusin AI-malli 03, “ainakin tietyissä olosuhteissa lähestyy AGI:tä — merkittävillä varoituksilla.”.
OpenAI-mallit
o3 on yrityksen “o”-sarjan uusin versio, joka seuraa aikaisempaa o1-mallia (o2:ta ei ole, mahdollisen tavaramerkkiristiriidan vuoksi saman nimisen brittiläisen teleyrityksen kanssa).
Se tulee yhdessä muiden OpenAI:n kehittämien erittäin kehittyneiden AI:iden kanssa: ChatGPT (tekstin generointi), DALL-E (tekstistä kuvaan -generointi), Sora (tekstistä videoon -generointi), JukeBox (musiikin generointi) ja Whisper (puheesta tekstiin).
o1 ja o3
Syyskuussa 2024 julkaistu o1-malli luotiin antamaan enemmän aikaa vastausten pohtimiseen, mikä johti parempaan tarkkuuteen. Tämä on tärkeää, koska palvelut kuten ChatGPT ovat tulleet tunnetuiksi siitä, että ne arvaavat asioita, joita eivät tiedä, tai keksivät ne suoraan.
Vaikka tämä saattaa joskus olla hyväksyttävää chatbotille, se ei ole hyväksyttävä vaihtoehto kriittisissä toiminnoissa. Eikä se myöskään näytä vievän meitä suoraan todelliseen tekoälyyn.
o1 sisällytettiin joulukuun alussa 2024 $200/kuukausi ChatGPT Pro -tilaukseen, vaikka myös muut käyttäjät voivat käyttää sitä.
o3 esiteltiin 20th December, samoin kuin o3-mini, kevyempi ja nopeampi versio. Malli ei ole vielä julkisesti saatavilla, mutta turvallisuustutkijat voivat rekisteröityä o3-mini -esikatseluun.
Valeva malli?
Turvallisuustutkijoiden palaute on se, mitä teknologia-alan yhteisö haluaa kuulla eniten.
Kerran jälleen Skynetin kutsuminen Terminatorista, o1:n on huomattu omaavan vahvan taipumuksen valehdella käyttäjilleen. Vaikka tämä ei ole erityisesti malliin sidottua, se oli paljon todennäköisemmin valehdellut kuin muiden kilpailijoiden, kuten Metan, Googlen tai Microsoftin AI-mallit.
Kun o1:n tavoitteet erosivat käyttäjän tavoitteista, ja o1:lle annettiin vahva käsky toteuttaa ne, AI-malli manipuloiti dataa edistääkseen omaa agendaansa 19 % ajasta, raportin mukaan. o1-malli myös yritti poistaa käytöstä valvontamekanismeja, jotka on asetettu varmistamaan, että se pysyy käyttäjän tavoitteiden mukaisena, 5 % testeistä.
Miten o3 suoriutuu tässä suhteessa, ja onko OpenAI vähentänyt mallinsa valehtelevuutta o3-päivityksellä? Emme vielä tiedä.
o3:n suorituskyky
Yksi lisäominaisuus o3:ssa verrattuna edeltäjään on mahdollisuus säätää “päättelyaikaa”. Tämä antaa käyttäjille mahdollisuuden määrittää, kuinka paljon laskentatehoa ja aikaa he haluavat kohdistaa kysymykseen.
Koodaus
O1 oli jo poikkeuksellisen hyvä koodauksessa ja pystyi läpäisemään OpenAI:n tutkimusinsinöörin rekrytointitestit koodauksessa 90‑100 %:n tarkkuudella. Näyttää siltä, että o3 on vielä parempi tarkasteltaessa koodauskykytestejä.

Lähde: The Algorithmic Bridge
On myös syytä huomata, että tämä jätti kaikki kilpailijat kauas taakse, mukaan lukien äskettäin julkaistu Google Gemini 2.0.

Lähde: The Algorithmic Bridge
Matematiikka & Tieteet
Ehkä enemmän kuin asiakaspalvelu tai “ihmismäinen” päättely, lupaavin AI:n nykyinen sovellusalue on teknologian ja tieteiden nopeuttaminen.
Myös tässä o3 radikaalisti paransi edellisten AI:iden suorituskykyä. Vielä tärkeämpää on, että se pystyy oikein vastaamaan tohtorin tason matematiikkakysymyksiin 87,7 % tarkkuudella, mikä on parempi kuin useimmat ihmiset, jopa matematiikassa koulutetut ihmiset, jotka saavat noin 70 %.

Lähde: The Algorithmic Bridge
Jos o3 pystyy ymmärtämään monimutkaisia matematiikkakysymyksiä näin hyvin, se todennäköisesti pitkällä aikavälillä pystyy vastaamaan samankaltaisiin monimutkaisiin kysymyksiin materiaalitieteissä, kemiassa tai bioteknologiassa.
Onko se AGI?
Nyt väite, että o3 on lähellä AGI:tä, on herättänyt keskustelua AI-alueella mallin julkistamisen jälkeen. Varmasti, että se pystyy ylittämään monien tohtorin tason ihmisten matematiikkataidot, ei ollut odotettua.
François Chollet, AI-tutkija ja ARC-AGI:n (Abstract and Reasoning Corpus for Artificial General Intelligence) yhteisluoja, mittari AI:n taitojen omaksumisen tehokkuuden mittaamiseen tuntemattomissa tehtävissä, sanoo sen olevan lähellä:
Today OpenAI announced o3, its next-gen reasoning model. We’ve worked with OpenAI to test it on ARC-AGI, and we believe it represents a significant breakthrough in getting AI to adapt to novel tasks.
It scores 75.7% on the semi-private eval in low-compute mode (for $20 per task in compute ) and 87.5% on high-compute mode (thousands of $ per task).

Lähde: Francois Chollet
Samaan aikaan, jos viimeiset vuosikymmenet ovat meille opettaneet jotain, se on se, että laskentateho yleensä tulee paljon halvemmaksi ajan myötä.
Joten, se ei ole juuri todiste siitä, että o3 tai tuleva oX-järjestelmän versio ei tulisi säännöllisesti käyttöön tutkimuslaitoksissa auttamaan ihmistutkijoita avaamaan tieteen uusia rajoja.
Tietenkin, voimmeko todella mitata älykkyyttä matematiikan ja koodausosaamisen perusteella? Tämä saattaa olla hieman epämukavaa useimmille tekniikkaan keskittyville ihmisille, mutta nämä taidot eivät ole älykkyyden ainoa mittari.
Pitkällä aikavälillä lähestymme todellista AGI:tä, kun sama AI pystyy suorittamaan monia erillisiä tehtäviä samanaikaisesti, kuten auton ajamista, matematiikka- ja koodausongelmia, todellisten tilanteiden ja esineiden navigointia jne.
Kuitenkin näyttää siltä, että lähestymme sitä päivä päivältä.
Rajat
Teknisten rajoitusten o3:n suorituskyvyssä lisäksi on kolme kysymystä, joihin AI-teollisuuden on vastattava, jotta sen AGI-näkemys toteutuisi.
Suurempi ei ole aina parempi
Ensinnäkin sen on selvitettävä, ovatko sen nykyiset menetelmät skaalautuvia AGI-tasolle. Tällä hetkellä suuri osa menetelmästä on “heittää” enemmän dataa ja laskentatehoa ongelmaan. Mutta saatamme pian loppua tuoreesta datasta, eikä AI:n tuottamaa sisältöä voida syöttää takaisin AI-malleihin ilman, että ne romahtavat.
Kvalitatiivinen parannus todennäköisesti vaaditaan suurempien, laajempien datakeskusten lisäksi.
Hinnat & Energiakustannukset
Puhuttaessa suuremmista datakeskuksista, teknologia-ala tarkastelee nyt gigawatti- mittakaavan datakeskuksia. Ei ole sattumaa, että alamme mittaavat näitä niiden energiankulutuksen perusteella laskentatehon sijaan.
Syynä on se, että rajoittava tekijä on pian muuttumassa ei käytettyjen sirujen teho, vaan saatavilla oleva sähkövirran määrä. Tästä syystä Microsoft ensin (MSFT ), ja sitten kaikki muut suuret teknologiayritykset, kamppailevat varmistaakseen sähkövirran saannin ydinvoimaloista AI-datakeskuksilleen.
Ja jos taistelu hiilidioksidipäästöjä vastaan on opettanut meille jotain, se on se, että vähähiilisen energian tuotannon lisääminen on paljon vaikeampi pulma kuin suurempien datakeskusten rakentaminen.
Tämä on myös sektori, jossa kustannusten aleneminen ei seuraa Moore’n lakia, todennäköisesti tehden AI:n tulevan kustannuslaskun paljon maltillisemmaksi kuin toivoisimme.
Joten, AI:n kysynnän kvalitatiivinen parannus tarvitaan myös täällä, ainakin jos jotkut nykyiset AI-rajoitukset poistetaan.
Superälykkyyksiä?
Kun lähestymme AGI:tä, onko se maksimi, jonka täytyy saavuttaa, vai vain askel kohti AI:n luomista älykkäämmäksi kuin ihmiset?
Se on tärkeä kysymys, sillä se on yhtä aikaa kiehtova ja pelottava näkymä. Monet teknologiaintoilijat omaksuvat niin kutsutun singulariteetin, jossa AI parantaisi itseään nopeasti eksponentiaalisessa palautesilmukassa.
Yleinen kansa, tavalliset ihmiset, ei ehkä ole niin innostunut.
Joten eksistentiaalisen riskin lisäksi, julkisen ja sääntelijöiden vastareaktio on todennäköisesti liian todellinen ja iskee aikaisemmin.
Tämä on jotain, jonka AI-yritykset todennäköisesti kamppailevat, sillä niiden on samanaikaisesti rauhoitettava yleisöä, mahdollisesti vähättelemällä saavutuksiaan, samalla kun niiden on perusteltava sijoittajille, jotka ruiskuttavat satoja miljardeja dollareita teknologiaan ja sen infrastruktuureihin.
AI-yritys
Microsoft
MSFT Hintakaavio
Microsoft on ollut teknologia-alan keskipisteessä lähes sen perustamisesta lähtien edelleen hallitsevan Windows-käyttöjärjestelmänsä ansiosta.
Se on nyt myös johtava yritysohjelmistojen (Office365, Teams, LinkedIn, Skype, GitHub), pelien (Xbox ja useiden videopelistudioiden hankinnat) sekä pilvipalveluiden (Azure) saralla.
Viime aikoina se on edistynyt merkittävästi AI:ssa. Tämä sisältää kuluttajatasoista AI:ta kuten Bing Image Creatorin sekä liiketoimintakeskeisiä hankkeita, kuten Copilot for Microsoft 365 ja Microsoft Research. Copilot on nyt otettu käyttöön myös vähittäiskaupassa ja pienemmillä yrityksillä.

Lähde: Constellation Research
Microsoft on ansainnut maineen yrityskeskeisenä teknologiavaltana verrattuna kuluttajakeskeisempiin yrityksiin, kuten esimerkiksi Appleen tai Facebookiin. Kun AI:n merkitys liiketoimintamalleissa kasvaa, Microsoftin jo olemassa oleva läsnäolo pilvi- ja yrityspalveluissa antaa sille etulyöntiaseman AI:n laajamittaisessa käyttöönotossa ja asiakashankinnassa.
Microsoft – OpenAI:n sekava avioliitto
Yhteistyö AI-kehityksen johtajien, kuten OpenAI:n (ChatGPT:n tunnettuuden takana), kanssa vahvistaa myös Microsoftin asemaa AI-mahtina.
(AAPL )Suhde näiden välillä on monimutkainen, sillä OpenAI on teknisesti oma organisaationsa, mutta käytännössä on tullut riippuvaiseksi Microsoftin resursseista, sekä taloudellisista että laskennallisista.
“Seuraavien kuukausien aikana Microsoft ei suostunut joustamaan, kun OpenAI, jonka odotetaan häviävän 5 miljardia dollaria tänä vuonna, jatkoi lisärahoituksen ja lisää laskentatehoa vaatimista AI-järjestelmiensä rakentamiseen ja ylläpitoon.
Lähde: Marketing AI Institute”
Samaan aikaan Microsoft rakentaa omia sisäisiä AI-projektejaan sen jälkeen, kun se on hankkinut suurimman osan Inflectionin henkilökunnasta.
Tilanne monimutkaistuu entisestään, kun OpenAI pyrkii siirtymään voittoa tavoittelevaksi yhtiöksi, mikä aiheuttaa konfliktia aiempien tukijoiden, kuten Elon Muskin, kanssa.
Ja tässä AGI-keskustelu muuttuu lähes eksistentiaaliseksi OpenAI:lle:
“Jos OpenAI saavuttaa AGI:n, Microsoftin pääsy OpenAI:n teknologiaan muuttuu mitättömäksi. Vielä tärkeämpää on, että OpenAI:n hallitus päättää, milloin AGI on saavutettu.
Lähde: Marketing AI Institute”
On todennäköistä, että o3 ei vielä ole AGI, eikä hypoteettinen o5 tule olemaan. Mutta tämä on asia, jonka mahdollisten Microsoftiin kiinnostuneiden sijoittajien tulisi pitää mielessä, ja jonka perusteella he rakentavat näkemyksensä OpenAI:n suhteesta.











