Agenttinen päättely (o1, o3, Reasoning Models)
Mallit, jotka ”ajattelevat” ennen vastaamista — sisäiset ajatusketjut, testiaikainen laskenta ja itsekorjaus.
Agenttinen päättely (o1, o3, Reasoning Models) on ilmainen Tekoälyagentit-oppitunti CoddyKitissä. Tämä on oppitunti 1/4. Voit lukea koko oppitunnin alta ilmaiseksi ja harjoitella sen jälkeen käytännössä selaimessa sisäänrakennetulla koodieditorilla ja ympäri vuorokauden käytettävissä olevan tekoälytuutorin avulla. Oppitunti kuuluu Tekoälyagentit-oppimispolkuun, ja edistymisesi synkronoituu verkon ja CoddyKit-sovelluksen välillä. Tekoälyagentit-kurssilla on yhteensä 4 oppituntia.
Osaa tämän oppitunnin sisällöstä ei ole vielä käännetty, joten se näytetään englanniksi.
Uusi malliluokka
OpenAI o1 (syyskuu 2024) toi käyttöön "päättelymallit" — LLM:t, jotka päättelevät vaiheittain ennen näkyvän vastauksen tuottamista. Seuraajia ovat muun muassa o3, DeepSeek R1, Claude extended thinking ja Gemini 2.5 thinking.
Näin ne toimivat
Sen sijaan, että malli tuottaisi vastauksen heti, se:
- Tuottaa pitkän sisäisen "ajattelusarjan" (CoT-tyylisesti)
- Tutkii useita lähestymistapoja
- Korjaa itse omia virheitään
- Tuottaa lopuksi näkyvän lopullisen vastauksen
Testiaikainen laskenta
Voitte valita, kuinka paljon "ajattelua" malli käyttää. Mitä enemmän tokeneita käytetään ajatteluun, sitä parempia vastaukset ovat vaikeissa ongelmissa. Haittapuolina ovat suurempi viive ja kustannukset.
OpenAI o-Series API
response = client.chat.completions.create(
model='o3-mini',
messages=[{'role': 'user', 'content': 'Solve this puzzle...'}],
reasoning_effort='high' # low / medium / high
)
print(response.choices[0].message.content)
print(response.usage.reasoning_tokens) # how many 'thinking' tokens were usedAnthropic Extended Thinking
response = client.messages.create(
model='claude-sonnet-4-5',
max_tokens=8192,
thinking={'type': 'enabled', 'budget_tokens': 4096},
messages=[{'role': 'user', 'content': 'Hard reasoning problem'}]
)
# response.content includes 'thinking' blocks + 'text' final answerMilloin päättelymallit loistavat
- Monivaiheinen matematiikka
- Monimutkaista logiikkaa sisältävä koodin generointi
- Oikeudellinen ja tieteellinen päättely
- Ennakointia vaativa suunnittelu
Vertailutestissä o3 saavuttaa AIME-testissä yli 90 %:n tuloksen ja saa korkean tuloksen GPQA:ssa — selvästi paremmin kuin päättelyyn käyttämättömät mallit.
Milloin standardimallit ovat parempia
- Yksinkertainen keskustelu tai kysymykset ja vastaukset — päättely on turhaa
- Viivekriittiset polut — päättely lisää sekunteja
- Kustannusherkkä massakäsittely — päättely moninkertaistaa kustannukset
- Tyylitys- ja muotoilutehtävät — ei hyötyä
Kustannusprofiili
Päättelytokenit lasketaan mukaan hinnoitteluun. o3-mini voi korkealla effort-asetuksella käyttää kysymykseen 10 000–100 000 ajattelutokenia. Suuremmilla päättelymalleilla se voi tarkoittaa 0,10–1 dollarin kustannusta kysymystä kohden.
Agenttisilmukoiden sisällä
Päättelymallin käyttäminen suunnittelijana suuremman agentin sisällä:
- Päättelymalli: suunnittelee, päättää ja arvioi
- Standardimalli: suorittaa vaiheet
- Työkalukutsut: suoritetaan normaalisti
Saatte molempien parhaat puolet: syvällistä päättelyä siellä, missä sitä tarvitaan, ja edullista suorittamista muualla.
Älkää pakottako CoT:tä päälle
Päättelymallien kanssa ei enää tarvita "ajatelkaa vaihe vaiheelta" -kehotteita — ne suorittavat CoT:n jo sisäisesti. Sen lisääminen voi itse asiassa heikentää tulosta.
Avoimen lähdekoodin päättely
DeepSeek R1, R1-Distill ja muut tuovat päättelyn avoimiin painoihin. Ne ovat saatavilla HuggingFacessa, Together AI:ssa ja muualla.
Tutkimuksen eturintama
- Reflection-tuning — mallien kouluttaminen kritisoimaan itseään
- Hakuperustainen päättely — Tree-of-Thoughts, MCTS päättelyaikana
- Testiaikainen koulutus — painojen mukauttaminen kyselykohtaisesti
Varoitus: mustan laatikon ajattelu
Päättelymallien "ajatukset" ovat yleensä teiltä piilossa (OpenAI) tai tiivistettyinä (Anthropic). Rajallinen läpinäkyvyys vaikeuttaa virheenkorjausta, joten luottakaa sen sijaan syöte- ja tulostearviointeihin.
Milloin päättelymalleja kannattaa käyttää
Mihin tehtävään päättelymalli on lisäkustannuksensa arvoinen?
Kertaus
Päättelymallit (o1, o3, R1, Claude extended thinking) vaihtavat aikaa ja kustannuksia vaikeiden tehtävien parempaan laatuun. Käyttäkää niitä agenttien sisällä suunnittelijoina ja arvioijina. Ohittakaa ne yksinkertaisessa keskustelussa.
Opi Tekoälyagentit tekoälytuutorin avulla — ilmaiseksi
Kirjoita ja suorita oikeaa koodia selaimessa, saa välitöntä apua tekoälytuutorilta ympäri vuorokauden ja jatka siitä, mihin jäit, verkossa tai sovelluksessa.
- Kurssit
- 60
- Oppitunnit
- 239
Usein kysytyt kysymykset
Onko oppitunti ”Agenttinen päättely (o1, o3, Reasoning Models)” ilmainen?
Kyllä – oppitunnin ”Agenttinen päättely (o1, o3, Reasoning Models)” koko tekstin voi lukea täällä verkossa ilmaiseksi. Jos haluat harjoitella interaktiivisesti sisäänrakennetulla koodieditorilla ja ympäri vuorokauden käytettävissä olevan tekoälytuutorin avulla sekä avata koko Tekoälyagentit-kurssin, päivitä CoddyKit PROhon. Tekoälyagentit-kurssilla on yhteensä 4 oppituntia.
Mitä opin oppitunnilla ”Agenttinen päättely (o1, o3, Reasoning Models)”?
Mallit, jotka ”ajattelevat” ennen vastaamista — sisäiset ajatusketjut, testiaikainen laskenta ja itsekorjaus. Harjoittelet Tekoälyagentit-aihetta koodilla, jonka suoritat suoraan selaimessa. Ympäri vuorokauden käytettävissä oleva tekoälytuutori vastaa kysymyksiisi oppitunnin aikana.
Tarvitsenko kokemusta aloittaakseni Tekoälyagentit-opiskelun?
Aiempi kokemus ei ole tarpeen. CoddyKitin Tekoälyagentit-oppimispolku sopii vasta-alkajista edistyneisiin, joten voit aloittaa tästä tai alusta ja edetä omaan tahtiisi. Tämä on oppitunti 1/4.
Kuinka kauan ”Agenttinen päättely (o1, o3, Reasoning Models)”-oppitunnin suorittaminen kestää?
Useimmat CoddyKitin oppitunnit kestävät noin 5–10 minuuttia. Jokainen oppitunti on lyhyt ja interaktiivinen, joten edistyt tasaisesti ja voit jatkaa siitä, mihin jäit – sekä verkossa että sovelluksessa.
Voinko kirjoittaa ja suorittaa koodia tällä Tekoälyagentit-oppitunnilla?
Kyllä. Jokainen Tekoälyagentit-oppitunti sisältää sisäänrakennetun koodieditorin, joten voit kirjoittaa ja suorittaa oikeaa koodia suoraan selaimessa ja saada välitöntä palautetta tekoälyltä – paikallista asennusta ei tarvita.
Kaikki tämän kurssin oppitunnit
- Agenttinen päättely (o1, o3, Reasoning Models)
- Symbolisten ja neuroverkkoagenttien yhdistelmät
- Multimodaaliset agentit (näkö + ääni + toiminta)
- Avoimet ongelmat: kestävyys, linjakkuus, pitkän aikavälin muisti