Rozumowanie agentowe (o1, o3, modele rozumujące)
Modele, które „myślą” przed udzieleniem odpowiedzi — wewnętrzne łańcuchy rozumowania, obliczenia w czasie testu i samokorekta.
Rozumowanie agentowe (o1, o3, modele rozumujące) to bezpłatna lekcja AI Agents na CoddyKit. To lekcja 1 z 4. Możesz przeczytać całą lekcję poniżej za darmo — a potem ćwiczyć ją interaktywnie w przeglądarce z wbudowanym edytorem kodu i tutorem AI dostępnym 24/7. To część ścieżki edukacyjnej AI Agents, a Twój postęp synchronizuje się między webem a aplikacją CoddyKit. Kurs AI Agents zawiera 4 lekcji w sumie.
Części tej lekcji nie zostały jeszcze przetłumaczone i są wyświetlane po angielsku.
Nowa klasa modeli
OpenAI o1 (wrzesień 2024 r.) wprowadził „modele rozumujące” — LLM-y, które przed wygenerowaniem widocznej odpowiedzi jawnie rozumują krok po kroku. Do ich następców należą o3, DeepSeek R1, Claude z rozszerzonym trybem thinking, Gemini 2.5 thinking i wiele innych modeli.
Jak działają
Zamiast od razu wygenerować odpowiedź, model:
- Tworzy długi wewnętrzny ciąg „myślenia” (w stylu CoT)
- Rozważa wiele podejść
- Samodzielnie koryguje błędy
- Następnie emituje końcową, widoczną odpowiedź
Obliczenia w czasie testowania
Można określić, ile „myślenia” ma wykonać model. Więcej tokenów przeznaczonych na myślenie oznacza lepsze odpowiedzi w trudnych zadaniach. Kompromisem są opóźnienie i koszt.
OpenAI o-Series API
response = client.chat.completions.create(
model='o3-mini',
messages=[{'role': 'user', 'content': 'Solve this puzzle...'}],
reasoning_effort='high' # low / medium / high
)
print(response.choices[0].message.content)
print(response.usage.reasoning_tokens) # how many 'thinking' tokens were usedAnthropic Extended Thinking
response = client.messages.create(
model='claude-sonnet-4-5',
max_tokens=8192,
thinking={'type': 'enabled', 'budget_tokens': 4096},
messages=[{'role': 'user', 'content': 'Hard reasoning problem'}]
)
# response.content includes 'thinking' blocks + 'text' final answerKiedy modele rozumujące sprawdzają się najlepiej
- Matematyka wieloetapowa
- Generowanie kodu złożonego logicznie
- Rozumowanie prawnicze i naukowe
- Planowanie wymagające przewidywania kolejnych kroków
W testach o3 osiąga ponad 90% w AIME i wysokie wyniki w GPQA — znacznie wyższe niż modele nierozumujące.
Kiedy lepsze są standardowe modele
- Prosty czat / pytania i odpowiedzi — rozumowanie jest zbędne
- Ścieżki krytyczne pod względem opóźnień — rozumowanie dodaje sekundy
- Masowe zadania wrażliwe na koszty — rozumowanie zwielokrotnia koszt
- Zadania związane ze stylem i formatowaniem — brak korzyści
Profil kosztów
Tokeny rozumowania są uwzględniane w cenniku. o3-mini przy wysokim poziomie intensywności może użyć od 10 tys. do 100 tys. tokenów myślenia na jedno pytanie. W przypadku większych modeli rozumujących może to oznaczać koszt od 0,10 do 1 dolara za pytanie.
W pętlach agentów
Wykorzystanie modelu rozumującego jako planisty w większym agencie:
- Model rozumujący: planowanie / podejmowanie decyzji / ocena
- Standardowy model: wykonywanie kroków
- Wywołania narzędzi: standardowe wykonywanie
To najlepsze połączenie obu podejść: głębokie rozumowanie tam, gdzie jest potrzebne, oraz tanie wykonywanie w pozostałych miejscach.
Nie wymuszaj CoT dodatkowym promptem
W przypadku modeli rozumujących nie trzeba już dodawać promptów w rodzaju „myślmy krok po kroku” — modele i tak wykonują CoT wewnętrznie. Dodanie takiej instrukcji może wręcz pogorszyć wyniki.
Rozumowanie open source
DeepSeek R1, R1-Distill i inne modele wprowadzają rozumowanie do modeli z otwartymi wagami. Są dostępne w HuggingFace, Together AI i innych usługach.
Granica badań
- Dostrajanie refleksyjne — uczenie modeli krytykowania własnych odpowiedzi
- Wnioskowanie oparte na wyszukiwaniu — Tree-of-Thoughts, MCTS podczas wnioskowania
- Uczenie w czasie testowania — dostosowywanie wag do każdego zapytania
Uwaga: myślenie jest czarną skrzynką
„Myśli” modeli rozumujących są zazwyczaj ukryte przed użytkownikiem (OpenAI) albo podsumowywane (Anthropic). Ograniczona przejrzystość utrudnia debugowanie, dlatego zamiast tego należy polegać na ewaluacji danych wejściowych i wyjściowych.
Kiedy używać modeli rozumujących
W przypadku którego zadania model rozumujący jest najbardziej wart dodatkowego kosztu?
Podsumowanie
Modele rozumujące (o1, o3, R1, Claude z rozszerzonym trybem thinking) wymieniają czas i koszt na lepszą jakość w trudnych zadaniach. W agentach warto używać ich jako planistów i sędziów. W prostym czacie lepiej z nich zrezygnować.
Ucz się AI Agents dzięki korepetycjom AI — za darmo
Pisz i uruchamiaj kod w przeglądarce, otrzymuj natychmiastową pomoc od korepetytora AI dostępnego 24/7 i kontynuuj naukę w sieci lub w aplikacji.
- Kursy
- 60
- Lekcje
- 239
Często zadawane pytania
Czy lekcja „Rozumowanie agentowe (o1, o3, modele rozumujące)” jest bezpłatna?
Tak — pełny tekst „Rozumowanie agentowe (o1, o3, modele rozumujące)” jest dostępny za darmo tutaj w sieci. Aby ćwiczyć ją interaktywnie (wbudowany edytor kodu i tutor AI dostępny 24/7) i odblokować resztę kursu AI Agents, przejdź na CoddyKit PRO. Kurs AI Agents zawiera 4 lekcji w sumie.
Co nauczysz się w „Rozumowanie agentowe (o1, o3, modele rozumujące)”?
Modele, które „myślą” przed udzieleniem odpowiedzi — wewnętrzne łańcuchy rozumowania, obliczenia w czasie testu i samokorekta. Ćwiczysz AI Agents z praktycznym kodem, który uruchamiasz bezpośrednio w przeglądarce, a tutor AI dostępny 24/7 odpowiada na Twoje pytania podczas pracy nad lekcją.
Czy potrzebuję doświadczenia, aby zacząć AI Agents?
Nie wymagamy żadnego doświadczenia. AI Agents w CoddyKit jest strukturyzowany dla początkujących i zaawansowanych użytkowników, więc możesz zacząć tutaj lub od początku i uczyć się w swoim tempie. To lekcja 1 z 4.
Ile czasu zajmuje lekcja „Rozumowanie agentowe (o1, o3, modele rozumujące)”?
Większość lekcji CoddyKit trwa około 5–10 minut. Każda lekcja to mały, interaktywny krok, dzięki czemu robisz systematyczne postępy i zawsze wracasz dokładnie do tego samego miejsca — na webie i w aplikacji.
Czy mogę pisać i uruchamiać kod w tej lekcji AI Agents?
Tak. Każda lekcja AI Agents zawiera wbudowany edytor kodu, więc piszesz i uruchamiasz prawdziwy kod bezpośrednio w przeglądarce i od razu otrzymujesz sprzężenie zwrotne od AI — bez konfiguracji na komputerze.
Wszystkie lekcje w tym kursie
- Rozumowanie agentowe (o1, o3, modele rozumujące)
- Hybrydowi agenci symboliczno-neuronowi
- Agenci multimodalni (wizja + głos + działanie)
- Nierozwiązane problemy: odporność, zgodność, pamięć długoterminowa