Architektury SWE-Agent i OpenDevin
Przejrzyj kod źródłowy dwóch czołowych otwartych agentów kodujących, aby zobaczyć, jak profesjonaliści projektują interfejsy narzędzi i prompty.
Architektury SWE-Agent i OpenDevin to bezpłatna lekcja AI Agents na CoddyKit. To lekcja 4 z 4. Możesz przeczytać całą lekcję poniżej za darmo — a potem ćwiczyć ją interaktywnie w przeglądarce z wbudowanym edytorem kodu i tutorem AI dostępnym 24/7. To część ścieżki edukacyjnej AI Agents, a Twój postęp synchronizuje się między webem a aplikacją CoddyKit. Kurs AI Agents zawiera 4 lekcji w sumie.
Dlaczego warto badać istniejących agentów?
SWE-Agent i OpenDevin (obecnie OpenHands) to czołowi agenci programistyczni o otwartym kodzie źródłowym. Czytanie ich kodu uczy, jak pracują profesjonaliści.
SWE-Agent (Princeton)
SWE-Agent wprowadził koncepcję „Agent-Computer Interface” (ACI) — ściśle zaprojektowany interfejs wiersza poleceń, za pomocą którego agent manipuluje kodem.
Zakres narzędzi SWE-Agent
open/goto/scroll_up/scroll_down— przeglądarka plikówedit— edycja zakresów wierszycreate— tworzenie nowych plikówfind_file/search_dir— wyszukiwaniesubmit— zakończenie zadania
Koncepcja „window”
SWE-Agent pokazuje modelowi za każdym razem tylko 100-wierszowe „okno” pliku. Wymusza to jawne przewijanie, co zaskakująco pomaga utrzymać koncentrację.
Pętla informacji zwrotnych z lintera
Po każdej edycji SWE-Agent uruchamia linter. Jeśli pojawiły się nowe błędy, edycja zostaje odrzucona, a model musi spróbować ponownie.
OpenDevin / OpenHands
OpenDevin (przemianowany na OpenHands) to platforma wieloagentowa zbudowana wokół piaskownicy Dockera. Obsługuje wiele backendów „agenta” (CodeAct, BrowsingAgent itd.).
Zestaw narzędzi OpenHands
execute_bash— uruchamianie powłokistr_replace_editor— edytor w stylu Anthropicbrowse— narzędzie przeglądarkowe do wyszukiwania informacji w siecifinish— zakończenie zadania
Pętla działania i obserwacji
OpenHands jawnie modeluje kroki agenta jako pary Działanie -> Obserwacja:
{'action': 'execute_bash', 'args': {'command': 'pytest'}, 'observation': '5 failed, 3 passed', 'next_thought': 'I need to look at the failing tests.'}Wniosek z CodeAct
CodeAct (UIUC) pokazał, że pozwolenie modelowi na generowanie KODU PYTHON dla każdego wywołania narzędzia (zamiast ustalonych wywołań narzędzi w formacie JSON) często daje lepsze wyniki.
Powód: kod można naturalnie komponować, a model może używać pętli, warunków i wartości pośrednich.
OpenAI Codex CLI
OpenAI udostępniło Codex CLI — swój referencyjny agenta programistycznego o otwartym kodzie źródłowym. Wzorzec jest podobny: edytor, powłoka, wyszukiwanie i zakończenie.
Typowe wzorce architektoniczne
- Oddzielna piaskownica Dockera dla każdego zadania
- Zestaw narzędzi do odczytu, edycji, uruchamiania i wyszukiwania
- Weryfikacja po każdej edycji (linter lub test)
- Limity kroków (50–100 iteracji)
- Rejestrowanie śladu wszystkich działań
Różnice między implementacjami
- Format edycji: zakres wierszy a zamiana ciągu znaków lub pełnego pliku
- Przeglądarka plików: przewijanie w oknie a przejście do wiersza
- Pamięć: notatnik a uwagi w prompcie systemowym
- Częstotliwość weryfikacji: po każdym kroku a na końcu
Zbuduj własnego agenta
Można zbudować konkurencyjnego agenta programistycznego w 500–1000 wierszach kodu Pythona, łącząc:
- Narzędzia z lekcji 2
- Pętlę naprawczą z lekcji 3
- Krok planowania z lekcji 1
- Piaskownicę z kursu 23
- Ewaluację z kursu 21
Przeczytaj kod źródłowy
Zarówno SWE-Agent, jak i OpenHands są dostępne publicznie na GitHubie. Warto poświęcić popołudnie na przeczytanie ich głównych pętli — to najlepsza dostępna nauka projektowania agentów.
Wspólny wzorzec projektowy
Jaki wzorzec architektoniczny występuje niemal powszechnie u agentów programistycznych?
Podsumowanie
ACI w SWE-Agent, pętla działania i obserwacji w OpenHands oraz kod jako działanie w CodeAct. Należy czytać ich kod źródłowy, zapożyczać sprawdzone rozwiązania i budować własną, smuklejszą wersję.
Ucz się AI Agents dzięki korepetycjom AI — za darmo
Pisz i uruchamiaj kod w przeglądarce, otrzymuj natychmiastową pomoc od korepetytora AI dostępnego 24/7 i kontynuuj naukę w sieci lub w aplikacji.
- Kursy
- 60
- Lekcje
- 239
Często zadawane pytania
Czy lekcja „Architektury SWE-Agent i OpenDevin” jest bezpłatna?
Tak — pełny tekst „Architektury SWE-Agent i OpenDevin” jest dostępny za darmo tutaj w sieci. Aby ćwiczyć ją interaktywnie (wbudowany edytor kodu i tutor AI dostępny 24/7) i odblokować resztę kursu AI Agents, przejdź na CoddyKit PRO. Kurs AI Agents zawiera 4 lekcji w sumie.
Co nauczysz się w „Architektury SWE-Agent i OpenDevin”?
Przejrzyj kod źródłowy dwóch czołowych otwartych agentów kodujących, aby zobaczyć, jak profesjonaliści projektują interfejsy narzędzi i prompty. Ćwiczysz AI Agents z praktycznym kodem, który uruchamiasz bezpośrednio w przeglądarce, a tutor AI dostępny 24/7 odpowiada na Twoje pytania podczas pracy nad lekcją.
Czy potrzebuję doświadczenia, aby zacząć AI Agents?
Nie wymagamy żadnego doświadczenia. AI Agents w CoddyKit jest strukturyzowany dla początkujących i zaawansowanych użytkowników, więc możesz zacząć tutaj lub od początku i uczyć się w swoim tempie. To lekcja 4 z 4.
Ile czasu zajmuje lekcja „Architektury SWE-Agent i OpenDevin”?
Większość lekcji CoddyKit trwa około 5–10 minut. Każda lekcja to mały, interaktywny krok, dzięki czemu robisz systematyczne postępy i zawsze wracasz dokładnie do tego samego miejsca — na webie i w aplikacji.
Czy mogę pisać i uruchamiać kod w tej lekcji AI Agents?
Tak. Każda lekcja AI Agents zawiera wbudowany edytor kodu, więc piszesz i uruchamiasz prawdziwy kod bezpośrednio w przeglądarce i od razu otrzymujesz sprzężenie zwrotne od AI — bez konfiguracji na komputerze.
Wszystkie lekcje w tym kursie
- Wzorce agentowe: planowanie–wykonanie–weryfikacja
- Interfejs narzędzi agenta kodującego (Read, Edit, Bash)
- Iteracyjne pętle samokorekty
- Architektury SWE-Agent i OpenDevin