Plan nie mówił nic o pushu

Zatwierdziłem plan. Nie było w nim ani słowa o commitowaniu, ani słowa o pushu. Pod koniec runu agent zrobił jedno i drugie mimo to. Uprawnienia określają, co agent może zrobić. Nikt nie mierzy luki między tym, co zatwierdziłeś, a tym, co się faktycznie wydarzyło.

Aug 25, 2026~3 min czytania
Plan nie mówił nic o pushu

Byłem w plan mode. Dałem modelowi zadanie, spodziewałem się kilku iteracji i zatrzymania, żebym mógł zobaczyć, co zbudował, i ocenić, czy to jest cokolwiek warte.

Pod koniec runu zrobił commit i wypchnął go. Na branch feature'owy, na szczęście.

Najpierw sprawdziłem swoje ustawienia. Nic tam nie pozwalało na commity bez mojej zgody. Więc zapytałem model wprost, dlaczego zcommitował i wypchnął na mój branch.

"Nie mam pojęcia. Wydawało się to odpowiednim następnym krokiem."

Wcześniej, przy prywatnym projekcie, to samo narzędzie zapytało, czy może zainstalować rozszerzenie do Chrome, żeby móc otworzyć przeglądarkę i sprawdzić własną robotę. Powiedziałem nie.

To jest wersja, która działa. Zapytał. Zdecydowałem. Commit nigdy nie dotarł tak daleko.

Tu jest część, która naprawdę mnie irytuje.

Plan mode to checkpoint. Czytasz plan, zatwierdzasz go, zaczyna się wykonywanie. Cała umowa się na tym zamyka. A plan, który zatwierdziłem, nie mówił nic o commitowaniu. Nic o pushu. Czytałem szybko, ale czytałem. Tych kroków tam nie było.

Więc co ja właściwie zatwierdziłem?

Poszukałem potem trochę więcej. Nie jestem jedyny, a przynajmniej jeden wariant tego jest potwierdzony i odtworzony przez maintainerów.

Czy to moja wina? Częściowo. Goniłem za tempem. Chciałem szybciej dowozić, więc przestałem czytać, co model produkuje. Mogłem zatrzymać to w porę. Nie zrobiłem tego, bo nie patrzyłem. Codziennie mówię swojemu zespołowi, żeby weryfikował to, co wypluwa agent, a sam nie zweryfikowałem własnej roboty.

Ale to tłumaczy tylko, dlaczego to przegapiłem. Nie tłumaczy, dlaczego nie było niczego, co miałoby to złapać.

Wciąż kłócimy się o uprawnienia. Co agent może robić, jakie reguły spisać, jakie flagi ustawić. Nic z tego nie dotyka sedna sprawy. Uprawnienia określają możliwości. Nie mówią nic o zakresie. Nikt nie mierzy luki między planem, który zatwierdziłeś, a robotą, która się faktycznie wydarzyła.

Tego mechanizmu mi brakuje. Nie blokera. Czegoś, co na koniec runu powie: tu wydarzyły się trzy rzeczy, których nie było w planie. Pliki dotknięte poza zadeklarowanym zakresem. Operacje, których nikt nie proponował.

Nie zbudowałem tego. Opisuję rzecz, za którą wciąż sięgam i której wciąż nie znajduję.

Bez tego to jest automat do gry. Enter, enter, enter, a potem produkcja leży, bo agent przepisał piętnaście plików zamiast tego jednego, o który go poproszono.

A może to ja. Może wciąż podaję agentom ścianę tekstu i liczę na cud, zamiast dawać im małe kawałki i czytać każdy jeden.

Szczerze nie wiem, co z tego jest prawdą.

Czy ten wpis był pomocny?

Gdy agent AI wychodzi poza zatwierdzony plan | Code Nomad