Od chata do delegiranja

Agentska AI za metodološka istraživanja

2026-06-23

Gdje ste sada

Otvorite prozor za chat. Sastavite prompt. Dobijete odgovor.

Zatim vi kopirate kôd, pokrenete ga, naletite na grešku, zalijepite grešku natrag i pokušate ponovno.

Vi ste voditelj projekta. Cijeli plan držite u svojoj glavi, a AI vam pomaže s jednim korakom u nizu.

Iskorak

Razgovorna AI (chat AI) pomaže vam da obavite posao.

Agentskoj AI (agentic AI) se posao povjerava.

Prestajete sastavljati prompt da biste dobili odgovor. Počinjete zadavati cilj i ograničenja, a zatim nadzirati dok ona planira, djeluje, provjerava vlastiti rad i vraća se kad je gotovo.

Ovo je vama poznata vrsta problema

Ne razmišljajte o „pametnijem chatbotu”. Razmislite o onome što ionako svakodnevno radite.

Brifirate i nadzirete asistenta (RA) te provjeravate njegov rad.

Pišete plan analize prije nego što dotaknete podatke.

Recenzirate (peer review) tuđi rad jer autor ne ocjenjuje objektivno vlastiti.

Vodite revizijski trag kako bi rezultat bio obranjiv i ponovljiv.

Agentska AI sastavljena je upravo od tih poteza, a vi ste jedinstveno osposobljeni da je vodite.

Četiri boli koje rješava

Zaboravlja između sesija zašto ste odabrali tu notaciju ili koji ste bug ispravili.

Kvaliteta varira, pa je jedna tablica čista, a sljedećoj nedostaju standardne greške.

Pregledavanje iscrpljuje, jer ručno provjeriti 140 slajdova ubija volju. Umoran recenzent propušta grešku u analizi, ne samo tipfeler.

Najdublja je ova. Provjera pravopisa uhvati pogrešku u slovu, ali nikad obrnuti predznak u teoremu ili regresiju koja je tiho pogrešna.

Sve u jednom dahu

Opišete što želite, običnim jezikom, a AI se ponaša kao glavni izvođač radova.

Izradi nacrt i zatraži vaše odobrenje.

Unajmi ekipu specijalista.

Pregleda njihov rad i vrati ih da poprave što ne valja.

Vrati se k vama tek kad posao prođe inspekciju.

Može se zapetljati ili preskočiti korak, pa zato vi odobravate plan prije nego dotakne datoteke, a prag kvalitete blokira rad ispod praga.

Vi govorite, AI vodi gradilište. Sve ostalo su instalacije, izgrađene tako da nikad ne morate misliti na instalacije.

Ekipa i kuća

Pet slojeva obavlja sav posao, a svaki je stvarna datoteka.

Što sloj radi Datoteka
Ustav, stalna kućna pravila koja se čitaju svake sesije CLAUDE.md · AGENTS.md
Priručnici na zahtjev koji se pojave samo kad su relevantni .claude/rules/*.md
Imenovani gumbi (vještine / skills), /render, /proofread, /commit .claude/skills/*/SKILL.md
Uski specijalisti, svaki provjerava jednu stvar .claude/agents/*.md
Dozvole i alarmi koji se automatski okidaju (opciono za početak) .claude/settings.json + hooks

CLAUDE.md je Claudeov oblik, a sličan obrazac postoji u OpenAI-jevim alatima (AGENTS.md, npr. Codex CLI). Ispod svega je memorija koja preživljava kroz sesije.

Ideja 1, specijalisti pobjeđuju generalista

Tražite li od jednog asistenta da istovremeno pazi na gramatiku, raspored, matematiku i kôd, sve četvero obavi osrednje.

Dajte svakoj dimenziji vlastitog uskog inspektora i greške skrivene na vidnom mjestu napokon budu uhvaćene.

Kao u istraživačkom timu, jedan RA čisti podatke, drugi provjerava kodiranje, a treći potpisuje, nikad jedna osoba za sve.

Na špici od 140 slajdova jedan agent uhvati indeks koji se tiho promijenio, drugi uhvati preklapajuću oznaku na dijagramu, a treći uhvati skriptu koja je vrtjela k = 10 dok slajd kaže k = 5.

Ideja 2, suparnička petlja (adversarial loop)

Ovo je srce dizajna.

Kritičar (deck-critic) čita rad i nabraja svaku grešku, ali ne smije dirati datoteke.

Zaseban ispravljač (deck-fixer) obavlja popravke, ali ne smije odobriti vlastiti rad.

Kritičar zatim ponovno čita, i tako u krug, do čistog prolaza.

Kritičar ne može popravljati, pa nema razloga biti popustljiv. Ispravljač ne može potpisati, pa ne može prerano proglasiti pobjedu. To je naprosto recenzija (peer review), i ubija najčešći AI promašaj, a to je veselo objaviti „izgleda dobro” kad nije.

Kako se to povezuje

Blokovi nisu zasebni. To su datoteke koje surađuju na jednom zadatku, a posao teče u tri koraka.

Prvo plan. AI pročita CLAUDE.md i relevantna pravila te napiše plan, a onda ga vi odobrite.

Zatim izvođač. Vještina razašalje agente, pri čemu kritičar i recenzent samo čitaju, ispravljač popravi, a kritičar ponovno provjeri. Naredba /render potvrdi da se HTML stvarno izgradio.

Na kraju ocjena. Dobijete ocjenu od 0 do 100 i kratak sažetak, pa vi odobrite spremanje naredbom /commit.

Vi pokrenete vještinu (/…), a ona zove agente. CLAUDE.md, pravila i memorija rade u pozadini, a vi ste prisutni na dvije kontrolne točke, kod odobrenja plana i kod odobrenja spremanja.

Dva pravila koja održavaju poštenje

Ocjena ide do 100 i čita se kao semafor.

80 znači sigurno za spremanje napretka.

90 znači spremno za isporuku, a 95 je izvrsnost.

Sve ispod 80 je blokirano dok se greške ne isprave.

Pravilo provjere je da AI ne smije proglasiti zadatak gotovim dok stvarno nije kompajlirao, renderirao ili pokrenuo rezultat. Bez objave uspjeha iz mašte.

Što preživi kad se chat napuni

Dugi razgovori se sažimaju, a živi chat je ono što ne preživljava. Zato sve vrijedno čuvanja ide na disk, u četiri označene ladice.

Ustav drži stalna pravila.

Dnevnik ispravaka drži lekcije, da se ista greška nikad ne ponovi.

Planovi drže strategiju za trenutni zadatak.

Dnevnici sesija drže zašto iza svake odluke. Git bilježi što, a dnevnik bilježi zašto.

Chat je ploča koja se briše. Ladice su laboratorijski dnevnik koji se ne briše.

Kako teče stvarni posao

Dva poteza, redom.

Prvo planiraj. AI izradi plan, spremi ga i pokaže vam prije nego dotakne ijednu datoteku, a vi ga odobrite ili izmijenite.

Zatim način rada izvođača (contractor mode) preuzima upravljač. Radi, provjerava, pokreće inspektore paralelno, primjenjuje popravke od najgoreg prema najmanjem, ocjenjuje rezultat i vrti petlju do čistog prolaza.

Na kraju vam preda kratak sažetak i čeka. Ništa ne sprema (commit) dok vi ne kažete.

Griješi, i to je poanta

Besprijekorna demonstracija je prodajni trik. Pošteni alati pokazuju svoje načine otkazivanja.

Može izmisliti citat (halucinacija), pa agent za provjeru uspoređuje svaku referencu sa stvarnim katalogom.

Može biti samouvjereno u krivu, pa kritičar ponovno provjerava, a prag blokira loš rad.

Može poduzeti pogrešnu radnju, pa visokorizični koraci čekaju vaše odobrenje.

Regulator autonomije nije prekidač. Visokorizični koraci, poput brisanja datoteke, commita ili slanja, stanu i čekaju vaše „da”, a niskorizični teku sami.

Kao kod plana analize, unaprijed odlučite koji su koraci visokorizični (čekaju vaše odobrenje), a koji niskorizični (teku sami).

Riječ o trošku

Jeftini modeli rade crnčarenje, a skupi model razmišlja.

Otprilike 70% sitnih mehaničkih zadataka odlazi brzom, jeftinom modelu (ilustrativna procjena).

Otprilike 20% posla pregleda odlazi srednjem modelu.

Otprilike 10% stvarne prosudbe odlazi vrhunskom modelu.

U nekim projektima račun zna pasti i za pola, ovisno o poslu (ilustrativno). Mehanički posao ništa ne gubi. Ne plaćate redovitog profesora da preoblikuje citate.

Ne treba vam sve odjednom

Cijeli ovaj repozitorij je samo 1 ustav, 4 pravila, 4 vještine i 3 agenta (peti sloj, dozvole i alarmi, još nije dodan).

I ni to ne trebate odjednom. To je strop, a ne pod.

Počnite s ustavom i tri vještine (skills), a to su /render, /proofread i /commit. Dodajte priručnik ili specijalista tek kad stvarno osjetite da nedostaje.

Usput, ovi slajdovi

Ova špica je obična tekstualna datoteka u mapi.

Agent je pomogao da se napiše.

Živi u sustavu za verzioniranje (git), pa vidite točno što se promijenilo, redak po redak.

Jedna naredba ponovno izgradi cijelu stvar, zajedno s ispisima kôda.

Medij jest poruka. Ovako izgleda „rad koji je napisao agent i koji je ponovljiv”.

Ako zaboravite sve ostalo

Vi govorite, AI vodi gradilište.

Specijalisti pobjeđuju generalista.

Kritičar koji ne može popravljati, uparen s ispravljačem koji ne može sam sebe odobriti, održava rad poštenim.

Što ne zapišete na disk nestaje kad se razgovor napuni.

Počnite malo i pustite da raste.

Kako se zapravo radi

Razgovarate s istim AI-jem kroz tri sučelja, a isti obrazac vrijedi i za Codex i druge alate.

Chat (npr. claude.ai) je poznat, ali ne dira vaše datoteke. Dobar je za učenje, ne za projekt.

Ekstenzija u VS Codeu (plugin) je AI asistent unutar uređivača. Vidite datoteke, gumbe i klik za odobrenje. To je preporuka za početak.

Terminal (CLI) znači da utipkate claude (ili codex) u mapi projekta. To je jedino sučelje gdje agenti, vještine i pravila rade zajedno.

Agenti, vještine i pravila žive u zadnja dva sučelja. Tu je „gradilište”. (Detalji su u radionica/01-postavljanje/.)

Što vam treba i koliko košta

Preduvjeti su Claude Code, Node.js i git, a po potrebi Quarto i R. (Cijene se mijenjaju.)

Claude Pro stoji oko 20 $ mjesečno i uključuje Claude Code. To je dovoljno za početak.

Napredni planovi stoje oko 100 do 200 $ mjesečno, za intenzivan rad.

Točne cijene i preduvjeti su u radionica/01-postavljanje/, a službeno na anthropic.com/pricing.

Gdje početi ovaj tjedan

Odaberite jedan dosadan, mehanički zadatak koji biste dali asistentu prve godine.

Napišite ga kao specifikaciju zadatka (task spec), s ciljem, ograničenjima i opisom kako izgleda „gotovo”.

Pustite agenta da ga isplanira, odobrite plan, pa pregledajte rezultat prema vlastitim mjerilima.

Taj jedan pokus nauči vas više od bilo kojeg slajda. (Komplet resursa čine pojmovnik, kartica praga kvalitete i podsjetnik.)

Empirijski primjer, uzmite s GitHuba

Ovo nije teorija. Klonirajte repozitorij i pokrenite dva mala pokusa.

git clone https://github.com/lusiki/AI-radionica-za-istra-iva-e.git

Otvorite mapu u VS Codeu, ili pokrenite claude u terminalu, i krenite. (Korak po korak je u radionica/02-primjeri/.)

Pokus 1, renderiraj i provjeri

Utipkate /render.

AI pokrene quarto render, pa provjeri da slides/talk.html stvarno postoji.

Tek tada javi „gotovo”. Otvorite HTML i špica je tu.

Poanta je da agent ne tvrdi uspjeh dok ga nije provjerio. Jedna naredba daje ponovljiv rezultat. (Bez Quarta /render pošteno STANE.)

Pokus 2, suparnička petlja

Utipkate /review-deck.

Agenti deck-critic i audience-reviewer samo čitaju, ne mijenjaju.

audience-reviewer pazi da poruka ostane primjerena publici, a izlaz su nalazi po težini i ocjena od 0 do 100.

Zatim deck-fixer popravi najgore prvo, kritičar ponovno provjeri, i dobijete novu ocjenu.

Poanta je da kritičar ne smije uređivati, a ispravljač ne smije sam sebe odobriti. To je recenzija koja hvata i ono što provjera pravopisa ne bi, na primjer tvrdnju bez pokrića.

Hvala i naprijed

Pregled blokova je u index.html, mapa za učenje u radionica/00-razumijevanje/, a pokusi u radionica/02-primjeri/.

Odaberite jedan dosadan zadatak ovaj tjedan i delegirajte ga.

Pitanja?