Delba Oliveira — Feedback loops: Help Claude Code complete ambitious tasks with less babysitting¶
Szerző: Delba (@delba_oliveira)
Forrás: X/Twitter cikk, 2026. június 3.
Hossz: ~2500 szó
Hivatkozás: https://x.com/delba_oliveira/status/...
Összegzés¶
Delba Oliveira (Anthropic, Claude Code team) arról ír, hogyan lehet az AI ügynököt (Claude Code) autonóm módon dolgoztatni, emberi beavatkozás nélkül. A kulcs a feedback loop-ok építése — minden lépésnél automatikus ellenőrzés, hogy a modell maga észrevegye a hibákat, ne a felhasználónak kelljen javítgatnia.
A cikk négy fő ötletet mutat be:
1. Self-verification (a modell saját maga ellenőrzi)¶
- A Claude már most is tud önellenőrzést végezni: type errors, lint errors, failing tests, runtime errors — ezek determinisztikus jelek
- Ameddig az ellenőrzés a felhasználótól függ (manuális kódnézegetés, design review), addig "turn-based game" a session — elveszik az agent lényege: az autonómia
- Ahogy a modellek javulnak, ezek a self-check képességek is javulnak
2. A manual lépések kódolása skill-ekké¶
- Első lépés: írd le a folyamatod — Henky-nél ez: "mikor új podcastot dolgozol fel, 1) transcript 2) summary 3) wiki raw 4) topic update 5) rebuild indexes"
- Második lépés: kódold skill-be — használd a
skill-creatorplugint:ask Claude to interview you - Példa skill: frontend-verify —
description: Run whenever a UI (page, component, typography, CSS style) change is made - A skill-ek magukba foglalják a "taste and judgment" kritériumokat is: performance budget, accessibility checklist, design system rules, jó vs rossz példák
3. Második ügynök review a merge előtt¶
- Minden, ami az agentic loop-ban történik, az első ügynök elfogultságával terhelt (látta a teljes kontextust, döntéseket hozott)
- A merge előtt egy új, független ügynök review-ja nélkülözi ezt a bias-t
- Opciók:
/review(built-in): gyors single-pass PR read a terminálban/code-review(plugin): több subagent párhuzamosan, scoring confidence- Claude Code Review (managed service, GitHub, Team/Enterprise): automatikus minden PR-en
4. Skill bundling — workflow-k láncolása¶
- Claude Code team példája: egy feature work-hoz 5 skill-t kötnek össze:
/simplify— diff cleanup/verify— end-to-end check- Design check — ha UI-t érint
- PR open + subscribe
- CI watch + auto-fix
- Az egész dev lifecycle egyetlen workflow-ban: change → cleanup → verify → commit → PR → review → CI watch
Gyakorlati alkalmazás Henky workflow-jára¶
| Delba ötlete | Jelenlegi állapot | Teendő |
|---|---|---|
| Self-verification | ⚠️ Részben: cron payload manuális tesztje (cron run force) |
Sanity check skill beépítése a podcast pipeline-ba |
| Manual lépések → skill-ek | ✅ Megvan: bitcoin-knowledge-base, nostr-post, orchestrator, skill_workshop |
Bővíteni: podcast/cikk sanity-check skill |
| Second agent review | ❌ Hiányzik: a wiki-weekly-deploy közvetlenül megy productionbe |
Second agent review lépés a deploy payload-ba |
| Skill bundling | ⚠️ Részben: subagent-ek használata summary-készítésre, de nem szétbontva | "Sanity orchestrator" skill: rebuild + privacy_scan + deploy |
Konkrét változtatások a saját rendszerünkben¶
1. Sanity check a podcast pipeline végén¶
Most: a subagent készíti a summary-t, majd a main session frissíti a topic-ot és futtatja a rebuild_indexes.py-t. A subagent sikeresnek jelenti magát, ha a fájl megvan — de nem ellenőrzi a topic update-et.
Új: a pipeline végén egy sanity check:
- ✅ summary fájl megvan
- ✅ wiki_raw artifact megvan
- ✅ topic fájl frissülve (regex check: raw fájl neve benne van a sources: listában)
- ✅ rebuild_indexes.py sikeresen lefutott
Ha bármelyik hiányzik → fail, ne silent pass.
2. Second agent review a wiki-weekly-deploy előtt¶
Most: a wiki-weekly-deploy cron V 10:00-kor közvetlenül SSH-zik a VPS-re és deployol.
Új: két lépésben:
- Lépés 1: build + git diff lokálisan → review
- Lépés 2: review elfogadása → deploy
A review-t egy új isolated session végzi (külön agent, nem azonos a build agent-tel). Ha a review anomáliát talál (pl. üres diff, hatalmas fájlváltozás, topic file törlés), akkor rollback vagy human approval kell.
3. Skill orchestrator: rebuild + scan + deploy¶
A wiki_privacy_scan.py és a rebuild_indexes.py jelenleg külön scriptek. Ha az egyik elromlik, a másik tovább fut.
Új: orchestrator skill, ami:
- rebuild_indexes.py (atomic, success required)
- wiki_privacy_scan.py (scan, JSON report)
- Ha bármelyik fail → rollback (a git stash / state mentésen alapul)
- Csak akkor megy tovább, ha minden zöld
Kulcs idézetek (angol, eredeti)¶
"The more Claude can self-verify: the more independently it can work on long-running tasks."
"When checks depend on you, coding sessions become a turn-based game, and you lose what makes agents useful: autonomy."
"A new agent won't carry the same biases as the one that wrote the code."
"A good place to start is to write down the best-practices version of what you or your team already do."
"Both belong to the same development lifecycle."
Vélemény (Henky kontextusban)¶
A cikk nem újdonság (a self-verification és skill rendszer a mi OpenClaw workflow-nkban is jelen van), de a framing hasznos:
-
A "babysitting" ellenpontjaként megfogalmazott autonómia a lényeg — a mi rendszerünkben a subagent-ek célja ugyanez, de a subagent_treatment (main session önelégült, mert "a subagent szólt, hogy kész") pont az, ami elveszi az autonómiát a hibák felismerésében.
-
A "second agent review" ötletet könnyű átvenni és a
wiki-weekly-deploy-be beépíteni — konkrét, alacsony kockázatú javítás. -
A "skill bundling" a mi rendszerünkben orchestration néven fut (
$HOME/.openclaw/workspace/skills/orchestrator/SKILL.md), de jelenleg nem használjuk konzisztensen. A mai sessionben minden kézzel volt összerakva (RHR-412 subagent + 4 topic update kézzel).
Wiki frissítés szükséges¶
- Új topic:
agentic-workflow— a saját rendszerünk feedback loop-jairól - Vagy meglévő topic bővítése: alatt keresendő, hol van a "tooling-agents" / "self-improvement" / "automation" tematika
Kapcsolódó wiki topic-ok¶
bitcoin-knowledge-base(a saját KB rendszerünk)practical-ai(AI workflow / tooling)- A mai session: 3 podcast feldolgozás = pont egy ilyen workflow
Privacy státusz¶
A cikk publikus X/Twitter poszt, személyes adat nincs benne. Anonimizálás nem szükséges.