Kihagyás

Delba Oliveira — Feedback loops: Help Claude Code complete ambitious tasks with less babysitting

Szerző: Delba (@delba_oliveira)
Forrás: X/Twitter cikk, 2026. június 3.
Hossz: ~2500 szó
Hivatkozás: https://x.com/delba_oliveira/status/...


Összegzés

Delba Oliveira (Anthropic, Claude Code team) arról ír, hogyan lehet az AI ügynököt (Claude Code) autonóm módon dolgoztatni, emberi beavatkozás nélkül. A kulcs a feedback loop-ok építése — minden lépésnél automatikus ellenőrzés, hogy a modell maga észrevegye a hibákat, ne a felhasználónak kelljen javítgatnia.

A cikk négy fő ötletet mutat be:

1. Self-verification (a modell saját maga ellenőrzi)

  • A Claude már most is tud önellenőrzést végezni: type errors, lint errors, failing tests, runtime errors — ezek determinisztikus jelek
  • Ameddig az ellenőrzés a felhasználótól függ (manuális kódnézegetés, design review), addig "turn-based game" a session — elveszik az agent lényege: az autonómia
  • Ahogy a modellek javulnak, ezek a self-check képességek is javulnak

2. A manual lépések kódolása skill-ekké

  • Első lépés: írd le a folyamatod — Henky-nél ez: "mikor új podcastot dolgozol fel, 1) transcript 2) summary 3) wiki raw 4) topic update 5) rebuild indexes"
  • Második lépés: kódold skill-be — használd a skill-creator plugint: ask Claude to interview you
  • Példa skill: frontend-verify — description: Run whenever a UI (page, component, typography, CSS style) change is made
  • A skill-ek magukba foglalják a "taste and judgment" kritériumokat is: performance budget, accessibility checklist, design system rules, jó vs rossz példák

3. Második ügynök review a merge előtt

  • Minden, ami az agentic loop-ban történik, az első ügynök elfogultságával terhelt (látta a teljes kontextust, döntéseket hozott)
  • A merge előtt egy új, független ügynök review-ja nélkülözi ezt a bias-t
  • Opciók:
  • /review (built-in): gyors single-pass PR read a terminálban
  • /code-review (plugin): több subagent párhuzamosan, scoring confidence
  • Claude Code Review (managed service, GitHub, Team/Enterprise): automatikus minden PR-en

4. Skill bundling — workflow-k láncolása

  • Claude Code team példája: egy feature work-hoz 5 skill-t kötnek össze:
  • /simplify — diff cleanup
  • /verify — end-to-end check
  • Design check — ha UI-t érint
  • PR open + subscribe
  • CI watch + auto-fix
  • Az egész dev lifecycle egyetlen workflow-ban: change → cleanup → verify → commit → PR → review → CI watch

Gyakorlati alkalmazás Henky workflow-jára

Delba ötlete Jelenlegi állapot Teendő
Self-verification ⚠️ Részben: cron payload manuális tesztje (cron run force) Sanity check skill beépítése a podcast pipeline-ba
Manual lépések → skill-ek ✅ Megvan: bitcoin-knowledge-base, nostr-post, orchestrator, skill_workshop Bővíteni: podcast/cikk sanity-check skill
Second agent review ❌ Hiányzik: a wiki-weekly-deploy közvetlenül megy productionbe Second agent review lépés a deploy payload-ba
Skill bundling ⚠️ Részben: subagent-ek használata summary-készítésre, de nem szétbontva "Sanity orchestrator" skill: rebuild + privacy_scan + deploy

Konkrét változtatások a saját rendszerünkben

1. Sanity check a podcast pipeline végén

Most: a subagent készíti a summary-t, majd a main session frissíti a topic-ot és futtatja a rebuild_indexes.py-t. A subagent sikeresnek jelenti magát, ha a fájl megvan — de nem ellenőrzi a topic update-et.

Új: a pipeline végén egy sanity check: - ✅ summary fájl megvan - ✅ wiki_raw artifact megvan - ✅ topic fájl frissülve (regex check: raw fájl neve benne van a sources: listában) - ✅ rebuild_indexes.py sikeresen lefutott

Ha bármelyik hiányzik → fail, ne silent pass.

2. Second agent review a wiki-weekly-deploy előtt

Most: a wiki-weekly-deploy cron V 10:00-kor közvetlenül SSH-zik a VPS-re és deployol.

Új: két lépésben: - Lépés 1: build + git diff lokálisan → review - Lépés 2: review elfogadása → deploy

A review-t egy új isolated session végzi (külön agent, nem azonos a build agent-tel). Ha a review anomáliát talál (pl. üres diff, hatalmas fájlváltozás, topic file törlés), akkor rollback vagy human approval kell.

3. Skill orchestrator: rebuild + scan + deploy

A wiki_privacy_scan.py és a rebuild_indexes.py jelenleg külön scriptek. Ha az egyik elromlik, a másik tovább fut.

Új: orchestrator skill, ami: - rebuild_indexes.py (atomic, success required) - wiki_privacy_scan.py (scan, JSON report) - Ha bármelyik fail → rollback (a git stash / state mentésen alapul) - Csak akkor megy tovább, ha minden zöld


Kulcs idézetek (angol, eredeti)

"The more Claude can self-verify: the more independently it can work on long-running tasks."

"When checks depend on you, coding sessions become a turn-based game, and you lose what makes agents useful: autonomy."

"A new agent won't carry the same biases as the one that wrote the code."

"A good place to start is to write down the best-practices version of what you or your team already do."

"Both belong to the same development lifecycle."


Vélemény (Henky kontextusban)

A cikk nem újdonság (a self-verification és skill rendszer a mi OpenClaw workflow-nkban is jelen van), de a framing hasznos:

  1. A "babysitting" ellenpontjaként megfogalmazott autonómia a lényeg — a mi rendszerünkben a subagent-ek célja ugyanez, de a subagent_treatment (main session önelégült, mert "a subagent szólt, hogy kész") pont az, ami elveszi az autonómiát a hibák felismerésében.

  2. A "second agent review" ötletet könnyű átvenni és a wiki-weekly-deploy-be beépíteni — konkrét, alacsony kockázatú javítás.

  3. A "skill bundling" a mi rendszerünkben orchestration néven fut ($HOME/.openclaw/workspace/skills/orchestrator/SKILL.md), de jelenleg nem használjuk konzisztensen. A mai sessionben minden kézzel volt összerakva (RHR-412 subagent + 4 topic update kézzel).


Wiki frissítés szükséges

  • Új topic: agentic-workflow — a saját rendszerünk feedback loop-jairól
  • Vagy meglévő topic bővítése: alatt keresendő, hol van a "tooling-agents" / "self-improvement" / "automation" tematika

Kapcsolódó wiki topic-ok

  • bitcoin-knowledge-base (a saját KB rendszerünk)
  • practical-ai (AI workflow / tooling)
  • A mai session: 3 podcast feldolgozás = pont egy ilyen workflow

Privacy státusz

A cikk publikus X/Twitter poszt, személyes adat nincs benne. Anonimizálás nem szükséges.

Vissza a tetejére