Inženýrství harnessů pro sebezdokonalování agentů
Článek se zabývá harnessem, vrstvou systému obklopující základní jazykový model, která orchestruje jeho provádění, správu kontextu a interakci s nástroji. Popisuje klíčové designové vzory jako automatizaci workflow, správu stavu prostřednictvím souborového systému a paralelní zpracování pomocí subagentur, s praktickou studií na příkladu kódovacích agentů jako Claude Code.
Jaký je rozdíl mezi harness vrstvou a samotným jazykovým modelem?
Harness je systém obklopující model, který orchestruje jeho chování, komunikaci s nástroji, správu kontextu a evaluaci výsledků. Zatímco model obsahuje základní inteligenci, harness určuje, jak model myslí, plánuje, vnímá kontext a zlepšuje se. Podle článku je harness vrstva stejně důležitá jako surová inteligence modelu.
Jak lze organizovat dlouhodobé agenturní úlohy s omezeným kontextovým oknem?
Místo uchovávání celého workflow a logů v kontextu model pracuje se souborovým systémem jako s trvalou pamětí. Artefakty jako experimenty, kódy, chyby a historie se ukládají do souborů, které model může číst a upravovat pomocí bash příkazů, čímž se překonávají limitace kontextové velikosti.
Jaký je vztah mezi harness engineringem a rekurzivním self-improvementem?
Harness engineering přispívá k rekurzivnímu self-improvement tím, že umožňuje modelům zlepšovat svůj systém nasazení, výcvikový pipeline a rozhodovací cykly. Vylepšení harnessové vrstvy může vést k lepším výkonům následujících verzí modelu bez změny vah samotného modelu.
- LongHorizon-Harness: nový přístup k dlouhodobým AI úkolům oddělením auditu od provádění — lh-harness.pages.dev 80 % shoda
- Umělá inteligence začíná zrychlovat svůj vlastní pokrok — openai.com 78 % shoda
- Mysl mimozemšťana: Hlavní vědec OpenAI v nové eseji říká, že jsme vytvořili intelekt, kterému doopravdy nerozumíme — openai.com 77 % shoda
- Claude Code8
- Codex6
- Cursor4
- OpenCode
- Anthropic16
- OpenAI26
- Lilian Weng
- Andrej Karpathy
- I. J. Good