AI harness – co to je a k čemu slouží?

AI harness je obal kolem jazykového modelu, díky kterému model něco skutečně vykoná. Tvoří ho exekuční smyčka, nástroje, přístup ke kontextu a paměti, oprávnění, hooky a limity. Model sám jen vytvoří výstup nebo požadavek na použití nástroje – teprve harness ho provede a dá modelu pravidla, podle kterých smí jednat.

Jaký je rozdíl mezi modelem a harnessem?

Model je jazyková část, harness je všechno kolem ní. Bez možnosti volat nástroje model jen popíše, co by udělal: nepřečte fakturu ze složky, nezaloží objednávku v systému, nepošle e-mail. Nástroje propojí model se světem a harness je vrstva, která volání zařídí, vrátí modelu výsledek a rozhodne, jestli se pokračuje dalším krokem. V komunitě se to shrnuje do rovnice agent = model + harness.

Z čeho se harness skládá?

  • Smyčka – opakovaný cyklus zadání, rozhodnutí, akce a vyhodnocení výsledku, který podrobněji popisuje heslo agent loop.
  • Nástroje – konkrétní schopnosti, které model může zavolat: čtení souborů, dotaz do databáze, propojení s firemními systémy přes API. Dobře postavený harness pouští souběžně nástroje, které jen čtou, zatímco kroky měnící data řadí za sebe.
  • Kontext – všechno, co model v daný okamžik vidí, tedy zadání, historii a výsledky nástrojů. Vejde se toho jen omezené množství, viz context window. Když se okno zaplní, harness starší obsah podle své Implementace zkrátí, vynechá, nebo shrne. Proto trvalá pravidla patří do souboru, který se do každého požadavku vkládá znovu.
  • Oprávnění – co agent smí udělat sám a na co se musí zeptat. Zamítnutí přitom nemusí být konec běhu: harness umí vrátit odmítnutí agentovi jako výsledek, aby zvolil jiný postup, jiné implementace tím běh ukončí. Odtud vede přímá cesta k režimu human-in-the-loop, kdy citlivé kroky schvaluje člověk.
  • Hooky – funkce navěšené na okamžiky v běhu agenta, třeba před použitím nástroje nebo po něm. Běží mimo hlavní konverzaci, a pokud se jejich výstup nevrací modelu, nespotřebovávají tokeny. Proto se hodí na záznam toho, co agent provedl.
  • Limity a navázání na běh – strop na počet kroků a na útratu, který ukončí zacyklený běh, a identifikátor sezení, přes který se dá pokračovat v rozdělané práci; starší obsah ovšem může být zkrácený.
  • Subagenti – pomocní agenti, kteří obvykle pracují ve vlastním čistém kontextu a vrací jen výsledek své práce. Podle implementace ale mohou dostat i vybranou část konverzace rodiče.

Proč se ten pojem používá nejednotně?

Protože není ustálený. Část zdrojů, například glosář Hugging Face, chápe harness úzce jako pouhou exekuční vrstvu, která volá model, zpracuje volání nástrojů a rozhodne, kdy skončit – nástroje, prompty i paměť řadí pod pojem „scaffolding“. Jiné zdroje, třeba parallel.ai, pojímají harness široce jako celý obal včetně nástrojů, paměti a orchestrace. Když tedy někdo řekne „harness“, vyplatí se doptat, co přesně tím myslí.

Pro netechnické vysvětlení pomáhá přirovnání k firmě, byť jde jen o pomůcku, ne o technický popis: smyčka je rozhodovací cyklus, nástroje jsou lidé a systémy, oprávnění jsou schvalovací pravidla, hooky jsou audit a subagenti jsou specialisté na dílčí úkoly.

Přesně tuhle vrstvu stavím klientům na míru – napojuju agenta na firemní data a nástroje a nastavuju, co smí udělat sám a co jde napřed člověku ke schválení. Víc o tvorbě AI agentů na míru →

Jak vypadá hotový harness?

Nejznámější příklady dnes najdete mezi nástroji pro programování. Claude Code a Codex jsou hotové harnessy: smyčku, nástroje, práci s kontextem i schvalování mají už vestavěné, takže se nemusí programovat od nuly. Proti nim stojí vývojářské frameworky, kde si obal obvykle skládáte sami a získáváte nad ním větší kontrolu – za cenu vlastního vývoje a údržby.

Jaké má harness limity?

První limit je cena. Agent pošle modelu tentýž kontext znovu a znovu, takže podle dostupných analýz provozu spotřebuje pětkrát až třicetkrát víc tokenů než běžný chatbot a velká část účtu padne právě na opakovaně posílaný kontext. Gartner k tomu předpovídá, že do konce roku 2027 bude zrušeno přes 40 % projektů s AI agenty, a to nejen kvůli nákladům. Strop na útratu a na počet kroků proto nemá být doporučení v zadání, ale pravidlo vynucené v kódu.

Druhý limit je bezpečnost. Útočník může skrýt instrukce do dokumentu, e-mailu nebo popisu nástroje a zranitelný agent je zamění za zadání a provede, zatímco člověk si jich při běžné kontrole nevšimne. Nástroje a doplňky od cizích dodavatelů navíc dosáhnou na všechno, co jim hostitelské prostředí dovolí, tedy případně i na soubory, přihlašovací údaje a odchozí kanály. Proto se vyplatí držet oprávnění co nejužší a nasazovat postupně, od schvalování jednotlivých kroků k větší samostatnosti.

Můj pohled

Přijde mi to nevídané a jsem přesvědčený, že to změní svět. Hlavně jsem zvědavý, kam se to posune dál. Sám už teď provozuju přes šedesát agentů. Někteří jsou čistě determinističtí, jiní stojí na Claude Code a často v nich mám smyčky, ve kterých funguju jako schvalovatel.

Pavel Szabo

Programátor webů, eshopů a informačních systémů s více než 23 lety praxe. Pomáhám firmám i jednotlivcům s online podnikáním, automatizacemi a využitím AI v praxi.

Znáte někoho komu by článek mohl pomoct? Budu rád za sdílení!

Nabídka služeb

Vyberte si z nabídky níže, co zrovna potřebujete nebo mi rovnou zavolejte a probereme Vaše potřeby.

Weby a portály

Kódování a programování

Marketing a obsah

AI školení a konzultace

Praha, Brno, Ostrava či zahraničí? Na tom nezáleží

Osobní schůzky jsou možné, ale většinu záležitostí — od tvorby webů po AI automatizace — lze vyřešit pohodlně přes videohovor. Působím po celé ČR, s klienty z mnoha měst: Praha, Brno, Ostrava, Jičín, Liberec, Olomouc, Hradec Králové, České Budějovice, Karviná, Frýdek-Místek, Opava, Třinec, Orlová, Český Těšín, Nový Jičín, Krnov, Bohumín, Kopřivnice, Bruntál...
Pro lepší porozumění vašim potřebám je ideální online hovor. Rezervujte si schůzku přes můj formulář nebo mě kontaktujte telefonicky. Můžeme se taky domluvit na výjezdu a osobní schůzce.
Praha, Brno, Ostrava či zahraničí? Na tom nezáleží