Spočítejte si agenta, než ho postavíte

Ve zkratce: Nástroj, který nacení jeden reprezentativní běh agenta a rozpočítá ho na šest položek z předchozího článku. Ukazuje dvě věci, které tabulka ukázat neumí: jak malý díl faktury bývají tokeny a která ze dvou pák — levnější model, nebo jednodušší architektura — u vašich vlastních čísel ušetří víc. Sazby jsou ceníkové, počítá se v prohlížeči a nic se nikam neposílá.

Předchozí článek o tom, co doopravdy stojí AI agent, končí radou, která se špatně následuje: nacení jednu reprezentativní úlohu od začátku do konce a teprve tu vynásob objemem. Rada je správná a nikdo ji neudělá, protože to znamená držet v hlavě šest položek naráz a jednu z nich násobit druhou.

Tak je tady jako nástroj.

Počítá se ve vašem prohlížeči a nikam se nic neposílá.

1 · Jeden reprezentativní běh

2 · Architektura a objem

3 · Co se vrátí

4 · Lidé, kteří výstup zpracují

5 · Aparát nad výstupem

Tokeny
Lidé
Aparát
Celkem za měsíc

Podíl tokenů na celku

Kde ušetříte víc

O třídu levnější model
O stupeň jednodušší architektura

Sazby jsou ceníkové ke dni, kdy tohle čtete; kalkulačka je nedotahuje ze sítě, takže než je někam odcitujete, ověřte si je.

Odkud ta čísla vzít

Kalkulačka je přesná přesně tak jako to nejhorší číslo, které do ní vložíte. Tři z nich se dají změřit, zbytek se dá jen poctivě odhadnout — a je rozdíl vědět který je který.

Vstupní a výstupní tokeny za jeden běh se měří, ne odhadují. Pusťte jednu skutečnou úlohu, ne zkrácenou ukázku, a přečtěte skutečnou spotřebu z odpovědi API. Odhad „to bude tak dvacet tisíc tokenů“ se u agenta míjí zpravidla o řád, protože každý krok s sebou nese celý nashromážděný kontext.

Násobič architektury je návrhové rozhodnutí, ne měření. Proto je v kalkulačce zvlášť: tokeny za běh se mění, když se změní úloha, násobič se mění, když se změní návrh. Čísla v nabídce jsou publikovaná měření Anthropicu — zhruba čtyřnásobek chatu u jednoho agenta, zhruba patnáctinásobek u systému s více agenty.

Podíl vstupu, který se dá cachovat, je ta stabilní část promptu: systémový prompt, referenční dokument, seznam nástrojů. Pozor na past — cachování je shoda předpony, takže jediné časové razítko v systémovém promptu shodí celou slevu a nic vás nevaruje. Než sem napíšete 80 %, ověřte si na skutečném běhu, že se cache doopravdy trefuje.

Minuty revize jsou to číslo, které lidé nadhodnocují směrem dolů. Neptejte se, jak dlouho trvá výstup přečíst. Ptejte se, jak dlouho trvá podle něj jednat — včetně případů, kdy je špatně a přijde se na to až po dvaceti minutách.

Cena aparátu je stavba toho, co výstup kontroluje: rozhodčí, testy, sada evaluací, párování proti známé pravdě. Rozpouští se přes tolik měsíců, kolik čekáte, že systém vydrží beze změny. Kdo tam napíše šedesát, počítá s tím, že se za pět let nezmění ani model, ani proces, ani ceník. Nezmění se ani jedno z toho.

Co v ní schválně není

Přepočet na koruny. Sazby modelů se účtují v dolarech a faktura přijde v dolarech. Kurz je číslo, které se hýbe každý den, a zadrátovat ho do stránky znamená mít tam za měsíc nepravdu.

Rozdíl ve schopnostech modelů. Kalkulačka umí porovnat, co stojí Haiku proti Opusu. Neumí říct, jestli Haiku tu práci zvládne. To je otázka pro evaluaci, ne pro tabulku, a levnější model, který úlohu nedodělá, je nekonečně drahý.

Aktuální sazby ze sítě. Kalkulačka je nikam nechodí načítat — počítá s ceníkovými cenami ke dni, kdy tohle čtete, a umí jedinou výjimku: zaváděcí cenu Sonnetu 5, která platí do 31. srpna 2026. Po tom dni se sama přepne na ceníkovou sazbu, protože prohlížeč zná datum. U všeho ostatního platí: než sazbu někam odcitujete, ověřte si ji.

Co uvidíte, když ji vyplníte poctivě

Dvě věci, a obě jsou důvod, proč tenhle nástroj existuje.

Tokeny bývají menšina faktury. U výchozího zadání — dva tisíce běhů měsíčně, šest minut revize na výstup — vyjdou tokeny zhruba na desetinu celku. Zbytek jsou lidé a aparát. Kdo optimalizuje jen tu desetinu, mění nejmenší číslo na obrazovce a nechává těch devadesát procent být.

Architektura hýbe fakturou víc než model. Kalkulačka počítá obě páky vedle sebe z týchž vstupů: o třídu levnější model proti o stupeň jednodušší architektuře. U většiny zadání vyhraje architektura, a není to náhoda — rozpětí mezi třídami modelů je násobek několika jednotek, rozpětí mezi chatovým voláním a systémem s více agenty je patnáct.

Zkuste si ale dosadit vlastní čísla i proti tomu. Existují zadání, kde vyhraje model: krátké běhy, velký objem, žádná revize. Kalkulačka to pozná a napíše to — nemá zabudovaný závěr, má zabudovaný výpočet.

Poslední poznámka

Kalkulačka počítá v prohlížeči a nic neodesílá. Objemy, mzdové sazby ani odhady nákladů stránku neopustí — nejen proto, že by to bylo nezdvořilé, ale protože bezpečnostní politika tohohle webu externí skripty vůbec nedovoluje. Pokud vám vyjde číslo, které se nechcete nikomu ukázat, nemusíte: nikdo jiný ho nevidí.

A jestli vám vyjde číslo, které dává smysl jen v nejlevnější třídě modelu a s nejtěsnějším nastavením, dostali jste odpověď, kvůli které se to počítá.

Často kladené dotazy

Jak si mám spočítat, kolik bude stát AI agent?

Nacenit jeden reprezentativní běh od začátku do konce a teprve ten vynásobit objemem. Kalkulačka na téhle stránce k tomu přidá čtyři věci, které se v odhadech ztrácejí: násobič architektury, návratnost cachování a dávek, hodiny lidí, kteří výstup zpracují, a rozpuštěnou cenu aparátu, který výstup kontroluje. Odhad na token bez těch čtyř položek bývá menší než polovina skutečné faktury.

Kolik tokenů má jeden běh agenta?

To se nedá odhadnout, dá se to jen změřit — pusťte jednu skutečnou úlohu a přečtěte skutečnou spotřebu. Kalkulačka proto chce tokeny za jeden běh a násobič architektury zvlášť: první číslo je měření, druhé je návrhové rozhodnutí a každé se mění z jiného důvodu.

Vyplatí se přejít na levnější model?

Skoro vždycky míň, než se čeká. Rozpětí mezi třídami modelů je násobek několika jednotek, rozpětí mezi chatovým voláním a systémem s více agenty je patnáct. Kalkulačka počítá obě páky vedle sebe z týchž vstupů, takže je vidět, která je u vašeho zadání větší — a u většiny zadání to není ta s modelem.

Posílá kalkulačka moje čísla někam?

Ne. Počítá se celá v prohlížeči, na stránce není žádný externí skript a objemy ani mzdové sazby stránku neopustí. Bezpečnostní politika webu externí skripty ani nedovoluje.

O autorovi

Filip Salamon

Filip Salamon

CEO / CTO, Salamon Capital

Filip has spent his career between media and technology — filming for ŠKODA, Pilsner Urquell and Range Rover, then co-founding a startup in San Francisco, working with a YC-backed company and serving as CIO at Renato. He built ZEUS Legal AI and now runs the systems Salamon Capital operates on.

ZÁZEMÍ

  • Founder, ZEUS Legal AI
  • Former CIO, Renato
  • 15+ years across media and technology

Nová analýza, když nějaká je

Jedna zpráva, když vyjde nová analýza nebo článek. Nic dalšího — žádná série, žádný souhrn, nikdo třetí. Adresa se ukládá, protože jinak není kam poslat, a jedno kliknutí ji smaže nadobro.

Nejdřív potvrzení. Bez něj se neodešle nic.

V PRAXI

Tenhle postup jsme použili na vlastní firmu dřív než na cizí.

PODÍVEJTE SE NA NAŠI PRÁCI →

DALŠÍ ČTENÍ

Analýzy k měření, automatizaci a k tomu, co data reálně ukazují.

VŠECHNY ČLÁNKY →

SLUŽBY

Růst a akvizice, AI a automatizace na míru, a právo přes vlastní advokátní kancelář.

CO DĚLÁME →

REFERENCE

Co jsme postavili klientům i sobě a co se měřitelně změnilo.

PŘÍPADOVÉ STUDIE →