Fable, Opus, Sonnet, Haiku: který AI model kdy použít
Otevřeš výběr modelu a koukáš na čtyři poetická jména bez návodu. Lidi v tom plavou — a pak platí desetinásobek za úlohy, které zvládne nejlevnější model, nebo se zlobí na „hloupou AI", protože na těžkou úlohu nasadili sprintera. Tady je celý systém vysvětlený jednou provždy: co je vlastně model, čím se liší, kolik stojí a který kdy dává smysl. S konkrétními příklady.
Co je vlastně „model"?
Model je ta samotná neuronová síť — miliardy naučených parametrů, které vznikly tréninkem na obrovském množství textu. Není to aplikace ani chatbot: Claude, ChatGPT nebo Gemini jsou produkty, a uvnitř každého z nich běží některý z modelů. Stejný model může pohánět chat na webu, mobilní aplikaci i systém, který ti postavíme na míru přes API.
Proč jich každá firma nabízí několik? Protože inteligence není zadarmo. Větší a důkladněji přemýšlející model dává lepší výsledky, ale je pomalejší a dražší na provoz. Menší model je bleskový a levný, ale na složité úlohy nestačí. Nikdo nechce platit chirurga za přelepení náplasti — proto existují výkonnostní třídy. U Anthropicu se jmenují podle literárních útvarů: Haiku (nejmenší), Sonnet, Opus a nově Fable.
Nejdřív minutka o tokenech — protože v nich se platí
AI modely se účtují za tokeny — kousky textu zhruba o délce slabiky až krátkého slova. Orientačně: 1 000 tokenů je asi 700 slov anglického textu, čeština je na tokeny o něco „dražší". Platí se zvlášť vstup (co modelu pošleš — dotaz, dokumenty, historii konverzace) a zvlášť výstup (co model napíše). Výstup je vždycky několikanásobně dražší, protože ho model musí „vymyslet".
A ještě jeden pojem: kontextové okno — kolik toho model pojme najednou. Dnešní Claude modely mají okno 1 milion tokenů (Haiku 200 tisíc), což je celá knihovna dokumentů v jedné konverzaci. Aktuální ceny všech modelů najdeš v oficiálním přehledu modelů.
Haiku — sprinter na velké objemy
Nejmenší a nejrychlejší model (aktuálně Haiku 4.5, cca 1 $ / 5 $ za milion tokenů vstup/výstup). Není hloupý — je úsporný. Skvělý všude, kde potřebuješ tisíce malých rozhodnutí denně a záleží na rychlosti a ceně, ne na hloubce úvahy.
Příklady: třídění příchozích e-mailů a poptávek podle typu, tagování produktů v katalogu, extrakce údajů z faktur (IČO, částka, datum), rychlé FAQ odpovědi z vlastních dat, moderace obsahu. Konkrétně: klasifikace jedné poptávky vyjde na zlomek haléře — deset tisíc denně tě stojí pár dolarů měsíčně. Na Opusu by stejná věc stála pětinásobek a trvala déle.
Sonnet — tahoun na 80 % práce
Prostřední třída (aktuálně Sonnet 5, cca 3 $ / 15 $ za milion tokenů) a podle nás nejlepší poměr cena/výkon na trhu. Nová generace Sonnetu se v kódování a agentních úlohách blíží Opusu — za pětinu až polovinu ceny. Když nevíš, kterým modelem začít, začni Sonnetem.
Příklady: zákaznický chatbot nad vlastním katalogem nebo dokumentací, generování produktových popisků a marketingových textů, sumarizace smluv a reportů, překlady s kontextem, běžná asistence při programování, analýza zpětné vazby od zákazníků. Náš concierge na tomto webu — AI, se kterou si můžeš psát vpravo dole — běží přesně v této třídě: dost chytrá na skutečný rozhovor, dost levná na to, aby byla zapnutá pořád.
Opus — senior, kterému svěříš celý projekt
Vlajková loď pro náročnou práci (aktuálně Opus 4.8, cca 5 $ / 25 $ za milion tokenů). Vyniká tam, kde úloha má mnoho kroků, vyžaduje udržet souvislosti a rozhodovat se samostatně — takzvané agentní úlohy, kdy model nejen odpovídá, ale pracuje: čte soubory, spouští nástroje, ověřuje si výsledky.
Příklady: vývoj a refaktoring softwaru (Opus je motor nástrojů jako Claude Code), hloubková analýza dat s vizualizacemi, právní a finanční rozbory, autonomní zpracování složitého workflow — třeba „projdi 200 smluv, najdi rizikové klauzule a připrav souhrn pro právníka". Tam, kde by Sonnet potřeboval vodit za ruku, Opus dojde do cíle sám.
Fable — specialista na nejtěžší problémy
Novinka z rodiny Claude 5 a aktuálně nejchytřejší veřejně dostupný model od Anthropicu (cca 10 $ / 50 $ za milion tokenů). Fable patří do nové třídy nad Opusem: má vždy zapnuté hloubkové přemýšlení a je stavěný na dlouhé samostatné běhy — úlohy, na kterých pracuje desítky minut i hodiny bez zásahu člověka. Detaily v oznámení Anthropicu.
Příklady: rozsáhlé migrace a přestavby systémů „přes noc", výzkumné rešerše s ověřováním zdrojů, návrh architektury složitého systému, úlohy, kde jedna chyba stojí víc než celý účet za AI. Pro běžný provoz je to kanón na vrabce — ale když ostatní modely narazí na strop, Fable je důvod, proč ten strop existoval.
Nejčastější chyba: jeden model na všechno
Firmy typicky udělají jednu ze dvou chyb. Buď nasadí všude nejchytřejší model „aby byl klid" — a platí desetinásobky za úlohy, které nerozeznají Haiku od Fable. Nebo všude nasadí nejlevnější „aby to nestálo majlant" — a pak se diví, že AI nezvládá složitější požadavky, a odepíšou celou technologii.
Dobře postavený systém modely kombinuje: levný model třídí, směruje a odbavuje objem, chytrý model nastupuje na to, co levný nezvládne. Zákazníkova otázka „kdy máte otevřeno" nepotřebuje stejný mozek jako „porovnejte mi tyhle tři nabídky a doporučte postup". Rozdíl na faktuře bývá řádový — klidně 80 % nákladů dolů při stejné kvalitě tam, kde na ní záleží.
Jak to děláme my
V našich systémech nemá model nikdo „navždy" — každá úloha dostane nejmenší model, který ji zvládne spolehlivě, a nejtěžší práci děláme s nejsilnějšími modely. Ceny a schopnosti se navíc mění každých pár měsíců (nová generace bývá chytřejší a levnější zároveň), takže systém stavíme tak, aby se model dal vyměnit konfigurací, ne přepsáním. Ty řešíš, co má systém umět — kterou třídu mozku na to zapojit, je naše práce.
Časté otázky
Kolik reálně stojí odpověď chatbota?
Počítej se mnou: dotaz zákazníka plus kontext z tvých dat je řekněme 2 000 tokenů na vstupu, odpověď 300 tokenů na výstupu. Na Haiku to vyjde zhruba na 0,35 centu — tedy pár haléřů. Na Sonnetu asi trojnásobek. I chatbot s tisíci konverzací měsíčně stojí na provozu méně než jeden oběd.
Proč prostě nepoužít vždycky ten nejchytřejší model?
Ze stejného důvodu, proč neposíláš ředitele vyřizovat podatelnu: cena a rychlost. Mezi Haiku a Fable je desetinásobný rozdíl v ceně a znatelný rozdíl v odezvě. U jednoduchých úloh chytřejší model nedává lepší výsledky — jen dražší.
Umí všechny modely česky?
Ano, všechny třídy jsou vícejazyčné a čeština jim nedělá problém — i Haiku. Rozdíl mezi modely je v hloubce uvažování, ne v jazykové výbavě. Jen počítej s tím, že český text spotřebuje o něco víc tokenů než anglický.
Platí tohle dělení i pro ChatGPT nebo Gemini?
Princip ano — OpenAI i Google nabízejí stejné spektrum od malých rychlých modelů po velké přemýšlivé (např. řady GPT a Gemini Flash/Pro). Jména se liší, logika výběru je stejná: objem a rychlost dole, hloubka a samostatnost nahoře.
Musím to jako zákazník vůbec řešit?
V aplikaci Claude stačí vědět, že výchozí volba je pro běžnou práci správně a nejsilnější model si zapínáš na těžké úlohy. U systému na míru to za tebe má vyřešit dodavatel — a stojí za to se ho zeptat, jak volí modely a co to dělá s cenou provozu. Je to jedna z otázek, která odliší návrh od nahodilosti.