Fable, Opus, Sonnet, Haiku: který AI model kdy použít
Otevřeš výběr modelu a koukáš na čtyři poetická jména bez návodu. Lidi v tom plavou — a pak platí desetinásobek za úlohy, které zvládne nejlevnější model, nebo se zlobí na „hloupou AI“, protože na těžkou úlohu nasadili sprintera. Tady je celý systém vysvětlený jednou provždy.
Co je vlastně „model“?#
Model je ta samotná neuronová síť — miliardy naučených parametrů, které vznikly tréninkem na obrovském množství textu. Není to aplikace ani chatbot: Claude, ChatGPT nebo Gemini jsou produkty, a uvnitř každého z nich běží některý z modelů. Stejný model může pohánět chat na webu, mobilní aplikaci i systém postavený na míru přes API.
Proč jich každá firma nabízí několik? Protože inteligence není zadarmo. Větší a důkladněji přemýšlející model dává lepší výsledky, ale je pomalejší a dražší na provoz. Nikdo nechce platit chirurga za přelepení náplasti — proto existují výkonnostní třídy. U Anthropicu se jmenují podle literárních útvarů: Haiku, Sonnet, Opus a nově Fable.
Minutka o tokenech — protože v nich se platí#
AI modely se účtují za tokeny — kousky textu zhruba o délce slabiky až krátkého slova. Orientačně: 1 000 tokenů je asi 700 slov anglického textu, čeština je na tokeny o něco „dražší“. Platí se zvlášť vstup (co modelu pošleš) a zvlášť výstup (co model napíše). Výstup je vždycky několikanásobně dražší, protože ho model musí vymyslet.
A ještě jeden pojem: kontextové okno — kolik toho model pojme najednou. Dnešní Claude modely mají okno 1 milion tokenů (Haiku 200 tisíc), což je celá knihovna dokumentů v jedné konverzaci. Aktuální ceny najdeš v oficiálním přehledu modelů.
Čtyři třídy a k čemu se hodí#
Nejmenší a nejrychlejší (Haiku 4.5, cca 1 $ / 5 $ za milion tokenů). Není hloupý, je úsporný. Na co: třídění poptávek a e-mailů, tagování produktů, extrakce údajů z faktur, rychlé FAQ odpovědi, moderace obsahu. Klasifikace jedné poptávky vyjde na zlomek haléře — deset tisíc denně stojí pár dolarů měsíčně.
Prostřední třída (Sonnet 5, cca 3 $ / 15 $) a podle nás nejlepší poměr cena/výkon na trhu; v kódování a agentních úlohách se blíží Opusu za zlomek ceny. Na co: chatbot nad vlastním katalogem, produktové popisky, sumarizace smluv, překlady s kontextem, běžná asistence při programování. Náš concierge vpravo dole běží přesně v téhle třídě.
Vlajková loď pro náročnou práci (Opus 4.8, cca 5 $ / 25 $). Vyniká u úloh s mnoha kroky, kde je potřeba udržet souvislosti a rozhodovat se samostatně. Na co: vývoj a refaktoring softwaru, hloubková analýza dat, právní a finanční rozbory, „projdi 200 smluv, najdi rizikové klauzule a připrav souhrn“.
Novinka z rodiny Claude 5 a nejchytřejší veřejně dostupný model Anthropicu (cca 10 $ / 50 $). Má vždy zapnuté hloubkové přemýšlení a je stavěný na dlouhé samostatné běhy. Na co: rozsáhlé migrace „přes noc“, výzkumné rešerše s ověřováním zdrojů, návrh architektury — úlohy, kde jedna chyba stojí víc než celý účet za AI.
Nejčastější chyba: jeden model na všechno#
Firmy typicky udělají jednu ze dvou chyb. Buď nasadí všude nejchytřejší model „aby byl klid“ — a platí desetinásobky za úlohy, které nerozeznají Haiku od Fable. Nebo všude nasadí nejlevnější „aby to nestálo majlant“ — a pak se diví, že AI nezvládá složitější požadavky, a odepíšou celou technologii.
- „Kdy máte otevřeno?“ řeší nejdražší mozek
- Nebo naopak: složitý rozbor řeší sprinter
- Faktura roste s objemem, ne s hodnotou
- Když to nefunguje, odepíše se celá technologie
- Levný model třídí, směruje a odbavuje objem
- Chytrý nastupuje na to, co levný nezvládne
- Každá úloha dostane nejmenší model, který ji utáhne
- Model se dá vyměnit konfigurací, ne přepsáním
Jak to děláme my#
V našich systémech nemá model nikdo „navždy“ — každá úloha dostane nejmenší model, který ji zvládne spolehlivě, a nejtěžší práci děláme s nejsilnějšími. Ceny a schopnosti se navíc mění každých pár měsíců (nová generace bývá chytřejší a levnější zároveň), takže systém stavíme tak, aby se model dal vyměnit konfigurací, ne přepsáním.
Ty řešíš, co má systém umět — kterou třídu mozku na to zapojit, je naše práce. Jak hlídáme, aby si při tom AI nevymýšlela, je v Jak stavíme AI, která si nevymýšlí.
Jak vybrat model pro svoji úlohu#
Tři kroky, které fungují bez ohledu na to, čí modely používáš.
Prostřední třída je výchozí bod, ne kompromis. Když úlohu zvládne, hotovo — a ušetřil jsi bez ztráty kvality. Teprve když opakovaně selže na téže věci, má smysl jít nahoru.
U úloh, které se opakují tisíckrát denně, se to vyplatí ověřit vždycky. Klasifikace, tagování, extrakce údajů — tam bývá rozdíl v kvalitě nulový a rozdíl v ceně pětinásobný.
Nejsilnější třída dává smysl u dlouhých samostatných běhů a úloh, kde jedna chyba stojí víc než celý měsíční účet za AI. Pro běžný provoz je to kanón na vrabce.
Časté otázky#
Kolik reálně stojí odpověď chatbota?
Počítej se mnou: dotaz zákazníka plus kontext z tvých dat je řekněme 2 000 tokenů na vstupu, odpověď 300 tokenů na výstupu. Na Haiku to vyjde zhruba na 0,35 centu — tedy pár haléřů. Na Sonnetu asi trojnásobek. I chatbot s tisíci konverzací měsíčně stojí na provozu méně než jeden oběd.
Proč prostě nepoužít vždycky ten nejchytřejší model?
Ze stejného důvodu, proč neposíláš ředitele vyřizovat podatelnu: cena a rychlost. Mezi Haiku a Fable je desetinásobný rozdíl v ceně a znatelný rozdíl v odezvě. U jednoduchých úloh chytřejší model nedává lepší výsledky — jen dražší.
Umí všechny modely česky?
Ano, všechny třídy jsou vícejazyčné a čeština jim nedělá problém — i Haiku. Rozdíl mezi modely je v hloubce uvažování, ne v jazykové výbavě. Jen počítej s tím, že český text spotřebuje o něco víc tokenů než anglický.
Platí tohle dělení i pro ChatGPT nebo Gemini?
Princip ano — OpenAI i Google nabízejí stejné spektrum od malých rychlých modelů po velké přemýšlivé (např. řady GPT a Gemini Flash/Pro). Jména se liší, logika výběru je stejná: objem a rychlost dole, hloubka a samostatnost nahoře.
Musím to jako zákazník vůbec řešit?
V aplikaci Claude stačí vědět, že výchozí volba je pro běžnou práci správně a nejsilnější model si zapínáš na těžké úlohy. U systému na míru to za tebe má vyřešit dodavatel — a stojí za to se ho zeptat, jak volí modely a co to dělá s cenou provozu. Je to jedna z otázek, která odliší návrh od nahodilosti.