Postav si systém
← Zpět na signál
// signál · průvodce

Fable, Opus, Sonnet, Haiku: který AI model kdy použít

Otevřeš výběr modelu a koukáš na čtyři poetická jména bez návodu. Lidi v tom plavou — a pak platí desetinásobek za úlohy, které zvládne nejlevnější model, nebo se zlobí na „hloupou AI“, protože na těžkou úlohu nasadili sprintera. Tady je celý systém vysvětlený jednou provždy.

Co je vlastně „model“?#

Model je ta samotná neuronová síť — miliardy naučených parametrů, které vznikly tréninkem na obrovském množství textu. Není to aplikace ani chatbot: Claude, ChatGPT nebo Gemini jsou produkty, a uvnitř každého z nich běží některý z modelů. Stejný model může pohánět chat na webu, mobilní aplikaci i systém postavený na míru přes API.

Proč jich každá firma nabízí několik? Protože inteligence není zadarmo. Větší a důkladněji přemýšlející model dává lepší výsledky, ale je pomalejší a dražší na provoz. Nikdo nechce platit chirurga za přelepení náplasti — proto existují výkonnostní třídy. U Anthropicu se jmenují podle literárních útvarů: Haiku, Sonnet, Opus a nově Fable.

Minutka o tokenech — protože v nich se platí#

AI modely se účtují za tokeny — kousky textu zhruba o délce slabiky až krátkého slova. Orientačně: 1 000 tokenů je asi 700 slov anglického textu, čeština je na tokeny o něco „dražší“. Platí se zvlášť vstup (co modelu pošleš) a zvlášť výstup (co model napíše). Výstup je vždycky několikanásobně dražší, protože ho model musí vymyslet.

A ještě jeden pojem: kontextové okno — kolik toho model pojme najednou. Dnešní Claude modely mají okno 1 milion tokenů (Haiku 200 tisíc), což je celá knihovna dokumentů v jedné konverzaci. Aktuální ceny najdeš v oficiálním přehledu modelů.

Čtyři třídy a k čemu se hodí#

01Haiku — sprinter na velké objemy

Nejmenší a nejrychlejší (Haiku 4.5, cca 1 $ / 5 $ za milion tokenů). Není hloupý, je úsporný. Na co: třídění poptávek a e-mailů, tagování produktů, extrakce údajů z faktur, rychlé FAQ odpovědi, moderace obsahu. Klasifikace jedné poptávky vyjde na zlomek haléře — deset tisíc denně stojí pár dolarů měsíčně.

02Sonnet — tahoun na 80 % práce

Prostřední třída (Sonnet 5, cca 3 $ / 15 $) a podle nás nejlepší poměr cena/výkon na trhu; v kódování a agentních úlohách se blíží Opusu za zlomek ceny. Na co: chatbot nad vlastním katalogem, produktové popisky, sumarizace smluv, překlady s kontextem, běžná asistence při programování. Náš concierge vpravo dole běží přesně v téhle třídě.

03Opus — senior, kterému svěříš projekt

Vlajková loď pro náročnou práci (Opus 4.8, cca 5 $ / 25 $). Vyniká u úloh s mnoha kroky, kde je potřeba udržet souvislosti a rozhodovat se samostatně. Na co: vývoj a refaktoring softwaru, hloubková analýza dat, právní a finanční rozbory, „projdi 200 smluv, najdi rizikové klauzule a připrav souhrn“.

04Fable — specialista na nejtěžší problémy

Novinka z rodiny Claude 5 a nejchytřejší veřejně dostupný model Anthropicu (cca 10 $ / 50 $). Má vždy zapnuté hloubkové přemýšlení a je stavěný na dlouhé samostatné běhy. Na co: rozsáhlé migrace „přes noc“, výzkumné rešerše s ověřováním zdrojů, návrh architektury — úlohy, kde jedna chyba stojí víc než celý účet za AI.

Haiku 4.55 $
Sonnet 515 $
Opus 4.825 $
Fable 550 $
Cena výstupu za milion tokenů, orientačně. Mezi krajními třídami je desetinásobek — a u jednoduchých úloh za něj nekoupíš lepší výsledek, jen dražší.

Nejčastější chyba: jeden model na všechno#

Firmy typicky udělají jednu ze dvou chyb. Buď nasadí všude nejchytřejší model „aby byl klid“ — a platí desetinásobky za úlohy, které nerozeznají Haiku od Fable. Nebo všude nasadí nejlevnější „aby to nestálo majlant“ — a pak se diví, že AI nezvládá složitější požadavky, a odepíšou celou technologii.

Jeden model na všechno
  • „Kdy máte otevřeno?“ řeší nejdražší mozek
  • Nebo naopak: složitý rozbor řeší sprinter
  • Faktura roste s objemem, ne s hodnotou
  • Když to nefunguje, odepíše se celá technologie
Modely kombinované
  • Levný model třídí, směruje a odbavuje objem
  • Chytrý nastupuje na to, co levný nezvládne
  • Každá úloha dostane nejmenší model, který ji utáhne
  • Model se dá vyměnit konfigurací, ne přepsáním
Zákazníkova otázka „kdy máte otevřeno“ nepotřebuje stejný mozek jako „porovnejte mi tyhle tři nabídky“. Rozdíl na faktuře bývá řádový — klidně 80 % nákladů dolů při stejné kvalitě tam, kde na ní záleží.

Jak to děláme my#

V našich systémech nemá model nikdo „navždy“ — každá úloha dostane nejmenší model, který ji zvládne spolehlivě, a nejtěžší práci děláme s nejsilnějšími. Ceny a schopnosti se navíc mění každých pár měsíců (nová generace bývá chytřejší a levnější zároveň), takže systém stavíme tak, aby se model dal vyměnit konfigurací, ne přepsáním.

Ty řešíš, co má systém umět — kterou třídu mozku na to zapojit, je naše práce. Jak hlídáme, aby si při tom AI nevymýšlela, je v Jak stavíme AI, která si nevymýšlí.

Jak vybrat model pro svoji úlohu#

Tři kroky, které fungují bez ohledu na to, čí modely používáš.

Krok 1Začni Sonnetem, ne nejchytřejším modelem

Prostřední třída je výchozí bod, ne kompromis. Když úlohu zvládne, hotovo — a ušetřil jsi bez ztráty kvality. Teprve když opakovaně selže na téže věci, má smysl jít nahoru.

Krok 2Zkus, jestli to neutáhne nejmenší model

U úloh, které se opakují tisíckrát denně, se to vyplatí ověřit vždycky. Klasifikace, tagování, extrakce údajů — tam bývá rozdíl v kvalitě nulový a rozdíl v ceně pětinásobný.

Krok 3Nahoru jdi jen tam, kde chyba stojí víc než provoz

Nejsilnější třída dává smysl u dlouhých samostatných běhů a úloh, kde jedna chyba stojí víc než celý měsíční účet za AI. Pro běžný provoz je to kanón na vrabce.

Časté otázky#

Kolik reálně stojí odpověď chatbota?

Počítej se mnou: dotaz zákazníka plus kontext z tvých dat je řekněme 2 000 tokenů na vstupu, odpověď 300 tokenů na výstupu. Na Haiku to vyjde zhruba na 0,35 centu — tedy pár haléřů. Na Sonnetu asi trojnásobek. I chatbot s tisíci konverzací měsíčně stojí na provozu méně než jeden oběd.

Proč prostě nepoužít vždycky ten nejchytřejší model?

Ze stejného důvodu, proč neposíláš ředitele vyřizovat podatelnu: cena a rychlost. Mezi Haiku a Fable je desetinásobný rozdíl v ceně a znatelný rozdíl v odezvě. U jednoduchých úloh chytřejší model nedává lepší výsledky — jen dražší.

Umí všechny modely česky?

Ano, všechny třídy jsou vícejazyčné a čeština jim nedělá problém — i Haiku. Rozdíl mezi modely je v hloubce uvažování, ne v jazykové výbavě. Jen počítej s tím, že český text spotřebuje o něco víc tokenů než anglický.

Platí tohle dělení i pro ChatGPT nebo Gemini?

Princip ano — OpenAI i Google nabízejí stejné spektrum od malých rychlých modelů po velké přemýšlivé (např. řady GPT a Gemini Flash/Pro). Jména se liší, logika výběru je stejná: objem a rychlost dole, hloubka a samostatnost nahoře.

Musím to jako zákazník vůbec řešit?

V aplikaci Claude stačí vědět, že výchozí volba je pro běžnou práci správně a nejsilnější model si zapínáš na těžké úlohy. U systému na míru to za tebe má vyřešit dodavatel — a stojí za to se ho zeptat, jak volí modely a co to dělá s cenou provozu. Je to jedna z otázek, která odliší návrh od nahodilosti.

Krok 1 / 4 · Vyber svůj svět
V jakém světě se pohybuješ?
Matrix se naladí na to, co je ve tvém oboru důležité.
Sport a kluby
Členové, tréninky, výsledky
Reality
Nabídky, oceňování, obchody
Finance a pojištění
Compliance, kalkulačky
E-commerce a brand
Katalog, SEO, obsah
Vzdělávání
Učení, gamifikace
SaaS / jiné
Něco nového
Skenuj svůj web