AI zlevňuje. Anthropic srazil cenu malého modelu o 90 procent
Anthropic vydal Haiku 5.5, nejlevnější a nejrychlejší malý model, jaký kdy měl. Cena za běžné dotazy klesla o devadesát procent a model výrazně pokročil v ovládání počítače. Zároveň Claude vstoupil do Google dokumentů.

AI zlevňuje. Anthropic srazil cenu malého modelu o 90 procent
Sedmého října představila společnost Anthropic nový model Claude Haiku 5.5. Podle svého vyjádření jde o její nejlevnější, nejrychlejší a nejschopnější malý model, jaký kdy vydala. Zpráva by možná zapadla mezi desítkami podobných oznámení, kdyby v ní nebyly dvě věci, které stojí za pozornost. Cena za běžné používání klesla o devadesát procent a model se výrazně zlepšil v tom, jak ovládá počítač. O pár dní dřív navíc Claude vstoupil do Google dokumentů.
Malý model, velká sleva
Modely se dnes dělí podle velikosti. Velké modely umí víc, ale jsou dražší a pomalejší. Malé modely jsou levné a rychlé, hodí se na opakující se úlohy: shrnutí textu, třídění dotazů nebo odpovídání v zákaznické podpoře. Právě na takové úlohy míří Haiku 5.5.
Nejzajímavější je cena. Za dotazy do sta tisíc tokenů, což je jednotka, kterou se měří délka textu, zaplatí vývojář deset centů za milion vstupních tokenů a padesát centů za milion výstupních. Starší Haiku 4.5 přitom stál dolar za milion vstupních a pět dolarů za milion výstupních tokenů. U běžných dotazů tedy cena spadla o devadesát procent, u delších o polovinu. Anthropic uvádí, že v průměru je nový model o zhruba pětasedmdesát procent levnější na provoz než jeho předchůdce.
K tomu firma zlevnila i čtení takzvané cache u většího modelu Sonnet 5.5 na polovinu a přidala měsíční kredit na API pro předplatitele plánů Max a Team.
Co model umí lépe
Levnost by sama o sobě nestačila, kdyby model nic neuměl. Podle testů Anthropicu se Haiku 5.5 posunul hlavně tam, kde jde o skutečnou práci na počítači. V testu OSWorld 2.1, který měří, jak dobře agent zvládne delší úlohy na počítači, skóroval 72,4 procenta. Předchozí Haiku 4.5 měl 15,7 procenta a konkurenční GPT-6 Luna 48,9 procenta. V testu Humanity's Last Exam, kde model odpovídá na odborné otázky bez použití nástrojů, se posunul z 10,2 na 45,9 procenta. A v testu Terminal-Bench 4.0, který zkouší práci v příkazové řádce, šel z nuly na 39,2 procenta.
Nezávislá analytická firma Artificial Analysis naměřila modelu skóre 43 v indexu inteligence, což je o šestadvacet bodů víc než u Haiku 4.5 zhruba před rokem. Podle stejné analýzy ale model spotřebuje při maximálním úsilí zhruba třikrát víc tokenů než konkurenční GPT-6 Luna, takže úspora na jednom místě se částečně vrací na jiném.
Dvě věci jsou u Haiku nové. Poprvé má nastavitelné úsilí, takže si vývojář může vybrat, jestli u jednoduché úlohy šetří, nebo u těžké přitlačí na výkon. A kontextové okno, tedy kolik textu model najednou udrží, narostlo z dvou set tisíc na milion tokenů.
Claude v Google dokumentech
Šestého října, den před vydáním Haiku, oznámila Anthropic veřejnou betu propojení Claude s Google Workspace. Claude teď sedí v postranním panelu vedle otevřeného dokumentu, tabulky nebo prezentace, čte ho a rovnou v něm i mění obsah. Nemusíte nic kopírovat tam a zpátky. Funguje to i opačně, takže z chatu v Claude můžete vytvářet a upravovat soubory v Googlu.
Máte dvě možnosti. Buď se Claude před každou úpravou zeptá, nebo všechny úpravy přijme naráz. Některé kroky ale pořád potřebují vaše potvrzení, třeba přidání externího odkazu, obrázku nebo změna přístupu, a všechny úpravy jsou vidět v historii verzí.
Jde o betu, takže má limity. Funguje jen na otevřeném souboru se základním rozšířením, panel musí zůstat otevřený, ve Firefoxu nefunguje vůbec a jedna dlouhá úloha má limit šesti minut. Neumí ani plánované automatizace, ani čtení komentářů. Kontext je přesto jasný. Google má ve svém balíčku Gemini, Microsoft Copilot v Office a Claude teď vstupuje do domu Googlu.
Krutost na model zakázaná
Do třetice Anthropic osmého října přepsal pravidla používání. Nově v nich zakazuje takzvané trvalé a zbytečné kruté nebo urážlivé chování vůči svým modelům. Účinnost má od dvanáctého listopadu. Firma zdůrazňuje, že nejde o běžné rozčilení, nesouhlas nebo temné motivy v povídkách, ani o testování modelu. Cílí jen na krajní případy, kdy někdo model soustavně trápí bez zjevného účelu. Hlavním nástrojem není zákaz účtu, ale to, že Claude takový rozhovor sám ukončí. Anthropic zároveň přiznává, že si není jistý, jestli mají modely nějaké morální postavení, a proto volí opatrnost.
Co si z toho vzít
Pro běžného čtenáře je tu jeden jasný vzkaz. Cena za používání umělé inteligence padá rychleji, než se čekalo, a to i u schopnějších modelů. Když se totéž stane u nástrojů, které denně používáte, poznáte to hlavně tak, že ubude limitů a přibude automatizace. Druhý vzkaz je o tom, kam se bitva přesouvá. Nejde už jen o to, který model je nejchytřejší, ale kdo bude sedět přímo v nástroji, který máte otevřený. Anthropic to teď zkouší v dokumentech Googlu.