Claude Sonnet 5.5: lacnejší a rýchlejší model, ktorý takmer dobehol Opus

Claude Sonnet 5.5

Anthropic 28. septembra vydal Claude Sonnet 5.5, druhý model z novej rodiny Claude 5.5. Prišiel len týždeň po silnejšom bratovi Claude Opus 5.5 a jeho úloha je jasná: ponúknuť veľkú časť jeho výkonu rýchlejšie a lacnejšie, aby sa dal pohodlne používať na každodennú prácu.

Čo je Sonnet 5.5 a na čo je ideálny

Anthropic má modely rozdelené podobne ako autá. Opus je výkonná limuzína na najťažšie úlohy, Sonnet je spoľahlivé auto na každý deň. Nový Sonnet 5.5 je podľa firmy najsilnejší pri jasne zadaných bežných úlohách, pri oprave chýb v kóde a pri tvorbe dokumentov, prezentácií a tabuliek, ktoré vyzerajú upravene a hotovo. Oproti predchodcovi Claude Sonnet 5 je zlepšenie v niektorých testoch obrovské, napríklad pri čítaní grafov vyskočila úspešnosť z necelých 16 na takmer 62 percent.

Ako zlacnel

Cena za samotný text sa nezmenila, Sonnet 5.5 stojí cez API rovnako ako Sonnet 5, teda 2 doláre za milión vstupných a 10 dolárov za milión výstupných tokenov. Tokeny sú malé kúsky textu, podľa ktorých sa AI účtuje. Úspora prichádza inak: nový model potrebuje na tú istú prácu výrazne menej tokenov, takže jedna úloha vás vyjde až o 30 percent lacnejšie. Navyše odpovedá o viac ako 30 percent rýchlejšie. Opus 5.5 je pritom presne dvakrát drahší, stojí 4 doláre za vstup a 20 dolárov za výstup.

Sonnet 5.5 verzus Opus 5.5

Rozdiel medzi oboma modelmi je prekvapivo malý. V hodnotení bežnej kancelárskej práce GDPval dosiahol Sonnet 1844 bodov a Opus 1846, teda prakticky remíza. Pri samostatnom ovládaní počítača v teste OSWorld má Sonnet 80,1 a Opus 81,8 percenta. V programátorskom teste Terminal-Bench 4.0 Sonnet dokonca vyhral, a to 70,6 oproti 66,4 percenta. Opus si náskok drží pri najnáročnejších úlohách, napríklad v teste Humanity’s Last Exam alebo pri zložitom kódovaní vo FrontierCode.

Sonnet 5.5 verzus GPT-6 Sol od OpenAI

Najbližším konkurentom je GPT-6 Sol, ktorý OpenAI vydal minulý týždeň ako lacnejšiu verziu modelu GPT-6 Astra. Oba modely majú rovnakú cenu 2 a 10 dolárov, takže rozhoduje výkon. Podľa čísel od Anthropicu Sonnet vedie pri kancelárskej práci výrazne, 1844 oproti 1487 bodom, a aj pri čítaní grafov, kde má 61,6 oproti 53,6 percenta. V náročnom kódovaní FrontierCode je to vyrovnanejšie, Sol má 49,3 percenta a Sonnet podľa nastavenia 46,2 až 52,1 percenta. Treba dodať, že ide o testy, ktoré zverejnila samotná firma Anthropic.

Čo to znamená pre vás

Ak používate Claude na písanie, prácu s dokumentmi alebo bežné programovanie, Sonnet 5.5 bude pre vás rozumnou voľbou na väčšinu dní. Opus si nechajte na naozaj ťažké úlohy. Model je dostupný v aplikácii Claude, cez API aj u Amazonu, Googlu a Microsoftu. Ak s Claude ešte len začínate, pomôže vám náš úvod do Claude.ai pre začiatočníkov a na automatizáciu práce na počítači sa oplatí pozrieť aj Claude Cowork.

Zdroje