
Jak udržet AI agenta v rozpočtu a včas ho vypnout
Limit na 1 běh, denní strop a vypínač mimo agenta zabrání tomu, aby se chyba opakovala 4 dny a vedla ke 4 819 placeným voláním.

Mozilla ve zprávě z 15. září 2026 uvádí, že nejlepší uzavřené modely umělé inteligence mají před modely s otevřenými vahami náskok 4,4 měsíce. Dokončená úloha s uzavřenými modely však vyšla přibližně na 5násobek.
Modely s otevřenými vahami umožňují stáhnout jejich parametry a provozovat je na vlastní infrastruktuře. Obvykle ale nezveřejňují trénovací data ani celý postup vývoje, takže nejde o plně otevřený software. Uzavřené modely od společností Anthropic nebo OpenAI jsou dostupné jako placené služby a dodavatelé jejich technické podklady nezveřejňují.
Čínský model Kimi K3 od Moonshot AI zaostal v souhrnném indexu Artificial Analysis za modelem Fable 5 od Anthropic o 3 body. Jeho používání přitom stálo 30 % ceny modelu Fable 5. V testu Terminal-Bench 2.1 dělil model GLM 5.2 od společnosti Z.ai od modelů Claude Opus 4.7 a 4.8 pouze 1 bod. Porovnávané modely používaly stejnou softwarovou vrstvu, která jim zpřístupňovala nástroje a paměť.
Rozdíl mezi otevřenými a uzavřenými modely se podle Mozilly projevuje hlavně u složitějších úloh. Nejlepší otevřený model dosahuje 50% úspěšnosti u práce, která člověku zabere přibližně 7 hodin. U uzavřeného modelu odpovídá stejná úspěšnost práci trvající asi 12 hodin. Pro úlohy kratší než 8 hodin mohou podle zprávy stačit levnější otevřené modely. U úloh přesahujících 12 hodin zatím nejsou obecně spolehlivé ani uzavřené varianty.
Výsledky benchmarku samy o sobě nestačí k rozhodnutí o výměně používané služby AI. Otevřený model vyžaduje vlastní infrastrukturu, správu a pracovníky, kteří jej dokážou nasadit a udržovat. Cena uzavřené služby může zahrnovat podporu, nástroje pro soulad s pravidly a odpovědnost dodavatele. Zpráva neuvádí konkrétní ceníky, náklady na infrastrukturu, podmínky podpory ani výsledky v běžných firemních procesech. Bez těchto údajů nelze z benchmarku určit, která varianta bude při konkrétním nasazení levnější.

Limit na 1 běh, denní strop a vypínač mimo agenta zabrání tomu, aby se chyba opakovala 4 dny a vedla ke 4 819 placeným voláním.

O přínosu 5 licencí nerozhodne jen měsíční cena. Podstatné je, zda ChatGPT zkrátí celý proces, nebo pouze vytvoří další text ke kontrole.

Pro první AI pilot je potřeba testovací sada, která zachytí běžné i hraniční případy. Bez výchozího času, chybovosti a hranice úspěchu ale výsledek nelze vyhodnotit.
Napište nám, co u vás řešíte. Společně probereme, jestli vám můžeme pomoci.