Přeskočit na obsah
Infrastruktura 4 min čtení

Ollama pozastavila prodej tarifu Max za 100 dolarů. Kapacita cloudu prý nestačí

Ollama, nástroj na provoz jazykových modelů na vlastním počítači, přestala prodávat nejdražší předplatné Max za 100 dolarů měsíčně. V odpovědi na ceníku uvádí, že objem tokenů v jejím cloudu se každý měsíc víc než zdvojnásobil a poptávka roste rychleji, než stačí přidávat kapacitu. Stávajícím předplatitelům tarif zůstává, levnější Pro se prodává dál.

Prázdný serverový rám v datovém sále
Prázdný serverový rám. Ollama uvádí, že nové předplatné tarifu Max neprodává, dokud nepřidá výpočetní kapacitu. Foto: Jemimus, Wikimedia Commons (CC BY 2.0)

Na ceníku Ollamy stojí u nejdražšího tarifu Max štítek „New sign-ups paused“, tedy pozastavený prodej. Pod ním je jediná věta: nová předplatná Max jsou dočasně pozastavená, než firma přidá kapacitu. Cena se přitom nemění, na stránce dál svítí 100 dolarů měsíčně.

Ollama je program, který stáhne jazykový model a spustí ho na počítači uživatele – bez účtu, bez sítě a bez placení za tokeny. Vedle toho ale provozuje i vlastní cloud: na model, na který domácí stroj nestačí, se sáhne stejným příkazem, jen běží na serverech firmy. Zavřený prodej se týká jen téhle druhé, placené části.

Datum firma neuvedla, archiv ho ohraničí

Kdy štítek na ceník přibyl, Ollama nikde nepíše. Dá se to ohraničit z archivu Internet Archive, který si stránku ukládá: ve snímku z 24. července slovo „paused“ na ceníku ještě není, v tom z 27. července už je. Mezi těmi dvěma daty archiv jiný snímek ceníku nemá, přesnější to tedy být nemůže. Je to naše zjištění z archivu, ne údaj od firmy.

Důvod podle firmy

V odpovědi na vlastní otázku, proč jsou nová předplatná Max pozastavená, Ollama uvádí, že objem tokenů v jejím cloudu se každý měsíc víc než zdvojnásobil a že poptávka roste rychleji, než stačí přidávat kapacitu. Jmenovitě u toho zmiňuje příchod ještě větších otevřených modelů, konkrétně Kimi K3. Předplatitelé Maxu podle ní patří k nejtěžším uživatelům, a tak se zavřel právě tenhle tarif; stávající zákazníci si drží plán, limity i cenu. Ověřit ta čísla zvenčí nejde, žádnou statistiku provozu firma nezveřejňuje.

Kimi K3 přitom v cloudové knihovně Ollamy už je. Kdy tam přibyl, stránka neuvádí; hlásí jen poslední změnu karty před čtyřmi dny, tedy kolem 27. července.

Co který tarif dovolí

Verze zdarma zvládne jeden cloudový model naráz, Pro za 20 dolarů měsíčně (nebo 200 dolarů ročně) tři a Max deset. Pro má mít podle firmy padesátkrát vyšší cloudový příděl než verze zdarma, Max pětkrát vyšší než Pro. Chystaný týmový tarif za 25 dolarů za místo měsíčně počítá s nejméně pěti místy, tedy od 125 dolarů; na ceníku je označený jako „Coming soon“ a koupit se zatím nedá.

Pevný počet tokenů v tom nehledejte. Ollama píše, že příděl počítá ze vstupních, uložených a výstupních tokenů podle toho, jak je model náročný, a modely dělí do čtyř tříd spotřeby – od lehkých, kam řadí gpt-oss:20b, po nejtěžší s deepseek-v4-pro. Relace se resetuje po pěti hodinách, týdenní strop po sedmi dnech. Běh modelu na vlastním počítači zůstává bez omezení.

Sedmnáct modelů, jeden z nich ke stažení není

cloudové části knihovny jsme napočítali sedmnáct položek: vedle Kimi K3 třeba GLM-5.2, Gemma 4, Qwen 3.5, obě verze DeepSeeku V4 nebo trojici Nemotron 3. Jedna z nich vybočuje. Gemini 3 Flash Preview od Googlu má jedinou značku, nemá uvedenou velikost souboru a na kartě je u něj jen příkaz s příponou :cloud. Otevřené modely mívají vedle cloudové značky i varianty ke stažení, tenhle ne.

Na kartách cloudových modelů je i cena za tokeny. Karta Kimi K3 uváděla 31. července 2026 tři dolary za milion vstupních tokenů, 0,30 dolaru za milion tokenů z mezipaměti a 15 dolarů za milion výstupních, k tomu kontext 1 milion tokenů a velikost 2,81 bilionu parametrů. Domácí varianta téhož modelu je jiná disciplína: i v jednobitové kvantizaci chce přes 600 GB paměti.

Holý příkaz ollama spustí agenta

Posun k cloudu je vidět i na programu samotném. Poznámky k vydání 0.32.0 z 11. července uvádějí, že příkaz ollama bez dalších argumentů nově spustí interaktivního agenta pro psaní kódu, hledání na webu a zadanou práci. V ukázce výpisu, kterou k tomu firma přiložila, je u té volby uvedený model glm-5.2:cloud, tedy ten, který běží na serverech Ollamy. Táž verze zavedla varování před spuštěním starších modelů: CodeLlama, Qwen2.5, Llama 3.x, Mistral, StarCoder a základní DeepSeek-R1 ohlásí konec podpory dřív, než se rozjedou.

Řada 0.32 vychází hustě, od 11. do 27. července šest vydání. Jedno z nich, 0.32.2, firma stáhla z oběhu jedinou větou „Withdrawn, please use 0.32.3 or newer“. Zatím poslední 0.32.5 opravuje chybu v enginu MLX, kvůli které klesala kvalita výstupu u modelů ve formátu NVFP4.

Co firma slibuje o datech

Ceník má i oddíl o soukromí. Ollama v něm uvádí, že modely a výpočetní kapacitu provozuje především ve Spojených státech a že kvůli celosvětové poptávce může požadavky směrovat i do Evropy a Singapuru. Prompty ani odpovědi se podle ní nelogují a netrénuje se na nich; totéž má smluvně vyžadovat po hostitelských partnerech, které označuje jako NVIDIA Cloud Providers. Doklad k tomu na ceníku není, je to závazek, ne měření.

Peníze na kapacitu firma má. Podle TechCrunche získala 9. července 65 milionů dolarů v kole série B vedeném Theory Ventures a s dřívějšími 15 miliony ze série A od Benchmarku má vybráno 88 milionů; vlastní blog Ollamy uvádí jen tu souhrnnou částku. Podle nás je na zavřeném tarifu vidět, že výpočetní výkon se za peníze nepořídí hned. Koho zajímá jen běh modelu u sebe, ten to nepozná; kdo si zvykl na cloud, vystačí s Pro, nebo čeká.

Zdroje: ceník a časté dotazy na ollama.com k 31. červenci 2026, karty modelů kimi-k3 a gemini-3-flash-preview, výpis cloudové části knihovny, poznámky k vydání 0.32.0 až 0.32.5 na GitHubu, dokumentace k cloudovým modelům, snímky ceníku v Internet Archive z 24. a 27. července 2026 a článek TechCrunche z 9. července 2026.

Diskuse

Zatím tu nikdo nediskutuje. Můžete být první.

Napsat příspěvek

Diskutovat můžete i bez účtu. S registrací se ale příspěvek zveřejní hned a nemusíte pokaždé vyplňovat jméno. Účet už máte? Přihlaste se.

Nezveřejňujeme ho, slouží jen redakci.

Podporuje zápis Texy: **tučně**, *kurzíva*, odrážky, odkazy.

Dál k tématu

  1. Infrastruktura

    Za tři měsíce 96 hlášení o poruchách u OpenAI. Příčinu popisuje jediné z nich

    Stavovou stránku OpenAI jsme přečetli strojově, ne okem: od května do konce července 2026 na ní přibylo 96 záznamů o poruchách. Příčinu z nich popisuje jediný, osmdesát…

  2. Infrastruktura

    EU shání sedm továren pro AI. Veřejných 10 miliard má přitáhnout dalších 20

    Evropská unie otevřela tendr na provoz až sedmi výpočetních center pro velké modely umělé inteligence. Nabízí jim až 10 miliard eur z veřejných peněz a čeká nejméně 20…