Ollama v 0.32.6 odstranila generování obrázků a odkazuje na starší verzi
Vydání Ollamy 0.32.6 ze 4. srpna 2026 smazalo ze zdrojového kódu celou část, která uměla generovat obrázky. Poznámky k vydání radí zůstat na verzi 0.32.5. Katalog modelů na ollama.com přitom dál ukazuje příkaz, kterým se ty modely spouštěly.

Ollama je nástroj, kterým si jazykový model pustíte na vlastním počítači, bez cloudu a bez účtu u poskytovatele. Od ledna 2026 uměla i něco navíc – generovat obrázky. Poznámky k vydání 0.32.6 ze 4. srpna 2026 to odbývají jednou odrážkou: „Experimental image generation has been temporarily removed. Continue using 0.32.5 for image generation support.“ Tedy že experimentální generování obrázků bylo dočasně odstraněno a kdo ho chce, má dál používat verzi 0.32.5.
Co ze zdrojového kódu zmizelo
Porovnání značek v0.32.5 a v0.32.6 ukazuje 130 dotčených souborů. Z nich je 57 smazaných a 55 leží pod adresářem x/imagegen; jde o 23 989 řádků. Zbylé dva smazané soubory jsou integrační testy integration/imagegen_test.go a integration/create_imagegen_test.go. Dohromady je to 24 245 řádků. Obojí je vlastní součet z pole files v odpovědi rozhraní GitHubu na porovnání obou značek, takže si ho každý může zopakovat.
Z adresáře x/imagegen zůstal jediný podadresář manifest se dvěma soubory. Řádek, kterým si ho server/routes.go načítal, ale ze souboru zmizel taky.
Za změnou stojí návrh číslo 16615 od uživatele jmorganca. Otevřený byl 7. června 2026, sloučený 28. července. Popis návrhu je jedna věta: „To be re-introduced on the new MLX runner in the future.“ Tedy že se to má někdy v budoucnu vrátit na novém MLX runneru. Datum v ní není.
Server na takový požadavek odpoví chybou
Nešlo jen o úklid nepoužívaného kódu. Do souboru server/routes.go přibyl řádek, který na model s obrazovou schopností vrátí stav 400 a text „image generation models are not currently supported“. Nový test TestImageGenerateUnsupported na to čeká přesně: očekává kód 400 a tenhle řetězec v těle odpovědi. Zmizela také cesta /v1/images/generations, kterou Ollama nabízela jako obdobu rozhraní OpenAI.
Spuštěním jsme to neověřovali – takhle to stojí ve zdrojovém kódu a v jeho vlastním testu.
Katalog modelů zůstal, jak byl
Stránky obou modelů na ollama.com jsou 5. srpna dál dostupné a dál ukazují příkaz ollama run. Flux.2 Klein u sebe uvádí 200 tisíc stažení, Z-Image-Turbo 178,4 tisíce; obě u poslední změny uvádějí šest měsíců. Readme prvního z nich navíc upozorňuje, že modely na generování obrázků zatím fungují jen na macOS. Stažení nejsou lidé – kolik z těch, kdo si model stáhli, ho opravdu používá, katalog neříká.
Necelých sedm měsíců v režimu „experimentální“
Funkce přišla 10. ledna 2026 ve verzi 0.14.0 jako „nová experimentální podpora modelů na generování obrázků, postavená na MLX“. O čtyři dny později verze 0.14.1 nabídla první model pro macOS a pro Linux s CUDA a slíbila další tři. 16. ledna přibyl Flux.2 Klein a možnost generovat obrázky rovnou přes /api/generate. Pak přišly opravy v únoru a další práce v květnu. Slovo „experimentální“ u té funkce zůstalo celou dobu.
Opravu pro Linux někdo poslal týden předtím
22. července otevřel AdamDLuz, u kterého GitHub žádnou vazbu na projekt neuvádí, návrh číslo 17333. Popisuje čtyři samostatné příčiny, proč generování na Linuxu s kartami NVIDIA padalo, a po jejich opravě uvádí vlastní měření: model flux2-klein:4b na kartě NVIDIA L4 s CUDA 13.0 a ovladačem 580.159.03 vykreslil obrázek 512×512 asi za 7 s a 1024×1024 asi za 29 s se špičkou 11,8 GB paměti. To je jeho číslo, nikdo jiný ho nezopakoval. Návrh je pořád otevřený a všech šest souborů, kterých se dotýká, leží pod smazaným adresářem x/imagegen.
Co vydání naopak přineslo
Tatáž verze zrychlila model Qwen3.5 na grafických čipech Applu – MLX engine si sám bere MTP hlavu modelu ke spekulativnímu dekódování, tedy k postupu, kdy menší část modelu napíše návrh odpovědi dopředu a zbytek ho jen potvrzuje. Streamování přes /v1/chat/completions se srovnalo s tvarem, jaký posílá OpenAI: role jen v prvním kusu, finish_reason ve vlastním a spotřeba tokenů v samostatném. Uříznutá odpověď se nově hlásí jako finish_reason: "length" místo "tool_calls". A ollama run kimi-k3 u modelů, které mají jen cloudovou podobu, nabídne značku :cloud místo toho, aby skončil chybou. Provozem cloudové části Ollamy jsme se zabývali dřív.
Kdo generoval obrázky u sebe doma, má zatím jedinou cestu: zůstat na 0.32.5 a čekat, až se funkce vrátí na novém MLX runneru. Kdy to bude, neříká ani návrh změny, ani poznámky k vydání.