Milvus 3.0 přinesl nové úložiště i nové rejstříky. Ve výchozím nastavení se nezapnou
Vektorová databáze Milvus dostala 29. července 2026 značku 3.0.0. Umí nově postavit rejstřík nad daty, která zůstanou ležet v objektovém úložišti, a má přepsaný řídký index. V konfiguraci přiložené k vydání je ale nové úložiště vypnuté a nové algoritmy rejstříků se bez ručního zásahu neuplatní.

Vektorová databáze ukládá text, obrázky nebo zvuk převedené na dlouhé řady čísel a hledá v nich podle podobnosti, ne podle shody slov. Jazykový model tak dostane k dotazu podklady, které v sobě nemá. Druhá cesta je nasypat mu je rovnou do kontextu, jenže dlouhý kontext má vlastní účet za paměť. Milvus je jedna z nejrozšířenějších takových databází, stojí za ní firma Zilliz a kód je pod licencí Apache 2.0.
Značku v3.0.0 dostal repozitář 29. července 2026 a totéž datum uvádějí poznámky k vydání. Je to první změna hlavního čísla po řadě 2.6. Popis novinek u vydání na GitHubu nenajdete, tělo tam nese jen větu, že poznámky teprve budou; celé jsou v dokumentaci.
Rejstřík nad daty, která zůstanou v úložišti
Hlavní novinka se jmenuje External Collection. Kolekce se dá založit nad soubory, které leží v objektovém úložišti v otevřených formátech tabulek – Parquet, Lance, Iceberg nebo Vortex –, a Milvus je nechá být. Nekopíruje je k sobě; postaví nad nimi rejstříky pro vektory, plnotextové hledání, JSON i běžné sloupce a nabídne stejné rozhraní jako nad vlastní kolekcí. Zapisovat se do takové kolekce nedá. Když se soubory změní, databáze si přečte popis úložiště a zaindexuje jen přibylé části, ne kolekci znovu celou.
Vedle toho přibyly snímky kolekce (Snapshot), tedy pohled na stav k jednomu okamžiku poskládaný z odkazů na už existující úseky dat, dále řazení a sčítání na straně serveru, fasetové hledání a pole typu TEXT pro dlouhé texty. Hodnoty do 64 kB zůstávají v řádku, delší jdou do samostatných souborů a ve sloupci zůstane jen odkaz na ně.
Co se po instalaci samo nezapne
Úložiště, na kterém část těch věcí stojí, je ve výchozím stavu vypnuté. Dokumentace to říká rovnou, anglicky „Storage V3 (Loon) is disabled by default“, a dodává, že funkce, které na něm závisejí – jmenovitě snímky a pole TEXT –, se musí zapnout ručně přepínačem common.storage.useLoonFFI. Sedí to s konfiguračním souborem přiloženým k vydání: u té položky je hodnota false.
Podobné je to s novými algoritmy rejstříků. Aby se uplatnily, musí se podle dokumentace ručně zvednout cílová verze rejstříku – dataCoord.targetVecIndexVersion na 10 a dataCoord.targetScalarIndexVersion na 4. V přiloženém souboru je první z nich 8 a druhá -1, což podle komentáře nad ní znamená, že se žádná cílová verze nevynucuje. Ve verzi 2.6.21, která vyšla pět dní před 3.0.0, byla obě čísla -1. Vydání tedy jedno z nich posunulo, jen ne až tam, kde se nové algoritmy zapnou.
Návrat zpět je podle téhož oddílu zaručený: nasazení 3.0 se dá vrátit na 2.6. Platí to ale jen do chvíle, než se zapne něco, co mění formát uložených dat, a jako příklad je uvedené právě nové úložiště. Kdo tedy sáhne po té části vydání, kvůli které se řada jmenuje 3.0, zavře si tím cestu zpátky.
Čísla o řídkém rejstříku měřil výrobce
Řídký rejstřík (sparse index) je ta část, která hledá podle slov, ne podle významu, a pouští se obvykle společně s vektorovým hledáním. Milvus 3.0 ho přepsal a přidal tři vyhledávací postupy: SINDI, Block-Max WAND a Block-Max MaxScore. K tomu komprimaci seznamů dokumentů a nastavitelné zaokrouhlování hodnot.
Zrychlení dokládají dvě čísla. Komprimovaný rejstřík pro vážení BM25 má být zhruba třikrát menší než řídký rejstřík z řady 2.6 při srovnatelné úplnosti výsledků a SINDI má na naučených řídkých vektorech dosáhnout až asi desetinásobku dotazů za sekundu proti postupu MaxScore. Obě čísla pocházejí z vlastního měření: dokumentace mluví o „internal benchmarks“, tisková zpráva o „internal testing“. Ani jeden z těch textů neuvádí, na jakém hardwaru a nad jakými daty se měřilo. Nezávisle to zatím nikdo nezopakoval.
Tři data k jednomu vydání
Kdy Milvus 3.0 vyšel, se ve zdrojích liší. Server TechTarget napsal 20. července 2026, že verze je „generally available“ od 16. července. Oznámení na blogu projektu je datované 27. července a začíná větou, že se Milvus 3.0 vydává dnes. Poznámky k vydání i značka v repozitáři pak shodně uvádějí 29. července. Který z těch okamžiků je vydání, žádný z těch zdrojů neupřesňuje; v tomhle textu bereme za datum vydání den, kdy vznikla značka.
Licence se nezměnila
Soubor LICENSE je ve značce 3.0.0 bajt po bajtu stejný jako ve 2.6.21 – Apache 2.0 v plném znění, bez prahů na tržby nebo počet uživatelů. Oba soubory jsme si porovnali. Vedle otevřeného Milvu provozuje Zilliz placenou službu Zilliz Cloud a podle vlastní tiskové zprávy staví obojí na témže jádru.
Pro provozovatele z toho plyne jednoduchá věc. Kdo aktualizuje kvůli něčemu jinému, dostane databázi, která se drží starého formátu dat a dá se vrátit. Kdo chce to, kvůli čemu vydání vzniklo, musí sáhnout do konfigurace – a tím tu cestu zpátky zavře. Dokumentace u obou přepínačů slibuje, že je pozdější vydání zapne samo; kdy, neříká.
Zdroje: poznámky k vydání Milvu, oznámení na blogu projektu, konfigurační soubory a soubor LICENSE ve značkách v3.0.0 a v2.6.21, zpráva TechTargetu a tisková zpráva firmy Zilliz. Porovnání konfiguračních souborů a souboru LICENSE mezi oběma značkami je naše.