Přeskočit na obsah
Licence a podmínky 4 min čtení

Qwen vydal nové váhy pod vlastní licencí se třemi prahy, ne pod Apache 2.0

Qwen zveřejnil 8. srpna 2026 váhy svého dosud největšího modelu Qwen3.8-2.4T-A95B. Předchozí generace vycházely pod Apache 2.0, tahle má vlastní licenci se třemi prahy: 100 miliony uživatelů měsíčně, 20 miliony dolarů měsíčních tržeb a 50 miliony dolarů tržeb za rok. Samotné soubory vah mají 4,89 TB.

Řady skříní superpočítače Frontier v sále laboratoře v Oak Ridge
Superpočítač Frontier v Oak Ridge National Laboratory. Foto: OLCF at ORNL, Wikimedia Commons (CC BY 2.0)

Qwen zveřejnil 8. srpna 2026 na Hugging Face váhy modelu Qwen3.8-2.4T-A95B, dosud největšího ze své otevřené řady. Vlastní oznámení z 3. srpna psalo, že váhy vyjdou v příštím týdnu a že model třídy Max dává tým ven poprvé. Přibalený soubor LICENSE se ale jmenuje Qwen3.8-Max License a Apache 2.0 v něm nikde není.

Licence pouští i prodej a hostování

Úvodní odstavec licenčního textu uděluje bezplatně právo software – tedy váhy, konfigurační soubory i přibalený kód pro inferenci – používat, kopírovat, upravovat, slučovat, zveřejňovat, šířit, poskytovat dál, prodávat, nasazovat, hostovat, dolaďovat a vytvářet z něj odvozená díla. Výčet zakázaných oborů užití v textu není; jediná obecná věta na konci říká, že užití musí být v souladu s právem a nesmí zasahovat do práv třetích osob. Pro čtenáře, který si model pustí u sebe, tím licence prakticky končí.

Tři čísla, u kterých volnost končí

První podmínka je běžná: s každou kopií musí jít i autorské oznámení a text licence. K tomu ale přibývá povinnost navázaná na velikost produktu. Když je software použitý v komerčním produktu nebo službě, která má víc než 100 000 000 aktivních uživatelů měsíčně nebo přes 20 000 000 dolarů měsíčních tržeb, musí být jméno modelu zřetelně vidět v rozhraní té služby.

Druhá podmínka jde dál. Kdo sám nebo s propojenými osobami provozuje činnost typu Model as a Service nebo AI Work Assistant a jejich souhrnné tržby přesáhnou 50 000 000 dolarů za jakýchkoli dvanáct po sobě jdoucích měsíců, musí si od Qwenu vyžádat samostatnou licenci, ještě než model použije k jakémukoli komerčnímu účelu. Výjimka platí pro vnitřní použití, které software, jeho výstupy ani jeho schopnosti nezpřístupní žádné třetí straně.

Mezi prvními dvěma čísly a tím třetím je podstatný rozdíl. Sto milionů uživatelů a dvacet milionů dolarů měsíčně se měří na produktu, ve kterém model běží. Padesát milionů dolarů se měří na celé firmě i s propojenými osobami, a to bez ohledu na to, kolik z těch tržeb má s modelem něco společného.

Obě činnosti si licence vymezuje sama. Model as a Service znamená zpřístupnit třetí straně inferenci nebo doladění tak, aby měla smysluplnou kontrolu nad vstupy, parametry nebo trénovacími daty; pouhé přeposílání dotazů na modely hostované někým jiným do toho nepatří. AI Work Assistant je samostatný produkt určený hlavně k programování nebo kancelářské práci a text jmenuje jako příklad Qoder a QwenWork. Jednoúčelový nástroj, třeba překladač, asistent z jiného oboru ani funkce uvnitř produktu, jehož hlavní účel je jinde, se za něj nepovažují.

Předchozí generace měly Apache 2.0

Rozhraní Hugging Face vrací u starších modelů téhož týmu jiný štítek. Qwen3.5-397B-A17B ze 16. února 2026 i Qwen3.6-27B z 21. dubna 2026 mají v kartě apache-2.0. U nové generace stojí v témže poli other a jméno qwen3.8-max. Na starší repozitáře to nesahá, u obou zůstává štítek Apache 2.0 dál; nová podmínka platí na tenhle model.

Prahů podle tržeb u otevřených vah přibývá. Licence modelu LFM2.5-2.6B pouští komerční užití jen do deseti milionů dolarů tržeb. Opačným směrem šla LG, která dala K-EXAONE 2.0 pod Apache 2.0 místo vlastní licence.

Váhy zaberou 4,89 terabajtu

Repozitář obsahuje 213 souborů safetensors. Součet jejich velikostí z rozhraní Hugging Face dává 4 892 365 649 336 bajtů, tedy 4,89 TB, po mocninách dvou 4 556 GiB. Je to vlastní výpočet: sečetli jsme pole size u všech souborů s touto příponou. Váhy jsou v bf16, tedy dva bajty na parametr, a z toho vychází 2,45 bilionu parametrů. S deklarovanými 2,4 bilionu to sedí. Souběžně vydaná varianta FP8 má stejný počet souborů a 2 496 102 697 232 bajtů, tedy 2,50 TB neboli 2 325 GiB.

Na akcelerátorech s 80 GiB paměti to znamená 57 karet jen na uložení vah v bf16 a 30 karet u varianty FP8. Také vlastní výpočet, a počítá jen s vahami: místo na keš klíčů a hodnot, kterou si pozornost drží po dobu rozhovoru, ani na aktivace v tom není. NVIDIA popsala 12. srpna nasazení na sestavě GB300 NVL72, což je 72 akcelerátorů propojených v jednom racku, a uvádí u něj přes 4 000 tokenů za sekundu na jeden akcelerátor a přes 350 tokenů za sekundu na jednoho uživatele ve výpočtu FP8. Jde o měření samotné NVIDIA a nikdo nezávislý ho zatím nezopakoval.

Že se model dá vůbec obsloužit, stojí na řídké architektuře. Konfigurační soubor uvádí 92 vrstev a 512 expertů, z nichž se na každý token zapojí deset směrovaných a jeden sdílený. Počítá se proto s 95 miliardami parametrů, ne se všemi 2,4 bilionu. V paměti ale musí být celá sada.

Tabulka v kartě měří jinou verzi

Karta modelu obsahuje rozsáhlou srovnávací tabulku, jenže její poslední sloupec se jmenuje Qwen3.8-Max. Táž karta o pár řádků výš vysvětluje, že Qwen3.8-Max je oficiální verze postavená na Qwen3.8-2.4T-A95B, která má navíc obrazový vstup, režim bez uvažování, ve výchozím stavu milion tokenů kontextu a vestavěné nástroje. Stažené váhy podle téže karty umí jen text, uvažování se u nich vypnout nedá a nativní kontextové okno má 262 144 tokenů s možností rozšíření na 1 010 000.

Pod tabulkou navíc stojí, že všechny výsledky pocházejí z vlastního testování týmu, a že se u části testů měřil každý model v jiném obalu: řada Qwen v OpenCode, konkurence v Claude Code nebo v Codexu. Jsou to tedy čísla výrobce, naměřená na cloudové verzi. Ve vlákně číslo 13 v diskusi u modelu si toho rozdílu všimli i uživatelé a autor vlákna ho shrnul do nadpisu o tom, že otevřené váhy jsou jen textové a bez milionového okna.

Kdo si model pustí u sebe nebo jen uvnitř firmy, žádné z těch tří čísel nepotká: takové užití licence nechává bez podmínek i bez poplatku. Rozdíl proti Apache 2.0 se projeví až tam, kde na modelu stojí placená služba. Tam je potřeba znát nejen tržby z ní, ale i souhrnné tržby celé skupiny za posledních dvanáct měsíců, a podle nich rozhodnout, jestli se má o licenci žádat zvlášť. A ještě předtím sehnat rack.

Diskuse

Zatím tu nikdo nediskutuje. Můžete být první.

Napsat příspěvek

Diskutovat můžete i bez účtu. S registrací se ale příspěvek zveřejní hned a nemusíte pokaždé vyplňovat jméno. Účet už máte? Přihlaste se.

Nezveřejňujeme ho, slouží jen redakci.

Podporuje zápis Texy: **tučně**, *kurzíva*, odrážky, odkazy.

Dál k tématu

  1. Licence a podmínky

    Ollama přibalila k Nemotronu 3.5 Lightning jinou licenci než NVIDIA

    Ollama 0.32.9 zpřístupnila Nemotron 3.5 Lightning v balíku o 25 GB. V jeho licenční vrstvě je ale NVIDIA Open Model License, zatímco NVIDIA u původních vah vydaných…

  2. Licence a podmínky

    GPT-5.6-Cyber zůstane u partnera, zákazník dostane jen řízený přístup

    Společnost OpenAI zpřístupňuje GPT-5.6-Cyber přes vybrané bezpečnostní a poradenské firmy. Model zůstane u schváleného partnera, který zákazníkovi nabídne jen řízenou…

  3. Licence a podmínky

    Na Hugging Face nemá polovina odvozenin tří modelů u sebe text licence

    Licence modelů LFM2.5-2.6B, MiniMax H3 a Kimi K3 shodně žádají, aby s každou další kopií šel i jejich text. Prošli jsme 9. srpna 2026 všech 212 repozitářů, které některý…

  4. Licence a podmínky

    Licence modelu LFM2.5-2.6B pouští komerční užití jen do 10 milionů dolarů ročních tržeb

    Oznámení k modelu LFM2.5-2.6B od Liquid AI slibuje stažení, doladění a nasazení bez omezení; slovo licence v něm nepadne ani jednou. Soubor LICENSE u vah přitom komerční…