Přeskočit na obsah
Čínské modely 3 min čtení

Qwen-Image-2.1 má zveřejněné váhy jen pro nekomerční použití

Alibaba 20. září vydala Qwen-Image-2.1 pro generování i úpravy obrázků; obrazová část má 7,1 miliardy parametrů a model pracuje až s deseti předlohami. Váhy lze podle souboru LICENSE používat, upravovat a šířit jen nekomerčně pro výzkum nebo hodnocení, zatímco firmy potřebují zvláštní smlouvu.

Čínský tým Qwen vydal 20. září Qwen-Image-2.1, model pro tvorbu i úpravy obrázků. Jeho obrazová část má 7,115 miliardy parametrů a umí pracovat až s deseti referenčními snímky naráz. Označení otevřené váhy je ale jen půlka informace: přiložená licence dovoluje nekomerční použití pro výzkum a hodnocení, nikoli běžné nasazení ve firmě.

Jde o jiné vydání než Qwen-Image-2512, na kterém jsme dříve měřili dopad rychlejšího jádra SGLangu na celý požadavek. Nové jsou váhy, schopnosti i licenční podmínky.

Dvě verze stejné fotografie tří historických osobních počítačů
Dvě podoby stejné fotografie po úpravě perspektivy a před ní. Foto: Tim Colegrove, úprava Pittigrilli, Wikimedia Commons (CC BY-SA 4.0)

Sedm miliard je jen obrazová část

Karta modelu mluví o sedmi miliardách parametrů ve vizuální složce. Strojový výpis souborů číslo zpřesňuje na 7 115 124 736 parametrů ve formátu BF16. Dva soubory této části mají dohromady 14,23 GB.

Ke generátoru patří ještě textový kodér ve čtyřech souborech o 17,534 GB a VAE o 1,351 GB. VAE převádí obraz mezi pixely a zhuštěným zápisem, se kterým model počítá. Součet tří skupin vah je 17,534 + 14,230 + 1,351, tedy přibližně 33,12 GB; tokenizer a konfigurační soubory leží vedle nich. Jde o vlastní součet velikostí z výpisu repozitáře, ne o slib výrobce ani o požadavek na paměť grafické karty.

Rozdíl je důležitý. Číslo 7,1 miliardy popisuje obrazový transformátor, nikoli všechno, co se při spuštění stáhne. Qwen v rychlém návodu nabízí odkládání částí modelu do operační paměti procesoru, ale neuvádí minimální sestavu ani změřenou rychlost na běžné kartě.

Deset předloh, maska a průhledné pozadí

Qwen spojil generování a editaci do jednoho modelu. Podle karty s návodem umí vytvořit i upravit obrázek s alfa kanálem, tedy s průhledností. Z fotografie může vyříznout předmět a místní úpravu lze vyznačit kruhem, barevnou poznámkou nebo samostatnou maskou.

Až deset předloh má sloužit například pro skupinový portrét, zkoušení oblečení nebo přestavbu místnosti. Výrobce zároveň tvrdí, že model při úpravách lépe zachová totožnost člověka či výrobku. To je tvrzení Qwenu. The Decoder při vydání upozornil, že nezávislé testy teprve chybějí, proto z porovnávacích tabulek výrobce nelze dělat potvrzené pořadí modelů.

Příklady v návodu počítají se 40 kroky a rozlišením od 1 536 × 2 752 do 2 752 × 1 536 bodů podle poměru stran. Jsou to doporučená nastavení, ne změřená hranice. Samotný model lze požádat i o jiný rozměr, karta ale u něj kvalitu neslibuje.

Licence dovoluje výzkum, ne podnikání

Qwen Research License Agreement má datum 20. září 2026. Povoluje váhy používat, kopírovat, upravovat, šířit a z nich vytvářet odvozená díla, pokaždé však jen pro nekomerční výzkum nebo hodnocení. Pro komerční použití má zájemce požádat Qwen o zvláštní licenci.

Redistribuce navíc vyžaduje přiložit celé znění licence, označit změněné soubory a ponechat předepsanou atribuci. Kdo pomocí materiálů nebo jejich výstupů vytrénuje další veřejně dostupný model, musí v dokumentaci viditelně uvést „Built with Qwen“ nebo „Improved using Qwen“. Název Qwen přitom nesmí použít jako hlavní jméno vlastního odvozeného výrobku.

Nejde o stejné podmínky, které jsme popsali u textového Qwen3.8. Tam licence pracovala s prahy podle počtu uživatelů, obratu a objemu poskytované inference. Qwen-Image-2.1 žádný podobný práh nemá: komerční účel vylučuje rovnou. Váhy jsou veřejně ke stažení, otevřený zdroj ani svobodný model z nich to nedělá.

První spuštění sahá do vývojové větve

Rychlý návod neinstaluje jen hotová vydání balíčků. Žádá PyTorch 2.4 nebo novější, Transformers 5.17 či novější a knihovnu Diffusers přímo z hlavní větve na GitHubu. To znamená, že podpora Qwen-Image-2.1 při vydání ještě nebyla odkázaná na konkrétní stabilní verzi Diffusers.

Pro výzkumníka nebo domácí pokus tak vydání přináší skutečné váhy, ukázkový kód i veřejnou licenci. Pro firmu je hranice jinde: stažení 33 GB souborů není souhlas s jejich použitím v placené službě. O tom rozhoduje samostatná obchodní smlouva, jejíž cenu ani podmínky veřejný repozitář neuvádí.

Zdroje

Diskuse

Zatím tu nikdo nediskutuje. Můžete být první.

Napsat příspěvek

Diskutovat můžete i bez účtu. S registrací se ale příspěvek zveřejní hned a nemusíte pokaždé vyplňovat jméno. Účet už máte? Přihlaste se.

Nezveřejňujeme ho, slouží jen redakci.

Podporuje zápis Texy: **tučně**, *kurzíva*, odrážky, odkazy.

Dál k tématu

  1. Čínské modely

    Qwen účtuje za Omni-Flash pětinu ceny Gemini 3.8 Flash a váhy drží u sebe

    Alibaba pustila 18. září omnimodální model Qwen3.8-Omni-Flash a chce za něj 0,15 dolaru za milion vstupních tokenů bez ohledu na to, jestli jde o text, zvuk, nebo video.…

  2. Čínské modely

    Agentní model Atria Dawn stojí na nezměněné architektuře GLM-5.2

    Šanghajská laboratoř umělé inteligence zveřejnila váhy agentního modelu Atria Dawn Preview a technickou zprávu k němu. Soubor s nastavením se od modelu GLM-5.2 firmy Z…

  3. Čínské modely

    Návrh na opravu štítku u GLM-OCR ležel v repozitáři Z.ai od května do září

    Vývojář Hugging Face nechal u čínského modelu GLM-OCR návrh na opravu štítku 19. května. Z.ai ho sloučila 11. září. Dvě hlášení uživatelů, kterým se model přes rozhraní…

  4. Čínské modely

    Anthropic tvrdí, že Moonshot a DeepSeek posílaly dotazy svých uživatelů Claudovi

    Tým Threat Intelligence společnosti Anthropic popsal 10. září pět kampaní, ve kterých čínské laboratoře sbíraly odpovědi Claudu pro výcvik vlastních modelů. U Moonshotu…