علیبابا از Qwen-Image-2.1، جدیدترین مدل هوش مصنوعی خود برای تولید و ویرایش تصویر، رونمایی کرد. این مدل بهصورت Open-Weight منتشر شده و برخلاف بسیاری از مدلهای بسته، وزنهای آن برای دانلود در دسترس توسعهدهندگان قرار گرفته است.
نکته جالب درباره Qwen-Image-2.1، اندازه نسبتاً کوچک بخش تولید تصویر آن است. این بخش تنها ۷ میلیارد پارامتر دارد و در عین حال میتواند تولید تصویر از متن و ویرایش تصاویر را در یک مدل واحد انجام دهد. مدل جدید همچنین از تولید تصاویر شفاف با پسزمینه Transparent بهصورت بومی پشتیبانی میکند.
یکی از قابلیتهای مهم این نسخه، امکان استفاده از تا ۱۰ تصویر مرجع برای ویرایش است. کاربر میتواند بخش مشخصی از تصویر را برای تغییر تعیین کند و مدل تلاش میکند هویت افراد، محصولات و جزئیات اصلی تصویر را حفظ کند. Qwen-Image-2.1 همچنین از تولید تصویر با وضوح 2K پشتیبانی میکند.
علیبابا میگوید معماری جدید علاوه بر کیفیت تصویر، روی کاهش هزینه محاسبات و افزایش سرعت استنتاج تمرکز دارد. این مدل از همان روز انتشار با ابزارهایی مانند ComfyUI و Diffusers نیز سازگار شده است و وزنهای آن از طریق Hugging Face و ModelScope در دسترس قرار گرفتهاند.
با این حال، یک نکته مهم برای کسبوکارها وجود دارد: Qwen-Image-2.1 برخلاف تصور رایج از مدلهای اوپنویت، مجوز استفاده تجاری آزاد ندارد. طبق مجوز رسمی Qwen، استفاده رایگان از وزنهای مدل برای اهداف پژوهشی و ارزیابی مجاز است و استفاده تجاری به دریافت مجوز جداگانه نیاز دارد.