فهرست مطالب
علیبابا مدل تصویرساز Qwen Image 2.1 را با ۷ میلیارد پارامتر معرفی کرد؛ مدلی با قابلیت اجرای محلی که با Nano Banana 2 گوگل رقابت میکند.
به گزارش سرویس هوش مصنوعی تکناک،البته این ادعاها بر اساس بنچمارک داخلی علیبابا مطرح شدهاند و برای رسیدن به نتیجهای قطعی، به آزمایشهای مستقل بیشتری نیاز است.
بااینحال، گزارشهای اولیه نشان میدهند Qwen Image 2.1 مدل توانمندی است که از قابلیتهایی مانند پشتیبانی بومی از پسزمینه شفاف و ترکیب تصاویر بر اساس چندین تصویر مرجع بهره میبرد.
با وجود این، تغییر شرایط مجوز استفاده از Qwen Image 2.1 توجه برخی کاربران را جلب کرده است. برخلاف نسخه قبلی، مجوز جدید فروش مجدد تجاری خود مدل را صراحتاً ممنوع میکند.
بنابراین، هر فرد یا شرکتی که بخواهد مدل را برای چنین منظوری عرضه کند، باید مجوزی جداگانه و مستقیماً از توسعهدهنده دریافت کند.
رقابت با مدلهای برتر تولید تصویر
Qwen Image 2.1 چند قابلیت تازه دارد که کاربردهای آن را گسترش میدهند و رقابتش را با گزینههای مطرح بازار آسانتر میکنند.
این مدل بهصورت بومی از شفافیت پشتیبانی میکند و میتواند تصاویری با پسزمینه شفاف بسازد.
این ویژگی برای هنرمندانی که میخواهند تصاویر تولیدشده با هوش مصنوعی را در پروژههای دیگر به کار ببرند یا محصولاتی مانند برچسبهای چاپ بر اساس سفارش تولید کنند، کاربردی است.
قابلیت ویرایش تصویر نیز بهبود یافته و مدل میتواند از حداکثر ۱۰ تصویر مرجع استفاده کند.
برای مثال، کاربر میتواند تصویر فردی را به مدل بدهد و سپس تصاویر چند لباس را به آن اضافه کند تا مدل تصویری از همان فرد با لباسهای موردنظر بسازد.
تیم Qwen میگوید مدل در تصاویر مختلف، از جمله هنگام بازنمایی افراد و محصولات، ثبات و سازگاری را حفظ میکند.
بااینحال، ویژگی برجسته Qwen Image 2.1 اندازه کوچک آن است. بخش تولید تصویر این مدل تنها ۷ میلیارد پارامتر دارد و آن را به یکی از مدلهای کمحجم این حوزه تبدیل میکند.
در مقایسهای که توسعهدهندگان منتشر کردهاند، تنها مدل LongCat-Image شرکت Meituan پارامترهای کمتری دارد و با ۶ میلیارد پارامتر عرضه شده است.
بیشتر مدلهای دیگر چند برابر بزرگترند یا وزنهای آنها در دسترس عموم قرار ندارد.
توسعهدهندگان Qwen ادعا میکنند که مدلشان میتواند مستقیماً با همین مدلهای اختصاصی رقابت کند.
در بنچمارک داخلی Qwen Image، این مدل امتیاز ۶۰٫۲ را به دست آورده است. در همین ارزیابی، GPT Image 2.5 Sunburst شرکت OpenAI امتیاز ۶۷، مدل Muse Image امتیاز ۶۲٫۳۴ و Nano Banana 2.0 گوگل امتیاز ۵۹٫۸۲ را کسب کردهاند.
نتایج اولیه بنچمارک AI Arena نشان میدهد عملکرد Qwen Image 2.1 در شرایط ارزیابی متفاوت، به اندازه نتایج داخلی درخشان نیست، اما همچنان به رقبایش نزدیک است.
این مدل در AI Arena امتیاز ۱۲۲۸ را کسب کرده، درحالیکه Nano Banana 2 امتیاز ۱۲۶۰ دارد. مدل Muse Image با امتیاز ۱۲۷۶ چند رتبه بالاتر قرار گرفته و GPT 65 Sunburst نیز با امتیاز ۱۴۲۳ در صدر جدول است.
این نتایج هنوز مقدماتیاند و برای تأیید یا رد کامل ادعاهای تیم Qwen، آزمایشهای بیشتری لازم است.
بااینحال، دادههای فعلی تا حد زیادی با این ادعاها همخوانی دارند. هرچند تعداد پارامترهای مدلهای اختصاصی مشخص نیست، Qwen Image 2.1 با وجود وزنهای نسبتاً کوچک، فاصله کمی با آنها دارد.
بیشتر بخوانید: تراشه هوش مصنوعی جدید علی بابا معرفی شد
اجرای مدل روی سختافزارهای شخصی

گزارشهای برخی کاربران اولیه نشان میدهد Qwen Image 2.1 روی کارتهای گرافیک مصرفی نیز عملکرد مناسبی دارد.
کاربری با نام Vunderba در انجمن Hacker News که توسعهدهنده وبسایت GenAI Showdown است، میگوید توانسته یک تصویر یک مگاپیکسلی را با این مدل و کارت گرافیک RTX 4090 در حدود پنج ثانیه تبدیل کند.
کاربر دیگری با نام cgs019283 در سابردیت Stable Diffusion از عملکرد مدل تمجید کرده و گفته است که Qwen Image 2.1 میتواند روی کارتهای گرافیک جدید سری RTX 50 انویدیا، مانند RTX 5070 و RTX 5080، تصاویری یک مگاپیکسلی را در حدود ۲۵ ثانیه تولید کند.
البته به گفته او، استفاده از تعداد زیادی تصویر مرجع میتواند زمان پردازش را بهشدت افزایش دهد. در آزمایشهای این کاربر، ویرایش تصویر کندترین قابلیت مدل بوده است.
برخی کاربران حتی موفق شدهاند مدل را روی سختافزارهای قدیمیتر و ضعیفتر اجرا کنند. یکی از آنها مدعی است که با کارت گرافیک Nvidia RTX 3060 و ۶۴ گیگابایت حافظه، تصاویر با وضوح 2K را در حدود ۵۰ ثانیه تولید میکند.
کاربر دیگری نیز به کارت گرافیک قدرتمند RTX 6000 Pro دسترسی دارد و میگوید این سختافزار میتواند تصاویر ۱۰۲۴ در ۱۰۲۴ پیکسلی را تنها در چند ثانیه تولید کند.
با وجود این نتایج، راهاندازی و استفاده از هوش مصنوعی بهصورت محلی همچنان به سادگی پلتفرمهای ابری مانند Nano Banana گوگل و مدلهای GPT Image شرکت OpenAI نیست.
بااینحال، نتایج اولیه در نگاه نخست چشمگیرند. اگر قابلیتهای مدل در آزمایشهای دقیقتر نیز تأیید شوند، Qwen Image 2.1 میتواند رقیبی جدی برای کاربرانی باشد که به تولید سریع تصاویر باکیفیت، اجرای محلی، کنترل کامل و بینیازی از حسابهای ابری یا اشتراک پولی اهمیت میدهند.
بیشتر بخوانید: علی بابا 2 مدل جدید هوش مصنوعی معرفی کرد
ابهامهای مربوط به مجوز استفاده
در میان بحثهای کاربران اولیه Qwen Image 2.1، موضوع مجوز استفاده از مدل بارها مطرح شده است. متن مجوز تا حدی مبهم به نظر میرسد و در بخشی از آن آمده است:
مجوزی محدود، غیرانحصاری، جهانی، غیرقابلانتقال و بدون حق امتیاز، تحت حقوق مالکیت فکری یا سایر حقوق متعلق به ما که در مواد ارائهشده تجسم یافتهاند، به شما اعطا میشود تا این مواد را صرفاً برای اهداف غیرتجاری استفاده، تکثیر، توزیع، کپی، اصلاح یا بر اساس آنها آثار مشتقشده ایجاد کنید.
این عبارت تا حد زیادی موضوع را روشن میکند. به نظر میرسد محتوایی که کاربران با مدل تولید میکنند، مشمول تعریف «مواد» دارای مجوز نمیشود و در نتیجه، این بند نباید شامل خروجیهای تولیدشده باشد.
بااینحال، این مجوز به آن معناست که فروش مجدد خود مدل بدون دریافت مجوز از علیبابا امکانپذیر نیست.
این شرایط با مجوز Apache که نسخه اصلی Qwen Image بر اساس آن عرضه شده بود، تفاوت دارد و ممکن است تعریف «وزنباز» بودن مدل را نیز با پرسشهایی روبهرو کند. در هر صورت، مجوز جدید به اندازهای که میتوانست باز و آزاد نیست.
البته این محدودیت برای بیشتر کاربران مسئله مهمی ایجاد نمیکند.
آنها همچنان میتوانند Qwen Image 2.1 را روی سختافزار شخصی خود اجرا کنند، تصاویر موردنظرشان را بسازند و از خروجیها به شیوه دلخواه استفاده کنند.
با توجه به طراحی سبک و قابلیتهای چشمگیر این مدل، واکنش توسعهدهندگان مدلهای اختصاصی به آن نیز جالبتوجه خواهد بود.
در متن مجوز همچنین آمده است که هر فردی که بخواهد از «مواد» یادشده برای اهداف تجاری استفاده کند، باید متناسب با مورد استفاده خود، مجوزی جداگانه از تیم Qwen دریافت کند.

















