فهرست مطالب
شرکت مایکروسافت مدل تولید تصویر MAI-Image-2.6 را عرضه کرد که با عملکردی درخشان در نمایش متن و تصاویر واقعگرایانه، اکنون در رتبه دوم جدول جهانی Arena قرار گرفته است.
به گزارش سرویس هوش مصنوعی تکناک، این شرکت نخستین مدل داخلی تبدیل متن به تصویر خود، یعنی MAI-Image-1 را در اکتبر ۲۰۲۵ عرضه کرد. این مدل کار خود را در رتبه نهم جدول Arena آغاز کرد. بخش هوش مصنوعی مایکروسافت در مارس ۲۰۲۶، مدل MAI-Image-2 را معرفی کرد؛ یک ارتقای بزرگ نسل دوم که کیفیت و عملکرد تصاویر را به طور محسوسی بهبود میداد. این مدل در رتبهبندی Arena جایگاه سوم را به دست آورد و تنها پایینتر از مدلهای gemini-3.1-flash-image-preview گوگل و gpt-image-1.5-high-fidelity شرکت OpenAI قرار گرفت.
شرکت مایکروسافت در ماه مه MAI-Image-2.5 را عرضه کرد که تازهترین مدل تبدیل متن به تصویر این شرکت در آن زمان بود و بار دیگر جایگاه سوم جدول رقابتی Arena را به دست آورد. ماه گذشته نیز MAI-Image-2.5-Pro معرفی شد که دقیقترین مدل تولید تصویر مایکروسافت تا آن زمان به حساب میآمد. این مدل برای کاربردهایی طراحی شده بود که به تولید و ویرایش تصاویر دارای جزئیات فراوان و نمایش دقیقتر متن درون تصاویر نیاز دارند.
01
از 02جهش مایکروسافت با مدل تولید تصویر MAI-Image-2.6
مایکروسافت امروز MAI-Image-2.6 را معرفی کرد. این مدل جدید تولید تصویر اکنون در رتبه دوم جدول Arena قرار دارد و تنها مدل GPT-Image-2 شرکت OpenAI جایگاه بالاتری از آن دارد. مدل MAI-Image-2.6 در بخش تبدیل متن به تصویر Arena، امتیاز Elo آن ۷۹ واحد بیشتر از MAI-Image-2.5 است.

مصطفی سلیمان، مدیرعامل بخش هوش مصنوعی مایکروسافت، در شبکه اجتماعی ایکس نوشت:
«MAI-Image-2.6 اکنون دومین مدل تبدیل متن به تصویر جهان است و توانسته است Nano Banana، مدلهای متا و Grok را پشت سر بگذارد. این لحظهای فوقالعاده برای تیمی است که بیوقفه برای بهبود عملکرد مدل تلاش کرده است. کاربران میتوانند همین حالا آن را در Arena امتحان کنند.»
بهگفته مایکروسافت، مدل MAI-Image-2.6 در نمایش متن، تولید پرتره و ساخت تصاویر سهبعدی عملکرد بهتری دارد. همچنین این مدل میتواند خروجیهای تجاری و فوتورئالیستی صیقلخوردهتری تولید کند و در کاربردهای مرتبط با محصول، برندسازی و تولید تصاویر سینمایی نتایج قدرتمندتری ارائه دهد.
02
از 02استفاده آسانتر از چند تصویر مرجع و کنترل بیشتر بر خروجی
براساس اعلام مایکروسافت و به نقل از نئووین، مدل جدید کار با چند تصویر مرجع را برای کاربران سادهتر میکند و از قابلیت زمینهسازی دقیقتری بهره میبرد. همچنین این مدل کنترل بیشتری بر فرایند استدلال، قالب خروجی و وضوح تصویر در اختیار کاربران قرار میدهد. مایکروسافت قصد دارد طی هفتههای آینده جزئیات بیشتری درباره این مدل منتشر کند.
کاربران علاقهمند میتوانند برای تولید تصویر، مدل MAI-Image-2.6 را در Arena امتحان کنند. مایکروسافت در ادامه همین هفته عرضه این مدل را برای MAI Playground، Microsoft Foundry و دیگر محصولات و سرویسهای خود آغاز خواهد کرد.

















