Microsoft MAI-Image-2.6 вийшов на друге місце у рейтингу Text-to-Image Arena, поступившись лише моделі GPT-Image-2 від OpenAI. Редакція сайту Realnist повідомляє про це з посиланням на офіційне повідомлення Microsoft AI та актуальний рейтинг Arena. Microsoft представила нову версію моделі 10 серпня 2026 року, заявивши про поліпшення якості генерації тексту всередині зображень, портретів, тривимірної графіки, рекламних матеріалів і фотореалістичних сцен.
За даними Arena станом на 10 серпня, MAI-Image-2.6-preview отримав 1336±11 бала і посів другу позицію серед 77 моделей. Перше місце займає GPT-Image-2 (medium) від OpenAI із результатом 1381±5, а третє — Grok Imagine Image 2.0 (low) із 1316±12. На момент зафіксованого рейтингу за MAI-Image-2.6 було віддано 3488 голосів, тоді як загальна кількість голосів у Text-to-Image Arena перевищила 5,9 млн.
Таким чином, нова модель Microsoft випередила в загальному рейтингу рішення xAI, Meta, Google, ByteDance, Alibaba, Ideogram та низки інших розробників.
MAI-Image-2.6 отримала суттєвий приріст у рейтингу Arena
Microsoft заявляє, що MAI-Image-2.6 принесла ще один значний стрибок для сімейства MAI-Image. За даними компанії, нова версія додала 79 балів Elo порівняно з MAI-Image-2.5, а результат у категорії відтворення тексту всередині зображень зріс на 91 бал. Компанія також повідомила про покращення в усіх категоріях Text-to-Image Arena, які враховувалися під час оцінювання.
Актуальна версія таблиці Arena показує такий розподіл у верхній частині рейтингу:
- 1 місце — GPT-Image-2 (medium), OpenAI: 1381±5 бала;
- 2 місце — MAI-Image-2.6-preview, Microsoft AI: 1336±11;
- 3 місце — Grok Imagine Image 2.0 (low), xAI: 1316±12.
Далі розташувалися Reve 2.1 із 1302±8 бала, Muse Image від Meta із 1282±7 та Reve 2.0 із 1270±6. Gemini 3.1 Flash Image, який у рейтингу також позначений як Nano Banana 2, має 1264±5 бала та перебуває на сьомій позиції.
Попередня модель Microsoft MAI-Image-2.5 у цьому ж актуальному рейтингу займає десяте місце з результатом 1256±4. Ще старіша MAI-Image-2 перебуває на 19-й позиції з 1183±5, а MAI-Image-1 — на 53-й із результатом 1093±4.
Керівник Microsoft AI Мустафа Сулейман окремо звернув увагу на позицію нової моделі в Arena.
“MAI-Image-2.6 is now the #2 text-to-image model in the world.”
(Мустафа Сулейман, керівник Microsoft AI, у дописі в X 10 серпня 2026 року).
У тому ж повідомленні він зазначив, що модель випередила Nano Banana, Meta та Grok, і запропонував користувачам протестувати її безпосередньо в Arena.
Що покращили в Microsoft MAI-Image-2.6
Microsoft називає кілька основних напрямів, де MAI-Image-2.6 отримала покращення порівняно з попереднім поколінням. Йдеться не лише про загальний рівень деталізації зображень, а й про конкретні сценарії генеративної графіки.
Серед заявлених змін:
- точніше відтворення тексту всередині згенерованих зображень;
- краща генерація портретів та 3D-графіки;
- якісніші комерційні, продуктові, брендингові, фотореалістичні та кінематографічні зображення.
Окремо Microsoft вказує на роботу з кількома референсними зображеннями, розширені можливості grounding та більший контроль над параметрами reasoning, форматом і роздільною здатністю результату. Детальнішу інформацію про ці функції компанія планує розкрити окремо.
“Stronger text rendering. Better portraits and 3D imagery.”
(Microsoft AI, опис ключових покращень MAI-Image-2.6 у повідомленні про реліз від 10 серпня 2026 року).
Для генеративних моделей коректна робота з написами залишається одним із практично важливих напрямів, особливо під час створення дизайнів, рекламних матеріалів, брендингу, презентацій та продуктової графіки.
Цей напрям Microsoft послідовно розвивала й у попередніх поколіннях MAI-Image. Під час презентації MAI-Image-2 у березні компанія окремо наголошувала на генерації тексту всередині зображень — від написів на плакатах до інфографіки, схем і слайдів.

Як розвивався генератор зображень Microsoft
Перша власна модель серії, MAI-Image-1, була представлена Microsoft 13 жовтня 2025 року. Компанія називала її своїм першим генератором зображень, повністю розробленим усередині Microsoft, і повідомляла про дебют у першій десятці Text-to-Image Arena. Arena також зафіксувала додавання MAI-Image-1 до відповідного рейтингу в жовтні 2025 року.
19 березня 2026 року Microsoft представила MAI-Image-2. Компанія повідомила, що сімейство моделей увійшло до трійки найкращих у Arena. Основний акцент тоді робився на фотореалізмі, природному освітленні, точних відтінках шкіри, генерації читабельного тексту та створенні складних деталізованих сцен.
У червні з’явилася MAI-Image-2.5, створена для генерації та контрольованого редагування зображень. Microsoft повідомляла, що модель увійшла до топ-3 як у Text-to-Image, так і в Image Edit Arena. В окремому рейтингу редагування зображень MAI-Image-2.5 на момент запуску посіла друге місце.
Наступним етапом стала MAI-Image-2.5-Pro, представлена 23 липня. Microsoft позиціонувала її як модель для сценаріїв, де пріоритетом є максимальна якість: складного редагування, деталізованих зображень і точного відтворення написів. На момент релізу версія Pro була доступна в Microsoft Foundry у статусі public preview.
Про роботу попереднього покоління з комерційною графікою глобальний креативний директор WPP Роб Рейлі говорив:
“Beyond the impressive image quality, its ability to render text with this kind of accuracy is a real breakthrough.”
(Роб Рейлі, Global Chief Creative Officer WPP, у коментарі Microsoft щодо MAI-Image-2.5-Pro, 23 липня 2026 року).
Де вже використовуються моделі MAI-Image
Microsoft поступово інтегрує власні генеративні моделі у свої продукти. У липні компанія повідомила, що MAI-Image-2.5 стала моделлю за замовчуванням для Bing Image Creator, де забезпечує як генерацію, так і редагування зображень.
MAI-Image-2.5 також була запущена у виробничому середовищі PowerPoint для сценаріїв image-to-image. За даними Microsoft, використання власної моделі там дозволило зменшити витрати GPU до 84% порівняно з GPT-Image-2. Крім того, MAI-Image-2.5 стала моделлю за замовчуванням для ключових сценаріїв редагування зображень у OneDrive.
Microsoft повідомляла, що після впровадження MAI-Image-2.5 в OneDrive частота збереження результатів користувачами зросла на 26%, P95 latency скоротилася приблизно на 25%, а ефективність за середнього виробничого навантаження збільшилася у 2,5 раза.
Коли MAI-Image-2.6 стане доступною
На момент презентації Microsoft відкрила MAI-Image-2.6 для генерації зображень у Text-to-Image Arena, де модель уже можна випробувати у прямому порівнянні з конкурентами.
За планом компанії, подальше розгортання відбуватиметься у кілька етапів:
- MAI-Image-2.6 має з’явитися в MAI Playground протягом тижня після презентації;
- після цього Microsoft планує розгортання моделі в Microsoft Foundry та інших продуктах компанії.
На 10 серпня 2026 року Arena оцінювала MAI-Image-2.6 як другу за результатом text-to-image модель серед 77 представлених систем. Вище перебувала лише GPT-Image-2 (medium) від OpenAI, тоді як найближчими переслідувачами Microsoft були Grok Imagine Image 2.0, Reve 2.1 і Muse Image від Meta.
Читайте також: Meta змінює підхід до ШІ: Цукерберг представив маніфест про суперінтелект