近期,Microsoft AI 於自家部落格上宣布,旗下最新一代影像生成模型「MAI-Image-2.6」在權威的 Arena 文字生成影像(Text-to-Image)排行榜中榮獲全球第二名,成績一舉超越 Google、Meta 及 xAI 等競爭對手的同類產品,目前僅次於居首的 OpenAI「GPT-Image-2」。
整體評分大躍進,文字渲染單項表現呈突破性升級
相較於前代 MAI-Image-2.5,新模型在整體 Elo 評分上大幅躍升了 79 分,並於 Arena 評測的所有圖像生成類別中展現出全面性的品質提升;其中,解決傳統 AI 繪圖痛點的「文字渲染(Text Rendering)」單項表現更是一舉衝高 91 Elo 分。
參照 Arena 8 月初的歷史榜單,MAI-Image-2.5 先前僅位居第六,本次 2.6 版本的強勢躍升,標誌著微軟在影像生成技術上與 OpenAI 的差距已顯著縮小。
縱觀 MAI-Image 系列的迭代歷程,微軟展現出極為扎實且穩健的技術演進軌跡:
- MAI-Image-1:成功奠定家族模型架構基礎。
- MAI-Image-2:在照片真實感(Photo-realism)與文字渲染精準度上大飛升。
- MAI-Image-2.5:全面向專業級影像創作與修圖編輯能力推進。
- MAI-Image-2.6:延續強勁動能,在文字渲染、人像雕琢、3D 質感,以及涵蓋商業與影像設計等專業輸出,進一步提升。
貫徹自研模型戰略,全面注入 Microsoft 生態系
微軟同步透露,MAI-Image-2.6 未來將支援多參考圖輸入、更強大的圖文對齊與空間定位(Grounding)能力,並賦予使用者對推論邏輯、輸出格式與解析度具備更嚴密的掌控力,相關技術細節將於近日陸續揭曉。
這項部署策略與微軟上個月發表 MAI-Image-2.5-Pro 時的佈局一脈相承,再次印證了微軟「以自研核心模型全面驅動自有產品生態系」的戰略藍圖——從 Bing Image Creator 到 PowerPoint 等主力工具,皆已逐步切換至 MAI 系列模型。
目前,全球使用者與開發者已可在 Arena 平台上實機體驗 MAI-Image-2.6 的生成效果。微軟預計於本週稍晚將其正式導入 MAI Playground,隨後也將陸續推廣至 Microsoft Foundry 平台及其他微軟企業級產品線中。
|