微軟在必應和Copilot推出MAI-Image-1 AI影像產生器
微軟首款自主研發的AI影像產生器MAI-Image-1現已推出。您可以在Bing Image Creator和Copilot Audio Expressions中試用。目前,除歐盟以外,所有支援這些服務的國家/地區均可使用。

在必應上,您可以在bing.com/create、行動應用程式或搜尋欄中找到它。它是模型清單中的選項之一,與 DALL-E 3 和 GPT-4o(均來自 OpenAI)並列。同時,在Copilot上,它現在是故事模式的一部分。 MAI-Image-1 會將您的故事錄製成音訊表達。
該模型於10月13日發布,並在LMArena的十大文字轉圖像模型排名中亮相。 LMArena是一個人工智慧效能基準測試平台,使用者可以在該平台上根據輸出結果比較和評估大型語言模型(LLM)。 MAI-Image-1目前在該排名中排名第九,與Seedream 3並列。
微軟人工智慧部門表示,開發人員“優先考慮準確的數據選擇和嚴格的、以任務為中心的評估,以緊密反映現實世界的創意用例——同時考慮創意行業專業人士的反饋。該模型旨在提供真正的靈活性、視覺多樣性和實用價值。”
您可以在微軟人工智慧部落格上找到許多範例。

總的來說,這是一個以創作者需求為優先的生成器。它避免了低品質原型製作中常見的陷阱,例如通用或重複的設計。
MAI-Image-1 專門用於產生高度逼真的影像。它可以快速渲染資源密集設計,例如精細的地形和逼真的光照效果,包括反射和漫射光。大多數其他AI 工具要么難以勝任這些任務,要么速度相對較慢。
微軟目前正在建立自己的人工智慧模型。
有趣的是,此次亮相再次顯示微軟正逐漸與OpenAI保持距離。微軟曾為OpenAI在業界建立聲譽發揮了重要作用。但如今,微軟已將大部分人工智慧研發工作轉向內部,而OpenAI則與其他合作夥伴進行更廣泛的合作。
今年8月,微軟人工智慧發布了其首批兩款內部人工智慧模型:MAI-Voice-1和MAI-1-preview。 MAI -Voice-1 是一款自然語音生成模型,可在 Copilot Labs、Daily 和 Podcasts 中使用。
此外,MAI-1-preview 是一個聊天機器人原型,最初計劃作為 Copilot 的一部分發布。然而,Copilot Chat 目前正在遷移到OpenAI 的GPT-5作為其主要支援的語言學習模型 (LLM)。它還將 Anthropic 的 Claude AI 添加為可選的輔助語言學習模型。
儘管微軟和 OpenAI 的關係有些緊張,但 MAI-Image-1 仍然是其 AI 工具包中令人興奮的新成員。如果您富有創意,並且需要源源不絕的逼真設計素材,那麼它或許值得您花時間去了解。現在就去 Bing 和 Copilot 上看看吧。
評論被關閉。