Microsoftは7月23日(現地時間)、最新の生成AIモデル「MAI-Image-2.5-Pro」および「MAI-Voice-2-Flash」を一般公開した。
MAI-Image-2.5-Proは高品質な画像生成や編集、画像内のテキスト精度を大きく向上させ、自然言語での編集指示にも対応した。主に高精細な画像表現や、きめ細かな編集、テキストレンダリングに最適化されており、画像入力100万トークンあたり8ドル、出力100万トークンあたり106ドルで提供される。
一方、MAI-Voice-2-Flashは、音声生成のスピードと大規模対応を重視したモデルで、従来比2倍の高速化、32%のコスト削減を実現している。価格は100万文字あたり15ドル。自然な音声表現と抑揚を維持しつつ、Azure Voice LiveやDynamics 365 Contact Centerへの適用が進む。
これらのモデルはBing Image Creator、PowerPoint、OneDriveなど既存のMicrosoft製品にも導入されており、画像編集の効率化や音声サービスのコスト削減に寄与している。
- 関連リンク
この記事は参考になりましたか?
- この記事の著者
-
CodeZine編集部(コードジンヘンシュウブ)
CodeZineは、株式会社翔泳社が運営する開発者のための情報メディアです。日々の開発に取り組むエンジニアやテクノロジーを学びたい方に向けて、プログラミングやAI活用、開発ツール、エンジニアの学びとキャリアに関する記事をお届けしています。
※プロフィールは、執筆時点、または直近の記事の寄稿時点での内容です
この記事は参考になりましたか?
この記事をシェア
