SHOEISHA iD

※旧SEメンバーシップ会員の方は、同じ登録情報(メールアドレス&パスワード)でログインいただけます

DeveloperZine(デベロッパージン)- エンジニアの意思決定を支える技術情報メディア ProductZine

CodeZine編集部では、現場で活躍するデベロッパーをスターにするためのカンファレンス「Developers Summit」や、エンジニアの生きざまをブーストするためのイベント「Developers Boost」など、さまざまなカンファレンスを企画・運営しています。

CodeZineニュース

Inception、高性能な拡散言語モデル「Mercury 2.5」リリース

 米Inceptionは、9月8日、高性能な拡散言語モデル「Mercury」の最新版「Mercury 2.5」をリリースした。

 Mercury 2.5は、低遅延・低コストなサービスプロファイルはそのままに、Mercury 2と比較して品質が大幅に向上している。知能が40%向上し、GPT-5.6 Luna(Low)、Gemini 3.5 Flash-Lite、Claude Haiku 4.5といったコスト最適化された最先端モデルに匹敵するという。

 NVIDIA製GPUで毎秒1107トークンという高速処理を実現しつつ、26万トークンの大容量コンテキストに対応している。推論の深さ(強度)の調整機能や並列ツール呼び出し、スキーマ準拠のJSON出力といった機能も備える。

 価格は、入力トークン0.20ドル/100万、出力トークン0.75ドル/100万。発売初期は入力0.04ドル・出力0.15ドル(100万トークンあたり)で導入可能。

 Mercuryはすでに多くの企業の本番環境で活用されている。例えば、検索プランの作成やクエリの書き換えといった、複雑なモデル呼び出しがトリガーされる検索エージェントやRAGにおいても、Mercuryは呼び出しを高速化し、単一のユーザー操作内で処理を完了させる。また、顧客からの電話をリアルタイムで処理するAI電話エージェントにおいて、Mercuryはモデルの応答遅延の中央値を約170ミリ秒まで短縮したという。

 Mercuryモデルは、Inception API、Baseten、およびOpenRouterを通じて利用可能。エンタープライズ向け導入では、専用容量、自動スケーリング、コンプライアンス管理などがサポートされる。詳細はブログポストを参照のこと。

関連リンク

この記事は参考になりましたか?

この記事の著者

CodeZine編集部(コードジンヘンシュウブ)

CodeZineは、株式会社翔泳社が運営する開発者のための情報メディアです。日々の開発に取り組むエンジニアやテクノロジーを学びたい方に向けて、プログラミングやAI活用、開発ツール、エンジニアの学びとキャリアに関する記事をお届けしています。

※プロフィールは、執筆時点、または直近の記事の寄稿時点での内容です

この記事は参考になりましたか?

この記事をシェア

CodeZine(コードジン)
https://codezine.jp/news/detail/29654 2026/09/11 08:00

イベント

CodeZine編集部では、現場で活躍するデベロッパーをスターにするためのカンファレンス「Developers Summit」や、エンジニアの生きざまをブーストするためのイベント「Developers Boost」など、さまざまなカンファレンスを企画・運営しています。

新規会員登録無料のご案内

  • ・全ての過去記事が閲覧できます
  • ・会員限定メルマガを受信できます

メールバックナンバー