サイバーエージェントは、中国のDeepSeekがオープンソースで公開した、大規模言語モデル「DeepSeek-R1-Distill-Qwen-14B/32B」をベースに、日本語データで追加学習を行った言語モデル「DeepSeek-R1-Distill-Qwen-32B-Japanese」を、Hugging Faceにて1月27日に公開した。
DeepSeek R1は、中国のDeepSeekによって開発され、オープンソースで公開されている大規模言語モデル(LLM)。
今回、サイバーエージェントが公開したDeepSeek-R1-Distill-Qwen-32B-Japaneseは、このDeepSeek R1をベースに日本語データを用いた追加学習によって微調整が行われており、MITライセンスで公開されている。
この記事は参考になりましたか?
- この記事の著者
-
CodeZine編集部(コードジンヘンシュウブ)
CodeZineは、株式会社翔泳社が運営する開発者のための情報メディアです。日々の開発に取り組むエンジニアやテクノロジーを学びたい方に向けて、プログラミングやAI活用、開発ツール、エンジニアの学びとキャリアに関する記事をお届けしています。
※プロフィールは、執筆時点、または直近の記事の寄稿時点での内容です
この記事は参考になりましたか?
この記事をシェア
