フラッシュ2023年7月25日
-
東大発スタートアップ、67億パラメーターの日本語LLMをOSSで公開
by MITテクノロジーレビュー編集部 [MIT Technology Review Japan]東京大学発のスタートアップ企業であるLightblue(ライトブルー)は、公開モデルとしては国内最大規模の67億パラメーターの日本語大規模言語モデルを開発し、オープンソース・ソフトウェアとして公開した。ライセンスはApache 2.0。
この言語モデルは、米モザイクML (MosaicML)が公開した多言語大規模言語モデル「MPT-7B」を基にしたもの。グーグルが開発した多言語データセット「MC4」をアレン人工知能研究所(Allen Institute for AI)がそれぞれの言語ごとに利用可能にしたサブセットの日本語部分を使って追加学習した。
Lightblueは、今回公開したモデルを法人向けに提供する。業界用語や部署特有の専門用語、慣習などに合わせて訓練・調整することで、企業や部署によって異なる要望に応じるという。加えて、自社サービスの提供も予定しているとのことだ。
(笹田)
-
- 人気の記事ランキング
-
- One option for electric vehicle fires? Let them burn. EV電池火災、どう対応?「燃え尽きるまで待つしかない」と専門家
- Promotion Innovators Under 35 Japan × CROSS U 好評につき第2弾!研究者のキャリアを考える無料イベント【3/14】
- One option for electric vehicle fires? Let them burn. EV電池火災、どう対応?「燃え尽きるまで待つしかない」と専門家
- How Silicon Valley is disrupting democracy テックラッシュ時代の到来、 「シリコンバレー流」が 本当に破壊したもの
- The AI relationship revolution is already here 始まったAI人間関係革命、 世界の「普通の人」は どう使っている?