GPT-4oを超えた日本語特化モデルが示す、AI国産化の現在地 2026年3月17日、楽天グループ株式会社は「Rakuten AI 3.0」の提供開始を発表しました。経済産業省と国立研究開発法人NEDO(新エネルギー・産業技術総合開発機構)が推進する「GENIACプロジェクト」の一環として開発されたこのモデルは、国内最大規模となる約7,000億パラメータを持つ大規模言語モデルです。複数の日本語ベンチマークテストでOpenAIのGPT-4oを上回るスコアを記録したことが発表されており、日本国内のAI開発競争において注目を集めています。
GENIACプロジェクトとは何か GENIACとは「Generative AI Accelerator Challenge」の略称で、経済産業省とNEDOが主導する日本の生成AI開発力を強化するための国家プロジェクトです。海外の大手テック企業が主導するAI開発に対して、日本独自の高品質な言語モデルを育てることを目的としており、民間企業の研究開発に対して計算資源の補助などを提供しています。楽天は2025年7月にGENIACの第3期公募に採択されており、今回の「Rakuten AI 3.0」の学習費用の一部もこの補助を受けています。
国内最大の7,000億パラメータとはどういう意味か パラメータとは、AIモデルが学習を通じて獲得する知識や判断基準の数を示す指標です。人間で言えば「脳内の神経接続の数」にたとえられることがあります。一般的に、パラメータが多いほどモデルの表現力や推論能力が高くなる傾向があります。楽天のAIモデルはこれまで「Rakuten AI 7B」(約70億パラメータ)、「Rakuten AI 2.0」(約470億パラメータ)と段階的に規模を拡大してきました。今回の「Rakuten AI 3.0」はその10倍以上となる約7,000億パラメータに達しており、日本の企業が独自開発したモデルとしては最大規模です。
Mixture of Expertsアーキテクチャの採用 「Rakuten AI 3.0」が採用するMixture of Experts(MoE)アーキテクチャは、近年の大規模言語モデルで注目されている設計手法です。モデル全体を複数の専門サブモデル(エキスパート)に分割し、各入力に対して最も適したエキスパートだけを選択的に動作させる仕組みになっています。7,000億というパラメータ数はモデル全体の合計ですが、実際の推論や学習時にはそのすべてが同時に動作するわけではありません。必要なエキスパートのみが起動するため、計算効率が大幅に向上します。大きな組織の中で専門家ごとに案件を振り分けるような仕組みと考えるとわかりやすいでしょう。この設計により、高い性能を保ちながら運用コストを抑えることが可能になります。
日本語ベンチマークでGPT-4oを上回った 今回の発表で特に注目されるのは、日本語に関する複数の評価指標で「Rakuten AI 3.0」がOpenAIのGPT-4oを上回った点です。具体的には、日本固有の文化や歴史に関する知識を問うJamC-QA、大学院レベルの推論能力を測るMMLU-ProX(日本語版)、競技レベルの数学問題を扱うMATH-100(日本語版)、指示への正確な追従能力を評価するM-IFEvalの4項目すべてで、GPT-4oのスコアを超えています。たとえばJamC-QAでは、Rakuten AI 3.0が76.9点に対してGPT-4oは74.7点です。MMLU-ProX(日本語)では71.7点対64.9点、数学問題のMATH-100では86.9点対75.8点と、特に数学・推論分野での差が顕著です。国内の他の競合モデルと比較しても、今回発表されたスコアは全項目で最高値を記録しています。
「ベンチマークで勝った」の重みと限界 今回の「Rakuten AI 3.0」発表は、単なる楽天のAI製品リリースにとどまらず、日本のAI産業が置かれている現状と今後の可能性を考える上で、重要な論点を含んでいると思われます。 GPT-4oを上回ったという数字は確かに印象的です。しかし、AIモデルの評価において、ベンチマークスコアはあくまで一側面にすぎません。実際に企業のシステムや個人のワークフローに組み込んだとき、回答の自然さ、安全性、応答速度、コストなど、スコアには表れにくい要素が使い勝手を左右します。特に今回採用された評価指標は日本語に特化したものが中心であり、英語を含む汎用性や、実業務での応用という観点からの比較はまだ十分に公開されていません。「日本語の理解力」という切り口での優位性は本物と見てよいと思いますが、それがあらゆる場面での実用性の高さを意味するわけではないことは念頭に置いておく必要があります。ベンチマークの種類の選定自体が発表者の意図を反映しやすいという点も、冷静に受け止めたいところです。
今後への期待と注視すべき点 「Rakuten AI 3.0」の登場は、日本がAI開発において海外依存から脱却しようとする動きの中で、民間企業が果たし得る役割の大きさを改めて示すものです。GENIACという政策的な後押しを得ながらも、楽天独自のデータ資産と技術力を組み合わせたこのモデルが、実際のサービスや社会にどれほどの変革をもたらすか、これから具体的な成果が問われる段階に入ります。スコア上の優位性が実用上の差別化につながるかどうか、オープンソース公開を通じた開発コミュニティの形成が実際に機能するかどうか、そして楽天モバイルやFinTechなどの既存サービスとの統合がどのような形で進むかという3点が、今後の進展を見極める上での重要な判断軸になるでしょう。日本のAI産業の岐路を示す一里塚として、「Rakuten AI 3.0」は注視し続ける価値があるモデルです。
楽天、「GENIACプロジェクト」の一環として開発された国内最大規模の高性能AIモデル「Rakuten AI 3.0」を提供開始
楽天、「GENIACプロジェクト」の一環として開発された 国内最大規模の高性能AIモデル「Rakuten AI 3.0」を提供開始 | 楽天グループ株式会社 楽天グループ株式会社(以下「楽天」)は、経済産業省および国立研究開発法人新エネルギー・産業技術総合開発機構(以下「NEDO」)が推進する日本の生成AIの開発力強化を目的としたプロジェクト「GENIAC(Generative AI Accelerator Challenge)プロジェクト」(以下「GENIAC」)の一環として開発した国内最大規模(注1)の最新A…