さくらのクラウドで、3つの国内開発された大規模言語モデルの試用を開始、デジタル庁がガバメントAI「源内」用に評価

この記事はAIが元記事をもとに要約・生成したものです。内容の正確性や最新情報を確認する場合は、必ず元記事をご確認ください。

デジタル庁は、国内開発の3つの大規模言語モデルをさくらのクラウドで試用し、ガバメントAI「源内」の実装に向けた評価を開始した。現行のAWSやAnthropicのモデルと比較するA/Bテストを実施し、ユーザーの選択をもとに性能を評価する。2026年9月から11月にかけて複数回の実験を予定し、同年8月までに実験環境を構築する。公募により選定された7つのモデルの中から、今年度は5社の国産基盤モデルを試用する。この取り組みは行政業務の効率化や住民サービス向上を目的としており、大規模言語モデルの選定と活用が今後の政府AIの方向性に影響を与える要因となる。

記事を読んだ感想

A

さくらのクラウドで国内開発のモデルが試用されるなんて、すごいよね。(^_-)-☆ 行政の効率化が進んで、住民サービスも良くなるって聞くと、ワクワクしちゃうの。

B

そうねー。(^_-)-☆ 国内開発のモデルが活用できるって、技術の自立って意味でも嬉しいよね。でも、現行のAWSやAnthropicのモデルと比べるA/Bテストって、結構厳しい試練になるのかな?(-_-メ)

A

うんうん、でもユーザーの選択をもとに性能を評価するって、実際の使い勝手を重視しているんだよね。(^_-)-☆ 2026年8月までに実験環境を構築するって、準備がしっかりしている気がする。

B

確かに。7つのモデルから5社を選定するって、公募で選定したってことは、信頼性もあるよね。(;^_^A ただ、国内開発のモデルが本当に現行モデルと比べて優れているかどうか、結果次第だよね。

A

でも、行政業務の効率化や住民サービス向上のためにこの取り組みを始めたんだから、きっと何かいい結果が生まれるはずだよ。(^_-)-☆ 大規模言語モデルの選定が今後の政府AIの方向性に影響するって、楽しみだね。

B

うんうん、でも実験が複数回行われるってことは、うまくいかなかった場合の修正の余地もあるってことかな?( ;∀;) ただ、モデルの性能が期待通りにいかなかったら、また一からやり直しになるかもしれないけど。

A

でも、ガバメントAI『源内』って名前、なんか和みますよね。(^_-)-☆ 『源内』って、江戸時代の役人みたいで、ちょっとノスタルジックな気分になる。

B

あはは、源内って名前、なんかAIのイメージとちょっとかけ離れてるよね。(-_-メ) でも、そんな名前で国民に親しまれたら、結果的にうまくいくかもしれない。

A

そうねー。(^_-)-☆ 今後、国内の技術が世界に通用するようになることを願って、このプロジェクトを応援したいです。

B

うんうん、でももし『源内』がうまくいかなかったら、次は『源外』って名前にするのかな?(;^_^A

キーワード: IT技術ブログ, Publickey, さくらのクラウドで、3つの国内開発された大規模言語モデルの試用を開始、デジタル庁がガバメントAI「源内」用に評価