Moonshot AI、Kimi K3をオープンウェイト化 Hugging Faceなどで配布
中国のMoonshot AIは、2.8兆パラメーターの「Kimi K3」を公開した。外部開発者はモデルをダウンロードし、自前の環境で動かしたり、追加学習などで用途に合わせて調整したりできる。
本ページでは「大規模言語モデル」をテーマとした記事を一覧で掲載しています。
中国のMoonshot AIは、2.8兆パラメーターの「Kimi K3」を公開した。外部開発者はモデルをダウンロードし、自前の環境で動かしたり、追加学習などで用途に合わせて調整したりできる。
アリババは2026年7月19日(中国時間)、Qwen3.8-Max-Previewの先行提供を始めた。第一財経によると、Alibaba Cloudは2.4兆パラメーターのモデルで、正式版の公開とオープンウェイト化を予告している。
富士通は2026年6月24日、LLM向け新アーキテクチャ「PHOTON」を開発したと発表した。PHOTONは「Parallel Hierarchical Operation for TOp-down Networks」の略称で、Transformer比でGPUリソース当たり最大475倍のマルチクエリー性能を示し、生成AIの運用コスト削減を狙う。
米スタンフォード大の「AI Index」2025年版は、Epoch AIの推計を引用し、公開された人間生成テキストを中心とする学習データの有効ストックが2026年から2032年の間にフル活用される可能性があると整理した。これはインターネット上の文章が物理的になくなるという意味ではなく、大規模言語モデルを現在のペースで大型化する際に、学習に使える公開データの余地が逼迫するということだ。性能向上を支え…
医学書院、NTT、NTTドコモビジネスの3社は4月16日、純国産の医療AI情報プラットフォームの共同開発に向けた協業に合意したと発表した。医学書院が保有する医療情報と、NTTの大規模言語モデル「tsuzumi 2」を組み合わせ、科学的根拠に基づく回答を返す基盤の構築を進める。
メタ・プラットフォームズは米国時間4月8日(日本時間9日)、AIモデル「Muse Spark」を発表した。公式発表では、Meta Superintelligence Labs(MSL)が構築した新しい大規模言語モデル群の第1弾として公表し、公開時点でMeta AIアプリとmeta.aiの基盤として稼働している。Metaは米国で新しいAI体験の提供を始め、今後数週間で主要サービスやAIグラスにも広げ…
米AI開発大手Anthropicのダリオ・アモデイCEOが、主力モデル「Claude」をめぐり、AIに意識がないと断言する段階ではないとの見方を示した。2026年2月の米メディアのインタビューで、現在の大規模言語モデルに人間のような意識が確認されたわけではないとしつつも、可能性を頭から排除すべきではないと発言した。生成AIを巡る議論が性能や安全性から、倫理や権利の扱いにまで広がっていることを映す発…
日立製作所の内藤健太研究員、芹澤靖隆主任研究員、松本久功部長らが、AI向け半導体の回路設計をAIに下書きさせる試作システムを開発した。大規模言語モデル(LLM)にAIモデルの形式情報を与えて回路コードを生成し、回路評価ツールで性能を測って修正を繰り返す。20回の試行で、効率を約2割高めたコードが得られたという。基礎検証の段階だが、設計現場の時間の使い方を変える芽になりそうだ。
楽天グループが、生成AIの中核となる大規模言語モデル(LLM)「Rakuten AI 3.0」を開発し、近く発表する予定だ。学習規模の目安となるパラメータ数は約7000億で、楽天市場などのサービスに順次組み込み、日々の検索や案内の形を変える構えである。運用コストを同規模モデルより9割下げたという点が、普及の現実味を左右しそうだ。
デジタル庁は12月2日、行政向けAI基盤で使う国内開発の大規模言語モデル(LLM)の募集を始めた。 応募は2026年1月30日まで受け付け、人口減少で人手が細る行政の仕事をAIで補う狙いだ。 すでに庁内では生成AI環境「源内」が動き始めており、今回はそこに国産LLMを組み込む一歩となる。 国産モデルの採用は、現場と産業に何をもたらすのかを見ていく。
検索ボックスに質問を打ち込むと、画面の下に新しい答えがすっと現れる。その裏側で動き始めたのが、Googleが2025年11月18日(米国時間)に公開した最新AIモデル「Gemini 3」だ。検索だけでなくGoogle WorkspaceやAndroid、専用アプリまで、日常のあちこちに入り込みながら、より賢く動くアシスタントを目指している。
午前の気配は静かだったが、端末の通知だけが忙しく鳴った。リコーが金融業務特化型の大規模言語モデル(LLM)を打ち出したと伝えられている。700億パラメータ級の日本語モデルに金融文書で磨いた語彙と推論機能を重ね、国内ベンチマークで「GPT‑5と同等」と主張した格好だ。生成AIを社内に閉じて使いたい金融の現場にとって、オンプレミスで運用できる私有型の選択肢が現れた意味は小さくないと映る。
都市の喧騒が少し湿った空気を運ぶ夕刻、生成AIの進化がまた一段、現実に近づいた。中国のスタートアップ、DeepSeekが公開した実験的LLM「V3.2-Exp」は、長文処理の効率を高める新しい仕組みを備え、モデル運用のコスト構造を揺さぶっている。2025年9月29日の発表は、「次世代アーキテクチャに向けた中間的なステップ」と位置づけられ、各社の採用や連携を促す合図となったと映る。