NaiveAI、3090億パラメーター「Naive-N0.5-Flash」公開 AIも開発工程に参加

NaiveAI、3090億パラメーター「Naive-N0.5-Flash」公開 AIも開発工程に参加

※記事を視覚化したイメージであり、実際の事象とは異なります。

本サイトの記事や画像は、AIが公的資料や複数の報道を基に事実関係を整理・再構成し制作したものです。[続きを表示]特定の報道内容や表現を再利用・要約することを目的としたものではありません。ただし、誤りや不確定な情報が含まれる可能性がありますので、参考の一助としてご覧いただき、実際の判断は公的資料や各出典元の原文をご確認ください。[私たちの取り組み]

NaiveAIは、大規模AIモデル「Naive-N0.5-Flash」の重みを公開した。総パラメーター数は3090億で、100万トークンの文脈に対応する。同社は2026年9月27日付の技術発表で、人間の研究者が方針や重要な判断を担い、AIモデルも設計案の探索や実験、開発作業に携わったと説明した。

長い文脈を扱うモデルの構成と学習

NaiveAIは、このモデルをコーディングとAI研究開発向けに位置付け、Xiaomiの「MiMo-V2.5」を基盤に用いたと説明している。MoE方式を採用し、総3090億パラメーターのうちトークン当たり155億が稼働する。モデル重みと推論コードはMITライセンスで公開している。

48層のうち39層には128トークン幅のスライディングウィンドウ注意機構、9層には必要な情報を選択するスパース注意機構を使う。全注意力層はないが、インデクサーは全履歴を走査し、KVキャッシュも保持する。構成変更後の学習量は計3兆2500億トークンで、500億、3兆、2000億トークンの3段階に分かれる。

AIが関わった開発工程と推論速度

同社によると、人間の研究者が技術方針や採用基準を定め、AIモデルがコード作成、実験、結果分析などを担当した。推論システム「NaiveRT」では6日間に151件の最適化を試し、63件を採用したという。

NaiveAIは、Standardモードで利用者当たり毎秒50トークン、Ultrafastモードで最大毎秒2000トークンと説明する。8基のGPUを使った単一系列では、ピーク毎秒2122トークンを記録したとしている。いずれも同社の測定値だ。

同社は100万トークン当たり入力0.10ドル、出力0.40ドル、キャッシュ読み取り0.01ドルのAPI料金を示している。公式サイトにはAPI Platformへの導線があるが、技術発表とモデルカードでは提供予定とされ、一般提供開始日は確認できない。

参考・出典

ニュースはAIで深化する—。日々の出来事を深掘りし、次の時代を考える視点をお届けします。

本サイトの記事や画像はAIが公的資料や報道を整理し制作したものです。
ただし誤りや不確定な情報が含まれることがありますので、参考の一助としてご覧いただき、
実際の判断は公的資料や他の報道を直接ご確認ください。
[私たちの取り組み]