Moonshot AIが2.8兆パラメータのオープンモデル「Kimi K3」を公開、Arenaのコード部門でClaude Fable 5を上回り首位に

  • URLをコピーしました!

中国のMoonshot AIは2026年7月16日、大規模言語モデル「Kimi K3」を発表しました。総パラメータ数は2.8兆で、同社は世界初の3兆パラメータ級オープンモデルと位置づけています。コーディング性能を評価するArena.aiのフロントエンドコード部門では、Claude Fable 5やGPT-5.6 Solを抑えて首位に立ちました。現時点で使えるのはAPIとアプリ経由のみで、モデル本体のデータ(ウェイト)をダウンロードして自前の環境で動かせるようになるのは7月27日までの予定です。

運営者情報
AI JOURNALは一般社団法人 日本AI導入支援協会が運営する、日本企業のAI活用支援を目的としたメディアです。記事制作にあたっては、経済産業省「AI事業者ガイドライン」をはじめとする公的機関の公表情報等を参考にしています。内容の正確性には十分配慮していますが、誤りや更新漏れがある場合は、お問い合わせフォームよりご連絡ください。掲載情報は公開日時点のものであるため、最新情報は公式サイト等でご確認ください。

【日本AI導入支援協会からのお知らせ】 昨今、補助金・助成金の不正受給を持ちかける悪質な業者が増加しています。補助金・助成金の不正受給にご注意ください →

目次

Kimi K3の構成と公開スケジュール

Moonshot AI公式ブログ Kimi K3発表ページ
出典: Moonshot AI公式ブログ

Kimi K3は、896個のエキスパートのうち各トークンで16個だけを動かすMixture-of-Experts(MoE)構成を採用します。基盤には線形アテンションを組み合わせたKimi Delta Attention(KDA)を用い、画像を直接扱うネイティブなマルチモーダル対応と、100万トークンの文脈長を備えます。総パラメータ2.8兆という規模は、これまで一般公開されたオープンウェイトモデルとして最大です。

APIの利用料金は、入力が100万トークンあたり3ドル(キャッシュ利用時は0.3ドル)、出力が100万トークンあたり15ドルです。中国のAIラボが公開したモデルとしては高めの水準で、AnthropicのClaude Sonnet 5(入力3ドル、出力15ドル)と同じ価格設定です。モデルのウェイト自体は7月27日までに公開予定で、公開時点ではAPIとKimiアプリ、コーディング向けのKimi Codeを通じて利用できます。

Arenaのコード部門で首位、総合では3位

Kimi K3が首位を取ったのは、開発者がブラインドで出力を評価するArena.aiのフロントエンドコード部門です。スコアは1679点で、前世代のKimi K2.6が記録した1515点(18位)から17ランク上昇しました。有効投票数は1757件で、7つのフロントエンド領域のうち6領域で1位、ゲーミングのみClaude Fable 5に次ぐ2位でした。

モデル フロントエンドコード部門スコア 順位
Kimi K3 1679 1位
Claude Fable 5 1631 2位
GPT-5.6 Sol 1618 3位
Arena.ai フロントエンドコード部門スコア比較

一方で、総合的な能力を測る評価ではKimi K3の順位は3位にとどまります。Moonshot AI自身が示したベンチマークでも、Claude Fable 5とGPT-5.6 Solの2モデルには及ばないと説明されており、フロントエンドのコード生成という特定領域で最上位に立った形です。分析会社Artificial Analysisの非公開評価「AA-Briefcase」では、Elo1547でClaude Fable 5に次ぐ2位につけています。

オープンモデル最大規模がもたらす意味

米国が先端半導体の輸出を制限するなかで、中国のAI開発が米国勢との差を詰めつつあることを示す発表になりました。発表前のTechCrunchの報道は、Kimi 3がAnthropicのOpus 4.8に肩を並べる水準になると見込んでいましたが、公開されたKimi K3はコード領域で最新のClaude Fable 5を上回るスコアを記録しました。

ウェイトが公開される点も注目されます。フロンティア級とされるモデルの多くはクローズドで提供されるのに対し、Kimi K3は誰でもウェイトをダウンロードして自前の環境で動かせるため、研究や企業導入の裾野を広げる可能性があります。ClaudeやGPTといった商用モデルとの性能差が特定領域で縮まったことで、オープンモデルを選択肢に含める動きが今後強まるとみられます。なお、現時点の性能評価はMoonshot AI自身の発表とArenaのスコアに基づくものです。7月27日までにウェイトが公開されれば、第三者が実際に動かして性能を検証できるようになります。ベンチマークどおりの実力かどうかは、その検証結果を待つ必要があります。

参考

AI研修・人材育成支援 サービス資料

無料ダウンロード資料

AI研修・人材育成支援 サービス資料

研修プログラムの対象範囲、カリキュラム例、料金、導入までの流れをまとめたサービス資料です。社内のAI活用を体系立てて進めたい企業向けにまとめています。

資料をダウンロードする

発行:一般社団法人日本AI導入支援協会(J-AIX)

  • URLをコピーしました!

author

AI JOURNAL編集部は、一般社団法人日本AI導入支援協会が運営する、AI活用に挑戦するビジネスパーソンを応援するメディアチームです。編集部の運営体制・編集方針はこちら

コメント

コメントする


目次