中国ムーンショットAIのキミk3。/聯合ニュース

オープンAIとAnthropicの人工知能(AI)モデルが一部の作業で中国のオープンウェイト(重み開放型)AIモデルより実際の利用コストが安いという研究結果が出たと、ザ・インフォメーションが13日(現地時間)に報じた。

AI基盤の検索・市場調査企業アルファセンスは今月初め、オープンAIとAnthropicのクローズドモデルが一部の作業で中国のオープンウェイトモデルより低コストでより良い回答を示したという研究結果を公表した。

アルファセンスは決算発表文・投資家向けカンファレンスコールの書き起こし・証券申告書などを活用した金融分析の質問245件で、9つのモデルの回答品質とコストをテストした。

その結果、オープンAIの「GPT-5.6 Sol」とAnthropicの「Opus 4.8」が、中国Moonshotの「Kimi K3」、ズフー(現Z.ai)の「GLM-5.2」より少ないコストでより高品質の回答を出した。

一般的にトークン価格だけ見れば中国モデルの方が安い。出力トークン100万個当たりKimi K3は15ドル、Opus 4.8は25ドル、GPT-5.6 Solは30ドルである。

しかしKimi K3はトークン単価は低い一方で、回答を生成するのにより多くのトークンを消費する。このため質問1件当たりの実際の総コストはかえってGPT-5.6 Solより高かったというのがアルファセンスの説明である。

GPT-5.6 Solの中央値の総コストはKimi K3より13%低く、品質スコアは20%高かった。Opus 4.8はKimi K3の半分のコストで品質スコアが13%上回った。ズフーのGLM-5.2はコストがKimi K3の約2倍だったにもかかわらず、品質はより低かった。

今回の研究は先月Kimi K3が一部ベンチマークで米国のクローズドAIモデルに匹敵する性能を示し、オープンAIとAnthropicの価格競争力が弱まる可能性があるとの見方が出る中で公開された。

ジャック・ココ・アルファセンス最高経営責任者(CEO)は「トークン当たりの価格だけを見ると高く見えるモデルが、実際にはトークンをより効率的に使ってコストが抑えられることが分かった」と語った。

先月末、ブレット・テイラー・オープンAI取締役会議長はCNBCとのインタビューで、最上位級モデルは質問に答えたり課題を遂行したりする際にトークンをより少なく使うため、オープンソースモデルより安価で効率的だと明らかにしたことがある。

ただし評価手法によって結果は変わりうる。AIモデル分析企業アーティフィシャル・アナリシスは、同一の基準で比較した場合、Kimi K3とGLM-5.2のコストが米国モデルよりはるかに安いと評価した。どの作業を対象にし、コストをどのように算定するかによって、モデルの価格競争力に関する結論は変わりうるということだ。

ココCEOは、理想的なアプローチは複数のモデルを混用することだと述べた。アルファセンスも実際に自社の検索サービスでこの原理を適用している。質問の性質に応じ、計画立案には性能が高いモデルを、実行には安価なモデルを割り当てる自社ハーネス(エンジン)でコストを下げる方式である。

※ 本記事はAIで翻訳されています。ご意見はこちらのフォームから送信してください。