Anthropicのロゴ画像。/聯合ニュース

Anthropicが「コストパフォーマンス」を前面に押し出した新たな人工知能(AI)モデル「Claudeオ퍼ス5(Opus 5)」を公開した。

24日(現地時間)Anthropicによると、同社は公式ホームページを通じてオ퍼ス5を公開し、最上位の公開モデルである「페이블5」に近い性能をコスト半分の水準で提供すると明らかにした。オ퍼ス5はコーディングと知識業務など主要ベンチマークで既存の公開モデルを上回る性能を記録した。

エージェントのターミナル環境におけるコーディング能力を評価する「フロンティア・ベンチ v0.1」では43.3%を記録し、OpenAIのGPT-5.6 ソル(34.4%)と페이블5(33.7%)をいずれも上回った。知識業務能力を評価する「GDPval-AA v2」では1861点を記録し、エージェント検索性能の評価でも90.8%を記録して最高点を得た。

ただしエージェントのコーディング能力を評価する「딥SWE v1.1」では68.8%を記録し、GPT-5.6 ソル(72.7%)よりやや低かった。専門家水準の推論能力を評価する「人類の最後の試験(HLE)」では外部ツールを使用しない基準で56.3%を記録し、페이블5(56.5%)に僅差で及ばなかった。

Anthropicは今回のモデルの最大の強みとして価格を挙げた。オ퍼ス5の開発者向けAPI利用料は入力トークン100万個当たり5ドル、出力トークン100万個当たり25ドルで、従来モデルのオ퍼ス 4.8と同水準に設定した。

Anthropicがこのような「コストパフォーマンス」モデルを投入したのは、OpenAI、グーグル、xAIはもちろん、中国の키미 K3やDeepSeek(ディープシーク)など低コスト高性能のAIモデルとの競争が激化しているためとみられる。

一方Anthropicは、オ퍼ス5のサイバーセキュリティ脆弱性の検知能力が社内研究モデル「Mythos5」に近いと明らかにした。ただし、検知した脆弱性を実際の攻撃へ転化する能力と、生物学分野での長時間自律研究能力はMythos5より低いと説明した。

※ 本記事はAIで翻訳されています。ご意見はこちらのフォームから送信してください。