Claude Opus 4.6 リリース!

ClaudeのChatBotのAIモデルを Claude Sonnet 4.5 から、2026年2月5日にリリースされたばかりの最新フラッグシップモデル Claude Opus 4.6 にアップグレードいたしました。Claude Opus 4.6は、OpenAIのGPT-5.2やGoogleのGemini 3 Proを凌駕し、主要ベンチマークで業界トップの成績を記録したモンスターモデルです。

Claude Opus 4.6 リリース!
ンチマーク 内容 Opus 4.6のスコア 比較
ARC-AGI-2(汎用推論) 人間には簡単だがAIには難しい問題を解く力 68.8% GPT-5.2: 54.2% / 旧Opus 4.5: 37.6%
GDPval-AA(実務知識作業) 財務・法務など44職種の実務タスク 1606 Elo GPT-5.2に144 Eloポイント差で圧勝
Terminal-Bench 2.0(コーディング) AIによる自律コーディング能力 65.4% 全フロンティアモデル中 史上最高スコア
BigLaw Bench(法務推論) 法律的推論の正確性 90.2% Claude史上最高スコア
MRCR v2(長文理解) 100万トークン中に埋もれた情報の検索 76% 旧Sonnet 4.5: 18.5%(約4倍に向上)
Finance Agent(財務分析) SEC文書調査の精度 60.7% 業界最高水準を達成

Share

What's Your Reaction?

Like Like 0
Dislike Dislike 0
Love Love 0
Funny Funny 0
Angry Angry 0
Sad Sad 0
Wow Wow 0