Anthropic開発の次世代基盤モデル。最新の訓練データとアーキテクチャで高い性能を実現。
パラメータ
非公開
コンテキスト長
1M
ライセンス
プロプライエタリ
リリース日
2026-06-30
日本語性能
多言語対応モデルのうち、日本語処理に優れた性能を持つモデル。
API料金
入力料金(1Mトークンあたり)
$2
出力料金(1Mトークンあたり)
$
課金モード: standard
強み
弱み
活用例
深度分析
Artificial Analysis Intelligence Index
53
#5全体、GPT-5.5(xhigh)やOpus 4.8(max)の2〜3ポイント後
SWE-bench Pro
63.2%
Sonnet 4.6: 58.1%、Opus 4.8: 69.2%
Terminal-Bench 2.1
80.4%
Opus 4.8の74.6%を上回る
OSWorld-Verified
81.2%
Sonnet 4.6: 78.5%、Opus 4.8: 83.4%
標準入力価格
$3/100万トークン
8/31まで導入価格$2、Opusは$5
強み
- ・Opus並みのエージェント性能をほぼ半額で達成。Terminal-Bench 2.1でOpus 4.8を上回り、知識作業(GDPval-AA v2)で互角
- ・プロンプトインジェクション耐性が最高水準(攻撃成功率0.19%)、追従的虚偽率も最低(3.1%)
- ・一貫したエージェント完走性。テスト実行・失敗読み取り・修正・再実行を人間の促しなしで行う
弱み
- ・更新トークナイザーが同一テキストのトークン数を1.0〜1.35倍に膨らませ、実効コストが見かけの単価より高くなる
- ・Opus 4.8は最難関で明確なリードを保つ(USAMO +17.2pt、SWE-bench Pro +6.0pt、HLE no-tools +6.6pt)
- ・意図的に低いサイバー能力。正当なセキュリティ研究にも強いセーフガードが初期設定され免除なしでは不向き
競合比較
| Model | Price |
|---|---|
| Claude Opus 4.8 | $5/$25 per 1M |
| GPT-5.5 | $5/$30 per 1M |
| Gemini 3.5 Flash | Per Google pricing |
Claude Sonnet 5は2026年6月30日公開のAnthropicの中核ミッドティアで、フラッグシップOpus 4.8との性能差を大きく詰めつつトークン単価を約半額に抑えた。SWE-bench Pro 63.2%(4.6から+5.1pt)、Terminal-Bench 2.1 80.4%(Opus 4.8の74.6%を実際に上回る)、知識作業はGDPval-AA v2で1618 Elo(Opus 4.8と互角)を記録。更新トークナイザーが同一テキストのトークン数を最大1.35倍に増やすため、Anthropicは2026年8月31日まで$2/$10の導入価格を提示し以降は標準$3/$15になる。特徴は信頼できるエージェント完走性で、早期利用者は複数ステップのコーディング・デバッグ・業務自動化を前モデルが止まるところまでやり遂げると報告。5段階のエフォートと適応思考(既定high)、100万トークン文脈を持つ。安全性も際立ち、プロンプトインジェクション攻撃成功率0.19%(最低)と追従的虚偽率3.1%(最低)を達成。現在ClaudeのFree/Proの既定モデルであり、Claude Code・API・AWS Bedrock・Google Vertex AI・Microsoft Foundry、Cursor/VSCode/GitHub Copilot等で利用可能。大半の実稼働エージェント負荷にはClaude系列で新たな最良の価値であり、Opus 4.8は最難関の精度重視タスクとサイバー研究に残すべき。
出典
分析生成日: 2026-09-05