Anthropicプロプライエタリ

Claude Sonnet 5

このモデルを比較

Anthropic開発の次世代基盤モデル。最新の訓練データとアーキテクチャで高い性能を実現。

シェア:XはてブLINE

パラメータ

非公開

コンテキスト長

1M

ライセンス

プロプライエタリ

リリース日

2026-06-30

日本語性能

高品質日本語

多言語対応モデルのうち、日本語処理に優れた性能を持つモデル。

API料金

入力料金(1Mトークンあたり)

$2

出力料金(1Mトークンあたり)

$

課金モード: standard

強み

    弱み

      活用例

        深度分析

        Artificial Analysis Intelligence Index

        53

        #5全体、GPT-5.5(xhigh)やOpus 4.8(max)の2〜3ポイント後

        SWE-bench Pro

        63.2%

        Sonnet 4.6: 58.1%、Opus 4.8: 69.2%

        Terminal-Bench 2.1

        80.4%

        Opus 4.8の74.6%を上回る

        OSWorld-Verified

        81.2%

        Sonnet 4.6: 78.5%、Opus 4.8: 83.4%

        標準入力価格

        $3/100万トークン

        8/31まで導入価格$2、Opusは$5

        強み

        • Opus並みのエージェント性能をほぼ半額で達成。Terminal-Bench 2.1でOpus 4.8を上回り、知識作業(GDPval-AA v2)で互角
        • プロンプトインジェクション耐性が最高水準(攻撃成功率0.19%)、追従的虚偽率も最低(3.1%)
        • 一貫したエージェント完走性。テスト実行・失敗読み取り・修正・再実行を人間の促しなしで行う

        弱み

        • 更新トークナイザーが同一テキストのトークン数を1.0〜1.35倍に膨らませ、実効コストが見かけの単価より高くなる
        • Opus 4.8は最難関で明確なリードを保つ(USAMO +17.2pt、SWE-bench Pro +6.0pt、HLE no-tools +6.6pt)
        • 意図的に低いサイバー能力。正当なセキュリティ研究にも強いセーフガードが初期設定され免除なしでは不向き

        競合比較

        ModelPrice
        Claude Opus 4.8$5/$25 per 1M
        GPT-5.5$5/$30 per 1M
        Gemini 3.5 FlashPer Google pricing

        Claude Sonnet 5は2026年6月30日公開のAnthropicの中核ミッドティアで、フラッグシップOpus 4.8との性能差を大きく詰めつつトークン単価を約半額に抑えた。SWE-bench Pro 63.2%(4.6から+5.1pt)、Terminal-Bench 2.1 80.4%(Opus 4.8の74.6%を実際に上回る)、知識作業はGDPval-AA v2で1618 Elo(Opus 4.8と互角)を記録。更新トークナイザーが同一テキストのトークン数を最大1.35倍に増やすため、Anthropicは2026年8月31日まで$2/$10の導入価格を提示し以降は標準$3/$15になる。特徴は信頼できるエージェント完走性で、早期利用者は複数ステップのコーディング・デバッグ・業務自動化を前モデルが止まるところまでやり遂げると報告。5段階のエフォートと適応思考(既定high)、100万トークン文脈を持つ。安全性も際立ち、プロンプトインジェクション攻撃成功率0.19%(最低)と追従的虚偽率3.1%(最低)を達成。現在ClaudeのFree/Proの既定モデルであり、Claude Code・API・AWS Bedrock・Google Vertex AI・Microsoft Foundry、Cursor/VSCode/GitHub Copilot等で利用可能。大半の実稼働エージェント負荷にはClaude系列で新たな最良の価値であり、Opus 4.8は最難関の精度重視タスクとサイバー研究に残すべき。

        分析生成日: 2026-09-05