articleニュース
Anthropic が Claude Opus 4.8 をリリース——エージェント精度とコード品質が大幅向上
Anthropic が Claude Opus 4.8 を2026年5月28日にリリース。エージェント型コーディングスコアが64.3%から69.2%に向上し、Dynamic Workflows リサーチプレビューも同時公開。
概要
Anthropic は 2026 年 5 月 28 日、最新フラッグシップモデル Claude Opus 4.8 を公式リリースした。Opus 4.7 から 6 週間という短期間でのメジャーアップデートとなる。エージェント型コーディングスコアが 64.3% から 69.2% へ、ツール付き多分野推論(MMMU-Pro)が 54.7% から 57.9% に向上したほか、エージェント型 PC 操作(Computer Use)スコアも 82.8% から 83.4% へ改善された。
※本記事は公開情報をもとに編集部が再構成したサマリです。一次情報は出典欄をご参照ください。
事実のポイント
- モデル精度の向上: エージェント型コーディングスコアが 64.3% → 69.2%(+4.9pt)、ツール付き多分野推論が 54.7% → 57.9%
- コード品質改善: 内部評価でコードの未指摘欠陥が Opus 4.7 比 4 倍減少。見落とされがちな問題の自律的な検出・報告が改善
- Fast Mode 強化: Opus 4.8 Fast Mode は Opus 4.7 比で約 2.5 倍高速化、かつ 3 分の 1 のコストを実現
- コンテキストウィンドウ: デフォルト 100 万トークンコンテキスト、会話中のシステムメッセージ変更に対応
- Dynamic Workflows プレビュー: Claude Code にてリサーチプレビューとして同時公開。詳細は別稿参照
- 価格据え置き: Opus 4.7 から料金変更なし
用語・背景の補足
エージェント型コーディングスコア: AI が単体でコード生成・実行・デバッグのループを完結させる能力を測定するベンチマーク指標。Anthropic 内部評価基準(SWE-bench 系)で測定される。
Dynamic Workflows: Claude Code で複数のサブエージェントを並列実行できる新機能。JS/TS オーケストレーションスクリプトで最大 1,000 並列エージェントを制御可能。現在リサーチプレビュー段階。
Fast Mode: Anthropic が Opus シリーズ向けに提供する高速推論モード。標準出力よりも優先処理でレスポンス速度を高める機能。
注意点
- ベンチマークは内部評価であり、第三者による独立検証とは異なる場合がある
- Dynamic Workflows はリサーチプレビューであり、正式機能として確定していない点に留意
- Claude Code v2.1.154 以降が Dynamic Workflows の利用要件とされている
- 各スコアの改善幅は評価タスクの設計によって変動しうる
編集部見解
(追記予定)
info 公開情報をもとに編集部が再構成したサマリです。一次情報・追加情報は出典欄をご参照ください。