過去の出来事の日付:2026年5月28日。

Anthropicは、最上位モデルの更新版としてClaude Opus 4.8を発表し、コーディングと自律的なタスク実行能力が向上したとの主張に加え、システムが適用する計算量を調整する新たな制御機能を組み合わせた。同社は、消費者向けサービス、Claude Code、Claude APIを通じ、claude-opus-4-8という識別子でこのモデルを利用可能にした。

通常モードでは、100万トークン当たりの入力料金が5ドル、対応する出力料金が25ドルで、Opus 4.7と同額だった。高速モードは2.5倍の速度で動作した。このオプションでは、入力100万トークンが10ドル、出力100万トークンが50ドルだった。Anthropicによると、このオプションは従来モデルで同等の高速動作を利用する場合より3分の1の料金だった。

Claude.aiの利用者には、処理量を設定する機能が追加された。Opus 4.8のデフォルトは高処理量で、Anthropicによれば、コーディング作業で従来モデルのデフォルトと同程度のトークン数を使用しながら、結果を改善した。「extra」と「max」のレベルでは、難しい課題や長時間にわたる非同期作業により多くのトークンを使用できた。Claude Codeには利用上限の引き上げと、非常に大規模な問題向けの「dynamic workflows」機能も追加された。

同社はベンチマーク性能だけでなく、信頼性も強調した。Anthropic独自の評価と初期テスターの報告によると、Opus 4.8は不確実性をより頻繁に認識し、裏付けのない結論を避けた。同社によれば、生成したコードの欠陥に言及しない確率は、Opus 4.7と比べて約4分の1だった。これらは提供企業による主張であり、提示された証拠には独立した評価は含まれていなかった。

Anthropicのアラインメントチームは、利用者の自律性を支える行動の指標が向上し、欺瞞や悪用への協力の割合がOpus 4.7より低下したと報告した。新モデルの不整合の程度は、Project Glasswingの下で少数の組織がサイバーセキュリティー用途に試験している、より高性能なシステムClaude Mythos Previewと同程度だったという。

今回の発表は、将来の製品階層も示唆した。AnthropicはOpus 4.8を小幅な改善と説明し、同様の能力をより低コストで提供するために取り組んでいると述べた。また、より強力な安全対策によって、Mythos級のシステムをその後数週間以内により広く提供できるようになると見込んでいた。

モデルと同時に、Model Hardware Standardが研究プレビューに入った。物理デバイスを操作するエージェントを対象とするもので、選定された研究所と先進的な製造企業に開放された。対象となる研究チームを通じて最大1万人の科学者に最長1年間、Claudeへの無料アクセスを提供し、Premiumシートの料金は月額15ドルだった。Anthropicは、AIがウェルビーイングに及ぼす影響を独立して研究するための500万ドルの助成プログラムも発表した。

この発表では、独立したベンチマークの再現結果も、このモデルを使用する顧客の本番環境での結果も示されなかった。今回の公開はモデルの更新とワークフロー、研究、安全性に関する取り組みを組み合わせたものだったが、比較性能についての主張は引き続き開発元によるものだった。