2026年9月
    月 火 水 木 金 土 日
     123456
    78910111213
    14151617181920
    21222324252627
    282930  

     Claudeの「Sonnet」が、価格据え置きのまま速く、賢くなった。Anthropicは9月28日(現地時間)、AIモデル「Claude Sonnet 5.5」を発表した。同日より、Claude PlatformのAPIなどで提供を開始している。API価格は「Claude Sonnet 5」から据え置きで、100万トークン当たり入力が2ドル(約314円、1ドル=157円換算)、出力が10ドル(約1,570円)。

     Claude Sonnet 5.5は、Claude 5.5ファミリーの2番目となるモデル。上位のClaude Opus 5.5を補完する高速/低コストなモデルという位置付けで、範囲が明確な日常的なタスクやバグ修正、ドキュメントやスライド、スプレッドシートの作成を得意とする。出力の生成速度はSonnet 5比で30%以上高速化しており、同社はSonnetモデルとして過去最速としている。また、同じ作業に必要なトークン数が削減され、タスク当たりのコストが最大30%低減したという。

     ベンチマークでは、エージェント型コーディングの評価「Terminal-Bench 4.0」で70.6%を記録。Sonnet 5の10.3%から大きく伸び、Opus 5.5の66.4%も上回った。一方、「FrontierCode 1.1(Main)」と「CursorBench 4.0」では、Sonnet 5を上回ったもののOpus 5.5には及ばなかった。

     そのほか、知識労働の評価「GDPval-AA v2.1」ではOpus 5.5とほぼ同等のスコアを記録した。コンピュータ操作の「OSWorld 2.1」、ツールなしでの「Chartography」、ツールありでの「Humanity’s Last Exam」でも、いずれもSonnet 5を上回り、Opus 5.5に迫る結果となっている。

     また、初期テスターは、コーディングではコードベースを素早く把握できるほか、ツール呼び出しをまとめて実行するなど、効率的な動作を評価した。ナレッジワークでは、より自然な会話が可能で、ユーザーインターフェイスやプレゼンテーション資料のデザインセンスにも優れているなど、数値化できない点を高く評価した。

     安全面では、約1,850のシナリオでClaudeの振る舞いを検証する自動監査において、アライメントのほとんどの指標でSonnet 5と同等以上の結果を残した。また、Opus 5.5と同様にサイバーセキュリティに関するセーフガードを搭載し、リスクの高いサイバーセキュリティタスクではSonnet 5へフォールバックする。生物学分野については、Sonnet 5と同じセーフガードを採用する。

    Share.

    Comments are closed.