Claude Sonnet 5.5が気になる人へ
仕事でAIを使っていて、こんな経験はないでしょうか。答えは立派なのに、少し直したいだけで待ち時間が長い。安いモデルを選ぶと、今度は指示の読み違いを直す時間が増える。使うモデルを決める時、私なら「一回の回答がどれほど賢いか」より、納得できる結果に何分・いくらでたどり着くかを先に見ます。
2026年9月28日に発表されたClaude Sonnet 5.5は、まさにその問いを投げかける新モデルです。Anthropicは、前世代のSonnet 5より出力が30%以上速く、多くの仕事でタスク当たりの費用が最大30%下がると説明しています。ただしAPIの入力・出力単価は据え置きです。ここを取り違えると、料金の見積もりを誤ります。Anthropicの発表と日本語のモデル資料を基に、何が変わったのかを順に見ていきましょう。
この記事は2026年10月1日に公式資料と公開画面を確認して書きました。筆者はClaude Sonnet 5.5を有料アカウントやAPIで実行していません。以降の「使い方」は公式仕様から組み立てた手順と、試すための日本語の例です。実測結果や採用企業の成果として扱わないでください。

30秒で分かる結論
Sonnet 5.5を一言で表すなら、毎日の作業を、上位モデルに近い品質で軽快に進めるための選択肢です。文章の推敲、資料づくり、表の整理、仕様が明確なコード修正など、往復しながら仕上げる仕事に向いています。研究、複数の判断が絡む長い開発、曖昧な依頼ではOpus 5.5も比較してください。短い分類を大量に処理するなら、Haiku 4.5も候補です。モデルの公式な位置づけはAnthropicの発表にあります。
価格は、APIで入力100万トークン当たり2米ドル、出力100万トークン当たり10米ドル。Sonnet 5と同額、Opus 5.5の半額です。ただしトークン単価の半分は、仕事一件の請求額が必ず半分という意味ではありません。推論の深さ、再試行、長い資料の入力、ツール呼び出しによって請求額は変わります。チャットのFree・Pro・Maxは月額契約と利用上限の話で、API従量課金とは別です。公式API料金とClaudeのプラン表を分けて確認しましょう。
なぜ今、Sonnet 5.5が話題なのか
9月22日に上位モデルのOpus 5.5が出たばかりのところへ、6日後にSonnet 5.5が発表されました。大きな話題になった理由は、最上位モデルの性能をただ追う競争とは違い、日常の実務に直結する速度と仕事当たりの費用を前に出したことです。発表に対するClaudeAIコミュニティの投稿には公開時点で多くの反応が集まり、「どの仕事ならOpusを使い、どこまでSonnetで足りるか」という議論も起きています。SNSの反応は需要の手掛かりであって、性能の検証結果ではありません。
背景には、AIを一日に何度も使う人が増えたことがあります。初稿を出して終わりではなく、「この段落だけ短く」「根拠を追加」「表の順番を変更」と直していく。そんな一連の仕事では、一回の回答速度より、依頼から完成までの合計時間が効いてきます。Anthropicの説明する30%以上の出力速度改善は期待できる材料ですが、通信環境やタスク、設定によって体感は変わります。自分の仕事で測る必要があります。
もう一つは、公開ベンチマークの意外な近さです。業務タスクを使ったGDPval-AA v2.1ではSonnet 5.5が1844、Opus 5.5が1846と、Anthropicの表ではわずかな差でした。一方、複雑なコード変更を扱うFrontierCode 1.1ではSonnet 5.5の46.2%(Max)、Opus 5.5の54.4%と差があります。同じ「賢さ」という言葉で括ると、仕事ごとの差が消えてしまいます。公式発表の評価表を読む際は、この点に注意してください。
「どのAIが世界一か」という話は盛り上がりますが、読者の毎日には少し遠い問いです。たとえば、昼休みの15分で提案書の荒いメモを整える人と、数時間かけて不具合の原因を探す開発者では、必要な能力も許せる待ち時間も違います。Sonnet 5.5のニュースを自分事にするなら、自分が昨日AIに頼んだ仕事を一つ思い出すのが早いでしょう。そこで困ったのが速度か、事実の間違いか、回数制限か、費用か。困りごとが違えば、同じ発表から得る答えも違います。

Claude Sonnet 5.5とは何か
Sonnet 5.5はClaude 5.5ファミリーの中核となるモデルです。Anthropicは、範囲の明確な日常業務、バグ修正、文書・スライド・表計算の作成に強いモデルと説明しています。Claudeのチャット画面に加え、Claude Code、Claude Platform、Amazon Bedrock、Google Cloud、Microsoft Foundryなどでの提供を案内しています。利用可否と上限はサービスや契約で異なるため、使う画面でモデル名を確かめてください。提供状況は公式発表に記載されています。
Claude APIのモデルIDはclaude-sonnet-5-5。入力はテキストと画像、出力はテキストです。公式モデルページにはコンテキストウィンドウ100万トークン、最大出力12.8万トークンとあります。大きい上限があっても、長い資料を毎回すべて入れるほど費用と確認負担が増えます。「入れられる量」と「入れるべき量」は別です。公式モデル概要を参照してください。
ここで区別したいのは、モデルそのものとClaudeというアプリの機能です。モデルの文章生成能力があっても、ブラウザ操作、外部アプリ連携、スライド作成などを実際に使えるかは、プラン、機能の提供地域、権限、接続したツールに左右されます。SNSで見たデモが、自分の無料アカウントで同じ手順で動くとは限りません。まず利用画面とプランの案内を見てから試すのが近道です。
100万トークンという数字も、そのまま「分厚い本を何冊でも完璧に理解する」という保証にはなりません。長い文脈の途中から重要な条件を拾えるか、複数の表を正しく結び付けられるか、最後に出典を戻せるかは個別に確認が必要です。資料を一気に渡して一行の結論を求めるより、「まず関連する箇所を特定し、引用を示し、その後で結論を書く」と段階を分けるほうが、読み手も結果を点検できます。大きな上限は選択肢を広げるための容量と捉えるのが健全です。

Sonnet 5から何が変わったのか
価格表だけを見ると、Sonnet 5とSonnet 5.5は同じです。どちらもAPIで入力2ドル、出力10ドル/100万トークンです。違いは、Anthropicの測定ではSonnet 5.5のほうが仕事を少ないトークンと手順で進め、出力も30%以上速い点にあります。「モデルが値下げされた」わけではなく、「同じ単価で仕事を終えるまでの使い方が効率化した」という理解が正確です。発表のCost and speed節に根拠があります。
コードを書く仕事では、AIがファイルを読む、変更する、テストする、失敗を直す、というループを何度も回します。Sonnet 5.5は、Anthropicの説明ではツール呼び出しをまとめる傾向があり、早期利用者から少ない手順で済むという報告がありました。利用者コメントは有益ですが、各社が異なる課題で測った感想です。自社のリポジトリで同じ結果が出る保証ではありません。公式発表のCoding節で前提を確認できます。
仕事の文書でも改善が報告されています。Anthropicは、初期テスターが読みやすい文章、デザインの整った資料、スライドのテンプレートへの追従を評価したと紹介しています。ここは数値だけでは測りにくい部分です。私は、文書の品質を評価する時に「最初の文章が美しいか」より、元資料にない主張を足していないか、修正指示を一回で守れるかを見ます。会社の資料は、きれいな言い回しより事実の正確さで信頼が決まるからです。
| 見るところ | Sonnet 5 | Sonnet 5.5 | 読む時の注意 |
|---|---|---|---|
| API入力/出力 | 2ドル/10ドル | 2ドル/10ドル | 100万トークン単価は同じ |
| 出力速度 | 基準 | 公式発表で30%以上高速 | 条件により体感は変わる |
| タスク当たり費用 | 基準 | 公式測定で最大30%減 | 個別業務で保証されない |
| 仕事の傾向 | 日常業務と開発 | 文書、表、コード修正の効率改善 | 実際の仕事で評価する |
ベンチマークの数字を仕事に翻訳する
新モデルの記事では「何%」が目を引きます。しかし評価表には、作業環境、使えるツール、推論設定、採点基準が隠れています。AnthropicはTerminal-Bench 4.0でSonnet 5.5が70.6%、Sonnet 5が10.3%、Opus 5.5が66.4%と公表しました。これだけを見るとSonnetが最強に見えます。一方、FrontierCode 1.1ではOpusが高く、GDPval-AAではほぼ同点です。一つの表の一番大きい数字で、すべての業務を決めないことが肝心です。公式評価表を参照してください。
Terminal-Benchはターミナルでの複数手順の作業を、FrontierCodeはコード変更が受け入れられるかを、GDPval-AAは職業横断の仕事を測ります。日本語の営業資料を作る人にはGDPvalに近い評価がヒントになり、既存アプリの不具合を直す人にはコードの評価が参考になります。しかし自社の用語や承認手順、日本語の読みやすさは、公開ベンチマークには十分に表れません。評価の詳細と脚注を確認してから、業務に引き寄せてください。
同じ発表ページには、Sonnet 5.5がOpus 5.5に近いスコアを出す場合でも、複雑で結論が開かれた仕事ではOpusがなお強い、というAnthropic自身の留保があります。Opusの価格が二倍だから常にSonnetを選ぶ、という単純な話ではありません。難しい案件でSonnetを何度もやり直すなら、最初からOpusを使うほうが安いこともあります。逆に、定型化した仕事でOpusを常用すると、品質差が小さいのに請求額だけが増えるかもしれません。
| 評価 | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | 測る仕事 |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% | ターミナルの複数手順 |
| FrontierCode 1.1 | 46.2%(Max) | 42.4% | 54.4% | コード変更の採用可能性 |
| GDPval-AA v2.1 | 1844 | 1449 | 1846 | 職業横断の業務 |
料金を混同しない:チャットのプランとAPI
Claudeをブラウザやアプリで使う場合、まずFree・Pro・Maxなどのプランを選びます。APIから使う場合は、入力と出力のトークン量などに応じて支払います。同じ「Sonnet 5.5を使う」でも請求の仕組みが違います。Proの月額料金を払えば、外部アプリから使うAPIが無制限になるわけではありません。 Claude公式のプラン案内とClaude Platform料金表は別のページです。
2026年10月1日にChromeの日本語表示で確認したプラン画面では、Freeが0ドル、Proが年払い換算で月18ドル・月払い22ドル、Maxが月110ドルからと表示されました。一方、公式サイトの表示は地域、通貨、税、販売条件によって変わり得ます。この記事の金額は撮影時の表示として読み、申し込み直前の決済画面で確認してください。ProやMaxでも利用量には上限があり、利用するモデルや会話の長さで消費は変わります。料金画面を参照してください。
無料プランのモデル欄にはSonnetが含まれていますが、使える回数や選択の表示は利用環境で変わります。Claude Codeは公式プラン表では有料プランに含まれ、チャットと利用枠を共有します。仕事で毎日使う人は、「月額で何回質問できるか」という固定回数より、自分の長い会話やファイルを扱った時、どのくらいで上限に近づくかを小さく試したほうが実態をつかめます。公式プラン比較に利用枠の説明があります。

| プラン | 画面で確認した表示 | 使い方の目安 | 注意 |
|---|---|---|---|
| Free | 0米ドル | 短い用事で試す | 利用枠とモデル表示を確認 |
| Pro | 年払い換算18米ドル/月、月払い22米ドル | 日常の文書とClaude Code | 年払いは一括請求の条件を確認 |
| Max | 110米ドル/月から | 利用量が多い人 | 複数の枠と条件を確認 |
APIの費用はどう見積もるか
APIの基本式は、入力トークン数÷100万×入力単価+出力トークン数÷100万×出力単価です。Sonnet 5.5なら入力2ドル・出力10ドル、Opus 5.5なら入力4ドル・出力20ドル。100万トークン当たりの価格なので、「100万トークン使わないと課金されない」という意味ではありません。短い一件にも、その分だけ費用が発生します。キャッシュ読み取りや書き込み、Batch APIなどには別の単価があり、ツール使用でも追加費用があり得ます。公式API料金を参照してください。
架空の試算をしてみます。一件の資料整理で入力1万トークン、出力2千トークン使ったと仮定すると、Sonnet 5.5の基本トークン費用は0.01×2+0.002×10=0.04米ドルです。Opus 5.5なら0.08米ドル。同じ量なら確かに半額です。ただしSonnetで二回やり直して合計で入出力が三倍になれば、結果は変わります。反対に、Sonnetが少ない手順で終われば、差は単価以上に広がります。この数字は課税、為替、キャッシュ、ウェブ検索などを除いた例で、実測でも請求額の保証でもありません。
現場で見落としやすいのは同じ資料を会話のたびに再送するコストです。数十ページの社内資料を付けて細かな修正を繰り返すと、指示が短くても入力トークンが積み重なります。最初に必要な章だけ渡す、出典箇所を指定する、長い共通指示はキャッシュの条件を確認する。こうした設計は、モデル選びと同じくらい請求額に効きます。キャッシュは最小長や書き込み時間で条件が異なるので、先にモデル概要と料金表を見てください。
もう一つ、モデルの思考の深さを表すeffort設定も見積もりに入れます。公式資料ではClaudeのアプリやClaude CodeはMedium、Claude PlatformはHighが既定です。高い設定ほど難題で助かる可能性がある一方、考える時間やトークンが増えます。短い定型文まで最も高い設定で処理すれば、Sonnetを選んだ節約効果が消えるかもしれません。反対に難しい設計相談で設定を低くしすぎれば、やり直しが増えます。AnthropicもSonnet 5からeffortの意味をそのまま引き継がず、比較し直すよう案内しています。公式の動作変更を参照してください。
見積もり表には「一件の平均」だけでなく、長文が混ざる月末の仕事も入れます。例えば毎日50件の短文分類ならHaikuとの比較が効き、週に二件の長い提案書なら人のレビュー時間が大きく効くでしょう。平均的な一件で最安のモデルが、月全体でも最安とは限りません。入力文の長さがばらつくなら、短文・標準・長文の三つに分けて仮の件数を置き、計算結果を並べてください。これは料金表の数字を、自社の予算へ翻訳するための方法です。

| モデル | 入力 | 出力 | キャッシュ読み取り | 向く候補 |
|---|---|---|---|---|
| Claude Haiku 4.5 | $1 | $5 | $0.10 | 短い定型処理 |
| Claude Sonnet 5.5 | $2 | $10 | $0.20 | 日常業務と明確な開発 |
| Claude Opus 5.5 | $4 | $20 | $0.20 | 複雑な開発と長い判断 |
Claudeの画面で最初に試す3つの仕事
Sonnet 5.5を試すなら、最初から大きな仕事を丸投げしなくて大丈夫です。Claudeのモデル選択欄でSonnet 5.5を選べるか確認し、正解を人が見分けられる、小さな仕事から始めます。モデル選択や利用枠の表示はプランによって違います。手順の基礎はClaudeの公式プランページとSonnet 5.5の発表で確認できます。
- Claudeの画面でSonnet 5.5を選べるか、プランと利用枠を確認する。
- メールや会議メモなど一つの小さな仕事を渡し、変えてはいけない事実を明示する。
- 一度修正を頼み、数字、固有名詞、出典を元資料と照合する。
一つ目は、すでに自分で書いたメールの編集です。「このメールを、相手が今日判断できる順番に並べ替えて。事実を追加せず、日時と金額は変えない。変更した理由を最後に三行で書いて」と頼みます。見るべき点は、丁寧さより事実の保持です。送信前の確認は人が行います。件名が魅力的でも、元の締め切りを勝手に変えていれば不合格にします。
二つ目は、会議メモを次の行動に変える仕事です。「決定事項、未決事項、担当者が明示された作業、期限が明示された作業を分けて。担当者や期限が書かれていないものは推測せず空欄にして」と指定します。AIがそれらしく穴を埋めるのを防ぎやすくなります。三つ目は、表の点検です。数値の列と計算条件を渡して、「計算値と原文の値が違う行だけ抜き出して」と頼みます。出力表は元データと照合します。
ここで私が勧めたいのは、同じ指示をSonnet 5.5と、今使っているモデルの両方へ渡すことです。便利かどうかは、SNSの感想より自分の文章で判断しやすい。修正回数、誤った追加、読み終えるまでの時間をメモしておくと、数回で相性が見えてきます。無料枠の範囲でも、短い文章なら試しやすいはずです。ただし実際に利用できるモデルと枠は、アカウント画面で確認してください。
試す時は「良い答えを出して」だけでなく、何を勝手に変えてはいけないかを一行加えます。商品紹介なら価格と仕様、採用メールなら面談日時、議事録なら誰が言ったか。この一行があると、見た目の良さだけに引っ張られず、モデルの注意深さを判断できます。私は二回目の指示もあらかじめ用意します。「二段落目だけ半分の長さにして、ほかはそのまま」。最初の回答と修正への追従は別の能力だからです。仕事で使うなら、この二往復目のほうが大切になる場面が多いと感じます。
文書・スライド・表計算ではどこまで任せるか
Sonnet 5.5は文書やスライド、表計算の仕事も公式に強調しています。ここで期待したいのは、見た目の完成度だけではありません。例えば提案書なら、顧客が知りたい順に要点を並べ、数字に出典を付け、前提条件を小さく示す。スライドなら、一枚に伝えることを一つに絞り、図と見出しが同じ結論を指す。表なら、単位と計算式を揃える。これらは人間の編集者が普段やっている仕事です。公式発表のKnowledge work節を参照してください。
AIに渡す依頼文は、資料の用途を具体的にしたほうが効果を見やすくなります。「社内の10分会議で、今月の売上変動の原因を議論したい。添付資料だけを根拠に、確かな数字・仮説・確認が必要な点を分けた五枚の構成案を出して。添付にない市場データは足さない」。このように、読者、制限、完成物、根拠を一緒に渡します。数値や市場環境の真偽は、出典を開いて確認します。
便利さの裏側にある落とし穴は、流麗な文章が、検証を終えた文章に見えてしまうことです。AIが「売上低下の原因は競合の値下げ」と書いても、資料にその情報がなければ仮説です。「事実」「推測」「未確認」を見た目から分かるように分けるだけで、社内資料の事故はかなり減らせます。私ならモデルの評価項目に、出来栄えと同じ重みで「根拠のない断定の件数」を入れます。
Claude Codeで使う人が確認したいこと
Claude Codeを使う開発者にとって、Sonnet 5.5は候補になります。バグの再現、修正、テスト、レビューの指摘対応のように、完了条件を決めやすい仕事が合います。公式発表はコードベースの理解とツール呼び出しの効率を強みとして挙げています。ですが「速いモデルだからレビューなしで変更を採用する」は別の話です。AnthropicのCoding節を参照してください。
試す課題は「壊れている小さな機能を一つ直す」がよいでしょう。修正前に再現手順と期待結果を書き、使用を許可するフォルダを絞る。Sonnet 5.5に変更理由とテスト結果を出させ、人が差分を読む。同じ課題をSonnet 5やOpus 5.5でも走らせるなら、テスト通過だけでなく、余計なファイルを触ったか、説明と差分が合っているか、やり直しが何回必要だったかを記録します。時間と費用を測る時は同じ環境と同じ課題を使います。
大規模な設計変更や曖昧な仕様の整理では、Opus 5.5を先に使う価値があります。方針を人とOpusで固め、範囲を切り出した実装をSonnetに任せる方法もあります。ただし二つのモデルを使えば、やり取りの引き継ぎやコンテキスト再入力に費用がかかります。分担が本当に得かは、チームの代表課題を十件程度測って決めてください。これは公式が保証する成果ではなく、AQUAの運用提案です。
Claude Codeをこれから使う方には、当サイトのClaude Codeの超入門が基本操作の参考になります。すでに別の開発エージェントを使っているなら、Claude CodeとCodexの比較で両者の仕事の進め方を確認できます。ただし既存記事の検証時点とSonnet 5.5の発表日は異なります。最新モデルの性能を示す資料として、古い比較結果をそのまま流用しないでください。
Sonnet 5.5、Opus 5.5、Haiku 4.5をどう選ぶか
最初にSonnet 5.5を試し、そこで困った理由が明確になってから別モデルを選ぶと、判断しやすくなります。複雑で長い仕事や曖昧な判断が残るならOpus 5.5。短い抽出・分類を大量に回し、正解を機械で確かめやすいならHaiku 4.5。Sonnet 5は現行の処理が安定しているなら、急いで全部入れ替える必要はありません。機能やモデルの位置づけと価格はClaudeのモデル一覧と料金表で確認できます。
GPT-6 Solとの比較も気になるでしょう。公式発表には両社モデルを並べた評価がありますが、各社が示した条件を揃えずに勝敗を断定できません。GPT-6 Astra・Sol・Lunaの特徴とAPI料金は当サイトのGPT-6比較記事で説明しています。この記事では、Sonnet 5.5を選ぶ上で必要な点に絞ります。同じ入力2ドル・出力10ドル/100万トークンという価格だけで決めず、実際の仕事一件の完了率と、手直しにかかった人の時間を比べてください。
| 仕事 | 最初の候補 | 別モデルを試す条件 | 確認すること |
|---|---|---|---|
| 短文の分類・抽出 | Haiku 4.5 | 例外や曖昧さが増えたらSonnet | 正解率と一件の費用 |
| 文書の編集・表の整理 | Sonnet 5.5 | 根拠の整理に失敗したらOpus | 事実保持と修正回数 |
| 小さなバグ修正 | Sonnet 5.5 | 設計判断が広がるならOpus | テスト、差分、時間 |
| 複雑で長い設計 | Opus 5.5 | 部分実装を切り出せたらSonnet | 完了率と人のレビュー |
| 現行の安定した処理 | 現在のモデル | 改善が測れた時に変更 | 変更リスクと費用 |
Sonnet 5からAPIを移行する時の落とし穴
チャットで新しいモデルを選ぶだけなら、利用者がAPIの設定に触れないことも多いでしょう。自社アプリやエージェントでSonnet 5を呼んでいる場合は話が違います。Anthropicの日本語の移行資料は、互換性に影響する変更を五つ挙げています。モデルIDだけを書き換えて本番へ出す前に、使っている機能が該当するか確認してください。
まず、事前の思考をオフにしていた場合、従来のthinking: {"type":"disabled"}はSonnet 5.5でエラーになります。新しいbetween_toolsの指定を使います。次にtool_choiceで特定ツールの使用を強制するanyやtoolも受け付けられず、400エラーです。ツールの選び方と出力の検証を作り直す必要があります。新機能の公式説明に変更前後が書かれています。
さらに、思考ブロックはモデルと会話に結び付けられ、会話の途中でモデルを切り替える設計に影響します。Claude APIとGoogle Cloudでは旧computer_20251124のコンピューター操作ツールが使えず、新しいツールセットが必要です。一部のadvisorツールの組み合わせも変わります。ツール呼び出しの間に表示していた進捗文は、レスポンスのブロック形式の違いで見えなくなる場合があります。ユーザーの画面が静かになったのに処理だけ続く、といった不具合を防ぐため、ストリーミングの表示まで確認します。日本語の移行ガイドが具体的な変更点を示しています。
私なら移行前に、通常の依頼、ツール使用、長い会話、モデル切り替え、エラー、キャンセルの六場面を固定した検証セットにします。そのうえで一部の利用者に先行提供し、レスポンスの欠落、予期しない再試行、請求額の変化を見ます。特に「旧モデルで通った設定が新モデルでは400になる」点は、文章の品質以前にサービスを止める可能性があるため、先に潰す価値があります。
移行の判断を急がなくてよい場合もあります。既存のSonnet 5で問い合わせの分類が安定し、月の費用が予算内に収まっているなら、移行そのものが新しいリスクです。まず開発環境で並行評価し、何を改善したいから替えるのかを明文化します。応答時間を短くしたいのか、文書の修正回数を減らしたいのか、コード修正の完了率を上げたいのか。改善が確認できた仕事から切り替えれば、モデルの発表日を追いかける運用から抜け出せます。法人でAPI利用を考える場合は、当サイトのClaude API企業導入ガイドも入口になります。

安全対策、データの扱い、誤りへの向き合い方
AnthropicはSonnet 5.5のサイバーセキュリティ能力が前世代より上がったとして、一部の高リスクな依頼をSonnet 5へ切り替えるなどの安全策を案内しています。生物学分野にも別の対策があります。普通のソフトウェア開発がすべて止まるという説明ではありません。逆に、正常な修正依頼で期待したモデルと違う応答が返る可能性は運用上、知っておきたい点です。用途ごとの条件は公式発表のSafeguards節で確認してください。
企業で使う時は、モデルの能力と社内データの扱いを分けて考えます。会議録、顧客名、契約書、未公開の数字は、入力してよい環境かを先に確認する。役職や担当者だけでなく、閲覧・編集・外部送信の権限を分ける。AIが作ったメールや公開文は、送信前に人が見る。利用者が安心して使うには、「AIが断ってくれるだろう」という期待より、そもそも渡すデータと実行権限を限定する設計が効きます。データ保持や学習利用の条件は製品・契約によって異なり、記事の一般論だけで判断できません。
Sonnet 5.5にはゼロデータ保持の提供もあるとAnthropicは案内していますが、すべての個人向けチャットや全契約に自動で適用される意味ではありません。法人導入で必要なら、契約対象と設定、保持期間を確認してください。公式発表のGetting started節に記載があります。文章や表の誤りについても、モデルが新しいほどゼロになるわけではありません。特に引用、金額、日付、単位、相手の名前を最後に確認する習慣が必要です。
一週間で見極める、小さな評価方法
「すごいらしい」で契約を増やすと、あとで使い道に困ります。まず一週間、実際の仕事から匿名化した十件を選びましょう。メール修正三件、会議メモ二件、資料の要約二件、コード修正三件など、使いたい仕事に寄せます。入力を同じにし、期待する出力条件を先に書く。機密情報が必要なら社内の承認された環境だけで試します。架空の題材でも操作には慣れますが、導入判断には自社の実務に近い題材が必要です。
採点は五つに絞れます。①事実の正確さ ②指示の遵守 ③完成までの時間 ④人の修正時間 ⑤費用です。品質は五段階でも構いませんが、重大な誤りは別に数えてください。一つの大きな誤りが平均点に埋もれるのを防げます。たとえばメールの敬語が自然でも、契約の金額を変えていれば不合格です。コードならテスト通過率と変更範囲も加えます。
比較対象は、今使っているモデル一つで十分です。Sonnet 5.5、Sonnet 5、Opus 5.5を全部試してもよいですが、まずは日常の基準と二つを比べ、違いが出た課題だけ上位モデルで再確認するほうが続けやすい。APIならusageに出る入出力トークン、キャッシュ、追加のツール費用を記録します。チャットなら月額プランの範囲と、上限に達した時の仕事への影響を記録します。
私が最終的に見たいのは、モデルの採点表で一位になることではなく、人が読んで直したあとに、仕事全体が軽くなったかです。週末に「AIを使った案件の修正時間」を振り返ると、華やかなデモでは見えない価値が分かります。速度が上がっても確認作業が増えれば改善とは言えません。反対に出力が地味でも、毎日五分の確認で済むなら良い道具です。
十件を評価しても結果が割れることはあります。そんな時は無理に一つのモデルへ統一せず、失敗の種類ごとに分けます。「資料を読んで要点を並べる」はSonnetで十分、「相手の意図が曖昧な提案」はOpusを使う、「形式が決まった短い分類」はHaikuを検証する。この分け方なら、何となく上位モデルへ頼り続けるより理由が残ります。人がモデルを選ぶための長い説明が必要なら、選択条件が細かすぎる合図かもしれません。現場では、迷った時の標準と例外だけ決めるほうが続きます。
よくある質問
Sonnet 5.5は無料で使えますか?
Claudeの公式プラン表ではFreeにSonnetが含まれています。ただしモデルの選択表示、利用枠、使える機能はアカウントと提供状況で確認してください。APIは別の従量課金です。公式プラン表をご覧ください。
Sonnet 5よりAPI料金は安くなりましたか?
いいえ。入力2ドル・出力10ドル/100万トークンで、単価は同じです。Anthropicは、少ないトークンや速い処理でタスク当たりの費用が下がる場合があると説明しています。「最大30%」は特定条件での発表値です。公式発表に根拠があります。
Opus 5.5の代わりになりますか?
範囲が明確な日常業務では有力ですが、長い開発や曖昧な判断ではOpusも比較してください。Anthropic自身が複雑で結論が開かれた仕事ではOpusが強いと説明しています。自分の代表課題で完了率と再試行を比べるのが確実です。
100万トークンを一度に使うべきですか?
いいえ。100万はモデルが扱える文脈の上限です。大きな資料を何度も入れると費用や確認負担が増えます。関連する章を選び、出典を指定して使ってください。公式モデル概要に上限が載っています。
日本語の文章に向いていますか?
利用はできます。ただし「自然な日本語」を一つの基準にせず、敬語、事実の保持、読み手に必要な情報の順番、修正指示への追従を自分の文章で試してください。この記事は日本語の実測比較をしていません。
Sonnet 5から移行する時、モデルIDだけ変えればよいですか?
API統合ではそうとは限りません。思考設定、ツールの強制指定、思考ブロック、旧コンピューター操作ツール、advisorの組み合わせなどに変更があります。日本語の移行資料で該当箇所を確認してください。
入力したデータは必ず保存されませんか?
一律には言えません。Anthropicはゼロデータ保持での提供を案内していますが、利用環境と契約で条件が異なります。業務データを入れる前に、契約、管理設定、保持期間を確認してください。公式発表を参照してください。
まとめ:モデル名より、完成までの仕事を見る
Sonnet 5.5は、APIの単価を変えずに、Anthropicが速度とタスク効率の改善を打ち出したモデルです。公開評価ではOpusに近い領域もありますが、難しい仕事では差が残ります。だから「今後は何でもSonnet」と決める必要はありません。まず一つの仕事を選び、今の方法と完成までの時間、費用、人の手直しを比べる。これが一番確かな選び方です。
最初の一歩として、明日送る予定のメール一通か、担当者が決まっていない会議メモ一枚を使ってみてください。元の事実を守る条件を明記し、出力を人が照合する。使い勝手がよければ、資料づくりやコード修正へ広げる。AQUA合同会社では、AIの導入範囲や業務ごとのモデル選定についてご相談を受けています。自社での評価方法から考えたい方はお問い合わせページをご利用ください。
あわせて読みたい記事
参考資料・確認日
情報確認:。数値は各社の公開値、プラン料金は撮影時の日本語表示です。この記事ではSonnet 5.5の実行結果を測定していません。独自意見と架空の試算は本文で区別しました。
- Anthropic「Claude Sonnet 5.5」発表
- Claude Platform 日本語モデル概要
- Claude Platform 日本語の新機能と破壊的変更
- Claude Platform 日本語移行ガイド
- Claude Platform API料金
- Claude公式プラン料金
最終更新: