Skip to content
モデル・研究

Anthropic、Claude 3.7 Sonnetの利用状況に関する第2回経済指数レポートを公開

Anthropicは、新たな拡張思考モードやタスク単位の自動化データを含め、Claude 3.7 Sonnetがどのように利用されているかを分析した第2回経済指数レポートを公開した。

DigitalNeuron Desk約1分

ひとことで言うと

Anthropicの第2回経済指数レポートは、Claude 3.7 Sonnetの利用状況について何を明らかにしたのか?

Anthropicの第2回経済指数レポートによると、Claude 3.7 Sonnetの公開後、Claude.aiの利用はコーディング、教育、科学、医療分野で増加した。拡張思考モードは技術系職種で最も多く利用された。利用全体に占める能力拡張型の割合は57%で横ばいとなり、Anthropicは新たに630カテゴリーからなる利用分類体系とタスク単位の自動化データを公開した。

要点

  • Anthropicによると、第1回経済指数レポートとの比較で、Claude 3.7 Sonnetの公開後11日間におけるClaude.aiの利用割合は、コーディング、教育、科学、医療分野で増加した。
  • Anthropicによると、拡張思考モードは技術系タスクで最も多く利用され、コンピューター・情報研究科学者のタスクでは約10%、ソフトウェア開発者のタスクでは約8%を占めた。
  • Anthropicの報告では、Claude.aiの利用に占める能力拡張型の割合は前回と変わらず57%だった一方、学習型のやり取りは約23%から約28%へ増加した。
  • Anthropicは、タスク反復型の利用がコピーライターと編集者のタスクで最も多く、人間の関与を最小限に抑えてモデルが作業を完了する指示型の利用は、翻訳者と通訳者のタスクで特に多かったとしている。
  • Anthropicは、Clio分析ツールで構築した630の利用カテゴリーからなる新たなボトムアップ型分類体系を、タスク・職業単位の自動化型/能力拡張型データセットと併せて公開した。いずれもダウンロードできる。

Anthropicは、AIが労働市場と経済に及ぼす影響についてのデータや研究を定期的に公開する取り組み「Anthropic Economic Index」の第2回レポートを発表した。今回は、Anthropicがエージェント型コーディングに強みを持ち、新たな「拡張思考」モードを備えた同社最新かつ最も高性能なモデルと位置付けるClaude 3.7 Sonnetの公開後に収集された、Claude.aiの利用データを扱っている。

Anthropicが分析した内容

Anthropicによると、Claude 3.7 Sonnetの公開後11日間に行われた、匿名化済みのClaude.ai FreeおよびProの会話100万件を調査した。同社はプライバシーを保護する分析ツール「Clio」を使用し、各会話を米労働省のO*NETデータベースに収録された約1万7,000のタスクのいずれかに対応付けたうえで、職業および職業カテゴリー別の傾向を分析した。

公開後の利用動向の変化

Anthropicによると、コーディング、教育、科学のほか、医療関連の用途を含む複数の職業カテゴリーで、利用割合が緩やかに上昇した。利用割合の絶対的な伸びが最も大きかったのはコンピューター・数学系職種で、3ポイント増加したという。Anthropicは、Claude 3.7 Sonnetのコーディング評価指標が向上したことから、コーディング分野での増加は予想どおりだったとする一方、ほかのカテゴリーでの伸びについては、AIの普及拡大、各分野におけるコーディングの新たな応用、または予想外のモデル能力を反映している可能性があるとしている。

拡張思考モードの利用状況

Anthropicの報告によると、ユーザーが有効にした際に複雑な問いについてモデルがより長く推論できる拡張思考モードは、主に技術的・創造的な場面で利用された。コンピューター・情報研究科学者に関連するタスクが約10%で最多となり、ソフトウェア開発者が約8%、マルチメディア・アーティストが約7%、ビデオゲームデザイナーが約6%で続いたという。Anthropicは、O*NETの各タスクと、それに対応する思考モードの利用状況を関連付けたデータセットをHugging Faceで公開している。

能力拡張と自動化

Anthropicによると、モデルを使って学習したり、モデルと反復的に作業したりする能力拡張型の利用と、モデルにタスクの完了やデバッグを直接行わせる自動化型の利用との全体的な比率は、第1回レポートからほぼ変わらず、能力拡張型が57%を占めた。ユーザーがClaudeに情報や説明を求める学習型のやり取りは、約23%から約28%へ増加したという。Anthropicによると、教育や進路指導を含む地域・社会福祉関連のタスクでは能力拡張型が75%近くに達した一方、生産職とコンピューター・数学系職種ではほぼ半々だった。自動化型が優勢となった職業カテゴリーはなかったとしている。また、人間とモデルが共同で成果物を作成するタスク反復型の利用はコピーライターと編集者のタスクで最も多く、人間の関与を最小限に抑えてモデルが作業を完了する指示型の利用は、翻訳者と通訳者のタスクで特に多かったという。同社によると、学習型のやり取りの割合は司書が約56%で最も高く、タスク反復型ではコピーライターが約58%で首位だった。

新たなボトムアップ型利用分類体系

Anthropicは同じ会話データセットを基にClioで構築した、Claude.aiの利用状況に関する初の試みだというボトムアップ型分類体系も公開している。これは3段階の階層に整理された630の詳細なクラスターで構成され、各クラスターには説明、普及度の指標、自動化型と能力拡張型の内訳が付されている。Anthropicは例として、水管理システムの支援、物理法則に基づくシミュレーション、フォント選定、応募書類、バッテリー技術に関する助言、コード内でのタイムゾーン処理などのクラスターを挙げた。同社によると、両分析の基礎となるデータセットはすべて無料でダウンロードでき、モデルの能力向上に合わせて今後もこれらの指標を追跡する予定だという。Anthropicはまた、社会的影響担当リサーチサイエンティスト、リサーチエンジニア、エコノミストを募集していることも明らかにした。

出典:Anthropic「Anthropic Economic Index: Insights from Claude 3.7 Sonnet」、2025年3月27日公開。

よくある質問

Anthropic Economic Indexとは何か?
Anthropicは、AIが長期的に労働市場と経済へ及ぼす影響について、データや研究を定期的に公開する取り組みと説明している。
第2回レポートでは、どのようなデータを分析したのか?
Anthropicは、Claude 3.7 Sonnetの公開後11日間に行われた、匿名化済みのClaude.ai FreeおよびProの会話100万件を分析した。Clioツールを使い、会話を米労働省のO*NETデータベースに収録されたタスクへ対応付けた。
拡張思考モードについて、Anthropicは何を明らかにしたのか?
Anthropicによると、拡張思考モードは主に技術的・創造的な問題解決タスクで利用され、コンピューター・情報研究科学者が約10%で最多となり、ソフトウェア開発者が約8%で続いた。
AIによる能力拡張と自動化の比率は変化したのか?
Anthropicの報告によると、比率はほぼ変わらず、能力拡張型が利用全体の57%を占めた。ただし、学習型のやり取りはデータ全体の約23%から約28%へ増加した。

出典

  1. Anthropic Economic Index: Insights from Claude 3.7 Sonnet \ AnthropicAnthropic
タグanthropicclaude-3-7-sonneteconomic-indexai-labor-marketextended-thinking-modeusage-data

あわせて読みたい

MiniMaxがサウンドタグと音声クローン機能を備えたSpeech 2.8をリリース

MiniMaxは、息継ぎやためらいを表現するネイティブサウンドタグ、10秒間のサンプルによる音声クローニング、ノイズや歪みの低減を目的とした処理を備えた合成音声モデル「Speech 2.8」を発表しました。同社はまた、中国語(標準語)と日本語の言語横断的な音声生成を改善し、自社プラットフォームおよびAudio製品を通じて同モデルを利用可能にしたと述べています。

約3分

DeepSeekがV4-Flash-Vision-Expマルチモーダルモデルをリリース

DeepSeekは、APIプラットフォーム上で実験的なマルチモーダルモデル「DeepSeek-V4-Flash-Vision-Exp」をリリースしました。同社によると、テキストタスクではDeepSeek-V4-Flashと同等の性能を維持しつつ、画像認識機能を追加しており、マルチモーダルエージェントのベンチマーク性能はV4-Flashから大幅に向上し、Opus-4.8に迫るとしています。DeepSeekはまた、無料のFiles APIとDeepSeek Harness 0.1.1も公開しました。

約2分

コンテキストウィンドウとは何か、そしてなぜ枯渇してしまうのか?

コンテキストウィンドウは、モデルが一度のリクエストで考慮できるテキストの最大量(トークン数で測定)です。システム指示、これまでの会話、貼り付けたドキュメント、生成中の回答を含みます。合計が制限を超えると、何かを削除したり要約したりしなければなりません。

更新 約5分