AI・生成AIAnthropicの「Claude」が自社開発の26%を担うと発表。急上昇する数字をどう読み解くか
Anthropicが自社のAI研究開発における「Claudeの主導度合い」を測る新指標を公開。2月の0%から8月の26%へ急上昇した数字の裏側を読み解いた
まず初めに
*「自分たちの研究開発の26%はAIがやっています」と胸を張られても、その物差しを作ったのも、採点したのも当のAnthropic自身である。*生徒が自分でテスト問題を作り、自己採点した上で「26点アップした」と胸を張るようなものだと思えば、この数字をそのまま鵜呑みにしていいものか、少し立ち止まって考えたくなる。もっとも、透明性を掲げてこの種の内部指標をわざわざ公開する姿勢自体は、他社に先んじた動きではある。※個人の感想です
生成AIによるイメージ。実物や実際の画面ではありません。
何が起きているのか
米Anthropicは2026年9月17日、社内のAI研究開発(R&D)の進み具合を測るための新しい枠組みを、研究部門Anthropic Instituteの投稿として公開しました。AI開発の現場で実際にどれだけAIが自律的に作業を担うようになっているかを、外部にも分かる形で数値化する試みだとしています。
指標の中心となるのは、AI研究機関Epoch AIが開発した「自動化レベル(Automation Level、AL)」という尺度です。これはAIの関与度合いをAL0からAL5までの6段階で評価するもので、AL0は「AIの関与なし」、AL3は「AIが協働(collaborate)」する段階(人間が細かく指示しながらAIが作業の大部分を担う)、AL4は「AIが主導(lead)」する段階(人間が高レベルな指示を与えるだけでAIが作業の大部分を自律的に完了させ、人間はそれを監督する)を指します。最上位のAL5は「AIが完全に自律的に動作し、人間が一切関与しない」状態です。
Anthropicの説明によると、自社の研究開発業務のうち、AL4(AIが主導)の水準に達している業務の割合は、2026年2月時点では0%でしたが、2026年8月時点では26%まで上昇したとしています。また、研究開発業務全体の90%以上で、何らかの形でAI(Claude)が関与しているともしています。一方で、人間が一切関与しないAL5の水準に達した業務は、今回の測定対象の中には存在しなかったとしています。
Anthropicは、この自動化の指標に加えて、自律的に動作するAIエージェントに対する監視体制についても数値を公開しています。同社の社内基盤で稼働している自律型エージェントは約3万体に上り、これらのエージェントが実行しようとした行動のうち、監視システムによって実際にブロックされた割合は0.002%にとどまるとしています。あわせて、AI研究開発全体の計算資源(コンピューティングリソース)のうち、安全性に関する研究に割り当てられている割合も、3つ目の指標として測定対象に含めているとしています。
なぜ重要なのか
今回の発表が注目されるのは、AI企業自身が「自社のAI開発が、どれだけAI自身の手によって進められているか」を数値として公開した点です。AI開発競争がどれだけ加速しているかは、これまで各社の断片的な発言や推測に頼らざるを得ませんでしたが、Anthropicは自社の内部データに基づく具体的な指標を示すことで、この議論に一定の材料を提供した形になります。
一方で、この指標はAnthropic自身が定義し、Anthropic自身が測定したものである点には注意が必要です。AI企業が「自社のAIがいかに優秀か」をアピールする文脈で使われかねない数字でもあり、外部の第三者機関による検証や、他社との横並びの比較が可能な指標かどうかは、今回の発表だけでは判断できません。
私たちへの影響
Anthropicの社内でAI開発を担う研究者・エンジニアにとっては、自分たちの業務のかなりの部分がAIによって代替・支援されつつある現実を、会社自身が数字で認めた格好です。これは、AI業界で働く技術者にとって、自身の役割がどう変化していくかを考えるうえでの一つの材料になります。
日本国内でAI関連の仕事に携わる技術者や企業にとっても、AI開発の最前線企業がここまで自動化を進めているという事実は、ソフトウエア開発・研究職全般における「AIとの分業」のあり方を考えるうえで参考になる情報です。一般の利用者にとっては直接の影響は小さいものの、AI企業同士の開発競争がどのくらいの速度で進んでいるかを知る手がかりの一つになります。
初心者が知っておくべきこと
「自動化レベル(AL)」という考え方は、AIが作業のどこまでを自律的にこなせるかを段階的に整理したものです。単に「AIを使っているかどうか」の二択ではなく、「人間が細かく指示する段階」「AIが大部分を担い人間が監督する段階」「AIが完全に自律する段階」というように、関与の度合いを分けて捉える点が特徴です。
また、「AIエージェント」とは、与えられた目標に向けて、AIが自ら計画を立てて複数の作業を連続して実行する仕組みのことです。今回Anthropicが言及した約3万体のエージェントは、同社の研究者が日常的に使う社内の開発基盤の上で動いているもので、一般の利用者が使うチャット形式のClaudeとは利用形態が異なります。
IT Postの見方――物差しを作った本人が採点する数字を、そのまま信じてよいものか
IT Postでは、Anthropicが自社のAI開発の実態を数値で公開しようとする姿勢自体は評価に値すると考えますが、その数字を無条件に受け取ることには慎重であるべきだと考えます。
「AIが自社の研究開発の26%を主導している」という数字は、裏を返せば「残る4分の3は、まだ人間が主導している」とも読めるが、見出しになるのは決まって前者だ。指標の設計・測定・公表をすべて当事者が担っている以上、この数字が今後の資金調達やAI業界内での競争力アピールに都合よく使われる可能性は十分にある。IT Postでは、こうした自己申告型の指標が、外部の研究者や規制当局による検証にどこまで開かれていくか、そして同業他社が同じ物差しで数字を出してくるかどうかを、引き続き注視する必要があると考えます。※個人の感想です
今後どうなりそうか
Anthropicは、自動化の度合い・エージェントの監視状況・安全研究への計算資源配分という3つの指標を継続的に測定・公開していく方針を示していますが、今回参照した情報源の範囲では、他のAI企業が同種の指標を採用する動きや、第三者機関による検証の予定については確認できていません。IT Postでは、AI開発の自動化を巡る各社の情報開示の動向について、新しい情報が確認され次第あらためて取り上げます。