Anthropic、Accentureと組み込み型評価で提携 - 社内に評価者を置く構想を具体化
Anthropicが2026年9月18日、Accentureの専門AI事業Facultyが主導する組み込み型評価の提携を発表した。社員並みのアクセスでモデルの評価・レッドチーミング・セーフガード検証を行う。両社は今後5年でそれぞれ10億ドル以上の投資を見込み、提携は非独占としている。
Anthropicは2026年9月18日、フロンティアAIの独立評価でAccentureと提携すると発表し、CEOのエッセイで示した「評価者を社内に組み込む」というコミットメントに向けた一歩だと位置づけた1。
- 体制と役割: Accentureの専門AI事業であるFacultyが主導し、モデルの評価とレッドチーミング、アラインメント評価、セーフガードの検証を担う。評価者は社員に匹敵するアクセスを持ち、訓練中のモデルや構築・展開の意思決定を追い、社員と直接話せるとされる
- 投資と資金: 両社は今後5年でこの分野の体制構築にそれぞれ少なくとも10億ドルを投資する見込み。Accentureの作業にはAnthropicが直接資金を出し、METRなど非営利の評価者とは、それぞれの自己資金で要素を試行する方向で対話している
- 非独占: Anthropicは今後数週間で別の評価者も発表するとし、Accentureも他のAI開発企業と同様の立場で働くという
発端は、Dario Amodei氏が9月12日に公開したエッセイ「We Must Pace the Frontier」で、第三者の評価者チームに従業員並みのアクセスを与えることにAnthropicが単独でコミットすると表明したことだった。今回はその具体化にあたる。一方でAnthropicは、評価者がどの情報にアクセスし、所見をどう報告するかの標準はまだなく、運用の詳細の多くは詰めている段階だとも書いている1。TechCrunchは、組み込み型評価をめぐる議論がMETRやRedwood Researchのような安全性研究組織を中心に語られてきたなかで、コンサルティング大手が選ばれたことは多くの観察者を驚かせたと伝えている2。モデルを業務に組み込む企業から見ると、提供元の安全性の主張を外部がどう検証するかの具体例であり、評価結果がどの形で公開されるかが次の焦点になる。
Sources
- Partnering with Accenture on embedded evaluation - Anthropic公式発表(2026年9月18日)
- Anthropic’s first embedded evaluator is … Accenture? - TechCrunch(2026年9月18日)
この記事は役に立ちましたか?
ありがとうございます!
受け取りました。ありがとうございます!