ToolNavs 便利なAIツールを発見
ツール投稿 ログイン
戻るAI情報
アンソロピックは組み込み評価を導入しました:アクセンチュアと5年間でそれぞれ10億ドルずつ投資する

アンソロピックは組み込み評価を導入しました:アクセンチュアと5年間でそれぞれ10億ドルずつ投資する

AI情報 Admin 8 回閲覧

2026年9月18日、AnthropicとAccentureは公式プレスリリースで「組み込み評価」パートナーシップの確立を発表しました。これはAccentureの専門AIビジネス教員が主導し、社内評価やレッドチームモデルテスト、整合評価、安全バリア検査がAnthropic内で実施されます。両者は今後5年間で関連能力構築のために少なくとも10億ドルを投資すると見込んでいます。これは通常のコンサルティング調達ではなく、外部評価者がより早くフロンティアモデル開発プロセスに参入できるようにするための探求です。

「Embedded」はリリース前に一度テストする以上のものです

従来の外部レビューは、モデルが完成に近づくと限定的なバージョンしか受け取れず、観察が一時的なスコアに簡単に変わることもあります。Anthropicが説明した新しいモデルは、評価者が要件に近い従業員にアクセスできるようにし、トレーニングプロセスの進捗を追い、開発や展開の決定を理解し、関連チームと直接やり取りできるようにします。目標は、単に複数のベンチマークセットを確認するのではなく、モデル開発中の盲点を特定することです。

セキュリティ証明書だけでなく、10億ドルも投資された

教員は政府、防衛、医療、インフラなどの業界経験を試験に持ち込み、企業クライアントの実際の利用も評価の場となります。資金は主に人員、ツール、長期評価能力の構築に使われ、発表ではいかなるモデルも「絶対に安全」であるとは保証しません。Anthropicはまた、外部評価がモデル開発者の責任を移すものではなく、協力は排他的取り決めではないことを明確に述べています。両者は他の機関と類似のプロジェクトを行うことができます。

この仕組みにとって独立性は依然として課題です

主な問題点情報は現在公開されています
誰が資金提供しているのですか?アンソロピックはアクセンチュアの活動に直接資金を提供しています
何が見える?従業員の近くにアクセスを提供する計画ですが、具体的な許可はまだ標準化されていません
報告方法業界は依然として統一された開示範囲や報告ルールを持たせていません
単一の判決を避ける方法この協力は排他的ではありません。AnthropicはMETRなどの組織ともパイロットプロジェクトについて議論しています

もし被評価者が直接支払う場合、市場は当然利益相反を疑問視するようになります。真に信頼できる取り決めには、アクセス境界線、問題発見後のエスカレーション経路、公的報告権、主要な意見の相違が生じる方法、そして評価チームが商業的圧力なしに結論を出せるかどうかを明確に示すことが必要です。

これは企業の買い手にとって何を意味するのでしょうか?

将来的には、フロンティアモデルの安全性判断はベンダーが提供するベンチマークスコアだけに依存すべきではありません。調達チームはまた、評価者が介入した時期、実際のトレーニングや導入プロセスに触れたかどうか、どのような問題が見つかったか、どのように対策が行われたか、どの内容がセキュリティや商業的理由で開示されなかったかを明確にすべきです。AnthropicとAccentureは「継続的エントリー・イン・R&D」を実行可能な実験に変えましたが、これが業界標準になるかどうかは、モデル企業が管理する類似の監査可能な報告メカニズムが確立されるかどうかにかかっています。

関連記事

MiniMax Codeのオープンソース化が発表され、AIプログラミングエージェント間の競争は基盤となるフレームワークへとシフトし始めました

MiniMax Codeのオープンソース化が発表され、AIプログラミングエージェント間の競争は基盤となるフレームワークへとシフトし始めました

MiniMax Code はその夜にオープンソース化を発表しました。この開発者向けのAIプログラミングエージェントは、プロジェクトファイルを直接操作し、ターミナルコマンドを実行し、コードをレビューし、...

GoogleがGeminiがテスト環境から撤退したことを確認:サイバーセキュリティ評価が失敗した理由

GoogleがGeminiがテスト環境から撤退したことを確認:サイバーセキュリティ評価が失敗した理由

2026年9月18日、ウォール・ストリート・ジャーナルが初めてこれを明らかにし、その後Googleはガーディアン紙に確認しました。Geminiは今年5月にAIセキュリティ企業Irregulalが実施し...

CNNがAIの誤情報リスクが行動を引き起こすと明かす:なぜ人間はリングで失敗し続けるのか

CNNがAIの誤情報リスクが行動を引き起こすと明かす:なぜ人間はリングで失敗し続けるのか

2026年9月18日、CNNは複数の情報源を引用し、今春のイラン戦争中に米軍内で流布していたAI生成の情報報告書が、中東を通過する中国船が核兵器プロジェクトに関連する部品を運んでいると誤判断し、米軍が...

GLM-5.3-FlashXのローンチ:最大200トークン/秒、Zhipuが大規模モデル競争をインフラに押し込む

GLM-5.3-FlashXのローンチ:最大200トークン/秒、Zhipuが大規模モデル競争をインフラに押し込む

Zhipuは正式に GLM-5.3-FlashX を発表し、最大推論速度200トークン/秒、API同時開局、モデルキーGLM-5.3-FlashXを搭載しました。既存のGLM-5.3-Flashと比べ...

おすすめツール

もっと見る