ToolNavs KI-Tools entdecken
Tool einreichen Anmelden
Zurück zu KI-Informationen
Anthropic führte eingebettete Bewertung ein: Je 1 Milliarde Dollar über fünf Jahre mit Accenture zu investieren

Anthropic führte eingebettete Bewertung ein: Je 1 Milliarde Dollar über fünf Jahre mit Accenture zu investieren

KI-Informationen Admin 8 Aufrufe

Am 18. September 2026 gaben Anthropic und Accenture in offiziellen Pressemitteilungen die Einrichtung einer "Embedded Assessment"-Partnerschaft bekannt: Geleitet von der professionellen KI-Fakultät von Accenture werden interne Bewertungen sowie Red-Team-Modelltests, Ausrichtungsbewertungen und Sicherheitsbarriereninspektionen innerhalb von Anthropic durchgeführt. Beide Parteien erwarten, in den nächsten fünf Jahren mindestens eine Milliarde US-Dollar in den Aufbau entsprechender Fähigkeiten zu investieren. Dies ist keine routinemäßige Beratungsbeschaffung, sondern eine Erkundung, externe Evaluatoren frühzeitig in den Modellentwicklungsprozess der Grenze einzusteigen.

"Embedded" ist weit mehr als nur einmal vor der Veröffentlichung zu testen

Traditionelle externe Bewertungen erhalten in der Regel begrenzte Versionen, wenn das Modell sich dem Abschluss nähert, und Beobachtungen können leicht zu einmaligen Werten werden. Das von Anthropic beschriebene neue Modell gibt den Evaluatoren Zugang zu Mitarbeitern, die nahe an den Anforderungen sind, sodass sie den Schulungsprozess verfolgen, Entwicklungs- und Bereitstellungsentscheidungen verstehen und direkt mit relevanten Teams interagieren können. Das Ziel ist es, während der Modellentwicklung blinde Flecken zu identifizieren, anstatt nur mehrere Benchmark-Sätze vor der Einführung zu überprüfen.

Eine Milliarde Dollar wurde nicht nur in ein Wertpapierzertifikat investiert

Die Fakultät wird Industrieerfahrung aus Regierung, Verteidigung, Gesundheitswesen und Infrastruktur in den Test einbringen, und die tatsächliche Nutzung durch Unternehmenskunden dient ebenfalls als Bewertungskontext. Die Finanzierung wird hauptsächlich für den Aufbau von Personal, Werkzeugen und Langzeitbewertungskapazitäten verwendet, und die Ankündigung verspricht nicht, dass ein Modell daher "absolut sicher" ist. Anthropic stellt außerdem klar fest, dass externe Bewertungen die Verantwortung nicht von den Modellentwicklern abwälzen und die Zusammenarbeit keine exklusive Vereinbarung ist; beide Parteien können ähnliche Projekte mit anderen Institutionen durchführen.

Die Unabhängigkeit bleibt für diesen Mechanismus eine Herausforderung

Zentrale ThemenInformationen sind derzeit öffentlich
Wer finanziert das?Anthropic finanziert direkt Accentures Arbeit
Was kannst du sehen?Der Plan sieht vor, Zugang in der Nähe der Mitarbeiter zu gewähren, aber spezifische Berechtigungen sind noch nicht standardisiert
Wie man meldetDer Branche fehlen weiterhin einheitliche Offenlegungsumfangs- und Berichtsregeln
Wie man ein einzelnes Urteil vermeidetDie Zusammenarbeit ist nicht exklusiv; Anthropic diskutiert außerdem Pilotprojekte mit Organisationen wie METR

Wenn die bewertete Partei direkt zahlt, veranlasst dies den Markt natürlich, Interessenkonflikte zu hinterfragen. Eine wirklich glaubwürdige Vereinbarung erfordert klare Angabe von Zugangsgrenzen, Eskalationspfaden nach Problementdeckung, Melderechten, wie größere Meinungsverschiedenheiten entstehen und ob das Bewertungsteam ohne kommerziellen Druck Schlussfolgerungen treffen kann.

Was bedeutet das für Unternehmenskäufer?

In Zukunft sollte die Beurteilung der Sicherheit von Frontier-Modellen nicht mehr ausschließlich auf den von Anbietern bereitgestellten Benchmark-Scores abhängen. Beschaffungsteams sollten außerdem klarstellen: Wann Evaluatoren eingegriffen haben, ob sie mit echten Schulungs- und Bereitstellungsprozessen konfrontiert wurden, welche Probleme festgestellt wurden, wie die Behebung durchgeführt wurde und welche Inhalte aus Sicherheits- oder kommerziellen Gründen nicht offengelegt wurden. Anthropic und Accenture haben den "kontinuierlichen Eintritt in F&E" in ein ausführbares Experiment verwandelt, aber ob dies zum Industriestandard werden kann, hängt davon ab, ob ein vergleichbarer, auditierbarer Berichtsmechanismus etabliert wird, der von Modellfirmen kontrolliert wird.

Empfohlene Tools

Mehr