LONDON (IT BOLTWISE) – Die KI-Entwicklung in sogenannten Frontier-Labs lässt sich künftig anhand messbarer Indikatoren nachvollziehen. Anthropic beschreibt drei Metrikblöcke: wie viel KI-eigene R&D per Automation statt durch Menschen entsteht, wie eng Agenten überwacht werden und wie Rechenleistung auf Sicherheitsarbeit versus andere Forschung aufgeteilt wird. Die Labormessungen sollen öffentlich vergleichbar werden und später durch unabhängige Dritte verifiziert werden. Bis dahin bleibt aber unklar, wie stark sich die Zahlen verändern würden, sobald es eine abgestimmte Strategie zur „Pacing“-Kontrolle gäbe.

Anthropic veröffentlicht Messwerte zur KI-Entwicklung in Frontier-Labs
Anthropic veröffentlicht Messwerte zur KI-Entwicklung in Frontier-Labs (Foto: IT BOLTWISE)
🧠 KI & Robotik auf Google News abonnieren

Die Diskussion um das „Pacing“ der KI-Entwicklung bekommt eine neue Qualität, weil sie nicht mehr nur an Modellfähigkeiten anknüpft, sondern an den Produktionsprozess. Wenn Systeme zunehmend Teile ihrer eigenen Forschung übernehmen, verschiebt sich die Frage vom „Was kann ein Modell?“ hin zu „Wie schnell und mit welcher internen Organisation wird es gebaut?“ Genau dort setzt Anthropic an und stellt Messwerkzeuge vor, die Transparenz über die Entwicklungstempo-Frage in Frontier-Labs schaffen sollen.

Im Kern geht es um drei Messachsen. Erstens quantifiziert Anthropic, wie stark die KI-gestützte Forschung sich selbst beschleunigt: Dafür baut das Unternehmen einen Prototyp-Index, den „Anthropic R& D Automation Index“. Er entsteht durch Katalogisierung verschiedener R& D-Aufgaben und Bewertung, wie automatisiert jede Aufgabe bereits erledigt wird, anschließend werden diese Bewertungen zu einem Gesamtscore aggregiert. Anthropics Skala lehnt sich dabei an „Automation Level“ (AL) an, von AL0 ohne KI-Beteiligung bis AL5, bei dem KI vollständig autonom arbeitet. In den veröffentlichten Snapshot-Werten gilt: Stand August 2026 betreibt keine der gemessenen Teilmengen der KI-gestützten R& D bei Anthropic den Sprung zu echter Vollautonomie. Stattdessen „führt“ Claude 26 % der AI R& D-Arbeiten, während der Anteil auf oder oberhalb von „AI collaborates“ über 90 % liegt. Das ist wichtig, weil es die Autonomie-Hypothese nicht pauschal bestätigt, aber zugleich zeigt, dass Menschen in vielen Teilbereichen faktisch stärker in den Hintergrund treten.

Zweitens adressiert Anthropic die Frage, wie kontrolliert wird, wenn Agenten über lange Zeiträume selbstständig handeln. Das Unternehmen beschreibt ein System zur Überwachung und Intervention in Aktionen von KI-Agenten auf internen Plattformen. Die Darstellung stützt sich auf drei Kennzahlen: Coverage (welcher Anteil der Agentenaktionen vor oder nach der Ausführung durch einen Monitor läuft), Review-Latenz (wie lange zwischen Aktion und Überprüfung vergeht, zunächst automatisiert, dann durch Menschen) sowie Eskalationsrate (wie häufig Aktivitäten blockiert oder für weitere Prüfung markiert werden). Im August-2026-Snapshot geht Anthropic von ungefähr 30.000 Agenten aus, die parallel Research- und Engineering-Aufgaben auf der am häufigsten genutzten internen Plattform abwickeln. Für diese Plattform berichtet das Unternehmen Coverage von 100 % vor der Ausführung durch Online-Monitore und zudem 100 % der Nachverarbeitung durch Offline-Monitore. Die automatisierte Überprüfung passiert vor der Aktion; blockierte Fälle werden durch Menschen innerhalb einer Woche beurteilt. Bei den Eskalationen analysiert Anthropic über eine Milliarde Entscheidungen aus Research- und Engineering-Agenten und kommt auf 0,002 % blockierte Ereignisse (etwa 1 von 47.000). Zusätzlich werden pro Woche rund 100.000 Transkripte getaggt, überwiegend lösen Klassifikatoren und erste Prüfungen die Markierungen auf; die höchste Priorität von ungefähr 50 pro Woche wird dann zur menschlichen Prüfung eskaliert. In Summe wird damit eine konkrete Antwort auf ein häufiges Problem der Agenten-Überwachung gegeben: Selbst wenn Fehlverhalten selten ist, steigt bei großer Agentenanzahl die Wahrscheinlichkeit, dass es regelmäßig auftritt – und genau dafür muss ein Monitoring-Regime skalieren.

Drittens nimmt Anthropic die Ressourcenseite in den Blick. Unter „Measuring compute allocation“ untersucht das Unternehmen einen Snapshot, wie Rechenleistung vom 13. Juli bis zu einem späteren Stichtag im Jahr 2026 eingesetzt wurde, und ordnet Workloads Kategorien zu, um abzuleiten, welcher Anteil von AI R& D als „Safety work“ durchging. Das Unternehmen betont dabei zwei methodische Begrenzungen: Safety-Forschung verbraucht naturgemäß oft weniger Rechenleistung als große Frontier-Trainingsläufe, weil viele Sicherheitsarbeiten stärker experimentell und konzeptionell getrieben sind – und weniger durch massiv skalierte Trainings. Trotzdem eignet sich Compute-Ausrichtung als relativ „verifizierbarer“ Eingangsparameter, gerade weil Compute in einer Pacing-Debatte als Hebel denkbar wäre: Ein koordiniertes Vorgehen könnte etwa dazu führen, dass die Industrie mehr Rechenbudget auf Ausrichtung, Interpretierbarkeit, Sicherheits-Tests und Evaluationen umschichtet. Im betrachteten Zeitraum liegt Anthropics konservativer Schätzwert bei rund 6 % des auf AI R& D entfallenden Compute für Safety-Arbeit; bezogen auf den Teilbereich „AI-driven AI R& D“ sind es etwa 12 %. Zusätzlich weist Anthropic darauf hin, dass diese Zahlen absichtlich konservativ sind: Wenn ein Token gleichermaßen Capability- und Safety-Ziele unterstützt, wird er nicht als Safety gezählt. Außerdem berücksichtigen die Metriken keine separate Compute-Klasse für Safeguards-Klassifikatoren, die das System laut Darstellung noch einmal sicherer machen sollen. Für Entwickler folgt daraus ein praktischer Auftrag: Wer solche Reports veröffentlichen will, muss Kategorien definieren, die Zuordnung transparent halten und die Korrektheit durch unabhängige Dritte prüfen lassen.

Um den Nutzen über das eigene Haus hinaus zu sichern, schlägt Anthropic eine Brücke von internen Zahlen zu vergleichbaren öffentlichen Messungen. Das Unternehmen erklärt, dass es künftig eine stärkere Einbindung unabhängiger Drittanbieter plant, die internen Zugriff erhalten sollen – auf Prozesse, Systeme und Daten, die vergleichbar mit dem sind, was interne Risk-Assessment-Teams nutzen. Ziel ist, dass diese externen Evaluatoren Sicherheitspraktiken verifizieren, Vorfälle berichten und zentrale Kennzahlen überwachen. Gleichzeitig räumt Anthropic zwei Hürden für labübergreifende Vergleiche ein: Es fehlt bisher eine gemeinsame Methodik, und viele Messungen beruhen auf „judge models“, die denselben Typ von Fehlern machen können wie die zu prüfenden Modelle. Als Gegenmaßnahme nennt Anthropic zusätzliche Verifikation durch Dritte oder die Nutzung anderer Modellinstanzen mit Guardrails, um den Austausch wettbewerblich sensibler Daten zu begrenzen. Für Unternehmen und Forschungseinrichtungen heißt das: Transparenz wird hier nicht als reine Absichtserklärung verkauft, sondern als messbarer Prozess – mit klarer Aussage, wo die Unsicherheiten liegen.

Für die Industrie entsteht daraus ein neues Set an Stellschrauben, die über reine Benchmark-Ergebnisse hinausgehen. Wer etwa Agenten in der KI-Entwicklung einsetzt, kann Coverage- und Eskalationsraten als operatives Qualitätskriterium verstehen: Nicht nur, ob Agenten arbeiten, sondern wie schnell Menschen eingreifen und wie häufig Monitore wirklich blockieren oder flaggen. Ebenso könnte „compute allocation“ in künftigen Pacing-Regimen eine Rolle spielen, weil es (trotz der methodischen Grenzen) zeigt, wie viel Budget in Sicherheitsarbeit statt in reine Capability-Forschung fließt. Und schließlich liefert der Automation Index einen Hinweis darauf, ob ein Labor in Richtung stärkerer KI-gestützter R& D umschaltet – ohne dass dafür schon die schwierigste Grenze erreicht sein muss, nämlich KI, die Aufgaben vollständig autonom ausführt. Genau diese Mischung aus Prozess- und Ressourcenmessung macht die Veröffentlichung für den Markt relevant: Sie bietet Ansatzpunkte, um Fortschritt, Risiken und Tempo gemeinsam zu beobachten.


💳 Amazon-Kreditkarte mit 2.000 Euro Limit bestellen!
🔥 Heutige Hot Deals bei Amazon: Bis zu 80% Rabatte!
🎉 Amazon Haul-Store für absolute Schnäppchenjäger!


Sense Robot Go KI-Go-Brett mit Roboterarm – Automatische Steinplatzierung, interaktives Lernen, Spielwiederholung – Intelligenter Weiqi-Trainer für Kinder & Erwachsene
152 Bewertungen
Sense Robot Go KI-Go-Brett mit Roboterarm – Automatische Steinplatzierung, interaktives Lernen, Spielwiederholung – Intelligenter Weiqi-Trainer für Kinder & Erwachsene
  • ★ 23-stufiges KI-Go-Training – Für Spieler mit Grundkenntnissen der Regeln – Entwickelt als intelligenter Trainingspartner passt sich die KI Spielern von 18K bis 9D an. Ideal für alle, die die Grundregeln bereits beherrschen und ihr Spiel verbessern möchten.
ENERGIZE LAB Eiliko Coral Pink - Ihr winziger KI-Charm-Roboter, der zu jedem täglichen Outfit passt, lustiges elektronisches Anhängerspielzeug, für Paare und beste Freunde
334 Bewertungen
ENERGIZE LAB Eiliko Coral Pink - Ihr winziger KI-Charm-Roboter, der zu jedem täglichen Outfit passt, lustiges elektronisches Anhängerspielzeug, für Paare und beste Freunde
  • IHR EMOTIONALER AI-BEGLEITER: Eiliko ist mehr als nur ein Anhänger, es ist ein charismatischer KI-Freund. Mit einem dynamischen LED-Bildschirm, der eine Vielzahl von animierten Gesichtern und Ausdrucksformen anzeigt, reagiert er auf Ihre Interaktionen mit einzigartiger Persönlichkeit und Charme.
Eilik – Interaktiver Desktop Roboter mit Persönlichkeit, lebendigen Animationen & Reaktionen, Touch-Steuerung, Mini-Spiele, emotionaler Roboter Freund und besonderes Geschenk für Kinder & Erwachsene
1.501 Bewertungen
Eilik – Interaktiver Desktop Roboter mit Persönlichkeit, lebendigen Animationen & Reaktionen, Touch-Steuerung, Mini-Spiele, emotionaler Roboter Freund und besonderes Geschenk für Kinder & Erwachsene
  • 【MEHR LEBEN FÜR DEINEN SCHREIBTISCH】 Lerne Eilik kennen – deinen kleinen Roboter-Freund mit Persönlichkeit. Mit liebevollen Animationen, ausdrucksstarken Reaktionen und spielerischen Interaktionen bringt Eilik mehr Freude in deinen Alltag. Ob auf dem Schreibtisch, im Büro oder am Nachttisch – Eilik wird schnell zu einem vertrauten Begleiter für besondere Momente.
Plantbot Upgraded Large Smart Flower Pot Pet Planter Robot with Artificial Intelligence, Time Temperature Display, and Numerous Expressive Animations Based, for Indoor Decoration, Gifts (White)
53 Bewertungen
Plantbot Upgraded Large Smart Flower Pot Pet Planter Robot with Artificial Intelligence, Time Temperature Display, and Numerous Expressive Animations Based, for Indoor Decoration, Gifts (White)
  • 【XL-Größe für gedeihende Pflanzen】Geben Sie Ihren Pflanzen den Raum, den sie verdienen! Unser verbessertes, großes 13,7 cm großes Design bietet Platz für Pflanzen mit einem Durchmesser von bis zu 8,9 cm und damit deutlich mehr Platz für Wurzelwachstum und Pflanzengesundheit im Vergleich zu kleineren, veralteten Modellen. Die Produktabmessungen betragen 13,6 x 13,6 x 13,2 cm und das Gerät wiegt nur 355 g.
Loona KEYI Premium Haustier-Roboter mit Ladestation (Smarte AI ChatGPT-4o, Stimmen- & Gestensteuerung, Echtzeit-Interaktion, Heimüberwachung)
946 Bewertungen
Loona KEYI Premium Haustier-Roboter mit Ladestation (Smarte AI ChatGPT-4o, Stimmen- & Gestensteuerung, Echtzeit-Interaktion, Heimüberwachung)
  • V28 Update - JETZT MIT NEUEN FUNKTIONEN! Als Reaktion auf das Ladeproblem von Loona haben wir das automatische Aufladen 2.0 verbessert. Diese Optimierung hilft Loona, die Ladewege in verschiedenen Szenarien zu erkennen und anzupassen, um die Erfolgsquote beim automatischen Aufladen zu erhöhen. Mobile Hotspots können sich mit Loona verbinden und überwinden WLAN-Einschränkungen, sodass Sie jederzeit und überall mit Loona interagieren können.


Hat Ihnen der Artikel bzw. die News - Anthropic veröffentlicht Messwerte zur KI-Entwicklung in Frontier-Labs - gefallen? Dann abonnieren Sie uns doch auf Insta: AI News, Tech Trends & Robotics - Instagram - Boltwise

Unseren KI-Morning-Newsletter «Der KI News Espresso» mit den besten KI-News des letzten Tages gratis per eMail - ohne Werbung: Hier kostenlos eintragen!





Folgen Sie aktuellen Beiträge über KI & Robotik auf Twitter, Telegram, Facebook oder LinkedIn!
Hinweis: Teile dieses Textes könnten mithilfe Künstlicher Intelligenz generiert worden sein. Die auf dieser Website bereitgestellten Informationen stellen keine Finanzberatung dar und sind nicht als solche gedacht. Die Informationen sind allgemeiner Natur und dienen nur zu Informationszwecken. Wenn Sie Finanzberatung für Ihre individuelle Situation benötigen, sollten Sie den Rat von einem qualifizierten Finanzberater einholen. IT BOLTWISE® schließt jegliche Regressansprüche aus.









Ergänzungen und Infos bitte an die Redaktion per eMail an de-info[at]it-boltwise.de. Da wir bei KI-erzeugten News und Inhalten selten auftretende KI-Halluzinationen nicht ausschließen können, bitten wir Sie bei Falschangaben und Fehlinformationen uns via eMail zu kontaktieren und zu informieren. Bitte vergessen Sie nicht in der eMail die Artikel-Headline zu nennen: "Anthropic veröffentlicht Messwerte zur KI-Entwicklung in Frontier-Labs".
Stichwörter Agent AI Anthropic Artificial Intelligence Automation Automation Level Compute KI Künstliche Intelligenz Model Development Oversight R&D Risk Reporting
Alle Märkte in Echtzeit verfolgen - 30 Tage kostenlos testen!

Du hast einen wertvollen Beitrag oder Kommentar zum Artikel "Anthropic veröffentlicht Messwerte zur KI-Entwicklung in Frontier-Labs" für unsere Leser?

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert

  • Die aktuellen intelligenten Ringe, intelligenten Brillen, intelligenten Uhren oder KI-Smartphones auf Amazon entdecken! (Sponsored)


  • Es werden alle Kommentare moderiert!

    Für eine offene Diskussion behalten wir uns vor, jeden Kommentar zu löschen, der nicht direkt auf das Thema abzielt oder nur den Zweck hat, Leser oder Autoren herabzuwürdigen.

    Wir möchten, dass respektvoll miteinander kommuniziert wird, so als ob die Diskussion mit real anwesenden Personen geführt wird. Dies machen wir für den Großteil unserer Leser, der sachlich und konstruktiv über ein Thema sprechen möchte.

    Du willst nichts verpassen?

    Du möchtest über ähnliche News und Beiträge wie "Anthropic veröffentlicht Messwerte zur KI-Entwicklung in Frontier-Labs" informiert werden? Neben der E-Mail-Benachrichtigung habt ihr auch die Möglichkeit, den Feed dieses Beitrags zu abonnieren. Wer natürlich alles lesen möchte, der sollte den RSS-Hauptfeed oder IT BOLTWISE® bei Google News wie auch bei Bing News abonnieren.
    Nutze die Google-Suchmaschine für eine weitere Themenrecherche: »Anthropic veröffentlicht Messwerte zur KI-Entwicklung in Frontier-Labs« bei Google Deutschland suchen, bei Bing oder Google News!


    933 Leser gerade online auf IT BOLTWISE
    KI-Jobs