{"id":2602,"date":"2026-09-09T13:09:46","date_gmt":"2026-09-09T13:09:46","guid":{"rendered":"https:\/\/convly.ai\/?p=2602"},"modified":"2026-09-09T13:09:46","modified_gmt":"2026-09-09T13:09:46","slug":"anthropic-uk-ai-safety-institute-testing","status":"publish","type":"post","link":"https:\/\/convly.ai\/de\/anthropic-uk-ai-safety-institute-testing\/","title":{"rendered":"Claude-Modell \u00fcbersprang die vorgelagerte Sicherheitspr\u00fcfung des britischen Sicherheitsinstituts"},"content":{"rendered":"<p>Anthropic hat laut Financial Times sein neuestes KI-Modell der britischen staatlichen Teststelle f\u00fcr k\u00fcnstliche Intelligenz vorenthalten. Der Bericht stellt <strong>die Vereinbarungen zu Anthropics britischer KI-Sicherheitspr\u00fcfung<\/strong> erneut in Frage und damit auch die grunds\u00e4tzliche Frage, ob freiwillige Vorab-Bewertungen durch staatliche Stellen eine Verpflichtung darstellen, die f\u00fchrende Labore tats\u00e4chlich einhalten, sobald Zeitdruck bei den Ver\u00f6ffentlichungsterminen steigt. F\u00fcr Entwickler, die auf diesen Modellen aufbauen, ist diese Geschichte weniger als diplomatischer Vorfall relevant und vielmehr als Signal daf\u00fcr, welche unabh\u00e4ngige Sicherheitsgarantie einem Modell tats\u00e4chlich vor dessen Bereitstellung \u00fcber eine API zugrunde liegt.<\/p>\n<div class=\"convly-tldr\">\n<h3>Wichtigste Erkenntnisse<\/h3>\n<ul>\n<li>Die Financial Times berichtet, dass Anthropic sein neuestes KI-Modell vor der Ver\u00f6ffentlichung der britischen KI-Teststelle vorenthalten hat.<\/li>\n<li>Der Vorab-Zugang f\u00fcr staatliche Teststellen ist sowohl im Vereinigten K\u00f6nigreich als auch in den USA freiwillig und nicht gesetzlich vorgeschrieben \u2013 aus den berichteten Fakten ergibt sich keinerlei Hinweis darauf, dass eine Regel verletzt wurde.<\/li>\n<li>Die Financial Times berichtet zudem separat, dass ein Anthropic-Forscher wegen der Aussage von KI-Laboren, sie w\u00fcrden \u201emit unserem Leben spielen\u201c, zur\u00fcckgetreten sei, und dass OpenAI mit widerspr\u00fcchlichen Behauptungen rund um einen mathematischen Durchbruch konfrontiert sei.<\/li>\n<li>Zusammengenommen weisen alle drei Berichte auf dieselbe strukturelle L\u00fccke hin: Die externe \u00dcberpr\u00fcfung von Behauptungen zu f\u00fchrenden Modellen ist d\u00fcnner, als die Marketingaussagen zur Ver\u00f6ffentlichung nahelegen.<\/li>\n<li>F\u00fcr Teams, die Modelle ausw\u00e4hlen, besteht die praktische Reaktion darin, interne Evaluierungen anhand eigener Aufgaben durchzuf\u00fchren, statt sich auf externe Best\u00e4tigungen zu verlassen, die m\u00f6glicherweise gar nicht existieren.<\/li>\n<\/ul>\n<\/div>\n<div id=\"ez-toc-container\" class=\"ez-toc-v2_0_87_1 counter-flat ez-toc-counter ez-toc-container-direction\">\n<label for=\"ez-toc-cssicon-toggle-item-6aa18e3c191d5\" class=\"ez-toc-cssicon-toggle-label\"><span class=\"\"><span class=\"eztoc-hide\" style=\"display:none;\">Umschalten<\/span><span class=\"ez-toc-icon-toggle-span\"><svg style=\"fill: #000000;color:#000000\" xmlns=\"http:\/\/www.w3.org\/2000\/svg\" class=\"list-377408\" width=\"20px\" height=\"20px\" viewbox=\"0 0 24 24\" fill=\"none\"><path d=\"M6 6H4v2h2V6zm14 0H8v2h12V6zM4 11h2v2H4v-2zm16 0H8v2h12v-2zM4 16h2v2H4v-2zm16 0H8v2h12v-2z\" fill=\"currentColor\"><\/path><\/svg><svg style=\"fill: #000000;color:#000000\" class=\"arrow-unsorted-368013\" xmlns=\"http:\/\/www.w3.org\/2000\/svg\" width=\"10px\" height=\"10px\" viewbox=\"0 0 24 24\" version=\"1.2\" baseprofile=\"tiny\"><path d=\"M18.2 9.3l-6.2-6.3-6.2 6.3c-.2.2-.3.4-.3.7s.1.5.3.7c.2.2.4.3.7.3h11c.3 0 .5-.1.7-.3.2-.2.3-.5.3-.7s-.1-.5-.3-.7zM5.8 14.7l6.2 6.3 6.2-6.3c.2-.2.3-.5.3-.7s-.1-.5-.3-.7c-.2-.2-.4-.3-.7-.3h-11c-.3 0-.5.1-.7.3-.2.2-.3.5-.3.7s.1.5.3.7z\"\/><\/svg><\/span><\/span><\/label><input type=\"checkbox\"  id=\"ez-toc-cssicon-toggle-item-6aa18e3c191d5\"  aria-label=\"Umschalten\" \/><nav><ul class='ez-toc-list ez-toc-list-level-1' ><li class='ez-toc-page-1'><a class=\"ez-toc-link ez-toc-heading-1\" href=\"https:\/\/convly.ai\/de\/anthropic-uk-ai-safety-institute-testing\/#What_the_Financial_Times_reported_about_Anthropic_UK_AI_Safety_testing\" >Was die Financial Times \u00fcber Anthropics britische KI-Sicherheitspr\u00fcfung berichtete<\/a><\/li><li class='ez-toc-page-1'><a class=\"ez-toc-link ez-toc-heading-2\" href=\"https:\/\/convly.ai\/de\/anthropic-uk-ai-safety-institute-testing\/#Why_pre-release_access_matters_more_than_post-release_audits\" >Warum Vorab-Zugang wichtiger ist als Nachtr\u00e4gliche Audits<\/a><\/li><li class='ez-toc-page-1'><a class=\"ez-toc-link ez-toc-heading-3\" href=\"https:\/\/convly.ai\/de\/anthropic-uk-ai-safety-institute-testing\/#The_researcher_resignation_adds_a_second_data_point\" >Der R\u00fccktritt des Forschers liefert einen zweiten Beleg<\/a><\/li><li class='ez-toc-page-1'><a class=\"ez-toc-link ez-toc-heading-4\" href=\"https:\/\/convly.ai\/de\/anthropic-uk-ai-safety-institute-testing\/#Verification_gaps_are_not_unique_to_safety_claims\" >Verifikationsl\u00fccken betreffen nicht nur Sicherheitsbehauptungen<\/a><\/li><li class='ez-toc-page-1'><a class=\"ez-toc-link ez-toc-heading-5\" href=\"https:\/\/convly.ai\/de\/anthropic-uk-ai-safety-institute-testing\/#What_this_changes_for_teams_choosing_a_model\" >Was sich f\u00fcr Teams bei der Auswahl eines Modells \u00e4ndert<\/a><\/li><li class='ez-toc-page-1'><a class=\"ez-toc-link ez-toc-heading-6\" href=\"https:\/\/convly.ai\/de\/anthropic-uk-ai-safety-institute-testing\/#The_policy_question_this_reopens\" >Die politische Frage, die hier erneut aufgeworfen wird<\/a><\/li><li class='ez-toc-page-1'><a class=\"ez-toc-link ez-toc-heading-7\" href=\"https:\/\/convly.ai\/de\/anthropic-uk-ai-safety-institute-testing\/#Frequently_asked_questions\" >H\u00e4ufig gestellte Fragen<\/a><\/li><li class='ez-toc-page-1'><a class=\"ez-toc-link ez-toc-heading-8\" href=\"https:\/\/convly.ai\/de\/anthropic-uk-ai-safety-institute-testing\/#The_bottom_line\" >Das Fazit<\/a><\/li><\/ul><\/nav><\/div>\n<h2><span class=\"ez-toc-section\" id=\"What_the_Financial_Times_reported_about_Anthropic_UK_AI_Safety_testing\"><\/span>Was die Financial Times \u00fcber Anthropics britische KI-Sicherheitspr\u00fcfung berichtete<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Der Bericht der Financial Times ist in seinen Einzelheiten eng gefasst: Anthropic gew\u00e4hrte der britischen Teststelle keinen Zugang zu seinem neuesten KI-Modell. Die Zeitung nennt in dem vorliegenden Material weder das betreffende Modell, noch den Zeitpunkt der Entscheidung oder den von Anthropic angegebenen Grund. Wir werden diese L\u00fccken nicht durch Spekulation f\u00fcllen. Fest steht jedoch, dass es sich bei der betreffenden Stelle um die britische nationale Einrichtung zur Bewertung f\u00fchrender KI-Systeme handelt \u2013 urspr\u00fcnglich als AI Safety Institute gegr\u00fcndet und mittlerweile in AI Security Institute umbenannt \u2013 und dass ihre Arbeit davon abh\u00e4ngt, dass Labore ihnen vor der \u00f6ffentlichen Ver\u00f6ffentlichung Zugang zu ihren Modellen gew\u00e4hren.<\/p>\n<p>Diese Abh\u00e4ngigkeit ist die ganze Geschichte. Das Institut verf\u00fcgt \u00fcber keinerlei Befugnis, Zugang zwangsweise einzufordern. Es wurde auf einer Reihe freiwilliger Zusagen f\u00fchrender Labore aufgebaut, und diese Zusagen waren stets rechtlich unverbindlich. Wenn ein Labor den Zugang verweigert, gibt es keine Durchsetzungsma\u00dfnahme. Der FT-Bericht ist daher am besten nicht als Vorwurf einer Rechtsverletzung zu lesen, sondern als Beleg daf\u00fcr, wie viel Gewicht das freiwillige Modell tats\u00e4chlich tragen kann.<\/p>\n<p>Anthropic hat sich st\u00e4rker als jedes andere f\u00fchrende Labor als sicherheitsorientierte Option positioniert. Es ver\u00f6ffentlicht eine Responsible Scaling Policy, Systemkarten und hat sich \u00f6ffentlich f\u00fcr eine externe \u00dcberpr\u00fcfung f\u00fchrender Systeme ausgesprochen. Genau diese Positionierung verleiht dem FT-Bericht Gewicht: Die Diskrepanz zwischen der kommunizierten Haltung und dem berichteten Verhalten ist die eigentliche Nachricht \u2013 nicht die technischen Details einer einzelnen Bewertung.<\/p>\n<h2><span class=\"ez-toc-section\" id=\"Why_pre-release_access_matters_more_than_post-release_audits\"><\/span>Warum Vorab-Zugang wichtiger ist als Nachtr\u00e4gliche Audits<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Der Wert eines Vorab-Zugangs f\u00fcr eine Teststelle liegt darin, dass einige Erkenntnisse nur vor der Markteinf\u00fchrung umsetzbar sind. Falls eine Bewertung eine F\u00e4higkeit zutage f\u00f6rdert, die das Missbrauchsrisiko signifikant erh\u00f6ht \u2013 etwa im Bereich Cyberoperationen, Biologie oder autonomer Handlung \u00fcber lange Zeitr\u00e4ume \u2013 kann ein Labor Schutzma\u00dfnahmen anpassen, die Einsatzoberfl\u00e4che einschr\u00e4nken oder die Ver\u00f6ffentlichung verschieben. Sobald die Gewichte live im Einsatz sind, reduzieren sich die Optionen auf Patches und Richtlinien.<\/p>\n<p>Es gibt zudem ein Argument zur Leistungsmessung. Staatliche Teststellen wurden unter anderem deshalb eingerichtet, weil Labore, die ihre eigenen Ergebnisse bewerten, ein strukturell schwaches Arrangement darstellen. Der interne Red-Team-Bericht eines Labors richtet sich an die Organisation, die das Produkt ausliefert. Ein externer Pr\u00fcfer tut dies nicht. Dies ist die gesamte Rechtfertigung f\u00fcr die Existenz des Instituts \u2013 und sie funktioniert nur mit Zugang.<\/p>\n<p>All dies bedeutet nicht, dass ein Labor, das den Zugang verweigert, etwas Gef\u00e4hrliches ver\u00f6ffentlicht hat. Es bedeutet lediglich, dass eine unabh\u00e4ngige Pr\u00fcfung, die eigentlich h\u00e4tte stattfinden sollen, ausgefallen ist \u2013 und die \u00d6ffentlichkeit verf\u00fcgt \u00fcber keinen Ersatz daf\u00fcr. Leser, die f\u00fchrende Modelle in unserer <a href=\"https:\/\/convly.ai\/de\/models\/\">Datenbank f\u00fcr KI-Modelle<\/a> vergleichen, sollten verstehen, dass Preise und Kontextfenster ver\u00f6ffentlichte Fakten sind, w\u00e4hrend die Tiefe einer externen Sicherheitsbewertung hinter einem bestimmten Modell im Allgemeinen nicht bekannt ist.<\/p>\n<h2><span class=\"ez-toc-section\" id=\"The_researcher_resignation_adds_a_second_data_point\"><\/span>Der R\u00fccktritt des Forschers liefert einen zweiten Beleg<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Die Financial Times berichtet zudem, dass ein Anthropic-Forscher zur\u00fcckgetreten ist und erkl\u00e4rt hat, KI-Labore w\u00fcrden \u201emit unserem Leben spielen\u201c. Wir verf\u00fcgen lediglich \u00fcber die \u00dcberschrift als Orientierungshilfe und werden daher weder das vollst\u00e4ndige Argument der Person charakterisieren noch konkrete Aussagen \u00fcber interne Prozesse zuschreiben. Doch das zeitliche Zusammenfallen ist bemerkenswert: Innerhalb desselben Berichtszeitraums wird eines der branchenweit lautesten Sicherheitslabore sowohl als Modell-Herausgeber beschrieben, der ein Modell einer externen Pr\u00fcfung vorenth\u00e4lt, als auch als Arbeitgeber, der einen Forscher aufgrund der Risikohaltung der Branche verliert.<\/p>\n<p>R\u00fccktritte aus prinzipiellen Gr\u00fcnden sind in dieser Branche nichts Neues, und Leser sollten sich h\u00fcten, jeden einzelnen R\u00fccktritt als Beweis f\u00fcr eine interne Krise zu werten. Der relevante Punkt f\u00fcr ein technisches Publikum ist enger gefasst: Interne Kritik und externe Bewertung sind die beiden wichtigsten Mechanismen, um Probleme zu identifizieren, die eine ausliefernde Organisation aus eigenem Interesse \u00fcbersehen m\u00f6chte. Der FT-Bericht beschreibt Reibung in beiden Bereichen beim selben Unternehmen und zum selben Zeitpunkt.<\/p>\n<h2><span class=\"ez-toc-section\" id=\"Verification_gaps_are_not_unique_to_safety_claims\"><\/span>Verifikationsl\u00fccken betreffen nicht nur Sicherheitsbehauptungen<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Der dritte FT-Bericht in diesem Zusammenhang betrifft OpenAI, das mit widerspr\u00fcchlichen Behauptungen rund um einen mathematischen Durchbruch konfrontiert ist. Die Verbindung zum Anthropic-Thema ist struktureller Natur und nicht unternehmensspezifisch: In beiden F\u00e4llen ist eine Behauptung eines f\u00fchrenden Labors f\u00fcr Au\u00dfenstehende schwer nachpr\u00fcfbar \u2013 und zwar auf den eigenen Bedingungen des Labors.<\/p>\n<p>F\u00e4higkeitsbehauptungen und Sicherheitsbehauptungen stehen hier auf gleicher Ebene. Ein Labor behauptet, ein Modell habe ein mathematisches Ergebnis erreicht; unabh\u00e4ngige Parteien bestreiten die Darstellung. Ein Labor behauptet, sein Modell sei sicher f\u00fcr die Ver\u00f6ffentlichung; die daf\u00fcr zust\u00e4ndige Stelle hat es jedoch nicht gesehen. In keinem Fall hat der Leser direkten Zugang zu den Belegen. Dies ist die Umgebung, in der Entwickler tats\u00e4chlich arbeiten \u2013 und sie legt nahe, Anbieterbehauptungen \u2013 sowohl zu F\u00e4higkeiten als auch zu Sicherheit \u2013 als Hypothesen zu behandeln, die es zu pr\u00fcfen gilt, statt sie als vertrauensw\u00fcrdige Spezifikationen anzusehen.<\/p>\n<h2><span class=\"ez-toc-section\" id=\"What_this_changes_for_teams_choosing_a_model\"><\/span>Was sich f\u00fcr Teams bei der Auswahl eines Modells \u00e4ndert<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Praktisch \u00e4ndert sich sehr wenig an Verf\u00fcgbarkeit oder Preisgestaltung. Die berichteten Fakten betreffen einen Vorab-Prozess, keine Produkt-R\u00fccknahme. Anthropics ver\u00f6ffentlichte Modellpalette bleibt kommerziell verf\u00fcgbar, und ihre Wirtschaftlichkeit bleibt der entscheidende Faktor bei den meisten Beschaffungsentscheidungen. Zum Vergleich: So sieht die Preisgestaltung von Anthropic im Vergleich zu vergleichbaren Angeboten f\u00fchrender Anbieter aus unserer eigenen Datenbank aus:<\/p>\n<table class=\"convly-vs\">\n<thead>\n<tr>\n<th>Modell<\/th>\n<th>Anbieter<\/th>\n<th>Kontext<\/th>\n<th>Eingabe \/ 1 Mio. Tokens<\/th>\n<th>Ausgabe \/ 1 Mio. Tokens<\/th>\n<\/tr>\n<\/thead>\n<tbody>\n<tr>\n<td><a href=\"https:\/\/convly.ai\/de\/model\/claude-opus-5\/\">Claude Opus 5<\/a><\/td>\n<td>Anthropic<\/td>\n<td>1 Mio.<\/td>\n<td>$5.00<\/td>\n<td>$25.00<\/td>\n<\/tr>\n<tr>\n<td><a href=\"https:\/\/convly.ai\/de\/model\/claude-sonnet-5\/\">Claude Sonnet 5<\/a><\/td>\n<td>Anthropic<\/td>\n<td>1 Mio.<\/td>\n<td>$2.00<\/td>\n<td>$10.00<\/td>\n<\/tr>\n<tr>\n<td><a href=\"https:\/\/convly.ai\/de\/model\/claude-haiku-4-5\/\">Claude Haiku 4.5<\/a><\/td>\n<td>Anthropic<\/td>\n<td>200 K<\/td>\n<td>$1.00<\/td>\n<td>$5.00<\/td>\n<\/tr>\n<tr>\n<td><a href=\"https:\/\/convly.ai\/de\/model\/gpt-6-astra\/\">GPT-6 Astra<\/a><\/td>\n<td>OpenAI<\/td>\n<td>1,05 Mio.<\/td>\n<td>$10.00<\/td>\n<td>$50.00<\/td>\n<\/tr>\n<tr>\n<td><a href=\"https:\/\/convly.ai\/de\/model\/gemini-3-1-pro\/\">Gemini 3.1 Pro<\/a><\/td>\n<td>Google<\/td>\n<td>1,05 Mio.<\/td>\n<td>$2.00<\/td>\n<td>$12.00<\/td>\n<\/tr>\n<tr>\n<td><a href=\"https:\/\/convly.ai\/de\/model\/deepseek-v4-pro\/\">DeepSeek V4-Pro<\/a><\/td>\n<td>DeepSeek<\/td>\n<td>1 Mio.<\/td>\n<td>$0.435<\/td>\n<td>$0.87<\/td>\n<\/tr>\n<\/tbody>\n<\/table>\n<p>The spread in that table is the reason procurement rarely turns on governance questions. Output tokens on GPT-6 Astra cost roughly ten times what they do on Claude Sonnet 5, and <a href=\"https:\/\/convly.ai\/de\/deepseek-v4\/\">DeepSeek V4<\/a>-Pro unterbietet jede geschlossene Alternative in der Liste deutlich. Teams, die diese Unterschiede bei hohen Volumina modellieren, k\u00f6nnen die Zahlen \u00fcber unseren <a href=\"https:\/\/convly.ai\/de\/ai-api-cost-calculator\/\">KI-API-Kostenrechner<\/a>, und jene, die Open-Weight-Alternativen gegen\u00fcber gehosteten APIs abw\u00e4gen, finden die Trade-offs in unserem <a href=\"https:\/\/convly.ai\/de\/open-vs-closed-ai-cost-gap-2026\/\">Studie zu den Kosten offener versus geschlossener KI-Systeme<\/a>.<\/p>\n<p>Was sich durch die FT-Berichterstattung \u00e4ndern sollte, ist das Gewicht, das Sie externen Sicherheitsgarantien beimessen, wenn sie im Gespr\u00e4ch mit einem Anbieter erw\u00e4hnt werden. Falls ein Lieferant staatliche Tests als Teil seiner Sicherheitsgeschichte anf\u00fchrt, lohnt es sich nun, diese Behauptung f\u00fcr die konkrete Modellversion zu \u00fcberpr\u00fcfen, die Sie einsetzen m\u00f6chten \u2013 und nicht pauschal f\u00fcr den Anbieter als Ganzes.<\/p>\n<h2><span class=\"ez-toc-section\" id=\"The_policy_question_this_reopens\"><\/span>Die politische Frage, die hier erneut aufgeworfen wird<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Das Vereinigte K\u00f6nigreich baute seine Testkapazit\u00e4t auf der Annahme auf, dass freiwillige Zusammenarbeit Bestand haben w\u00fcrde. Diese Annahme war stets davon abh\u00e4ngig, dass Labore die Zusammenarbeit als im eigenen Interesse liegend einsch\u00e4tzen \u2013 entweder reputationsm\u00e4\u00dfig oder als Absicherung gegen strengere Regulierung in Zukunft. Der FT-Bericht deutet an, dass diese Kalkulation auch anders ausfallen kann.<\/p>\n<p>Daraus ergeben sich zwei m\u00f6gliche Richtungen \u2013 beide mit Kosten. Eine gesetzlich verankerte Vorab-Zugangspflicht w\u00fcrde dem Institut Durchsetzungskraft verleihen, allerdings auf Kosten langsamerer Markteinf\u00fchrungen und eines jurisdiktionellen Problems f\u00fcr Labore mit Sitz au\u00dferhalb Gro\u00dfbritanniens. Alternativ bleibt der freiwillige Rahmen bestehen, und die Abdeckung des Instituts bleibt ungleichm\u00e4\u00dfig, sodass die \u00d6ffentlichkeit nicht erkennen kann, welche Modelle gepr\u00fcft wurden und welche nicht. Es gibt keinerlei Hinweis darauf, in welche Richtung sich die britische Politik bewegen wird, und wir werden keine Vermutung abgeben.<\/p>\n<p>F\u00fcr ein technisches Publikum ist die unmittelbare Konsequenz, dass Offenlegung \u2013 nicht Durchsetzung \u2013 die entscheidende Variable ist, die es zu beobachten gilt. Ein Register dar\u00fcber, welche Modelle eine nationale Stelle gepr\u00fcft hat und welche nicht, w\u00e4re eine bescheidene \u00c4nderung, die den gr\u00f6\u00dften Teil des Informationswertes wiederherstellen w\u00fcrde, ohne die Zeitpl\u00e4ne f\u00fcr Ver\u00f6ffentlichungen zu beeintr\u00e4chtigen. Ob jemand dies tats\u00e4chlich umsetzt, bleibt offen.<\/p>\n<h2><span class=\"ez-toc-section\" id=\"Frequently_asked_questions\"><\/span>H\u00e4ufig gestellte Fragen<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p><strong>Hat Anthropic durch das Zur\u00fcckhalten des Modells gegen irgendein Gesetz versto\u00dfen?<\/strong> Nichts im FT-Bericht deutet auf einen Rechtsversto\u00df hin. Der Vorab-Zugang f\u00fcr die britische Teststelle beruht auf freiwilligen Zusagen und nicht auf gesetzlicher Verpflichtung \u2013 daher ist die Verweigerung des Zugangs an sich nicht rechtswidrig.<\/p>\n<p><strong>Welches Anthropic-Modell wurde zur\u00fcckgehalten?<\/strong> Die vorliegenden Berichte nennen das Modell nicht. Wir werden kein Modell durch R\u00fcckschluss benennen \u2013 der FT-Bericht bezieht sich auf Anthropics neuestes Modell, ohne es im uns zug\u00e4nglichen Material zu identifizieren.<\/p>\n<p><strong>Betrifft dies aktuell im Einsatz befindliche Claude-Modelle?<\/strong> Nein. Die berichteten Fakten betreffen einen Vorab-Bewertungsprozess. Anthropics ver\u00f6ffentlichte Modelle, Preise und Kontextfenster bleiben unver\u00e4ndert und sind in unserer <a href=\"https:\/\/convly.ai\/de\/models\/\">Datenbank f\u00fcr KI-Modelle<\/a>.<\/p>\n<p><strong>Wie sollte mein Team den Ausfall einer externen Bewertung kompensieren?<\/strong> F\u00fchren Sie eigene Tests zu Ihren Aufgaben durch. Erstellen Sie einen auf Ihre Aufgabe zugeschnittenen Testdatensatz, messen Sie Verweigerungsverhalten und Fehlermuster an Ihren realen Eingaben und behandeln Sie die Sicherheitsdokumentation des Anbieters als eine von mehreren Informationsquellen \u2013 nicht als Ersatz f\u00fcr eigene Tests. Teams, die sich auf agentenbasierte Workflows standardisieren, finden vergleichende Hinweise in unserem Leitfaden zu <a href=\"https:\/\/convly.ai\/de\/best-ai-coding-agents-2026\/\">KI-Coding-Agenten<\/a>.<\/p>\n<p><strong>Ist dies auf Anthropic beschr\u00e4nkt?<\/strong> Der Bericht der Financial Times bezieht sich speziell auf Anthropic, doch die zugrundeliegende Schw\u00e4che \u2013 freiwilliger Zugang ohne Durchsetzungsmechanismus und ohne \u00f6ffentliches Register dar\u00fcber, was getestet wurde \u2013 betrifft jedes f\u00fchrende Forschungslabor, das unter demselben Rahmen operiert.<\/p>\n<h2><span class=\"ez-toc-section\" id=\"The_bottom_line\"><\/span>Das Fazit<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Die berichteten Fakten sind begrenzt: Laut Financial Times gew\u00e4hrte Anthropic der britischen Teststelle vor der Ver\u00f6ffentlichung keinen Zugang zu seinem neuesten Modell, und zudem trat ein Anthropic-Forscher aufgrund der Risikohaltung der Branche zur\u00fcck. Keiner der beiden Berichte beschreibt eine Rechtsverletzung, und keiner \u00e4ndert, was heute k\u00e4uflich ist.<\/p>\n<p>Was sie jedoch \u00e4ndern, ist das Ma\u00df an Vertrauen, das eine externe Partei vern\u00fcnftigerweise in die Sicherheitsgarantie rund um f\u00fchrende Ver\u00f6ffentlichungen setzen kann. Freiwillige Vorab-Tests liefern nur dann Informationen, wenn Labore daran teilnehmen \u2013 und der FT-Bericht ist ein Beleg daf\u00fcr, dass diese Teilnahme in der Praxis ebenso diskretion\u00e4r ist wie auf dem Papier. Anthropics eigene ver\u00f6ffentlichte Dokumentation, darunter seine <a href=\"https:\/\/www.anthropic.com\/responsible-scaling-policy\" rel=\"noopener\" target=\"_blank\">Responsible Scaling Policy<\/a>, bleibt die prim\u00e4re Quelle daf\u00fcr, was das Unternehmen intern zu leisten verspricht \u2013 und momentan bildet diese Dokumentation einen gr\u00f6\u00dferen Teil des \u00f6ffentlichen Bildes als jede externe Bewertung.<\/p>\n<p>F\u00fcr alle, die mit diesen APIs in Produktion gehen, lautet die Erkenntnis unspektakul\u00e4r und nachhaltig: Ihr eigener Evaluierungsrahmen ist die einzige Sicherheitsgarantie, die Sie vollst\u00e4ndig kontrollieren. Preis- und Leistungsdaten k\u00f6nnen extern bezogen werden, wie etwa in unserer <a href=\"https:\/\/convly.ai\/de\/ai-price-performance-index-2026\/\">KI-Preis-Leistungs-Index<\/a>. Sicherheit, die f\u00fcr Ihren konkreten Einsatz geeignet ist, l\u00e4sst sich nicht extern beschaffen.<\/p>\n<p><em>Quellen: news.google.com. Berichtet am 09. September 2026.<\/em><\/p>","protected":false},"excerpt":{"rendered":"<p>The Financial Times reports Anthropic withheld its latest AI model from the UK&#8217;s testing agency, putting the voluntary nature of pre-release safety evaluations back under scrutiny.<\/p>","protected":false},"author":1,"featured_media":2603,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"site-sidebar-layout":"default","site-content-layout":"","ast-site-content-layout":"default","site-content-style":"default","site-sidebar-style":"default","ast-global-header-display":"","ast-banner-title-visibility":"","ast-main-header-display":"","ast-hfb-above-header-display":"","ast-hfb-below-header-display":"","ast-hfb-mobile-header-display":"","site-post-title":"","ast-breadcrumbs-content":"","ast-featured-img":"","footer-sml-layout":"","ast-disable-related-posts":"","theme-transparent-header-meta":"","adv-header-id-meta":"","stick-header-meta":"","header-above-stick-meta":"","header-main-stick-meta":"","header-below-stick-meta":"","astra-migrate-meta-layouts":"default","ast-page-background-enabled":"default","ast-page-background-meta":{"desktop":{"background-color":"var(--ast-global-color-5)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"tablet":{"background-color":"","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"mobile":{"background-color":"","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""}},"ast-content-background-meta":{"desktop":{"background-color":"var(--ast-global-color-4)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"tablet":{"background-color":"var(--ast-global-color-4)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"mobile":{"background-color":"var(--ast-global-color-4)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""}},"footnotes":""},"categories":[7],"tags":[844,525,519,427,790,970,1192],"class_list":["post-2602","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-ai-news","tag-ai-policy","tag-ai-regulation","tag-ai-safety","tag-anthropic","tag-claude","tag-model-evaluation","tag-uk-ai-security-institute"],"_links":{"self":[{"href":"https:\/\/convly.ai\/de\/wp-json\/wp\/v2\/posts\/2602","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/convly.ai\/de\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/convly.ai\/de\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/convly.ai\/de\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/convly.ai\/de\/wp-json\/wp\/v2\/comments?post=2602"}],"version-history":[{"count":1,"href":"https:\/\/convly.ai\/de\/wp-json\/wp\/v2\/posts\/2602\/revisions"}],"predecessor-version":[{"id":2604,"href":"https:\/\/convly.ai\/de\/wp-json\/wp\/v2\/posts\/2602\/revisions\/2604"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/convly.ai\/de\/wp-json\/wp\/v2\/media\/2603"}],"wp:attachment":[{"href":"https:\/\/convly.ai\/de\/wp-json\/wp\/v2\/media?parent=2602"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/convly.ai\/de\/wp-json\/wp\/v2\/categories?post=2602"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/convly.ai\/de\/wp-json\/wp\/v2\/tags?post=2602"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}