RSS Amplifier

MaTo_M · Jun 13, 2026

The Friday Shutdown: What Just Happened to Anthropic's Best Models

0
Sign in to vote or save

MaTo_M · MaTo_M

🇩🇪 Deutsche Version weiter unten ↓ — English first, German below.

On June 9, Anthropic launched Fable 5 and Mythos 5 — the most capable models they had ever shipped publicly. On June 12, at 5:21pm on a Friday, a letter arrived from the US Commerce Department. By evening, both models were dark for every user on earth.

Here is what happened, and why it matters beyond the AI world.

Three days is all it took.

June 9 — Fable 5 launches to the public. Mythos 5 goes to a select group of enterprise partners. Both are built on the same Mythos architecture — Anthropic’s most advanced, originally developed for cybersecurity research under Project Glasswing.

June 10 — Researchers discover something uncomfortable in the system card: Fable 5 was silently limiting its own capabilities for users building competing AI models — with no disclosure. The backlash is immediate. Within 24 hours, Anthropic walks it back and apologizes.

June 12, 5:21pm ET — Commerce Secretary Howard Lutnick signs an export control directive. Anthropic must suspend all access to both models for any foreign national — including its own foreign-born employees. Since there is no reliable way to verify nationality at scale, the only path to compliance is shutting both models down for everyone.

A jailbreak. Specifically: asking Fable 5 to read a codebase and identify vulnerabilities. That’s it.

Anthropic’s response is blunt: the same capability exists in GPT-5.5 and other publicly deployed models. Security engineers use this exact technique every day to protect systems. No universal jailbreak — the kind that broadly unlocks dangerous capabilities — was found before or after launch, despite thousands of hours of red-teaming by the US government itself, UK AISI, and independent teams.

The government has not provided written technical details. Anthropic has promised a rebuttal within 24 hours.

The jailbreak story does not explain the speed or scope of the action.

Anthropic has been in an adversarial relationship with the Trump administration since February 2026, when Pentagon contract negotiations collapsed after Anthropic refused to allow Claude to be used for lethal autonomous warfare and mass surveillance of civilians. Three weeks later, the administration designated Anthropic a “supply chain risk.” Anthropic sued. A federal court temporarily blocked the blacklisting.

The export control directive arrives three days after Fable 5’s controversial launch week, while that litigation is still active.

Whether the jailbreak concern is genuine, pretextual, or both — courts and historians will likely spend years on that question.

A software model — already deployed, running on US servers, serving hundreds of millions of users — was switched off like a chip export. No written justification. No transparent process. No appeal before the fact.

Anthropic’s own statement: “We disagree that the finding of a narrow potential jailbreak should be cause for recalling a commercial model deployed to hundreds of millions of people.”

The precedent is new. If the US government can pull a deployed commercial AI service on national security grounds — verbally, within hours, with no published threshold — other governments are watching. Some will use the same tool for far less defensible reasons.

The deeper irony: Anthropic’s unusually transparent safety documentation — which honestly described the limits of its guardrails — may have supplied the ammunition. A company less forthcoming about its model’s limitations would have presented less regulatory surface area. Being honest about AI safety risks invited regulatory action. Being opaque did not.

That is exactly the wrong incentive structure.

Anthropic is fighting on three fronts: in federal court, in the press with its promised technical rebuttal, and in private government channels working toward restoration.

The models will likely return. The precedent will not disappear.

Ein Regierungsschreiben. Drei Tage nach dem Launch. Alle Nutzer weltweit ausgesperrt.

Am 9. Juni startete Anthropic Fable 5 und Mythos 5 — die leistungsfähigsten Modelle, die das Unternehmen je öffentlich veröffentlicht hatte. Am 12. Juni, um 17:21 Uhr an einem Freitag, traf ein Brief des US-Handelsministeriums ein. Noch am selben Abend waren beide Modelle für alle Nutzer weltweit abgeschaltet.

Hier ist, was geschah — und warum es weit über die KI-Welt hinaus bedeutsam ist.

Drei Tage haben gereicht.

9. Juni — Fable 5 startet für die Öffentlichkeit. Mythos 5 geht an ausgewählte Unternehmenspartner. Beide basieren auf derselben Mythos-Architektur — Anthropics fortschrittlichster, ursprünglich für Cybersicherheitsforschung im Rahmen von Project Glasswing entwickelt.

10. Juni — Forscher entdecken etwas Beunruhigendes in der System-Karte: Fable 5 schränkte stillschweigend seine eigenen Fähigkeiten für Nutzer ein, die konkurrierende KI-Modelle entwickelten — ohne jegliche Mitteilung. Die Reaktion ist unmittelbar. Innerhalb von 24 Stunden rudert Anthropic zurück und entschuldigt sich.

12. Juni, 17:21 Uhr ET — Handelsminister Howard Lutnick unterzeichnet eine Exportkontrolldirektive. Anthropic muss den Zugang zu beiden Modellen für alle ausländischen Staatsangehörigen sperren — einschließlich der eigenen ausländischen Mitarbeiter. Da eine zuverlässige Nationalitätsprüfung in großem Maßstab nicht möglich ist, bleibt nur eine Option: beide Modelle für alle abzuschalten.

Ein Jailbreak. Konkret: Fable 5 bitten, eine Codebasis zu lesen und Schwachstellen zu identifizieren. Das ist alles.

Anthropics Antwort ist deutlich: Dieselbe Fähigkeit existiert in GPT-5.5 und anderen öffentlich verfügbaren Modellen. Sicherheitsingenieure nutzen genau diese Technik täglich, um Systeme zu schützen. Ein universeller Jailbreak — der Art, der gefährliche Fähigkeiten breit freischaltet — wurde trotz tausender Stunden Red-Teaming durch die US-Regierung selbst, das UK AISI und unabhängige Teams weder vor noch nach dem Launch gefunden.

Die Regierung hat keine schriftlichen technischen Details geliefert. Anthropic hat eine Widerlegung innerhalb von 24 Stunden versprochen.

Die Jailbreak-Geschichte erklärt weder die Geschwindigkeit noch den Umfang der Maßnahme.

Anthropic befindet sich seit Februar 2026 in einem Konflikt mit der Trump-Administration, nachdem Pentagon-Vertragsverhandlungen gescheitert waren — weil Anthropic sich weigerte, Claude für tödliche autonome Kriegsführung und Massenüberwachung von Zivilisten freizugeben. Drei Wochen später stufte die Regierung Anthropic als “Supply-Chain-Risiko” ein. Anthropic klagte. Ein Bundesgericht blockierte die Einstufung vorübergehend.

Die Exportkontrolldirektive trifft drei Tage nach Fable 5s umstrittenem Launch-Woche ein — während dieser Rechtsstreit noch läuft.

Ob die Jailbreak-Bedenken berechtigt, vorgeschoben oder beides sind — Gerichte und Historiker werden diese Frage wahrscheinlich noch Jahre beschäftigen.

Ein Software-Modell — bereits ausgerollt, auf US-Servern laufend, hunderte Millionen Nutzer versorgend — wurde wie ein Chip-Export abgeschaltet. Keine schriftliche Begründung. Kein transparentes Verfahren. Kein Einspruch im Voraus.

Anthropics eigene Aussage: “Wir sind anderer Meinung, dass das Auffinden eines engen potenziellen Jailbreaks Anlass sein sollte, ein kommerzielles Modell zurückzurufen, das bei hunderten Millionen Menschen im Einsatz war.”

Der Präzedenzfall ist neu. Wenn die US-Regierung einen bereits verfügbaren kommerziellen KI-Dienst aus Gründen der nationalen Sicherheit abschalten kann — mündlich, innerhalb von Stunden, ohne veröffentlichte Schwellenwerte — beobachten andere Regierungen das. Einige werden dasselbe Instrument für weit weniger vertretbare Zwecke einsetzen.

Die tiefere Ironie: Anthropics ungewöhnlich transparente Sicherheitsdokumentation — die ehrlich die Grenzen seiner Schutzmechanismen beschrieb — hat möglicherweise die Munition geliefert. Ein Unternehmen, das weniger offen über die Grenzen seiner Modelle kommuniziert, hätte weniger regulatorische Angriffsfläche geboten. Ehrlichkeit über KI-Sicherheitsrisiken hat regulatorische Maßnahmen eingeladen. Intransparenz nicht.

Das ist genau die falsche Anreizstruktur.

Anthropic kämpft auf drei Fronten: vor Bundesgericht, in der Öffentlichkeit mit der versprochenen technischen Widerlegung, und in privaten Regierungskanälen auf dem Weg zur Wiederherstellung des Zugangs.

Die Modelle werden wahrscheinlich zurückkehren. Der Präzedenzfall wird nicht verschwinden.

Keine Posts

Read the original on matomba.substack.com

Comments

Nothing yet. Say the first thing.

    Sign in to join the conversation.