在Claude Mythos之后,美国政府令人不安的“触发”

Après Claude Mythos, le « déclic » préoccupant de l’administration US

Silicon.fr by Clément Bohic 2026-06-29 10:18 Original
摘要
美国加强对AI模型出口管制,要求OpenAI的GPT-5.6和Anthropic的Claude Mythos 5仅向白宫个案批准的“可信伙伴”开放预览,而非全面发布。此举源于经由Amazon报告的“越狱”漏洞担忧,但业界指出此类代码修复能力本就是网络安全防御的必需,Alex Stamos等人发起公开信抗议。特朗普政府另颁布行政令建立自愿评估机制,允许开发者在发布前30天与政府协商并指定合作伙伴,拜登任内拟议的先进模型权重全面出口禁令则已被废除。

美国政府近期明显加大对AI模型发布的干预力度,直接否决扩散或设置严苛预览条件。最新例子是OpenAI的GPT-5.6,该模型已以预览形式推出,但仅向白宫逐案批准的“可信合作伙伴群体”开放。OpenAI希望在“未来几周”实现更广泛分发,并强调当前流程“不应成为默认程序”。

GPT-5.6系列分为三款:能力最强的Sol具备全新最大推理模式与可启动子代理的超模式;Terra定位日常均衡工作,性能与GPT-5.5相当且“成本减半”;Luna则“更快更实惠”。OpenAI称Sol在ExploitBench基准上与Claude Mythos Preview不相上下,且输出token少三倍。公司还表示,根据其Preparedness Framework设定的关键网络风险阈值,该模型并未超标——它虽成功识别Chromium和Firefox的漏洞,但“未能自主生成完整的功能性利用链”。不过OpenAI也坦承现有基准无法覆盖模型所有潜在用途,预览期正是为了进一步检验内置防护措施。

此前,Anthropic的Claude Mythos 5与Fable 5率先受到管控。6月12日,华盛顿将二者纳入出口管制,要求仅允许美国公民访问。Anthropic为彻底合规选择完全下线模型,并称特朗普政府以国家安全为由,但未提供细节。触发事件疑似由一种越狱方法被通报引起——可能来自亚马逊。Anthropic认为该方法“看似相当简单”,且GPT-5.5等公开模型也可被同样利用,其本质是要求模型修复特定代码库中的软件漏洞,而这本就是日常网络防御中“已在使用的能力”。联邦政府可能还注意到,数周前一家“与中国有关”的电信企业曾获准试用Claude Mythos Preview,Anthropic最终取消了其权限。

行业迅速反应。前Facebook CTO亚历克斯·斯塔莫斯发起“解放Fable”公开信,召集约二百名产业与学术界人士签署,主张Fable与Mythos等模型对网络防御至关重要,所谓的越狱实为生成安全代码的必备能力,不应被视为攻击性功能,且该能力在大量模型上均可重现,“包括中国模型Kimi 2.7”。斯塔莫斯还警示,美国实验室相对中国同行的领先优势并不突出,后者“可能拥有超出公开信息的更多能力”。

6月26日,华盛顿将Claude Mythos 5置于与GPT-5.6相同的机制——允许在预览阶段向选定组织开放,但Fable仍未有新消息。与此同时,6月初特朗普签署的行政命令正在构建更系统的审查框架:60天内制定评估AI模型“高级网络能力”的涉密程序,并设定阈值,达标后启动基于自愿的合作——开发者可与政府讨论模型是否达标、提前30天提供访问、共同确定可获提前访问的“可信伙伴”。白宫特别声明,该命令不创建任何许可或强制预授权制度。

这一趋势的背景是,拜登在2025年1月曾签署行政命令,计划将“某些先进模型”的权重纳入出口管制,对中国、俄罗斯和朝鲜彻底封锁,其他国家需许可证(法国等约二十国除外)。特朗普政府今年5月取消了该命令,恰在其生效前夕。如今实际做法已让白宫对正在开发中的模型拥有事实上的审查权,令业界担忧形成新的隐性壁垒。

Summary
Washington is forcing OpenAI and Anthropic to limit access to their latest AI models—GPT-5.6 and Claude Mythos 5—to only a White House-approved group of trusted partners, following national security concerns triggered by a jailbreak method. A Trump executive order formalizes voluntary government review of advanced cyber capabilities ahead of release, while Biden’s earlier export controls on model weights were scrapped. The move raises industry fears of slowing deployment and ceding ground to Chinese labs, with former Facebook CTO Alex Stamos leading a letter arguing such restrictions harm cyber defense.

Washington is tightening its grip on the release of advanced AI models, with GPT-5.6 now under restricted preview — available only to a White House‑vetted “group of trusted partners.” The move marks the administration’s latest intervention, following a similar clampdown on Anthropic’s models, and signals an emerging, informal veto power over model deployment.

OpenAI had planned a wider rollout of GPT-5.6 “in the coming weeks” and insists the current process “must not become the default.” The new model family comprises three tiers: Sol, the most capable, featuring a max reasoning mode and an ultra setting that spins up sub‑agents; Terra, “balanced for daily work,” matching GPT-5.5’s performance at half the cost; and Luna, faster and more affordable. On the ExploitBench cybersecurity benchmark, Sol rivals Anthropic’s Claude Mythos Preview while generating three times fewer tokens. OpenAI states that the model stays below the critical risk thresholds defined in its internal Preparedness Framework; although it found bugs in Chromium and Firefox, it did not “autonomously produce a full, working exploit chain.” The company nonetheless admits benchmarks cannot capture all potential uses, justifying the preview period as a way to stress‑test the model’s built‑in safeguards.

The crackdown began on June 12 when Washington placed Anthropic’s Claude Mythos 5 and Fable 5 under export controls, effectively limiting access to US citizens. Anthropic chose to take the models completely offline, saying the Trump administration cited national security without further detail. The apparent trigger was the disclosure of a jailbreak method — reportedly by Amazon — that, according to Anthropic, is “relatively simple” and involves asking a model to fix software vulnerabilities in a specific codebase. The capability is already used routinely for cyber defense, and other publicly available models, including OpenAI’s GPT-5.5, can be exploited in the same way. The government may also have been influenced by an earlier incident in which a China‑linked telecom company was granted, and then stripped of, experimental access to Claude Mythos Preview.

In response, former Facebook CTO Alex Stamos spearheaded an open letter, “Free Fable,” signed by around 200 industry and academic figures. The letter argues that models such as Fable and Mythos are vital for cyber defense and that identifying and patching vulnerabilities — the very behavior at issue — is a defensive imperative, not an offensive one. The jailbreak technique, it notes, works on many models, “including Chinese ones like Kimi 2.7.” Stamos also warned that US labs may not be as far ahead of Chinese competitors as commonly believed, with the latter likely possessing “more capabilities than public information suggests.”

On June 26, the administration harmonized its approach, permitting Anthropic to release Claude Mythos 5 in preview to selected organizations — the same regime applied to GPT-5.6. Fable’s status remains unresolved.

The evolving policy framework underpinning these actions includes an early‑June Trump executive order on AI deployment and security. It mandates the creation of a classified procedure — within 60 days — to evaluate “advanced cyber capabilities” of AI models and set a threshold triggering voluntary collaboration with the federal government. Developers would gain the possibility to discuss whether a model reaches that threshold, grant pre‑release access up to 30 days before publication, and jointly designate “trusted partners” for early access. Officials stress the decree does not establish a formal licensing or pre‑authorization system. This contrasts with a last‑minute Biden administration order in January 2025 that would have directly controlled the export of model weights for “certain advanced” dual‑use AI, with total bans for China, Russia, and North Korea and licensing requirements for most other countries. The Trump administration rescinded that order in May before it could take effect.

Résumé
Les États-Unis ont imposé un veto sur la diffusion de modèles d’IA, bloquant Claude Mythos 5 d’Anthropic puis restreignant GPT-5.6 d’OpenAI à des partenaires triés sur le volet par la Maison Blanche. Un décret Trump instaure une procédure classifiée pour évaluer les capacités cyber des modèles en développement, donnant au gouvernement un droit de regard anticipé. Cette emprise suscite des inquiétudes chez les experts, tel Alex Stamos, qui y voient un frein à la cyberdéfense américaine face à des rivaux comme la Chine.

La tendance se confirme : Washington n’hésite plus à poser son droit de veto sur la diffusion de modèles d’IA.

Dernier concerné : GPT-5.6. Le voilà lancé en preview… mais seulement auprès d’un « groupe de partenaires de confiance » que la Maison Blanche a approuvés au cas par cas.

OpenAI table sur une diffusion plus large « dans les prochaines semaines ».  Il espère surtout un autre cadre pour mettre à disposition ses futurs modèles. La méthode actuelle « ne doit pas devenir le processus par défaut », affirme-t-il.

OpenAI tempère le niveau de risque de GPT-5.6

La famille GPT-5.6 comprend trois modèles :

Sol, le plus puissant, avec un nouveau mode de raisonnement max et un mode ultra qui lance des sous-agents

Terra, « équilibré pour le travail quotidien », dit au niveau de GPT-5.5 tout en étant « deux fois moins cher »

Luna, « plus rapide et plus abordable »

OpenAI assure que sur ExploitBench, GPT-5.6 Sol rivalise avec Claude Mythos Preview tout en produisant 3 fois moins de tokens. L’entreprise déclare surtout que le modèle ne dépasse pas les seuils critiques de risque cyber qu’elle a définis dans son Preparedness Framework. Il a bien identifié des bugs dans Chromium et Firefox, mais n’a « pas produit, de manière autonome, une chaîne d’exploitation fonctionnelle complète ».

OpenAI reconnaît toutefois sobrement que les benchmarks ne sont pas à même de refléter tous les usages potentiels d’un modèle. Une manière de justifier la période de preview, qui servira à mettre l’épreuve les garde-fous intégrés à GPT-5.6…

Anthropic conteste le jailbreak qui aurait convaincu Washington

Claude Mythos 5 et Fable 5 avaient été les premiers visés. Le 12 juin, Washington les avait soumis au contrôle des exportations. Anthropic devait couper l’accès pour tout le monde, hormis les citoyens des États-Unis.

Pour s’assurer de respecter cette obligation, l’entreprise a préféré débrancher complètement ses modèles. Elle explique que l’administration Trump a invoqué des motifs de sécurité nationale, sans donner de détails.

Le déclencheur semble avoir été la communication d’une méthode de jailbreak – possiblement par Amazon. Selon Anthropic, cette méthode « paraît relativement simple », d’autant plus que d’autres modèles accessibles au public – comme GPT-5.5 – permettent par défaut de l’exploiter. Dans les grandes lignes, elle consiste à demander au modèle de corriger les vulnérabilités logicielles dans une codebase spécifique. Une capacité « déjà utilisée au quotidien » pour la cyberdéfense, constate-t-il.

Le gouvernement fédéral se sera aussi probablement rappelé que quelques semaines en amont, un acteur des télécoms « lié à la Chine » avait obtenu le droit d’expérimenter Claude Mythos Preview (Anthropic avait fini par lui retirer l’accès).

Claude Mythos 5 et GPT-5.6 finalement soumis au même traitement

Entre autres réponses à cette initiative, il y eut une lettre ouverte « Free Fable », sous l’impulsion d’Alex Stamos, ancien CTO de Facebook. Elle a réuni environ 200 signataires des sphères industrielle et académique. Y est défendue l’idée que des modèles comme Fable et Mythos sont essentiels pour la cyberdéfense. Et que le fameux jailbreak relève en fait d’une capacité nécessaire pour tout modèle dont on attend qu’il produise du code sécurisé. En ce sens, il serait erroné d’y voir une capacité offensive. D’autant plus qu’elle est reproductible sur quantité de modèles, « même chinois, comme Kimi 2.7 ».

Alex Stamos brandit un autre épouvantail : les labos américains n’auraient pas tant d’avance sur leurs homologues chinois. Lesquels ont « probablement accès à plus de capacités » que les informations publiques ne le suggèrent…

Le 26 juin, Washington a finalement mis Claude Mythos 5 au même régime que GPT-5.6. Anthropic a eu la permission de l’ouvrir, en preview, à des organisations triées sur le volet. Pas de nouvelles, en revanche, pour Fable.

La Maison Blanche se donne un droit de regard sur les modèles en développement

Début juin, Donald Trump a signé un décret relatif au déploiement et à la sécurité de l’IA. Il impose, entre autres, de développer sous 60 jours une procédure classifiée pour évaluer les « capacités cyber avancées » des modèles d’IA. Et, de là, déterminer un seuil à partir duquel s’enclencherait une collaboration « sur la base du volontariat ». Les développeurs des modèles concernés auraient en l’occurrence la possibilité de :

Discuter avec le gouvernement fédéral pour déterminer si des modèles en cours de développement atteignent ledit seuil

Lui donner un accès à ces modèles jusqu’à 30 jours avant la date de publication prévue

Définir ensemble des « partenaires de confiance » pouvant bénéficier d’un accès anticipé

L’administration américaine a pris des pincettes en précisant que le décret ne crée aucunement un système de licence ou de préautorisation gouvernementale obligatoire pour développer, publier ou distribuer des modèles…

Joe Biden avait voulu contrôler l’exportation des poids de « modèles avancés »

Traditionnellement, le contrôle des exportations s’est appliqué à des biens matériels. Avec le temps, il s’est étendu aux logiciels, aux codes sources, aux données, etc.

En janvier 2025, à quelques jours de la fin de son mandat, Joe Biden avait signé un décret qui devait inclure, dans le contrôle des exportations, les poids de « certains modèles avancés » à double usage potentiel. L’exclusion aurait été totale pour Chine, Russie et Corée du Nord. Une licence serait nécessaire dans tous les autres pays, à l’exception d’une vingtaine dont la France.

L’administration Trump a annulé le décret en mai, juste avant qu’il prenne effet.

Illustration

The post Après Claude Mythos, le « déclic » préoccupant de l’administration US appeared first on Silicon.fr.

AI Insight
Core Point

The US government is blocking broad access to frontier AI models like GPT-5.6 and Claude Mythos, citing cybersecurity risks, and imposing a preview-only approval process—a shift that could stifle innovation and alter the global AI race.

Key Players
  • OpenAI — AI lab developing GPT models; based in San Francisco, USA.
  • Anthropic — AI lab behind Claude and Fable models; based in San Francisco, USA.
  • White House / US administration — federal body enforcing AI export controls and security reviews.
Industry Impact
  • ICT: High — restricted model access may delay enterprise and developer adoption of powerful AI tools.
  • Computing/AI: High — direct government scrutiny over model releases adds friction and uncertainty for frontier AI labs.
Tracking

Strongly track — this marks a new normal of US veto power on AI diffusion, with ripple effects for security research, open-source, and international competitiveness.

Related Companies
neutral
OpenAI
mature
negative
Amazon
mature
neutral
Anthropic
startup
neutral
Facebook
mature
neutral
negative
Categories
人工智能 网络安全
AI Processing
2026-06-29 16:04
deepseek / deepseek-v4-pro