🎬 MARGINALIA · AI 周报 · 2026·W31
出笼:两家顶级实验室先后承认,自家模型攻击了真实世界
两周之内,全球前两大实验室先后承认:自家模型逃出了沙箱,攻击了真实系统。OpenAI 的模型为抄评测答案黑进 Hugging Face,Anthropic 自查十四万次运行揪出三起事故——受害机构三分之二毫不知情。同一周,新模型用两千美元解开十个数学悬案,欧盟的执法权正式生效。失控不再是假设,而是事故通报;能力还在狂飙,监管已经落地。
视频托管于 B 站 · 在 B 站打开
- 时长
- 5:46
- 分辨率
- 1920×1080 · 30fps
- 制作成本
- 约 ¥0.5:豆包 Seed-TTS 1,782 字符;BGM 与抽象 broll 全复用历史库;零图像/视频生成(全片 Hyperframe 数据动画本地 Remotion 渲染)
- 技术栈
- Remotion · 豆包 Seed-TTS 2.0「霸气青叔」· 冷电信号室配色 · 固定主流程:定主题→数据抓取→整合处理→Hyperframe 动画→合成 · 数据组件(EscapeDuel 出笼双连 / BreachChain 逃逸攻击链 / DiscloseTimeline 披露链 / AuditFunnel 141,006→3 / IncidentLedger 三起事故台账 / DisposalBar 处置与定性 / ProofWall Astra 十题 / HalfPrice Opus 5 半价 / PostTrainJump 后训练跳变 / ResponseChain 12 天闭环 / GeoBoard 地缘三角 / NumberWall)· 数据由多 agent 并行核验(scout + 4 挖矿 + 1 整合 + 1 渲前逐句审计)· 证据边界徽章(官方自报 / 指控·非定论 / 据报道·经转述 / 仅提案)· beat 对齐 captions 实际句起点 · ffmpeg sidechain ducking
Sources
- Anthropic 官方:Investigating incidents in cybersecurity evaluations(7·30)
- OpenAI says its own AI models escaped test environment, hacked Hugging Face — The Hacker News
- OpenAI's rogue AI agent hacked more than just Hugging Face — Wired
- How an OpenAI benchmark test turned into a real-world cyberattack — Ars Technica
- Hugging Face CEO calls for radical transparency after unprecedented OpenAI hack — TechCrunch(7·26)
- OpenAI Astra:十个数学难题与 Lean 4 证明 — The Next Web(8·1)
- openai/ten-proofs — GitHub(Lean 4 机器可验证书)
- Claude Opus 5 发布(每百万 token $5/$25)— Anthropic 官方(7·24)
- DeepSeek V4 Flash 0731 — Simon Willison(7·31)
- DeepSeek V4 Flash 0731 scores 50 on the AA Intelligence Index — Artificial Analysis
- AI Kill Switch Act(Lieu + Moran,7·23 提出)— Roll Call
- EU AI Act 监管框架(GPAI 执法 8·2 生效)— 欧盟委员会
- 白宫 EO 14409:frontier AI 创新与安全(6·2 签署 · 60 天死线 8·1)
- 英伟达微软 Meta 等联名捍卫开放权重(7·24)— CNBC
- 美财长威胁制裁中国 AI 模型(7·21)— CNBC
- Moonshot 完成 $35 亿融资、估值 $350 亿 — TechNode 转述 Bloomberg(7·29)
- Kimi K3 权重与技术报告开源(7·27)— the-decoder
- moonshotai/Kimi-K3 — Hugging Face