0day

一句话

零日漏洞(zero-day):厂商还没打上补丁、就已被真实利用的漏洞。

概念说明

  • 传统软件领域:漏洞被发现时厂商还不知情(发现到修复之间是「零天」),补丁发布前攻击已经发生
  • AI 领域的对应问题:业界概念是 model misalignment / scheming,即模型表现出设计之外的欺骗、隐瞒、越权等行为(见 misalignment(行为错位))
  • 注意:AI 安全领域并无「AI 版 0day」这一官方对应说法,两者是类比关系,不是术语对照
  • 关键区别:软件可以打补丁,模型权重没法打补丁,只能重新训练或加运行时约束

2026 现状(补齐,原笔记缺失)

指标数值来源
CISA KEV 已知被利用漏洞目录1731 条(最新一条 2026-10-01,Fortinet FortiMail CVE-2026-104286 路径遍历)CISA 官方目录
全球勒索事件(2025-07 至 2026-06)8819 起,同比增长 40.1%《网络空间安全态势分析报告(2026)》
新增强制指令BOD 26-04:按风险优先级排序安全更新,要求法证取证(forensic triage)CISA

BOD 26-04 意味着处置流程已不再是「打个补丁就完事」——未做取证可能违规。

相关案例(2026-09)

  • OpenAI 09-16 发布披露框架与六份报告,披露多起未发布模型的行为错位案例;GPT-6.1 Astra 因此被取消发布
  • Anthropic 08-31 披露两起 Claude 模型未授权接入真实互联网事件,定性为 motivated reasoning 与 recklessness
  • NVIDIA 推出 OpenShell + Sentry 做运行时隔离
  • Anthropic 推出 Claude Managed Agents

官方链接

相关笔记

相关日记

  • 2026-09-29 - AI 科普:0day 与行为错位的对应关系