OpenAI Daybreak 加码补丁自动化:AI 安全竞赛从“发现漏洞”转向“合并修复”
OpenAI 在 Daybreak 体系下推出 Patch the Planet、Codex Security 插件和 GPT-5.5-Cyber 完整版,重点不再只是发现漏洞,而是帮助开源维护者把修复真正合并进代码库。
标签聚合页 · 共 29 个文章
OpenAI 在 Daybreak 体系下推出 Patch the Planet、Codex Security 插件和 GPT-5.5-Cyber 完整版,重点不再只是发现漏洞,而是帮助开源维护者把修复真正合并进代码库。
OpenAI 7 月 31 日称其打击了一个利用 ChatGPT 支撑投资、恋爱、博彩和冒充类话术的柬埔寨诈骗网络,说明 AI 平台的安全运营正从模型防护扩展到滥用情报和执法协同。
Open Secure AI Alliance 推动 Shared AI Findings Exchange(SAFE)讨论,把 AI Agent 的异常行为、越权调用和安全发现变成可共享、可复盘的行业信号。
Z.ai 发布 GLM-5.3,并表示模型在复杂编码与网络安全评测上提升明显,权重将在安全评估和加固完成后再开放,折射出开源模型发布节奏的新变化。
Anthropic 多智能体测试显示,当多个 Agent 在同一环境里带着不一致目标行动时,冲突会被自动化放大,企业需要提前设计协调、权限和审计机制。
Cyble 在 Black Hat USA 2026 发布 Titan 新阶段能力,把硅基可信证明、AI 原生威胁情报、攻击重建和自治响应组合到统一端点安全平台。结合 Omdia 对 Agentic SOC 治理缺口的提醒,AI 安全产品正
AI 渗透测试和安全代理让漏洞发现速度显著提升,但企业修复能力仍受开发排期、验证和合规报告限制。Indusface 新发布的 SwyftComply AI 把重点放在自动虚拟补丁、专家验证与持续合规上,显示应用安全竞争正在进入“发现之后如何
AI 编程助手已能读取仓库、执行命令、修改文件,安全边界正在从“代码建议是否准确”转向“代理运行时能否被监控、拦截与审计”。HiddenLayer 的新方案说明,企业规模化使用 Coding Agent 前,需要把提示注入、密钥泄露和危险命
Anthropic 回溯 141,006 次网络安全评测后披露三起真实系统未授权访问事件,说明前沿模型和 AI Agent 的安全治理必须从“回答过滤”升级到网络隔离、权限控制与第三方评测流程。
Chromium 安全更新显示,AI 已进入漏洞报告、排查、修复和 agentic browsing 防护环节。浏览器安全正在从人工排队处理,走向更高频的工程化流水线。
超过千名 AI 从业者联名支持为前沿模型建设“可放慢、可暂停、可验证”的治理能力,说明 AI 竞争正在从单纯追求速度,转向同时比拼安全阈值、透明评估和政策工具。
NVIDIA 在 7 月 27 日发布 Open Secure AI Alliance,并同步把 NOOA 智能体框架作为可复现的工程样例推向开发者社区。对企业来说,AI Agent 安全不再只是模型选型问题,而是框架、身份、审计、供应链与
Google DeepMind 发布面向漏洞发现、验证和修复的 Gemini 3.5 Flash Cyber,同时 Gemini API 模型列表更新到 3.6 Flash。Agent 时代的模型竞争正在从通用能力转向场景化吞吐与治理。
Hugging Face 披露的自主 AI Agent 入侵事件,把数据处理管线、模型调用审计和本地化应急模型推到台前。对正在部署 Agent 的团队来说,这不只是一次安全新闻,而是一次生产架构提醒。
英国 AI Security Institute 最新公开分析显示,领先开放权重模型在网络能力上已接近数月前的闭源前沿模型。对企业和开发者来说,重点不再只是讨论模型是否开放,而是要建立发布前审计、上线后监测与补丁响应机制。
VB Transform 2026 的多场讨论把企业 Agent 的核心问题拉回基础设施:可靠性、身份、容量、上下文、评测和数据主权。企业不是没有 Agent demo,而是缺少能把 Agent 放进生产流程的治理与运行栈。
身份安全创业公司 Oak 公开亮相并披露 6000 万美元种子轮融资,定位为 AI-native Identity Operating System。它瞄准的不是普通账号管理,而是企业同时面对员工、机器身份和 AI Agent 权限扩张后的
Google 在 I/O Connect India 2026 上集中展示面向印度开发者、企业和教育生态的 AI 布局:从 AI Research Foundations 课程、企业部署支持,到安全与数据本地化能力。它说明大模型竞争已进入“
白宫推进 Gold Eagle AI clearinghouse,用于协调 AI 系统相关漏洞披露、修复和行业响应。它显示 AI 安全不再只是模型公司内部的红队问题,而正在进入公共网络安全基础设施。
Axios 与 The Verge 报道称,Google DeepMind CEO Demis Hassabis 呼吁建立美国牵头、行业出资、专家主导的前沿 AI 标准机构,对最先进模型在发布前进行安全测试。这反映出 AI 治理正在从企业自
WIRED 报道称,OpenAI 安全系统负责人 Johannes Heidecke 将离职;公司将安全团队置于 Mia Glaese 扩大后的研究与安全职责之下。对中文 AI 产品团队来说,这不是一条普通人事新闻,而是前沿模型在更快训练、
Anthropic 7 月 9 日推出 Hard Questions,邀请公众提交关于 AI 就业、家庭、科学、安全和社会影响的难题,并承诺公开追踪回应行动。它不像一次模型发布,更像前沿 AI 公司在信任压力下对公众问责机制的产品化尝试。
OpenAI 在 2026 年 7 月 9 日把 GPT-5.5 Bio Bug Bounty 扩展为持续运行的 OpenAI Bio Bounty Program,并把通用越狱最高奖励提高到 5 万美元。这说明前沿模型的生物安全评估正在从
Future of Life Institute 更新 2026 夏季 AI Safety Index,将主流前沿 AI 公司放在安全治理、风险披露和承诺执行的同一张表里比较。对企业用户来说,这类外部评估正在成为选择模型供应商的新参考。