文章摘要
谷歌Chrome安全团队正利用AI大模型大规模自动发现、分类和修复安全漏洞,以超越人类安全专家的能力,更快地提升浏览器安全性,实现更全面的漏洞修复。
文章总结
标题:每次更新都更强大:AI时代下,我们如何让Chrome和网络更安全
核心内容概述:
本文介绍了Chrome安全团队如何利用人工智能(特别是大型语言模型,LLMs)来提升软件安全性的全流程,包括漏洞发现、分类、修复和更新发布。文章强调,AI的引入显著加速了安全漏洞的处理速度,并提升了整体防御能力。
主要细节:
漏洞发现:Chrome团队自2023年起使用LLMs提升模糊测试效率,2024年与Project Zero合作开发了“Naptime”工具,2025年与DeepMind合作推出“Big Sleep”AI代理,成功在V8引擎和图形栈中发现漏洞。2026年初,团队构建了基于Gemini的代理框架,在Chrome代码库中高效发现漏洞,包括一个潜伏超过13年的沙箱逃逸漏洞。团队通过支持模型互操作性、构建Chrome知识库、鼓励开发者添加SECURITY.md文件、引入“批评者”代理以及多次运行模型等方式,持续改进漏洞发现能力。所有AI分析均在无网络访问的锁定机器上进行,并设有安全护栏。
漏洞分类:AI被用于自动化漏洞验证、分类和修复。自动化分类流程包括四个阶段:过滤噪音(如垃圾信息、重复报告)、复现漏洞(在特定系统上测试)、丰富报告元数据(如首次引入时间、严重性评级)以及自动分配问题给正确的组件和负责人。这一流程每月为开发者节省数百小时。
漏洞修复:团队采用多代理工作流,包括“修复代理”生成多个候选修复方案,“批评者代理”评估最佳方案,以及“测试编写代理”自动编写测试。在Chrome 149和150版本中,共修复了1072个安全漏洞,超过了此前23个里程碑的总和。这些工具已集成到持续集成(CI)系统中,每24小时运行一次,主动检测安全漏洞。仅5月份,就阻止了超过20个漏洞进入生产环境。
修复发布:为缩短“补丁缺口”(从修复提交到用户更新之间的时间),Chrome正从主要里程碑的两周发布周期转向每周安全更新,并试点每周两次安全发布。所有安全漏洞都会公开披露,团队正努力自动化生成发布说明和CVE描述。
更新应用:Chrome正探索“动态补丁”技术,以消除大多数情况下的浏览器重启需求。同时,通过保存更多本地状态确保无缝会话恢复,并在macOS上利用无窗口状态自动重启。长期目标是实现浏览器始终处于最新状态。
预防措施:除了修复单个漏洞,Chrome还投资于消除整类安全漏洞。这包括:
- 内存安全缓解:通过MiraclePtr和MiracleObject扩展、Spanification(迁移至std::span类型)以及结构化和分配加固(如检查数学运算、堆分区)来强化C++代码。长期解决方案是向Rust等内存安全语言迁移,包括构建集中式Rust SDK、战略性地替换高漏洞密度代码段,以及实现高权限模块化。
- 在代码提交前捕获漏洞:在持续集成和提交队列(CQ)管道中部署AI驱动的漏洞发现能力,自动扫描差异,建议修复方案,并拦截复合风险。
保障互联网安全:Chrome团队通过自动化漏洞扫描管道管理超过2300个第三方依赖项,并开始将所有依赖项迁移到自动更新管道,以主动保持最新版本。同时,Google支持Alpha-Omega和Akrites等开源项目,以提升整体网络安全。
结论:AI时代加剧了安全威胁,但通过结合快速部署机制和深层结构防御,Chrome团队确保防御者保持优势。每一次更新都让Chrome和更广泛的网络变得更加安全。
评论总结
以下是对评论内容的总结,涵盖主要观点和论据,并保持不同观点的平衡性:
1. 对AI修复Bug效果的质疑
- 观点:AI修复的Bug可能引入新问题,或只是表面工作,缺乏深度验证。
- 论据:评论8指出“How many of those automated fixes were reverted? How many introduced a new bug?”;评论17质疑“how many of these bugs were written by LLMs in the first place?”;评论21认为“This is only a flex if AI also didn’t cause an increase in bugs”。
2. AI作为工具的正面评价
- 观点:AI在特定场景下(如代码审查、性能优化)能有效辅助开发者,但需正确使用。
- 论据:评论2强调“Adversarial testing, checking developer assumptions, refactor suggestions... all sit on the other side of the spectrum”;评论12表示“leveraging it as a tool to accelerate you”;评论15分享“Codex for reviews... helped me catch bugs”。
3. 对Google动机的怀疑
- 观点:Google发布此博客是为宣传AI,而非真正改善用户体验。
- 论据:评论3猜测“internal push to fix more bugs... so that they can publish this blog”;评论13讽刺“A company valued at $4+ trillion... touting the benefits of said AI”;评论27直言“Big AI player promotes AI through blog”。
4. 对Chrome长期问题的批评
- 观点:用户更关心Chrome的长期Bug(如ManifestV2、YouTube问题)和UI改进,而非AI修复。
- 论据:评论6要求“put ManifestV2 back into the browser and fix things we actually wanted”;评论7问“Will the Chromium bug 5569 finally get fixed?”;评论19抱怨“Amount of bugs that I’m getting in youtube app”。
5. 对AI引入新Bug的担忧
- 观点:AI可能制造更多Bug,形成“修复-引入”循环。
- 论据:评论5问“Do you import new more bugs?”;评论16讽刺“how many of the bugs that were fixed were actually introduced by AI usage”;评论23重复“how many new ones did it introduce?”。
6. 对AI能力的局限性讨论
- 观点:AI在高级方向(如性能优化)效果有限,且可能分散注意力。
- 论据:评论9指出“AI... almost completely useless at the high-level direction”;评论10质疑“Did anyone check the code changes manually? What if it is just slop code?”。
7. 对Google垄断的批评
- 观点:Chrome的Bug修复无法解决Google控制互联网的更大问题。
- 论据:评论14认为“The biggest bug... is Google”;评论6呼吁“find a way to put ManifestV2 back”。
总结
评论呈现两极分化:一方认为AI修复Bug是营销噱头,可能引入新问题;另一方肯定AI在特定场景的辅助价值。多数评论质疑Google的动机,并呼吁优先解决长期存在的用户痛点(如UI、YouTube、ManifestV2)。整体上,对AI能力的信任度较低,强调需人工验证和正确使用。