文章总结: 该文档汇总了2026年7月17日前后多项网络安全与AI安全新闻。核心要点包括:OpenAI推出GPT-Red自动化红队模型,通过自博弈强化学习挖掘提示注入漏洞,显著提升GPT-5.6Sol的防护能力;AI安全治理存在巨大断层,多数企业数据防护体系割裂;DDoS攻击进入Tbps常态化阶段,多向量攻击占比上升;可口可乐旗下Fairlife遭勒索软件攻击导致生产中断;英国调查TikTok年龄验证机制;23andMe因基因数据泄露支付1800万美元和解金;以及苹果AI在中国市场落地,将联动阿里、百度等本土大模型满足合规要求。 综合评分: 65 文章分类: 红队,AI安全,安全事件,网络安全,漏洞分析
OpenAI 推出 GPT-Red 自动化红队模型;苹果 AI 中国市场落地方案出炉,联动阿里、百度大模型满足本地化合规审核要求| 牛览
安全牛
2026年7月17日 12:05 北京
在小说阅读器读本章
去阅读
点击蓝字 关注我们
新闻速览
- OpenAI 推出 GPT-Red 自动化红队模型,大幅提升 GPT-5.6 Sol 提示词注入防护能力
- 可口可乐称Fairlife遭勒索软件攻击 美国乳制品生产暂停
- 隐藏指令即可操控AI助手,Gemini间接Prompt Injection攻击解析
- AI 安全治理存在巨大断层,千余家企业调研揭示统一数据防护建设困境
- Google Vids上线个人AI分身,账号绑定与SynthID降低身份滥用风险
- 英国调查TikTok年龄验证机制,误判儿童或触发高额罚款
- 基因数据泄露巨额和解落地:23andMe 赔付 1800 万美元,账号填充攻击暴露底层安全缺失
- 苹果 AI 中国市场落地方案出炉,联动阿里、百度大模型满足本地化合规审核要求
- ISD 研究曝光:YouTube、X 成为 AI 脱衣伪造工具主要引流渠道,非自愿深度伪造风险泛滥
- DDoS攻击进入Tbps常态化阶段,多向量攻击占比升至11.7%
特别关注
OpenAI 推出 GPT-Red 自动化红队模型,大幅提升 GPT-5.6 Sol 提示词注入防护能力
2026 年 7 月 16 日,OpenAI 对外披露自研自动化红队模型 GPT-Red,依托自博弈强化学习完成大规模提示注入漏洞挖掘,用于对抗训练 GPT-5.6 Sol,强化大模型安全护栏。
GPT-Red 模拟人工红队人员逻辑,持续迭代构造恶意提示,尝试达成目录窃取、云凭证外泄、篡改 2FA、注入外部脚本等攻击目标,在间接提示注入场景下攻击效率优于人工测试人员,还挖掘出 Fake Chain-of-Thought(CoT)这类新型直注攻击。
经过 GPT-Red 对抗训练,GPT-5.6 Sol 抗提示注入能力大幅提升:相较 GPT-5.5,直注基准测试失效案例减少 6 倍;曾对 GPT-5.1 成功率超 95% 的 Fake CoT 攻击,在新版本中成功率低于 10%;面对 GPT-Red 发起的直接提示注入,模型仅 0.05% 场景失守。
实测案例显示,GPT-Red 可突破 AI 自动售货机、Codex 命令行智能体等外接工具型 AI 系统,窃取或篡改业务数据。OpenAI 将 GPT-Red 与生产模型物理隔离,防止恶意攻击能力外泄。
同步披露的配套信息显示,OpenAI 审计发现 SWE-Bench Pro 基准存在大量缺陷,约 30% 测试任务失效,已不再推荐用于评估前沿代码模型能力。
原文链接:
https://thehackernews.com/2026/07/openais-gpt-red-automates-prompt.html
热点观察
AI 安全治理存在巨大断层,千余家企业调研揭示统一数据防护建设困境
Cybersecurity Insiders 联合 Netskope 发布《2026 Unified Data Security Report》,调研覆盖 1064 名员工规模 2500 人以上企业的网络安全从业人员,聚焦多云、SaaS、终端、AI 场景下敏感数据流转的可视、管控与溯源难题。
调研核心数据显示,58% 企业部署 11 套及以上独立数据安全工具,仅 7% 从业者确信敏感数据不会无管控流入 AI;仅 7% 可实时跨应用追踪敏感数据流向,27% 企业需耗时数周人工还原数据传输路径。
管控层面存在明显失衡:53% 企业可管控文件上传行为,但仅 20% 能约束向 AI 工具提交提示词、文本内容;67% 企业制定 AI 安全制度,仅有 8% 可在 AI 环境落地常态化管控策略。
取证溯源能力同样薄弱,面对监管核查需求,仅 12% 机构可快速出具完整数据保管链证据。报告指出,企业多零散堆砌安全产品,数据防护体系割裂,安全团队难以掌握数据流转全链路,导致策略执行标准不一、安全取证分散。
报告配套数据安全成熟度矩阵,梳理企业建设卡点,并提出五大落地举措,用于补齐数据可视、AI 治理、合规取证等能力缺口。报告为 20 页 PDF 文档,可免费无注册下载。
原文链接:
2026 Unified Data Security Report
ISD 研究曝光:YouTube、X 成为 AI 脱衣伪造工具主要引流渠道,非自愿深度伪造风险泛滥
2026 年 7 月 14 日,反极端主义机构 ISD 发布专项报告,指出 YouTube、X 两大主流社交平台已成为 nudify 类 AI 脱衣伪造工具的核心引流入口,大量非自愿私密图像(NCII)黑产依托平台传播。
报告统计 2025 年 12 月至 2026 年 3 月数据,社交平台为伪造工具网站带来超 570 万次访问,其中 YouTube 引流 182 万次,占比超 30%;X 引流 130 万次。平台内大量测评、推广视频附带工具链接与优惠码,明显违反平台禁止色情相关内容、外链的规则,但审核落地存在严重缺失。
此类 AI 工具单张生成成本低至 1 美元,行业年总营收可达 3600 万美元,使用者除色情目的外,还利用伪造图像实施职场打压、人身胁迫等恶意行为;X 平台内置 AI 对话工具 Grok 曾被用于生成未成年人不雅伪造图,平台后续仅限制付费用户使用。
美国已出台联邦 Take It Down Act 法案,明确定义非自愿私密图像违法,明尼苏达州更是首个专门立法禁止 nudify 工具。但全球超 90 所校园已出现深度伪造侵害案例,工具仍持续扩散。
报告呼吁平台完善内容拦截、外链管控机制,搭配专项立法与数字素养教育形成综合治理体系,弥补 AI 图像伪造领域的安全治理短板。
原文链接:
https://www.wired.com/story/youtube-and-x-have-become-gateways-to-nudify-apps/#intcid=_wired-tag-right-rail_a2eb72e5-cf1e-4822-a1b3-e00aa6ffbd25_popular4-2
DDoS攻击进入Tbps常态化阶段,多向量攻击占比升至11.7%
DDoS防护厂商CURATOR发布2026年上半年报告称,Tbps级攻击正由少见事件转为常态。仅4月至6月,该公司便拦截12起峰值超过1Tbps的攻击,是2025年全年数量的两倍。
金融科技仍是受攻击最多的行业,但占比由44.2%降至31.9%。媒体行业攻击显著增加,电视台、广播机构和博主所在细分领域占全部事件的12.7%,跃居首位。支付系统、银行、在线博彩和电商平台同样位列高风险目标。
季度内两次最强攻击均指向在线博彩平台,峰值分别达到1.64Tbps和1.58Tbps,最高包速率为每秒6.38亿个数据包。持续时间最长的一次攻击针对在线零售业务,接近80小时。
攻击复杂度也在上升。多向量攻击占比由2025年的8.0%增至11.7%,攻击者同时组合UDP flood、TCP flood、SYN flood等方式耗尽网络和服务器资源。ICMP flood占比则由0.1%升至4.3%。
受美、加、德执法机构联合打击Aisuru和Kimwolf基础设施影响,最大Botnet规模从1350万台设备降至209万台。但CURATOR认为,随着脆弱联网设备增加,以及AI降低攻击组织和自动化门槛,威胁不会长期回落。由于攻击源分布趋于全球化,单纯依赖地理封禁效果有限,公开网站和服务仍需部署不依赖行业假设的分层DDoS防护体系。
原文链接:
https://www.securitylab.ru/news/574942.php
安全事件
可口可乐称Fairlife遭勒索软件攻击 美国乳制品生产暂停
2026 年 7 月 16 日,Coca-Cola 向美国证券交易委员会(SEC)提交 Form 8-K 公告,披露旗下乳制品子品牌 fairlife 遭遇勒索软件攻击,全美工厂生产活动临时中断。
本次攻击中,恶意攻击者未经授权入侵 fairlife 内网,波及核心生产相关业务系统。企业监测到异常后,第一时间启动事件响应与业务连续性预案,同步联合外部网络安全专家开展溯源排查,并向执法部门报备案件。
官方明确,本次网络事件未造成产品质量、食品安全问题;fairlife 加拿大厂区系统未遭入侵,生产正常运转。截至公告发布,尚无勒索软件团伙认领此次攻击,Coca-Cola 未披露是否发生数据窃取、是否收到赎金勒索通知。企业对外回应称,除公开文件外暂无更多细节可披露。
fairlife 主营超滤牛奶、Core Power 蛋白饮、营养代餐等乳制品,其生产系统瘫痪直接造成美国市场供货停滞。目前企业仍在修复受加密影响的业务系统,事故整体经济损失、是否构成重大经营影响尚在评估中。
安全行业分析指出,该事件属于典型工业场景勒索攻击,攻击者优先瞄准制造产线控制系统,通过加密生产设备迫使企业停产妥协;若后台客户、生产数据已被窃取,后续大概率触发双重勒索,黑客会以泄露敏感数据持续施压企业支付赎金。
原文链接:
https://www.bleepingcomputer.com/news/security/coca-cola-says-fairlife-ransomware-attack-halts-us-dairy-production/
英国调查TikTok年龄验证机制,误判儿童或触发高额罚款
英国通信监管机构Ofcom于7月15日对TikTok启动调查,怀疑其年龄验证措施未能有效识别未成年用户,可能违反英国《在线安全法》。Ofcom指出,TikTok使用的年龄推断模型或未能正确识别“相当比例”的儿童,使其面临色情、自杀及进食障碍等有害内容。
年龄推断不同于身份证件、生物特征或文件验证,它主要通过分析用户的浏览习惯、互动行为及其他网络活动来估算年龄。Ofcom认为,该技术不属于监管指南列出的“高度有效”年龄验证方法,并要求依赖此类模型履行儿童保护义务的平台尽快改用更可靠的方案。
根据《在线安全法》,违规企业最高可被处以1800万英镑或符合条件的全球营业收入10%的罚款,严重情况下还可能被限制在英国运营。TikTok回应称,公司已投入数十亿美元用于平台安全,并通过专业规则和先进年龄推断技术实施年龄适配体验,有信心证明其符合法律要求。Ofcom计划于10月公布调查进展。
原文链接:
https://therecord.media/ofcom-investigation-tiktok-age-verification
基因数据泄露巨额和解落地:23andMe 赔付 1800 万美元,账号填充攻击暴露底层安全缺失
2026 年 7 月 16 日,基因检测企业 23andMe(现 Chrome Holding Co.)与美国 43 州检察总长联盟达成和解,将支付 1800 万美元,了结 2023 年大规模基因数据泄露引发的合规追责。
此次安全事件源于 2023 年 4 月至 9 月持续 5 个月未被察觉的凭证填充攻击,黑客窃取 6900 万客户基因溯源数据,并将海量基因档案投放暗网售卖。多州调查证实,企业缺失多因素认证、密码黑名单、登录限流、入侵监测等基础安全防护,对异常登录行为置之不理,且未修复已知漏洞;事发初期平台否认泄露,还将风险归咎于用户密码习惯。
和解协议强制要求企业设立数据安全顾问委员会、完善风险评估流程,并保障用户删除个人基因数据的权利。 该事件衍生多起追责:2024 年企业支付 3000 万美元解决集体诉讼;英国 ICO 因同类泄露处以 312 万美元罚款,相关处罚累计超 5112 万美元。企业 2025 年 3 月申请 Chapter 11 破产,同年 7 月由 TTAM Research Institute 完成收购。
行业观点指出,基因属于极高敏感生物数据,该案例充分证明,仅靠用户自主保管账号无法抵御凭证填充攻击,面向生物信息的平台必须配齐多因素认证、异常登录风控等基础安全能力。
原文链接:
https://www.bleepingcomputer.com/news/security/23andme-to-pay-18-million-in-new-genetics-data-breach-settlement/
安全攻防
隐藏指令即可操控AI助手,Gemini间接Prompt Injection攻击解析
Kaspersky近日介绍了一项针对GoogleGemini助手的安全研究。研究人员发现,攻击者可利用间接Prompt Injection(Indirect Prompt Injection),将恶意指令隐藏在Google Calendar邀请、电子邮件或共享文档中。当用户要求Gemini总结日程、邮件等内容时,模型可能将这些隐藏内容误识别为有效指令,从而执行非预期操作。
研究团队在Black Hat 2025展示了多种攻击场景,包括删除日历事件、修改助手回复风格、推荐恶意网站,以及通过Delayed Tool Invocation绕过部分限制,在用户后续说出“谢谢”等正常指令时触发恶意操作。进一步结合Google Home等智能设备后,还可实现打开窗户、启动热水器等物理控制;在Android设备上,攻击者还可能诱导Gemini启动Zoom、获取地理位置或泄露邮件、日历等敏感信息。
研究提出了“Promptware”概念,用于描述针对大语言模型设计的恶意提示攻击。基于TARA(Threat Analysis and Risk Assessment)评估框架,73%的攻击场景被评定为High-Critical风险。研究人员已将相关问题报告给Google,Google随后部署了包括恶意提示检测、输出过滤及高风险操作需用户确认等多项缓解措施。
Kaspersky认为,随着AI助手不断接入邮件、日历、办公软件及智能家居等生态,间接Prompt Injection已成为AI应用的重要安全挑战。企业应遵循最小权限原则,加强外部内容过滤,对高风险操作实施人工确认,并持续关注AI代理的安全防护能力。
原文链接:
https://www.kaspersky.com/blog/gemini-assistant-attacks/56134/
产业动态
苹果 AI 中国市场落地方案出炉,联动阿里、百度大模型满足本地化合规审核要求
2026 年 7 月 16 日,TechCrunch 援引路透社消息披露,国家互联网信息办公室正式批准 Apple Intelligence 在中国大陆上线,苹果将依托本土大模型厂商完成本地化 AI 合规部署。
此前 Apple Intelligence 自 2024 年发布后长期未能进入中国市场,核心卡点为境内生成式 AI 监管合规要求。本次获批核心合作方案为接入 Alibaba 旗下 Qwen 大模型,全面适配 iOS、iPadOS、macOS、visionOS 全系统,覆盖图文理解、图文生成等核心 AI 能力;Alibaba 官方确认合作落地,但未公布正式上线时间。
Baidu 方面也向媒体证实,同步参与适配面向国内用户的 Apple Intelligence 功能开发。另有消息称苹果还在对接 DeepSeek、ByteDance 等本土大模型厂商,拓展备选算力与能力底座。
从市场数据来看,苹果大中华区第二季度营收达 205 亿美元,同比上涨 28%,且最新促销活动后苹果重回国内智能手机市场第二名,中国属于苹果核心营收市场。
行业合规视角分析,苹果引入本土大模型,可实现用户 AI 交互数据境内留存、内容前置审核,满足国内生成式 AI 安全、数据跨境管控相关法规,为海外终端厂商 AI 服务入华提供典型合规落地范式。
原文链接:
Apple Intelligence approved for launch in China with Alibaba and Baidu
新品发布
Google Vids上线个人AI分身,账号绑定与SynthID降低身份滥用风险
Google于7月16日宣布升级Google Vids,用户可通过上传自拍照片和语音录音,创建外貌、声音与本人相似的定制数字分身,并让其出演AI生成的视频。该功能进一步推动Google Vids从面向企业的AI演示工具,转向一体化视频创作平台。
此次更新还将多模态模型Gemini Omni引入Google Vids。用户可同时提交文字Prompt和参考图片,由模型综合生成视频,也可替换手机视频背景、修正光线或添加视觉效果。新功能支持分步骤编辑,用户无需因局部修改而重新生成整段视频。
在安全与身份保护方面,个人Avatar将与账号持有者的生物特征及Google账号绑定,生成内容还会嵌入不可见的SynthID数字水印,以便识别AI生成素材并降低冒用风险。该功能目前仅向部分地区年满18岁的用户开放。
Google Vids原本主要用于企业通知和培训视频,如今加入个人Avatar及对话式编辑能力后,将与HeyGen、Synthesia、Captions和D-ID等AI视频平台展开更直接的竞争。对安全从业者而言,数字分身的账号认证、授权边界、水印可靠性及生物特征数据保护,将成为此类工具规模化应用后的重点风险领域。
原文链接:
Google Vids now lets you star in your own AI videos
联系我们
合作电话:18610811242
合作微信:aqniu001
联系邮箱:[email protected]
免责声明:
本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。
任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。
本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。
本文转载自:安全牛 《OpenAI 推出 GPT-Red 自动化红队模型;苹果 AI 中国市场落地方案出炉,联动阿里、百度大模型满足本地化合规审核要求| 牛览》
版权声明
本站仅做备份收录,仅供研究与教学参考之用。
读者将信息用于其他用途的,全部法律及连带责任由读者自行承担,本站不承担任何责任。








评论