网易首页 > 网易号 > 正文 申请入驻

OpenAI 推出 GPT-Red 自动化红队模型;苹果 AI 中国市场落地方案出炉,联动阿里、百度大模型满足本地化合规审核要求| 牛览

0
分享至


新闻速览

  • OpenAI 推出 GPT-Red 自动化红队模型,大幅提升 GPT-5.6 Sol 提示词注入防护能力

  • 可口可乐称Fairlife遭勒索软件攻击 美国乳制品生产暂停

  • 隐藏指令即可操控AI助手,Gemini间接Prompt Injection攻击解析

  • AI 安全治理存在巨大断层,千余家企业调研揭示统一数据防护建设困境

  • Google Vids上线个人AI分身,账号绑定与SynthID降低身份滥用风险

  • 英国调查TikTok年龄验证机制,误判儿童或触发高额罚款

  • 基因数据泄露巨额和解落地:23andMe 赔付 1800 万美元,账号填充攻击暴露底层安全缺失

  • 苹果 AI 中国市场落地方案出炉,联动阿里、百度大模型满足本地化合规审核要求

  • ISD 研究曝光:YouTube、X 成为 AI 脱衣伪造工具主要引流渠道,非自愿深度伪造风险泛滥

  • DDoS攻击进入Tbps常态化阶段,多向量攻击占比升至11.7%

特别关注

OpenAI 推出 GPT-Red 自动化红队模型,大幅提升 GPT-5.6 Sol 提示词注入防护能力

2026 年 7 月 16 日,OpenAI 对外披露自研自动化红队模型 GPT-Red,依托自博弈强化学习完成大规模提示注入漏洞挖掘,用于对抗训练 GPT-5.6 Sol,强化大模型安全护栏。

GPT-Red 模拟人工红队人员逻辑,持续迭代构造恶意提示,尝试达成目录窃取、云凭证外泄、篡改 2FA、注入外部脚本等攻击目标,在间接提示注入场景下攻击效率优于人工测试人员,还挖掘出 Fake Chain-of-Thought(CoT)这类新型直注攻击。

经过 GPT-Red 对抗训练,GPT-5.6 Sol 抗提示注入能力大幅提升:相较 GPT-5.5,直注基准测试失效案例减少 6 倍;曾对 GPT-5.1 成功率超 95% 的 Fake CoT 攻击,在新版本中成功率低于 10%;面对 GPT-Red 发起的直接提示注入,模型仅 0.05% 场景失守。

实测案例显示,GPT-Red 可突破 AI 自动售货机、Codex 命令行智能体等外接工具型 AI 系统,窃取或篡改业务数据。OpenAI 将 GPT-Red 与生产模型物理隔离,防止恶意攻击能力外泄。

同步披露的配套信息显示,OpenAI 审计发现 SWE-Bench Pro 基准存在大量缺陷,约 30% 测试任务失效,已不再推荐用于评估前沿代码模型能力。

https://thehackernews.com/2026/07/openais-gpt-red-automates-prompt.html

热点观察

AI 安全治理存在巨大断层,千余家企业调研揭示统一数据防护建设困境

Cybersecurity Insiders 联合 Netskope 发布《2026 Unified Data Security Report》,调研覆盖 1064 名员工规模 2500 人以上企业的网络安全从业人员,聚焦多云、SaaS、终端、AI 场景下敏感数据流转的可视、管控与溯源难题。

调研核心数据显示,58% 企业部署 11 套及以上独立数据安全工具,仅 7% 从业者确信敏感数据不会无管控流入 AI;仅 7% 可实时跨应用追踪敏感数据流向,27% 企业需耗时数周人工还原数据传输路径。

管控层面存在明显失衡:53% 企业可管控文件上传行为,但仅 20% 能约束向 AI 工具提交提示词、文本内容;67% 企业制定 AI 安全制度,仅有 8% 可在 AI 环境落地常态化管控策略。

取证溯源能力同样薄弱,面对监管核查需求,仅 12% 机构可快速出具完整数据保管链证据。报告指出,企业多零散堆砌安全产品,数据防护体系割裂,安全团队难以掌握数据流转全链路,导致策略执行标准不一、安全取证分散。

报告配套数据安全成熟度矩阵,梳理企业建设卡点,并提出五大落地举措,用于补齐数据可视、AI 治理、合规取证等能力缺口。报告为 20 页 PDF 文档,可免费无注册下载。

https://www.cybersecurity-insiders.com/portfolio/2026-unified-data-security-report-netskope/

ISD 研究曝光:YouTube、X 成为 AI 脱衣伪造工具主要引流渠道,非自愿深度伪造风险泛滥

2026 年 7 月 14 日,反极端主义机构 ISD 发布专项报告,指出 YouTube、X 两大主流社交平台已成为 nudify 类 AI 脱衣伪造工具的核心引流入口,大量非自愿私密图像(NCII)黑产依托平台传播。

报告统计 2025 年 12 月至 2026 年 3 月数据,社交平台为伪造工具网站带来超 570 万次访问,其中 YouTube 引流 182 万次,占比超 30%;X 引流 130 万次。平台内大量测评、推广视频附带工具链接与优惠码,明显违反平台禁止色情相关内容、外链的规则,但审核落地存在严重缺失。

此类 AI 工具单张生成成本低至 1 美元,行业年总营收可达 3600 万美元,使用者除色情目的外,还利用伪造图像实施职场打压、人身胁迫等恶意行为;X 平台内置 AI 对话工具 Grok 曾被用于生成未成年人不雅伪造图,平台后续仅限制付费用户使用。

美国已出台联邦 Take It Down Act 法案,明确定义非自愿私密图像违法,明尼苏达州更是首个专门立法禁止 nudify 工具。但全球超 90 所校园已出现深度伪造侵害案例,工具仍持续扩散。

报告呼吁平台完善内容拦截、外链管控机制,搭配专项立法与数字素养教育形成综合治理体系,弥补 AI 图像伪造领域的安全治理短板。

https://www.wired.com/story/youtube-and-x-have-become-gateways-to-nudify-apps/=_wired-tag-right-rail_a2eb72e5-cf1e-4822-a1b3-e00aa6ffbd25_popular4-2

DDoS攻击进入Tbps常态化阶段,多向量攻击占比升至11.7%

DDoS防护厂商CURATOR发布2026年上半年报告称,Tbps级攻击正由少见事件转为常态。仅4月至6月,该公司便拦截12起峰值超过1Tbps的攻击,是2025年全年数量的两倍。

金融科技仍是受攻击最多的行业,但占比由44.2%降至31.9%。媒体行业攻击显著增加,电视台、广播机构和博主所在细分领域占全部事件的12.7%,跃居首位。支付系统、银行、在线博彩和电商平台同样位列高风险目标。

季度内两次最强攻击均指向在线博彩平台,峰值分别达到1.64Tbps和1.58Tbps,最高包速率为每秒6.38亿个数据包。持续时间最长的一次攻击针对在线零售业务,接近80小时。

攻击复杂度也在上升。多向量攻击占比由2025年的8.0%增至11.7%,攻击者同时组合UDP flood、TCP flood、SYN flood等方式耗尽网络和服务器资源。ICMP flood占比则由0.1%升至4.3%。

受美、加、德执法机构联合打击Aisuru和Kimwolf基础设施影响,最大Botnet规模从1350万台设备降至209万台。但CURATOR认为,随着脆弱联网设备增加,以及AI降低攻击组织和自动化门槛,威胁不会长期回落。由于攻击源分布趋于全球化,单纯依赖地理封禁效果有限,公开网站和服务仍需部署不依赖行业假设的分层DDoS防护体系。

https://www.securitylab.ru/news/574942.php

安全事件

可口可乐称Fairlife遭勒索软件攻击 美国乳制品生产暂停

2026 年 7 月 16 日,Coca-Cola 向美国证券交易委员会(SEC)提交 Form 8-K 公告,披露旗下乳制品子品牌 fairlife 遭遇勒索软件攻击,全美工厂生产活动临时中断。

本次攻击中,恶意攻击者未经授权入侵 fairlife 内网,波及核心生产相关业务系统。企业监测到异常后,第一时间启动事件响应与业务连续性预案,同步联合外部网络安全专家开展溯源排查,并向执法部门报备案件。

官方明确,本次网络事件未造成产品质量、食品安全问题;fairlife 加拿大厂区系统未遭入侵,生产正常运转。截至公告发布,尚无勒索软件团伙认领此次攻击,Coca-Cola 未披露是否发生数据窃取、是否收到赎金勒索通知。企业对外回应称,除公开文件外暂无更多细节可披露。

fairlife 主营超滤牛奶、Core Power 蛋白饮、营养代餐等乳制品,其生产系统瘫痪直接造成美国市场供货停滞。目前企业仍在修复受加密影响的业务系统,事故整体经济损失、是否构成重大经营影响尚在评估中。

安全行业分析指出,该事件属于典型工业场景勒索攻击,攻击者优先瞄准制造产线控制系统,通过加密生产设备迫使企业停产妥协;若后台客户、生产数据已被窃取,后续大概率触发双重勒索,黑客会以泄露敏感数据持续施压企业支付赎金。

https://www.bleepingcomputer.com/news/security/coca-cola-says-fairlife-ransomware-attack-halts-us-dairy-production/

英国调查TikTok年龄验证机制,误判儿童或触发高额罚款

英国通信监管机构Ofcom于7月15日对TikTok启动调查,怀疑其年龄验证措施未能有效识别未成年用户,可能违反英国《在线安全法》。Ofcom指出,TikTok使用的年龄推断模型或未能正确识别“相当比例”的儿童,使其面临色情、自杀及进食障碍等有害内容。

年龄推断不同于身份证件、生物特征或文件验证,它主要通过分析用户的浏览习惯、互动行为及其他网络活动来估算年龄。Ofcom认为,该技术不属于监管指南列出的“高度有效”年龄验证方法,并要求依赖此类模型履行儿童保护义务的平台尽快改用更可靠的方案。

根据《在线安全法》,违规企业最高可被处以1800万英镑或符合条件的全球营业收入10%的罚款,严重情况下还可能被限制在英国运营。TikTok回应称,公司已投入数十亿美元用于平台安全,并通过专业规则和先进年龄推断技术实施年龄适配体验,有信心证明其符合法律要求。Ofcom计划于10月公布调查进展。

https://therecord.media/ofcom-investigation-tiktok-age-verification

基因数据泄露巨额和解落地:23andMe 赔付 1800 万美元,账号填充攻击暴露底层安全缺失

2026 年 7 月 16 日,基因检测企业 23andMe(现 Chrome Holding Co.)与美国 43 州检察总长联盟达成和解,将支付 1800 万美元,了结 2023 年大规模基因数据泄露引发的合规追责。

此次安全事件源于 2023 年 4 月至 9 月持续 5 个月未被察觉的凭证填充攻击,黑客窃取 6900 万客户基因溯源数据,并将海量基因档案投放暗网售卖。多州调查证实,企业缺失多因素认证、密码黑名单、登录限流、入侵监测等基础安全防护,对异常登录行为置之不理,且未修复已知漏洞;事发初期平台否认泄露,还将风险归咎于用户密码习惯。

和解协议强制要求企业设立数据安全顾问委员会、完善风险评估流程,并保障用户删除个人基因数据的权利。 该事件衍生多起追责:2024 年企业支付 3000 万美元解决集体诉讼;英国 ICO 因同类泄露处以 312 万美元罚款,相关处罚累计超 5112 万美元。企业 2025 年 3 月申请 Chapter 11 破产,同年 7 月由 TTAM Research Institute 完成收购。

行业观点指出,基因属于极高敏感生物数据,该案例充分证明,仅靠用户自主保管账号无法抵御凭证填充攻击,面向生物信息的平台必须配齐多因素认证、异常登录风控等基础安全能力。

https://www.bleepingcomputer.com/news/security/23andme-to-pay-18-million-in-new-genetics-data-breach-settlement/

安全攻防

隐藏指令即可操控AI助手,Gemini间接Prompt Injection攻击解析

Kaspersky近日介绍了一项针对GoogleGemini助手的安全研究。研究人员发现,攻击者可利用间接Prompt Injection(Indirect Prompt Injection),将恶意指令隐藏在Google Calendar邀请、电子邮件或共享文档中。当用户要求Gemini总结日程、邮件等内容时,模型可能将这些隐藏内容误识别为有效指令,从而执行非预期操作。

研究团队在Black Hat 2025展示了多种攻击场景,包括删除日历事件、修改助手回复风格、推荐恶意网站,以及通过Delayed Tool Invocation绕过部分限制,在用户后续说出“谢谢”等正常指令时触发恶意操作。进一步结合Google Home等智能设备后,还可实现打开窗户、启动热水器等物理控制;在Android设备上,攻击者还可能诱导Gemini启动Zoom、获取地理位置或泄露邮件、日历等敏感信息。

研究提出了“Promptware”概念,用于描述针对大语言模型设计的恶意提示攻击。基于TARA(Threat Analysis and Risk Assessment)评估框架,73%的攻击场景被评定为High-Critical风险。研究人员已将相关问题报告给Google,Google随后部署了包括恶意提示检测、输出过滤及高风险操作需用户确认等多项缓解措施。

Kaspersky认为,随着AI助手不断接入邮件、日历、办公软件及智能家居等生态,间接Prompt Injection已成为AI应用的重要安全挑战。企业应遵循最小权限原则,加强外部内容过滤,对高风险操作实施人工确认,并持续关注AI代理的安全防护能力。

https://www.kaspersky.com/blog/gemini-assistant-attacks/56134/

产业动态

苹果 AI 中国市场落地方案出炉,联动阿里、百度大模型满足本地化合规审核要求

2026 年 7 月 16 日,TechCrunch 援引路透社消息披露,国家互联网信息办公室正式批准 Apple Intelligence 在中国大陆上线,苹果将依托本土大模型厂商完成本地化 AI 合规部署。

此前 Apple Intelligence 自 2024 年发布后长期未能进入中国市场,核心卡点为境内生成式 AI 监管合规要求。本次获批核心合作方案为接入 Alibaba 旗下 Qwen 大模型,全面适配 iOS、iPadOS、macOS、visionOS 全系统,覆盖图文理解、图文生成等核心 AI 能力;Alibaba 官方确认合作落地,但未公布正式上线时间。

Baidu 方面也向媒体证实,同步参与适配面向国内用户的 Apple Intelligence 功能开发。另有消息称苹果还在对接 DeepSeek、ByteDance 等本土大模型厂商,拓展备选算力与能力底座。

从市场数据来看,苹果大中华区第二季度营收达 205 亿美元,同比上涨 28%,且最新促销活动后苹果重回国内智能手机市场第二名,中国属于苹果核心营收市场。

行业合规视角分析,苹果引入本土大模型,可实现用户 AI 交互数据境内留存、内容前置审核,满足国内生成式 AI 安全、数据跨境管控相关法规,为海外终端厂商 AI 服务入华提供典型合规落地范式。

https://techcrunch.com/2026/07/16/apple-intelligence-approved-for-launch-in-china-with-alibabas-qwen-ai/

新品发布

Google Vids上线个人AI分身,账号绑定与SynthID降低身份滥用风险

Google于7月16日宣布升级Google Vids,用户可通过上传自拍照片和语音录音,创建外貌、声音与本人相似的定制数字分身,并让其出演AI生成的视频。该功能进一步推动Google Vids从面向企业的AI演示工具,转向一体化视频创作平台。

此次更新还将多模态模型Gemini Omni引入Google Vids。用户可同时提交文字Prompt和参考图片,由模型综合生成视频,也可替换手机视频背景、修正光线或添加视觉效果。新功能支持分步骤编辑,用户无需因局部修改而重新生成整段视频。

在安全与身份保护方面,个人Avatar将与账号持有者的生物特征及Google账号绑定,生成内容还会嵌入不可见的SynthID数字水印,以便识别AI生成素材并降低冒用风险。该功能目前仅向部分地区年满18岁的用户开放。

Google Vids原本主要用于企业通知和培训视频,如今加入个人Avatar及对话式编辑能力后,将与HeyGen、Synthesia、Captions和D-ID等AI视频平台展开更直接的竞争。对安全从业者而言,数字分身的账号认证、授权边界、水印可靠性及生物特征数据保护,将成为此类工具规模化应用后的重点风险领域。

https://techcrunch.com/2026/07/16/google-vids-now-lets-you-star-in-your-own-ai-videos/

合作电话:18610811242

合作微信:aqniu001

联系邮箱:bd@aqniu.com


特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
梅德韦杰夫:拯救俄罗斯只有一条路,打赢这场特别军事行动

梅德韦杰夫:拯救俄罗斯只有一条路,打赢这场特别军事行动

鲁中晨报
2026-07-30 20:26:06
7月政治局重磅定调!6大信号落地,5年内普通人命运将重新洗牌

7月政治局重磅定调!6大信号落地,5年内普通人命运将重新洗牌

白米饭怎么吃
2026-07-30 20:33:46
住建部原副部长仇保兴建议:2000年前预制板结构的房子都应逐步拆除

住建部原副部长仇保兴建议:2000年前预制板结构的房子都应逐步拆除

专业聊房君
2026-07-29 17:41:05
宝妈电梯大战女孩后续:警方已介入,央媒怒评,点出孩子家教堪忧

宝妈电梯大战女孩后续:警方已介入,央媒怒评,点出孩子家教堪忧

社会日日鲜
2026-07-30 12:10:27
随着吴宜泽6-5绝杀墨菲,上海大师赛4强全出炉!最新夺冠排行如下

随着吴宜泽6-5绝杀墨菲,上海大师赛4强全出炉!最新夺冠排行如下

小火箭爱体育
2026-07-30 23:42:22
内塔尼亚胡,万里赴葬礼

内塔尼亚胡,万里赴葬礼

中国新闻周刊
2026-07-29 21:43:19
中方必须无条件割让领土?美发话后,马来西亚叫嚣:中国放弃南海

中方必须无条件割让领土?美发话后,马来西亚叫嚣:中国放弃南海

梦在深巷aqa
2026-07-31 02:01:50
NASA探测器原本只是路过火星,结果拍到了它从未被见过的样子

NASA探测器原本只是路过火星,结果拍到了它从未被见过的样子

知识碎碎念
2026-07-30 00:27:58
媒体爆料:马斯克计划斥巨资助力共和党中期选举 目前正重启由他创建的“美国政治行动委员会”

媒体爆料:马斯克计划斥巨资助力共和党中期选举 目前正重启由他创建的“美国政治行动委员会”

每日经济新闻
2026-07-30 16:49:54
康宁的“玻璃桥”断了,京东方的百万股东傻眼了…

康宁的“玻璃桥”断了,京东方的百万股东傻眼了…

巴山侃侃
2026-07-30 20:06:25
局势失控,外资纷纷撤离,正副总统同台断交,印尼政坛迎来大清洗

局势失控,外资纷纷撤离,正副总统同台断交,印尼政坛迎来大清洗

凡知
2026-07-30 23:12:05
网友曝入职前被公司要求填离职申请:一年一签,杜绝裁员赔偿金问题

网友曝入职前被公司要求填离职申请:一年一签,杜绝裁员赔偿金问题

可达鸭面面观
2026-07-30 09:54:31
轰2杆破百!赵心童6-0零封世界第2,强势跻身上海大师赛四强

轰2杆破百!赵心童6-0零封世界第2,强势跻身上海大师赛四强

全景体育V
2026-07-30 16:17:28
深圳31岁富豪猝死,妻引产双胞胎,豪车再无主人

深圳31岁富豪猝死,妻引产双胞胎,豪车再无主人

娱乐圈见解说
2026-07-31 02:40:35
大瓜!王虹前男友被“挖”:她在获得博士学位后,感谢过一个叫王东浩的人,放在父母之后

大瓜!王虹前男友被“挖”:她在获得博士学位后,感谢过一个叫王东浩的人,放在父母之后

火山詩话
2026-07-30 20:38:54
一群小伙赤裸上身吃烧烤,周围站着一堆民警,网友:防范太到位

一群小伙赤裸上身吃烧烤,周围站着一堆民警,网友:防范太到位

映射生活的身影
2026-07-30 20:13:00
凤凰卫视“元老级”人物沈蓓蓓去世,曾被称为主持人事务部的大姐大,被夸“人品一流”

凤凰卫视“元老级”人物沈蓓蓓去世,曾被称为主持人事务部的大姐大,被夸“人品一流”

极目新闻
2026-07-30 14:56:13
全面绞杀开始?日本突然宣布,中方亮明底线:不认错,就没得谈

全面绞杀开始?日本突然宣布,中方亮明底线:不认错,就没得谈

疯狂小菠萝
2026-07-30 21:31:20
29.99万太爆炸了!雷军又让友商失眠了

29.99万太爆炸了!雷军又让友商失眠了

李东阳朋友圈
2026-07-30 23:21:25
2026年,越来越多的东西开始不对劲了。

2026年,越来越多的东西开始不对劲了。

放牛娃的遐想
2026-07-29 08:10:06
2026-07-31 05:35:00
安全牛 incentive-icons
安全牛
信息安全新媒体
4709文章数 5976关注度
往期回顾 全部

科技要闻

小米澎程N90 Max预售价29.99万

头条要闻

陕西"公公强奸儿媳案"维持原判 女方精神鉴定结果公布

头条要闻

陕西"公公强奸儿媳案"维持原判 女方精神鉴定结果公布

体育要闻

曝皇马将签罗德里!转会费6000万签约4年

娱乐要闻

周星驰用态度打破快餐式宣发

财经要闻

中共中央政治局:提升资本市场韧性和信心

汽车要闻

FREELANDER神行者8下线 8月10日开启预售/海外版同步推进

态度原创

时尚
本地
健康
数码
家居

细品赞达亚的红毯妆造,每一套都有彩蛋!

本地新闻

神仙也“蓉”漂,哪吒与八仙,皆是成都出品!

最近总忘事,我是要中风了吗?

数码要闻

国家广电总局联合工信部召开一体化电视全国推广工作部署会

家居要闻

2026建博会(广州) 公装联探展交流活动

无障碍浏览 进入关怀版