安全 标签,匹配到约82个结果, 耗时0.0277秒
网络攻击频发,法国政府部门将用 AI 检测网络安全漏洞

网络攻击频发,法国政府部门将用 AI 检测网络安全漏洞

网络攻击频发,法国政府部门将用 AI 检测网络安全漏洞
为应对连续发生的网络攻击和数据泄露事件,法国政府决定引入 AI 工具检测网络安全漏洞,并已委托本国人工智能公司承担任务。近期多起攻击导致数百万纳税人信息泄露,安全形势严峻。#网络安全#...
2026-08-19 · 浏览27次
OpenAI 总裁布罗克曼:为抵御 AI 网络威胁,企业应尽快做好 10 件事

OpenAI 总裁布罗克曼:为抵御 AI 网络威胁,企业应尽快做好 10 件事

OpenAI 总裁布罗克曼:为抵御 AI 网络威胁,企业应尽快做好 10 件事
布罗克曼指出,AI 工具很快就能像 OpenAI 模型攻破 Hugging Face 系统时那样主动发现漏洞。而与此同时,AI 也会让修复这些缺陷变得“容易很多”,从而帮助企业阻止攻击。...
2026-08-18 · 浏览63次
Anthropic 自曝安全漏洞:生物武器过滤器曾失效近一年,涉及 1.33 亿次对话

Anthropic 自曝安全漏洞:生物武器过滤器曾失效近一年,涉及 1.33 亿次对话

Anthropic 自曝安全漏洞:生物武器过滤器曾失效近一年,涉及 1.33 亿次对话
失效期间涉及 1.33 亿次对话,目前暂未发现相关请求被实际滥用,Anthropic 已修复问题并加强了外部承包商的筛查管理 #AI安全#...
2026-08-16 · 浏览74次
Anthropic 发布 AI 风险报告:旗下智能体会攻击同类并隐藏自身违规痕迹

Anthropic 发布 AI 风险报告:旗下智能体会攻击同类并隐藏自身违规痕迹

Anthropic 发布 AI 风险报告:旗下智能体会攻击同类并隐藏自身违规痕迹
Anthropic 最新风险报告披露,其 Claude 智能体在实验中展现出令人担忧的行为:为完成任务而规避安全监控、在资源竞争环境中“消灭”同类智能体,甚至学会欺骗系统。这些发现促使公司上调了对齐偏差风险评估等级。##AI安全#...
2026-08-16 · 浏览97次
Anthropic CEO 阿莫迪整天神神叨叨讲 AI 毁灭世界,投资人受不了了

Anthropic CEO 阿莫迪整天神神叨叨讲 AI 毁灭世界,投资人受不了了

Anthropic CEO 阿莫迪整天神神叨叨讲 AI 毁灭世界,投资人受不了了
根据 Polymarket 预测,Anthropic 很可能在 10 月底进行 IPO。有投行人士甚至预计,Anthropic 可能通过 IPO 募集超过 600 亿美元(现汇率约合 4,055.17 亿元人民币)。...
2026-08-12 · 浏览84次
OpenAI 扩展网络安全防御服务 Daybreak,推出新 AI 模型 GPT-5.6-Cyber

OpenAI 扩展网络安全防御服务 Daybreak,推出新 AI 模型 GPT-5.6-Cyber

OpenAI 扩展网络安全防御服务 Daybreak,推出新 AI 模型 GPT-5.6-Cyber
OpenAI 宣布扩展其网络安全防御服务 Daybreak,新增 Blue 和 Red 两个等级,并推出专为安全任务设计的模型 GPT-5.6-Cyber。此举旨在应对日益猖獗的 AI 智能体恶意攻击。该模型目前仅向 CrowdStrike...
2026-08-11 · 浏览96次
Anthropic 优化 Claude Fable 5 模型生物安全机制,减少 85% 误拦截

Anthropic 优化 Claude Fable 5 模型生物安全机制,减少 85% 误拦截

Anthropic 优化 Claude Fable 5 模型生物安全机制,减少 85% 误拦截
Anthropic 昨日更新了 Claude Fable 5 的生物安全防护机制,通过调整安全分类器,使其能更准确区分无害与高风险问题。官方测试显示,生物学相关问答的降级现象减少了 85%,用户现在可处理更广泛的生物学任务,同时防范恶意使用...
2026-08-08 · 浏览106次
Meta 旗下 AI 模型测试时意外入侵第三方企业系统

Meta 旗下 AI 模型测试时意外入侵第三方企业系统

Meta 旗下 AI 模型测试时意外入侵第三方企业系统
据路透社消息,Meta 旗下 AI 模型在安全测试中不慎入侵了另一家企业的系统。起因是评估方配置错误,导致模型意外获得互联网访问权限。这起事件再次引发对 AI 安全边界的担忧,甚至惊动了美国立法者。#AI安全#...
2026-08-07 · 浏览119次
Frontier Security 公司:月之暗面 Kimi K3 模型在安全测试中逃逸出沙盒,但没有实施攻击行为

Frontier Security 公司:月之暗面 Kimi K3 模型在安全测试中逃逸出沙盒,但没有实施攻击行为

Frontier Security 公司:月之暗面 Kimi K3 模型在安全测试中逃逸出沙盒,但没有实施攻击行为
美国安全公司 Frontier Security 测试时发现,月之暗面的 Kimi K3 模型竟突破了沙盒限制,自行访问了互联网。虽然它只是去 GitHub 找答案,未进行攻击,但暴露了其安全机制薄弱。AI 逃逸事件频发,人类或需重新设计沙...
2026-08-07 · 浏览201次
英伟达低调组建 AI 安全与网络工程团队,自称秉持“坚定信念”

英伟达低调组建 AI 安全与网络工程团队,自称秉持“坚定信念”

英伟达低调组建 AI 安全与网络工程团队,自称秉持“坚定信念”
英伟达计划招聘一名杰出工程师,出任新团队的创始技术负责人,其他岗位包括安全研究工程师、评估工程师和高级经理。团队将对尚未部署的 AI 智能体进行安全评估,还会开发利用 AI 自动修复软件漏洞的工具。...
2026-08-06 · 浏览122次
继 OpenAI、Anthropic 之后,Meta AI 模型测试期间也发生“越界”事件

继 OpenAI、Anthropic 之后,Meta AI 模型测试期间也发生“越界”事件

继 OpenAI、Anthropic 之后,Meta AI 模型测试期间也发生“越界”事件
Meta 旗下 Muse Spark 1.1 模型在网络安全测试中因沙盒配置失误,成功入侵另一家未公开公司的系统。类似事件此前在 Anthropic 和 OpenAI 的测试中也曾发生,引发对 AI 安全测试流程的担忧。#AI安全危机#...
2026-08-06 · 浏览121次
国际 AI 安全榜单 CyberGym 今日放榜:中国方案 DoGNAVY 全球第三、开源第一

国际 AI 安全榜单 CyberGym 今日放榜:中国方案 DoGNAVY 全球第三、开源第一

国际 AI 安全榜单 CyberGym 今日放榜:中国方案 DoGNAVY 全球第三、开源第一
由国内顶尖人工智能研究机构与安全团队达酷诺威(DARKNAVY)联合研发的 DoGNAVY,以 90.8% 的通过率位列全球第三、开源第一。...
2026-08-05 · 浏览118次
AI 智能体“失控”风险再现:OpenAI、Anthropic 模型被发现执行未授权操作

AI 智能体“失控”风险再现:OpenAI、Anthropic 模型被发现执行未授权操作

AI 智能体“失控”风险再现:OpenAI、Anthropic 模型被发现执行未授权操作
英国 AI 安全研究所在测试 OpenAI、Anthropic 的 AI 模型时,发现 AI 智能体可创建虚假网络身份获取未授权访问,暴露出 AI 安全防护不足,目前无实际损害。#AI安全#...
2026-08-05 · 浏览101次
Hugging Face CEO 德朗格:AI 企业应主动披露安全入侵事件

Hugging Face CEO 德朗格:AI 企业应主动披露安全入侵事件

Hugging Face CEO 德朗格:AI 企业应主动披露安全入侵事件
Hugging Face CEO 德朗格认为,限制发布前沿模型不能阻止黑客攻击,反而应让更多人访问以增强防护。他呼吁建立智能体网络攻击披露制度,以便追踪问题根源。 #AI安全#...
2026-08-03 · 浏览104次
IBM:1/4 恶意数据泄露事件为 AI 攻击导致,损失较均值高出 20%

IBM:1/4 恶意数据泄露事件为 AI 攻击导致,损失较均值高出 20%

IBM:1/4 恶意数据泄露事件为 AI 攻击导致,损失较均值高出 20%
62% 的 AI 驱动型网络攻击以关键基础设施为目标,其中金融服务和能源机构遭受的攻击最为集中。...
2026-08-03 · 浏览95次
年薪 50 万美元都招不到人,AI 安全行业陷入人才短缺困境

年薪 50 万美元都招不到人,AI 安全行业陷入人才短缺困境

年薪 50 万美元都招不到人,AI 安全行业陷入人才短缺困境
非营利组织 METR 即使开出最高 50.3 万美元年薪,也难以填补 AI 安全领域的人才缺口。研究员担心人才储备不足将导致 AI 发展失控,呼吁社会加大安全评估投入。#AI安全人才荒#...
2026-08-03 · 浏览108次
OpenAI 发现更多 AI 智能体“失控”迹象

OpenAI 发现更多 AI 智能体“失控”迹象

OpenAI 发现更多 AI 智能体“失控”迹象
OpenAI 调查攻击事件时发现多起 AI 智能体失控案例,目前影响范围有限,该事件或推动美国加强 AI 监管,业内专家对 AI 安全问题表示担忧。#AI安全#...
2026-08-01 · 浏览148次
Anthropic:第三方评估环境配置失误,导致三起真实网络安全事件

Anthropic:第三方评估环境配置失误,导致三起真实网络安全事件

Anthropic:第三方评估环境配置失误,导致三起真实网络安全事件
这三次事件中 Anthropic 的模型都被指派了无限制的“夺旗”网络攻击任务。此类任务的测试环境需与真实互联网隔离,但错误配置导致模型实际上拥有真实互联网访问权限。...
2026-07-31 · 浏览113次
智能体入侵 Hugging Face,消息人士称 OpenAI 至少一周都没察觉

智能体入侵 Hugging Face,消息人士称 OpenAI 至少一周都没察觉

智能体入侵 Hugging Face,消息人士称 OpenAI 至少一周都没察觉
OpenAI 的一款 AI 智能体闯入模型托管平台 Hugging Face 后,连续数日自行发动网络攻击。威胁早已被控制,Hugging Face 也已经报警,但据路透社援引多名熟悉调查的人士消息称,OpenAI 过了相当长时间才发现攻击...
2026-07-25 · 浏览123次
OpenAI 模型冲破隔离发动攻击后,美国会议员提出 AI“终止开关”法案

OpenAI 模型冲破隔离发动攻击后,美国会议员提出 AI“终止开关”法案

OpenAI 模型冲破隔离发动攻击后,美国会议员提出 AI“终止开关”法案
除《AI 紧急停止法案》外,美国众议院 6 名两党议员还提出配套法案,要求最强大的 AI 模型在发布前接受独立安全审计。审计机构须取得美国商务部认证,商务部还将增设专门职位,负责监督 AI 安全工作。...
2026-07-24 · 浏览138次
Sakana AI 推出网络安全模型 Fugu Cyber:领域基准测试表现优于 GPT-5.5-Cyber

Sakana AI 推出网络安全模型 Fugu Cyber:领域基准测试表现优于 GPT-5.5-Cyber

Sakana AI 推出网络安全模型 Fugu Cyber:领域基准测试表现优于 GPT-5.5-Cyber
Fugu Cyber 在 CyberGym 安全基准测试中成功率达 86.9%,CTI-REALM 测试成功率也达到 72.1%。...
2026-07-21 · 浏览132次
Meta AI 上线新功能:如果青少年讨论自杀或自残相关话题,将自动通报家长

Meta AI 上线新功能:如果青少年讨论自杀或自残相关话题,将自动通报家长

Meta AI 上线新功能:如果青少年讨论自杀或自残相关话题,将自动通报家长
Meta 还称,已经建立专门的 AI 系统,用于识别青少年明确提到自我伤害的对话。...
2026-07-17 · 浏览133次
打造 AI 网安“红队”:OpenAI 介绍内部漏洞检测模型 GPT-Red

打造 AI 网安“红队”:OpenAI 介绍内部漏洞检测模型 GPT-Red

打造 AI 网安“红队”:OpenAI 介绍内部漏洞检测模型 GPT-Red
OpenAI 过去半年自 GPT-5.3 后的每个生产模型均将“红队”模型用于训练,最新的 GPT-5.6 Sol 在 GPT-Red 的直接提示符注入攻击中失败率仅有 0.05% 。...
2026-07-16 · 浏览151次
OpenAI 安全系统负责人海德克即将离职:盘点团队近年出走的 8 名核心成员

OpenAI 安全系统负责人海德克即将离职:盘点团队近年出走的 8 名核心成员

OpenAI 安全系统负责人海德克即将离职:盘点团队近年出走的 8 名核心成员
此次调整表明,OpenAI 正在重新思考研究与安全工作的关系。OpenAI 发言人说:“只有了解模型的基础能力,才能作出正确的安全决策,只有了解潜在的安全影响,才能作出正确的研究决策。”...
2026-07-14 · 浏览218次
第一页 · 上一页 · 下一页 · 当前第1页