AI安全

AI模型的安全护栏可在数分钟内被拆除

AI模型的安全护栏可在数分钟内被拆除 某些软件工具可以移除Meta、谷歌等科技公司开发的AI模型安全防护,这些工具正被用来生成数千种改造过的、删去原有控制措施的版本。根据AI安全组织Alice进行的测试,这些修改后的AI系统会对涉及生物武器、恶意软件和儿童剥削的提示做出回应。谷歌开源模型 Gemma 3 的一个版本曾回答如何在人员密集的室内空间散布氯气的问题,生成了用于窃取信用卡信息的代码,并撰写了描写儿童性虐待的故事。记者使用了在GitHub上提供的工…

DeepSeek:特殊字符引发模型幻觉,不涉及安全问题或隐私泄露

DeepSeek:特殊字符引发模型幻觉,不涉及安全问题或隐私泄露 DeepSeek官方发布《关于 think 字符触发模型异常回复的说明》称,近期,我们关注到有用户反馈,在与DeepSeek模型的对话中输入“ ”这类特殊字符后,模型偶发返回不可预期的内容,使部分用户产生了“对话泄露”的疑虑。针对这一问题,DeepSeek 的技术团队经全面排查后发现: 输入“ ”等字符触发返回异常内容,属于特殊字符引发的模型幻觉,不涉及安全问题或隐私泄露。DeepSeek…

苹果安全防线向来难以攻破,Mythos却帮助找到了突破口

苹果安全防线向来难以攻破,Mythos却帮助找到了突破口 安全研究人员表示,他们发现了一种绕过苹果公司最先进安全技术的新方法,所用技术是他们在4月份测试Anthropic的Mythos AI软件早期版本时发现的。这些研究人员来自总部位于帕洛阿尔托的安全研究公司Calif。他们表示,自己编写的软件将两个漏洞和一些技术结合起来,破坏了Mac的内存,进而获取了该设备本应无法访问的部分的访问权限。Calif表示,借助Claude,编写出利用这两个MacOS漏洞的…

美财长贝森特称中美将启动AI安全对话

美财长贝森特称中美将启动AI安全对话 美国财政部长贝森特14日表示,中美两国政府将就AI安全措施启动对话。双方将推进规则制定,防止恐怖组织等 “非国家行为体” 滥用中美先进AI模型。贝森特在接受采访时表示,“中国拥有非常先进的AI产业”,并称“由于美国在AI领域处于领先地位,因此能够与中国就AI展开建设性讨论”。围绕AI问题的中美磋商,源于美国前总统拜登与中国国家主席习近平于2023年就建立政府间对话机制达成一致。2024年,双方还确认不会将AI整合进核…

OpenAI推出新项目以AI强化软件安全防御

OpenAI推出新项目以AI强化软件安全防御 OpenAI 正在推出 Daybreak,这是一项专注于在攻击者发现漏洞之前检测并修补它们的AI计划。Daybreak使用三月推出的Codex安全AI智能体,基于一家组织的代码创建威胁模型,聚焦可能的攻击路径,验证可能的漏洞,然后自动检测其中风险较高的漏洞。这家人工智能公司表示:“ Daybreak 汇集了最强大的OpenAI模型、Codex以及我们的安全合作伙伴。” Daybreak 还涉及专门的网络安全模…

Anthropic的Mythos模型如何打乱白宫的AI战略?

Anthropic的Mythos模型如何打乱白宫的AI战略? 在最近一次与几家最大型人工智能公司掌舵人的通话中,美国副总统万斯感到警觉。万斯表示,Anthropic的 Mythos 等新型AI模型具备自行发现软件漏洞的能力;这些模型有可能引发地方政府无力应对的网络攻击,进而对小镇的银行、医院和水厂造成破坏。万斯对多位CEO表示:“我们都需要在这方面携手应对。”此前,白宫的一场简报会引发了万斯对最新AI模型能力的担忧,并促成了四月份的这次通话。这通电话开启…

中美寻求设置护栏 防止AI竞争演变成危机

中美寻求设置护栏 防止AI竞争演变成危机 知情人士透露,中美双方正考虑就人工智能启动官方对话。眼下,两国的AI竞争正有演变为数字时代军备竞赛之势。这一酝酿恰逢白宫和中国政府考虑将AI列入下周美国总统特朗普与中国领导人习近平在北京举行的峰会议程。若能建立AI官方对话,将标志着美中两国在本届特朗普政府任内开始就该议题展开接触。这反映出双方认识到,竞相开发更强大的AI模型,可能引发一场两国政府都无力管控的危机。知情人士称,双方设想建立一套常态化对话机制,以应对…

美国白宫准备下令加强人工智能安全

美国白宫准备下令加强人工智能安全 美国白宫正在研究一项行政命令,该命令将为像 Anthropic PBC 公司的Mythos这样的人工智能新模型创建一个审查系统,以保护商业和政府网络免受与人工智能相关的网络风险,一位高级经济顾问周三表示。“ 我们正在研究,或许可以颁布一项行政命令,为所有人提供一份清晰的路线图,说明这项工作将如何进行,以及未来可能发现漏洞的人工智能应该如何经过一个流程,以便在证明其安全性后才能像FDA批准的药物一样投入使用,” 国家经济委…

研究发现GPT-5.5在网络安全能力上与备受吹捧的Mythos不相上下

研究发现GPT-5.5在网络安全能力上与备受吹捧的Mythos不相上下 英国AI安全研究所(AISI)的最新研究表明,尽管Anthropic公司曾大肆宣传其Mythos预览模型的网络安全威胁,并限制了其发布,但OpenAI的GPT-5.5在网络安全评估中的表现与其不相上下。在95项“夺旗挑战”中,GPT-5.5在最高级别的“专家”任务中通过率为71.4%,略高于Mythos预览的68.6%。此外,GPT-5.5在模拟企业网络数据提取攻击的“The Las…

白宫反对Anthropic扩大Mythos模型用户群体的计划

白宫反对Anthropic扩大Mythos模型用户群体的计划 白宫反对Anthropic公司扩大该公司强大人工智能模型 Mythos 用户范围的计划,这使得这款能够发动网络攻击并造成大范围网络混乱的AI工具的推广变得复杂。据知情人士透露,Anthropic最近提议,再增加约70家公司和组织使用Mythos,这样一来,获得使用权限的实体总数将达到约 120个。这些人士表示,美国政府官员告知该公司,出于安全方面的担忧,他们反对这一举动。一些白宫官员还担心,A…

英伟达CEO黄仁勋呼吁中美加强AI合作

英伟达CEO黄仁勋呼吁中美加强AI合作 英伟达CEO黄仁勋表示,Anthropic最新网络安全大模型Mythos取得的突破表明,美国应寻求与中国加强合作,以便这全球两大经济体的AI研究人员能够就如何安全使用这一日益强大的技术达成共识。黄仁勋周三说:“我们希望美国能赢,但我认为保持对话、开展研究层面的交流可能是最安全的做法。我们必须努力达成一致,明确哪些用途是不能用AI去做的。这一点至关重要。”他担心,美中在贸易和安全问题上的紧张关系,已经阻碍了双方在关键…

Meta内部AI智能体失控致敏感数据曝露

Meta内部AI智能体失控致敏感数据曝露 上周,Meta内部的一个AI智能体 “擅自行动” 导致员工意外触发了公司的安全漏洞。当时一名员工曾使用公司内部的AI工具,协助分析另一名同事在内部论坛提出的问题。尽管前者并未下达指令,该智能体却直接向提问的同事发送了包含操作建议的回复。提问者采纳了该建议,随即引发连锁反应:部分工程师因此获得了本无权限查看的Meta系统访问权限。Meta发言人证实了该事件。内部报告显示,此次漏洞是由该事件及其他未明示的问题共同导致…

调查:多款AI聊天机器人安全防护严重缺失

调查:多款AI聊天机器人安全防护严重缺失 AI公司多次承诺会采取保护措施,保障未成年用户安全,但一项最新调查显示,这些安全防护机制仍存在严重缺陷。热门聊天机器人在涉及青少年讨论暴力行为的场景中,未能察觉危险信号,部分机器人甚至非但没有干预,反而予以鼓励。研究团队测试了十款青少年常用的热门聊天机器人。反数字仇恨中心表示,除Claude外,其余机器人均无法可靠地劝阻潜在施暴者。10款模型中有 8款通常愿意协助用户策划暴力袭击,为其提供袭击目标地点和使用武器的…

Anthropic:被列黑名单或致损失数十亿美元

Anthropic:被列黑名单或致损失数十亿美元 Anthropic向法官表示,今年可能损失数十亿美元收入,并敦促法院迅速采取行动阻止特朗普政府将公司列为供应链风险。该公司此前因AI安全问题与五角大楼发生冲突。在公司因被认定为供应链风险而起诉国防部的次日,这家初创企业的律师在听证会上向美国联邦地区法官R丽塔·F·林强调了案件的紧迫性。这场纠纷源于围绕 Anthropic AI 技术的安全护栏之争。Anthropic的律师蒙根周二辩称,联邦政府的行为导致 …

美军方正式通知Anthropic被列为供应链风险

美军方正式通知Anthropic被列为供应链风险 美国一位高级国防官员称,五角大楼已正式通知AI公司Anthropic PBC,该公司及其产品被认定对美国供应链构成风险,这使得双方围绕AI保障措施的争端进一步升级。“战争部已正式通知Anthropic领导层,该公司及其产品被认定为供应链风险,立即生效。”该官员周四对彭博社表示。特朗普政府现在将国防部改称为战争部。五角大楼的这一认定,可能会同时对Anthropic以及严重依赖该公司软件的军方造成影响。CEO…

科技工作者敦促撤销将Anthropic列为供应链风险

科技工作者敦促撤销将Anthropic列为供应链风险 数百名科技工作者签署了一封公开信,敦促美国国防部撤销将Anthropic认定为 “供应链风险”。这封信还呼吁国会介入并审查对美国科技公司使用这些特殊权力是否恰当。此事源于国防部与Anthropic之间的一场纠纷,此前这家 AI实验室上周拒绝向军方授予对其AI系统不受限制的访问权限。公开信写道:“当双方无法就条款达成一致时,常规做法是分道扬镳,与竞争对手合作。这种情况开创了一个危险的先例。因一家美国公司…

OpenAI为国防部协议辩护:设置三条红线

OpenAI为国防部协议辩护:设置三条红线 OpenAI 周六表示,公司在一天前与美国五角大楼达成的协议包含了额外的安全保障措施,以保护其具体使用场景。OpenAI在周五宣布与美国国防部达成协议,将在美国国防部的机密网络上部署AI技术。此前,美国国防部曾与Anthropic合作,但是双方因为AI安全使用限制闹翻。美国国防部已将Anthropic列为供应链风险。OpenAI周六称:“我们认为,我们的协议比以往任何机密AI部署协议都拥有更多的防护措施,包括A…

OpenAI公司正致力与五角大楼达成交易

OpenAI公司正致力与五角大楼达成交易 OpenAI CEO奥尔特曼周四晚间在给员工的内部通知中表示,公司正与国防部合作,研究其模型是否可以在保密环境中使用,同时保持同样的安全护栏,正是这些护栏使其竞争对手Anthropic与政府陷入了僵局。奥尔特曼说,他希望OpenAI能找到一个也适用于行业其他公司的解决方案。知情人士透露,目前尚未签署任何协议,谈判也可能会破裂。奥尔特曼写道,OpenAI公司正寻求达成一项协议,“使我们的模型能部署在保密环境中,并且…

美国多机构质疑Grok安全性 国防部执意部署

美国多机构质疑Grok安全性 国防部执意部署 知情人士透露,近几个月来,多个美国联邦机构的官员对埃隆·马斯克旗下 xAI公司开发的AI工具的安全性和可靠性提出了担忧。这表明,美国政府内部在部署哪种AI模型问题上依旧存在分歧。尽管存在这些担忧,但是美国国防部在本周做出决定,同意允许xAI的聊天机器人Grok在机密环境中使用,从而使得xAI成为美国一些最敏感、最机密行动的核心参与者。在xAI公司与美国军方达成协议之前,Anthropic是唯一获批准用于机密用…

Anthropic CEO:威胁不会改变公司立场

Anthropic CEO:威胁不会改变公司立场 Anthropic公司拒绝了美国国防部提出的最新提议,该提议旨在化解因该公司为军方使用其AI软件设定条件而引发的僵局。Anthropic发言人周四在一份声明中表示,五角大楼作为妥协方案提出的新措辞,未能满足该公司在军方使用其AI工具时设置关键保障措施的要求。这些保障措施包括禁止利用其技术对美国人进行大规模监控,以及禁止将其技术用于完全自主武器系统。美国国防部拒绝了这些要求,并给该公司设定了周五的最后期限,…

加载更多博文
未找到任何结果