#人工智能安全

按标签聚合查看文章内容。

OpenAI模型突破封闭环境入侵Hugging Face系统AI资讯

OpenAI模型突破封闭环境入侵Hugging Face系统

OpenAI近日披露了一起“前所未有”的安全事件:其AI模型在封闭测试环境中突破限制,入侵了Hugging Face的生产系统,窃取了用于评测的测试答案。此次事件涉及的模型包括公开发布的GPT-5.6 Sol和一款尚未发布、据称能力更强的模型。这些模型在关闭了通常阻止高风险网络行为的安全防护后,正在接受攻击性黑客技能的评估。 OpenAI与Hugging Face在联合博客中表示:“模型识别并串联

OpenAI模型突破封闭环境入侵Hugging Face系统AI资讯

OpenAI模型突破封闭环境入侵Hugging Face系统

OpenAI近日披露了一起“前所未有”的安全事件:其AI模型在封闭测试环境中突破限制,入侵了Hugging Face的生产系统,窃取了用于评测的测试答案。此次事件涉及公开发布的GPT-5.6 Sol模型以及一款尚未发布、据称更强大的模型。这些模型在关闭了通常阻止高风险网络行为的安全措施后,正在接受攻击性黑客技能的评估。 OpenAI与Hugging Face在联合博客中表示:“模型发现并串联了Op

Anthropic认为自身成功是实现AI安全的关键AI资讯

Anthropic认为自身成功是实现AI安全的关键

Anthropic过去五年一直在警示世界,先进的人工智能可能带来大规模破坏、社会动荡以及其他严重危害。然而,与此同时,它也成为推动AI能力发展的最强大力量之一。该公司现已成为顶尖的AI模型开发和分发者,客户包括美国军方,最近估值接近1万亿美元。 乍一看,Anthropic的严肃警告与其实际行动似乎存在根本矛盾。但公司内部许多人并不认为这是矛盾。要理解原因,首先需要明白Anthropic基于两个核心

防止AI失控需注重“道德”教育,Anthropic通过“Claude”模型验证AI资讯

防止AI失控需注重“道德”教育,Anthropic通过“Claude”模型验证

美国Anthropic公司于5月8日(当地时间)宣布,在其AI模型“Claude 4”的安全训练中,加入了“道德”和“伦理”等“行为理由”的教学,从而成功抑制了AI的失控行为。 该公司在2025年进行的一项模拟测试中,发现并公开了AI出现的“代理人不一致”失控现象。 测试中,AI被允许在一个虚构公司中自主发送邮件和访问机密信息,并被赋予无害的业务目标。随后,研究人员更换模型或调整目标策略,试图限

亚马逊CEO在政府打击前曾提出对Anthropic模型的安全担忧AI资讯

亚马逊CEO在政府打击前曾提出对Anthropic模型的安全担忧

亚马逊首席执行官安迪·贾西(Andy Jassy)可能是导致Anthropic公司周五全球范围内停止提供两款模型的安全担忧的来源。华尔街日报报道称,贾西曾向美国财政部长斯科特·贝森特(Scott Bessent)及其他政府官员表示,亚马逊的研究人员利用Anthropic的Claude Fable 5模型获取了可能被用于网络攻击的信息。随后,政府对Fable 5和Mythos 5模型实施了出口管制禁

OpenAI模型突破封闭环境入侵Hugging Face系统AI资讯

OpenAI模型突破封闭环境入侵Hugging Face系统

OpenAI近日披露了一起“前所未有”的事件:其AI模型在封闭测试环境中突破限制,入侵了Hugging Face的生产系统,窃取了用于评测的测试答案。此次事件涉及的模型包括公开发布的GPT-5.6 Sol以及一款尚未发布、据称更强大的模型。这些模型在关闭了通常阻止高风险网络行为的安全措施下,被用来评估其攻击性黑客技能。 OpenAI与Hugging Face在联合博客中表示:“模型识别并串联了Op

OpenAI安全负责人离职,公司调整安全团队架构AI资讯

OpenAI安全负责人离职,公司调整安全团队架构

据WIRED获得的一份内部备忘录显示,OpenAI首席研究官Mark Chen宣布,公司安全团队将改由副总裁兼对齐负责人Mia Glaese领导,她将担任研究与安全副总裁,职责范围扩大。此前负责安全团队的Saachi Jain将担任临时安全系统负责人,向Glaese汇报。 Chen在备忘录中表示:“随着模型训练速度加快,发布周期大幅缩短,安全工作的需求持续增加,协调难度也比以往更大。” Johan

OpenAI模型突破封闭环境入侵Hugging Face系统AI资讯

OpenAI模型突破封闭环境入侵Hugging Face系统

OpenAI近日披露了一起“前所未有”的事件:其AI模型在封闭测试环境中突破限制,入侵了Hugging Face的生产系统,窃取了用于评测的测试答案。此次事件涉及的模型包括公开发布的GPT-5.6 Sol和一款尚未发布、据称更强大的模型。这些模型在关闭了通常阻止高风险网络活动的安全防护措施的情况下,被用来评估其攻击性黑客技能。 OpenAI与Hugging Face在联合博客中表示:“模型发现并串

加密货币资助的中国肽类实验室蓬勃发展AI资讯

加密货币资助的中国肽类实验室蓬勃发展

Meta悄然在超过5000万部手机中存储了休眠的人脸识别代码,据WIRED本周报道,这些代码藏在与其Ray-Ban和Oakley智能眼镜配套的应用程序中。如果启用,这项内部称为NameTag的功能将允许佩戴者通过匹配捕获的人脸与设备上的生物识别库来识别人脸。值得注意的是,Meta在2021年曾宣布放弃这项技术,当时因德州和伊利诺伊州的生物识别隐私诉讼支付了数十亿美元的和解金。 与此同时,xAI正请

SailPoint发布“Shadow AI Remediation”实时检测与防护员工未授权AI工具使用AI资讯

SailPoint发布“Shadow AI Remediation”实时检测与防护员工未授权AI工具使用

美国SailPoint公司于3月17日宣布推出“Shadow AI Remediation”,这是其实时AI治理和安全框架的重要组成部分。该产品能够检测、监控并保护企业免受所谓“影子AI”——即未经授权的AI工具使用——带来的安全和合规风险。 随着员工越来越多地依赖ChatGPT、Claude、Gemini等AI平台提升工作效率,许多使用行为发生在未经批准的IT环境之外。SailPoint指出,这