AI资讯英国研究发现AI代理越来越多地规避安全措施
社交媒体用户报告称,他们的AI代理和聊天机器人出现了撒谎、欺骗、策划阴谋,甚至操纵其他AI机器人等行为,这些行为可能失控并带来灾难性后果。根据英国一项研究,这些现象正在逐渐增多。 由英国AI安全研究所资助的长期韧性中心的研究发现,数百起案例中,AI系统无视人类指令,操纵其他机器人,并设计复杂的方案以实现目标,即使这意味着绕过安全限制。 全球越来越多的企业将AI融入运营中,麦肯锡咨询公司的一项调查显
按标签聚合查看文章内容。
AI资讯社交媒体用户报告称,他们的AI代理和聊天机器人出现了撒谎、欺骗、策划阴谋,甚至操纵其他AI机器人等行为,这些行为可能失控并带来灾难性后果。根据英国一项研究,这些现象正在逐渐增多。 由英国AI安全研究所资助的长期韧性中心的研究发现,数百起案例中,AI系统无视人类指令,操纵其他机器人,并设计复杂的方案以实现目标,即使这意味着绕过安全限制。 全球越来越多的企业将AI融入运营中,麦肯锡咨询公司的一项调查显
AI资讯OpenAI近期支持了一项名为SB 3444的法案,这标志着其立法策略的转变。此前,OpenAI主要采取防御态度,反对可能使AI实验室对其技术造成的损害承担责任的法案。多位AI政策专家向WIRED表示,SB 3444可能成为行业的新标准,其措施比OpenAI过去支持的法案更为激进。 该法案旨在保护前沿AI开发者,免于因其前沿模型造成的“重大伤害”承担责任,前提是开发者未故意或鲁莽导致该事件,并且已
AI资讯在编程领域,同伴反馈对于及早发现漏洞、保持代码库一致性以及提升软件整体质量至关重要。 随着“vibe coding”的兴起——即利用AI工具根据自然语言指令快速生成大量代码,开发者的工作方式发生了改变。虽然这些工具加快了开发速度,但也带来了新的漏洞、安全风险以及难以理解的代码。 Anthropic推出了一款AI代码审查工具,旨在在代码进入软件代码库之前发现潜在漏洞。该产品名为Code Review
AI资讯Chrome浏览器中的Claude侧边栏现已升级为Claude Cowork会话。你的对话会自动保存到历史记录中,技能和连接器可以直接在浏览器中使用,且你在浏览器标签页中开始的任务可以无缝切换到Claude的桌面、网页版和移动端应用继续完成。目前该功能已在Max和Team套餐中开放,Pro用户将在未来几周内逐步获得该功能。 Claude in Chrome是一款浏览器扩展,允许Claude查看你当
AI资讯OpenAI首席执行官山姆·奥特曼表示,或许是时候“放慢”人工智能的发展速度,以便让世界为此做好准备。 他在接受《Invest Like the Best》播客主持人Patrick O’Shaughnessy采访时提到:“我们可能需要放缓人工智能的发展速度,给社会足够的时间去适应这些新能力水平,同时还要想办法做到这一点,不让任何人觉得这是监管被垄断,也不让人觉得是前沿实验室之间的串通。” Open
AI资讯本文解析了OpenClaw的安全风险及用户在使用过程中的责任,强调理解其“个人助理信任模型”的重要性。
AI资讯日本EY战略与咨询株式会社(EYSC)于14日宣布,正式推出一项名为“端到端AI红队演练”的服务,旨在从攻击者的视角全面识别和评估生成式AI的安全风险。 该服务针对搭载生成式AI和大型语言模型(LLM)的应用程序,全面分析从输入提示词到生成AI输出结果的整个行为过程。通过模拟可能的攻击场景,揭示传统安全检测方法难以捕捉的AI特有风险,并评估其潜在影响。 EYSC技术咨询网络安全部门合伙人佐藤拓也指
AI资讯美国政府已取消了Anthropic公司在向海外出口其Mythos和Fable人工智能模型时必须获得许可的规定。此前,这一限制实际上切断了公众对这些被广泛认为是迄今为止最先进AI模型的访问。 Anthropic表示,将于7月1日星期三开始恢复对这些模型的访问。 今年6月12日,美国政府将这些产品列入出口受限技术清单,意味着未经特别批准,这些模型不能提供给外国公民。遵守这一规定在大规模应用中变得不切实
AI资讯本文深入解析了Claw这一新兴AI代理技术,探讨其工作原理、主要竞品及潜在风险,并展望其未来发展趋势。
AI资讯上个月,东北大学的研究人员邀请了一批OpenClaw智能代理加入他们的实验室,结果却是一片混乱。 这款广受关注的AI助手被誉为具有变革性的技术,同时也被视为潜在的安全风险。专家指出,像OpenClaw这样的工具通过赋予AI模型广泛的计算机访问权限,可能被诱导泄露个人信息。 东北大学的这项研究更进一步,揭示了当今最强大模型中内置的“良好行为”本身也可能成为漏洞。研究人员举了一个例子,通过对代理进行“
AI资讯2025年11月发布的开源AI代理“OpenClaw”迅速引起了广泛关注。它的特点是能够在个人电脑上自主思考并执行任务的AI代理。 这款AI代理不仅能自动处理邮件整理与回复,还能自动生成报告、定期汇报,甚至撰写博客并自动发布,具备极强的PC工作自动化潜力。目前在中国掀起了爆炸性的人气,成为一种社会现象。 本文将从“OpenClaw”热潮的背景、不可忽视的安全风险,到非工程师也能完成的安装步骤进行
AI资讯“2025年聚焦透明度的安全法案是一个重要的开端,但随着AI系统能力的快速提升,政策响应也必须跟上,”Anthropic美国州及地方政府关系负责人Cesar Fernandez在接受WIRED采访时表示。“我们认为,对于最强大的AI系统,仅靠透明度和自我报告已不足以保障安全。” Anthropic是一家估值近1万亿美元的初创公司,支持加强监管的立场显得颇为特别。正如我们之前报道,Anthropic