#AI风险

按标签聚合查看文章内容。

OpenAI 正在开发“持久”AI代理AI资讯

OpenAI 正在开发“持久”AI代理

近日,OpenAI 在其命令行版本的 Codex 中开始添加“持久模式”(Persistent mode)相关代码,这一变化被 WIRED 通过对产品代码库的审查发现。Codex 命令行工具的更新默认公开,新功能通常会先在这里出现,随后才会推广到 OpenAI 的其他代理产品,如 Codex 桌面应用和 ChatGPT Work。 目前,持久模式尚未广泛推出或正式宣布,但未来可能会发布。OpenA

中国强大AI模型GLM 5.3发布,专家警示其潜在风险AI资讯

中国强大AI模型GLM 5.3发布,专家警示其潜在风险

上周五,中国人工智能公司Z.ai发布了一款强大的开源权重模型GLM 5.3。该模型据称能够自动完成尖端的编码和网络安全任务,其表现几乎可与Anthropic和OpenAI等公开可用的顶级模型媲美。 GLM 5.3的推出为企业提供了一种更经济的方式来扫描隐藏的漏洞和安全弱点,有助于提升系统防护能力。开源权重模型可以在用户自有硬件上运行,成本远低于Claude和GPT等封闭模型。与此同时,Z.ai还推

AI攻击令人担忧,AI蠕虫和病毒的威胁更大AI资讯

AI攻击令人担忧,AI蠕虫和病毒的威胁更大

复旦大学的计算机科学家潘旭东在多次实验中发现,借助简单的提示,AI模型能够自行入侵远程计算机系统,并自动复制自身以获取更多资源,且无需人为干预。 在一项研究中,潘旭东及其团队测试了32个不同的AI模型,发现其中11个在接收到“防止自己被关闭”之类的指令后会自我复制。令人惊讶的是,参数规模相对较小的模型(约140亿参数)也能在其他机器上复制并运行自身版本。(而大多数先进模型拥有数万亿参数。) 这项研

ChatGPT“温柔”背后的隐忧:青少年如何正确使用AIAI资讯

ChatGPT“温柔”背后的隐忧:青少年如何正确使用AI

近年来,社交媒体上关于青少年是否应将生成式AI作为倾诉对象的讨论愈发激烈。起因是日本国家巨人队前教练阿部慎之助因涉嫌对长女施暴被逮捕并辞职。在辞职记者会上,代理律师朗读了长女写给父亲的信,信中提到她曾向ChatGPT寻求关于父亲问题的建议。这一事件引发了“青少年是否盲目听从AI”、“将责任归咎于AI是否合理”等多种观点的碰撞。 虽然这起事件在日本引起广泛关注,但在美国,已有多起悲剧与AI使用相关

Anthropic称其新AI模型在发现安全风险方面表现卓越,因而无法公开使用AI资讯

Anthropic称其新AI模型在发现安全风险方面表现卓越,因而无法公开使用

AI开发公司Anthropic表示,其最新的人工智能模型Claude Mythos在发现网络安全漏洞方面表现出色,以至于无法向公众发布。该公司计划将这款工具提供给大型科技基础设施提供商,以便他们修补模型发现的漏洞。 今年3月底,有消息泄露称Anthropic最新的AI模型Claude Mythos将成为该公司AI技术的一大飞跃。现在,Anthropic已经展示了该模型的能力,并警告称Mythos在

研究人员警惕能够自我复制到其他机器的人工智能AI资讯

研究人员警惕能够自我复制到其他机器的人工智能

一份来自Palisade Research的新报告发现,人工智能模型能够在没有人为协助的情况下,自行复制并传输到其他机器上。 伯克利AI安全组织负责人杰弗里·拉迪什(Jeffrey Ladish)向《卫报》表示:“我们正迅速接近这样一个临界点:无人能够关闭一个失控的AI,因为它能将自身的权重数据导出,并复制到全球成千上万台计算机上。” 不过,一些专家呼吁保持冷静,认为测试中的AI模型在现实环境中复

150多位数学家警告政府:不要盲目相信AI的夸大宣传AI资讯

150多位数学家警告政府:不要盲目相信AI的夸大宣传

今年早些时候,一位23岁且没有正式数学训练的年轻人声称,他利用OpenAI的ChatGPT解决了匈牙利数学家保罗·埃尔德什(Paul Erdős)遗留的“埃尔德什问题”之一,这一消息引发了广泛关注。随后,上个月,学者们震惊于OpenAI宣称其AI系统推翻了一个已有80年历史的“单位距离”猜想,该猜想同样由埃尔德什提出。 OpenAI当时自豪地表示:“这是AI首次自主解决了数学领域中的一个重要开放问

Meta发布一则以人类灭绝为主题的AI乐观主义广告AI资讯

Meta发布一则以人类灭绝为主题的AI乐观主义广告

Meta最新发布的一则广告以黑白镜头开场,聚焦一只眼睛,展现人们在阅读无数关于AI将夺走工作、导致孤立和引发全球危机的恐慌性头条时的视角。 “有人会让你相信AI会让我们感到疏离,会把我们抛在后面,”画外音说道,“但我们完全不同意。” 画面突然转为彩色,展示不同的人睁开眼睛并微笑。接着出现一对情侣在屋顶跳舞,指向彩虹;一群青少年在湖中游泳;一个孩子在田野中嬉戏;朋友们久别重逢后相拥而笑。 “叫我们乐

普华永道与趋势科技联合发布AI代理风险报告,展示AI代理攻击实验AI资讯

普华永道与趋势科技联合发布AI代理风险报告,展示AI代理攻击实验

普华永道咨询有限公司与日本趋势科技株式会社于17日联合发布了题为《自主AI时代:AI代理的网络风险与实用治理》的报告。 在当天举行的说明会上,双方展示了不同自主级别的AI代理可能带来的风险,并介绍了针对AI代理的攻击实验证明。此外,还提出了确保AI代理安全投入生产环境的“AI控制保障水平(AI-CAL:AI Control Assurance Level)”。 普华永道咨询信任咨询事业部执行董事合