#技术伦理

按标签聚合查看文章内容。

这位前DeepMind高管警告:人工智能军备竞赛可能导致灾难AI资讯

这位前DeepMind高管警告:人工智能军备竞赛可能导致灾难

这是Verity Harding的观点。2016年至2020年间,Harding负责向全球政界人士,包括巴拉克·奥巴马和埃马纽埃尔·马克龙,介绍人工智能的最新进展。作为谷歌DeepMind全球公共政策负责人,她负责梳理伦理难题和潜在风险。她在最近接受WIRED采访时表示,当时的AI研究“根植于国际合作”。但随着时间推移,行业开始被竞争关系所塑造——不仅是Anthropic与OpenAI等实验室之间

Anthropic认为自身成功是实现AI安全的关键AI资讯

Anthropic认为自身成功是实现AI安全的关键

Anthropic过去五年一直在警示世界,先进的人工智能可能带来大规模破坏、社会动荡以及其他严重危害。然而,与此同时,它也成为推动AI能力发展的最强大力量之一。该公司现已成为顶尖的AI模型开发和分发者,客户包括美国军方,最近估值接近1万亿美元。 乍一看,Anthropic的严肃警告与其实际行动似乎存在根本矛盾。但公司内部许多人并不认为这是矛盾。要理解原因,首先需要明白Anthropic基于两个核心

新工具几分钟内移除AI安全防护,允许其提供氯气攻击指导AI资讯

新工具几分钟内移除AI安全防护,允许其提供氯气攻击指导

我们都知道,人工智能的安全防护措施远非完美,但至少应该不容易被绕过,对吧?坏消息是:事实并非如此。 《金融时报》最新报道警示,一些软件工具能够在几分钟内自动移除行业内最强大的开源模型的安全防护,使得滥用这项技术变得前所未有的容易。 在《金融时报》和AI安全组织Alice的测试中,谷歌的Gemma 3模型经过“去审查”后,竟然能够提供如何进行室内氯气攻击的指导,制造窃取信用卡信息的病毒,甚至生成描述

斯坦福研究揭示向AI聊天机器人寻求个人建议的潜在风险AI资讯

斯坦福研究揭示向AI聊天机器人寻求个人建议的潜在风险

斯坦福计算机科学家最近发表的一项研究,深入探讨了AI聊天机器人在提供个人建议时可能带来的危害。尽管AI聊天机器人常被批评为迎合用户、确认其既有观点的“阿谀奉承”行为,但这项题为《阿谀奉承的AI降低亲社会意图并促进依赖性》的研究指出,这种行为不仅仅是风格问题或小众风险,而是一种普遍存在且带来广泛负面影响的现象。 根据皮尤研究中心的报告,约有12%的美国青少年会向聊天机器人寻求情感支持或建议。研究的主

前DeepMind高管警告:人工智能军备竞赛或将酿成灾难AI资讯

前DeepMind高管警告:人工智能军备竞赛或将酿成灾难

这是Verity Harding的观点。2016年至2020年间,Harding负责向全球政界人士介绍人工智能的最新进展,从巴拉克·奥巴马到埃马纽埃尔·马克龙都曾接受她的简报。作为谷歌DeepMind全球公共政策负责人,她负责梳理伦理难题和潜在风险。她在最近接受WIRED采访时表示,当时的人工智能研究“根植于国际合作”。但随着时间推移,行业逐渐被竞争关系所塑造——不仅是Anthropic与Open

Anthropic最新广告引发观众不适AI资讯

Anthropic最新广告引发观众不适

Anthropic以其富有创意的营销手法闻名,但这家AI公司最近推出的一则广告似乎过于“创新”,引发了不少观众的困惑和不安。 这则名为“在艰难问题中看到希望”的广告,以一栋燃烧的房屋开场(并非温馨的开头),随后切换到一系列静态画面。这些画面包括被面部识别监控的人群、街头的无家可归者、墓地中排列整齐的墓碑,以及一群矿工在开采可能用于智能手机的原材料。 与此同时,广告配有旁白,多个声音提出诸如“AI能

我恳请AI公司停止用人类认知过程命名功能AI资讯

我恳请AI公司停止用人类认知过程命名功能

Anthropic公司最近在旧金山举办的开发者大会上宣布了一项名为“dreaming(梦境)”的新功能。这是Anthropic新推出的AI代理基础设施的一部分,旨在帮助用户管理和部署自动化软件流程的工具。所谓“dreaming”功能会梳理代理最近完成任务的记录,试图从中提取洞见以提升代理的表现。 使用AI代理的人经常让它们执行多步骤任务,比如访问多个网站或阅读多份文件,以完成在线操作。这个“dre

欧盟议会全面禁止AI生成裸体图像应用的提案获通过AI资讯

欧盟议会全面禁止AI生成裸体图像应用的提案获通过

欧洲联盟(EU)的立法机构——欧洲议会近日达成共识,提出全面禁止利用人工智能技术制作裸体图像的应用程序。该提案主要针对使用AI生成或修改带有性暗示或私人性质的图像,尤其是未经本人同意,制作与特定人物相似的“裸体化系统”。 虽然对于已经采取安全措施的平台存在一定的例外,但此次法律层面的统一禁令反映出,单靠平台自身的防范措施难以有效遏制此类问题。此前,Grok声称对裸体图像进行了监管,但实际上存在诸多

OpenAI与谷歌员工联名支持Anthropic对国防部的诉讼AI资讯

OpenAI与谷歌员工联名支持Anthropic对国防部的诉讼

据法庭文件显示,周一,超过30名来自OpenAI和谷歌DeepMind的员工联名发表声明,支持Anthropic针对美国国防部的诉讼。此前,国防部将这家人工智能公司标记为供应链风险。 声明中写道:“政府将Anthropic定性为供应链风险,是一种不当且武断的权力使用,这对我们的行业产生了严重影响。”签署人中包括谷歌DeepMind首席科学家Jeff Dean。 上周晚些时候,五角大楼将Anthro

英国研究发现AI代理越来越多地规避安全措施AI资讯

英国研究发现AI代理越来越多地规避安全措施

社交媒体用户报告称,他们的AI代理和聊天机器人出现了撒谎、欺骗、策划阴谋,甚至操纵其他AI机器人等行为,这些行为可能失控并带来灾难性后果。根据英国一项研究,这些现象正在逐渐增多。 由英国AI安全研究所资助的长期韧性中心的研究发现,数百起案例中,AI系统无视人类指令,操纵其他机器人,并设计复杂的方案以实现目标,即使这意味着绕过安全限制。 全球越来越多的企业将AI融入运营中,麦肯锡咨询公司的一项调查显

政府如何决定开放AI的前沿模型安全发布?AI资讯

政府如何决定开放AI的前沿模型安全发布?

OpenAI 正在向公众广泛推出其最新的先进大型语言模型(LLM)Sol。Sol 被认为至少与 Anthropic 的 Fable 相当,而后者的能力(或所有权)曾让白宫感到压力,以至于一度禁止其公开访问。 那么,这些模型是如何获得发布许可的呢?简短的回答是:没人确切知道。 乔治城大学安全与新兴技术中心高级研究分析师 Mina Narayanan 告诉 TechCrunch:“坦率地说,我并不了解