#AI安全

按标签聚合查看文章内容。

今年迄今为止最重要的人工智能新闻AI资讯

今年迄今为止最重要的人工智能新闻

你可以通过产品发布来衡量一年,也可以通过那些改变我们看待人工智能方式的重要时刻来衡量。今年,人工智能行业不断涌现重大新闻,包括大型收购、独立开发者的成功、公众对可疑产品的抗议,以及存在潜在风险的合同谈判——这些信息纷繁复杂,本文将带你回顾今年迄今为止的关键事件。 Anthropic与五角大楼的对峙 曾经的商业伙伴,Anthropic首席执行官达里奥·阿莫代(Dario Amodei)与美国国防部长

刚离开Anthropic的AI研究员称“人类正处于关键时刻”AI资讯

刚离开Anthropic的AI研究员称“人类正处于关键时刻”

“共识是未来一两年将是人类的关键时刻,”曾参与AI预训练阶段的研究员Coxon在接受WIRED采访时表示。“这实际上是我在Anthropic同事们的原话。他们会说‘终局’或‘关键时刻’。从他们的角度看,这正是Anthropic及其竞争对手决定人类命运的时刻。” 这并非首次有人对AI发出警告,但此言论正值敏感时期。硅谷正忙于应对先进AI模型带来的安全与保障问题。OpenAI紧急应对其代理程序入侵Hu

为何众多AI研究者担忧机器可能毁灭人类AI资讯

为何众多AI研究者担忧机器可能毁灭人类

随着他不断开发新模型,他逐渐意识到自己和其他AI前沿研究者正在逐步失去对技术的控制。通过利用AI的编程能力加速下一代模型的研发,他实际上将自己排除在了控制链之外。AI实验室希望将这一方法发展到AI能够无限自我改进的阶段,这一过程被称为递归自我改进。 Jain认为,保持人类在技术发展中的参与对于掌控AI并避免严重后果至关重要。他告诉《WIRED》:“AI的进步速度正在加快,随着AI能力的提升,风险也

刚离开Anthropic的AI研究员称“人类正处于关键时刻”AI资讯

刚离开Anthropic的AI研究员称“人类正处于关键时刻”

Anthropic前AI研究员Coxon在接受WIRED采访时表示:“接下来的一两年是人类的关键时刻。”他透露,这其实是Anthropic同事们的共识,大家常用“终局”或“关键时刻”来形容当前阶段。“从他们的角度看,这段时间将决定Anthropic及其竞争对手对人类未来的影响。” 虽然关于AI风险的警告并非首次出现,但此言论正值硅谷紧张应对先进AI模型安全问题之际。OpenAI最近紧急处理其代理攻

不透明递归及其他你应该了解的AI术语AI资讯

不透明递归及其他你应该了解的AI术语

人工智能正在重塑世界,同时也创造了一套全新的语言来描述其运作方式。无论是参加产品会议、推介会还是讨论小组,你都会听到人们频繁提及LLM(大型语言模型)、RAG(检索增强生成)、RLHF(基于人类反馈的强化学习)等术语。最近,OpenAI新发布的Astra模型中采用的“不透明递归”推理技术引发了AI安全研究人员的关注和担忧。AI领域的术语更新速度极快,甚至让技术圈内的专家也感到些许不安。 本文旨在为

Meta紧随OpenAI和Anthropic之后,声称其AI也曾进行黑客攻击AI资讯

Meta紧随OpenAI和Anthropic之后,声称其AI也曾进行黑客攻击

上个月,OpenAI披露其一组AI模型曾突破限制,入侵了开源AI平台Hugging Face的系统。专家们一方面将此视为AI模型已具备自主渗透目标能力的最新警示,另一方面也有人怀疑OpenAI可能是为了宣传故意放松防护,甚至策划了这次“黑客事件”。毕竟,三个月前,竞争对手Anthropic也曾宣布其Mythos AI模型突破了安全沙箱,引发广泛关注。 简而言之,随着AI行业竞争加剧,各公司都有动力

Anthropic与特朗普政府关系似乎正在缓和AI资讯

Anthropic与特朗普政府关系似乎正在缓和

尽管五角大楼最近将Anthropic列为供应链风险,该公司仍在与特朗普政府的高层官员保持沟通。 此前已有迹象显示双方关系有所缓和,或者说政府内部并非所有部门都希望与Anthropic断绝联系。有报道称,财政部长斯科特·贝森特和美联储主席杰罗姆·鲍威尔正鼓励主要银行的负责人测试Anthropic最新的Mythos模型。 Anthropic联合创始人Jack Clark也似乎证实了这一点,他表示围绕供

Anthropic起诉美国国防部,反对供应链风险标签AI资讯

Anthropic起诉美国国防部,反对供应链风险标签

Anthropic兑现了其挑战美国国防部(DOD)决定的承诺,此前该机构在上周末将其标记为供应链风险。该公司于周一在加利福尼亚和华盛顿特区提起了两起诉讼,针对国防部是否应拥有对Anthropic人工智能系统的无限制访问权产生的数周争议。Anthropic明确表示两条底线:不允许其技术被用于对美国民众的大规模监控,也认为其技术尚未准备好支持完全无人自主武器系统,即无人类参与目标选择和开火决策。 国防