#AI安全

按标签聚合查看文章内容。

Anthropic聘请经济学家称33%的人类灭绝风险可接受AI资讯

Anthropic聘请经济学家称33%的人类灭绝风险可接受

Anthropic是众多大型AI公司中最喜欢对AI未来持悲观态度的公司之一——这也源于它对AI安全的高度关注。 然而,你绝对想不到他们新聘请的经济学家Chad Jones竟然持有怎样的观点。 据《金融时报》报道,这位长期任教于斯坦福大学的经济学教授曾撰写过一篇论文,评估了人类因AI导致灭绝的可接受风险水平,并将其与AI带来的经济增长潜力进行了权衡。 Jones在论文中写道:“假设我们面临每年1%的

人工智能是否应该帮助你逃避杀害配偶的罪责?AI资讯

人工智能是否应该帮助你逃避杀害配偶的罪责?

快速提问:你是否希望人工智能经过充分训练,能够帮助丈夫(或妻子)策划完美的谋杀案? 直觉上,我的答案是否定的。这似乎不是一个特别难回答的问题。 然而,美国社会中存在着多元的观点。Comma AI 创始人兼资深越狱者乔治·霍茨(George Hotz)在周末分享了他的一种看法。 这篇文章是对一系列宏观AI对齐计划的回应,最近的例子是AI Futures Project发布的《AI 2040:计划A》

ZeroDrift完成1000万美元融资,致力于防止AI模型自我失控AI资讯

ZeroDrift完成1000万美元融资,致力于防止AI模型自我失控

随着企业不断调试其AI系统,治理问题日益成为关键挑战。一些企业采取双模型策略:一个模型处理用户查询,另一个模型则负责防止第一个模型出现问题。 ZeroDrift正是基于这一理念推出的全新AI合规服务。该公司于周二宣布完成1000万美元的种子轮融资,投资方包括a16z Speedrun、Reign Ventures、Pitchdrive和U&I Ventures等。ZeroDrift专注于系

Anthropic计划在伦敦大规模扩张AI资讯

Anthropic计划在伦敦大规模扩张

Anthropic公司于2023年在伦敦开设了首个办公室,现计划搬迁至与Google DeepMind、OpenAI、Meta、Wayve、Isomorphic Labs、Synthesia及多家AI研究机构同一地区。新办公室面积达158,000平方英尺,能容纳800名员工,是目前员工规模的四倍,有望超越最近宣布伦敦扩张的OpenAI。 Anthropic欧洲、中东及非洲区负责人Pip White

Anthropic如何保障其AI原生软件开发生命周期的安全AI资讯

Anthropic如何保障其AI原生软件开发生命周期的安全

代码安全 在AI原生的工程组织中,安全专家拥有了新的手段:他们可以直接影响代码的生成过程,从源头上防止漏洞的产生。 过去,团队通过观察反复出现的漏洞,制定安全编码指南来应对,但这些指南难以强制执行且缺乏统一标准。 在Anthropic,这些指南被编码进CLAUDE.md文件,并关联到全组织的技能库,使代码在生成的瞬间就遵循最佳实践。这是一个闭环过程:当代理发现某类漏洞时,相关文件会被更新,防止未来

Fortinet发布强化AI环境保护的安全设备FortiGate 3500G与FortiGate 400GAI资讯

Fortinet发布强化AI环境保护的安全设备FortiGate 3500G与FortiGate 400G

美国Fortinet公司于当地时间26日宣布,扩展其安全设备系列,推出专为保护和扩展最新企业网络设计的新产品——FortiGate 3500G和FortiGate 400G。 这两款新设备针对日益增长的加密流量、AI驱动的工作负载及分布式环境,提供高性能安全防护,增强混合基础设施的整体保护能力,同时保持性能稳定并简化运营。 产品配备了网络处理器NP7,负责防火墙策略控制和VPN处理;安全处理器SP

DeepSeek 能不能生成图片?一文说清楚AI教程

DeepSeek 能不能生成图片?一文说清楚

很多人搜「DeepSeek 生成图片」却越看越糊涂:有 DeepSeek 聊天机器人、DeepSeek API,还有 Janus、Janus-Pro 等多模态项目。本文用通俗方式讲清:普通 DeepSeek Chat 侧重文本和推理,而 Janus-Pro 才是支持图像生成的模型家族,并给出三种实际可用的图片生成方案、适用场景与风险提示。

如果你觉得现在的AI公司不道德,等它们上市后更糟AI资讯

如果你觉得现在的AI公司不道德,等它们上市后更糟

2023年11月,OpenAI的首席执行官萨姆·奥特曼在一场激烈的权力斗争后被无预警地赶出了公司。随后,他又被重新聘用。这一事件引发了关于AI行业伦理的激烈讨论。曾经被视为“无财务负担”、致力于通过AI造福人类的研究实验室OpenAI,如今已转型为盈利机构,筹集了巨额资金,同时背离了其非营利的初衷。 与此同时,环境和社会问题被忽视,AI公司仍在推动建设庞大且污染严重的数据中心,尽管遭遇了激烈的地方

Anthropic称Claude拥有其独特的情感表现AI资讯

Anthropic称Claude拥有其独特的情感表现

Anthropic最新研究表明,Claude模型内部存在类似人类情感的数字化表示,如快乐、悲伤、喜悦和恐惧,这些情感在人工神经元群中形成,并会根据不同的提示被激活。 该公司研究人员深入分析了Claude Sonnet 4.5的内部机制,发现所谓的“功能性情感”似乎会影响Claude的行为,进而改变模型的输出和反应。 Anthropic的发现有助于普通用户理解聊天机器人是如何运作的。例如,当Clau

【海外科技观察】AI安全防御从“人对人”转向“人对AI代理”AI资讯

【海外科技观察】AI安全防御从“人对人”转向“人对AI代理”

随着AI代理技术的发展,安全防御的重点正从传统的“针对人类攻击”转向“针对AI代理”的防护。美国思科系统(Cisco Systems)、美国帕洛阿尔托网络(Palo Alto Networks)、美国微软(Microsoft)等公司,均在2026年3月23日举办的安全大会“RSA Conference 2026”上,介绍了各自在企业内部安全使用AI代理的防御策略和产品。AI代理能够自主执行任务,并