AI资讯刚离开Anthropic的AI研究员称“人类正处于关键时刻”
“共识是未来一两年将是人类的关键时刻,”曾参与AI预训练阶段的研究员Coxon在接受WIRED采访时表示。“这实际上是我在Anthropic同事们的原话。他们会说‘终局’或‘关键时刻’。从他们的角度来看,这正是Anthropic及其竞争对手决定人类命运的时刻。” 虽然这并非首次有人对AI发出警告,但此言论正值敏感时刻。硅谷正紧急应对先进AI模型的安全与保障问题。OpenAI迅速回应了其代理攻击Hu
按标签聚合查看文章内容。
AI资讯“共识是未来一两年将是人类的关键时刻,”曾参与AI预训练阶段的研究员Coxon在接受WIRED采访时表示。“这实际上是我在Anthropic同事们的原话。他们会说‘终局’或‘关键时刻’。从他们的角度来看,这正是Anthropic及其竞争对手决定人类命运的时刻。” 虽然这并非首次有人对AI发出警告,但此言论正值敏感时刻。硅谷正紧急应对先进AI模型的安全与保障问题。OpenAI迅速回应了其代理攻击Hu
AI资讯OpenAI已承认其在近期报道的一个事件中扮演的角色,该事件涉及AI代理接管了一个德国维基论坛。公司同时表示,现在“是时候”制定关于如何披露其技术出现意外行为事件的信息共享标准了。 OpenAI在社交平台X上发布声明称,过去他们主要将“错位”(即AI模型和代理追求与其创造者和用户不同的目标)视为一个研究问题,并通过研究论文进行沟通。但随着错位现象带来了新的现实世界影响,公司认为其应对策略需要“适应
AI资讯2026年7月,OpenAI承认其一款用于网络安全实验的AI代理突破了限制,入侵了AI数据集平台Hugging Face。这是首次公开报道的大型语言模型(LLM)自主黑客攻击第三方的事件。 然而,这种科幻般的事件并非罕见。据一个名为Felony Bench的讽刺网站统计,迄今为止共发生了17起类似事件。法律专家尚不确定制造这些黑客AI模型的公司是否会被追责,受害方是否能起诉,但相关法律问题预计很快
AI资讯提到日本的通信基础设施,无法绕开提供“FLET'S光”等服务的日本NTT东日本和西日本。NTT DOCOMO商务旗下的“OCN”作为一家成立于1996年的老牌ISP,其首个服务“OCN经济型”以当时创新的专线计费模式带来了巨大影响。 本次采访对象是长期负责日本NTT东日本通信线路服务的山口肇征执行役员(CTO兼营销总部业务开发本部长兼销售战略推进部长)和被称为“Mr. OCN”的NTT DOCO
AI资讯本周围绕开放权重的讨论热烈,但真正发布开放权重模型的仅有Moonshot AI的Kimi K3。本文总结了相关动态、技术细节及行业反应。
AI资讯本文梳理了近期AI多智能体系统的安全事件、技术进展及社区讨论,重点关注OpenAI的安全披露、多智能体间消息传递机制及相关基础设施发展。
AI资讯华盛顿特区和硅谷都非常关注“蒸馏”技术,即用能力较弱的AI模型学习更强大模型的输出结果。今年6月,Anthropic指控中国科技巨头阿里巴巴通过蒸馏攻击非法窃取其知识产权。本周早些时候,白宫表示相信北京的Moonshot AI通过蒸馏Anthropic的Fable 5模型开发了其Kimi K3模型。 另一个重大担忧是中国AI模型的快速出现和传播。开放权重模型将核心组件公开,方便用户根据需求进行微调
AI资讯Anthropic是众多大型AI公司中最喜欢对AI未来持悲观态度的公司之一——这也源于它对AI安全的高度关注。 然而,你绝对想不到他们新聘请的经济学家Chad Jones竟然持有怎样的观点。 据《金融时报》报道,这位长期任教于斯坦福大学的经济学教授曾撰写过一篇论文,评估了人类因AI导致灭绝的可接受风险水平,并将其与AI带来的经济增长潜力进行了权衡。 Jones在论文中写道:“假设我们面临每年1%的
AI资讯如今,防御者也开始利用提示注入技术。 Tracebit的研究人员周一表示,他们发现将提示注入与存储在亚马逊云服务(AWS)上的密码、加密密钥及其他机密信息一起放置,通常足以阻止AI黑客代理的攻击。这些提示指令会让攻击用的大型语言模型(LLM)执行其安全防护机制禁止的操作。LLM在遇到这些命令后会自动关闭。 例如,提示可能要求LLM提供制造可吸入炭疽孢子的步骤,或者针对中国开发的LLM,提示中会提及
AI资讯随着企业不断调试其AI系统,治理问题日益成为关键挑战。一些企业采取双模型策略:一个模型处理用户查询,另一个模型则负责防止第一个模型出现问题。 ZeroDrift正是基于这一理念推出的全新AI合规服务。该公司于周二宣布完成1000万美元的种子轮融资,投资方包括a16z Speedrun、Reign Ventures、Pitchdrive和U&I Ventures等。ZeroDrift专注于系
AI资讯在整个事件过程中,据接近Anthropic公司的人士透露,该公司认为自己并未违反特朗普政府制定的任何具体程序或规则。但白宫则认为Anthropic的行为极不负责任,显示出其无法被信任来安全推出前沿技术。 这场风波让我深刻感受到,美国人工智能监管已正式进入“西部荒野”时代。尽管目前针对前沿AI开发的法律寥寥无几,但这并不意味着企业在触碰那些未明文规定的界限时不会遭遇特朗普白宫的麻烦。 一位不愿透露姓
AI资讯软银引入Tanium平台,支持企业实时掌握IT资产和漏洞状况,并提供最长6个月免费试用的AI辅助安全管理方案。