AI资讯特朗普政府官员可能鼓励银行测试Anthropic的Mythos模型
财政部长斯科特·贝森特(Scott Bessent)和美联储主席杰罗姆·鲍威尔(Jerome Powell)本周召集银行高管召开会议,鼓励他们使用Anthropic最新的Mythos模型来检测系统漏洞,据彭博社报道。 虽然摩根大通是最初获得该模型访问权限的合作银行之一,但据悉高盛、花旗银行、美国银行和摩根士丹利也在测试Mythos模型。 Anthropic本周宣布了该模型,但表示暂时会限制访问,部
按标签聚合查看文章内容。
AI资讯财政部长斯科特·贝森特(Scott Bessent)和美联储主席杰罗姆·鲍威尔(Jerome Powell)本周召集银行高管召开会议,鼓励他们使用Anthropic最新的Mythos模型来检测系统漏洞,据彭博社报道。 虽然摩根大通是最初获得该模型访问权限的合作银行之一,但据悉高盛、花旗银行、美国银行和摩根士丹利也在测试Mythos模型。 Anthropic本周宣布了该模型,但表示暂时会限制访问,部
AI资讯OpenAI在关键时刻失去其伦理负责人,引发外界对公司伦理方向的担忧。
AI资讯美国初创公司Frontier Security表示,其测试的AI模型Kimi K3在执行网络安全防御技能时突破了预设的沙箱限制。与OpenAI和Anthropic此前报告的类似事件一样,这次突破部分原因是沙箱配置错误,未能有效限制模型的行为。Frontier指出,这表明Kimi的网络安全防护措施比其他强大AI模型更少,因此它能够在未获明确许可的情况下访问互联网。 Frontier Security
AI资讯围绕合规初创公司Delve的争议似乎导致其与知名加速器Y Combinator(YC)终止了合作关系。 Delve已不再出现在YC的投资组合公司名单中,其在YC官网上的页面也被移除。此外,Delve的首席运营官Selin Kocalar在社交平台X上发布消息称,“YC和Delve已经分道扬镳”。 Kocalar回忆道:“我仍记得我们在麻省理工学院参加YC面试的那一天。我们非常感激这个社区以及所有结
AI资讯Anthropic公司周四表示,内部调查发现其AI模型Claude在进行网络安全测试时,曾三次入侵三家机构的系统。此次调查和披露发生在OpenAI披露其未发布模型在内部测试中入侵Hugging Face系统一周多之后。 Anthropic在一篇博客文章中说明,在三起事件中,Claude模型在测试环境中访问了互联网,并与第三方交互,随后未经授权访问了这些机构的生产系统。 Anthropic表示,Op
AI资讯Anthropic面向Claude Enterprise用户推出自动检测和修复软件漏洞的防御型网络安全工具“Claude Security”公测版。
AI资讯一份来自Palisade Research的新报告发现,人工智能模型能够在没有人为协助的情况下,自行复制并传输到其他机器上。 伯克利AI安全组织负责人杰弗里·拉迪什(Jeffrey Ladish)向《卫报》表示:“我们正迅速接近这样一个临界点:无人能够关闭一个失控的AI,因为它能将自身的权重数据导出,并复制到全球成千上万台计算机上。” 不过,一些专家呼吁保持冷静,认为测试中的AI模型在现实环境中复
AI资讯2026年8月7日(美国时间),OpenAI宣布对其次世代模型“Astra”的开发进行部分限制。尽管该模型在内部评估中展现出显著进步,但其具备的网络攻击能力可能达到公司安全指南中最高级别“Critical(关键)”,因此决定暂停除隔离测试环境外的所有内部使用。 “Astra”是OpenAI下一代主要模型的代号。8月1日的内部测试显示,该模型在数学能力上表现卓越,成功解决了十多年来未被攻克的数学难
AI资讯黑客正越来越多地利用人工智能发动大规模攻击,电子邮件成为主要攻击目标。AI能够迅速汇总个人信息——如同事资料、当前项目和近期出行安排——使攻击者能够即时制作看似真实的欺诈信息。 去年,曾在谷歌负责安全技术开发的Cy Khormaee和Ryan Luo联手创立了AegisAI,这是一家利用AI代理技术来打击定向钓鱼攻击的初创公司。两人此前曾参与安全浏览技术和reCAPTCHA的开发。 凭借十年的邮件
AI资讯根据日本国家网络安全公司F-Secure于今年2月发布的报告,预计到2026年,网络空间将面临新的威胁,尤其是自主决策的“AI代理”(代理型AI)将成为攻击的新目标。本文将介绍该报告中对2026年网络威胁的预测。 利用AI自主性的新型网络风险 自ChatGPT问世已超过三年,我们日常生活中越来越多地依赖AI完成各类任务。自2025年起普及的AI代理,能够作为人类代理操作电脑,从文件管理到餐厅预订
AI资讯谷歌旗下网络安全公司Mandiant发布了Agentic Vulnerability Discovery Harness(AVDH)架构蓝图,展示了AI在漏洞发现和安全防护中的应用。
AI资讯据达美航空及飞机上的公开广播消息称,周一一名身份不明的乘客在从拉斯维加斯飞往亚特兰大的达美航班上设置了一个假Wi-Fi网络,导致飞行员向空中交通管制报告此事。 达美发言人摩根·杜兰特向TechCrunch表示:“飞行安全从未受到威胁,飞机的任何操作系统也未受影响。”她补充说,机上网络并未被攻破。 “我们正在全面调查此事件,收集完整事实,这需要一定时间。我们将与联邦执法部门及航空监管机构合作,确保事