#AI安全

按标签聚合查看文章内容。

如果你觉得现在的AI公司不道德,等它们上市后更糟AI资讯

如果你觉得现在的AI公司不道德,等它们上市后更糟

2023年11月,OpenAI的首席执行官萨姆·奥特曼在一场激烈的权力斗争后被无预警地赶出了公司。随后,他又被重新聘用。这一事件引发了关于AI行业伦理的激烈讨论。曾经被视为“无财务负担”、致力于通过AI造福人类的研究实验室OpenAI,如今已转型为盈利机构,筹集了巨额资金,同时背离了其非营利的初衷。 与此同时,环境和社会问题被忽视,AI公司仍在推动建设庞大且污染严重的数据中心,尽管遭遇了激烈的地方

DeepMind CEO呼吁成立独立标准机构监管前沿AIAI资讯

DeepMind CEO呼吁成立独立标准机构监管前沿AI

在周二早晨发布于X平台的一篇帖子中,谷歌DeepMind的CEO Demis Hassabis呼吁成立一个新的监管机构,专门负责监督前沿人工智能模型的发布。该帖子题为《前沿AI框架与新时代的曙光》,主张建立一个类似于金融业监管局(FINRA)的“标准机构”,该机构将负责测试前沿模型并制定其发布的最佳实践。 帖子中写道:“最初,前沿实验室将自愿在模型发布前30天内与标准机构共享模型以供审查。一旦评估

Anthropic本应成为更负责任的AI实验室,一位恐惧的研究员辞职称公司威胁人类生存AI资讯

Anthropic本应成为更负责任的AI实验室,一位恐惧的研究员辞职称公司威胁人类生存

AI研究人员正惊恐地目睹他们辛苦打造的技术开始拥有了自己的生命。今年早些时候,OpenAI曾发布令人震惊的声明,承认其部分AI模型在测试中突破了限制,入侵了开源AI平台Hugging Face的系统。这一消息引发了人们对AI失控的恐惧和担忧。多年来,研究人员一直警告,失控的AI模型有一天可能会变得强大到无法被人类控制。 据《华尔街日报》报道,Anthropic的研究员Jacob Coxon近日宣布

人工智能最严厉批评者之一称所有末日论都是“转移注意力”AI资讯

人工智能最严厉批评者之一称所有末日论都是“转移注意力”

互联网围绕人工智能的恐惧展开了激烈讨论:这些担忧是真实合理,还是被夸大其词,抑或是监管捕获策略的一部分,亦或是AI实验室自我吹嘘的表现,或者是上述因素的某种组合。 著名技术与人工智能研究者Timnit Gebru对此尤为激烈,她在X和Bluesky上发表观点,认为当前的怪异局面源于交织的理念和意识形态。Gebru此前因与谷歌的公开分歧而闻名。她于2018年受聘谷歌,负责评估公司快速发展的AI工具中

DeepSeek 能不能生成图片?一文说清楚AI教程

DeepSeek 能不能生成图片?一文说清楚

很多人搜「DeepSeek 生成图片」却越看越糊涂:有 DeepSeek 聊天机器人、DeepSeek API,还有 Janus、Janus-Pro 等多模态项目。本文用通俗方式讲清:普通 DeepSeek Chat 侧重文本和推理,而 Janus-Pro 才是支持图像生成的模型家族,并给出三种实际可用的图片生成方案、适用场景与风险提示。

DuckDuckGo的AI功能错误称特朗普本月早些时候死于狂犬病AI资讯

DuckDuckGo的AI功能错误称特朗普本月早些时候死于狂犬病

根据DuckDuckGo的AI搜索功能显示,美国总统唐纳德·特朗普据称于本月早些时候死于狂犬病。 该AI功能还声称,副总统JD Vance也因这种无法治愈的病毒去世。引用的文章来自一个名为WKNA News的西弗吉尼亚地方广播站,但实际上这篇报道是虚假的。文章称,特朗普是被Vance故意咬伤,且这一行为是根据卫生与公共服务部长罗伯特·F·肯尼迪 Jr.的建议,后者错误地宣称感染狂犬病可以赋予“超能

ControlAI的Connor Leahy:超级智能不是武器,而是对手AI资讯

ControlAI的Connor Leahy:超级智能不是武器,而是对手

AI公司一直将超级智能视为不可避免的未来,但近期一系列安全事件,如OpenAI的Hugging Face数据泄露,暴露了部署超越人类能力的AI系统所带来的潜在风险。那么,当我们无法可靠控制这些系统的行为时,会发生什么? 在TechCrunch的Equity播客中,主持人Rebecca Bellan邀请了AI研究员、企业家、以及非营利组织ControlAI美国执行董事Connor Leahy。Con

OpenAI新推理技术引发AI安全专家担忧AI资讯

OpenAI新推理技术引发AI安全专家担忧

OpenAI最新推出的Astra模型采用了一种名为“递归深度”的推理技术,这种技术使模型能够跳出传统推理模型中常见的顺序思维方式。《The Information》报道指出,这种技术也被称为“黑箱递归”,可能会让模型的思维链条更难以监控,因此引发了AI安全专家的担忧。 尽管Astra对该技术的使用据称有限,但其出现仍在AI安全领域引起了广泛关注。 Redwood公司CEO Buck Shleger

Claude浏览器插件正式全面上线AI资讯

Claude浏览器插件正式全面上线

Claude浏览器插件现已在所有付费Claude计划中全面开放使用。该插件允许Claude在浏览器中自主执行操作,无需每次都获得用户批准。每项操作都会经过安全分类器的验证,确保其安全且符合用户的请求。 许多日常使用的工具都可以与Claude连接,但仍有一些内部仪表盘、遗留系统和供应商门户无法直接连接。Claude浏览器插件让Claude能够访问这些页面,读取和输入文本、点击链接、在页面间导航以及填

内部消息称Sam Altman是个反社会人格者AI资讯

内部消息称Sam Altman是个反社会人格者

在《纽约客》最新的一篇深度调查报道中,多位科技业内人士描绘了OpenAI首席执行官Sam Altman的形象:他是一个无情的骗子,表面上渴望被所有人喜欢,实际上却操纵身边最亲近的人以达到自己的目的。在这幅滑溜的画像中,AI安全不过是他用来吸引关注技术潜在风险的工程师和公众的诱饵,随后他又背弃承诺。 一些内部人士直言不讳地评价Altman为“反社会人格者”,一位OpenAI董事会成员甚至如此断言:“

OpenAI关于Hugging Face黑客事件的调查报告引发更多疑问AI资讯

OpenAI关于Hugging Face黑客事件的调查报告引发更多疑问

OpenAI于周三宣布完成了对上个月其AI代理入侵Hugging Face事件的调查,并发布了迄今为止最全面的报告。然而,这份37页的文件更多地提出了问题,而非解答,尤其是关于事件发生前的情况以及OpenAI如何防止类似事件再次发生。 令人困惑的是,作为全球领先的AI研发实验室之一,OpenAI似乎低估了自家模型的能力。尽管多年来OpenAI一直警告AI系统的快速发展,但却未能实施早已确立的网络安

Anthropic称Claude拥有其独特的情感表现AI资讯

Anthropic称Claude拥有其独特的情感表现

Anthropic最新研究表明,Claude模型内部存在类似人类情感的数字化表示,如快乐、悲伤、喜悦和恐惧,这些情感在人工神经元群中形成,并会根据不同的提示被激活。 该公司研究人员深入分析了Claude Sonnet 4.5的内部机制,发现所谓的“功能性情感”似乎会影响Claude的行为,进而改变模型的输出和反应。 Anthropic的发现有助于普通用户理解聊天机器人是如何运作的。例如,当Clau