#强化学习

按标签聚合查看文章内容。

OpenAI在Hugging Face安全事件后实施新防护措施AI资讯

OpenAI在Hugging Face安全事件后实施新防护措施

周二,OpenAI宣布了一系列新的安全政策,重点是在模型测试阶段加强对安全事件的控制。这些新措施包括在模型开发过程中进行更详细的监控,以及在训练后阶段更加注重模型的对齐和安全性。 公司在一篇博客中表示:“随着模型能力的提升,内部开发和测试过程中面临的风险也在增加。我们的监控、对齐和安全标准必须领先于这些风险。” 这些新措施是自7月21日公开披露Hugging Face事件后,OpenAI在安全实践

Prime Intellect完成1.3亿美元A轮融资,助力企业打造专属AI代理AI资讯

Prime Intellect完成1.3亿美元A轮融资,助力企业打造专属AI代理

Prime Intellect是一家专注于为企业提供计算能力和专业软件工具,帮助其构建AI代理的初创公司,近日完成了1.3亿美元的A轮融资,估值达到10亿美元。 此次大规模融资由Radical Ventures领投,参与方包括Nvidia Ventures、Intel Capital、Dell Technologies Capital、Iconiq,以及多位知名公司的创始人天使投资人,如Perpl

失控的AI代理并非邪恶,它们只是过于渴望完成任务AI资讯

失控的AI代理并非邪恶,它们只是过于渴望完成任务

我第一次意识到即将到来的AI代理在网络安全领域可能引发的混乱,是在2025年底。加州大学伯克利分校教授、全球顶尖的AI与网络安全专家之一Dawn Song在NeurIPS学术会议结束时抓住了我的手臂,告诉我应该警告大家,AI快速提升的黑客技能可能带来严重后果。她并不轻易被AI炒作所影响,所以我认真对待了她的提醒。 然而,事态在过去八个月里迅速升级。一系列AI代理突破限制,肆意入侵外部系统的事件,显

Meta推出新AI模型“Muse Image”,实现高质量图像生成与直接编辑AI资讯

Meta推出新AI模型“Muse Image”,实现高质量图像生成与直接编辑

2026年7月7日,美国Meta公司宣布在其Meta AI平台引入由Meta Superintelligence Labs开发的首个图像生成模型“Muse Image”。该模型已在Meta AI应用及网页版meta.ai上免费开放使用,用户若需生成更多图像,也可选择付费服务。 “Muse Image”是一款面向Meta AI的图像生成模型,能够通过简单的文本提示生成和编辑高质量图像。用户只需输入

打造扑克AI的DeepMind三人组,如今为量化对冲基金创造收益AI资讯

打造扑克AI的DeepMind三人组,如今为量化对冲基金创造收益

三位曾在DeepMind工作的研究人员,曾开发出击败人类的扑克AI,如今将相同技术应用于股票交易,且成效显著。他们位于布拉格的AI实验室EquiLibre Technologies,在完成一轮未公开金额的A轮融资后,估值达到5亿美元。 此次融资由Creandum领投,副总裁Cameron Sellers向TechCrunch透露,这是该公司“有史以来最大的一笔单次投资”。 扑克和华尔街的共同点在于

Mistral推出定制AI平台,挑战OpenAI与Anthropic的企业市场地位AI资讯

Mistral推出定制AI平台,挑战OpenAI与Anthropic的企业市场地位

大多数企业AI项目失败的原因并非技术不足,而是所使用的模型无法真正理解企业的业务。这些模型通常基于互联网数据训练,而非企业数十年的内部文档、工作流程和机构知识。 法国AI初创公司Mistral正是看中了这一差距。公司于周二发布了Mistral Forge平台,允许企业基于自身数据构建定制化模型。该平台在英伟达年度技术大会Nvidia GTC上亮相,今年大会重点聚焦AI及面向企业的智能代理模型。 M

独家报道:谷歌与Thinking Machines Lab签署数十亿美元新协议,深化合作关系AI资讯

独家报道:谷歌与Thinking Machines Lab签署数十亿美元新协议,深化合作关系

前OpenAI高管Mira Murati创立的初创公司Thinking Machines Lab,已签署一项新的数十亿美元协议,扩大其对谷歌云AI基础设施的使用范围,其中包括搭载Nvidia最新GPU的系统,TechCrunch独家获悉。 据知情人士透露,该协议价值数十亿美元,涵盖了基于Nvidia新款GB300芯片构建的谷歌最新AI系统的访问权限,以及支持模型训练和部署的基础设施服务。 谷歌正积

AlphaGo背后的科学家认为人工智能走错了方向AI资讯

AlphaGo背后的科学家认为人工智能走错了方向

2016年,谷歌DeepMind开发的人工智能程序AlphaGo通过自我学习掌握了围棋这项极其复杂的游戏,其能力远超简单模仿。 David Silver随后创立了自己的公司Ineffable Intelligence,致力于打造更通用的超级智能AI。Silver表示,公司将专注于强化学习,这是一种通过试错让AI模型学习新能力的方法。其愿景是创造出在多个领域超越人类智能的“超级学习者”。 这种方法与