AI资讯参数时代终结:Z.ai CEO Jie Tang谈GLM 5.3与新型后训练规模定律
Jie Tang教授强调,模型规模不再仅以参数数量衡量,数据质量、计算资源分配及运行环境同样关键。GLM 5.3通过强化学习在长时环境中实现突破,推动AI向更复杂任务的自主完成迈进。
按标签聚合查看文章内容。
AI资讯Jie Tang教授强调,模型规模不再仅以参数数量衡量,数据质量、计算资源分配及运行环境同样关键。GLM 5.3通过强化学习在长时环境中实现突破,推动AI向更复杂任务的自主完成迈进。
AI资讯Prime Intellect是一家专注于为企业提供计算能力和专业软件工具,帮助其构建AI代理的初创公司,近日完成了1.3亿美元的A轮融资,估值达到10亿美元。 此次大规模融资由Radical Ventures领投,参与方包括Nvidia Ventures、Intel Capital、Dell Technologies Capital、Iconiq,以及多位知名公司的创始人天使投资人,如Perpl
AI资讯我第一次意识到即将到来的AI代理在网络安全领域可能引发的混乱,是在2025年底。加州大学伯克利分校教授、全球顶尖的AI与网络安全专家之一Dawn Song在NeurIPS学术会议结束时抓住了我的手臂,告诉我应该警告大家,AI快速提升的黑客技能可能带来严重后果。她并不轻易被AI炒作所影响,所以我认真对待了她的提醒。 然而,事态在过去八个月里迅速升级。一系列AI代理突破限制,肆意入侵外部系统的事件,显
AI资讯2026年7月7日,美国Meta公司宣布在其Meta AI平台引入由Meta Superintelligence Labs开发的首个图像生成模型“Muse Image”。该模型已在Meta AI应用及网页版meta.ai上免费开放使用,用户若需生成更多图像,也可选择付费服务。 “Muse Image”是一款面向Meta AI的图像生成模型,能够通过简单的文本提示生成和编辑高质量图像。用户只需输入
AI资讯随着OpenAI即将提交IPO申请,模型实验室正逐步转向构建智能代理产品,行业格局正在发生深刻变化。
AI资讯三位曾在DeepMind工作的研究人员,曾开发出击败人类的扑克AI,如今将相同技术应用于股票交易,且成效显著。他们位于布拉格的AI实验室EquiLibre Technologies,在完成一轮未公开金额的A轮融资后,估值达到5亿美元。 此次融资由Creandum领投,副总裁Cameron Sellers向TechCrunch透露,这是该公司“有史以来最大的一笔单次投资”。 扑克和华尔街的共同点在于
AI资讯大多数企业AI项目失败的原因并非技术不足,而是所使用的模型无法真正理解企业的业务。这些模型通常基于互联网数据训练,而非企业数十年的内部文档、工作流程和机构知识。 法国AI初创公司Mistral正是看中了这一差距。公司于周二发布了Mistral Forge平台,允许企业基于自身数据构建定制化模型。该平台在英伟达年度技术大会Nvidia GTC上亮相,今年大会重点聚焦AI及面向企业的智能代理模型。 M
AI资讯天工AI大模型SkyReels V4在全球视频生成领域领先,突破性应用强化学习与逻辑推理技术,解决视频生成中的一致性和叙事逻辑难题,成为全球最强视频生成AI模型。
AI资讯前OpenAI高管Mira Murati创立的初创公司Thinking Machines Lab,已签署一项新的数十亿美元协议,扩大其对谷歌云AI基础设施的使用范围,其中包括搭载Nvidia最新GPU的系统,TechCrunch独家获悉。 据知情人士透露,该协议价值数十亿美元,涵盖了基于Nvidia新款GB300芯片构建的谷歌最新AI系统的访问权限,以及支持模型训练和部署的基础设施服务。 谷歌正积
AI教程用一个完整的奥赛罗棋盘游戏,手把手示范如何设计状态、动作、奖励和环境循环,并迁移到你自己的任务中。
AI资讯2016年,谷歌DeepMind开发的人工智能程序AlphaGo通过自我学习掌握了围棋这项极其复杂的游戏,其能力远超简单模仿。 David Silver随后创立了自己的公司Ineffable Intelligence,致力于打造更通用的超级智能AI。Silver表示,公司将专注于强化学习,这是一种通过试错让AI模型学习新能力的方法。其愿景是创造出在多个领域超越人类智能的“超级学习者”。 这种方法与
AI资讯Stockmark基于NVIDIA开源AI模型Nemotron-3-Nano-Omni,开发了专门针对日本复杂商务文档的视觉语言模型,并公开了可商用的开源版本。