#AI训练

按标签聚合查看文章内容。

Thinking Machines实验室发布首款模型InklingAI资讯

Thinking Machines实验室发布首款模型Inkling

Thinking Machines实验室近日发布了其首款AI模型Inkling。该模型从零开始训练,能够理解音频、视频以及文本输入。虽然Inkling在主流基准测试中并非表现最佳,但它在多项任务中表现出色,具备高级推理和编程能力。与许多开源权重模型类似,Inkling规模庞大,拥有9750亿参数,需要在专用芯片集群上运行。 值得注意的是,Thinking Machines利用Inkling自身进行

GitHub Copilot开始收集作业数据用于AI训练,支持用户选择退出AI资讯

GitHub Copilot开始收集作业数据用于AI训练,支持用户选择退出

日本国家GitHub于3月25日宣布,将更新GitHub Copilot的交互数据使用政策。从4月24日起,Copilot Free、Copilot Pro、Copilot Pro+等计划中的用户作业数据将被收集,用于AI模型的训练。这些数据包括用户的输入、输出以及代码片段等。 GitHub Copilot是一款面向集成开发环境(IDE)的AI助手,旨在辅助用户进行编码等工作。 此前,AI训练数

如何选择退出AI聊天机器人收集数据用于训练AI资讯

如何选择退出AI聊天机器人收集数据用于训练

AI聊天机器人已经无处不在,越来越多的人依赖它们来生成图像、视频,甚至开发应用和游戏。虽然使用这些工具很有趣,但并非所有人都只是轻松地与聊天机器人互动。有人将它们用于心理治疗、作为AI伴侣,甚至解决健康问题。你与聊天机器人的对话数据不仅会被存储,还很可能被用来进一步训练AI模型,除非你主动采取措施阻止。 大多数AI聊天机器人默认允许公司使用你的数据来训练AI模型,但你可以通过调整设置来关闭这一功能

Cursor承认其新编程模型基于Moonshot AI的Kimi构建AI资讯

Cursor承认其新编程模型基于Moonshot AI的Kimi构建

本周,AI编程公司Cursor发布了名为Composer 2的新模型,并宣传其具备“前沿级编程智能”。 然而,一位名为Fynn的X用户很快指出,Composer 2实际上是“仅在Kimi 2.5基础上加入了强化学习”的版本。Kimi 2.5是由中国公司Moonshot AI最近开源发布的模型,该公司由阿里巴巴和红杉中国(前身为红杉资本中国)支持。 Fynn提供了代码证据,显示模型标识符指向了Kim

AI公司面临讽刺教训:他们付钱让人改进聊天机器人,结果却是喂给AI“垃圾数据”AI资讯

AI公司面临讽刺教训:他们付钱让人改进聊天机器人,结果却是喂给AI“垃圾数据”

对于争夺AI领域霸主地位的科技公司来说,原始且高质量的数据极为珍贵。为了保持支撑我们喜爱AI聊天机器人的大型语言模型的最新状态,这些公司必须不断输入大量新鲜数据。正如一项研究显示,自2010年以来,用于训练AI的数据量每九个月就翻一番,这种指数级增长可能很快会遇到瓶颈,因为干净数据的储备正处于严重短缺状态。 当没有更多原创内容可供挖掘时,企业开始支付给工人以生成新的训练数据,通常提供低质量的合同,

Uber计划将数百万司机车辆变为自动驾驶数据传感网AI资讯

Uber计划将数百万司机车辆变为自动驾驶数据传感网

Uber的长期目标不仅仅是提供乘客接送服务,公司希望未来能在其人类司机的车辆上安装传感器,收集真实世界的数据,供自动驾驶(AV)公司以及其他训练物理世界场景AI模型的企业使用。 Uber首席技术官Praveen Neppalli Naga在旧金山TechCrunch StrictlyVC活动上透露了这一计划,他称这是一项从今年一月底推出的“AV Labs”项目自然延伸出来的战略。 “这是我们最终想

谷歌再次因AI训练遭主要出版商集体诉讼AI资讯

谷歌再次因AI训练遭主要出版商集体诉讼

一群出版商和作者联合对谷歌提起了集体诉讼,指控这家科技巨头未经授权使用他们的版权作品来训练其AI平台Gemini。 原告团体包括哈切特(Hachette)、森盖奇(Cengage)、爱思唯尔(Elsevier)、作家斯科特·图罗(Scott Turow)以及S.C.R.I.B.E.。诉讼中称,谷歌故意删除或更改了这些作品上的版权信息,以“掩盖其Gemini模型是基于盗用材料训练”的事实。 这起诉讼

Thinking Machines实验室发布首款模型InklingAI资讯

Thinking Machines实验室发布首款模型Inkling

Thinking Machines实验室在一篇博客文章中介绍了其首款模型Inkling。该模型从零开始训练,能够理解音频、视频以及文本输入。虽然Inkling在主流基准测试中并非表现最佳,但它在多项任务中表现出色,具备高级推理和编程能力。与许多开源权重模型类似,Inkling规模庞大,拥有9750亿参数,需要在专用芯片集群上运行。 值得注意的是,Thinking Machines利用Inkling

如果你使用谷歌,就在训练它的AI。教你如何退出AI资讯

如果你使用谷歌,就在训练它的AI。教你如何退出

请注意:谷歌最近悄然更新了隐私设置,允许公司保存更多用户数据,包括“图片、文件以及音频和视频录制内容”,用于提升其AI模型的表现。换句话说,只要你向谷歌搜索服务上传任何媒体内容,这些内容就可能被用来训练AI,除非你主动选择退出。 这项变更通过谷歌在六月通过邮件通知用户的隐私设置更新悄然实施。实际上,谷歌默认将用户纳入了这项扩展的AI训练计划,表面上是为了让用户更好地管理保存的历史记录和个性化推荐。

GitHub政策大逆转:私有仓库代码也将用于AI训练AI资讯

GitHub政策大逆转:私有仓库代码也将用于AI训练

GitHub宣布自2026年4月24日起,将使用用户交互数据训练AI模型,引发争议。此举被戏称为“撤销操作”,因此前GitHub强调尊重用户隐私。新政策默认开启,私有仓库数据不再绝对私密,免费版Copilot也受影响。