AI资讯谷歌发布Gemma 4系列开源模型,基于Gemini 3技术打造
谷歌将Gemini 3的先进技术带入开源领域,推出了Gemma 4系列多参数开源模型,支持多模态输入和多语言处理。
按标签聚合查看文章内容。
AI资讯谷歌将Gemini 3的先进技术带入开源领域,推出了Gemma 4系列多参数开源模型,支持多模态输入和多语言处理。
AI资讯2026年3月5日发布的LTX-2.3版本,在本地AI生成视频领域迈出了重要一步。该版本支持同时生成对白、旁白、背景音乐和音效,支持HD及全高清分辨率,视频最长可达20秒。 这让人不禁想尝试能否制作出类似日本Sora 2的视频作品。Sora 2的核心在于能够从简单的提示词自动生成多个场景、对白和音乐,连剧情构思也实现自动化。要在本地复现这一点,LTX-2.3之前还需加入剧情生成模块,而利用大型语
AI资讯谷歌I/O前夕,聚焦一篇关于预训练岗位准备的精彩博客。
AI资讯自从ChatGPT问世以来,以大型语言模型(LLM)为核心的人工智能技术迅速普及。其中,能够在个人电脑或智能手机上本地运行LLM的“本地LLM”也逐渐受到关注。 然而,对于初学者来说,最大的难题之一是完全无法判断自己当前设备能够运行多大规模的模型,性能表现如何。 在本地运行LLM时,几乎成为事实标准的“LM Studio”软件可以自动检测电脑的硬件规格,判断现有的GPU和内存容量是否足以加载模型
AI资讯ArXiv 是一个广泛使用的开放预印本研究存储库,近期加强了对科学论文中不当使用大型语言模型(LLM)的监管。 虽然ArXiv上的论文是在同行评审前发布的,但它已成为计算机科学和数学等领域研究传播的主要渠道之一,同时该平台也成为科学研究趋势数据的重要来源。 为了应对越来越多低质量的AI生成论文,ArXiv已经采取措施,例如要求首次投稿者必须获得资深作者的推荐。经过20多年由康奈尔大学托管后,ArX
AI资讯随着特朗普政府的指令导致Anthropic将其最新的AI模型下线,以及越来越多呼吁发展减少对美国依赖的主权技术,法国AI新星Mistral AI引起了广泛关注。然而,这家法国独角兽公司常被误解,尤其是因为它开发大型语言模型(LLM),使得外界对其定位产生混淆。 如果有人期待Mistral成为“欧洲的OpenAI”,可能会感到失望。其聊天和代理产品Vibe(前身为Le Chat)在品牌认知度上远不及
AI资讯人工智能正在改变世界,同时也创造了一套全新的语言来描述它的运作方式。只需花五分钟阅读AI相关内容,你就会遇到LLM、RAG、RLHF等众多术语,即使是技术领域的专家也可能感到困惑。本文词汇表旨在帮助你理解这些术语,并会随着领域的发展不断更新,堪称一份“活文档”,就像它所描述的AI系统一样。 AGI 人工通用智能(AGI)是一个模糊的概念,通常指的是在多数任务上能力超过普通人的AI。OpenAI的C
AI资讯介绍了嵌入技术如何将语言和文本转换为计算机可处理的数值向量,支持AI理解词义相似性及语义搜索。
AI资讯Yann LeCun认为,大多数人类推理基于物理世界而非语言,因此构建AI世界模型是实现真正人类级智能的关键。他在接受WIRED采访时表示:“认为通过扩展大型语言模型(LLMs)的能力就能达到人类级智能完全是无稽之谈。” 这轮融资使该初创公司估值达到35亿美元,领投方包括Cathay Innovation、Greycroft、Hiro Capital、HV Capital和Bezos Expedi
AI资讯日本东京大学AI研究会于5月25日推出了一款名为「EveryonesLLM」的教学工具,该工具允许用户仅通过Google Colab平台,从零开始构建一个规模为0.5B的完整大型语言模型(LLM/SLM)。 EveryonesLLM采用教程式的学习方式,包含超过600道填空题,帮助学习者逐步实现模型的编写与训练,最终能够培养出具备对话能力的语言模型。该教材共分为28个章节,每个章节的学习时间约为
AI资讯模型能力正迅速且不均衡地提升。我们一直在与安全团队合作,帮助他们发现并修复自身代码及开源软件中的漏洞,这使我们更深入地理解了如何利用模型来保障源代码安全。我们的主要结论是:漏洞发现阶段现在可以轻松并行化,而瓶颈已转移到漏洞验证、分类和修复阶段。 以我们对开源软件的扫描为例,截至2026年5月22日,我们已披露了1596个漏洞,其中据我们所知已有97个被修复。 本文将介绍如何使用Claude Opu