#大型语言模型

按标签聚合查看文章内容。

Pramaana Labs获Khosla Ventures领投2700万美元种子轮融资,致力于将形式化验证引入人工智能AI资讯

Pramaana Labs获Khosla Ventures领投2700万美元种子轮融资,致力于将形式化验证引入人工智能

随着企业努力将人工智能试点项目转化为业务的实际组成部分,可靠性问题日益成为关注焦点。一家新兴初创公司希望通过借助数学形式化工具,结合计算机科学中最可靠的系统与最复杂的技术,来解决这一难题。 周三,Pramaana Labs宣布完成2700万美元的种子轮融资,领投方为Khosla Ventures,Accel、BoldCap、Nexus Venture Partners、Premji Invest和

SB C&S开始代理Sparticle的本地部署生成式AI平台“GBase on Spark”AI资讯

SB C&S开始代理Sparticle的本地部署生成式AI平台“GBase on Spark”

日本SB C&S株式会社于10日宣布,正式开始代理Sparticle株式会社的本地部署型大型语言模型(LLM)平台“GBase on Spark”,该平台能够在不将机密数据发送到外部的情况下,安全地利用生成式AI。 “GBase on Spark”是一套结合了本地部署生成式AI解决方案“GBase On-premises”与包括NVIDIA AI基础设施“NVIDIA DGX Spark”

这家初创公司希望让企业软件更像一个提示界面AI资讯

这家初创公司希望让企业软件更像一个提示界面

每一项新技术都会创造一个新的工作环境,但人工智能将如何改变这一点尚不明确。其中一种可能性是界面完全消失。 这正是Josh Sirota的愿景。他于去年八月创立了初创公司Eragon,刚刚完成了1200万美元融资,估值达1亿美元,旨在为企业客户打造一个具备自主代理能力的AI操作系统。 Sirota提出了一个简单的论点:“软件已死。”按钮、对话框和下拉菜单将成为过去,未来的业务将通过提示(prompt

本地运行大型语言模型工具“Ollama”支持“Hermes Desktop”AI资讯

本地运行大型语言模型工具“Ollama”支持“Hermes Desktop”

开源工具“Ollama”近日发布了v0.30.7版本更新,该工具支持在本地环境运行大型语言模型(LLM),兼容Windows、macOS和Linux系统,用户可从官方网站免费下载使用。 “Ollama”允许用户通过简单的命令下载并本地运行如“Gemma”、“Qwen”、“Llama”等开源大型语言模型,支持聊天和API调用,且基于MIT许可证开源开发,方便用户管理和使用本地模型。 此次更新的亮点

AI在“脑中”思考:Anthropic揭示Claude模型的内部思维机制AI资讯

AI在“脑中”思考:Anthropic揭示Claude模型的内部思维机制

在人类大脑中,诸如呼吸控制和文字识别等大部分处理过程都是无意识进行的。同时,也存在着人们能够意识到并用语言表达的思考,比如突然浮现的画面或有意制定的计划。美国Anthropic公司于7月6日(当地时间)发布了一项研究成果,指出类似的区分也自然存在于其大型语言模型“Claude”的内部。 该公司发现了Claude内部的一小部分神经模式群,称之为“J空间”。这些模式是通过一种基于数学概念雅可比矩阵的

政府如何决定开放AI的前沿模型安全发布?AI资讯

政府如何决定开放AI的前沿模型安全发布?

OpenAI 正在向公众广泛推出其最新的先进大型语言模型(LLM)Sol。Sol 被认为至少与 Anthropic 的 Fable 相当,而后者的能力(或所有权)曾让白宫感到压力,以至于一度禁止其公开访问。 那么,这些模型是如何获得发布许可的呢?简短的回答是:没人确切知道。 乔治城大学安全与新兴技术中心高级研究分析师 Mina Narayanan 告诉 TechCrunch:“坦率地说,我并不了解

科技圈困惑:为何人工智能尚未“彻底颠覆”图书行业?AI资讯

科技圈困惑:为何人工智能尚未“彻底颠覆”图书行业?

许多人依然坚信人工智能将取代地球上的所有工作,尽管这项技术在简单数学计算上仍存在困难。随着人工智能热潮逐渐消退,现实与炒作之间的差距变得越来越明显。 当前流行的聊天机器人背后的大型语言模型(LLM)相比早期的预测文本算法确实更强大,但距离许多人预期的划时代超级智能还有很大差距。 在Reddit论坛r/singularity上,一位人工智能爱好者曾提出一个自认为非常聪明的问题:“既然技术上具备能力,

这家贝索斯支持的初创公司称你的游戏数据可能是实现通用人工智能的关键AI资讯

这家贝索斯支持的初创公司称你的游戏数据可能是实现通用人工智能的关键

在实现通用人工智能(AGI)的道路上,现有的大型语言模型还远远不够。像ChatGPT和Claude这样的模型虽然在文本处理方面表现出色,但它们在理解事物如何在空间和时间中运动方面能力不足——而这正是实现具备泛化能力的智能所必需的关键技能。令人意外的是,这一缺口或许可以通过游戏数据来填补。 这正是总部位于纽约、获得贝索斯支持的初创公司General Intuition的核心理念。该公司估值达23亿美

什么是Mistral AI?全面了解这家OpenAI竞争对手AI资讯

什么是Mistral AI?全面了解这家OpenAI竞争对手

随着特朗普政府的指令导致Anthropic将其最新的AI模型下线,以及越来越多呼吁发展减少对美国依赖的主权技术,法国AI新星Mistral AI引起了广泛关注。然而,这家法国独角兽公司常被误解,尤其是因为它开发大型语言模型(LLM),使得外界对其定位产生混淆。 如果有人期待Mistral成为“欧洲的OpenAI”,可能会感到失望。其聊天和代理产品Vibe(前身为Le Chat)在品牌认知度上远不及

日本NTT突破大型语言模型间“词汇壁垒”,实现异种LLM协同AI资讯

日本NTT突破大型语言模型间“词汇壁垒”,实现异种LLM协同

日本NTT公司成功开发出全球首创的推理技术,能够在不降低精度的情况下缩减大型语言模型(LLM)中的输入输出单位“Token”的词汇量,实现不同LLM之间Token词汇的统一。 大型语言模型通过“Token”这一单位处理文本,推理时会基于概率预测下一个Token。然而,不同LLM使用的Token词汇通常各不相同,这导致模型之间无法直接比较或共享推理过程中的预测结果,形成了所谓的“词汇壁垒”。因此,