#大型语言模型

按标签聚合查看文章内容。

谷歌发布“Android CLI”预览版,提升基于代理的应用开发效率AI资讯

谷歌发布“Android CLI”预览版,提升基于代理的应用开发效率

美国谷歌于4月16日(当地时间)推出了“Android CLI”,这是一款面向Android应用开发的命令行界面工具,支持使用编码代理。该工具能够将大型语言模型(LLM)消耗的令牌数量减少70%,并且代理在仅使用标准工具集导航任务时,完成任务的速度是之前的三倍。 目前,“Android CLI”处于预览阶段,提供了以下主要功能: SDK管理:通过命令“android sdk install”仅获

野村综合研究所提升行业与任务专用大型语言模型的构建精度以推动AI代理应用AI资讯

野村综合研究所提升行业与任务专用大型语言模型的构建精度以推动AI代理应用

日本国家野村综合研究所(NRI)于27日宣布,在日本经济产业省及国立研究开发法人新能源·产业技术综合开发机构(NEDO)支持的生成式AI开发力强化项目“GENIAC(Generative AI Accelerator Challenge)”第三期(2025年8月至2026年3月)中,成功提升了针对特定行业和任务的大型语言模型(LLM)的构建方法的精度与效率。 NRI将该LLM集成到AI代理系统中,

政府如何决定开放AI的前沿模型安全发布?AI资讯

政府如何决定开放AI的前沿模型安全发布?

OpenAI 正在向公众广泛推出其最新的先进大型语言模型(LLM)Sol。Sol 被认为至少与 Anthropic 的 Fable 相当,而后者的能力(或所有权)曾让白宫感到压力,以至于一度禁止其公开访问。 那么,这些模型是如何获得发布许可的呢?简短的回答是:没人确切知道。 乔治城大学安全与新兴技术中心高级研究分析师 Mina Narayanan 告诉 TechCrunch:“坦率地说,我并不了解

Kog深入挖掘GPU潜力,提升AI推理速度AI资讯

Kog深入挖掘GPU潜力,提升AI推理速度

AI推理速度的竞赛正如火如荼地进行中,Cerebras凭借其专用芯片在今年五月的IPO中获得了市场的热烈欢迎。然而,法国初创公司Kog则认为,传统GPU仍有巨大的潜力可以挖掘。 今年五月,Kog在Hacker News首页发布了一项技术预览,展示了“在企业现有的标准数据中心GPU上实现极快的单请求解码”的可能性,演示中使用了AMD MI300X和Nvidia H200 GPU。 虽然部分人对其未能

Clio实现5亿美元收入里程碑,Anthropic加码法律AI竞争AI资讯

Clio实现5亿美元收入里程碑,Anthropic加码法律AI竞争

随着人工智能技术广泛应用于医疗、客户支持等多个领域,代码生成无疑是最受欢迎且最具盈利潜力的应用场景之一。加拿大法律事务管理软件公司Clio的联合创始人兼CEO Jack Newton坚信,法律科技将成为大型语言模型(LLM)时代的下一个重要赢家。虽然这一观点带有一定的主观色彩——毕竟Clio是一家已有18年历史的法律科技公司——但其业绩数据令人难以忽视。 自2023年Clio将AI技术整合进其产品

维基百科加强对AI写作的监管AI资讯

维基百科加强对AI写作的监管

随着人工智能在编辑和媒体领域的广泛应用,各大网站纷纷制定相关使用规范。本周,维基百科宣布禁止编辑者使用AI生成的文本,尽管并未完全禁止AI参与其编辑流程。 根据最新的政策更新,维基百科明确规定“禁止使用大型语言模型(LLM)生成或重写条目内容”。这一新规定对之前较为模糊的表述进行了明确,之前的政策仅表示“LLM不应被用来从零开始生成新的维基百科条目”。 AI在维基百科条目中的使用已成为该网站庞大且

OpenAI与Broadcom联合开发专为大型语言模型优化的芯片“Jalapeño”AI资讯

OpenAI与Broadcom联合开发专为大型语言模型优化的芯片“Jalapeño”

2024年6月24日,日本OpenAI与Broadcom联合发布了OpenAI首款智能处理器“Jalapeño(哈拉佩尼奥)”。 这款芯片专为大型语言模型(LLM)的处理需求进行了优化。初步测试显示,其每瓦性能相比现有最先进技术有显著提升。详细的技术报告预计将在未来几个月内公布。 据日本OpenAI介绍,Jalapeño芯片是基于ChatGPT、Codex、API以及未来计划推出的智能代理系统的

AI资讯

xAI发布Grok4.20:推理性能大幅提升,78%非虚构率创行业新高

2026年3月12日,xAI正式推出新一代大型语言模型Grok4.20Beta,该模型在保持竞争性价格的同时,实现了极高的事实可靠性,刷新了行业记录。 根据Artificial Analysis的最新评测,Grok4.20在智能指数中的推理能力得分为48分,比上一版本提升了6分。虽然在综合基准测试中仍落后于Gemini3.1Pro Preview和GPT-5.4(两者均为57分),但其在AA全知测

Reddit利用大型语言模型解决由大型语言模型引发的问题AI资讯

Reddit利用大型语言模型解决由大型语言模型引发的问题

随着强大的大型语言模型(LLMs)变得触手可及,网络上恶意行为者散布垃圾信息变得比以往任何时候都容易。如果你在过去几年里花过大约10分钟上网,你就会发现垃圾信息和机器人内容的问题比以往更加严重。 Reddit表示,他们开发了基于大型语言模型的工具来减少垃圾信息,而这些垃圾信息本身很大一部分也是由大型语言模型生成的。这种做法有些讽刺,但在人工智能时代,平台别无选择,只能以火攻火。据该平台称,Redd

五角大楼正在开发替代Anthropic的人工智能方案AI资讯

五角大楼正在开发替代Anthropic的人工智能方案

五角大楼与Anthropic之间的合作关系在经历了戏剧性的破裂后,似乎难以恢复。根据彭博社对五角大楼首席数字与人工智能官卡梅伦·斯坦利的采访,五角大楼正在积极开发多种大型语言模型(LLM),以替代Anthropic的人工智能技术,并计划很快将这些模型投入实际使用。 Anthropic与美国国防部签订的2亿美元合同在过去几周内因双方未能就军方对Anthropic人工智能的无限制访问达成一致而告吹。A

AI在“脑中”思考:Anthropic揭示Claude模型的内部思维机制AI资讯

AI在“脑中”思考:Anthropic揭示Claude模型的内部思维机制

在人类大脑中,诸如呼吸控制和文字识别等大部分处理过程都是无意识进行的。同时,也存在着人们能够意识到并用语言表达的思考,比如突然浮现的画面或有意制定的计划。美国Anthropic公司于7月6日(当地时间)发布了一项研究成果,指出类似的区分也自然存在于其大型语言模型“Claude”的内部。 该公司发现了Claude内部的一小部分神经模式群,称之为“J空间”。这些模式是通过一种基于数学概念雅可比矩阵的