#大型语言模型

按标签聚合查看文章内容。

Anthropic未发布模型在数学重大未解难题上取得突破AI资讯

Anthropic未发布模型在数学重大未解难题上取得突破

150多年来,黎曼猜想一直是数学领域最重要的未解难题之一,涉及素数分布的深刻奥秘。目前,针对该猜想的通用证明尚未被发现,仍有100万美元的奖金悬赏。 尽管当代的人工智能模型尚未能完全解决这一问题,但它们在这一领域取得的进展远超预期,这一发现可能会重新引发关于现代AI在科学和数学创新能力方面的讨论。 Anthropic公司于周一宣布,其一款尚未发布的模型在黎曼猜想上取得了重大进展,显著提升了猜想成立

员工用公司超贵的AI代币做最荒谬无用的事情AI资讯

员工用公司超贵的AI代币做最荒谬无用的事情

在AI热潮的背后,隐藏着一个现实难题:企业为AI工具支付天价费用,但这些工具的价值仍无法媲美一名称职的人类员工。随着AI公司及其投资者不断投入数十亿美元进行AI研发,这种矛盾的后果正逐渐显现于美国各地的办公室和商铺中。 例如,金融科技公司Slash最近鼓励员工尽可能多地使用AI编程工具,这种行为被称为“代币最大化”,旨在提升生产力并降低成本。然而,语言模型(LLM)代币价格过高且实用性有限,难以实

西川和久不定期专栏:利用WebGPU轻松运行本地大型语言模型(LLM)AI资讯

西川和久不定期专栏:利用WebGPU轻松运行本地大型语言模型(LLM)

截至2026年,想要在本地体验大型语言模型(LLM),通常需要下载并启动如LM Studio的软件,下载模型,进行配置和运行。虽然步骤不算复杂,但对普通用户来说门槛仍然较高。大家可能更希望像使用云服务一样,只需打开网页浏览器访问一个URL,就能轻松运行本地LLM。 实现这一目标的关键技术是WebGPU。本文将介绍如何利用Web浏览器和WebGPU轻松运行本地LLM,并推荐几个可以立即体验的相关网

如何在自己的电脑上运行聊天机器人AI资讯

如何在自己的电脑上运行聊天机器人

如果你使用过 ChatGPT、Claude、Perplexity 或其他 AI 平台,那么你实际上是在使用大型语言模型(LLM)。但鲜为人知的是,这些大型语言模型其实可以在本地电脑上运行。这样做的主要好处是可以离线使用,且隐私性更强,因为你的数据不会被上传到云端供他人分析或查看。 此外,你无需支付任何 AI 公司的月费订阅,也不会受到使用次数的限制。许多大型语言模型都可以免费下载,包括 Meta

中国AI模型一举登顶排行榜,引发美国科技界震动AI资讯

中国AI模型一举登顶排行榜,引发美国科技界震动

在华尔街沉睡之际,一款由中国研发的大型语言模型悄然跃升,超越了16个竞争对手,登顶AI排行榜。 这款名为Kimi-K3的模型由北京Moonshot AI公司开发。周四,AI基准测试平台Arena.ai宣布,Kimi-K3在“前端代码竞技场”中,从第17名一跃成为第一名,远远领先于备受关注的Claude Fable 5和GPT-5.6 Sol。 在“文本竞技场”——衡量模型在文本生成和创意写作等任务

美国政府支持OpenAI使用版权材料训练大型语言模型的立场AI资讯

美国政府支持OpenAI使用版权材料训练大型语言模型的立场

在《纽约时报》对OpenAI提起的诉讼中,特朗普政府提交了一份20页的法律意见书,为ChatGPT开发商未经授权使用版权材料训练其大型语言模型(LLM)进行辩护。 该意见书指出:“美国有强烈的利益继续发展一个强大且具有竞争力的人工智能产业,该产业将成为全球人工智能使用规范和程序的标准……因此,美国必须‘保持在人工智能领域的全球领导地位’。”这段话引用了特朗普总统去年签署的一项行政命令。 驱动Cha

本地运行大型语言模型工具“Ollama”v0.34发布,支持“ChatGPT”桌面应用集成AI资讯

本地运行大型语言模型工具“Ollama”v0.34发布,支持“ChatGPT”桌面应用集成

9月5日(美国时间),支持在本地环境运行大型语言模型(LLM)的桌面应用“Ollama”更新至v0.34.0版本。此次更新的亮点是用户可以直接通过“Ollama”应用设置与“ChatGPT”桌面应用的联动,实现熟悉的“ChatGPT”工作流程同时运行开放模型。 “Ollama”支持下载并本地运行管理包括“Gemma”、“Qwen”、“Llama”等开放大型语言模型,同时也能访问云端模型。它提供图

GMKtec发布搭载192GB内存的迷你PC EVO-X5 Pro,实现3000亿参数级LLM本地推理AI资讯

GMKtec发布搭载192GB内存的迷你PC EVO-X5 Pro,实现3000亿参数级LLM本地推理

在2026年IFA展会上,多款搭载192GB内存和AMD Ryzen AI Max+ PRO 495处理器,能够本地运行3000亿参数级大型语言模型(LLM)的迷你PC相继亮相。日本GMKtec公司于9月5日(德国时间)发布了其旗舰迷你PC产品——EVO-X5 Pro。 EVO-X5 Pro结合了AMD最新的Ryzen AI Max+ PRO 495处理器与最高192GB统一内存,支持无需依赖云