#大型语言模型

按标签聚合查看文章内容。

SpaceXAI发布Grok 4.5,埃隆称其为“Opus级模型”AI资讯

SpaceXAI发布Grok 4.5,埃隆称其为“Opus级模型”

SpaceXAI近日推出了最新的AI模型Grok 4.5,这是公司上市后发布的首个新版本。 在周三发布的官方博客中,SpaceXAI将Grok 4.5描述为一款多面手,能够完成AI行业普遍追求自动化的各类任务,包括编程与应用开发、办公文书、研究、写作以及其他常规知识工作。 据称,Grok 4.5在成本上也更具优势,SpaceXAI表示该模型的“令牌效率是其他领先模型的两倍”。如果这一效率在实际应用

本地运行大型语言模型工具“Ollama”支持“Codex”应用AI资讯

本地运行大型语言模型工具“Ollama”支持“Codex”应用

日本国家开源本地大型语言模型(LLM)运行工具“Ollama”最新版本v0.24.0于5月14日发布。该版本支持Windows、macOS和Linux系统,用户可从官方网站免费下载使用。 “Ollama”是一款通过简单命令即可下载并本地运行管理“Gemma”、“Qwen”、“Llama”等开源大型语言模型的工具。它支持聊天和API调用,且基于MIT许可证开源开发。 此次v0.24.0版本的最大亮

日本LLMC发布拥有332亿参数的日语大型语言模型“LLM-jp-4 33B”AI资讯

日本LLMC发布拥有332亿参数的日语大型语言模型“LLM-jp-4 33B”

日本大型语言模型研究开发中心(LLMC)于8月18日发布了拥有约332亿参数的Dense型大型语言模型“LLM-jp-4”系列新模型“LLM-jp-4 33B”。该系列包含两个版本:基础模型“llm-jp-4-33b-base”以及经过后期训练的“llm-jp-4-33b-thinking”。 “llm-jp-4-33b-thinking”模型在预训练和中间训练基础上,进一步进行了监督微调(SF

OpenAI打造全能AI代理,人人都会用吗?AI资讯

OpenAI打造全能AI代理,人人都会用吗?

你愿意让大型语言模型(LLM)掌控你多少数字生活? 要充分发挥模型的价值,就得把“钥匙”交给它。对控制欲强或对AI持谨慎态度的人来说,这似乎太冒险了。但对OpenAI桌面应用的首席工程师Andrew Ambrosino来说,这正是测试未来的唯一方式。因此,他的应用现在可以访问并控制他的邮箱、Slack账号、手机,以及Notion、Figma等应用。 “如果我让它写文档,有可能它会从私人私信中提取相

日本NTT突破大型语言模型间“词汇壁垒”,实现异种LLM协同AI资讯

日本NTT突破大型语言模型间“词汇壁垒”,实现异种LLM协同

日本NTT公司成功开发出全球首创的推理技术,能够在不降低精度的情况下缩减大型语言模型(LLM)中的输入输出单位“Token”的词汇量,实现不同LLM之间Token词汇的统一。 大型语言模型通过“Token”这一单位处理文本,推理时会基于概率预测下一个Token。然而,不同LLM使用的Token词汇通常各不相同,这导致模型之间无法直接比较或共享推理过程中的预测结果,形成了所谓的“词汇壁垒”。因此,

SandboxAQ将其药物发现模型引入Claude——无需计算机博士学位AI资讯

SandboxAQ将其药物发现模型引入Claude——无需计算机博士学位

药物发现是现代工业中成本最高的领域之一。找到一个可行的分子可能需要十年时间,花费数十亿美元,而且大多数候选分子最终都未能成功。新一代的人工智能初创公司承诺解决这一难题——大多数工具已经让技术足够成熟的研究人员使用起来更为轻松。 但SandboxAQ认为,瓶颈不在于模型本身,而在于界面设计。 该公司与Anthropic合作,将其科学人工智能模型直接集成到Claude中——通过一个对话式界面提供强大的

数百万美国人选择与AI对话代替看医生,却收到严重错误的医疗建议AI资讯

数百万美国人选择与AI对话代替看医生,却收到严重错误的医疗建议

尽管谷歌的人工智能不再建议用户“吃石头”或自信地告诉用户在披萨上涂胶水,但即使是最先进的AI聊天机器人在提供医疗建议方面仍然表现极其不可靠。 本周发表在《JAMA Network Open》期刊上的一项新研究中,研究人员让21个前沿大型语言模型(LLMs)在面对真实且患者可能提出的症状时“扮演医生”角色。 结果令人震惊。当面对可能对应多种疾病的模糊症状时,AI的失败率超过80%;即使是包含体检发

由被排名公司资助的“无法作弊”排行榜AI资讯

由被排名公司资助的“无法作弊”排行榜

人工智能模型迅速增多,竞争异常激烈。在众多参与者争夺市场的情况下,谁能成为最优秀的模型?又由谁来决定?Arena(前身为LM Arena)已经成为前沿大型语言模型(LLM)的事实公共排行榜,影响着资金投入、产品发布和公关周期。仅仅七个月时间,这家初创公司就从加州大学伯克利分校的博士研究项目,发展到估值达到17亿美元。 在《Equity》节目中,主持人Rebecca Bellan采访了Arena的联

不透明递归及其他你应该了解的AI术语AI资讯

不透明递归及其他你应该了解的AI术语

人工智能正在重塑世界,同时也创造了一套全新的语言来描述其运作方式。无论是参加产品会议、推介会还是讨论小组,你都会听到人们频繁提及LLM(大型语言模型)、RAG(检索增强生成)、RLHF(基于人类反馈的强化学习)等术语。最近,OpenAI新发布的Astra模型中采用的“不透明递归”推理技术引发了AI安全研究人员的关注和担忧。AI领域的术语更新速度极快,甚至让技术圈内的专家也感到些许不安。 本文旨在为