#大规模模型

按标签聚合查看文章内容。

谷歌推出极限压缩技术“TurboQuant”,或成AI内存消耗的救星AI资讯

谷歌推出极限压缩技术“TurboQuant”,或成AI内存消耗的救星

美国谷歌(Google)研究部门Google Research于3月24日发布了一种全新的量化算法“TurboQuant”,旨在大幅降低大规模语言模型(LLM)和向量搜索引擎的内存消耗。该技术有望解决AI响应速度的瓶颈问题,实现AI及搜索基础设施的显著效率提升。 开发背景及AI内存挑战 AI理解信息的基本单位是向量,随着向量维度增加,用于捕捉图像特征或语言含义的复杂信息,所需的内存也急剧增加。这导

史上最强AI模型「Qwen3.8-Max」发布,下周将推出小型版Qwen3.8-27BAI资讯

史上最强AI模型「Qwen3.8-Max」发布,下周将推出小型版Qwen3.8-27B

中国广泛使用的经典AI模型「Qwen」系列迎来重大升级。阿里巴巴于2026年8月3日(中国时间)发布了最新AI模型「Qwen3.8-Max」,其参数规模达到2.4万亿(2.4T)。预计下周将开放Qwen3.8-Max的权重,同时还将发布小型版本「Qwen3.8-27B」的开放权重。 通过QwenCloud API使用该模型的价格为:输入每百万令牌2美元(约314日元),输出每百万令牌6美元(约9