AI资讯阿里云正式发布高性能模型「Qwen 3.8-Max」,开放权重下周公开
阿里云推出了Qwen系列中性能最强的模型Qwen 3.8-Max,支持通过API访问,开放权重计划于下周发布。
按标签聚合查看文章内容。
AI资讯阿里云推出了Qwen系列中性能最强的模型Qwen 3.8-Max,支持通过API访问,开放权重计划于下周发布。
AI资讯美国谷歌(Google)研究部门Google Research于3月24日发布了一种全新的量化算法“TurboQuant”,旨在大幅降低大规模语言模型(LLM)和向量搜索引擎的内存消耗。该技术有望解决AI响应速度的瓶颈问题,实现AI及搜索基础设施的显著效率提升。 开发背景及AI内存挑战 AI理解信息的基本单位是向量,随着向量维度增加,用于捕捉图像特征或语言含义的复杂信息,所需的内存也急剧增加。这导
AI资讯中国广泛使用的经典AI模型「Qwen」系列迎来重大升级。阿里巴巴于2026年8月3日(中国时间)发布了最新AI模型「Qwen3.8-Max」,其参数规模达到2.4万亿(2.4T)。预计下周将开放Qwen3.8-Max的权重,同时还将发布小型版本「Qwen3.8-27B」的开放权重。 通过QwenCloud API使用该模型的价格为:输入每百万令牌2美元(约314日元),输出每百万令牌6美元(约9
Mistral AI发布了全新开源模型Mistral Small4,集成三大旗舰能力,加入NVIDIA Nemotron联盟,提升效率与性能。