AI资讯文本基准测试超越Opus-4.6 Max的「Qwen3.7-Plus」
阿里巴巴云发布了集视觉与语言功能于一体的多模态AI代理Qwen3.7-Plus,支持多种交互方式,提升编码和生产力工作流程能力。
按标签聚合查看文章内容。
AI资讯阿里巴巴云发布了集视觉与语言功能于一体的多模态AI代理Qwen3.7-Plus,支持多种交互方式,提升编码和生产力工作流程能力。
AI资讯Thinking Machines团队发布了全新交互模型TML-Interaction-Small,凭借2760亿参数和12亿活跃参数,显著提升了实时语音模型的性能,开创了人机协作的新范式。
AI资讯本文探讨了OpenAI宣布弃用微调API背后的行业变化,以及AI模型训练、推理和应用领域的新动态。
AI资讯本文分享了OpenAI研究员Aidan McLaughlin关于提升对大型语言模型(LLMs)期望值的思考,以及近期AI领域的热点动态和技术进展。
AI资讯OpenAI的Sora应用虽然已经关闭,但谷歌显然认为用户对能让自己成为AI视频主角的工具仍有兴趣。周四,这家科技巨头宣布对Google Vids进行更新,用户可以通过上传自拍照和语音录音,创建一个看起来和听起来都像自己的数字化身。 此外,谷歌还将其多模态AI模型Gemini Omni引入Vids,用户可以通过文字提示和上传的参考图片组合来制作视频。Omni会将这些输入融合,生成所需的AI视频。它
AI聊天助手通义实验室是阿里云面向开发者与企业推出的全系列大模型与应用创新平台,核心包括通义千问大语言模型与万相视觉生成大模型,覆盖文本、图像、视频、音频等多模态能力,支持从对话问答、代码生成到智能体Agent与行业应用的一站式构建。
AI资讯美国谷歌公司于当地时间23日发布了首版《AI与经济ATLAS(活动、任务、环境与采用研究)》报告,深入分析了人们在工作和日常生活中如何使用人工智能(AI)。 该报告基于谷歌旗下“Gemini”应用及“Gemini API”等AI产品收集的1500万条匿名对话数据,涵盖了全球150多个国家和地区,使用140种语言,涉及800种职业和4000种任务,构成了规模庞大的调研基础。 职场中AI的使用现状 调
AI图片Pollinations.ai 是一个面向创作者和开发者的 AI 生成平台,提供简单易用的 API、免费算力和社区支持,可快速生成图片、文本、音频和视频,帮助你低成本搭建 AI 应用与创意项目。
AI商业Nexa SDK 是一款面向移动端、PC、车载与物联网设备的 AI 部署工具包,可在 NPU、GPU、CPU 上高效运行 LLM、多模态、语音识别与语音合成模型,实现本地快速、私密、可量产的 AI 推理。
AI资讯谷歌DeepMind发布了Gemma 4系列模型,带来显著性能提升和多模态支持,成为当前顶尖的开源模型之一。
AI商业LAION 是一个非营利的大规模人工智能开放网络组织,专注于向公众免费开放高质量机器学习数据集、工具与模型,推动开放研究与教育。
AI资讯在人工智能引发的失业担忧和少数大公司权力增强的背景下,Mira Murati创办的初创公司Thinking Machines Lab提出了一个截然不同的技术愿景。 Murati在接受WIRED采访时表示:“未来我们终将拥有超级智能机器,但我们认为实现多种可能的美好未来的最佳方式,是让人类始终参与其中。” 她认为,人工智能不必将人类排除在外。她提出一种更乐观的观点:让人们构建并定制自己的前沿AI模型