AI资讯DeepSeek发布新AI模型,缩小与顶尖模型的差距
中国AI实验室DeepSeek近日推出了其最新大型语言模型DeepSeek V4的两个预览版本——V4 Flash和V4 Pro。这是继去年发布的V3.2版本及其备受关注的R1推理模型之后的重要升级。DeepSeek表示,这两款模型均采用了专家混合(mixture-of-experts)架构,拥有高达100万令牌的上下文窗口,能够处理大型代码库或文档输入。专家混合技术通过激活部分参数来降低推理成本
按标签聚合查看文章内容。
AI资讯中国AI实验室DeepSeek近日推出了其最新大型语言模型DeepSeek V4的两个预览版本——V4 Flash和V4 Pro。这是继去年发布的V3.2版本及其备受关注的R1推理模型之后的重要升级。DeepSeek表示,这两款模型均采用了专家混合(mixture-of-experts)架构,拥有高达100万令牌的上下文窗口,能够处理大型代码库或文档输入。专家混合技术通过激活部分参数来降低推理成本
AI资讯随着强大的大型语言模型(LLMs)变得触手可及,网络上恶意行为者散布垃圾信息变得比以往任何时候都容易。如果你在过去几年里花过大约10分钟上网,你就会发现垃圾信息和机器人内容的问题比以往更加严重。 Reddit表示,他们开发了基于大型语言模型的工具来减少垃圾信息,而这些垃圾信息本身很大一部分也是由大型语言模型生成的。这种做法有些讽刺,但在人工智能时代,平台别无选择,只能以火攻火。据该平台称,Redd
AI资讯Wix.com在其AI应用开发平台Base44上正式推出了自主研发的大型语言模型Base 1,利用海量用户操作数据持续优化性能。
AI资讯日本MINISFORUM公司推出了搭载Core Ultra 7 356H处理器的迷你电脑产品——MINISFORUM M2。该机型直销价格为187,199日元。官方还提供不含内存、存储和操作系统的裸机版本,售价为124,999日元,但目前显示已售罄。 MINISFORUM M2采用基于Panther Lake架构的Core Ultra 7 356H处理器,内置NPU性能达到50TOPS,GPU性
AI资讯SpaceXAI近日推出了最新的AI模型Grok 4.5,这是公司上市后发布的首个新版本。 在周三发布的官方博客中,SpaceXAI将Grok 4.5描述为一款多面手,能够完成AI行业普遍追求自动化的各类任务,包括编程与应用开发、办公文书、研究、写作以及其他常规知识工作。 据称,Grok 4.5在成本上也更具优势,SpaceXAI表示该模型的“令牌效率是其他领先模型的两倍”。如果这一效率在实际应用
AI资讯日本东京大学AI研究会于5月25日推出了一款名为「EveryonesLLM」的教学工具,该工具允许用户仅通过Google Colab平台,从零开始构建一个规模为0.5B的完整大型语言模型(LLM/SLM)。 EveryonesLLM采用教程式的学习方式,包含超过600道填空题,帮助学习者逐步实现模型的编写与训练,最终能够培养出具备对话能力的语言模型。该教材共分为28个章节,每个章节的学习时间约为
AI资讯美国微软公司于2026年5月31日(当地时间)发布了面向全球创作者和AI开发者的15英寸笔记本电脑“Surface Laptop Ultra”。该产品预计将于今年下半年正式上市,售价尚未公布。 Surface Laptop Ultra由微软与NVIDIA联合工程设计,搭载了NVIDIA最新的Windows平台处理器“RTX Spark”,配备Blackwell RTX GPU和最高128GB统一
AI资讯美国谷歌于4月16日(当地时间)推出了“Android CLI”,这是一款面向Android应用开发的命令行界面工具,支持使用编码代理。该工具能够将大型语言模型(LLM)消耗的令牌数量减少70%,并且代理在仅使用标准工具集导航任务时,完成任务的速度是之前的三倍。 目前,“Android CLI”处于预览阶段,提供了以下主要功能: SDK管理:通过命令“android sdk install”仅获
AI资讯谷歌的AI到底能不能正确拼写“Google”?答案是不能。谷歌的AI概述功能竟然说“Google”里有两个字母P。 不仅如此,谷歌AI还声称“poop”这个词里只有一个字母r,而“journalism”这个词被拼成了j-o-u-r-n-a-d-i-s-m,明显拼错了。它至少认出了美国总统姓氏中有一个P,但却拼成了t-r-p-u-m。 谷歌将生成式AI作为其29年历史旗舰产品的核心,然而这次升级的搜
AI资讯美国谷歌公司发布了一种名为“TurboQuant”的压缩算法,旨在解决大型语言模型(LLM)运行时大量内存消耗的问题。该算法通过向量量子化技术,将内存使用量降低至原来的六分之一。详细内容预计将在2026年4月23日召开的国际学习表征会议(ICLR 2026)上公布。 当前的人工智能技术通过向量来理解和处理语言、图像等信息。虽然向量技术强大,但它们会消耗大量内存。为了让计算机无需低速搜索庞大数据库
AI资讯DeepSeek正处于首轮风险投资融资谈判中,短短几周内,其潜在估值已从200亿美元飙升至450亿美元,《金融时报》和彭博社报道。 这家中国人工智能实验室于2025年初崭露头角,推出了一款大型语言模型,该模型在计算资源和成本上仅为美国大型模型(如OpenAI和Anthropic)的部分,表现出色。此后,DeepSeek在推理和编程等领域与全球顶尖模型保持合理的竞争速度,同时其模型权重保持开放,版本
AI资讯EY战略与咨询推出针对生成式AI安全风险的端到端红队测试服务,帮助企业识别和应对特有威胁。