AI资讯挑战英伟达霸主地位:Cohere发布开源轻量级语音识别模型Transcribe
Cohere于2026年3月26日推出了开源语音识别模型Cohere Transcribe,拥有20亿参数,专为边缘设备设计,解决大型语音模型带来的延迟问题。该模型支持14种语言,性能超越主流竞争对手,旨在通过开发者社区推动生态发展并实现商业化。
按标签聚合查看文章内容。
AI资讯Cohere于2026年3月26日推出了开源语音识别模型Cohere Transcribe,拥有20亿参数,专为边缘设备设计,解决大型语音模型带来的延迟问题。该模型支持14种语言,性能超越主流竞争对手,旨在通过开发者社区推动生态发展并实现商业化。
AI资讯2026年7月16日,日本NVIDIA宣布推出面向机器人技术和物理AI的AI模型“Cosmos 3 Edge”。 Cosmos 3 Edge是一款能够在设备端实现视觉推理和机器人策略部署的AI模型。它帮助机器人和视觉AI代理实时感知周围环境,进行即时推理,并自主决定下一步行动。该模型基于NVIDIA Nemotron架构,拥有40亿参数。 通过开放的NVIDIA Cosmos框架,开发者可以在仅
AI资讯尽管太空数据中心备受关注,但目前轨道上的GPU数量仍然非常有限。随着这一状况逐渐改变,轨道计算的近期商业模式开始逐步成型。 加拿大Kepler Communications于今年一月发射了目前轨道上最大的计算集群,该集群由10颗运行卫星组成,搭载约40颗Nvidia Orin边缘处理器,并通过激光通信链路相互连接。 Kepler目前拥有18家客户,最新合作伙伴是初创公司Sophia Space。S
AI资讯SDG&E、Qualcomm及加州大学圣地亚哥分校合作开发边缘AI系统,实时监测和预测山火及极端气象灾害。
AI资讯谷歌在印度举办的Google I/O India活动中推出了可在智能手机上运行的轻量级AI模型“Gemma 4 E2B for TPU”,支持离线隐私保护和多种边缘AI应用。
AI资讯日本互联网倡议株式会社(IIJ)、日本NTT数据株式会社及日本日比谷综合设备株式会社宣布,自6月起将共同开展模块化边缘数据中心的社会应用验证。 近年来,随着人工智能(AI)的广泛应用,计算需求和能耗急剧增加,支撑AI基础设施的数据中心供给不足问题日益突出。然而,由于城市区域及现有数据中心设施在液冷设备引入方面存在限制,亟需建设能够灵活容纳高发热、高密度IT设备的数字基础设施。 针对这一挑战,模块
AI资讯日本Liquid AI公司于2026年6月6日宣布推出两款面向日语的通用聊天模型和多模态语音文本模型,分别命名为「LFM2.5-1.2B-JP-202606」和「LFM2.5-Audio-1.5B-JP」。这两款模型采用LFM Open License v1.0授权,年收入低于1000万美元的企业可免费商用。 LFM2.5是基于多模态架构“Liquid Foundation Models”的最新
AI资讯美国思科公司(Cisco)于3月18日宣布,扩展其“NVIDIA安全AI工厂(Secure AI Factory with NVIDIA)”框架,旨在从集中式数据中心到本地数据生成和决策点,实现客户基础设施的全面AI部署。 此次扩展使企业、新兴云服务商、主权云及服务提供商能够无缝整合系统,快速将AI从试验阶段推向正式生产,显著缩短部署周期,从数月缩短至数周,并从初期即内置安全机制。 思科与NVID
据《华尔街日报》报道,尽管苹果在自主开发大型AI模型方面被认为落后于竞争对手,但凭借其强大的设备生态系统,预计到2026年,苹果的AI相关收入将超过10亿美元。 苹果并不需要拥有最强大的AI模型,只要iPhone掌握在用户手中,就能通过App Store的佣金获得收益: ChatGPT贡献最大:生成式AI应用的佣金收入中,约75%来自OpenAI的ChatGPT,其次是埃隆·马斯克的Grok,占比
AI资讯日本东海旅客铁道公司(JR东海)、Preferred Networks(PFN)和Actia三家公司签署了基本合作协议,计划在JR东海的业务区域内建设AI边缘数据中心,推动分布式AI基础设施的构建。 近年来,随着AI应用的普及,能够实时处理大数据的低延迟AI边缘数据中心的重要性日益凸显。 此次合作将结合JR东海集团拥有的东海道新干线沿线闲置土地和网络资源,PFN开发的国产AI半导体“MN-Cor
AI资讯IBM推出了专为边缘计算和企业应用优化的Granite4.01B语音模型,参数减半性能提升,支持多语言语音识别和双向翻译,新增日语识别及关键词偏置功能,显著提升英语转录准确率。
AI商业Sightline Intelligence 提供面向防务与无人系统的实时视频处理与AI目标识别方案,在边缘侧实现毫秒级检测、跟踪与分类,摆脱云端依赖与延迟风险。