#GPU加速

按标签聚合查看文章内容。

AWS与NVIDIA扩大战略合作 应对AI基础设施需求激增AI资讯

AWS与NVIDIA扩大战略合作 应对AI基础设施需求激增

亚马逊云服务(Amazon Web Services,简称AWS)与美国NVIDIA公司于8月26日宣布,将进一步扩大双方的战略合作。此次合作扩展旨在应对全球范围内对人工智能基础设施需求的快速增长。 双方计划在AWS全球基础设施中新增200万个NVIDIA GPU,以加强在AI工厂、CPU、开源模型和机器人技术等领域的合作。 随着AI工作负载的迅速扩展,市场对更多样化的模型选择、更高速的数据管道

8GB显存也能高速运行35B参数模型!专为MoE设计的AI执行环境“FreeToken”AI资讯

8GB显存也能高速运行35B参数模型!专为MoE设计的AI执行环境“FreeToken”

许多用户可能遇到过这样的困扰:“模型本可以放入主内存,但显卡的显存不足,导致运行缓慢甚至无法使用。”针对这一问题,日本推出了免费的AI模型执行环境“FreeToken”,目前可从官方网站免费下载,采用Apache 2.0开源许可。 FreeToken专注于MoE(专家混合模型,Mixture-of-Experts)模型的高效运行。MoE模型只激活部分参数进行计算,因此实际占用的显存远低于模型总参

AMD的AI战略:重点降低从竞争对手环境迁移的成本AI资讯

AMD的AI战略:重点降低从竞争对手环境迁移的成本

日本AMD于7月1日举办了关于AMD Instinct和ROCm的媒体圆桌会议,商业销售总部销售工程经理大原久树介绍了最新动态。 大原表示,AMD的AI战略不仅关注总拥有成本(TCO)的降低,更重视减少从NVIDIA等竞争对手环境迁移所带来的成本和复杂度。 在硬件方面,AMD支持符合OCP标准的机架,并积极参与Ultra Ethernet等标准化工作;在软件方面,提供完全开源的ROCm开发环境,

HBM价格飙升的解决方案?日本国家铠侠推出1000万IOPS直连GPU的高速SSD“GP1”AI资讯

HBM价格飙升的解决方案?日本国家铠侠推出1000万IOPS直连GPU的高速SSD“GP1”

在GPU进行AI处理时,大容量且高速的内存是必不可少的。然而,与GPU配套使用的HBM(高带宽内存)容量有限,且内存价格飙升、供需紧张的问题日益严重。为了解决这一难题,日本国家铠侠(KIOXIA)于8月4日发布了面向AI应用的超高速SSD产品——“KIOXIA GP1”系列。 KIOXIA GP1系列被该公司称为“超级高IOPS SSD”。其最大特点包括支持GPU的直接访问,随机读取性能高达10

缩小浏览器窗口竟能提升AI图像生成速度最高达40%?Windows环境下的奇特现象AI资讯

缩小浏览器窗口竟能提升AI图像生成速度最高达40%?Windows环境下的奇特现象

近日,Reddit论坛上出现了一则引人关注的报告:Web浏览器窗口大小竟然会影响Stable Diffusion的运行速度。 该报告由论坛用户RaspberryOk4750发布。根据他的测试,Stable Diffusion(主要使用Illustrious检查点和Forge Neo组合)在浏览器窗口最大化或全屏运行时,性能相比于在较小窗口中运行时,速度降低了20%至40%。类似的速度下降现象在C

Adobe与NVIDIA合作,利用RTX技术实现Premiere AI处理速度提升两倍AI资讯

Adobe与NVIDIA合作,利用RTX技术实现Premiere AI处理速度提升两倍

日本国家Adobe宣布,将通过NVIDIA RTX Spark的软件支持,扩大双方的合作关系。此次合作重点是提升其创作者工具Creative Cloud中的两款主力应用——Premiere和Photoshop的GPU加速功能。 同时,双方还将在代理型AI领域展开合作,推动今年4月Adobe发布的面向创作者的代理型AI“Creative Agent”在Premiere和Photoshop中的应用。