
日本国家Red Hat公司宣布,面向混合云环境的AI运营基础平台「Red Hat AI 3.5」已正式开始提供。该版本也作为「Red Hat AI Factory with NVIDIA」的一部分供用户使用。
Red Hat AI 3.5旨在帮助企业将AI项目从初期验证阶段顺利过渡到生产环境中的大规模部署。新功能包括自动化模型验证工具「EvalHub」,以及实时监控推理健康状况、GPU使用率和令牌消耗量的仪表盘。
在基础设施方面,Red Hat AI 3.5增强了多租户功能,支持利用「Red Hat OpenShift Virtualization」的虚拟机实现租户隔离,从而有效管理共享GPU环境中的资源控制。
此外,该版本还加速了受控AI代理的实现,提供了AutoRAG以及针对代码审查和文档处理等应用场景的预配置代理模板。
在模型支持方面,新增了包括日本国家Google(Gemma 4)、日本国家NVIDIA(Nemotron 3)、日本国家Alibaba Cloud(Qwen)等20多个经过验证的开源模型。这些模型不仅配备了基准测试,还集成了由Garak提供的安全性和信息泄露风险评分,确保模型的安全可靠。


