移动端


当前位置:兴旺宝>资讯首页> 产品新闻

高通技术公司发布AI200和AI250,重新定义AI时代机架级数据中心推理性能

2025-10-30 08:33:44来源:“高通中国”微信公众号 阅读量:17375 评论

分享:

  高通技术公司今日宣布,推出面向数据中心的下一代AI推理优化解决方案:基于Qualcomm AI200与AI250芯片的加速卡及机架系统。依托公司在NPU技术领域的优势,这些解决方案提供机架级性能与卓越的内存容量,能够以出色的每美元每瓦特的高性能赋能高速生成式AI推理,为推动各行业可扩展、高效率、高灵活性的生成式AI部署树立重要里程碑。
 
  
       Qualcomm AI200带来专为机架级AI推理打造的解决方案,旨在为大语言模型(LLM)与多模态模型(LMM)推理及其他AI工作负载提供低总体拥有成本与优化性能。每张加速卡支持768GB LPDDR内存,实现更高内存容量与更低成本,为AI推理提供卓越的扩展性与灵活性。
 
  Qualcomm AI250解决方案将首发基于近存计算(Near-Memory Computing)的创新内存架构,实现超过10倍的有效内存带宽提升并显著降低功耗,为AI推理工作负载带来能效与性能的跨越性提升。该架构支持解耦式AI推理,实现硬件资源的高效利用,同时满足客户性能与成本需求。
 
  两款机架解决方案均支持直接液冷散热,以提升散热效率,支持PCIe纵向扩展与以太网横向扩展,并具备机密计算,保障AI工作负载的安全性,整机架功耗为160千瓦。
 
    
       高通技术公司高级副总裁兼技术规划、边缘解决方案和数据中心业务总经理马德嘉(Durga Malladi)表示:
 
  凭借Qualcomm AI200与AI250,我们正在重新定义机架级AI推理的可能性。这些创新的AI基础设施解决方案能够让客户以业界先进的总体拥有成本部署生成式AI,同时满足现代数据中心对灵活性与安全性的要求。我们拥有丰富的软件栈与开放生态支持,能够支持开发者和企业更加轻松地基于我们的优化AI推理解决方案,集成、管理并扩展完成训练的AI模型。基于与主流AI框架的无缝兼容性和一键模型部署功能,Qualcomm AI200与AI250旨在支持无缝应用与快速创新。
 
  我们的超大规模级AI软件栈,覆盖从应用层到系统软件层的全链路,专为AI推理优化。该软件栈支持主流机器学习(ML)框架、推理引擎、生成式AI框架,以及解耦服务等LLM/LMM推理优化技术。开发者可通过高通技术公司的高效Transformer库(Efficient Transformers Library)与 Qualcomm® AI Inference Suite,实现模型无缝接入及Hugging Face模型的一键部署。我们的软件提供开箱即用的AI应用与智能体、完善工具、库、API接口及AI运营化服务。
 
  Qualcomm AI200与AI250预计将分别于2026年和2027年实现商用。未来,高通技术公司将致力于按照年度迭代节奏,持续推进公司数据中心产品技术路线图,聚焦业界先进的AI推理性能、能效与总体拥有成本优势。
版权与免责声明:1.凡本网注明“来源:兴旺宝装备总站”的所有作品,均为浙江兴旺宝明通网络有限公司-兴旺宝合法拥有版权或有权使用的作品,未经本网授权不得转载、摘编或利用其它方式使用上述作品。已经本网授权使用作品的,应在授权范围内使用,并注明“来源:兴旺宝装备总站”。违反上述声明者,本网将追究其相关法律责任。 2.本网转载并注明自其它来源(非兴旺宝装备总站)的作品,目的在于传递更多信息,并不代表本网赞同其观点或和对其真实性负责,不承担此类作品侵权行为的直接责任及连带责任。其他媒体、网站或个人从本网转载时,必须保留本网注明的作品第一来源,并自负版权等法律责任。 3.如涉及作品内容、版权等问题,请在作品发表之日起一周内与本网联系,否则视为放弃相关权利。
我来评论

验证码

文明上网,理性发言。(您还可以输入200个字符)

所有评论仅代表网友意见,与本站立场无关

    相关新闻