Hehson科技讯 9月9日晚间消息,在GPUStack AI Infra生态与技术创新大会上,GPUStack CEO秦小康指出,国产GPU和模型生态快速发展的同时,兼容适配、性能调优、版本迭代等环节仍较为复杂。GPUStack希望与合作伙伴、社区用户和开发者共同努力,让国产算力变得更加简单易用,并通过持续优化释放每一块GPU的性能与价值。
据悉,自2024年开源以来,目前GPUStack已服务全球121个国家和地区的超过11万用户,形成了广泛的全球用户基础,也为国产算力适配、模型部署和产品迭代积累了丰富的真实场景验证。秦小康认为,AI基础设施涉及芯片、服务器、存储、模型和应用等多个环节,一家公司不可能包揽所有能力。GPUStack将聚焦自身擅长的方向,同时与产业伙伴共同完善产品和解决方案,让复杂的算力适配与平台建设变得更加简单。
GPUStack联合创始人、CTO梁胜结合全球GPU产业演进进一步指出,GPU市场的竞争从来不只是硬件性能的竞争,成熟的GPU生态背后,是一套贯穿底层计算、网络和存储,并延伸至模型推理与服务交付的完整软件体系。随着国产GPU不断提升产能、质量和性能,软件栈能否同步成熟,将直接影响其规模化应用和全球市场拓展。GPUStack希望通过开放的软件平台,将繁琐的部署和调优过程沉淀为标准化能力。
大会期间,GPUStack分别与帝欧水华集团、亚信科技、容芯致远和XSKY签署战略合作协议,进一步深化AI基础设施产业链协同。
在算力供给与运营侧,GPUStack与帝欧水华集团围绕算力建设、算力租赁和模型API服务展开合作,共同完善“水华Do.top”在线算力服务平台,推动算力资源向标准化服务转化。
面向企业级AI平台建设,GPUStack与亚信科技将异构算力管理、模型部署、服务运营和计量计费等能力进行整合,提升企业AI基础设施的运营与规模化交付能力。
为进一步向智算硬件延伸,GPUStack将作为AIOS集成到容芯致远AGC智算设备中,打通硬件设备、算力调度与模型服务,为企业提供更加便捷的软硬一体化部署方案。
在推理加速环节,GPUStack与XSKY围绕共享KV Cache展开合作。通过集成XSKY MeshFusion,双方将进一步提升长上下文、多轮对话和智能体等场景下的推理效率。
四项战略合作连接了算力供给、平台运营、智算硬件和数据存储等关键能力,是GPUStack生态聚合能力的一次集中体现,也标志着其与产业伙伴的合作正从产品适配走向联合方案与深度共建。(文猛)
下一篇:韩国8月同比新增就业18.4万人