【CNMO科技动静】AI数据基础举措措施公司Weka与高机能计较平台Andromeda近日公布告竣战略互助,Weka的NeuralMesh平台将作为Andromeda治理型GPU集群的焦点AI数据存储层。经由过程专用NeuralMesh或者GPU原生方式的NeuralMesh Axon部署,Andromeda的客户可于差别超年夜范围计较办事商及AI云情况中得到一致的存储机能。
图源收集
Andromeda致力在闪开发前沿技能的所有团队都能获取高机能计较资源,使立异由设法自己而非硬件可和性驱动。该公司与重要AI研究机构、数据中央及云办事提供商互助,于全世界供给链中分配练习及推理事情负载。今朝Andromeda已经与全世界50余家计较提供商成立互助,经由过程不停增加的治理型集群收集路由练习及推理事情负载。
Andromeda平台上的所有集群不管由哪家运营商治理,都必需满意不异的质量尺度。公司于向客户提供办事前,会对于每一个集群的GPU、存储、收集架谈判安全举行认证。于此历程中,差别供给商的存储情况差异致使集群间机能乱七八糟的问题逐渐闪现。
经由过程与Weka互助,Andromeda于现有硬件上实现了显著的机能晋升,可于几分钟内完成部署,确保所有供给商的一致性,同时降低存储成本。Andromeda首席履行官威尔·穆谢暗示,公司的方针是实现计较的全世界流动,这象征着提供的每一个集群不管容量来自那边都必需正常运行。经由过程Weka NeuralMesh实现尺度化后,客户于决议机能的存储及内存层同时得到了超年夜范围办事商级另外一致性及开放市场的矫捷性。他增补道,闲置的GPU正于拦阻AI立异的速率,Weka帮忙Andromeda治理的所有GPU都能充实阐扬作用。
NeuralMesh Axon是NeuralMesh软件平台的GPU原生部署方式,将存储直接集成到Andromeda的GPU办事器中,经由过程将集群现有的NVMe转换为同一的高机能数据层,以最高速率为练习及推理供给数据。因为该基础举措措施已经安装于机架中并通电运行,成本也已经付出,是以可于不增长分外空间、电力耗损及用度的环境下仅晋升机能。
借助NeuralMesh Kubernetes Operator,Andromeda可于几分钟内构建完备的NeuralMesh集群,并经由过程治理仓库其他所有层的不异事情流治理整个集群收集。Andromeda的NeuralMesh部署中约一半采用NeuralMesh Axon方式运营,另外一半则为需要将所有GPU焦点及每一GB内存专用在自身事情负载的客户提供专用NeuralMesh部署。不管部署位置怎样,NeuralMesh都能为底层任何供给商的硬件提供不异的机能尺度。这类靠得住性使Andromeda可以或许将客户接入此前没有同享存储的集群。
互助带来的现实效果已经经闪现。新的NeuralMesh Axon集群可于最短10分钟内完成部署,AI团队从集群上线当天便可运行事情负载。情况启动加载时间从3分钟缩短至30秒,使AI团队天天可以或许举行更多试验。采用NeuralMesh Axon运营的Andromeda集群实现了每一集群每一秒跨越400GB的连续吞吐量及现实运营情况中每一秒跨越600万IOPS的机能。患上益在此,Andromeda的一家生物技能客户可于几分钟而非几小时内完成触及每一目次10亿文件的元数据密集型传输使命。当集群存于妨碍扩散危害时,NeuralMesh可以或许阻断妨碍流传,维持集群可用性,掩护所有客户的事情负载。
版权所有,未经许可不患上转载
-彩神vll