为AI数据全链路闭环管道打造的高性能数据平台

在本地、云、混合或多云环境中,支持无缝访问、管理和运行您的人工智能和数据分析工作负载

为什么选择 Alluxio

Alluxio位于计算和存储之间,为企业提供统一的视图,

使其能够轻松地跨多个基础架构环境管理AI和数据分析工作负载。

Alluxio 数据平台有两种产品 – Alluxio Enterprise AI Alluxio Enterprise Data。

您可根据工作负载需求选择相应的产品,

享受Alluxio带来的巨大优势:卓越的性能、无缝数据访问、简化数据工程并节约成本。

卓越的性能

可将模型训练速度提高 20 倍

将模型服务速度提高 10 倍

最大化基础设施投资回报率

搭建在现有数据湖之上

90% + GPU 利用率

无缝数据访问

消除数据副本

随时随地无缝访问数据

SLACK社区成员超过
0
全球排名前10的互联网公司有9家在使用
0
GITHUB贡献者超过
+ 0
平均每月下载量超过
+ 0

数据分析和AI基础设施面临的挑战

数据分散在位于不同地理位置的存储系统和云上

数据往往远离应用程序,导致性能低下。复制数据会进一步增加数据工程复杂性和成本。

管理不同的技术栈既昂贵又复杂

每当引入新的存储时,应用开发人员都可能需要重写应用程序,来匹配新的存储协议。大量存储选项需要太多的人力来维护和操作。用户体验差,导致用户对数据平台团队的不满增加。

云和网络成本难以管理和预估

每当数据从一个存储复制到另一个存储时,都会产生成本。API 成本和流量成本会随着时间的推移而增加,而且难以预估。

数据基础设施无法满足AI的需求

数据基础设施的构建不能满足AI工作负载的要求。数据平台团队需要升级数据基础设施,并引入昂贵的硬件,如高性能计算或专用存储。

GPU 稀缺且往往利用率不高

GPU 供不应求,训练通常在GPU可用时进行。当训练数据集远离 GPU 集群时,数据加载速度会非常慢,从而浪费 GPU周期。而复制数据会导致数据工程复杂性的问题。

数据访问缓慢,模型处于饥饿状态

模型通常需要根据不同的协议从多个数据源获取数据。因此,数据往往离模型较远,造成 I/O 瓶颈。对海量小文件进行元数据操作也会导致性能低下,进而使训练流程停滞不前。

热衷于走在技术前沿并构建创新产品

成为云中AI/ML和分析工作负载的数据编排层

解锁跨云AI的算力瓶颈
解锁跨云AI的算力瓶颈
在构建大规模 AI 的今天,多云已成常态。无论是为了避免被单一云厂商绑定,还是为了获取稀缺的 GPU 资源,AI 团队都在多云环境中运作。这意味着,他们时常面临这样的场景:“我们需要...
查看更多 →
Anyscale-Ray
Alluxio + Anyscale Ray框架,实现跨区域训练数据读取速度20倍提升
当 AI 训练数据存储在某个云区域,而 GPU 集群部署在另一个云区域时,每一轮 epoch 训练迭代都会给跨区域网络传输带来可观开销。于是,我们利用算力侧的 NVMe...
查看更多 →
智加科技
重卡自动驾驶数据引擎升级,智加科技凭借Alluxio实现训练吞吐10倍跃迁
在 L4 重卡自动驾驶量产前夜,数据规模决定算法迭代速度,数据吞吐定义研发竞争力。一辆自动驾驶重卡日均产生 TB 级传感器数据,PB 级数据湖成为标配,多云混合架构成为行业常态。但算力持续增长,数据却在...
查看更多 →
robotaxi
造父智能(哈啰robotaxi)在阿里云环境下构建极致透明的训练加速层
存算分离的阿里云环境下,自动驾驶模型训练面临 OSS 数据访问延迟高、GPU 利用率不足的普遍挑战。造父智能(哈啰robotaxi)基于 Alluxio 构建了一套对用户完全透明的训练数据加速层:平台自动完成...
查看更多 →
3
Alluxio AI 3.9 正式发布:为任意 AI 训练框架提供 checkpoint 加速能力
大规模训练中被忽视的 checkpoint 隐性成本 如今,分布式训练的大量时间并非用于模型迭代,而是消耗在 checkpoint 的写入与等待上。 每个 checkpoint...
查看更多 →
九识智能
从 PFS 带宽瓶颈到分布式缓存的演进——Alluxio在九识智能仿真云端调度中的应用
本文分享九识智能在这一演进过程中的实际路径:如何用 Alluxio 替代 PFS 和自研缓存,将 IO 带宽从 30GB/s 突破到 100GB/s 以上,同时降低架构复杂度。
查看更多 →

客户评价 & 重要奖项

与超过300+知名机构共同成长

全球不同行业的领军企业都在使用Alluxio

互联网

云服务
提供商

综合行业

电子商务

金融服务业

电信媒体

更多行业