

人工智能(AI)和机器学习工作负载依赖大型数据集,并且对数据吞吐量有较高的要求,两者都可以通过优化数据工作流来实现。 当进行AI模型训练时,我们需要高效的数据平台架构来快速生成分析结果,而模型训练在很大程度上依赖于大型数据集。执行所有模型训练的第一步都是将训练数据从存储输送到计算引擎的集群,而数据工

Raft是一套基于多副本状态机(Replicated State Machine)实现高可用(HA)和容错的算法。本文介绍了Alluxio的日志系统如何从Zookeeper演进到内置Raft算法来实现高可用(HA)的过程。

介绍如何解决金融场景落地腾讯 Alluxio (DOP=Data Orchestration Platform 数据编排平台过程中遇到的各种问题。

增强S3 API,企业级安全功能重大更新,提高数据迁移易用性、成本更低。

全球首创的开源数据编排软件开发商Alluxio宣布正式发布数据编排平台2.8版本,新版本立即可用。

了解像BOSS直聘、知名对冲基金等成功案例,基于解决方案应用的性能基准测试和成本节约测算,以及关于新手的部署引导。

为了帮助大家在我们社区玩得开心同时玩有所得,我们特意制定了【开源社区贡献积分奖励计划】,丰厚奖品等着你!

本文将介绍 Raptor 的历史,以及为什么 Meta 最终替换了它,转而采用基于本地缓存的新架构 RaptorX。

顾荣老师会给大家介绍Fluid开源项目的发展背景,主要技术架构与概念,典型应用场景案例,以及关于Fluid开源项目未来发展的讨论。

本文介绍了一种可用于软亲和调度的新哈希算法——一致性哈希。

金山云团队在交互查询场景下对presto与Alluxio相结合进行了测试,并总结了一些Presto搭配Alluxio使用的建议。

联通核心业务如何基于Alluxio构建数据分析平台,在不同时期通过缓存加速与数据编排能力,应对系统扩展性提升、系统性能优化、复杂环境整合、与多场景融合等领域的挑战。
京公网安备 11010802040260号