

9月27日,全球首创的开源数据编排软件开发商Alluxio与北京大学计算机学院举行产学研合作框架协议签约仪式。北京大学计算机学院刘譞哲研究员、金鑫研究员、马郓研究员,Alluxio创始人兼CEO李浩源、Chief of Staff 吕薇、中国区市场负责人沙鹏、中国区社区运营负责人王添钰出席了本次仪式

9月16日,由中国信息通信研究院与中国通信标准化协会联合主办的“2022 OSCAR 开源产业大会”在北京召开。Alluxio创始人兼CEO李浩源,凭借在全球开源领域的持续创新与探索,被授予「OSCAR尖峰开源人物奖」。 OSCAR是业界首个专注于云计算领域的开源产业联盟,“OSCAR尖峰开源人物”

美国艺电 (EA) 是游戏行业的翘楚,每年为全球几十亿用户提供数十款游戏。能否针对EA的在线服务做出近实时决策对于业务发展至关重要。本文介绍了在AWS上搭建的基于Presto和Alluxio的数据平台,如何为游戏产业提供即时响应的在线服务。 EA的数据与人工智能部门搭建了数百个平台,来管理游戏和用户

主要从技术的角度,对跨地域的数据联邦,或者说总公司和分公司不同数据域的互联互通进行讨论,研究相关技术可行性与分享整个研究过程。

英特尔公布 AI 百佳创新激励计划第七期创新团队名单,Alluxio凭借在AI模型训练优化方面高效的数据平台架构,成为17家AI智慧创新型入选企业之一。

Alluxio与Spark联合部署实现一个可扩展、敏捷和经济有效的方案,打造现代化的数据平台。 本文提供了Spark + Alluxio这个技术栈/解决方案的概述,你将会了解到系统架构、实践案例和性能及成本基准测试的结果。

Alluxio 与 Spark 是来自加州大学伯克利分校 AMP 实验室的姊妹项目。为了提升性能和简化数据管理,许多企业如中国联通、BOSS直聘、WeRide文远知行、去哪儿等将Alluxio 与 Spark 部署在一起。

随着我们在Iceberg的一些改造,元数据文件也逐渐增大。同时为了降低新增索引文件的读取开销以及Hadoop集群抖动等因素对文件读取的影响,我们引入了Alluxio。

通过这篇文章,我们希望可以对经济化数据存储策略做一个初步探索,首先我们将具象化两个关键特性,然后通过几组实验对技术可行性进行一个讨论。

Shuttle 是OPPO大数据团队开源的高可用高性能的 Spark Remote Shuffle Service,文中详细介绍了Shuttle的架构和设计理念。

人工智能(AI)和机器学习工作负载依赖大型数据集,并且对数据吞吐量有较高的要求,两者都可以通过优化数据工作流来实现。 当进行AI模型训练时,我们需要高效的数据平台架构来快速生成分析结果,而模型训练在很大程度上依赖于大型数据集。执行所有模型训练的第一步都是将训练数据从存储输送到计算引擎的集群,而数据工

Raft是一套基于多副本状态机(Replicated State Machine)实现高可用(HA)和容错的算法。本文介绍了Alluxio的日志系统如何从Zookeeper演进到内置Raft算法来实现高可用(HA)的过程。
京公网安备 11010802040260号