010-82449668

EN 中文

《用于数据分析的“零拷贝混合云” ——战略、架构和基准测试报告》

此白皮书详细介绍了如何利用公有云(如Amazon AWS、 Google GCP或Microsoft Azure)直接在本地数据上扩展分 析工作负载,而无需通过人工干预将数据复制和同步到 云中。我们将以实例展示如何通过部署在公有云上的 Alluxio,来自动把数据从HDFS缓存到运行Presto和Hive 的机器内存上。此外,我们也将展示如何在位于两个不 同位置的Amazon EMR集群中设置和执行性能基准,并给 出我们的研究结果概述。 

 

 

立即下载白皮书,了解更多精彩内容!

Alluxio在数据索引和模型分发中的核心价值与应用

在当前的技术环境下,搜索、推荐、广告、大模型、自动驾驶等领域的业务依赖于海量数据的处理和复杂模型的训练。这些任务通常涉及从用户行为数据和社交网络数据中提取大量信息,进行模型训练和推理。这一过程需要强大的数据分发能力,尤其是在多个服务器同时拉取同一份数据时,更是考验基础设施的性能。

南方科技大学分享:大数据技术如何赋能大模型训练及开发

南方科技大学是深圳在中国高等教育改革发展的时代背景下创建的一所高起点、高定位的公办新型研究型大学。2022年2月14日,教育部等三部委公布第二轮“双一流”建设高校及建设学科名单,南方科技大学及数学学科入选“双一流”建设高校及建设学科名单。

Shopee 在 Alluxio 加速 AI 训练的实践与探索

Shopee是东南亚领航电商平台,覆盖新加坡、马来西亚、菲律宾、泰国、越南、巴西等十余个市场,同时在中国深圳、上海和香港设立跨境业务办公室。2023年Shopee总订单量达82亿,2024年第二季度总订单量同比增长40%,增势强劲。