成功可信度高

软件与互联网 · 算力基础设施与AI平台 / 流程自动化

MiniMax基于MaxCompute构建高效低成本的Data+AI大模型数据预处理平台

MiniMax采用阿里云MaxCompute和MaxFrame,构建了全托管Data+AI平台,实现大模型数据预处理弹性扩展,资源利用率提升30%,运维成本降低50%。

MiniMax发布于 2026年7月27日阅读 0

业务效果

高峰时段支持数十万核计算资源快速弹性扩展

未披露

业务效果

计算资源利用率提升30%

未披露

业务效果

运维资源投入减少50%

未披露

01

业务背景

MiniMax是一家全球通用人工智能科技公司,自2022年成立以来,致力于推动AGI发展,自研了多模态通用大模型,服务全球超200个国家的1.57亿个人用户和5万企业客户。

02

遇到的问题

大模型训练依赖大规模数据预处理,面临三大挑战:资源弹性瓶颈,传统架构无法兼顾弹性、时效和成本;预处理算子性能不足,常出现内存溢出、任务失败等问题;缺乏统一任务管理,开发依赖Python脚本,可视化运维能力弱,人力投入大。

03

AI 解决方案

基于阿里云MaxCompute构建全托管Data+AI平台,引入MaxFrame分布式计算框架。MaxFrame兼容Python生态,提供分布式算子(如Minhash),支持离线推理和自定义镜像,实现结构化与非结构化数据的统一管理和弹性伸缩预处理。采用包月固定资源加按需弹性组合模式,结合冷热分层存储策略。

  1. 1使用MaxCompute搭建云原生数据仓库作为核心存储和计算底座
  2. 2部署MaxFrame分布式框架,统一Python开发生态并对接MaxCompute资源
  3. 3迁移原有数据预处理任务,利用MaxFrame的分布式算子优化Minhash等任务
  4. 4配置包月固定资源加按需弹性策略,实施冷热分层存储策略
  5. 5整合开发、调度、运维流程,实现全托管PaaS闭环管理

04

实施结果

业务效果高峰时段支持数十万核计算资源快速弹性扩展

业务效果计算资源利用率提升30%

业务效果运维资源投入减少50%

业务效果历史数据存储成本降低40%

业务效果大模型数据预处理任务耗时缩短,FastText文本分类推理效率显著提升

05

风险与边界

平台高度依赖阿里云生态,跨云迁移可能面临兼容性问题;分布式框架的引入需要团队具备一定的Python和分布式系统开发能力。

编辑点评 · AI 辅助生成并经审核

MiniMax案例展示了如何利用云原生数仓和分布式计算框架,高效解决大模型数据预处理中的弹性、性能和运维难题,为大模型企业提供了可复用的工程范式。

适合

需要进行大规模数据预处理的大模型训练企业追求云原生Data+AI一体化的科技公司

前置条件

拥有PB级数据预处理需求团队熟悉Python和分布式计算概念

信息来源

1 个来源

页面内容为结构化改写;关键结论应可追溯到以下材料。

继续阅读

相关案例

更多软件与互联网案例
价值极高
部分达成可信度中

软件与互联网 · 企业知识库 · 2025

星环科技:AI 基础软件矩阵(TDH/Sophon LLMOps/向量库)落地金融能源政务,25Q4 营收提速

星环科技打造大数据与 AI 基础软件矩阵,涵盖 TDH 大数据平台、Sophon LLMOps 大模型运营工具、向量数据库 Hippo、知识平台 TKH。25Q4 营收 1.9-2.2 亿元、同比 +20.4%~38.9%(显著高于前三季度 7.4%),反映 AI 基础软件旺盛需求;基于海光 CPU 的 ArgoDB 联合方案在金融、能源、政务多行业落地并创 TPC-DS 性能纪录,受益于信息系统国产替代。

星环科技 · medium

更新于 2026年7月

价值中
成功可信度高

软件与互联网 · 算力基础设施与AI平台 · 2025

谷歌:自研 TPU Ironwood 推理成本较 GPU 低 30-40%,ASIC 规模化降本成基建标配

谷歌以自研 ASIC 重构 AI 算力成本。第五代 TPU Ironwood 通过架构优化形成 1.77 PB HBM3e 共享内存池与 42.5 Exaflops FP8 算力,内部实测同等负载下推理成本较 GPU 旗舰系统低 30%-40%;第五代 TPU、亚马逊 Trainium2 的单位算力成本已分别降至英伟达 H100 的 70%、60%,推动 ASIC 从可选项变为大规模应用的刚性需求。

谷歌(Google) · giant

更新于 2026年7月

价值高
成功可信度高

软件与互联网 · Agent · 2025

DeepSeek:全开源模型矩阵(价格约竞品 1/30)+ 国产芯片 day0 适配,V4 编程领先

DeepSeek 以全系列开源大模型构建高性价比 AI 生态:R1 价格约为 OpenAI o1 的 1/30,V2 价格约为 GPT-4 Turbo 的 1/70;V3.2-Exp 发布当日即实现寒武纪、华为昇腾 day0 适配,并大幅降价(API 超 50%)。据媒体报道,有望于 2 月发布的 V4 编程能力超过 Claude 与 GPT 系列。其自研 TileLang 将 CUDA/C++ 算子代码从 500 余行压缩至约 80 行、性能提升约 30%,推动国产软硬件生态去英伟达化。

DeepSeek(深度求索) · large

更新于 2026年7月