成功可信度高

软件与互联网 · 算力基础设施与AI平台 / 智能运维与巡检

MiniMax基于MaxCompute构建弹性高效的Data+AI大模型数据预处理平台

MiniMax利用阿里云MaxCompute及MaxFrame框架,构建了云原生数据仓库为核心的Data+AI一体化平台,实现大模型数据预处理的高效弹性与成本优化,支撑全球业务扩张。

MiniMax发布于 2026年8月8日阅读 0

业务效果

高峰时段支持数十万核计算资源快速弹性扩展

未披露

业务效果

计算资源利用率提升30%

未披露

业务效果

运维资源投入减少50%

未披露

01

业务背景

MiniMax成立于2022年,是一家致力于实现AGI的通用人工智能公司,自主研发了文本、音频、图像、视频等多模态大模型。随着全球用户超1.57亿、企业客户超5万,其业务快速增长,对大规模数据处理能力提出更高要求。

02

遇到的问题

大模型训练需频繁对PB级数据进行短时高效预处理,传统架构难以兼顾弹性、时效与成本;数据预处理时遇到文件大、内存溢出、MinHash去重失败等问题,作业稳定性差;原有Python开发流程缺少可视化管理和调度,开发效率低;自研数据预处理需耗费大量人力,影响核心AI创新。

03

AI 解决方案

MiniMax基于阿里云MaxCompute构建全托管Data+AI平台,采用MaxFrame分布式计算框架,统一Python生态,提供分布式算子(如Pandas、MinHash),支持多模态数据预处理和离线推理,实现计算资源包月+弹性组合,并利用冷热分层存储降低成本。

  1. 1在MaxCompute上搭建统一数据处理平台,集成MaxFrame计算框架。
  2. 2迁移现有Python预处理任务至MaxFrame,适配分布式环境。
  3. 3利用弹性资源应对高峰大规模计算需求,按需扩展和释放。
  4. 4实施存储冷热分层策略,优化历史数据存储成本。
  5. 5将文本分类等推理任务部署至MaxCompute,利用CPU弹性执行。
  6. 6建立统一的开发、调度、运维闭环,提升团队效率。

04

实施结果

业务效果高峰时段支持数十万核计算资源快速弹性扩展

业务效果计算资源利用率提升30%

业务效果运维资源投入减少50%

业务效果历史数据存储成本降低40%

业务效果缩短大模型数据预处理任务耗时

业务效果构建了国内外一体化的Data+AI处理平台

05

风险与边界

依赖特定云厂商生态,迁移其他平台可能面临兼容性成本;分布式框架对团队技术能力要求高;数据安全与合规需持续关注。

编辑点评 · AI 辅助生成并经审核

该案例展示了云原生数仓与AI结合的实践路径,通过分布式计算框架改造数据处理流程,实现降本增效。适合快速迭代的大模型企业参考。

适合

拥有大规模数据处理需求的大模型企业需要弹性计算资源的AI初创公司希望优化数据预处理效率的科技型公司

前置条件

具备一定的Python开发能力熟悉分布式计算概念有云上数据处理基础

信息来源

1 个来源

页面内容为结构化改写;关键结论应可追溯到以下材料。

继续阅读

相关案例

更多软件与互联网案例
价值极高
部分达成可信度中

软件与互联网 · 企业知识库 · 2025

星环科技:AI 基础软件矩阵(TDH/Sophon LLMOps/向量库)落地金融能源政务,25Q4 营收提速

星环科技打造大数据与 AI 基础软件矩阵,涵盖 TDH 大数据平台、Sophon LLMOps 大模型运营工具、向量数据库 Hippo、知识平台 TKH。25Q4 营收 1.9-2.2 亿元、同比 +20.4%~38.9%(显著高于前三季度 7.4%),反映 AI 基础软件旺盛需求;基于海光 CPU 的 ArgoDB 联合方案在金融、能源、政务多行业落地并创 TPC-DS 性能纪录,受益于信息系统国产替代。

星环科技 · medium

更新于 2026年7月

价值中
成功可信度高

软件与互联网 · 算力基础设施与AI平台 · 2025

谷歌:自研 TPU Ironwood 推理成本较 GPU 低 30-40%,ASIC 规模化降本成基建标配

谷歌以自研 ASIC 重构 AI 算力成本。第五代 TPU Ironwood 通过架构优化形成 1.77 PB HBM3e 共享内存池与 42.5 Exaflops FP8 算力,内部实测同等负载下推理成本较 GPU 旗舰系统低 30%-40%;第五代 TPU、亚马逊 Trainium2 的单位算力成本已分别降至英伟达 H100 的 70%、60%,推动 ASIC 从可选项变为大规模应用的刚性需求。

谷歌(Google) · giant

更新于 2026年7月

价值高
成功可信度高

软件与互联网 · Agent · 2025

DeepSeek:全开源模型矩阵(价格约竞品 1/30)+ 国产芯片 day0 适配,V4 编程领先

DeepSeek 以全系列开源大模型构建高性价比 AI 生态:R1 价格约为 OpenAI o1 的 1/30,V2 价格约为 GPT-4 Turbo 的 1/70;V3.2-Exp 发布当日即实现寒武纪、华为昇腾 day0 适配,并大幅降价(API 超 50%)。据媒体报道,有望于 2 月发布的 V4 编程能力超过 Claude 与 GPT 系列。其自研 TileLang 将 CUDA/C++ 算子代码从 500 余行压缩至约 80 行、性能提升约 30%,推动国产软硬件生态去英伟达化。

DeepSeek(深度求索) · large

更新于 2026年7月