成功可信度高

软件与互联网 · 算力基础设施与AI平台 / OCR / 文档识别

朗镜科技借助阿里云云原生AI套件升级商品识别平台

阿里云通过CPFS、DeepGPU和云原生AI套件,助力朗镜科技AI商品识别平台实现云原生架构升级,数据处理速度提升50%,GPU利用率提升30%,系统性能提升40%。

朗镜科技发布于 2026年8月8日阅读 0

业务效果

数据处理速度提升50%以上

未披露

业务效果

DeepGPU推理速度提升2倍(加速比1.12~4.60倍)

未披露

业务效果

GPU集群利用率提升30%

未披露

01

业务背景

朗镜科技(Trax中国)自2015年成立,专注于为零售业提供计算机视觉解决方案和数据分析服务,通过融合计算机视觉、机器学习和IoT技术,将传统货架转化为数字化货架,帮助品牌商实时掌握门店货架动态,加速零售数字化转型。

02

遇到的问题

朗镜科技每日需处理数百万张图片和海量SKU,商品图片识别量大;实体零售场景复杂多变,小文件处理能力需提升,下载延迟要求低;快消品新品迭代快,AI模型需高频更新,成本高昂。

03

AI 解决方案

阿里云提供高性能文件存储CPFS,优化数据写入方案,实现多机并行写入,降低小文件写入延迟;结合DeepGPU工具包,利用自研算子库加速多个计算机视觉模型推理;基于容器化架构,采用云原生AI套件,实现GPU共享调度和显存隔离,提升GPU集群利用率。

  1. 1优化图片预处理阶段的数据写入方案,采用CPFS并行文件写入
  2. 2集成DeepGPU工具包,加速模型推理性能
  3. 3构建云原生AI产品解决方案,实施GPU共享调度和显存隔离
  4. 4进行3个月的联合攻坚,完成系统整体优化与升级

04

实施结果

业务效果数据处理速度提升50%以上

业务效果DeepGPU推理速度提升2倍(加速比1.12~4.60倍)

业务效果GPU集群利用率提升30%

业务效果系统性能提升40%

业务效果小文件图片百毫秒以上写入延迟占比降至5%以内

业务效果满足97%以上高精度标准和95%以上识别流程10秒内完成

05

风险与边界

AI模型快速迭代对算力和存储提出持续挑战,需持续优化算法和基础设施。

编辑点评 · AI 辅助生成并经审核

该案例展示了如何通过云原生AI架构优化性能并降低成本,适合AI应用规模大、迭代快的企业借鉴。

适合

AI算力需求大的企业高频模型迭代的计算机视觉应用企业大规模图片处理场景的企业

前置条件

已有容器化基础架构具备AI模型开发和优化能力数据存储和算力需求明确

信息来源

1 个来源

页面内容为结构化改写;关键结论应可追溯到以下材料。

继续阅读

相关案例

更多软件与互联网案例
价值极高
部分达成可信度中

软件与互联网 · 企业知识库 · 2025

星环科技:AI 基础软件矩阵(TDH/Sophon LLMOps/向量库)落地金融能源政务,25Q4 营收提速

星环科技打造大数据与 AI 基础软件矩阵,涵盖 TDH 大数据平台、Sophon LLMOps 大模型运营工具、向量数据库 Hippo、知识平台 TKH。25Q4 营收 1.9-2.2 亿元、同比 +20.4%~38.9%(显著高于前三季度 7.4%),反映 AI 基础软件旺盛需求;基于海光 CPU 的 ArgoDB 联合方案在金融、能源、政务多行业落地并创 TPC-DS 性能纪录,受益于信息系统国产替代。

星环科技 · medium

更新于 2026年7月

价值中
成功可信度高

软件与互联网 · 算力基础设施与AI平台 · 2025

谷歌:自研 TPU Ironwood 推理成本较 GPU 低 30-40%,ASIC 规模化降本成基建标配

谷歌以自研 ASIC 重构 AI 算力成本。第五代 TPU Ironwood 通过架构优化形成 1.77 PB HBM3e 共享内存池与 42.5 Exaflops FP8 算力,内部实测同等负载下推理成本较 GPU 旗舰系统低 30%-40%;第五代 TPU、亚马逊 Trainium2 的单位算力成本已分别降至英伟达 H100 的 70%、60%,推动 ASIC 从可选项变为大规模应用的刚性需求。

谷歌(Google) · giant

更新于 2026年7月

价值高
成功可信度高

软件与互联网 · Agent · 2025

DeepSeek:全开源模型矩阵(价格约竞品 1/30)+ 国产芯片 day0 适配,V4 编程领先

DeepSeek 以全系列开源大模型构建高性价比 AI 生态:R1 价格约为 OpenAI o1 的 1/30,V2 价格约为 GPT-4 Turbo 的 1/70;V3.2-Exp 发布当日即实现寒武纪、华为昇腾 day0 适配,并大幅降价(API 超 50%)。据媒体报道,有望于 2 月发布的 V4 编程能力超过 Claude 与 GPT 系列。其自研 TileLang 将 CUDA/C++ 算子代码从 500 余行压缩至约 80 行、性能提升约 30%,推动国产软硬件生态去英伟达化。

DeepSeek(深度求索) · large

更新于 2026年7月