AI基础设施AI推理平台

魔坊ModelArts

魔坊ModelArts是一站式AI开发与模型训推平台,提供数据准备、模型开发、模型训练、模型评测、模型部署、推理服务、算力管理和MLOps等全生命周期能力。

标签:

魔坊ModelArts是什么

魔坊(ModelArts)是面向 AI 开发者和企业研发团队打造的一站式人工智能开发平台。

平台将数据准备、算法开发、模型训练、模型调测、模型评测、模型部署和资源管理等环节进行统一整合,帮助开发者完成从数据到模型、从模型训练到生产部署的完整 AI 开发流程。

ModelArts 底层兼容多种异构计算资源,并支持 MindSpore、TensorFlow、PyTorch、Ascend-vLLM、LlamaFactory、Verl 等主流 AI 开发、训练和推理框架,让开发者能够根据业务需求使用相应的计算资源和开发框架。

目前 ModelArts 已形成覆盖 数据、开发、训练、评测、推理和运维的完整 AI 工程化工具链,并支持大规模分布式训练以及多种模型部署形态。

魔坊ModelArts

魔坊ModelArts核心功能

魔坊ModelArts数据准备

ModelArts 提供数据接入和数据管理能力。

支持将不同来源、不同格式的数据导入平台,并形成原始数据集,为后续的数据加工和模型训练提供统一的数据基础。

支持图片、文本、视频、音频等多种类型的数据集管理,并提供数据集版本管理能力。

魔坊ModelArts数据处理

提供面向 AI 训练的数据处理能力。

通过数据处理算子和自动化流程,对原始数据进行筛选、加工和整理,将原始数据转化为适用于模型训练的数据集。

平台同时支持利用大模型增强多模态数据标注和数据合成能力。

魔坊ModelArts开发环境

提供云端 AI 开发环境。

通过 JupyterLab 提供在线 Notebook 开发能力,无需在本地安装复杂的 AI 开发环境即可进行模型开发和调试。

同时支持通过 SSH 连接 VS Code、PyCharm 等本地 IDE,实现云上云下协同开发。

魔坊ModelArts模型开发

支持开发者使用主流 AI 框架进行模型开发。

目前支持包括:

  • PyTorch
  • TensorFlow
  • MindSpore
  • Ascend-vLLM
  • LlamaFactory
  • Verl

等开发、训练和推理框架。

魔坊ModelArts一键训练

针对标准化 AI 训练任务,提供一键训练能力。

开发者准备数据集并选择任务类型后,平台可以自动完成算法选择、训练参数配置和资源调度,并最终生成可部署模型。

适合模型原型验证和快速业务落地。

魔坊ModelArts模型训练

提供企业级 AI 分布式训练能力。

支持大规模训练任务、主流训练框架和模型,并通过全栈加速、性能分析和故障诊断等能力提升训练效率和稳定性。

魔坊ModelArts超大规模训练

支持大规模分布式 AI 训练任务。

当前平台支持单作业万亿参数、百 PB 级数据的超大规模训练能力,可用于大模型研发和行业模型训练。

魔坊ModelArts模型调测

提供模型开发和训练过程中的调试能力。

开发者可以通过 Notebook、远程开发环境以及训练任务进行模型代码调试、参数调整和实验验证。

魔坊ModelArts模型评测

提供模型实时对比能力。

开发者可以在相同输入条件下,对不同模型进行横向比较,用于模型选择、效果验证和迭代优化。

魔坊ModelArts模型部署

支持将训练完成的模型部署为推理服务。

根据实际应用场景,可以采用不同的部署方式,将模型应用于生产环境。

魔坊ModelArts在线推理

将模型部署为在线服务,通过 API 等方式提供实时推理能力。

适用于智能问答、图像识别、文本处理和各种 AI 在线应用。

魔坊ModelArts批量推理

针对大规模离线数据提供批量推理能力。

适用于需要集中处理大量数据的 AI 应用场景。

魔坊ModelArts边缘推理

支持将模型部署到边缘设备,实现端、边、云不同环境下的模型推理。

魔坊ModelArts大模型推理

支持大模型推理部署,并针对大模型场景提供多种部署和资源管理能力。

目前支持多 P、多 D 部署方式,并提供部署拓扑可视化、多级流控等能力。

魔坊ModelArts算力资源管理

提供 AI 计算资源管理能力。

底层支持昇腾等 AI 算力资源,并提供大规模集群管理和资源负载调度能力。

魔坊ModelArts资源池

提供公共资源池和专属资源池等资源使用方式。

公共资源池可以根据训练作业、模型部署和开发环境需求动态分配计算资源;专属资源池则提供更加独立和可控的计算资源。

魔坊ModelArtsMLOps

支持 AI 模型全生命周期管理。

通过数据、模型、训练、部署和监控等能力形成持续迭代的 AI 工程流程,并支持模型监测、数据诊断和训练日志分析等能力。

魔坊ModelArts模型监测

提供模型运行状态和相关指标监控能力,用于发现模型运行过程中的异常情况,并辅助模型持续优化。

魔坊ModelArtsAI Gallery

提供 AI 模型、算法、数据和案例等 AI 资产。

开发者可以使用社区中的相关 AI 资源,也可以将自己的模型、算法和其他成果进行共享。

魔坊ModelArtsAgentic RL

提供面向智能体场景的强化学习能力。

平台当前内置进化式强化学习框架,用于支持智能体能力持续优化。

魔坊ModelArts产品优势

  • 一站式AI开发:覆盖数据、开发、训练、评测、部署和运维。
  • 全生命周期管理:支持从数据准备到模型生产运行的完整流程。
  • 大规模训练能力:支持企业级分布式 AI 训练。
  • 异构算力支持:兼容多种 AI 计算资源。
  • 主流框架兼容:支持 PyTorch、TensorFlow、MindSpore 等主流框架。
  • 云端开发环境:提供 JupyterLab 和远程 IDE 开发能力。
  • 多种部署方式:支持在线、批量和边缘推理。
  • 大模型支持:支持大模型训练和推理相关场景。
  • 模型评测能力:支持不同模型进行实时对比。
  • MLOps能力:支持 AI 模型持续开发、训练、部署和监控。
  • AI资产共享:通过 AI Gallery 提供模型、算法、数据等资源。
  • 算力统一管理:提供计算资源调度、任务管理和资源利用率管理。

魔坊ModelArts应用场景

魔坊ModelArts大模型开发

用于大语言模型、视觉模型、多模态模型等 AI 模型的开发、训练和推理。

魔坊ModelArts行业模型训练

结合行业数据进行模型训练和优化,适用于金融、医疗、制造、矿山、政务等行业。

魔坊ModelArtsAI应用开发

通过模型开发、训练和部署能力,为企业 AI 应用提供模型基础。

魔坊ModelArts自动驾驶

支持自动驾驶相关 AI 模型开发、训练和部署,用于环境感知、路径规划和智能控制等场景。

魔坊ModelArts金融AI

用于金融领域的模型开发和 AI 应用,包括智能客服、风险分析和金融数据处理等场景。

魔坊ModelArts医疗AI

可用于医疗数据分析、医学影像、报告辅助分析以及健康管理等 AI 场景。

魔坊ModelArts政府AI

支持政务领域 AI 模型和应用开发,用于公共服务、信息处理和智能辅助等场景。

魔坊ModelArts矿山AI

面向矿山场景开展 AI 模型开发和部署,用于生产、安全和智能运营等业务。

魔坊ModelArts科研开发

为科研人员提供云端 Notebook、模型训练、实验管理和算力资源,支持 AI 算法研究和模型实验。

魔坊ModelArts使用教程

第一步:准备华为云账号

注册华为云账号并完成实名认证,同时配置 ModelArts 所需的权限。

第二步:开通ModelArts

进入 ModelArts 控制台,完成服务开通和相关授权。

第三步:准备数据

将训练所需的数据导入平台。

可以使用 OBS 等存储服务保存数据,并在 ModelArts 中创建和管理数据集。

第四步:选择开发方式

根据开发需求选择 JupyterLab、远程 IDE 或其他模型开发方式。

第五步:选择模型和框架

根据实际任务选择 PyTorch、TensorFlow、MindSpore 等开发框架。

第六步:创建训练任务

配置数据集、算法、计算资源和训练参数,然后创建模型训练任务。

对于标准任务,也可以直接使用一键训练。

第七步:进行模型评测

训练完成后,对模型进行测试和评估。

如果需要比较多个模型,可以使用实时模型对比功能。

第八步:部署模型

选择在线推理、批量推理或边缘推理等部署方式,将模型发布到实际运行环境。

第九步:监控模型

通过模型监测和运维能力观察模型运行状态、推理性能和相关指标。

第十步:持续优化

根据评测结果和生产运行数据继续调整数据、算法、训练参数和模型,形成持续迭代的 AI 开发流程。

魔坊ModelArts收费标准

ModelArts采用按实际资源使用量计费等方式。

公共资源池可以用于训练作业、模型部署和开发环境实例,并按照实际使用量计费;同时提供专属资源池等资源形态。

ModelArts涉及的费用通常与以下资源有关:

  • 计算资源
  • 模型训练资源
  • 模型推理资源
  • 开发环境资源
  • 存储资源
  • 数据处理相关资源
  • 其他配套云服务资源

不同地域、计算规格、资源类型和计费模式对应的价格存在差异。

实际收费标准以官方最新计费页面为准。

魔坊ModelArts常见问题(FAQ)

魔坊ModelArts是什么?

魔坊(ModelArts)是华为云提供的一站式 AI 开发与模型训推平台,覆盖数据准备、模型开发、模型训练、模型评测、模型部署和资源管理等环节。

ModelArts可以训练大模型吗?

可以。ModelArts支持大规模分布式训练,并针对大模型开发、训练和推理提供相应能力。

ModelArts支持哪些AI框架?

目前支持 PyTorch、TensorFlow、MindSpore 等主流框架,同时支持 Ascend-vLLM、LlamaFactory、Verl 等大模型相关框架。

ModelArts支持JupyterLab吗?

支持。ModelArts提供云端 JupyterLab 开发环境,也支持通过 SSH 与本地 VS Code 等 IDE 协同开发。

ModelArts可以一键训练模型吗?

可以。针对标准任务,ModelArts提供一键训练能力,可以自动完成算法选择、参数配置和资源调度。

ModelArts可以部署模型吗?

可以。支持在线推理、批量推理和边缘推理等多种模型部署方式。

ModelArts支持模型评测吗?

支持。实时比对功能可以在相同输入条件下对不同模型进行横向评测。

ModelArts支持昇腾算力吗?

支持。ModelArts当前提供昇腾算力资源,并支持大规模集群管理和资源调度。

ModelArts适合初学者吗?

适合。平台提供一键训练、快速入门、Notebook 等能力,可以根据开发者不同基础选择相应的 AI 开发方式。

ModelArts和AI大模型是什么关系?

ModelArts不是一个单独的大模型,而是用于AI模型开发、训练、评测和部署的平台。开发者可以使用 ModelArts 训练自己的模型,也可以基于已有模型进行开发和部署。

相关导航