数据集成
提供可视化的数据同步能力,支持 50+ 数据源之间的批量与实时同步。通过配置即可完成跨库、跨系统的数据搬运,无需编写同步代码。
输入关键词开始搜索,支持产品名、别名、场景与关键词。
大数据开发治理平台 DataWorks 是阿里云的一站式数据开发与治理平台,提供数据集成、数据开发、任务调度、数据地图、数据质量、数据安全与数据服务能力。DataWorks 是连接各类计算引擎与存储的枢纽,帮助企业建立规范、可治理的数据生产体系。
建设数据仓库或数据中台的企业;需要统一调度与治理跨系统数据链路的团队;希望建立数据质量与血缘管理体系的组织。
以下参数用于快速比对本产品的核心能力边界。
| 数据集成 | 支持 50+ 数据源(数据库、消息队列、文件、大数据) |
|---|---|
| 数据开发 | SQL、Shell、Python、PyODPS、Spark、Flink 节点 |
| 调度 | 分钟级/小时级/天级调度,支持依赖、分支、循环 |
| 运维中心 | 任务实例监控、基线管理、智能诊断 |
| 数据地图 | 元数据采集、血缘分析、影响分析 |
| 数据质量 | 表级与字段级质量规则、质量报告 |
| 数据服务 | 一键生成数据 API,支持鉴权与限流 |
| 安全 | 数据分级分类、权限申请与审批流程 |
价格为整理时的参考区间,实际以下单页面为准。计费模式:按版本订阅(按用户数/规格) · 调度与集成按资源用量计费。
| 套餐 / 规格 | 配置说明 | 参考价格 | 备注 |
|---|---|---|---|
| 基础版 | 标准调度与开发 | 按量 | 入门使用 |
| 标准版 | 含数据质量与地图 | 按量 | 中小企业 |
| 专业版 | 含数据服务与安全 | 按量 | 中大型企业 |
| 企业版 | 全功能 | 按量 | 大型企业 |
省钱提示:长期稳定负载优先包年包月并叠加节省计划;无状态批处理可用抢占式实例,成本可低至按量价的 10%。 查看成本优化指南 →
提供可视化的数据同步能力,支持 50+ 数据源之间的批量与实时同步。通过配置即可完成跨库、跨系统的数据搬运,无需编写同步代码。
支持分钟级到天级的调度周期,可配置任务依赖、跨周期依赖、分支与循环逻辑。运维中心提供实例监控、基线管理与智能诊断,保障数据按时产出。
自动采集表、字段、分区等元数据并构建血缘关系。当上游表变更时,可快速分析影响的下游任务与报表,避免「改一处坏一片」。
可对关键表配置行数波动、空值率、唯一性、及时性等质量规则,异常时自动告警并阻断下游任务,防止脏数据扩散。
把数据表或 SQL 查询一键发布为带鉴权、限流与监控的数据 API,供业务系统与前端调用,打通数据到应用的最后一公里。
支持数据分级分类、敏感字段识别与脱敏、权限申请审批流程,满足数据安全法规与等保要求。
不是必须。DataWorks 可调度 MaxCompute、EMR、Flink、AnalyticDB 以及各类数据库上的任务,是跨引擎的统一开发与调度平台。
可以。通过数据集成与自定义节点,DataWorks 可以调度 ECS 上的 Shell 脚本、自建数据库的 SQL 任务,也支持通过数据服务对外提供 API。
建议优先对核心表(如交易、用户主表)配置质量规则:行数波动范围、主键唯一性、关键字段空值率、数据产出及时性。这几类规则能覆盖大部分数据事故。
EB 级离线数据仓库,PB 级数据分钟级处理
云上 Hadoop 生态集群,开源组件全兼容
全托管流计算引擎,流批一体处理实时数据
一体化实时数仓,写入即可查、高并发低延迟