DataWorks:数据集成问题排查

本文涉及的产品
云原生数据库 PolarDB MySQL 版,Serverless 5000PCU 100GB
大数据开发治理平台 DataWorks,不限时长
云数据库 RDS MySQL Serverless,0.5-2RCU 50GB
简介: 数据集成问题

测试连通性

以关系数据库jdbcUrl为例(其他数据源如hdfs、redis、mogodb对应连接地址约束等价),

本地IDC:

  • 有公网:支持测试连通性;需要jdbc url模式添加数据源;
  • 无公网:不支持测试连通性;需要jdbc url模式添加数据源;需要自定义资源组;

ECS自建数据源:

  • 有公网:支持测试连通性;需要jdbc url模式添加数据源;
  • 经典网络:

    • 如果是和dataworks同region则,支持测试连通性,需要jdbc url模式添加数据源;
    • 如果是和dataworks不同region则,不支持测试连通性,需要jdbc url模式添加数据源;需要自定义资源组;
  • 专有网络VPC内部地址:不支持测试连通性;需要jdbc url模式添加数据源;需要自定义资源组;

阿里云产品:

  • 实例模式添加数据源:
    rds(mysql、postgresql、sqlserver),polardb、drds、hybridb for mysql,hybridb for postgresql 支持反向vpc;redis,mongodb 支持实例模式添加数据源,还不支持反向vpc;
  • 有公网:支持测试连通性;支持jdbcUrl模式添加数据源;
  • 经典网络:如果是和dataworks同region则,支持测试连通性,需要jdbc url模式添加数据源;如果是和dataworks不同region则,不支持测试连通性,需要jdbc url模式添加数据源;需要自定义资源组;
  • 专有网络VPC内部地址:不支持测试连通性;需要jdbc url模式添加数据源;需要自定义资源组;其他Region中心化服务的产品,如MaxCompute、oss、loghub等,有3种类型的endpoint,按需选择可用的即可。

注意:

  • 数据源连接地址的选择,需要和任务配置模式(向导模式、脚本模式),任务实际执行资源组(默认资源组,自定义资源组)配合,让运行任务的资源组具备数据源的访问能力。
  • hbase hdfs数据源,由于数据存储特性,建议使用自定义资源组或独享资源组。
  • 金融云的数据源,网络打通或者实例模式添加数据源,如果出现不通,建议考虑自定义资源组。

支持运行数据集成任务的3中类型的机器,每种类型支持的网络环境不同

  • 默认资源组:经典网络同region,有公网,支持反向代理的数据源,支持反向vpc的数据源rds(mysql、postgresql、sqlserver),polardb、drds、hybridb for mysql,hybridb for postgresql 支持反向vpc;
  • 独享数据集成资源:vpc数据源
  • 数据集成自定义资源组,支持所有网络环境数据源,但需要dataworkszh专业版及以上功能才支持。

如何确认任务运行在什么类型的资源组上

  • 运行在默认的资源组上:
  1. in Pipeline[basecommon_ group_xxxxxxxxx]
  • 运行在数据集成自定义资源组上:
  1. in Pipeline[basecommon_xxxxxxxxx]
  • 运行在独享数据集成资源上:
  1. in Pipeline[basecommon_S_res_group_xxx]

购买独享资源组后如何切换任务运行资源组

绑定资源组所属项目:
绑定项目
更换独享调度资源:
更换独享调度资源
更换独享数据集成资源
脚本模式更换资源组
向导模式更换资源组

目录
相关文章
|
30天前
|
DataWorks 机器人 调度
DataWorks的集成任务并发度设置主要影响的是**调度资源组**。
【2月更文挑战第34天】DataWorks的集成任务并发度设置主要影响的是**调度资源组**。
13 1
|
1月前
|
DataWorks 安全 关系型数据库
DataWorks常见问题之使用公共数据集成资源组进行同步失败如何解决
DataWorks是阿里云提供的一站式大数据开发与管理平台,支持数据集成、数据开发、数据治理等功能;在本汇总中,我们梳理了DataWorks产品在使用过程中经常遇到的问题及解答,以助用户在数据处理和分析工作中提高效率,降低难度。
|
1月前
|
SQL DataWorks 关系型数据库
DataWorks报错问题之dataX数据导入报错如何解决
DataWorks是阿里云提供的一站式大数据开发与管理平台,支持数据集成、数据开发、数据治理等功能;在本汇总中,我们梳理了DataWorks产品在使用过程中经常遇到的问题及解答,以助用户在数据处理和分析工作中提高效率,降低难度。
DataWorks报错问题之dataX数据导入报错如何解决
|
1月前
|
SQL 分布式计算 DataWorks
DataWorks报错问题之集成hive数据源报错如何解决
DataWorks是阿里云提供的一站式大数据开发与管理平台,支持数据集成、数据开发、数据治理等功能;在本汇总中,我们梳理了DataWorks产品在使用过程中经常遇到的问题及解答,以助用户在数据处理和分析工作中提高效率,降低难度。
|
1月前
|
SQL DataWorks NoSQL
DataWorks报错问题之datax mongodb全量迁移报错如何解决
DataWorks是阿里云提供的一站式大数据开发与管理平台,支持数据集成、数据开发、数据治理等功能;在本汇总中,我们梳理了DataWorks产品在使用过程中经常遇到的问题及解答,以助用户在数据处理和分析工作中提高效率,降低难度。
|
30天前
|
消息中间件 DataWorks 关系型数据库
DataWorks的独享资源数据集成
DataWorks的独享资源数据集成
12 1
|
1月前
|
监控 Oracle 关系型数据库
Dataphin实时集成Oracle CDC相关问题排查
本文档提供了Dataphin平台Oracle CDC实时集成相关问题排查指南,覆盖了权限等常见问题,旨在帮助快速定位和解决Oracle数据库变更数据捕获(CDC)集成过程中所可能遇到的技术难题,确保数据的实时、准确同步。
|
1月前
|
DataWorks NoSQL MongoDB
DataWorks常见问题之如何集成离线数据
DataWorks是阿里云提供的一站式大数据开发与管理平台,支持数据集成、数据开发、数据治理等功能;在本汇总中,我们梳理了DataWorks产品在使用过程中经常遇到的问题及解答,以助用户在数据处理和分析工作中提高效率,降低难度。
47 1
|
1月前
|
SQL 分布式计算 DataWorks
DataWorks常见问题之dataworks连接FTP服务器失败如何解决
DataWorks是阿里云提供的一站式大数据开发与管理平台,支持数据集成、数据开发、数据治理等功能;在本汇总中,我们梳理了DataWorks产品在使用过程中经常遇到的问题及解答,以助用户在数据处理和分析工作中提高效率,降低难度。
|
1月前
|
SQL 分布式计算 DataWorks
DataWorks常见问题之dataworks自定义函数运行时报错如何解决
DataWorks是阿里云提供的一站式大数据开发与管理平台,支持数据集成、数据开发、数据治理等功能;在本汇总中,我们梳理了DataWorks产品在使用过程中经常遇到的问题及解答,以助用户在数据处理和分析工作中提高效率,降低难度。