云存储目标的设置 | Qlik Cloud帮助
跳到主要内容 跳到补充内容

云存储目标的设置

您可以根据需要更改默认的数据湖登陆设置。

一般

更新方法

可以在两种不同的模式下登陆数据。一旦准备好数据湖登陆任务,就无法更改模式。

  • 变更数据捕获 (CDC) 使用更改表: 数据湖登陆任务从满负载开始(在此期间,所有选定的表都将加载到目标)。然后使用 CDC(更改数据捕获)技术使目标数据保持最新。

    信息注释不支持 DDL 操作的 CDC(更改数据捕获)。

    使用 数据移动网关 时,除非使用 SaaS 应用程序源,否则会几乎实时地从源捕获更改。在不使用 数据移动网关 或使用 SaaS 应用程序源的情况下工作时,会根据调度程序设置捕获更改。有关更多信息,请参阅Scheduling tasks

  • 重新加载: 将数据从选定的源表满负载到目标平台,并在必要时创建目标表。任务启动时会自动进行满负载,但也可以手动执行或根据需要安排定期进行。

    信息注释使用 SaaS 应用程序连接器时,此设置不可用。

要使用的文件夹

请根据您希望将文件写入哪个存储段文件夹,选择以下选项之一:

  • 默认文件夹

    默认文件夹格式为 <您的项目名称>/<您的任务名称>

  • 根文件夹

    文件将写入根存储段文件夹。

  • 文件夹

    指定一个文件夹名称。如果该文件夹尚不存在,则会在数据任务期间创建该文件夹。

    信息注释 文件夹名称不能包含特殊字符(例如 @、#、! 等)。

数据上传

文件属性

格式

您可以选择以 CSVJSONParquet 格式创建目标文件。

信息注释使用 Parquet 文件格式时,不支持大于 1MB 的 LOB 列

在 JSON 文件中,每条记录都由一行表示,如下例所示:

{ "book_id": 123, "title": "Alice in Wonderland", "price": 6.99, "is_hardcover": false }

{ "book_id": 456, "title": "Winnie the Pooh", "price": 6.49, "is_hardcover": true }

{ "book_id": 789, "title": "The Cat in the Hat", "price": 7.23, "is_hardcover": true }

另请参阅:内容类型和内容编码属性

信息注释不支持在任务处于停止状态时更改格式(例如,从 CSV 更改为 JSON 或从 JSON 更改为 CSV),然后继续执行任务。
信息注释
  • 如果选择 JSONParquet 格式,以下字段将被隐藏,因为它们仅与 CSV 格式相关:字段分隔符记录分隔符Null 值报价字符报价转义符添加元数据标头
  • 以下字段仅与 Parquet 格式相关:Parquet 版本Parquet 时间戳单位Parquet 最大 LOB 大小 (KB)

有关使用 Parquet 格式时的数据类型映射及其限制的信息,请参阅Mapping from Qlik Cloud data types to Parquet

字段分隔符

将用于分隔目标文件中的字段(列)的分隔符。默认值为逗号。

使用逗号作为分隔符的示例:

"mike","male"

分隔符可以是标准字符或十六进制 (hex) 值。请注意,前缀“0x”必须用于表示十六进制分隔符(例如0x01 = SOH0x01 = SOH)。在字段分隔符记录分隔符Null 值字段中,分隔符可以由连接的十六进制值组成(例如 0x0102 = SOHSTX),而在报价字符报价转义符字段中,它只能是单个十六进制值。

不支持十六进制数字 0x00(即仅支持 0x01-0xFF)。

空值

将用于指示目标文件中的 null 值的字符串。

示例(其中 \n 是记录分隔符,@ 是空值):

"mike","male",295678\n
"sara","female",@\n

记录分隔符

将用于分隔目标文件中的记录(行)的分隔符。默认设置为新行 (\n)。

示例:

"mike","male"\n
"sara","female"\n

引号字符

将在文本列的开头和结尾使用的字符。默认为双引号字符 (")。当包含列分隔符的列用双引号括起来时,列分隔符字符将被解释为实际数据,而不是列分隔符。

示例(其中 @ 是引号字符):

@mike@,@male@

引号转义符

用于对实际数据中的引号字符进行转义的字符。默认为双引号字符 (")。

示例(其中 “ 是引号,\ 是转义符):

1955,"old, \"rare\", Chevrolet","$1000"

Parquet 版本

根据目标平台支持的版本选择要使用的版本。请注意,Parquet 1.0 版本仅支持 MICRO 时间戳单元,而 Parquet 2.6 版本同时支持 MICRONANO 时间戳单元。

Parquet 时间戳单位

当 Parquet 版本设置为2.6时,选择 MICRONANO。当 Parquet 版本设置为 1.0 时,仅支持 MICRO

Parquet 最大 LOB 大小 (KB)

默认的最大 LOB 大小为 64 KB,您可以在此字段中输入的最大值为 10000 KB。处理 LOB 列需要更多的资源,这反过来又会影响性能。只有当您正在复制大于 64 KB 的 LOB 数据,并且需要将所有 LOB 数据复制到目标时,才能增大此值。

最大文件大小

文件在关闭之前可以达到的最大大小(可选择压缩)。

文件在关闭之前可以达到的最大大小。与并行执行选项结合使用时,较小的文件可能会上传得更快(取决于网络),并提高性能。然而,通常认为用小文件扰乱数据库是不好的做法。

压缩文件方式

选择其中一个压缩选项来压缩目标文件,或者选择 NONE(默认值)使其保持未压缩状态。请注意,可用的压缩选项由选定的文件格式决定。

添加元数据标头

您可以选择将标题行添加到数据文件中。标题行可以包含源列名和/或中间(即Qlik Talend Data Integration)数据类型。

当同时选择带列名带数据类型时,具有标题行的目标文件示例:

Position:DECIMAL(38,0),Color:VARCHAR(10)

1,"BLUE"

2,"BROWN"

3,"RED"

...

变更处理

该部分介绍更改处理中的条件设置。

应用/存储更改场景

  • 文件大小达到:指定在将文件上传到目标之前要累积的更改数据的最大大小。
  • 运行时间达到运行时间达到 x。

元数据文件

当选择在目标文件夹中创建元数据文件选项时,对于每个数据文件,将在指定的目标文件夹下创建一个扩展名为 .dfm 的匹配元数据文件。元数据文件提供了有关任务/数据的附加信息,如源连接器类型、源表名称、数据文件中的记录数等。

有关元数据文件的完整描述以及可能的用途,请参阅元数据文件描述

元数据

LOB 列

信息注释这些设置不适用于使用 SaaS 应用程序连接器的任务。

包括 LOB 列并将列大小限制为 (KB)

您可以选择在任务中包括 LOB 列,并设置最大 LOB 大小。大于最大大小的 LOB 将被截断。

JSON 列映射

信息注释
  • 如果您使用 数据移动网关 访问数据源,则需要版本 2024.11.70 或更高版本。

选中此选项后,源上的 JSON 列将自动映射到目标上的 JSON 列。

此选项的状态和可见性由以下因素决定:

  • 新任务: 如果源和目标都支持 JSON 数据类型,则此选项将默认启用。

  • 现有任务: 即使源和目标都支持 JSON 数据类型,此选项也将默认禁用。这是为了保持与下游流程(例如转换)的向后兼容性,这些流程期望目标数据为 STRING 格式(这是传统行为)。您可以禁用该选项,也可编辑下游进程以兼容 JSON 格式,然后启用该选项。

  • 新建和现有任务: 如果只有源支持 JSON 数据类型,此选项将不可见。如果稍后在目标中添加 JSON 支持,该选项将变为可见,但仍处于禁用状态。这是为了保持与下游流程(例如转换)的向后兼容性,这些流程期望目标数据为 STRING 格式(这是传统行为)。

控制表

选择要在目标平台上创建以下控制表中的哪一个:

  • 复制状态: 提供有关当前登陆任务的详细信息,包括任务状态、任务消耗的内存量、尚未应用于数据平台的更改数量以及当前正在从中读取数据的数据源中的位置。
  • 挂起的表: 提供挂起的表的列表,以及它们被挂起的原因。
  • 登陆历史: 提供有关任务历史记录的信息,包括登陆任务期间处理的记录数量和卷、CDC 任务结束时的延迟等。
  • 更改数据分区: 提供由于更改数据分区在目标数据库上创建的分区的记录。您可以使用这些信息来标识需要进一步处理的分区数据。

有关每个控制表的详细说明,请参阅控制表

完全加载

信息注释这些设置不适用于使用 SaaS 应用程序连接器的任务。

性能调整

  • 并行加载的最大表数:输入一次要加载到目标中的最大表数。默认值为 5
  • 事务一致性超时(秒):输入在开始满负载操作之前等待打开的事务关闭的秒数。默认值为 600(10 分钟)。即使存在仍处于打开状态的事务,也会在达到超时值后开始满负载。

    信息注释要复制在满负载开始时打开但在达到超时值才提交的事务,需要重载目标表。
  • 满负载期间的提交率:可以一起传输的最大事件数。默认值为 10000

在满负载完成之后

创建主键或唯一索引:如果要将主键或唯一索引在数据平台上的创建延迟到满负载完成后,请选择此选项。

对于初始加载

信息注释如果您使用 数据移动网关 访问您的数据源,则这些设置需要 2022.11.74 或更高版本。
使用缓存数据

此选项允许您使用在选择完整数据扫描的情况下生成元数据时读取的缓存数据。

这减少了 API 使用和配额方面的开销,因为已经从源读取数据。自初始数据扫描以来的任何更改都可以通过更改数据捕获 (CDC) 获取。

从源加载数据

此选项从数据源执行新加载。此选项在以下情况下很有用:

  • 最近未执行元数据扫描。

  • 源数据集很小并且经常更改,而您不希望维护完整的更改历史记录。

存储更改

当您选择更改数据捕获 (CDC) 更新方法时,对源数据的更新将存储在目标平台上的更改表中。变更表捕获源中的所有插入、更新和删除操作,允许下游应用程序增量处理更改。

此部分介绍了如何配置“更改表”选项:DDL 处理、更新映像存储和表创建行为。

信息注释

存储更改处理只有当更新方法为更改数据捕获 (CDC) 时才可用。

对这些设置的任何更改将仅在下次运行满负载时生效。如果您在任务停止时修改这些设置,您必须重新加载目标表才能应用更改。

有关更改表的深入信息,请参阅使用更改表

基本设置

DDL 选项

信息注释从 SaaS 应用程序源进行复制时,这些设置不可用。

DDL(数据定义语言)选项确定如何在更改表中处理源中的架构更改。

  • 应用于更改表:选择此选项后,系统会自动将源表中的 DDL 更改(例如添加或删除列)应用于相应的更改表。当您的下游应用程序需要更改表反映源中的所有架构更改时,请使用此选项。

  • 忽略:系统将忽略对源的所有 DDL 更改。更改表结构保持不变。使用此选项,当源中的 DDL 更改不应影响存储的更改,或当您的目标系统需要固定的表架构时。

高级设置

在更新

信息注释此设置与 SaaS 应用程序源无关,因为更改是作为 INSERT 操作应用的。

更新设置控制当源记录更新时捕获哪些数据。

存储前后图像:系统会捕获原始数据(更新前)和修改后的数据(更新后)。此选项需要更多存储空间,但提供完整的审计信息,允许下游系统比较旧值和新值或执行复杂的变更分析。当您的应用程序需要完整的变更上下文时,请使用此功能。

如果此选项被禁用,系统只捕获修改后的数据(更新后),而不是原始值。此选项减少了目标端的存储要求。当您只需要更改记录的当前状态,而不需要历史更改前的值时,请使用此功能。

更改表创建

  • 后缀: 指定一个字符串作为所有更改表的后缀。默认值为 __ct。更改表名称是附加了后缀的目标表的名称。例如,使用默认值,变更表的名称将为 HR__ct
  • 标题列前缀: 指定一个字符串作为所有“更改表”标题列的前缀。默认值为 header__。例如,当使用默认值时,标题列 stream_position 将被称为 header__stream_position

当满负载启动时,这些设置确定如何处理目标上现有的更改表。选择最符合您的数据恢复和存储要求的选项:

  • 删除和创建:系统将完全删除现有更改表,并创建一个新的空表。所有先前存储的更改都已删除。当您希望在每次满负载周期中都全新开始时,请使用此选项。

  • 删除旧更改并将新更改存储在现有变更表中:系统会从现有变更表中删除所有数据,而不影响其结构或元数据。新更改存储在同一张表中。当您想要保留表结构但清除之前的更改时,请使用此功能。

  • 保留旧更改并将新更改存储在现有更改表中:系统会保留更改表中的所有现有数据和元数据。新更改已添加到现有数据。当您需要累积多个满负载周期中的所有更改时,请使用此项。

更改数据分区

信息注释只有当更新方法为更改数据捕获 (CDC) 时,此选项才可用。

在标准登陆任务中 (不使用变更数据分区),对目标的更改不按特定顺序登陆。更改数据分区可以用一致的方式处理来自多个表的更改数据。您可以定义分区的持续时间以及分区基准时间,从而确保分区数据的整体一致性(即不存在部分事务,不存在没有订单行的订单头等等。)

有关分区的信息记录在目标数据库的 attrep_cdc_partitions 控制表中。此信息可用于识别需要进一步处理的分区数据。

  • 在标准登陆任务中 (不使用变更数据分区),对目标的更改不按特定顺序登陆。更改数据分区可以用一致的方式处理来自多个表的更改数据。您可以定义分区的持续时间以及分区基准时间,从而确保分区数据的整体一致性(即不存在部分事务,不存在没有订单行的订单头等等。)

    • 计划的 CDC:分区在计划的任务实例运行时创建。所以,例如,如果一个任务计划在每天午夜运行,并且 分区间隔 设置为 4 小时,那么创建的分区数量将代表过去 24 小时内提交发生的时间。如果提交发生在 01:00-03:00 和 16:15-18:00 之间,并且 分区基准时间 设置为 0:00,则将创建两个分区:0:00-04:00 和 16:00-20:00。

    • 持续 CDC: 如果“分区间隔”设置为 4 小时,Replicate 每 4 小时创建一个分区,其中包含在此期间发生的所有提交。如果在4小时内没有提交,则不会为该时段创建分区。

  • 从 SaaS 应用程序源提取数据的任务总是按计划进行。分区基于数据提取时间,因为提交的概念不存在于 SaaS 应用程序源中。当计划任务实例运行时,数据提取开始。因此,例如,如果一个任务计划在每天午夜运行,并且 分区间隔 设置为 4 小时,那么创建的分区数量将代表数据提取的持续时间。如果数据提取耗时少于两小时,将创建一个分区。但是,如果提取需要六小时(例如),则会创建两个分区。

  • 分区间隔 - 指定每个分区的长度(以小时和分钟为单位)。

    信息注释

    建议指定的分区长度超过一小时。尽管指定小于一小时的分区长度可能会提高延迟,但在目标上创建许多分区也可能影响(目标)性能(尤其是在具有大量更改的系统中)。

    如果在创建最后一个分区之前继续执行任务,则数据湖登陆任务将写入已关闭的分区。

  • 分区基本时间 - 分区是在 24 小时内创建的,根据源数据库上指定的“分区基本时间”(UTC 时间)计算。例如,分区间隔为 8 小时,“分区基准时间”时间为 02:00,将创建以下分区:02:00-10:00、10:00-18:00、18:00-02:00,但不一定按此顺序。例如,如果一个任务在 01:00 开始,那么第一个分区的时间范围将是 18:00-02:00。此外,如果任务在分区中间启动(例如 04:00),则其更改数据将插入 02:00-10:00 分区,即使在 04:00 之前没有捕获任何更改。

表头列

警告注释

在任务运行时,不能添加或删除列。要修改列选择,停止任务,更新偏好设置,然后重新加载目标表。

更改表包含带可配置前缀的系统元数据列。默认情况下,这些列的前缀是header__(例如,header__stream_positionheader__operation)。这些列提供有关每个更改记录的信息,例如操作类型(INSERT、UPDATE、DELETE)以及更改发生的顺序。

如果您不需要该元数据,可以从更改表中排除特定的表头列。这减少了目标平台上的存储要求。

信息注释

更改数据分区 启用后,系统会自动向“更改表”添加一个名为 partition_name 的额外系统列,并在 UI 中自动选择。由于此列是分区跟踪所必需的,因此不能排除。

错误处理

数据错误

信息注释

只有变更数据捕获 (CDC) 更新方法才支持数据错误处理。

数据截断错误

对于数据截断错误:选择在一个或多个特定记录中发生截断时要执行的操作。您可以从列表中选择以下选项之一:

  • 忽略:任务将继续,并忽略该错误。
  • 挂起表:任务继续进行,但带有错误记录的表中的数据会移动到错误状态,并且不会复制其数据
  • 停止任务:任务已停止,需要手动干预。

其他数据错误

对于其他数据错误:选择在一个或多个特定记录中发生错误时要执行的操作。您可以从列表中选择以下选项之一:

  • 忽略:任务将继续,并忽略该错误。
  • 挂起表:任务继续进行,但带有错误记录的表中的数据会移动到错误状态,并且不会复制其数据
  • 停止任务:任务已停止,需要手动干预。

升级数据错误处理

当其他数据错误达到时,升级错误处理(每个表):选中此复选框,当非截断数据错误(每个表)数量达到指定数量时,将错误处理升级。有效值为 1-10,000。

升级操作:选择升级错误处理时应执行的操作。请注意,可用的操作取决于从上述针对其他数据错误下拉列表中选择的操作。

  • 挂起表(默认值):任务将继续,但带有错误记录的表中的数据将移动到错误状态,并且不会登陆其数据。

  • 停止任务:任务已停止,需要手动干预。

表格错误

遇到表格错误时:从下拉列表中选择以下选项之一:

  • 挂起表(默认):任务将继续,但带有错误记录的表中的数据将移动到错误状态,并且不会复制其数据。
  • 停止任务:任务已停止,需要手动干预。

当表格错误达到时,升级错误处理(每个表):选中此复选框,当表格错误(每个表)数量达到指定数量时,将错误处理升级。有效值为 1-10,000。

升级操作:表错误的升级策略设置为停止任务,无法更改。

环境

  • 最大重试数选择此选项,然后指定发生可恢复环境错误时重试任务的最大尝试次数。重试任务达到指定次数后,任务将停止,需要手动干预。

    若要从不重试任务,请清除复选框或指定“0”。

    要无限次重试任务,请指定“-1”

    • 重试间隔(秒)使用计数器选择或键入系统在尝试重试任务之间等待的秒数。

      有效值为 0-2000。

  • 延长长时间停机的重试间隔选中此复选框可增加长时间停机的重试间隔。启用此选项后,每次重试之间的间隔将加倍,直到达到最大重试间隔(并根据指定的最大间隔继续重试)。
    • 最大重试间隔(秒)使用计数器选择或键入在启用增加长时间中断的重试间隔选项时任务重试之间等待的秒数。有效值为 0-2000。

更改处理调谐

信息注释只有当更新方法为更改数据捕获 (CDC) 时,此选项卡才可用。

事务卸载调整

  • 该条件下将正在进行的事务卸载到磁盘

    事务数据通常保存在内存中,直到它完全提交到源或目标。但是,大于分配内存或未在指定时间限制内提交的事务将被卸载到磁盘。

    • 所有事务总内存大小超过 (MB):所有事务在卸载到磁盘之前可以在内存中占用的最大大小。默认值为 1024。
    • 事务持续时间超过(秒):每个事务在卸载到磁盘之前可以在内存中停留的最长时间。持续时间是从 Qlik Talend Data Integration 开始捕获事务的时间开始计算的。默认值为 60。

批量调节

  • 每笔交易的最小更改次数:每个事务中要包含的最小更改数。默认值为 1000

    信息注释

    当更改次数等于或大于每个事务的最小更改次数值时,或者当达到下面描述的应用前批处理事务的最长时间(秒)值时,将对目标应用更改,以先发生的为准。由于应用于目标的更改频率由这两个参数控制,因此对源记录的更改可能不会立即反映在目标记录中。

  • 应用前批处理事务的最长时间(秒):在声明超时之前分批收集事务的最长时间。默认值为 1

间隔

信息注释这些设置仅适用于 SAP ODP 连接器。
  • 每(分钟)读取更改

    从源读取更改的间隔(分钟)。有效范围为 1 到 1440。

    信息注释

    要使用此选项,任务必须采用:

    • 数据移动网关
    • 更改数据捕获 (CDC) 更新方法。
  • 根据增量提取间隔: 选中此选项后,数据任务会根据增量提取间隔来检查更改。

    信息注释该间隔将在每个“轮次”后开始。一个轮次可以定义为数据任务从源表读取更改并将其发送至目标(作为单个事务)所需的时间。一个轮次的长度会根据表的数量及更改的数量而变化。因此,如果您指定 10 分钟的间隔,并且一个轮次需要 4 分钟,那么检查更改之间的实际时间将为 14 分钟。
    • 增量提取间隔: 从您的系统之中提取增量的频率。默认值为每 60 秒一次。

  • 按计划:选中此选项之后,数据任务将提取一次增量,然后停止。然后它将继续按计划运行。

    信息注释仅当 CDC 周期之间的间隔为 24 小时或者更长时,此选项才相关。

    有关计划的信息:

其他调谐

  • 语句缓存大小(语句数): 要存储在服务器上以供以后执行(在对目标应用更改时)的最大准备语句数。默认值为 50。最大值为 200。
  • 更新主键列时的删除和插入: 此选项要求在源数据库中打开完整的补充日志记录。

    信息注释此设置不适用于使用 SaaS 应用程序连接器的任务,除非它是 Lite 连接器

自动模式演变

选择如何处理架构中以下类型的 DDL 更改。更改模式演变设置后,必须重新准备任务。选择如何处理架构中以下类型的 DDL 更改。

信息注释当使用 SaaS 应用程序连接器时,只支持更改列数据类型
DDL 更改 应用于目标 忽略 挂起表 停止任务
添加列 支持 支持 支持 支持
重命名列 不支持 不支持 支持 支持
重命名表格 不支持 不支持 支持 支持
更改列数据类型 不支持 支持 支持 支持
创建表格

如果使用选择规则添加与模式匹配的数据集,则将检测并添加符合模式的新表。

支持 支持 不支持 不支持

字符替换

您可以替换或删除目标数据库中的源字符,和/或替换或删除所选字符集不支持的源字符。

信息注释
  • 所有字符都必须指定为 Unicode 代码点。

  • 字符替换也将在控制表上执行。
  • 无效值将由表格单元格右上角的红色三角形指示。将鼠标光标悬停在三角形上会显示错误消息。

  • 为任务定义的任何表级或全局转换都将在字符替换完成后执行。

  • 替换或删除源字符表中定义的替换操作在替换或删除所选字符集不支持的源字符表格中定义的替代操作之前执行。

  • 字符替换不支持 LOB 数据类型。

替换或删除源字符

使用替换或删除源字符表可以定义特定源字符的替换项。例如,当字符的 Unicode 表示在源平台和目标平台上不同时,这可能很有用。例如,在 Linux上,Shift_JIS 字符集中的减号字符表示为 U+2212,但在 Windows 上,它表示为 U+FF0D

替换操作
进行该操作

定义替代操作

  1. 单击表上方的添加字符按钮。

  2. 源角色替换角色字段中分别指定源角色和目标角色。

    例如,要将字母“a”替换为字母“e”,请分别指定 00610065

    信息注释

    要删除指定的源字符,请在替换字符列中输入 0

  3. 重复步骤 1-2 以替换或删除其他字符。

编辑指定的源或目标角色

单击行末尾的 并选择编辑

从表中删除条目

单击行末尾的 并选择删除

替换或删除所选字符集不支持的源字符

使用不支持的源字符(按字符集)表为所选字符集不支持的所有字符定义一个替换字符。

不支持的字符替换操作
进行该操作

定义或编辑替换操作。

  1. 从表中的字符集下拉列表中选择一个字符集。

    所选字符集不支持的任何字符将在目标上替换为下面步骤 2 中指定的字符。

  2. 替换字符列中,单击列中的任意位置,然后指定替换字符。例如,要将所有不支持的字符替换为字母“a”,请输入0061

    信息注释

    要删除所有不支持的字符,请输入0

禁用替换操作。

字符集下拉列表中选择空白条目。

并行加载数据集片段

信息注释此设置不适用于 SaaS 应用程序源,仅适用于源数据库和目标数据库的特定子集。

在满负载期间,您可以通过将数据集拆分为并行加载的段来加速大型数据集的加载。表可以按数据范围、所有分区、所有子分区或特定分区进行拆分。

有关更多信息,请参阅并行复制数据集片段

更多选项

这些选项不会在 UI 中公开,因为它们仅与特定版本或环境相关。因此,除非 Qlik 支持或产品文档明确指示,否则不要设置这些选项。

要设置选项,只需将该选项复制到添加功能名称字段中,然后单击添加。然后根据收到的说明设置该值或启用该选项。

为湖登陆任务调度 CDC

信息注释使用调度器需要可操作角色或可编辑角色。

在以下用例中,您必须定义一个调度间隔,以保持目标数据的最新状态:

  • 不使用 数据移动网关 访问数据源
  • 使用不是 精简版连接器 的 SaaS 应用程序连接器。
  • 当使用按计划选项从SAP OData源捕获更改时。

该计划决定了目标数据集随源数据集的更改而更新的频率。时间表决定了更新频率,而数据集类型决定了更新方法。如果数据集支持 CDC,则只有对该数据集的更改会被检索并传播到相应的目标表。如果数据集不支持 CDC(例如,视图),则将通过重新加载整个数据集来传播更改。使用 SaaS 应用程序连接器,将创建一个单独的任务,能够在入职期间以及稍后在任务的调度设置中安排 CDC 间隔和重新加载间隔。当使用其他连接器类型(例如,数据库)并采用 CDC 更新方法时,如果部分选定数据集支持 CDC 而另一些不支持,将创建两个单独的子任务:一个用于检索对支持 CDC 的数据集的更改,另一个用于重新加载不支持 CDC 的数据集。

更改计划:

  1. 打开您的管道项目,然后执行以下操作之一:

    • 在任务视图中,单击菜单按钮由 3 个水平点组成。 在数据任务上,然后选择 计划
    • 在管道视图中,单击菜单按钮由 3 个垂直点组成。 在数据任务上,然后选择 计划
    • 打开复制任务,然后单击计划工具栏按钮。
  2. 根据需要更改计划设置,然后单击确定
信息注释如果下一个计划运行即将开始时数据任务仍在运行,则将跳过下一个或多个计划运行,直到任务完成。

执行基于数据移动网关的任务的错失运行

有时候,网络问题可能会导致与 数据移动网关 的连接中断。如果在下一次计划运行前没有恢复与 数据移动网关 的连接,数据任务将无法按计划运行。在这种情况下,您可以选择在连接恢复后是否立即执行一次运行。

所有数据移动网关的默认设置Administration活动中心中定义。您可以按如下所述覆盖单个任务的这些设置。

为此

  1. 打开项目,然后执行以下操作之一:

    • 在任务视图中,单击数据任务上的 菜单按钮由 3 个水平点组成。,然后选择 计划

    • 在管道视图中,单击数据任务上的 菜单按钮由 3 个垂直点组成。,然后选择 计划

    • 打开数据任务,然后单击计划工具栏按钮。

    计划 - <task>对话框打开。

  2. 启用为此任务使用自定义设置

  3. 在对话框底部,选择以下其中一个运行错过的计划任务选项。

    • 尽快,然后按计划,如果需要在下一个计划实例之前运行任务

    • 按计划在下一个计划实例运行任务

  4. 保存设置。

另请参阅:执行错过的计划任务运行

本页面有帮助吗?

如果您发现此页面或其内容有任何问题 – 打字错误、遗漏步骤或技术错误 – 请告诉我们!