⌘CtrlK
Appearance
Appearance
用于将数据写入 StarRocks 数据库。
提示
点击对应表的【目标表参数】按钮展开的配置项,完成配置后必须点击弹窗底部的【保存配置】按钮才能保存各自表的配置参数。
| 配置名称 | 数据类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| 节点名称 | String | 是 | StarRocks | 当前创建的节点名称,由用户自定义且不可为空。命名可包含字母、数字、下划线。确保唯一性。 |
| 节点编码 | String | 是 | 自动生成 | 当前创建的节点编码,以此标识此组件,由用户自定义且不可为空。命名可包含字母、数字、下划线。确保唯一性。 |
| 选择数据源 | String | 是 | - | 从下拉选项中选择列出的当前项目已经关联的数据源。 |
| 选择库 | String | 是 | - | 从下拉列表中选择数据库。 |
| 表添加模式 | String | 否 | 表不存在时创建 | 有四种: - 重新创建表 - 表不存在时创建 - 表不存在时报告错误 - 忽略对表的处理 |
| 选择表 | String | 是 | - | 从下拉列表中选择数据表。 |
| 数据添加模式 | String | 否 | 追加数据 | 支持四种模式: 1、追加数据:数据统一追加到目标表中; 2、同步前删除数据:先清空目标表数据,然后再给目标表添加数据; 3、当存在数据时,报告错误:当目标表存在相同数据时,报告错误,不会添加数据。 4、自定义处理:用户可以自定义写SQL的方式进行处理。 |
| 自定义SQL | 当「数据添加模式」为「自定义处理」时,执行的自定义SQL(如TRUNCATE TABLE)。 | |||
| 大小写转换模式 | String | 否 | 不转换 | 支持三种配置: - 不转换:目标表与来源表的表名、字段名大小写一致; - 转大写:将目标表的表名、字段名转换为大写; - 转小写:将目标表的表名、字段名转换为小写。 |
| 流加载标签前缀 | String | 否 | - | StarRocks Stream Load (流加载)导入作业的标签的前缀。用于任务级别去重与事务管理。 |
| 批量提交最大缓存行数 | String | 否 | 1024 | 对于批处理写入,当缓冲区数达到 batch_max_rows 数或 batch_max_bytes 字节大小或时间达到 batch_interval_ms 时,数据将被刷新到StarRocks中。 |
| 批量提交最大缓存 | Int | 否 | 5 | 对于批处理写入,当缓冲区数达到 batch_max_rows 数或 batch_max_bytes 字节大小或时间达到 batch_interval_ms 时,数据将被刷新到 StarRocks 中。 |
| 最大重试次数 | Int | 否 | 0 | 失败的最大重试次数。 |
| 重试乘数 | Int | 否 | 0 | 用作产生下一个重试延迟的乘数,详细说明参考:http://beginners-java.blogspot.com/2015/03/customize-volley-default-retry-policy.html |
| 重试等待时间 | Int | 否 | 0 | 尝试重试 StarRocks 请求之前等待的时间。 |
| 启用upsert语法支持 | Boolean | 否 | 否 | 是否启用 upsert/delete,只支持 PrimaryKey 模式。 false: |
| 可选参数 | Map | 否 | - | 可以根据需求进行配置。可选参数名称可以参考 Seatunnel 官方手册。 json 格式如: { "starrocks.config": "{ "format" :"JSON", "strip_outer_array": true }" } |
表添加模式为“重新创建表”和“表不存在时创建”,【获取表】后,可以点击每张表后的【目标表参数】按钮分别为表配置更多的参数,具体如下:
| 配置名称 | 数据类型 | 是否必填 | 默认值 | 描述 |
|---|---|---|---|---|
| 名称 | String | 是 | - | 表名称。 |
| 建表类型 | String | 是 | 明细表 | 三种类型:主键表、明细表、聚合表、更新表。 |
| 自定义模板 | Boolean | 否 | 否 | 是否启用自定义模板的开关。启用后可以自己定义模板内容。 |
| 选择分桶键字段 | List | 否 | - | 从下拉列表中选择表字段作为分桶键。 |
| 建表模板 | String | 否 | - | 自 v3.1.0 起,StarRocks 支持明细表进行随机分桶(默认分桶方式)。在建表和新增分区时可以不设置哈希分桶键(即 DISTRIBUTED BY HASH 子句)。在 v3.1.0 之前,StarRocks 仅支持哈希分桶。您在建表和新增分区时必须设置哈希分桶键(即 DISTRIBUTED BY HASH 子句),否则建表失败。 |
1. 写入机制:缓存 + Stream Load
2. 一致性语义:至少一次
3. CDC变更数据同步
4. Schema自动管理