跳到主要内容
版本:Next

SmbFile

SMB 文件接收连接器

描述​

将数据输出到 SMB(Server Message Block)文件共享。

提示

如果使用 spark/flink,为了使用此连接器,您必须确保您的 spark/flink 集群已集成 hadoop。已测试的 hadoop 版本为 2.x。

如果使用 SeaTunnel Engine,下载和安装 SeaTunnel Engine 时会自动集成 hadoop jar。您可以检查 ${SEATUNNEL_HOME}/lib 下的 jar 包来确认。

主要特性​

选项​

名称类型必填默认值描述
hoststring是-SMB 服务器主机地址
portint否445SMB 服务器端口
userstring是-SMB 认证用户名
passwordstring否-SMB 认证密码
domainstring否(空)SMB 认证域名(如 WORKGROUP)
sharestring是-要连接的 SMB 共享名称
pathstring是-共享内的目标文件路径
tmp_pathstring否/tmp/seatunnel结果文件将先写入临时路径,然后使用 mv 将临时目录提交到目标目录
file_format_typestring否"csv"支持的文件类型:text, csv, parquet, orc, json, excel, xml, binary
field_delimiterstring否text 为 '\001',csv 为 ','仅在 file_format_type 为 text 和 csv 时使用
row_delimiterstring否"\n"仅在 file_format_type 为 text, csv 和 json 时使用
have_partitionboolean否false是否需要处理分区
partition_byarray否-仅在 have_partition 为 true 时使用
sink_columnsarray否当此参数为空时,所有字段都是 sink 列
is_enable_transactionboolean否true
batch_sizeint否1000000
compress_codecstring否none
common-optionsobject否-
encodingstring否UTF-8仅在 file_format_type 为 text, json, csv, xml 时使用
schema_save_modestring否CREATE_SCHEMA_WHEN_NOT_EXIST已有目录处理方式
data_save_modestring否APPEND_DATA已有数据处理方式
enable_header_writeboolean否false仅在 file_format_type 为 text, csv 时使用。false:不写表头,true:写表头
parquet_avro_write_timestamp_as_int96boolean否false仅在 file_format 为 parquet 时使用
parquet_avro_write_fixed_as_int96array否-仅在 file_format 为 parquet 时使用

示例​

env {
parallelism = 1
job.mode = "BATCH"
}

source {
FakeSource {
schema = {
fields {
name = string
age = int
}
}
}
}

sink {
SmbFile {
host = "192.168.1.100"
port = 445
user = seatunnel
password = pass
domain = "WORKGROUP"
share = "data"
path = "/output/csv"
tmp_path = "/tmp/seatunnel"
file_format_type = "csv"
}
}

更新日志​

next version​

新功能​

  • [Feature] 支持 SMB 文件连接器 (10753)