类型 | 说明 |
源库限制 |
当 MySQL 实例的版本为 5.5 时,只支持结构同步和数据同步,不支持用户初始化。
当 MySQL 的版本小于 8.0 且未开启参数 gtid_mode 时,可能会在数据同步过程中导致外键级联删除失败,从而造成数据差异。
|
目标库限制 | Milvus 引擎版本为 2.5、2.6。 |
其他限制 |
|
数据库 | 结构初始化 | 全量初始化 |
源库 | SELECT 权限 | SELECT 权限 |
目标库 | Root 权限或授予 ClusterAdmin、DatabaseAdmin 和 CollectionAdmin 的 User 权限。 | |
类别 | 参数 | 说明 |
基本信息 | 任务名称 | (可选)自定义同步任务名称。长度需在 256 个字符内。 说明 若未进行设置,系统将按照命名规则,默认生成一个以 dts- 开头命名的任务。 |
| 链路规格 | 按需选择同步任务的链路规格,当前支持 Compact、Medium 和 Standard。 说明 |
| 同步拓扑 | 根据业务需要选择同步拓扑,当前支持单向同步和双向同步。 说明 |
源库配置 | 选择已有数据源 | 您可以按需选择是否使用已录入的实例:
|
| 实例类型 | 选择 MySQL。 |
| 接入方式 | 选择公有网络 MySQL。 说明 在同步公有网络 MySQL 实例时,您需要提前在源端的白名单或安全组策略中,添加 DTS IP 段的访问权限。单击查看 DTS IP 段查看和复制 IP 段。 |
| 地域 | 选择目标实例所属地域。 |
| 主机地址 | 输入目标库自建实例的主机地址。 |
| 端口 | 输入目标自建实例的端口号。 |
| 数据库账号 | 输入目标实例的数据库账号。 |
| 数据库密码 | 输入目标实例数据库账号对应的密码。 |
| 连接方式 | 按需选择非加密连接或 SSL 安全连接,建立更加安全可靠的同步链路。 说明
|
| SSL 加密证书 | 单击上传 SSL 加密证书上传 CA 证书。当连接方式选择了 SSL 安全连接时,支持该配置。 |
| 测试连接 | 单击测试连接,验证是否成功连接实例。 当测试连接失败时,根据失败提示信息修改相关配置后,再次单击测试连接,验证是否可以成功连接实例。具体提示信息如下:
|
目标库配置 | 选择已有数据源 | 当前暂不支持在数据源中录入 Milvus 相关实例信息,您需要配置以下数据库实例信息。 |
| 实例类型 | 选择 Milvus。 |
| 接入方式 | 接入方式选择火山引擎版 Milvus。 |
| 地域 | 按需选择目标实例的地域。 |
| Milvus 实例 | 从下拉列表中选择目标实例,支持模糊搜索。 |
| 数据库账号 | 输入需要进行数据同步的数据库账号。 |
| 数据库密码 | 输入对应账号的密码。 |
| 测试连接 | 单击测试连接,验证是否成功连接实例。 当测试连接失败时,根据失败提示信息修改相关配置后,再次单击测试连接,验证是否可以成功连接实例。具体提示信息如下:
|
Project 与计费 | 项目 | |
| 标签 | (可选)单击添加标签,为实例添加标签。标签可帮您实现云资源的分类、云资源的访问控制、账单与成本分摊等。标签由一个键值对(Key-Value)组成,用于标识云资源,可以帮助您从不同维度(例如用途、所有者等)对具有相同特征的云资源进行分类,便于筛选和聚合,从而轻松管理云上资源。关于标签的详细信息,请参见标签概述。标签的键值对规则如下:
说明
|
| 计费方式 | 按需选择计费方式,当前支持按量计费和包年包月两种计费方式。 说明 |
| 购买时长 | 按需选择包年包月的购买时长。 说明 在计费方式选择包年包月时,支持设置购买时长,同时您还可以勾选到期自动续费,系统会在任务到期前自动续费。 |
参数 | | 说明 |
同步类型 | | 支持选择结构初始化、全量初始化和增量同步。 |
向量化方式 | | 按需选择向量生成的时机和执行方式,取值如下:
|
同步起始点 | | 设置从某个指定位点或时间点拉取 Binlog 日志,取值如下:
说明
|
同步类型选择 | | 选择需要同步的操作类型,当前支持同步 DML 和 DDL 操作语句。具体如下所示:
|
写入方式 | | 按需选择数据写入方式,两种写入方式的区别和适用场景如下。
增量同步依赖源端主键来实现幂等、更新和删除操作。因此,在增量同步场景下,建议目标 Collection 关闭 AutoID。若开启 AutoID,在发生重复消费、UPDATE 或 DELETE 操作时,均可能无法保证数据的最终一致性。 |
同步对象 | | 选择同步对象时,可通过普通搜索/全局搜索(均支持正则表达式)定位目标对象。在已选择对象区域,支持以下操作:
在数据同步过程中,可将文本等非结构化数据实时转为向量,无需额外 ETL,即可在目标库直接支持AI语义搜索、相似推荐等场景。操作步骤:
每张表最多支持 4 个向量化列。
在已选择对象区域的搜索框中,支持模糊搜索定位目标,批量删除不需要的库/表。 |
向量化配置 | 模型 | 在选择向量化方式为将源列数据转换成向量类型时,支持配置向量化配置项。 从下拉列表中选择处理数据的模型,当前仅支持选择 Doubao-embedding-vision。 新版本 Seed-1.6-embedding 图文多模态向量化模型全新上线,主要面向图文多模向量检索的使用场景,支持图片输入及中、英双语文本输入,最长 8K 上下文长度。 |
| 推理接入点 | |
| API Key | |
| 维度 | 从下拉列表中选择 Doubao-embedding-vision 多模态向量化模型的输出向量长度,取值包括 2048 和 1024,建议选择 2048,可保留更丰富的语义信息,适合优先追求检索效果的场景;1024 可降低存储、索引构建和查询资源开销,适合对性能、成本或超大规模数据更敏感的场景。实际检索效果建议结合业务数据评测后确定。 |
异常处理策略 | | 按需设置在数据导入、字段映射或 ETL 过程中,遇到数据类型不匹配、长度超限或格式错误等异常情况时,系统的响应方式,取值如下:
|
高级配置 | 错误重试时间 | 在同步任务中,当源库和目标库断连后导致同步任务失败时,会立即在指定时间内多次重试连接源库和目标库。取值范围:600~86400,单位:秒(s)。默认值为 600 秒。 |