从 Pinecone 迁移至 Zilliz Cloud
Pinecone 是一款支持相似搜索的向量数据库。将数据从 Pinecone 迁移至 Zilliz Cloud,可以增强稠密和稀疏向量的管理能力,同时利用 Zilliz Cloud 高性能的搜索与分析能力。
注意事项
-
在将数据从 Pinecone 迁移至 Zilliz Cloud 时,向量字段会直接迁移,而 Pinecone 的元数据字段将以 JSON 格式存储在 Zilliz Cloud 的动态字段中。有关动态字段功能的详细信息,请参阅Dynamic Field。
-
本迁移仅支持 Pinecone 的 Serverless Index。
-
每次迁移任务仅限于单个源 Index。如果有多个源 Index,可为每个 Index 单独设置迁移任务。
开始前
-
Pinecone Index 必须能够通过公网访问。
-
如果您的网络环境配置了白名单列表,请确保将 Zilliz Cloud 的 IP 地址添加到其中。要了解更多信息,请参考 Zilliz Cloud IP。
-
已获取访问目标 Pinecone 项目的 API 密钥。
-
已在 Zilliz Cloud 中获得组织管理员或项目管理员权限。如果您没有相关权限,请联系您的 Zilliz Cloud 管理员。
-
确保目标集群的 CU 容量足以容纳源数据。要估算所需的 CU 规格,请使用计算器。
从 Pinecone 迁移至 Zilliz Cloud

您可以将源数据迁移到任何版本类型的 Zilliz Cloud 集群,只要其计算单元(CU)大小能够满足源数据的存储需求。
登录 Zilliz Cloud 控制台。
进入目标项目,选择数据迁移 > Pinecone。
在连接数据源步骤中,输入访问目标 Pinecone 项目的 API 密钥,然后点击下一步。
阅读 Authentication 文档将帮助您获取所需的连接信息。
在选择迁移来源和目标步骤中,配置源 Pinecone Index 和 Zilliz Cloud 集群设置,点击下一步。
每个从 Pinecone 迁移的源 Index 必须包含一个向量字段。
在配置 Schema 步骤中:
-
在 Schema 预览中,确认 Pinecone Index 与 Zilliz Cloud Collection 之间的字段映射。
📘说明-
Auto ID 禁用且无法修改。
-
Pinecone 的记录 ID 将映射为 Zilliz Cloud 中的主键字段,数据类型为
VARCHAR,最大长度为 1 至 65,535 字节。在插入或 Upsert 数据时,确保VARCHAR字段长度在此取值范围内。 -
您可以重命名字段,但不支持修改字段的数据类型。
-
-
在高级设置中,确认动态列和 Partition Key 的设置:
-
动态列:默认启用且不可修改。它用于存储源 Index 的元数据字段。
-
Partition Key:默认启用。启用后,Zilliz Cloud 会将 Pinecone 的 Namespace 映射到 Partition Key;禁用后,则会将其映射到 Partition。建议保持此功能启用。在此状态下,
namespace会作为目标 Collection Schema 中的标量字段,数据类型为VARCHAR。更多信息,请参考管理 Partition 和使用 Partition Key。
-
-
在目标 Collection 名称和描述中,自定义目标 Collection 的名称和描述。Collection 名称在每个集群中必须唯一。如果名称与现有 Collection 重复,请重命名 Collection。
点击迁移。
查看迁移进度
生成迁移任务后,您可前往任务中心查看任务状态和进度。如果迁移任务的状态从进行中变更为成功,则代表迁移成功。
迁移完成后,请验证目标集群中的 collection 和 entity 数量是否与数据源一致。如果发现不一致,请删除缺失 entity 的 collection 并重新进行迁移。

取消迁移任务
如果迁移过程遇到任何问题,您可以采取以下步骤进行故障排除并恢复迁移: