将 HubSpot 数据导出到 Amazon Redshift
上次更新时间: 2026年9月4日
摘要
使用 HubSpot 应用商店中的 Amazon Redshift 应用,将 HubSpot CRM 对象、关联和事件导出到 Amazon Redshift。您可以选择要导出的数据、配置同步计划,并从 HubSpot 监控同步活动。
本文介绍了如何安装和连接该应用、配置数据导出同步,以及监控或管理同步。
请注意: 如果您是 超级管理员,您可以将您的账户加入“改进版 Amazon Redshift 集成”测试版。
开始之前
了解系统要求
请确保您具备以下条件:
- 一个已连接到您的 HubSpot 账户,并配置为可访问您的 AWS 账户的 AWS 身份与访问管理 (IAM) 角色。
- 一个 HubSpot 可以访问的 Amazon Redshift 预配置集群或无服务器工作组。
- 用于暂存临时 Parquet 文件的 Amazon S3 存储桶。该存储桶必须位于与您的 Redshift 集群或无服务器工作组相同的 AWS 区域中。
- HubSpot 会将临时 Parquet 文件复制到已配置的 Amazon S3 中转存储桶中,且不会删除这些文件。若要清除旧文件并控制存储成本,请在您的 AWS 账户中创建一条 S3 生命周期规则。
- 一位 Redshift 管理员,能够对目标数据库执行一次性的 SQL 授权操作。
- 需具备访问 HubSpot 和 AWS 控制台的权限。建议在不同的标签页中分别打开这两个控制台。
了解限制和注意事项
- 每次同步都会生成所选数据的完整快照。
- 每次同步都会覆盖目标表。在 Redshift 中添加的任何表级权限或设置在两次同步之间都不会被保留。
- 您可以通过选择要包含的对象、关联和事件来控制导出的数据量。
- 如果同步失败,下一次计划的同步将自动再次尝试进行完整同步。
安装并连接 Amazon Redshift 应用
- 在HubSpot 应用市场中,打开 Amazon Redshift 应用的列表页面。
- 选择与您的 HubSpot 账户关联的 AWS 角色。
- 点击“安装”。
- 点击“下一步”。
- 创建一个与您的 HubSpot 账户关联且已配置为可访问您的 AWS 账户的 AWS IAM 角色。
- 输入该角色的 Amazon 资源名称 (ARN)。
- 点击“连接到 Amazon Redshift”。
配置您的 AWS 角色
HubSpot 将使用该关联的 AWS 角色,将临时 Parquet 文件写入您的 S3 中转存储桶,并将其加载到 Redshift 中。
- 在“S3 存储桶 URL”字段中,输入 HubSpot 将用于暂存临时 Parquet 文件的 S3 存储桶的 URL。
您可以在 URL 中添加前缀,以限制对存储桶内特定路径的访问。该存储桶必须位于与您的 Redshift 集群或无服务器工作组相同的 AWS 区域中。
请注意:HubSpot 会按设计将 Parquet 文件复制到配置的 S3 中转存储桶,且不会删除这些文件。请在 AWS 中创建 S3 生命周期规则,以自动删除较旧的文件。
- 从下拉菜单中选择您的 Redshift 部署类型:
- Redshift 无服务器
- 预配置集群
- 根据您的部署类型,更新已连接的 AWS 角色的权限策略:
- Redshift 无服务器:输入您的工作组 ARN。HubSpot 将生成一份包含该 ARN 的策略。复制该策略并将其附加到已连接的 AWS 角色上。
- 预配置集群:复制策略模板。将
YOUR_REGION、YOUR_ACCOUNT_ID、YOUR_CLUSTER_ID和YOUR_DATABASE替换为您 AWS 账户中的相应值,然后将该策略附加到已连接的 AWS 角色上。
- 在 AWS IAM 中,打开与 HubSpot 关联的角色。
- 将生成的权限策略关联到该角色,或使用该策略内容创建内联策略。

- 在同一 AWS IAM 角色中,使用 HubSpot 生成的声明更新信任策略。
HubSpot 会根据您选择的 Redshift 部署类型生成不同的信任策略语句。

将 AWS 角色与 Redshift 关联
在 Amazon Redshift 中,将上一节中更新的同一 AWS 角色与您的 Redshift 配置关联。
- Redshift Serverless:打开与 HubSpot 配合使用的命名空间的命名空间配置页面。在“安全和加密”选项卡中,单击“管理 IAM 角色”,然后选择“关联 IAM 角色”。
- 预配置集群:打开您的集群,点击“操作”,然后选择“管理 IAM 角色”>“关联 IAM 角色”。

授予 Redshift 权限
- 在 HubSpot 中,选择目标数据库。
- 请 Redshift 管理员在所选数据库中运行该 SQL 脚本。
HubSpot 将利用此权限在同步过程中为目标数据库创建模式。
- 点击“测试连接”。
- 如果连接测试成功,请点击“下一步”。
配置数据导出同步
- 选择要导出的数据源。
- 选择要包含的对象、关联和事件表。
- 配置同步频率和开始时间。
- 点击“开始同步”。
每次同步运行都会将所选数据的完整快照导出到 Amazon Redshift。
监控和管理同步
在同步详细信息页面上,您可以查看以下信息:
- 同步状态。
- 上次同步时间。
- 错误。
- 同步活动。
- 同步历史记录。
要打开同步详情页面:
- 在您的 HubSpot 账户中,导航至“数据管理”>“数据集成”。
- 在“应用同步”选项卡中,搜索 Amazon Redshift 应用同步。
- 点击您要查看的 Amazon Redshift 同步项。
在同步详情页面,您还可以执行以下操作:
- 点击“暂停”以暂停同步。
- 点击“归档”以将同步归档。
- 点击“立即同步”以手动启动同步。
同步状态
| 状态 | 描述 |
|---|---|
| 正在同步 | 同步正在进行中。 |
| 已同步 | 最近一次同步已成功完成。 |
| 失败 | 最近一次同步运行遇到错误。 |
| 已归档 | 同步配置已被归档或删除。 |
解决同步故障
当同步失败时:
- 同步在 HubSpot 中显示“失败”状态。
- 各表的详细信息会显示哪些表同步成功或失败。
- 下次计划的同步将自动再次尝试进行完整同步。
- 您可以点击“立即同步”手动启动另一次同步。
