ClickHouse Managed Postgres新入门体验:四步完成实时分析
DataHot 速览
ClickHouse 推出 Managed Postgres 新入门体验,通过四步引导用户从配置 Postgres 到查询操作数据并运行实时分析。该服务将 NVMe 后端的 Postgres 与 ClickHouse 组合为统一数据栈,由全托管复制保持同步,并提供 CLI 快速入门(加载百万行、设置 CDC ClickPipe 等)。目的是让用户通过实际操作数据而非仅看仪表盘来体验数据库价值。
为什么值得关注:ClickHouse 简化了 Postgres 与实时分析组合的落地路径,对构建实时分析栈的从业者有直接参考价值。
本文目录 7 节
译文
AI 逐段翻译ClickHouse 托管版 Postgres 不仅仅是另一个托管 Postgres。它是统一数据堆栈的一半:支持 NVMe 的 Postgres 用于事务性工作负载,ClickHouse 用于实时分析,以及完全托管的复制使两者保持同步。两个数据库,作为一个产品运行。
我们希望用户能够亲身体验这种组合的价值。所以我们问自己:从注册到在自己的数据上体验完整 Postgres + ClickHouse 堆栈的价值,最短路径是什么?
这个问题暴露了现有体验中的一个缺口。
创建 Postgres 服务后,用户会进入概述页面。该页面是为活跃数据库设计的,显示操作指标和活动。但对于刚起步的人来说,一切都是空的:没有活动,没有可探索的数据,也几乎没有下一步该做什么的指示。
与此同时,我们已经为这样的旅程提供了坚实的答案,在我们的文档中。我们的 CLI快速入门指南引导用户完成完整流程:配置 Postgres,加载一百万行数据,设置 CDC ClickPipe,从 ClickHouse 以及通过 pg_clickhouse 从 Postgres 查询复制的表。它精确、可脚本化,并且是我们向高级用户推荐的。
但文档快速入门指南是一个平行的轨道。你在一个标签页阅读,在另一个标签页操作,而产品本身并不知道你处于旅程的哪个阶段。我们希望同样的端到端路径能够在 ClickHouse Cloud 内部存在——有状态,知道用户已经完成的操作,并能引导他们走向下一步,创造价值。
人们如何体验数据库的价值?
我们 ClickHouse 认为数据库是最棒的东西,但也理解它们有时可能有点无聊。我们从过去使用 ClickHouse Cloud 的经验中知道,人们不是通过查看仪表板来体验数据库价值的。他们是通过处理数据来体验的。
这使得将数据导入 Postgres 成为自然的起点。从这里,用户可以运行查询,亲身体验 Postgres,然后看到相同的数据如何轻松流入 ClickHouse 进行实时分析。这成为入门体验的基础。
产品的价值,分四步走
四个使统一数据堆栈成为现实的步骤:
| 步骤 | 用户做什么 | 它证明了什么 |
|---|---|---|
| 1 | 启动一个 Postgres 服务 | NVMe Postgres,几分钟内配置完成 |
| 2 | 迁移或摄取数据 | 通过 ClickPipes 进行完全托管的 Postgres → Postgres 迁移 |
| 3 | 运行你的第一个查询 | 在 SQL 控制台中,对自己数据的原始吞吐量 |
| 4 | 使用 ClickHouse 运行分析 | CDC 到 ClickHouse + pg_clickhouse 作为单一查询层 |
完成这些,你就使用了产品的核心价值。之后的一切都是发现。
步骤 1 — 启动一个 Postgres 服务
配置故意是最无趣的步骤,并确认你的服务已成功创建。你选择云服务提供商和区域、大小、Postgres 版本,然后服务将在几分钟内启动并运行。我们使用 NVMe 存储,这是性能故事的开始。
几分钟后,你就有了一个运行中的数据库,无需再配置任何东西。
步骤 2 — 迁移或摄取数据
如果有一个步骤我们希望每个用户都完成,那就是这一步。数据库只有在有数据后才变得有趣。
大多数人应该从迁移现有 Postgres开始。没有什么比你自己表、自己的查询和访问模式更有说服力了。
因为这是我们相信能带来最大价值的工作流程,我们使“从你的 Postgres 数据库迁移数据”成为入门体验中的一等公民。
ClickPipes作为完全托管的 Postgres 到 Postgres 工作流处理迁移:用户提供连接字符串,ClickPipes 处理快照、发布、复制槽和持续同步。
但并不是每个人都准备好第一天就连接现有数据库。有些用户想先探索产品,而另一些用户只是想要一种快速实验的方式。所以我们提供了将数据导入系统的替代方法:
- 使用你的语言客户端连接 — Postgres 就是 Postgres;使用你已有的驱动。
- 加载示例数据集 — 并在几秒内开始查询
- 从零开始创建表 — 表创建器,快速动手开始。
如果你还不想连接数据库,可以使用多个示例数据集。
步骤 3 — 运行你的第一个查询
一旦数据进入,我们会直接带你到 SQL 控制台,而不是期望你自己找到它。在那里,你可以检查你的表并运行你的第一个查询。
这是第一个真正的“啊哈!”时刻。这是用户停止配置并开始体验产品的点。
如果你不想从空白编辑器开始,我们的 AI 助手可以根据你试图完成的任务帮助生成 SQL。当你刚刚迁移数据并且还不熟悉其模式时,这尤其有用。
步骤 4 — 使用 ClickHouse 运行分析
这是其他托管 Postgres 无法提供的步骤,完整的统一堆栈在此汇聚。
只需点击几下,你就可以配置一个Postgres CDC ClickPipe,它首先将现有的 Postgres 数据复制到 ClickHouse,然后持续复制每次更改。几分钟内,数据流入 ClickHouse,它们之间的延迟不到一分钟。你现在有一个用于操作工作负载的系统,一个用于分析,同步无需自己构建和维护管道。
对于希望完全停留在 Postgres 生态系统的团队,我们还展示了pg_clickhouse 扩展。它允许用户使用熟悉的 PostgreSQL 语法查询 ClickHouse,为他们提供一个跨越两个引擎的单一查询层。
将 ClickHouse 表导入为外部表,Postgres 就成为跨越两个引擎的单一查询层——相同的连接,相同的 SQL,分析查询在 ClickHouse 中执行。即使在 1M 行数据集上,这也快 3–7 倍:五个聚合操作从 555 毫秒降至 164 毫秒,带有聚合的 JOIN 从 1,246 毫秒降至 170 毫秒。差距随规模扩大而增大。
到步骤 4 结束时,您将完整走遍整个统一技术栈——事务性写入、托管 CDC、分析读取——无需您自己组装任何部分。
为动力而设计
我们有意识地让新的入门流程保持简短、可见且以结果为导向。每个完成的步骤都会强化进展感,而剩余的步骤则让终点显得触手可及。
我们还选择将每个步骤描述为结果,而非界面操作。我们没有告诉用户“打开 SQL 控制台”或“配置 CDC”,而是关注我们希望他们完成的目标:
- 启动 Postgres 服务
- 迁移或导入数据
- 运行您的第一个查询
- 使用 ClickHouse 运行分析
我们刻意只设置了四个步骤。增加更多步骤很诱人,但入门不是文档。它的工作不是教授每个功能,而是让用户足够深入地使用产品,使他们能够理解其价值并自行继续探索。
我们正在构建 ClickHouse 托管 Postgres,以提供快速、可靠的 Postgres 体验,并让 ClickHouse 分析功能仅几步之遥。我们新的入门体验旨在帮助您更快达到目标。试试吧,告诉我们您的想法——我们期待您的反馈和意见。
这篇内容对你有用吗?
反馈只用于改善内容筛选,不等同于收藏