欧洲企业服务市场迎来一项新的客户数据平台部署方案。Zeotap宣布推出Open CDP,一种完全运行在开源计算层之上、并部署于客户自有湖仓(lakehouse)之上的可组合客户数据平台(CDP)部署方式。该产品面向欧洲受监管企业,允许其在自身司法管辖区内运行完整的客户数据平台,底层不依赖任何专有数据仓库。
根据Zeotap公布的信息,Open CDP在客户自有对象存储上,使用开源Apache Spark进行大规模身份解析、受众计算与激活,数据以开源Apache Iceberg表的形式存储,并通过客户已有的数据目录进行治理。整个架构不包含专有仓库,不将数据复制到供应商的云环境中,也不收取按信用额(per-credit)计算的算力费用。Zeotap表示,这一部署方式为企业带来的实际收益包括更强的控制力、数据主权与驻留合规能力,以及更可预测的总拥有成本(TCO)。
Zeotap此前推出的InfraFlex平台已支持企业在打包式、可组合式及混合式部署模型之间灵活选择,可运行在Google BigQuery、Snowflake、Databricks、Amazon Redshift等数据仓库之上。此次发布的Open CDP进一步填补了仓库原生可组合CDP长期未能覆盖的空白,即面向受监管欧洲企业的数据主权与驻留需求。可组合CDP虽然将客户数据保留在客户自己的仓库中并就地激活,但仍需租用完整的云数据仓库来执行计算任务。这种架构将企业绑定在单一供应商的云平台上,将持续的受众计算按量计费,且无法满足严格的数据驻留或主权要求。Open CDP声称消除了这些限制。
在架构设计上,Open CDP强调每一层均可由客户自主选择,而非继承捆绑式依赖。计算引擎层采用开源Apache Spark,运行在裸金属计算资源上,用于大规模身份解析、受众计算和激活,不依赖专有运行时。存储层使用客户自有湖仓,用户画像、身份图谱、事件、计算特征和分群成员关系均以开源Apache Iceberg表的形式存储在客户拥有的兼容对象存储中,任何引擎均可读取。目录层支持客户自带现有目录,平台与客户已有目录联邦,而非强制推行新目录,发布时支持Databricks Unity Catalog、Google Cloud、Snowflake及开源Unity Catalog,治理权限保留在客户已有的管理体系中。部署层可由Zeotap或合作伙伴运营,客户可选择由Zeotap代为运营计算资源以获得全托管体验,也可在自身或合作伙伴的基础设施上运行以获得最大控制权。
在这一开放底座之上,Open CDP提供完整的CDP功能,包括身份解析、受众与分群构建、计算特征、旅程编排、反向ETL激活,以及面向受监管B2C场景的同意管理与PII治理。
从行业角度看,客户数据平台市场近年来经历了从打包式CDP向可组合CDP的演进。可组合架构的核心思路是将数据保留在客户的数据仓库中,避免数据复制带来的成本和合规风险。然而,这一模式仍依赖商业云数据仓库作为计算底座,导致企业在数据主权、成本可预测性和供应商锁定方面面临新的约束。Zeotap此次将计算层替换为开源Apache Spark、存储层替换为客户自有湖仓中的Iceberg表,实质上把可组合CDP的开放程度从“数据不搬移”推进到“计算不租用、目录不替换、治理不外移”。
对于受GDPR及欧盟数据主权要求约束的欧洲企业而言,这一方案提供了在自有基础设施上运行完整CDP的选项,同时保留全托管部署的灵活性。其按开源组件构建、不收取按量算力费用的模式,也可能对现有商业CDP的定价结构形成压力。不过,该方案的实际落地效果,仍取决于企业在裸金属计算资源上的运维能力,以及开源Spark与Iceberg在持续受众计算场景下的性能表现。Zeotap未披露Open CDP的具体客户数量或定价细节。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。