Skip to content
Charles Shao
Go back

后 Cookie 身份层:UID2 / RampID 的确定性 ID、Privacy Sandbox 的设备端方案,与第一方数据的三条路

Updated:
views

生态全景里反复出现一句话:第三方 cookie 退场、IDFA 覆盖坍塌,buyeruid 的匹配率随之崩塌。RTA策展的兴起,背后指向的都是这同一个背景。但此前几篇都只是顺带提及它,未曾正面拆解:当浏览器与操作系统不再免费提供一个稳定的用户标识,程序化究竟还靠什么认人?

本文就来正面回答。答案不是「某一个替代品」,而是三条并行的技术路线——它们的哲学、覆盖率与隐私姿态各不相同,今天的程序化栈往往同时押注其中数条。读完你会明白:所谓「身份层」,本质上是一组在覆盖率、隐私、精度这个不可能三角里各自取舍的方案。

范围划界:本文讲身份 / 认人这一层的技术路线。谁在用这些信号(DSP/DMP)见生态全景;用第一方数据在竞价前私有过滤的具体模式见 RTA;App 端归因的隐私冲击(SKAdNetwork)见归因专文。这里聚焦「用什么标识认人」。

TL;DR

Table of contents

Open Table of contents

1. 到底崩了什么:稳定的跨域标识

先精确定义问题。程序化广告长期依赖两类跨域 / 跨应用的稳定标识

它们撑起了三件事:跨站人群匹配DMP 人群包激活)、频次控制归因。而现在:

环境现状
Safari / Firefox第三方 cookie 早已默认屏蔽(ITP / ETP)
Chrome从「默认弃用」转向用户可选——不能再假设它默认可用
iOSATT 把 IDFA 关到极低覆盖,绝大多数用户不授权
AndroidPrivacy Sandbox on Android 推进中,方向类似

结论:你不能再假设 bid request 里有一个跨域稳定、可匹配的用户 ID。 认人这件事必须重建——于是有了下面三条路。

后 Cookie 身份层三条路线全景:顶部灰色问题条「第三方 cookie / IDFA 退场:跨域稳定标识没了」。下方三列并排——左列蓝色「① 确定性 ID(基于登录)」:锚点 email/手机号 → 规范化 → 哈希+加盐 → 可传播 token(UID2 / RampID),标注『覆盖=登录态占比,精度高』;中列紫色「② Privacy Sandbox(设备端)」:浏览器内保存兴趣/人群,Topics 只吐主题、Protected Audience 在浏览器里跑竞价,原始数据不出设备,标注『隐私强,买方可控性降』;右列绿色「③ 第一方数据 + 洁净室」:广告主与媒体各自第一方数据在受控 clean room 里匹配、只出聚合结果,标注『合规精准,但只能聚合、非实时逐人』。底部琥珀色「不可能三角:覆盖率 ↔ 隐私 ↔ 精度,三者难兼得,故同时押注多条」;右下角小字:围墙花园本就是登录态+自有身份,受冲击最小 三条路线不是「三选一的替代品」,而是同时押注的组合。它们落在「覆盖率 / 隐私 / 精度」不可能三角的不同角上:确定性 ID 精度高但只覆盖登录态、Privacy Sandbox 隐私最强但可控性降、洁净室合规精准但只出聚合。没有银弹,是这一层的第一性事实。

2. 路线①:确定性 ID(基于登录)

思路:既然浏览器不再免费给稳定标识,那就用用户主动给出的、天然跨域的标识——登录用的 email / 手机号——作为新锚点。

2.1 UID2:把 email 变成可传播的加密 token

UID2(Unified ID 2.0) 是目前开放网里最有共识的方案(源自 The Trade Desk,现走开源 / 由中立方运营)。它的关键是既用 email 做锚、又不让 email 明文在生态里流动

  1. 用户在某网站登录,给出 email / 手机号
  2. 规范化后做 SHA-256 哈希,得到 hashed identifier;
  3. 经运营方加盐(salt) 处理,生成 raw UID2
  4. 再包装成一个加密、会定期轮换的 UID2 token,在竞价里传播。

好处:token 可在 DSP/SSP 间流通做匹配,但拿到 token 的人反推不出原始 email;用户可通过统一门户一键 opt-out。它的天花板很清楚——只覆盖登录态流量,你有多少登录用户,它就覆盖多少。

2.2 RampID:人本身份图谱

LiveRamp RampID 走的是另一条:它维护一张人本(people-based)身份图谱,把同一个人散落在各处的线上线下标识(email、设备、离线 CRM 等)归并成一个稳定的假名 RampID。它更偏「把碎片拼成人」,常用于把广告主的离线第一方数据接进数字投放。此外还有 ID5、各家 publisher 的自有 ID 等,生态里 ID 是多头并存的。

确定性 ID 这条路的共同软肋:它是登录经济的映射。 登录率高的场景(电商、流媒体、新闻订阅)好用;登录率低的长尾开放网,覆盖依旧稀薄。

3. 路线②:Privacy Sandbox(把事情搬进设备)

Google Privacy Sandbox 的哲学和路线①相反:不要任何跨域标识,把原本靠标识做的事,改成在浏览器 / 设备内部完成,原始数据永不出设备。 两个和广告最相关的 API:

3.1 Topics API:浏览器只吐「兴趣主题」

浏览器自己根据近期浏览历史,算出用户的几个兴趣主题(来自一个公开、有限的主题分类表,如「健身」「旅游」),每周更新,并只向站点透露少数几个主题——不透露具体访问过哪些网站。它替代的是第三方 cookie 做的「兴趣画像」,但把粒度从「精确追踪」粗化到「几个宽泛主题」,以此保护隐私。代价就是精度下降

3.2 Protected Audience(原 FLEDGE):竞价搬进浏览器

再营销(“把加过购物车的人追回来”)过去靠第三方 cookie 跨站识别。Protected Audience 的做法是:

  1. 用户访问广告主站点时,浏览器把他加入一个兴趣组(interest group)存在设备本地
  2. 之后在某个媒体页面要展示广告时,竞价直接在浏览器里跑(on-device auction)——买方事先提供的出价逻辑在本地执行;
  3. 买方拿不到「这个人是谁、来自哪个站」,只拿到「我的某个兴趣组赢了这次曝光」的结果。

对工程的冲击很大:竞价的一部分从服务端挪到了客户端,买方的定向与出价逻辑要能在浏览器沙箱里运行,可观测性和实时控制都大幅降级。它隐私最强,但也最重构现有链路。

4. 路线③:第一方数据 + 数据洁净室

第三条路最保守也最扎实:别再追求「在开放网里认出每一个人」,而是在双方都信任的受控环境里,用各自的第一方数据做匹配和测量。

数据洁净室(data clean room)(Google Ads Data Hub、AWS Clean Rooms、Snowflake 等)是核心载体:广告主的第一方数据和媒体 / 平台的数据,在一个谁都拿不走对方原始明细的环境里做 join,只输出聚合结果(重合人群规模、转化提升、去重触达等)。

它换来合规与精准,代价是只能聚合、不能实时逐人竞价——它更多服务于受众规划与效果测量,而不是「对这一次曝光该不该出价」。所以它常和路线①/②配合:洁净室里学到的东西,再变成路线①的人群或路线②的出价逻辑。

5. 对竞价链路意味着什么

把三条路放到 OpenRTB bid request 的语境里,变化可以一句话概括:那个稳定的 user.id / buyeruid,正在被一束异构信号取代。

过去(cookie 时代)现在(后 cookie)
user.buyeruid 一个稳定 ID加密 token(UID2/RampID)、主题标签、设备端竞价钩子、洁净室聚合模型并存
买方全网逐人匹配人群包登录态走确定性 ID;无登录走 Topics / 上下文;再营销可能被搬进浏览器
频控 / 归因靠同一个 ID每条路各有各的频控与测量口径,需要多口径对齐

工程上的落点是**「多套身份并存 + 优雅降级」**:一次请求进来,先看有没有确定性 token → 没有就退回主题 / 上下文信号 → 再不行退回纯上下文定向。没有哪一条能单独覆盖全部流量,系统必须为「认不出这个人」这件事设计好兜底,而不是假设总能认出。

一个结构性推论:围墙花园(Google/Meta/Amazon/TikTok)内部本就是登录态 + 自有身份体系,cookie 退场对它们几乎无损。开放网越是为「怎么认人」焦头烂额,预算就越向这些自带身份的花园里流——这不是巧合,是隐私新规的结构性副作用。

6. 常见误解 ↔ 正解

常见误解正解
会有一个「替代第三方 cookie」的银弹没有;是三条路线并存 + 降级,各覆盖不同流量与场景
UID2 就是把 email 明文传来传去email 先哈希 + 加盐成 token,拿到 token 反推不出原始 email,且可 opt-out
Privacy Sandbox 只是换个追踪方式它把「认人 / 竞价」搬进设备内部,原始数据不出端,是范式变化不是换皮
Topics 能像 cookie 一样精确画像它只吐少数宽泛主题、每周更新——精度是被有意粗化
数据洁净室能拿来实时逐人竞价它只出聚合结果,服务规划与测量,不做逐次曝光的实时决策
cookie 退场对所有玩家一视同仁围墙花园靠登录态 + 自有身份几乎无损,开放网受冲击最大
有了确定性 ID 就不需要上下文定向了登录态覆盖有限,上下文 / 内容语义定向是无登录长尾的重要兜底

7. 一张速查表

路线 / 概念一句话权衡
确定性 ID(UID2)email/phone → 哈希+盐 → 可传播加密 token精度高,只覆盖登录态
RampID人本身份图谱,归并线上线下标识为假名 ID擅长接离线第一方数据
Topics API浏览器每周吐几个兴趣主题,不吐具体站点隐私强,精度被有意粗化
Protected Audience兴趣组存设备、竞价在浏览器内跑隐私最强,链路重构、可控性降
数据洁净室 clean room双方第一方数据受控匹配,只出聚合合规精准,仅聚合、非实时
不可能三角覆盖率 ↔ 隐私 ↔ 精度,难兼得故需多路并存
竞价链路影响稳定 buyeruid → 一束异构信号 + 优雅降级OpenRTB

一句话收尾:「后 cookie 身份层」不是找一个新 ID,而是接受「没有一个能认出所有人的 ID」这个事实,然后用三条路线各取所长、并为『认不出』设计兜底。 谁的第一方数据 / 登录关系越强,谁在这个新秩序里就越稳——这也解释了预算为何持续向围墙花园集中。


延伸阅读

资料:

附录:术语表


views
Share this post on:

Previous Post
广告 SDK 实战:APP 怎么接入、SDK 怎么实现、Mediation 怎么决策、谁在做 SDK
Next Post
App 广告 SDK 深挖:变现、聚合与 In-App Bidding