Omdia 在最近结束的 IBC 2026 论坛上分享了一组很有意思的数据:电视与手机的数量比值。把它和 Vuer 这家专注 CTV 测量的 Satrtup 正在试图解决的问题放在一起看,会浮现出一个比设备统计更有意思的命题。
Omdia 的数据显示,2025 年全球平均每一台活跃的智能电视背后,平均对应超过 4 台活跃的智能手机。不同市场的差异更有趣(我以后的文章可以单独分享这个观察):美国大约 1.5 台,中国接近 5 台,而部分东南亚、中东和非洲市场甚至达到 7–11 台。
这里需要先澄清一点:这是一个市场宏观层面的活跃设备比值,并不实际表示同一台电视周围同时存在 4 台手机,也不表示电视前有 4 个人。它真正说明的是,智能手机和智能电视在不同市场的渗透与使用,正在形成非常不同的设备关系。但更重要的是,它也提醒我们:智能手机和智能电视虽然都是联网设备,但它们与“人”的关系完全不同。
智能手机是典型的个人设备。一部手机通常对应一个主要使用者,它承载的是个人身份、个人数据和个人行为。而智能电视更接近家庭设备,一台电视通常由家庭成员共同使用,也有可能由个人使用。换句话说,智能手机是一对一的关系,而电视更接近一对多的关系,我想这应该是普遍共识。
也正因为如此,一台智能电视周围存在 4 台、5 台甚至更多智能手机,本身并不直接意味着什么,但它会自然引出一个非常有意思的问题:如果我们知道每台智能电视周围有这么多手机,那么这些手机能不能帮助我们知道,电视前到底有多少人?
很多人看到这里,第一反应可能都是:这不是很简单吗?既然一台手机对应一个人,如果一台电视周围有 4 台手机,那不就大概意味着有 4 个人?看起来很自然的判断,但真正进入测量,就会发现事情没有这么简单。
一台手机并不等于一个电视观众。手机可能放在客厅,但它的主人正在厨房;可能放在沙发上充电,而人已经离开;一个人也可能同时拥有多部手机。反过来,电视前的人也可能根本没有携带手机,尤其是儿童或者老人。更重要的是,“人在电视附近”也不等于“人在看电视”。一个人在沙发上刷手机,电视同时播放 Netflix,他当然可能处于电视的观看环境中,但他的注意力可能完全在手机上。
所以,从手机到观众,中间其实隔着一个非常重要的测量鸿沟:
设备 ≠ 人 ≠ 观众 ≠ 注意力
4+ 台手机背后,其实是两种完全不同的数字关系
因此,1 台手机 ≠ 1 个电视观众,1 台智能电视也 ≠ 1 个观众。这也是为什么我之前分析这张图时用了一个简单的区分:智能手机更围绕身份(Identity)运转,而电视更围绕共享注意力(Shared Attention)运转。
这背后实际上是两种互联网形态。智能手机是高度个人化的个人互联网,它知道“谁”在使用;智能电视则越来越接近家庭互联网,它承载的是一个家庭共同的内容消费和注意力。Omdia 的数据实际上揭示了一个更有价值的结构:每一台智能电视周围,都已经存在一个由多个个人设备构成的数字环境。而这恰好给 CTV 测量提出了一个新的可能性——能不能利用个人设备去理解共享屏幕上到底发生了什么?
电视设备如何数人?Vuer 选择另辟蹊径
其实答案并不难想到:摄像头。如果电视本身带有摄像头,理论上就可以直接观察电视前的环境:有几个人、是否有人在场、是否存在多人共同观看,甚至进一步尝试判断他们是否面向屏幕。从测量的角度来看,这似乎是一条非常直接的路径。
但问题在于,带摄像头的电视目前并不普及。
首先是成本。电视本身就是一个高度成熟、价格竞争激烈的消费电子品类。增加摄像头不只是多一个摄像头模组,还涉及 BOM、结构设计、供应链以及相关软件能力。对于大量价格敏感的电视市场来说,为了受众测量增加一套硬件,是否值得,本身就是一个现实的商业问题。
其次是隐私。电视通常位于家庭最核心的生活空间。如果摄像头持续面对客厅,消费者自然会关心它什么时候工作、采集什么信息、数据是否上传以及谁能够访问。对于 OEM、TV OS 平台、App 发行商和广告主来说,这也意味着更加复杂的用户同意、隐私和数据治理问题。
所以,摄像头确实能够比较直接地解决“电视前有几个人”这个问题,但它同时面临着成本、普及率和隐私等现实障碍。那么问题就变成了:如果不增加摄像头,又有没有办法获得关于电视观众的信息?
这时候,Vuer 的解决方案就变得非常有意思。
Vuer 的思路并不是再给电视增加一双“眼睛”,而是尝试利用用户已经随身携带的手机,把它变成一种额外的感知层。这其实又回到了最开始 Omdia 的那组数据:既然一台智能电视周围本来就已经存在多个个人设备,那么,与其在电视上增加新的硬件,能不能利用这些已经存在的设备,去帮助判断电视前到底发生了什么?
根据 Vuer 的公开介绍,其“可验证观看”(Verified Viewing)方法通过电视端的蓝牙信号,让经过用户同意的手机感知附近的电视,再结合手机的运动传感器、距离、方向等信号,以及针对不同电视环境进行校准的机器学习模型,尝试判断手机是否真正对应一个处于观看环境中的人。具体来说,电视端的蓝牙信号扮演“发射器”的角色,而手机端开启蓝牙的 App 则作为“接收器”来检测房间内的存在。整个测量是被动的——用户只需一次性授权,之后无论 App 是否打开、手机是否锁屏,数据都会在后台持续采集。Vuer 每大约 10 秒采集一次数据,输出接近实时的共同观看(co-viewing)和参与度信号。
这里最值得注意的是:Vuer 并不是简单地数手机。因为它同样需要解决“一台手机不一定等于一个观众”的问题。手机可能在电视附近,但人已经离开;人可能在电视前,但注意力却集中在手机上。因此,它尝试建立的并不是“电视 → 手机数量”这种直接映射,而是:
电视 → 手机信号 → 是否有人在场 → 共同观看
Vuer 目前已经设计了 VV1、VV2 等可验证观看标签,用来表达检测到的单人、双人等观看状态:VV1 表示单人观看,VV2 表示两人,以此类推,甚至还有 VVX 用于识别户外电视环境并创建高价值 deal ID。
Vuer 官网展示的聚合指标也提供了一些参考:每台电视的已验证观众数为 1.67,共同观看率为 39.9%,注意力率为 62.5%,空房间率为 11.4%,内容播放期间用户花在手机上的时间占比约为 29.8%。这些数据来自 31 天、全市场的聚合样本,并且在隐私保护前提下呈现。
Vuer 在 2026 年 2 月获得了行业验证:它被选入 CIMM(Coalition for Innovative Media Measurement,创新媒体测量联盟)2026 年 Startup Program。目前它仍处于概念验证(PoC)阶段,计划在 Q4 启动试验,初期聚焦体育内容,因为体育是最容易产生共同观看的内容类型之一,同时又拥有非常高的版权成本。Vuer 的目标是达到 70% 的渗透率,并希望通过与游戏、音乐、社交等大型移动 App 合作来实现规模化。它的商业模式也是基于效果:从已验证共同观看带来的 CPM 提升中分成,不会收取高额的前期费用。
从“数人”到共同观看,测量的价值开始发生变化
如果这种方法能够在真实的大规模场景中稳定工作,那么它的意义就不仅仅是“帮电视数人数”。因为一旦我们能够更准确地知道一个 CTV 广告展示背后有多少人,共同观看就可能从一个测量指标,进一步变成一个广告技术信号。
传统的 CTV 广告展示,系统通常可以知道智能电视、App、内容、设备以及广告是否完成投放,但如果增加关于在场和共同观看的信息,测量就开始多了一层关于真实受众的描述。一个广告展示背后究竟是一个观众,还是两个人、三个人甚至更多人共同观看,对于广告主理解媒体价值显然并不完全相同。
Vuer 目前公开展示了 VV1、VV2 等可验证观看标签,并进一步提供“每次展示的已验证观众数”“共同观看指数”“第二屏活动”“已验证在场”等信号。换句话说,它试图做的并不只是一个测量仪表盘,而是让共同观看成为可以进入 CTV 广告技术基础设施的信号。
这个问题到底有多大?ThinkTV 委托的一项加拿大研究给出了一个惊人的数字:加拿大电视实际触达的观众比现有测量系统报告的多出 40–60%,这部分差距主要由流媒体环境中的共同观看驱动,代表着每年 10 亿到 17 亿加元未被识别的价值。而在体育和直播赛事领域,低估更加严重——实际观众规模估计比报告数字大 130–200%,对应每年 6 亿到 10 亿加元的未实现影响。
如果这种信号最终能够被 SSP、DSP、Publisher 和广告主们广泛接受,那么 CTV 测量的表达方式可能会发生一些变化。过去我们更多关注的是广告展示:广告有没有播放、播放了多久、在哪台设备上播放。未来则可能进一步增加已验证在场、共同观看、真实曝光等维度。
此外,Vuer 对隐私的处理也值得注意。它明确表示不收集任何个人身份信息、不使用摄像头、麦克风、位置或生物识别数据。电视端只发出一个匿名且不断轮换的 token,所有数据以聚合形式呈现,每个数据点背后至少有 100 人。用户同意在手机端完成。这种“隐私优先设计”的路径,是它能够进入广告技术基础设施的前提条件之一。
当然,这并不意味着这些概念可以直接画等号,因为这里还有一个非常重要的问题:
在场 ≠ 观看 ≠ 注意力
一个人在电视旁边,不代表他正在看电视;一个人在看电视,也不代表他正在看广告;即使他看到了广告,也不意味着广告真正获得了有效注意力。Vuer 尝试区分“专注”和“分心”两种状态:利用手机陀螺仪和运动传感器,基于手机相对电视的位置和方向,来判断用户是否真正关注电视内容。比如手机竖直面对正在滚动屏幕的用户、电视内容同时在播放,与手机屏幕朝下、锁定或闲置在沙发上的状态,对应的注意力信号截然不同。这个思路和 Omdia 关于第二屏的研究非常契合:越来越多的人在看电视的同时使用手机,电视和移动端不是两个独立的媒体环境,而可能是同一个观看会话中的两个屏幕。
因此,真正值得关注的不是“Vuer 能不能数出电视前有几个人”这么浅层的信息,而是它是否能够帮助 CTV 测量建立一条更加完整的链路:
设备 → 在场 → 共同观看 → 注意力
从“手机”推导“人”,中间还有很多问题
当然,这套方法真正有价值的前提,是它能够在大规模真实场景中稳定工作。首先是移动渗透率和用户同意。不是每一个电视观众都拥有一部参与测量的手机,也不是每个人都会授权相关 App 使用蓝牙信号。
Vuer 的目标是达到 70% 的渗透率,其联合创始人、COO/增长负责人 Gary Yentin 认为如果能争取到游戏、音乐、社交等大型移动 App 的合作,这个目标是可以实现的。他特别指出,在 70% 的渗透率下,Vuer 的测量规模将远超现有最大的样本组——全球最大的样本组大约只有 3,000–5,000 人。为了加速 App 的合作规模,Vuer 还计划与 Magnite、PubMatic 等 SSP 合作,通过它们聚合的移动 App 生态实现级联效应。
其次是设备与人的映射。一个人可能拥有两部手机,一部手机也可能被多人使用;儿童可能正在看电视,却没有自己的手机。Yentin 坦承这是一个限制:家庭中的年轻成员如果没有手机或没有授权 App,就不会被测量覆盖。再进一步,检测到了手机,并不意味着手机主人就在电视前——手机可能放在桌子上充电,人已经去了另一个房间。Vuer 的“逐台电视机器学习模型”正是为了解决这个问题:它针对每台电视的环境进行单独校准,融合运动传感器遥测数据来区分真正的共同观看者和那些在走廊里、楼上或隔壁的人,并持续清除误报。但即便如此,在场、共同观看和注意力本质上是三个不同的问题,不能简单等同。
因此,从手机信号推导人是否在场,本质上是一个推断问题。测量需要通过多个信号去判断一个设备究竟是否对应一个真实的观众,以及这个观众是否真的处于共同观看环境中。这也是为什么在场、共同观看和注意力必须被区分开来。在场解决的是“人在不在附近”;共同观看解决的是“有多少人共同参与观看”;注意力则进一步解决“这些人在多大程度上真正关注屏幕”。每往后一步,测量难度都会提高。
另一个关键变量是消费者同意率。Vuer 目前仍处于概念验证阶段,其另外一个联合创始人 Omar Delgado 明确表示:“我们想知道用户主动授权率会是多少”——他们目前还没有这个数据,将在未来六个月密切观察。这是一个非常诚实的表态:再精妙的技术,如果消费者不愿意授权,就无法规模化。因此,类似 Vuer 这样的方案,更现实的定位可能是现有测量系统的补充,而不是替代样本组、ACR 或其他普查级数据。它真正需要证明的,也不是“可以检测到手机”,而是:这种手机信号能否经过校准,稳定地转化成一个市场能够接受的受众信号。
而一旦这种受众信号能够被市场接受,下一个问题自然就来到了商业价值:广告主是否愿意为了已验证的共同观看支付更高的 CPM?如果答案是肯定的,那么测量就开始从单纯的“测量”进入收益优化。因为到了这一步,共同观看不再只是一个研究指标,而可能成为影响媒体定价和广告收益的变量。
Nielsen 21.5 亿美元收购 DoubleVerify:测量行业变局下的多重博弈
Vuer 并非孤例。2026 年以来,整个 CTV 测量行业都在重新洗牌。Google 将“Total Co-view”(总共同观看)定义纳入 Google Ads API;Nielsen 把基于可穿戴设备的共同观看纳入其“大数据 + 样本组”体系,通过戴在样本用户手腕上的设备捕捉电视音频,实现更被动的测量;Viant Technology 收购 TVision Insights 之后,推出“注意力校准 CPM”(Attention-adjusted CPM)——这是一种基于已验证的室内在场、共同观看和眼球注视屏幕的注意力,而非已投放展示来定价 CTV 和线性电视库存的指标。
这些动作说明,行业正在从多个方向同时逼近同一个问题:到底有多少真实的人在看,以及他们的注意力值多少钱。
从设备到人,CTV 测量正在进入下一阶段
我们重新回到 Omdia 在 IBC 上展示的那张图,它的意义就不只是设备数量之间的关系了。
它当然说明不了“一台电视前面坐着 4 个人”,但它点出了一件事:每台智能电视所处的家里,本来就摆着一堆个人设备。智能手机更接近个人身份,智能电视更接近共享屏幕。而这些个人设备,未来可能成为连接设备、人和注意力的一层新的测量信号。
顺着这条线往下走,能看到一个逐层递进的链条:设备说明屏幕上在放什么,在场说明有没有人,共同观看说明有几个人一起看,注意力说明他们看得专不专心,而最终的转化,才说明这份注意力到底值多少钱。
这其实也是 CTV 和传统数字媒体很不一样的地方。在移动互联网里,我们习惯了“一台设备 → 一个用户”的逻辑;但在电视世界里,我们面对的是“一块屏幕 → 多人多设备”。
放在传统电视时代,这个问题根本不用想。一家人坐在电视机前,人在,就是在看。等智能设备进了客厅,这层默认关系才被打散——于是 CTV 测量绕了一大圈,难点又回到了最原始的地方:屏幕前到底有没有人、有几个人、他们看得有多专心。
这一点也印证了我之前对智能电视的判断:它正在从一台联网设备,慢慢长成一个家庭平台。操作系统控制入口,主屏(Home Screen)控制分发,内容驱动使用,注意力创造价值,数据支撑测量,广告最终完成变现。
从设备,到人,再到注意力,这大概才是 CTV 测量下一程真正的看点。
本文来源:【探显家Attention】公众号
版权归原作者所有,仅用于分享交流
2026年10月29-30日,诚邀您相聚江西南昌。让思想先于趋势,用实践回应未来,在每一次能力涌现中寻找机遇,在每一次时代争流中定义未来。
责任编辑:赵莹
24小时热文
流 • 视界
专栏文章更多
- [探显家] 智能电视背后4台手机:Vuer破解大屏共看测量难题 2026-09-23
- [常话短说] 【曝】某地广电与邮政合体! 2026-09-23
- [勾正科技] 勾正科技【内容营销监播功能】上线|Uni-content 2.0 2026-09-22
- [常话短说] 【解局】广电如何答好公共文化服务“十五五”答卷 2026-09-22
- [勾正科技] 2026暑期OTT数据曝光:630亿小时点播,内容进入“分众爆点”时代 2026-09-22






