Scalable Network-Aware Experiment Design for Two-Sided Marketplaces - 专知论文

会员服务 ·

0

溢出 · 偏差 · 网络感知 · 设计 · 结构 ·

Scalable Network-Aware Experiment Design for Two-Sided Marketplaces

翻译：可扩展的网络感知实验设计用于双边市场

Measuring causal effects in networked two-sided marketplaces is challenging due to treatment interference between market participants on different sides. When treatment is applied to one side (e.g., job seekers), their interactions with the other side (e.g., job posters) introduce spillover effects that violate the Stable Unit Treatment Value Assumption (SUTVA) and bias causal estimates. While cluster-based randomization mitigates this problem, prior approaches struggle with a fundamental trade-off: reducing spillover requires isolated clusters that will reduce the number of qualifying clusters, which decreases statistical power. This paper introduces EgoCluster V3, an iterative clustering algorithm that reduces spillover by 3x compared to prior versions while preserving node coverage and doubling test power. We further introduce MultiEgoCluster, which extends V3 through a two-stage procedure that first groups highly connected egos into multi-ego clusters before applying the iterative clustering algorithm. This achieves an additional ~56% spillover reduction and ~38% increase in sample size. Both methods are deployed in production at LinkedIn and have systematically enabled high-impact two-sided marketplace experiments. Since residual bias cannot be fully eliminated through clustering alone, we derive a theoretical bias correction method for average treatment effect (ATE) estimation based on graph structure and propose an approach to generalize results to the general population.

翻译：在具有网络结构的双边市场中，由于不同侧市场参与者之间的实验处理干扰，衡量因果效应面临挑战。当对其中一侧（如求职者）施加实验处理时，其与另一侧（如招聘方）的交互会引入溢出效应，违反稳定单元处理值假设（SUTVA）并导致因果估计偏差。虽然基于聚类的随机化能缓解该问题，但现有方法难以平衡根本性权衡：减少溢出需要隔离性强的聚类，但这会减少合格聚类数量，从而降低统计功效。本文提出EgoCluster V3，一种迭代聚类算法，与前代版本相比可将溢出效应降低3倍，同时保持节点覆盖率并提升两倍统计效力。我们进一步提出MultiEgoCluster，通过两阶段流程扩展V3：先通过高度连接的自我节点构建多自我聚类，再应用迭代聚类算法。该方法额外实现约56%的溢出效应降低和38%的样本量增加。两种方法已在LinkedIn生产环境中部署，系统性地支撑了高影响力的双边市场实验。由于聚类方法无法完全消除残余偏差，我们推导了基于图结构的平均处理效应（ATE）理论偏差校正方法，并提出将结果推广至总体的通用方案。

0

相关内容

随机网络效用最大化在战略排队系统中的博弈论方法

随机网络效用最大化在战略排队系统中的博弈论方法

专知会员服务

11+阅读 · 4月13日

【博士论文】扩展可扩展会话推荐的边界

【博士论文】扩展可扩展会话推荐的边界

专知会员服务

13+阅读 · 2025年8月5日

《战场物联网中边缘设备：基于大语言模型的自然语言交互》

《战场物联网中边缘设备：基于大语言模型的自然语言交互》

专知会员服务

29+阅读 · 2025年6月15日

《人机团队增强现实与虚拟现实用户界面设计中共享态势感知指南与指标开发》165页

《人机团队增强现实与虚拟现实用户界面设计中共享态势感知指南与指标开发》165页

专知会员服务

31+阅读 · 2025年4月8日

【博士论文】生成流网络：理论与结构学习的应用

【博士论文】生成流网络：理论与结构学习的应用

专知会员服务

22+阅读 · 2025年2月2日

可解释高效异构图卷积网络，Interpretable and Efficient Heterogeneous Graph Convolutional Network

可解释高效异构图卷积网络，Interpretable and Efficient Heterogeneous Graph Convolutional Network

专知会员服务

63+阅读 · 2020年7月12日

异质信息网络分析与应用综述，软件学报-北京邮电大学

异质信息网络分析与应用综述，软件学报-北京邮电大学

专知会员服务

64+阅读 · 2020年7月9日

因果关联学习，Causal Relational Learning

因果关联学习，Causal Relational Learning

专知会员服务

185+阅读 · 2020年4月21日

使用图卷积网络对多药副作用进行建模（Modeling polypharmacy side effects with graph convolutional networks）

使用图卷积网络对多药副作用进行建模（Modeling polypharmacy side effects with graph convolutional networks）

专知会员服务

36+阅读 · 2019年12月12日

Aspect-Oriented Syntax Network for Aspect-Based Sentiment Analysis，中山大学数据科学与计算机学院权小军教授，第八届全国社会媒体处理大会SMP2019

Aspect-Oriented Syntax Network for Aspect-Based Sentiment Analysis，中山大学数据科学与计算机学院权小军教授，第八届全国社会媒体处理大会SMP2019

专知会员服务

19+阅读 · 2019年10月22日

基于图神经网络的聚类研究与应用

基于图神经网络的聚类研究与应用

THU数据派

10+阅读 · 2020年5月29日

最新「因果推断Causal Inference」综述论文38页pdf，阿里巴巴、Buffalo、Georgia、Virginia

最新「因果推断Causal Inference」综述论文38页pdf，阿里巴巴、Buffalo、Georgia、Virginia

专知

68+阅读 · 2020年2月11日

【AAAI2020论文】用于视觉对话中深度视觉理解的自适应双向编码模型—DualVD, 中科院信工所于静等

【AAAI2020论文】用于视觉对话中深度视觉理解的自适应双向编码模型—DualVD, 中科院信工所于静等

专知

20+阅读 · 2019年11月24日

苏宁易购基于机器学习预测流量波动趋势的实践经验

苏宁易购基于机器学习预测流量波动趋势的实践经验

AI前线

15+阅读 · 2019年10月17日

论文浅尝 | 一种用于多关系问答的可解释推理网络

论文浅尝 | 一种用于多关系问答的可解释推理网络

开放知识图谱

18+阅读 · 2019年5月21日

【论文笔记和代码梳理】RippleNet：基于知识图谱的用户偏好传播

【论文笔记和代码梳理】RippleNet：基于知识图谱的用户偏好传播

专知

42+阅读 · 2019年4月9日

知识在检索式对话系统的应用

知识在检索式对话系统的应用

微信AI

32+阅读 · 2018年9月20日

推荐系统、风控模型、知识图谱，竟然都可以用网络挖掘来实现

推荐系统、风控模型、知识图谱，竟然都可以用网络挖掘来实现

数据分析

13+阅读 · 2018年8月15日

【论文推荐】最新六篇目标跟踪相关论文—双重Siamese网络、判别性相关滤波、多目标跟踪、深度多尺度时空判别性、综述、显著性增强

【论文推荐】最新六篇目标跟踪相关论文—双重Siamese网络、判别性相关滤波、多目标跟踪、深度多尺度时空判别性、综述、显著性增强

专知

34+阅读 · 2018年2月27日

SCENE-一个可扩展两层级新闻推荐系统

SCENE-一个可扩展两层级新闻推荐系统

全球人工智能

11+阅读 · 2018年1月7日

基于在线双向拍卖的运输服务市场交易策略研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于唯象分析的社会经济网络演化机理研究

国家自然科学基金

0+阅读 · 2015年12月31日

复杂市场环境下多阶段不等面积设施动态布局优化研究

国家自然科学基金

0+阅读 · 2015年12月31日

任意网络中的可分数据处理研究

国家自然科学基金

0+阅读 · 2015年12月31日

试验设计中的模型选择

国家自然科学基金

6+阅读 · 2014年12月31日

报价人的行为实验和拍卖机制的可实施性研究

国家自然科学基金

0+阅读 · 2014年12月31日

线上渠道交互对线下渠道绩效的影响：基于双路径的理论和实证研究

国家自然科学基金

0+阅读 · 2014年12月31日

半参数面板数据交互固定效应模型的理论与应用研究

国家自然科学基金

0+阅读 · 2014年12月31日

跨网络社会学习对移动用户创新扩散的影响研究

国家自然科学基金

0+阅读 · 2014年12月31日

多语言大数据环境下的复杂网络行为分析、预测和干预

国家自然科学基金

4+阅读 · 2014年12月31日

Quasi-randomization tests for network interference: a random graph approach

Arxiv

0+阅读 · 6月10日

Causal clustering: design of cluster experiments under network interference

Arxiv

0+阅读 · 6月10日

Operationalizing Property-Based Testing for Data-Intensive Scalable Computing Systems

Arxiv

0+阅读 · 6月9日

An Estimator-Robust Design for Augmenting Randomized Controlled Trials with External Real-World Data

Arxiv

0+阅读 · 6月8日

Synthesizing Evidence: Data-Pooling as a Tool for Treatment Selection in Online Experiments

Arxiv

0+阅读 · 6月6日

Design-based edge-level causal inference with machine learning assisted covariate adjustment

Arxiv

0+阅读 · 5月31日

Design-Based Anytime-Valid Inference for Randomized Experiments with Delayed Outcomes and Staggered Entry

Arxiv

0+阅读 · 5月29日

Heterogeneous Multi-Agent Modeling for Measurement and Network Analysis of the Data Service Market

Arxiv

0+阅读 · 5月22日

Multi-Dimensional Matching in Market Design

Arxiv

0+阅读 · 5月19日

Estimation and Inference in Boundary Discontinuity Designs: Location-Based Methods

Arxiv

0+阅读 · 5月14日

VIP会员

文章信息

相关主题

最新内容

美国从乌克兰无人机战争中学习经验

美国从乌克兰无人机战争中学习经验

专知会员服务

6+阅读 · 6月21日

ICML 2026 | 面向视觉语言模型的语义鲁棒性认证

ICML 2026 | 面向视觉语言模型的语义鲁棒性认证

专知会员服务

3+阅读 · 6月21日

综述 | 智能体电子设计自动化：从“交接有效性”重新理解Agentic EDA

综述 | 智能体电子设计自动化：从“交接有效性”重新理解Agentic EDA

专知会员服务

5+阅读 · 6月21日

深入解读 Palantir AIP：全球最具争议的人工智能平台究竟如何运作

深入解读 Palantir AIP：全球最具争议的人工智能平台究竟如何运作

专知会员服务

19+阅读 · 6月20日

ICML 2026 | 多任务贝叶斯上下文学习：让 Transformer 在测试时显式适应新先验

ICML 2026 | 多任务贝叶斯上下文学习：让 Transformer 在测试时显式适应新先验

专知会员服务

5+阅读 · 6月19日

ACL 2026综述 | 大规模手语数据集：资源、基准与标注标准

ACL 2026综述 | 大规模手语数据集：资源、基准与标注标准

专知会员服务

8+阅读 · 6月19日

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

专知会员服务

7+阅读 · 6月18日

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

专知会员服务

9+阅读 · 6月18日

《廉价自杀式无人机战争的军事战略影响：乌克兰和伊朗案例研究》

《廉价自杀式无人机战争的军事战略影响：乌克兰和伊朗案例研究》

专知会员服务

13+阅读 · 6月18日

《面向反无人机作战的联邦式可解释射频–光电/红外情报融合：边缘人工智能优化、电子战韧性及分布式监视验证》

《面向反无人机作战的联邦式可解释射频–光电/红外情报融合：边缘人工智能优化、电子战韧性及分布式监视验证》

专知会员服务

12+阅读 · 6月18日

ICML 2026 | FR3D：解耦自车运动的未来动态三维重建世界模型

ICML 2026 | FR3D：解耦自车运动的未来动态三维重建世界模型

专知会员服务

8+阅读 · 6月17日

【伯克利博士论文】迈向可扩展与自我演进的大语言模型智能体

【伯克利博士论文】迈向可扩展与自我演进的大语言模型智能体

专知会员服务

13+阅读 · 6月17日

学习数据的几何：形状空间分析数学综述

学习数据的几何：形状空间分析数学综述

专知会员服务

10+阅读 · 6月17日

《现代防空系统综述：架构、传感器、拦截器及新兴威胁环境对基础设施受限防御环境的影响》2026最新长综述

《现代防空系统综述：架构、传感器、拦截器及新兴威胁环境对基础设施受限防御环境的影响》2026最新长综述

专知会员服务

24+阅读 · 6月17日

定向能反无人机系统最新发展动态

定向能反无人机系统最新发展动态

专知会员服务

12+阅读 · 6月17日

相关VIP内容

随机网络效用最大化在战略排队系统中的博弈论方法

随机网络效用最大化在战略排队系统中的博弈论方法

专知会员服务

11+阅读 · 4月13日

【博士论文】扩展可扩展会话推荐的边界

【博士论文】扩展可扩展会话推荐的边界

专知会员服务

13+阅读 · 2025年8月5日

《战场物联网中边缘设备：基于大语言模型的自然语言交互》

《战场物联网中边缘设备：基于大语言模型的自然语言交互》

专知会员服务

29+阅读 · 2025年6月15日

《人机团队增强现实与虚拟现实用户界面设计中共享态势感知指南与指标开发》165页

《人机团队增强现实与虚拟现实用户界面设计中共享态势感知指南与指标开发》165页

专知会员服务

31+阅读 · 2025年4月8日

【博士论文】生成流网络：理论与结构学习的应用

【博士论文】生成流网络：理论与结构学习的应用

专知会员服务

22+阅读 · 2025年2月2日

可解释高效异构图卷积网络，Interpretable and Efficient Heterogeneous Graph Convolutional Network

可解释高效异构图卷积网络，Interpretable and Efficient Heterogeneous Graph Convolutional Network

专知会员服务

63+阅读 · 2020年7月12日

异质信息网络分析与应用综述，软件学报-北京邮电大学

异质信息网络分析与应用综述，软件学报-北京邮电大学

专知会员服务

64+阅读 · 2020年7月9日

因果关联学习，Causal Relational Learning

因果关联学习，Causal Relational Learning

专知会员服务

185+阅读 · 2020年4月21日

使用图卷积网络对多药副作用进行建模（Modeling polypharmacy side effects with graph convolutional networks）

使用图卷积网络对多药副作用进行建模（Modeling polypharmacy side effects with graph convolutional networks）

专知会员服务

36+阅读 · 2019年12月12日

Aspect-Oriented Syntax Network for Aspect-Based Sentiment Analysis，中山大学数据科学与计算机学院权小军教授，第八届全国社会媒体处理大会SMP2019

Aspect-Oriented Syntax Network for Aspect-Based Sentiment Analysis，中山大学数据科学与计算机学院权小军教授，第八届全国社会媒体处理大会SMP2019

专知会员服务

19+阅读 · 2019年10月22日

热门VIP内容

开通专知VIP会员享更多权益服务

ICML 2026 | 面向视觉语言模型的语义鲁棒性认证

深入解读 Palantir AIP：全球最具争议的人工智能平台究竟如何运作

美国从乌克兰无人机战争中学习经验

综述 | 智能体电子设计自动化：从“交接有效性”重新理解Agentic EDA

相关资讯

基于图神经网络的聚类研究与应用

基于图神经网络的聚类研究与应用

THU数据派

10+阅读 · 2020年5月29日

最新「因果推断Causal Inference」综述论文38页pdf，阿里巴巴、Buffalo、Georgia、Virginia

最新「因果推断Causal Inference」综述论文38页pdf，阿里巴巴、Buffalo、Georgia、Virginia

专知

68+阅读 · 2020年2月11日

【AAAI2020论文】用于视觉对话中深度视觉理解的自适应双向编码模型—DualVD, 中科院信工所于静等

【AAAI2020论文】用于视觉对话中深度视觉理解的自适应双向编码模型—DualVD, 中科院信工所于静等

专知

20+阅读 · 2019年11月24日

苏宁易购基于机器学习预测流量波动趋势的实践经验

苏宁易购基于机器学习预测流量波动趋势的实践经验

AI前线

15+阅读 · 2019年10月17日

论文浅尝 | 一种用于多关系问答的可解释推理网络

论文浅尝 | 一种用于多关系问答的可解释推理网络

开放知识图谱

18+阅读 · 2019年5月21日

【论文笔记和代码梳理】RippleNet：基于知识图谱的用户偏好传播

【论文笔记和代码梳理】RippleNet：基于知识图谱的用户偏好传播

专知

42+阅读 · 2019年4月9日

知识在检索式对话系统的应用

知识在检索式对话系统的应用

微信AI

32+阅读 · 2018年9月20日

推荐系统、风控模型、知识图谱，竟然都可以用网络挖掘来实现

推荐系统、风控模型、知识图谱，竟然都可以用网络挖掘来实现

数据分析

13+阅读 · 2018年8月15日

【论文推荐】最新六篇目标跟踪相关论文—双重Siamese网络、判别性相关滤波、多目标跟踪、深度多尺度时空判别性、综述、显著性增强

【论文推荐】最新六篇目标跟踪相关论文—双重Siamese网络、判别性相关滤波、多目标跟踪、深度多尺度时空判别性、综述、显著性增强

专知

34+阅读 · 2018年2月27日

SCENE-一个可扩展两层级新闻推荐系统

SCENE-一个可扩展两层级新闻推荐系统

全球人工智能

11+阅读 · 2018年1月7日

相关论文

Quasi-randomization tests for network interference: a random graph approach

Arxiv

0+阅读 · 6月10日

Causal clustering: design of cluster experiments under network interference

Arxiv

0+阅读 · 6月10日

Operationalizing Property-Based Testing for Data-Intensive Scalable Computing Systems

Arxiv

0+阅读 · 6月9日

An Estimator-Robust Design for Augmenting Randomized Controlled Trials with External Real-World Data

Arxiv

0+阅读 · 6月8日

Synthesizing Evidence: Data-Pooling as a Tool for Treatment Selection in Online Experiments

Arxiv

0+阅读 · 6月6日

Design-based edge-level causal inference with machine learning assisted covariate adjustment

Arxiv

0+阅读 · 5月31日

Design-Based Anytime-Valid Inference for Randomized Experiments with Delayed Outcomes and Staggered Entry

Arxiv

0+阅读 · 5月29日

Heterogeneous Multi-Agent Modeling for Measurement and Network Analysis of the Data Service Market

Arxiv

0+阅读 · 5月22日

Multi-Dimensional Matching in Market Design

Arxiv

0+阅读 · 5月19日

Estimation and Inference in Boundary Discontinuity Designs: Location-Based Methods

Arxiv

0+阅读 · 5月14日

相关基金

基于在线双向拍卖的运输服务市场交易策略研究

国家自然科学基金

0+阅读 · 2015年12月31日

基于唯象分析的社会经济网络演化机理研究

国家自然科学基金

0+阅读 · 2015年12月31日

复杂市场环境下多阶段不等面积设施动态布局优化研究

国家自然科学基金

0+阅读 · 2015年12月31日

任意网络中的可分数据处理研究

国家自然科学基金

0+阅读 · 2015年12月31日

试验设计中的模型选择

国家自然科学基金

6+阅读 · 2014年12月31日

报价人的行为实验和拍卖机制的可实施性研究

国家自然科学基金

0+阅读 · 2014年12月31日

线上渠道交互对线下渠道绩效的影响：基于双路径的理论和实证研究

国家自然科学基金

0+阅读 · 2014年12月31日

半参数面板数据交互固定效应模型的理论与应用研究

国家自然科学基金

0+阅读 · 2014年12月31日

跨网络社会学习对移动用户创新扩散的影响研究

国家自然科学基金

0+阅读 · 2014年12月31日

多语言大数据环境下的复杂网络行为分析、预测和干预

国家自然科学基金

4+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员