Evaluating Prediction-based Interventions with Human Decision Makers In Mind - 专知论文

会员服务 ·

0

设计 · 系统 · 情境 · 设计决策 · 偏差 ·

Evaluating Prediction-based Interventions with Human Decision Makers In Mind

翻译：基于人类决策者考量的预测干预评估

Inioluwa Deborah Raji,Lydia Liu

from arxiv, To be presented at AISTATS 2025

Automated decision systems (ADS) are broadly deployed to inform and support human decision-making across a wide range of consequential settings. However, various context-specific details complicate the goal of establishing meaningful experimental evaluations for prediction-based interventions. Notably, current experiment designs rely on simplifying assumptions about human decision making in order to derive causal estimates. In reality, specific experimental design decisions may induce cognitive biases in human decision makers, which could then significantly alter the observed effect sizes of the prediction intervention. In this paper, we formalize and investigate various models of human decision-making in the presence of a predictive model aid. We show that each of these behavioural models produces dependencies across decision subjects and results in the violation of existing assumptions, with consequences for treatment effect estimation. This work aims to further advance the scientific validity of intervention-based evaluation schemes for the assessment of ADS deployments.

翻译：自动化决策系统（ADS）被广泛应用于各类关键场景中，为人类决策提供信息与支持。然而，针对基于预测的干预措施建立有效的实验评估，受到诸多具体情境细节的复杂影响。值得注意的是，当前实验设计依赖于对人类决策行为的简化假设以推导因果估计。实际上，特定的实验设计决策可能诱发人类决策者的认知偏差，从而显著改变预测干预的观测效应量。本文形式化并研究了在预测模型辅助下多种人类决策模型。我们证明，这些行为模型均会在决策对象间产生依赖性，并导致现有假设的违背，进而影响处理效应的估计。本研究旨在进一步提升基于干预的评估方案在ADS部署评估中的科学有效性。

0

相关内容

设计是对现有状的一种重新认识和打破重组的过程，设计让一切变得更美。

《决策支持系统用户界面中的人工智能可解释性水平对提升决策绩效的影响》报告

《决策支持系统用户界面中的人工智能可解释性水平对提升决策绩效的影响》报告

专知会员服务

22+阅读 · 1月19日

用于自动驾驶系统测试的生成式人工智能：综述

用于自动驾驶系统测试的生成式人工智能：综述

专知会员服务

17+阅读 · 2025年8月28日

《人工智能辅助决策中的数据可视化：系统性综述》

《人工智能辅助决策中的数据可视化：系统性综述》

专知会员服务

27+阅读 · 2025年8月22日

因果决策综述

因果决策综述

专知会员服务

51+阅读 · 2025年3月1日

《比较人工智能辅助决策与人类辅助决策之间信任的判断和时间演变》最新109页

《比较人工智能辅助决策与人类辅助决策之间信任的判断和时间演变》最新109页

专知会员服务

42+阅读 · 2024年10月15日

军事决策中的人工智能：支持人类，而非取代人类

军事决策中的人工智能：支持人类，而非取代人类

专知会员服务

63+阅读 · 2024年9月10日

《评估人工智能和辅助自动化指挥与控制决策辅助工具以提高任务效率的分析框架》

《评估人工智能和辅助自动化指挥与控制决策辅助工具以提高任务效率的分析框架》

专知会员服务

137+阅读 · 2023年7月10日

推荐！《预测与判断：为什么人工智能会增加人类在战争中的重要性》2022.2 MIT最新出版，附讲解PPT与video

推荐！《预测与判断：为什么人工智能会增加人类在战争中的重要性》2022.2 MIT最新出版，附讲解PPT与video

专知会员服务

81+阅读 · 2022年5月5日

【AI+军事】附论文+PPT 《多少才算太多？用于提高决策绩效的决策支持系统用户界面中的人工智能可解释性水平》

【AI+军事】附论文+PPT 《多少才算太多？用于提高决策绩效的决策支持系统用户界面中的人工智能可解释性水平》

专知会员服务

21+阅读 · 2022年4月16日

【TPAMI】从人机对抗提出视觉跟踪智能评估新方法，Global Instance Tracking: Locating Target More Like Humans

【TPAMI】从人机对抗提出视觉跟踪智能评估新方法，Global Instance Tracking: Locating Target More Like Humans

专知会员服务

22+阅读 · 2022年3月29日

推荐！《基于人工智能（AI）的空中和导弹防御（AMD）：以结果为导向的辅助决策》美国海军研究生院系统工程顶点报告145页

推荐！《基于人工智能（AI）的空中和导弹防御（AMD）：以结果为导向的辅助决策》美国海军研究生院系统工程顶点报告145页

专知

118+阅读 · 2022年9月1日

推荐！【中文版】《利用人工智能辅助指挥官进行复杂决策》美国海陆空军10位技术专家联合撰写

推荐！【中文版】《利用人工智能辅助指挥官进行复杂决策》美国海陆空军10位技术专家联合撰写

专知

82+阅读 · 2022年8月29日

推荐！【中文版】《人工智能和仿真技术在军事决策中的作用》北约技术报告

推荐！【中文版】《人工智能和仿真技术在军事决策中的作用》北约技术报告

专知

111+阅读 · 2022年8月20日

推荐！【中文版】《人工智能在指挥和控制系统中的决策支持》瑞典国防研究局

推荐！【中文版】《人工智能在指挥和控制系统中的决策支持》瑞典国防研究局

专知

36+阅读 · 2022年7月31日

【开放新书】不确定性决策与强化学习，267页pdf，瑞典查尔姆斯理工大学

【开放新书】不确定性决策与强化学习，267页pdf，瑞典查尔姆斯理工大学

专知

31+阅读 · 2020年4月28日

最新「因果推断Causal Inference」综述论文38页pdf，阿里巴巴、Buffalo、Georgia、Virginia

最新「因果推断Causal Inference」综述论文38页pdf，阿里巴巴、Buffalo、Georgia、Virginia

专知

68+阅读 · 2020年2月11日

自动驾驶技术解读——自动驾驶汽车决策控制系统

自动驾驶技术解读——自动驾驶汽车决策控制系统

智能交通技术

30+阅读 · 2019年7月7日

【预测性维护】预测性维护是边缘计算与人工智能，在工业落地的最短路径？

【预测性维护】预测性维护是边缘计算与人工智能，在工业落地的最短路径？

产业智能官

14+阅读 · 2019年5月5日

深度 | 推荐系统评估

深度 | 推荐系统评估

AI100

24+阅读 · 2019年3月16日

推荐｜机器学习中的模型评价、模型选择和算法选择！

推荐｜机器学习中的模型评价、模型选择和算法选择！

全球人工智能

10+阅读 · 2018年2月5日

群体偏好的敏感性度量方法研究和群决策方法的可实施性评价

国家自然科学基金

0+阅读 · 2017年12月31日

复杂决策环境下面向共识的群体评价模型与方法研究

国家自然科学基金

1+阅读 · 2015年12月31日

基于深度表达和迁移学习的人体检测研究

国家自然科学基金

6+阅读 · 2015年12月31日

基于犹豫模糊语言信息的定性决策理论与方法

国家自然科学基金

2+阅读 · 2015年12月31日

人类双向选择行为的统计特征分析与预测方法研究

国家自然科学基金

1+阅读 · 2015年12月31日

面向大数据的群体偏好决策分析研究

国家自然科学基金

6+阅读 · 2014年12月31日

工程决策中业主乐观偏差的形成、测度及其影响研究

国家自然科学基金

0+阅读 · 2014年12月31日

动态环境下决策单元效率评价方法与应用研究

国家自然科学基金

3+阅读 · 2014年12月31日

多语言大数据环境下的复杂网络行为分析、预测和干预

国家自然科学基金

4+阅读 · 2014年12月31日

不确定环境下强化学习和决策的神经机制

国家自然科学基金

11+阅读 · 2012年12月31日

Real-World AI Evaluation: How FRAME Generates Systematic Evidence to Resolve the Decision-Maker's Dilemma

Arxiv

0+阅读 · 3月17日

When Should Humans Step In? Optimal Human Dispatching in AI-Assisted Decisions

Arxiv

1+阅读 · 3月14日

Constructing Evidence-Based Tailoring Variables for Adaptive Interventions

Arxiv

0+阅读 · 3月9日

Understanding the Effects of AI-Assisted Critical Thinking on Human-AI Decision Making

Arxiv

0+阅读 · 3月2日

AI-Assisted Decision Making with Human Learning

AI-Assisted Decision Making with Human Learning

Arxiv

0+阅读 · 2月19日

Decoding the Human Factor: High Fidelity Behavioral Prediction for Strategic Foresight

Decoding the Human Factor: High Fidelity Behavioral Prediction for Strategic Foresight

Arxiv

0+阅读 · 2月19日

Using predictive multiplicity to measure individual performance within the AI Act

Arxiv

0+阅读 · 2月12日

Constructing Evidence-Based Tailoring Variables for Adaptive Interventions

Arxiv

0+阅读 · 2月10日

Prescriptive Artificial Intelligence: A Formal Paradigm for Auditing Human Decisions Under Uncertainty

Arxiv

0+阅读 · 2月8日

Anticipatory Evaluation of Language Models

Arxiv

0+阅读 · 2月4日

VIP会员

文章信息

相关主题

最新内容

生成式AI基础小册子绪论解读：一条数学地基路线，178页pdf

生成式AI基础小册子绪论解读：一条数学地基路线，178页pdf

专知会员服务

6+阅读 · 5月29日

AutoScientists：自组织智能体团队驱动长期科学实验

AutoScientists：自组织智能体团队驱动长期科学实验

专知会员服务

2+阅读 · 5月29日

《阿利·伯克级驱逐舰的战损修理：桌面推演结果》报告

《阿利·伯克级驱逐舰的战损修理：桌面推演结果》报告

专知会员服务

4+阅读 · 5月29日

战略前沿人工智能的再思考（中文）

战略前沿人工智能的再思考（中文）

专知会员服务

4+阅读 · 5月29日

《量化地基防空系统间接效应的博弈论方法》

《量化地基防空系统间接效应的博弈论方法》

专知会员服务

4+阅读 · 5月29日

传感器网络：美国如何探测来自伊朗的导弹与无人机

传感器网络：美国如何探测来自伊朗的导弹与无人机

专知会员服务

4+阅读 · 5月29日

《无人机战争中的经济不对称：伊朗“沙赫德-136”对抗以色列“铁穹”防御系统的案例研究》

《无人机战争中的经济不对称：伊朗“沙赫德-136”对抗以色列“铁穹”防御系统的案例研究》

专知会员服务

5+阅读 · 5月29日

“史诗怒火行动”中美军损失的作战飞机

“史诗怒火行动”中美军损失的作战飞机

专知会员服务

4+阅读 · 5月29日

ICML 2026 | 理解上下文持续学习中的泛化与遗忘

ICML 2026 | 理解上下文持续学习中的泛化与遗忘

专知会员服务

5+阅读 · 5月28日

Agent Harness综述：大模型智能体执行器工程全景

Agent Harness综述：大模型智能体执行器工程全景

专知会员服务

14+阅读 · 5月28日

审视现代战争中的 AI 赋能杀伤链系统及印度防务的战略要务（中文版）

审视现代战争中的 AI 赋能杀伤链系统及印度防务的战略要务（中文版）

专知会员服务

14+阅读 · 5月28日

分布式作战效能：乌克兰如何在战术层面重新定义火力打击、电子战与防空（中文版）

分布式作战效能：乌克兰如何在战术层面重新定义火力打击、电子战与防空（中文版）

专知会员服务

9+阅读 · 5月28日

马赛克防御与分布式指挥：伊朗的回击（中文版）

马赛克防御与分布式指挥：伊朗的回击（中文版）

专知会员服务

10+阅读 · 5月28日

《基于理论的威慑效能评估》

《基于理论的威慑效能评估》

专知会员服务

8+阅读 · 5月28日

《移动旅级战斗队转型中的支援单元指挥控制挑战》

《移动旅级战斗队转型中的支援单元指挥控制挑战》

专知会员服务

15+阅读 · 5月27日

相关VIP内容

《决策支持系统用户界面中的人工智能可解释性水平对提升决策绩效的影响》报告

《决策支持系统用户界面中的人工智能可解释性水平对提升决策绩效的影响》报告

专知会员服务

22+阅读 · 1月19日

用于自动驾驶系统测试的生成式人工智能：综述

用于自动驾驶系统测试的生成式人工智能：综述

专知会员服务

17+阅读 · 2025年8月28日

《人工智能辅助决策中的数据可视化：系统性综述》

《人工智能辅助决策中的数据可视化：系统性综述》

专知会员服务

27+阅读 · 2025年8月22日

因果决策综述

因果决策综述

专知会员服务

51+阅读 · 2025年3月1日

《比较人工智能辅助决策与人类辅助决策之间信任的判断和时间演变》最新109页

《比较人工智能辅助决策与人类辅助决策之间信任的判断和时间演变》最新109页

专知会员服务

42+阅读 · 2024年10月15日

军事决策中的人工智能：支持人类，而非取代人类

军事决策中的人工智能：支持人类，而非取代人类

专知会员服务

63+阅读 · 2024年9月10日

《评估人工智能和辅助自动化指挥与控制决策辅助工具以提高任务效率的分析框架》

《评估人工智能和辅助自动化指挥与控制决策辅助工具以提高任务效率的分析框架》

专知会员服务

137+阅读 · 2023年7月10日

推荐！《预测与判断：为什么人工智能会增加人类在战争中的重要性》2022.2 MIT最新出版，附讲解PPT与video

推荐！《预测与判断：为什么人工智能会增加人类在战争中的重要性》2022.2 MIT最新出版，附讲解PPT与video

专知会员服务

81+阅读 · 2022年5月5日

【AI+军事】附论文+PPT 《多少才算太多？用于提高决策绩效的决策支持系统用户界面中的人工智能可解释性水平》

【AI+军事】附论文+PPT 《多少才算太多？用于提高决策绩效的决策支持系统用户界面中的人工智能可解释性水平》

专知会员服务

21+阅读 · 2022年4月16日

【TPAMI】从人机对抗提出视觉跟踪智能评估新方法，Global Instance Tracking: Locating Target More Like Humans

【TPAMI】从人机对抗提出视觉跟踪智能评估新方法，Global Instance Tracking: Locating Target More Like Humans

专知会员服务

22+阅读 · 2022年3月29日

热门VIP内容

开通专知VIP会员享更多权益服务

AutoScientists：自组织智能体团队驱动长期科学实验

战略前沿人工智能的再思考（中文）

生成式AI基础小册子绪论解读：一条数学地基路线，178页pdf

《阿利·伯克级驱逐舰的战损修理：桌面推演结果》报告

相关资讯

推荐！《基于人工智能（AI）的空中和导弹防御（AMD）：以结果为导向的辅助决策》美国海军研究生院系统工程顶点报告145页

推荐！《基于人工智能（AI）的空中和导弹防御（AMD）：以结果为导向的辅助决策》美国海军研究生院系统工程顶点报告145页

专知

118+阅读 · 2022年9月1日

推荐！【中文版】《利用人工智能辅助指挥官进行复杂决策》美国海陆空军10位技术专家联合撰写

推荐！【中文版】《利用人工智能辅助指挥官进行复杂决策》美国海陆空军10位技术专家联合撰写

专知

82+阅读 · 2022年8月29日

推荐！【中文版】《人工智能和仿真技术在军事决策中的作用》北约技术报告

推荐！【中文版】《人工智能和仿真技术在军事决策中的作用》北约技术报告

专知

111+阅读 · 2022年8月20日

推荐！【中文版】《人工智能在指挥和控制系统中的决策支持》瑞典国防研究局

推荐！【中文版】《人工智能在指挥和控制系统中的决策支持》瑞典国防研究局

专知

36+阅读 · 2022年7月31日

【开放新书】不确定性决策与强化学习，267页pdf，瑞典查尔姆斯理工大学

【开放新书】不确定性决策与强化学习，267页pdf，瑞典查尔姆斯理工大学

专知

31+阅读 · 2020年4月28日

最新「因果推断Causal Inference」综述论文38页pdf，阿里巴巴、Buffalo、Georgia、Virginia

最新「因果推断Causal Inference」综述论文38页pdf，阿里巴巴、Buffalo、Georgia、Virginia

专知

68+阅读 · 2020年2月11日

自动驾驶技术解读——自动驾驶汽车决策控制系统

自动驾驶技术解读——自动驾驶汽车决策控制系统

智能交通技术

30+阅读 · 2019年7月7日

【预测性维护】预测性维护是边缘计算与人工智能，在工业落地的最短路径？

【预测性维护】预测性维护是边缘计算与人工智能，在工业落地的最短路径？

产业智能官

14+阅读 · 2019年5月5日

深度 | 推荐系统评估

深度 | 推荐系统评估

AI100

24+阅读 · 2019年3月16日

推荐｜机器学习中的模型评价、模型选择和算法选择！

推荐｜机器学习中的模型评价、模型选择和算法选择！

全球人工智能

10+阅读 · 2018年2月5日

相关论文

Real-World AI Evaluation: How FRAME Generates Systematic Evidence to Resolve the Decision-Maker's Dilemma

Arxiv

0+阅读 · 3月17日

When Should Humans Step In? Optimal Human Dispatching in AI-Assisted Decisions

Arxiv

1+阅读 · 3月14日

Constructing Evidence-Based Tailoring Variables for Adaptive Interventions

Arxiv

0+阅读 · 3月9日

Understanding the Effects of AI-Assisted Critical Thinking on Human-AI Decision Making

Arxiv

0+阅读 · 3月2日

AI-Assisted Decision Making with Human Learning

AI-Assisted Decision Making with Human Learning

Arxiv

0+阅读 · 2月19日

Decoding the Human Factor: High Fidelity Behavioral Prediction for Strategic Foresight

Decoding the Human Factor: High Fidelity Behavioral Prediction for Strategic Foresight

Arxiv

0+阅读 · 2月19日

Using predictive multiplicity to measure individual performance within the AI Act

Arxiv

0+阅读 · 2月12日

Constructing Evidence-Based Tailoring Variables for Adaptive Interventions

Arxiv

0+阅读 · 2月10日

Prescriptive Artificial Intelligence: A Formal Paradigm for Auditing Human Decisions Under Uncertainty

Arxiv

0+阅读 · 2月8日

Anticipatory Evaluation of Language Models

Arxiv

0+阅读 · 2月4日

相关基金

群体偏好的敏感性度量方法研究和群决策方法的可实施性评价

国家自然科学基金

0+阅读 · 2017年12月31日

复杂决策环境下面向共识的群体评价模型与方法研究

国家自然科学基金

1+阅读 · 2015年12月31日

基于深度表达和迁移学习的人体检测研究

国家自然科学基金

6+阅读 · 2015年12月31日

基于犹豫模糊语言信息的定性决策理论与方法

国家自然科学基金

2+阅读 · 2015年12月31日

人类双向选择行为的统计特征分析与预测方法研究

国家自然科学基金

1+阅读 · 2015年12月31日

面向大数据的群体偏好决策分析研究

国家自然科学基金

6+阅读 · 2014年12月31日

工程决策中业主乐观偏差的形成、测度及其影响研究

国家自然科学基金

0+阅读 · 2014年12月31日

动态环境下决策单元效率评价方法与应用研究

国家自然科学基金

3+阅读 · 2014年12月31日

多语言大数据环境下的复杂网络行为分析、预测和干预

国家自然科学基金

4+阅读 · 2014年12月31日

不确定环境下强化学习和决策的神经机制

国家自然科学基金

11+阅读 · 2012年12月31日

微信扫码咨询专知VIP会员