Automated Modernization of Machine Learning Engineering Notebooks for Reproducibility - 专知论文

会员服务 ·

0

笔记本电脑 · 可复现性 · 复现性 · 机器学习 · 软件 ·

Automated Modernization of Machine Learning Engineering Notebooks for Reproducibility

翻译：机器学习工程笔记本的自动化现代化改造以实现可复现性

Bihui Jin,Kaiyuan Wang,Pengyu Nie

Interactive computational notebooks (e.g., Jupyter notebooks) are widely used in machine learning engineering (MLE) to program and share end-to-end pipelines, from data preparation to model training and evaluation. However, environment erosion-the rapid evolution of hardware and software ecosystems for machine learning-has rendered many published MLE notebooks non-reproducible in contemporary environments, hindering code reuse and scientific progress. To quantify this gap, we study 12,720 notebooks mined from 79 popular Kaggle competitions: only 35.4% remain reproducible today. Crucially, we find that environment backporting, i.e., downgrading dependencies to match the submission time, does not improve reproducibility but rather introduces additional failure modes. To address environment erosion, we design and implement MLEModernizer, an LLM-driven agentic framework that treats the contemporary environment as a fixed constraint and modernizes notebook code to restore reproducibility. MLEModernizer iteratively executes notebooks, collects execution feedback, and applies targeted fixes in three types: error-repair, runtime-reduction, and score-calibration. Evaluated on 7,402 notebooks that are non-reproducible under the baseline environment, MLEModernizer makes 5,492 (74.2%) reproducible. MLEModernizer enables practitioners to validate, reuse, and maintain MLE artifacts as the hardware and software ecosystems continue to evolve.

翻译：交互式计算笔记本（例如Jupyter笔记本）在机器学习工程中广泛用于编程和共享端到端流水线，涵盖从数据准备到模型训练与评估的全过程。然而，环境侵蚀——机器学习硬件与软件生态系统的快速演进——已导致许多已发布的机器学习工程笔记本在当代环境中无法复现，阻碍了代码重用与科学进展。为量化这一差距，我们研究了从79场热门Kaggle竞赛中挖掘的12,720个笔记本：目前仅有35.4%保持可复现性。关键的是，我们发现环境回退（即降级依赖项以匹配提交时的版本）不仅无法提升可复现性，反而会引入额外的故障模式。为解决环境侵蚀问题，我们设计并实现了MLEModernizer，这是一个以大型语言模型驱动的智能体框架，它将当代环境视为固定约束，通过现代化改造笔记本代码以恢复可复现性。MLEModernizer迭代执行笔记本，收集执行反馈，并实施三类针对性修复：错误修复、运行时优化与分数校准。在基线环境下不可复现的7,402个笔记本上评估，MLEModernizer成功使5,492个（74.2%）笔记本恢复可复现性。MLEModernizer使从业者能够在硬件与软件生态系统持续演进的过程中，有效验证、重用和维护机器学习工程制品。

0

相关内容

笔记本电脑

笔记本电脑

是一种小型、可以方便携带的个人电脑.通常拥有液晶显示器（液晶屏），现在新式的有触摸屏。除了键盘以外，有些还装有触控板（touchpad）或触控点作为定位设备。

什么是Machine Unlearning?悉尼科大等最新《机器遗忘》综述，36页pdf详述其技术体系

什么是Machine Unlearning?悉尼科大等最新《机器遗忘》综述，36页pdf详述其技术体系

专知会员服务

66+阅读 · 2023年6月7日

【干货书】机器学习练习册，211页pdf，Exercises in Machine Learning

【干货书】机器学习练习册，211页pdf，Exercises in Machine Learning

专知会员服务

111+阅读 · 2022年10月5日

【Manning新书】机器学习工程实战，Machine Learning Engineering in Action

【Manning新书】机器学习工程实战，Machine Learning Engineering in Action

专知会员服务

68+阅读 · 2022年4月26日

【干货书】《Transformers 机器学习:深度探究》，Transformers for Machine Learning A Deep Dive

【干货书】《Transformers 机器学习:深度探究》，Transformers for Machine Learning A Deep Dive

专知会员服务

473+阅读 · 2022年4月21日

【干货书】优化与机器学习，Optimization and Machine Learning Optimization for Machine Learning and Machine Learning for Optimization

【干货书】优化与机器学习，Optimization and Machine Learning Optimization for Machine Learning and Machine Learning for Optimization

专知会员服务

40+阅读 · 2022年4月8日

【简明书】机器学习用例书册，76页pdf，The Big Book of Machine Learning Use Cases

【简明书】机器学习用例书册，76页pdf，The Big Book of Machine Learning Use Cases

专知会员服务

67+阅读 · 2021年12月22日

【Manning新书】TensorFlow机器学习，454页pdf

【Manning新书】TensorFlow机器学习，454页pdf

专知会员服务

104+阅读 · 2021年11月14日

【2020新书】机器学习概念与PythonJupyter本环境使用Tensorflow 2.0，301页pdf

【2020新书】机器学习概念与PythonJupyter本环境使用Tensorflow 2.0，301页pdf

专知会员服务

96+阅读 · 2020年9月24日

【干货书】面向工程师的机器学习简介：理论、算法、概念全覆盖，206页pdf

【干货书】面向工程师的机器学习简介：理论、算法、概念全覆盖，206页pdf

专知会员服务

113+阅读 · 2020年6月13日

Andriy又一力作新书「机器学习工程」，177页pdf带你实战机器学习工程项目

Andriy又一力作新书「机器学习工程」，177页pdf带你实战机器学习工程项目

专知会员服务

127+阅读 · 2020年1月15日

【2022新书】使用Scikit-Learn、Keras和TensorFlow实践机器学习:构建智能系统的概念、工具和技术第三版

【2022新书】使用Scikit-Learn、Keras和TensorFlow实践机器学习:构建智能系统的概念、工具和技术第三版

专知

15+阅读 · 2022年11月8日

【干货书】《Transformers 机器学习:深度探究》，284页pdf

【干货书】《Transformers 机器学习:深度探究》，284页pdf

专知

72+阅读 · 2022年4月21日

【2020必看书】TinyML-微型化机器学习，149页pdf，在超低功耗微控制器上用TensorFlow Lite实现机器学习

【2020必看书】TinyML-微型化机器学习，149页pdf，在超低功耗微控制器上用TensorFlow Lite实现机器学习

专知

46+阅读 · 2020年2月19日

【2020新书】图机器学习，Graph-Powered Machine Learning

【2020新书】图机器学习，Graph-Powered Machine Learning

专知

76+阅读 · 2020年1月27日

【UMD开放经典书】机器学习课程简明书，19章227页pdf，带你学习ML

【UMD开放经典书】机器学习课程简明书，19章227页pdf，带你学习ML

专知

46+阅读 · 2019年12月9日

概述自动机器学习（AutoML）

概述自动机器学习（AutoML）

人工智能学家

19+阅读 · 2019年8月11日

【综述】自动机器学习AutoML最新65页综述，带你了解最新进展

【综述】自动机器学习AutoML最新65页综述，带你了解最新进展

中国人工智能学会

48+阅读 · 2019年5月3日

【机器学习】机器学习工业领域应用

【机器学习】机器学习工业领域应用

产业智能官

11+阅读 · 2018年10月23日

Jupyter Notebook的三大短板，都被这个新工具补齐了

Jupyter Notebook的三大短板，都被这个新工具补齐了

量子位

71+阅读 · 2018年9月10日

机器学习必备手册

机器学习必备手册

机器学习研究会

19+阅读 · 2017年10月24日

复杂环境下机器学习的理论研究

国家自然科学基金

21+阅读 · 2015年12月31日

分布式工业自动化系统可重构混合计算模型研究

国家自然科学基金

4+阅读 · 2015年12月31日

面向人类工作记忆改善的脑电复杂网络信息反馈非线性计算模型研究

国家自然科学基金

0+阅读 · 2015年12月31日

非结构环境下基于三维肢体动作理解的工业机器人交互技术研究

国家自然科学基金

1+阅读 · 2015年12月31日

基于非易失内存设备的数据读写性能优化方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

面向智能穿戴设备的三维图形网格简化与渐进显示方法

国家自然科学基金

1+阅读 · 2015年12月31日

工业过程动态数据的多模型在线重构研究

国家自然科学基金

1+阅读 · 2015年12月31日

极限学习机拓展研究及其在近红外光谱分析中的应用

国家自然科学基金

1+阅读 · 2014年12月31日

基于逆向强化学习和人工智能的移动机器人自主学习方法研究

国家自然科学基金

12+阅读 · 2013年12月31日

开放动态环境下在线机器学习理论与方法

国家自然科学基金

11+阅读 · 2013年12月31日

Memory, Benchmark & Robots: A Benchmark for Solving Complex Tasks with Reinforcement Learning

Arxiv

0+阅读 · 3月4日

Self-adapting Robotic Agents through Online Continual Reinforcement Learning with World Model Feedback

Arxiv

0+阅读 · 3月4日

Inline Visualization and Manipulation of Real-Time Hardware Log for Supporting Debugging of Embedded Programs

Arxiv

0+阅读 · 3月4日

Runtime-Augmented LLMs for Crash Detection and Diagnosis in ML Notebooks

Arxiv

0+阅读 · 2月20日

What makes an Expert? Comparing Problem-solving Practices in Data Science Notebooks

Arxiv

0+阅读 · 2月17日

A Multi-Agent Framework for Code-Guided, Modular, and Verifiable Automated Machine Learning

Arxiv

0+阅读 · 2月15日

Self-Augmented Robot Trajectory: Efficient Imitation Learning via Safe Self-augmentation with Demonstrator-annotated Precision

Arxiv

0+阅读 · 2月11日

Automating Computational Reproducibility in Social Science: Comparing Prompt-Based and Agent-Based Approaches

Arxiv

0+阅读 · 2月9日

Learning to Continually Learn via Meta-learning Agentic Memory Designs

Arxiv

0+阅读 · 2月8日

Machine Unlearning: A Survey

Arxiv

16+阅读 · 2023年6月6日

VIP会员

文章信息

相关主题

笔记本电脑

最新内容

ICML 2026 | 多任务贝叶斯上下文学习：让 Transformer 在测试时显式适应新先验

ICML 2026 | 多任务贝叶斯上下文学习：让 Transformer 在测试时显式适应新先验

专知会员服务

0+阅读 · 今天15:26

ACL 2026综述 | 大规模手语数据集：资源、基准与标注标准

ACL 2026综述 | 大规模手语数据集：资源、基准与标注标准

专知会员服务

0+阅读 · 今天15:19

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

专知会员服务

4+阅读 · 6月18日

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

专知会员服务

5+阅读 · 6月18日

《廉价自杀式无人机战争的军事战略影响：乌克兰和伊朗案例研究》

《廉价自杀式无人机战争的军事战略影响：乌克兰和伊朗案例研究》

专知会员服务

11+阅读 · 6月18日

《面向反无人机作战的联邦式可解释射频–光电/红外情报融合：边缘人工智能优化、电子战韧性及分布式监视验证》

《面向反无人机作战的联邦式可解释射频–光电/红外情报融合：边缘人工智能优化、电子战韧性及分布式监视验证》

专知会员服务

9+阅读 · 6月18日

ICML 2026 | FR3D：解耦自车运动的未来动态三维重建世界模型

ICML 2026 | FR3D：解耦自车运动的未来动态三维重建世界模型

专知会员服务

6+阅读 · 6月17日

【伯克利博士论文】迈向可扩展与自我演进的大语言模型智能体

【伯克利博士论文】迈向可扩展与自我演进的大语言模型智能体

专知会员服务

9+阅读 · 6月17日

学习数据的几何：形状空间分析数学综述

学习数据的几何：形状空间分析数学综述

专知会员服务

7+阅读 · 6月17日

《现代防空系统综述：架构、传感器、拦截器及新兴威胁环境对基础设施受限防御环境的影响》2026最新长综述

《现代防空系统综述：架构、传感器、拦截器及新兴威胁环境对基础设施受限防御环境的影响》2026最新长综述

专知会员服务

13+阅读 · 6月17日

定向能反无人机系统最新发展动态

定向能反无人机系统最新发展动态

专知会员服务

7+阅读 · 6月17日

从燃煤战舰到算法战争：水面指挥的永恒要求

从燃煤战舰到算法战争：水面指挥的永恒要求

专知会员服务

6+阅读 · 6月17日

《短程弹道再入飞行器拦截时间中的一项异常现象》

《短程弹道再入飞行器拦截时间中的一项异常现象》

专知会员服务

8+阅读 · 6月17日

《基于回归方法与任务上下文的对抗环境动态战术网络报文优先级排序》

《基于回归方法与任务上下文的对抗环境动态战术网络报文优先级排序》

专知会员服务

8+阅读 · 6月17日

美智库《战术级指挥控制的迫切要求：构建弹性机动式指挥控制网络》报告

美智库《战术级指挥控制的迫切要求：构建弹性机动式指挥控制网络》报告

专知会员服务

9+阅读 · 6月17日

相关VIP内容

什么是Machine Unlearning?悉尼科大等最新《机器遗忘》综述，36页pdf详述其技术体系

什么是Machine Unlearning?悉尼科大等最新《机器遗忘》综述，36页pdf详述其技术体系

专知会员服务

66+阅读 · 2023年6月7日

【干货书】机器学习练习册，211页pdf，Exercises in Machine Learning

【干货书】机器学习练习册，211页pdf，Exercises in Machine Learning

专知会员服务

111+阅读 · 2022年10月5日

【Manning新书】机器学习工程实战，Machine Learning Engineering in Action

【Manning新书】机器学习工程实战，Machine Learning Engineering in Action

专知会员服务

68+阅读 · 2022年4月26日

【干货书】《Transformers 机器学习:深度探究》，Transformers for Machine Learning A Deep Dive

【干货书】《Transformers 机器学习:深度探究》，Transformers for Machine Learning A Deep Dive

专知会员服务

473+阅读 · 2022年4月21日

【干货书】优化与机器学习，Optimization and Machine Learning Optimization for Machine Learning and Machine Learning for Optimization

【干货书】优化与机器学习，Optimization and Machine Learning Optimization for Machine Learning and Machine Learning for Optimization

专知会员服务

40+阅读 · 2022年4月8日

【简明书】机器学习用例书册，76页pdf，The Big Book of Machine Learning Use Cases

【简明书】机器学习用例书册，76页pdf，The Big Book of Machine Learning Use Cases

专知会员服务

67+阅读 · 2021年12月22日

【Manning新书】TensorFlow机器学习，454页pdf

【Manning新书】TensorFlow机器学习，454页pdf

专知会员服务

104+阅读 · 2021年11月14日

【2020新书】机器学习概念与PythonJupyter本环境使用Tensorflow 2.0，301页pdf

【2020新书】机器学习概念与PythonJupyter本环境使用Tensorflow 2.0，301页pdf

专知会员服务

96+阅读 · 2020年9月24日

【干货书】面向工程师的机器学习简介：理论、算法、概念全覆盖，206页pdf

【干货书】面向工程师的机器学习简介：理论、算法、概念全覆盖，206页pdf

专知会员服务

113+阅读 · 2020年6月13日

Andriy又一力作新书「机器学习工程」，177页pdf带你实战机器学习工程项目

Andriy又一力作新书「机器学习工程」，177页pdf带你实战机器学习工程项目

专知会员服务

127+阅读 · 2020年1月15日

热门VIP内容

开通专知VIP会员享更多权益服务

ACL 2026综述 | 大规模手语数据集：资源、基准与标注标准

综述 | 周期表视角下的大模型推理：范式、方法与失败模式

ICML 2026 | 多任务贝叶斯上下文学习：让 Transformer 在测试时显式适应新先验

ICML 2026 Spotlight | SmoothSMoE：解析稀疏 MoE 路由不连续

相关资讯

【2022新书】使用Scikit-Learn、Keras和TensorFlow实践机器学习:构建智能系统的概念、工具和技术第三版

【2022新书】使用Scikit-Learn、Keras和TensorFlow实践机器学习:构建智能系统的概念、工具和技术第三版

专知

15+阅读 · 2022年11月8日

【干货书】《Transformers 机器学习:深度探究》，284页pdf

【干货书】《Transformers 机器学习:深度探究》，284页pdf

专知

72+阅读 · 2022年4月21日

【2020必看书】TinyML-微型化机器学习，149页pdf，在超低功耗微控制器上用TensorFlow Lite实现机器学习

【2020必看书】TinyML-微型化机器学习，149页pdf，在超低功耗微控制器上用TensorFlow Lite实现机器学习

专知

46+阅读 · 2020年2月19日

【2020新书】图机器学习，Graph-Powered Machine Learning

【2020新书】图机器学习，Graph-Powered Machine Learning

专知

76+阅读 · 2020年1月27日

【UMD开放经典书】机器学习课程简明书，19章227页pdf，带你学习ML

【UMD开放经典书】机器学习课程简明书，19章227页pdf，带你学习ML

专知

46+阅读 · 2019年12月9日

概述自动机器学习（AutoML）

概述自动机器学习（AutoML）

人工智能学家

19+阅读 · 2019年8月11日

【综述】自动机器学习AutoML最新65页综述，带你了解最新进展

【综述】自动机器学习AutoML最新65页综述，带你了解最新进展

中国人工智能学会

48+阅读 · 2019年5月3日

【机器学习】机器学习工业领域应用

【机器学习】机器学习工业领域应用

产业智能官

11+阅读 · 2018年10月23日

Jupyter Notebook的三大短板，都被这个新工具补齐了

Jupyter Notebook的三大短板，都被这个新工具补齐了

量子位

71+阅读 · 2018年9月10日

机器学习必备手册

机器学习必备手册

机器学习研究会

19+阅读 · 2017年10月24日

相关论文

Memory, Benchmark & Robots: A Benchmark for Solving Complex Tasks with Reinforcement Learning

Arxiv

0+阅读 · 3月4日

Self-adapting Robotic Agents through Online Continual Reinforcement Learning with World Model Feedback

Arxiv

0+阅读 · 3月4日

Inline Visualization and Manipulation of Real-Time Hardware Log for Supporting Debugging of Embedded Programs

Arxiv

0+阅读 · 3月4日

Runtime-Augmented LLMs for Crash Detection and Diagnosis in ML Notebooks

Arxiv

0+阅读 · 2月20日

What makes an Expert? Comparing Problem-solving Practices in Data Science Notebooks

Arxiv

0+阅读 · 2月17日

A Multi-Agent Framework for Code-Guided, Modular, and Verifiable Automated Machine Learning

Arxiv

0+阅读 · 2月15日

Self-Augmented Robot Trajectory: Efficient Imitation Learning via Safe Self-augmentation with Demonstrator-annotated Precision

Arxiv

0+阅读 · 2月11日

Automating Computational Reproducibility in Social Science: Comparing Prompt-Based and Agent-Based Approaches

Arxiv

0+阅读 · 2月9日

Learning to Continually Learn via Meta-learning Agentic Memory Designs

Arxiv

0+阅读 · 2月8日

Machine Unlearning: A Survey

Arxiv

16+阅读 · 2023年6月6日

相关基金

复杂环境下机器学习的理论研究

国家自然科学基金

21+阅读 · 2015年12月31日

分布式工业自动化系统可重构混合计算模型研究

国家自然科学基金

4+阅读 · 2015年12月31日

面向人类工作记忆改善的脑电复杂网络信息反馈非线性计算模型研究

国家自然科学基金

0+阅读 · 2015年12月31日

非结构环境下基于三维肢体动作理解的工业机器人交互技术研究

国家自然科学基金

1+阅读 · 2015年12月31日

基于非易失内存设备的数据读写性能优化方法研究

国家自然科学基金

0+阅读 · 2015年12月31日

面向智能穿戴设备的三维图形网格简化与渐进显示方法

国家自然科学基金

1+阅读 · 2015年12月31日

工业过程动态数据的多模型在线重构研究

国家自然科学基金

1+阅读 · 2015年12月31日

极限学习机拓展研究及其在近红外光谱分析中的应用

国家自然科学基金

1+阅读 · 2014年12月31日

基于逆向强化学习和人工智能的移动机器人自主学习方法研究

国家自然科学基金

12+阅读 · 2013年12月31日

开放动态环境下在线机器学习理论与方法

国家自然科学基金

11+阅读 · 2013年12月31日

微信扫码咨询专知VIP会员