iPack: Intuitive Bin Packing with Large Language Models - 专知论文

会员服务 ·

0

Packing · 装箱 · 大语言模型 · 语言模型 · 机器人 ·

iPack: Intuitive Bin Packing with Large Language Models

翻译：iPack：基于大语言模型的直观装箱方法

Yannik Blei,Michael Krawez,Adrian Göß,Devadas Vijayan Sheela,Tobias Jülg,Pierre Krack,Florian Walter,Wolfram Burgard

from arxiv, 7 Pages, 9 Figures

Robotics and automation are increasingly influential in logistics but remain largely confined to traditional warehouses. In grocery retail, advancements such as cashier-less supermarkets exist, yet customers still manually pick and pack groceries. While there has been a substantial focus in robotics on the bin picking problem, the task of packing objects and groceries has remained largely untouched. However, packing grocery items in the right order is crucial for preventing product damage, e.g., heavy objects should not be placed on top of fragile ones. However, the exact criteria for the right packing order are hard to define, in particular given the huge variety of objects typically found in stores. In this paper, we introduce LLM-Pack, a novel approach for grocery packing. LLM-Pack leverages language and vision foundation models for identifying groceries and generating a packing sequence that mimics human packing strategy. LLM-Pack does not require dedicated training to handle new grocery items and its modularity allows easy upgrades of the underlying foundation models. We extensively evaluate our approach to demonstrate its performance. We will make the source code of LLMPack publicly available upon the publication of this manuscript.

翻译：机器人技术与自动化在物流领域日益重要，但仍主要局限于传统仓库场景。在生鲜零售中，虽已出现无收银员超市等技术突破，但顾客仍需手动挑选和包装商品。尽管机器人领域对箱体分拣问题已有大量研究，但物品与生鲜商品的包装任务仍未得到充分关注。然而，按正确顺序包装生鲜商品对防止产品损坏至关重要——例如，重物不应置于易碎物品之上。但包装顺序的具体标准难以界定，尤其面对商店中种类繁多的商品。本文提出LLM-Pack，一种面向生鲜包装的新方法。该方法利用语言与视觉基础模型识别生鲜商品，并生成模拟人类包装策略的序列方案。LLM-Pack无需专门训练即可处理新增生鲜品项，其模块化设计便于对底层基础模型进行升级。我们通过大量实验验证了该方法性能。本手稿发表后，我们将公开LLM-Pack的源代码。

0

相关内容

Packing

《大语言模型及其对生物武器研发与使用的潜在影响》

《大语言模型及其对生物武器研发与使用的潜在影响》

专知会员服务

15+阅读 · 2025年11月26日

智能体化多模态大语言模型综述

智能体化多模态大语言模型综述

专知会员服务

39+阅读 · 2025年10月14日

面向机器人操作的基于大型视觉‑语言模型（VLM）的视觉‑语言‑动作（VLA）模型综述

面向机器人操作的基于大型视觉‑语言模型（VLM）的视觉‑语言‑动作（VLA）模型综述

专知会员服务

34+阅读 · 2025年8月19日

迈向可解释和可理解的多模态大规模语言模型

迈向可解释和可理解的多模态大规模语言模型

专知会员服务

41+阅读 · 2024年12月7日

【NTU博士论文】机器人装配中的强化学习，136页pdf

【NTU博士论文】机器人装配中的强化学习，136页pdf

专知会员服务

32+阅读 · 2024年8月6日

大模型如何部署服务？ CMU最新《高效生成式大型语言模型服务：从算法到系统》综述

大模型如何部署服务？ CMU最新《高效生成式大型语言模型服务：从算法到系统》综述

专知会员服务

78+阅读 · 2023年12月27日

大模型如何用于机器人？CMU谷歌等最新《基于基础模型的通用机器人》综述，详解机器人技术基础模型

大模型如何用于机器人？CMU谷歌等最新《基于基础模型的通用机器人》综述，详解机器人技术基础模型

专知会员服务

65+阅读 · 2023年12月16日

大模型用于制造业？东北大学等《大型语言模型智能制造业应用》综述，详述大模型制造业技术路线图

大模型用于制造业？东北大学等《大型语言模型智能制造业应用》综述，详述大模型制造业技术路线图

专知会员服务

102+阅读 · 2023年12月13日

RecInterpreter：架起大语言模型与传统推荐模型的桥梁

RecInterpreter：架起大语言模型与传统推荐模型的桥梁

专知会员服务

54+阅读 · 2023年11月9日

【斯坦福大学李飞飞高徒朱玉可博士毕业论文和PPT，158页pdf与96页slides】闭合感知-动作循环:实现通用机器人的自治，能够理解并与现实世界交互的通用机器人构建智能

【斯坦福大学李飞飞高徒朱玉可博士毕业论文和PPT，158页pdf与96页slides】闭合感知-动作循环:实现通用机器人的自治，能够理解并与现实世界交互的通用机器人构建智能

专知会员服务

104+阅读 · 2019年10月22日

【干货书】MLOps是什么？MLOps实战：操作机器学习模型，461页pdf

【干货书】MLOps是什么？MLOps实战：操作机器学习模型，461页pdf

专知

15+阅读 · 2022年2月16日

自然语言生成资源列表

自然语言生成资源列表

专知

17+阅读 · 2020年1月4日

推荐系统丨完整的架构设计和算法（协同过滤、隐语义）

推荐系统丨完整的架构设计和算法（协同过滤、隐语义）

架构文摘

16+阅读 · 2019年9月9日

常用的模型集成方法介绍：bagging、boosting 、stacking

常用的模型集成方法介绍：bagging、boosting 、stacking

机器之心

14+阅读 · 2019年5月15日

阿里巴巴最新成果：每一个商品的描述都是为你量身订做的

阿里巴巴最新成果：每一个商品的描述都是为你量身订做的

专知

14+阅读 · 2019年5月2日

NLP实战：用主题建模分析网购评论（附Python代码）

NLP实战：用主题建模分析网购评论（附Python代码）

论智

18+阅读 · 2018年10月17日

【干货】NLP中“词袋”模型和词嵌入模型的比较（附代码）

【干货】NLP中“词袋”模型和词嵌入模型的比较（附代码）

专知

11+阅读 · 2018年8月4日

机器人操作的“圣杯问题” -- Bin Picking

机器人操作的“圣杯问题” -- Bin Picking

机器人学家

16+阅读 · 2018年8月2日

基于深度学习的文本分类6大算法-原理、结构、论文、源码打包分享

基于深度学习的文本分类6大算法-原理、结构、论文、源码打包分享

深度学习与NLP

25+阅读 · 2018年7月18日

报名 | 码隆科技与谷歌研究院合办Kaggle大赛，挑战商品图像分类极限！

报名 | 码隆科技与谷歌研究院合办Kaggle大赛，挑战商品图像分类极限！

机器之心

10+阅读 · 2018年4月19日

支持新产品快速设计的复杂产品系统功能模块化方法

国家自然科学基金

1+阅读 · 2015年12月31日

初级组装体的模块化组装、功能集成与仿生应用

国家自然科学基金

0+阅读 · 2015年12月31日

考虑物品种类有限性的分类存储策略及仓储系统优化研究

国家自然科学基金

0+阅读 · 2015年12月31日

随机接入中的分布式功率控制和数据包编码传输

国家自然科学基金

0+阅读 · 2015年12月31日

配送中心物流作业调度问题的建模与优化

国家自然科学基金

2+阅读 · 2014年12月31日

B2C电子商务物流整体优化及动态调整方法研究

国家自然科学基金

0+阅读 · 2014年12月31日

面向大数据的信息可视化设计方法研究

国家自然科学基金

7+阅读 · 2014年12月31日

电商环境下的仓库系统的运作研究

国家自然科学基金

1+阅读 · 2014年12月31日

基于物联网的集装箱甩挂运输协同机制与动态调度方法研究

国家自然科学基金

1+阅读 · 2014年12月31日

自动化集装箱码头装卸作业的时空同步策略与优化方法

国家自然科学基金

1+阅读 · 2014年12月31日

Algorithmic Prompt Generation for Diverse Human-like Teaming and Communication with Large Language Models

Arxiv

0+阅读 · 6月15日

LLM Agents Can See Code Repositories

Arxiv

0+阅读 · 6月12日

RepoLaunch: Automating Build and Management of Code Repositories across Languages and Platforms

Arxiv

0+阅读 · 6月6日

From Pixels to Shelf: An Integrated Robotic System for Autonomous Supermarket Stocking with a Mobile Manipulator

Arxiv

0+阅读 · 6月5日

RAT: RunAnyThing via Fully Automated Environment Configuration

Arxiv

0+阅读 · 6月4日

Many-to-Many Multi-Agent Pickup and Delivery

Arxiv

0+阅读 · 5月8日

A Universal Large Language Model -- Drone Command and Control Interface

Arxiv

0+阅读 · 5月6日

Pack it in: Packing into Partially Filled Containers Through Contact

Arxiv

0+阅读 · 5月6日

SysLLMatic: Large Language Models are Software System Optimizers

Arxiv

0+阅读 · 5月5日

Large Language Models Meet NLP: A Survey

Arxiv

14+阅读 · 2024年5月21日

VIP会员

文章信息

相关主题

大语言模型

最新内容

综述 | 从问答到任务完成：Agent系统与Harness设计

综述 | 从问答到任务完成：Agent系统与Harness设计

专知会员服务

1+阅读 · 今天16:54

Agentic RL：框架、实践与长程智能体训练

Agentic RL：框架、实践与长程智能体训练

专知会员服务

1+阅读 · 今天16:52

反无人机拦截器训练与运用课程：对美国陆军部队发展的启示

反无人机拦截器训练与运用课程：对美国陆军部队发展的启示

专知会员服务

6+阅读 · 今天8:00

重新思考无人机时代的生存能力

重新思考无人机时代的生存能力

专知会员服务

5+阅读 · 今天7:44

装甲突击旅：现代战争思考、战斗与组织

装甲突击旅：现代战争思考、战斗与组织

专知会员服务

4+阅读 · 今天7:28

在人工智能加速决策环境中拓展OODA循环

在人工智能加速决策环境中拓展OODA循环

专知会员服务

4+阅读 · 今天7:18

《廉价自杀式无人机战争的军事战略影响：乌克兰与伊朗案例研究》

《廉价自杀式无人机战争的军事战略影响：乌克兰与伊朗案例研究》

专知会员服务

5+阅读 · 今天7:07

军事欺骗：供作战战术指挥官使用的工具

军事欺骗：供作战战术指挥官使用的工具

专知会员服务

4+阅读 · 今天7:03

ICML 2026 | CFPO：用反事实策略优化提升多模态推理

ICML 2026 | CFPO：用反事实策略优化提升多模态推理

专知会员服务

4+阅读 · 6月23日

综述 | 世界动作模型：少做梦，多行动

综述 | 世界动作模型：少做梦，多行动

专知会员服务

6+阅读 · 6月23日

美以伊冲突：无人机与人工智能的运用

美以伊冲突：无人机与人工智能的运用

专知会员服务

10+阅读 · 6月23日

《战时图神经网络：整合以色列-伊朗冲突中的网络安全与无人机智能》最新50页文献

《战时图神经网络：整合以色列-伊朗冲突中的网络安全与无人机智能》最新50页文献

专知会员服务

4+阅读 · 6月23日

《特种部队在透明战场中的生存力》最新报告

《特种部队在透明战场中的生存力》最新报告

专知会员服务

5+阅读 · 6月23日

《自主无人机蜂群协同与控制系统：人工智能赋能的战场协同与自主任务编排平台》

《自主无人机蜂群协同与控制系统：人工智能赋能的战场协同与自主任务编排平台》

专知会员服务

8+阅读 · 6月23日

《人工智能生成的零日漏洞：对未来作战的影响》

《人工智能生成的零日漏洞：对未来作战的影响》

专知会员服务

7+阅读 · 6月23日

相关VIP内容

《大语言模型及其对生物武器研发与使用的潜在影响》

《大语言模型及其对生物武器研发与使用的潜在影响》

专知会员服务

15+阅读 · 2025年11月26日

智能体化多模态大语言模型综述

智能体化多模态大语言模型综述

专知会员服务

39+阅读 · 2025年10月14日

面向机器人操作的基于大型视觉‑语言模型（VLM）的视觉‑语言‑动作（VLA）模型综述

面向机器人操作的基于大型视觉‑语言模型（VLM）的视觉‑语言‑动作（VLA）模型综述

专知会员服务

34+阅读 · 2025年8月19日

迈向可解释和可理解的多模态大规模语言模型

迈向可解释和可理解的多模态大规模语言模型

专知会员服务

41+阅读 · 2024年12月7日

【NTU博士论文】机器人装配中的强化学习，136页pdf

【NTU博士论文】机器人装配中的强化学习，136页pdf

专知会员服务

32+阅读 · 2024年8月6日

大模型如何部署服务？ CMU最新《高效生成式大型语言模型服务：从算法到系统》综述

大模型如何部署服务？ CMU最新《高效生成式大型语言模型服务：从算法到系统》综述

专知会员服务

78+阅读 · 2023年12月27日

大模型如何用于机器人？CMU谷歌等最新《基于基础模型的通用机器人》综述，详解机器人技术基础模型

大模型如何用于机器人？CMU谷歌等最新《基于基础模型的通用机器人》综述，详解机器人技术基础模型

专知会员服务

65+阅读 · 2023年12月16日

大模型用于制造业？东北大学等《大型语言模型智能制造业应用》综述，详述大模型制造业技术路线图

大模型用于制造业？东北大学等《大型语言模型智能制造业应用》综述，详述大模型制造业技术路线图

专知会员服务

102+阅读 · 2023年12月13日

RecInterpreter：架起大语言模型与传统推荐模型的桥梁

RecInterpreter：架起大语言模型与传统推荐模型的桥梁

专知会员服务

54+阅读 · 2023年11月9日

【斯坦福大学李飞飞高徒朱玉可博士毕业论文和PPT，158页pdf与96页slides】闭合感知-动作循环:实现通用机器人的自治，能够理解并与现实世界交互的通用机器人构建智能

【斯坦福大学李飞飞高徒朱玉可博士毕业论文和PPT，158页pdf与96页slides】闭合感知-动作循环:实现通用机器人的自治，能够理解并与现实世界交互的通用机器人构建智能

专知会员服务

104+阅读 · 2019年10月22日

热门VIP内容

开通专知VIP会员享更多权益服务

Agentic RL：框架、实践与长程智能体训练

重新思考无人机时代的生存能力

综述 | 从问答到任务完成：Agent系统与Harness设计

反无人机拦截器训练与运用课程：对美国陆军部队发展的启示

相关资讯

【干货书】MLOps是什么？MLOps实战：操作机器学习模型，461页pdf

【干货书】MLOps是什么？MLOps实战：操作机器学习模型，461页pdf

专知

15+阅读 · 2022年2月16日

自然语言生成资源列表

自然语言生成资源列表

专知

17+阅读 · 2020年1月4日

推荐系统丨完整的架构设计和算法（协同过滤、隐语义）

推荐系统丨完整的架构设计和算法（协同过滤、隐语义）

架构文摘

16+阅读 · 2019年9月9日

常用的模型集成方法介绍：bagging、boosting 、stacking

常用的模型集成方法介绍：bagging、boosting 、stacking

机器之心

14+阅读 · 2019年5月15日

阿里巴巴最新成果：每一个商品的描述都是为你量身订做的

阿里巴巴最新成果：每一个商品的描述都是为你量身订做的

专知

14+阅读 · 2019年5月2日

NLP实战：用主题建模分析网购评论（附Python代码）

NLP实战：用主题建模分析网购评论（附Python代码）

论智

18+阅读 · 2018年10月17日

【干货】NLP中“词袋”模型和词嵌入模型的比较（附代码）

【干货】NLP中“词袋”模型和词嵌入模型的比较（附代码）

专知

11+阅读 · 2018年8月4日

机器人操作的“圣杯问题” -- Bin Picking

机器人操作的“圣杯问题” -- Bin Picking

机器人学家

16+阅读 · 2018年8月2日

基于深度学习的文本分类6大算法-原理、结构、论文、源码打包分享

基于深度学习的文本分类6大算法-原理、结构、论文、源码打包分享

深度学习与NLP

25+阅读 · 2018年7月18日

报名 | 码隆科技与谷歌研究院合办Kaggle大赛，挑战商品图像分类极限！

报名 | 码隆科技与谷歌研究院合办Kaggle大赛，挑战商品图像分类极限！

机器之心

10+阅读 · 2018年4月19日

相关论文

Algorithmic Prompt Generation for Diverse Human-like Teaming and Communication with Large Language Models

Arxiv

0+阅读 · 6月15日

LLM Agents Can See Code Repositories

Arxiv

0+阅读 · 6月12日

RepoLaunch: Automating Build and Management of Code Repositories across Languages and Platforms

Arxiv

0+阅读 · 6月6日

From Pixels to Shelf: An Integrated Robotic System for Autonomous Supermarket Stocking with a Mobile Manipulator

Arxiv

0+阅读 · 6月5日

RAT: RunAnyThing via Fully Automated Environment Configuration

Arxiv

0+阅读 · 6月4日

Many-to-Many Multi-Agent Pickup and Delivery

Arxiv

0+阅读 · 5月8日

A Universal Large Language Model -- Drone Command and Control Interface

Arxiv

0+阅读 · 5月6日

Pack it in: Packing into Partially Filled Containers Through Contact

Arxiv

0+阅读 · 5月6日

SysLLMatic: Large Language Models are Software System Optimizers

Arxiv

0+阅读 · 5月5日

Large Language Models Meet NLP: A Survey

Arxiv

14+阅读 · 2024年5月21日

相关基金

支持新产品快速设计的复杂产品系统功能模块化方法

国家自然科学基金

1+阅读 · 2015年12月31日

初级组装体的模块化组装、功能集成与仿生应用

国家自然科学基金

0+阅读 · 2015年12月31日

考虑物品种类有限性的分类存储策略及仓储系统优化研究

国家自然科学基金

0+阅读 · 2015年12月31日

随机接入中的分布式功率控制和数据包编码传输

国家自然科学基金

0+阅读 · 2015年12月31日

配送中心物流作业调度问题的建模与优化

国家自然科学基金

2+阅读 · 2014年12月31日

B2C电子商务物流整体优化及动态调整方法研究

国家自然科学基金

0+阅读 · 2014年12月31日

面向大数据的信息可视化设计方法研究

国家自然科学基金

7+阅读 · 2014年12月31日

电商环境下的仓库系统的运作研究

国家自然科学基金

1+阅读 · 2014年12月31日

基于物联网的集装箱甩挂运输协同机制与动态调度方法研究

国家自然科学基金

1+阅读 · 2014年12月31日

自动化集装箱码头装卸作业的时空同步策略与优化方法

国家自然科学基金

1+阅读 · 2014年12月31日

微信扫码咨询专知VIP会员