成为VIP会员查看完整内容
VIP会员码认证
首页
主题
会员
服务
注册
·
登录
非平稳
关注
0
综合
百科
VIP
热门
动态
论文
精华
Closing the Feedback Loop: From Experience Extraction to Insight Governance in Verbal Reinforcement Learning
Arxiv
0+阅读 · 6月16日
When Should a Robot Replan? Regret-Guided Update Scheduling in Time-Varying MDPs
Arxiv
0+阅读 · 6月15日
DAL: A Practical Prior-Free Black-Box Framework for Piecewise Stationary Bandits
Arxiv
0+阅读 · 6月13日
A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning
Arxiv
0+阅读 · 6月15日
Active Inference for Adaptive Traffic Signal Control in Noisy Nonstationary IoT Environments
Arxiv
0+阅读 · 5月31日
Efficient Domain-Adaptive Policy Learning via Kernel Representation with Application to Quadrotor Control under Non-Stationary Disturbances
Arxiv
0+阅读 · 6月11日
Scalable Reinforcement Learning via Adaptive Batch Scaling
Arxiv
0+阅读 · 6月4日
Hierarchical Successor Representation for Robust Transfer
Arxiv
0+阅读 · 6月11日
A Switching Beamformer for Highly Non-Stationary Environments
Arxiv
0+阅读 · 6月7日
Estimation of Treatment Effects Under Nonstationarity via the Truncated Policy Gradient Estimator
Arxiv
0+阅读 · 6月2日
Non-Stationary Bandit Learning via Predictive Sampling
Arxiv
0+阅读 · 6月6日
Learning-to-Defer in Non-Stationary Time Series via Switching State-Space Models
Arxiv
0+阅读 · 5月29日
Prospective Compression in Human Abstraction Learning
Arxiv
0+阅读 · 5月11日
Tests for Independence of High-Dimensional Nonstationary Time Series
Arxiv
0+阅读 · 6月7日
Rethinking Continual Learning for Speech and Audio: A Representation-Centric Taxonomy and Open Problems
Arxiv
0+阅读 · 5月29日
参考链接
提示
微信扫码
咨询专知VIP会员与技术项目合作
(加微信请备注: "专知")
微信扫码咨询专知VIP会员
Top