cs.LG(2026-08-18)

📊 共 18 篇论文 | 🔗 4 篇有代码

🎯 兴趣领域导航

支柱二:RL算法与架构 (RL & Architecture) (12 🔗3) 支柱九:具身大模型 (Embodied Foundation Models) (6 🔗1)

🔬 支柱二:RL算法与架构 (RL & Architecture) (12 篇)

#题目一句话要点标签🔗
1 No Gaussian Required: Contrastive Inverse Dynamics for JEPA World Models 提出对比逆动态方法以解决JEPA世界模型中的崩溃问题 world model worldmodel world models
2 Understanding Curriculum Learning in Large Language Models via Cross-Difficulty Optimization Dynamics 提出基于相对迁移的动态课程采样方法以优化大语言模型训练 curriculum learning large language model
3 MoRAX: Mobility-based Representation Augmentation for Geospatial Foundation Models 提出MoRAX以增强地理基础模型的城市表示能力 representation learning foundation model
4 Repetition as Reinforcement: Enhancing Sample Efficiency via Instant Episode Repetition in Reinforcement Learning 提出即时情节重复机制以提升强化学习样本效率 reinforcement learning SAC TD3
5 Policy-Invariant Reward Shaping from LLM Feedback: A Framework for Hybrid RL Agents 提出基于LLM反馈的政策不变奖励塑形框架以优化混合RL代理 reinforcement learning reward shaping large language model
6 An Omitted Mode Is a Rare Rule: The Sampling-Verification Danger Law in Continuous Code World Models 提出采样验证危险法则以解决连续控制中的模式遗漏问题 world model world models
7 Co-RL: Unsupervised Reasoning Emerges from Diverse Cohort in Multi-agent RL 提出Co-RL框架以解决无监督推理中的反馈循环问题 reinforcement learning multimodal
8 Composing Flow-Matching Energies with Known Physics: Generation, OOD Detection, and Inversion on PDE Fields 提出流匹配能量模型以解决PDE场的生成与OOD检测问题 flow matching
9 Efficient RLVR Scheduling via Graph-Structured Online Difficulty Estimation 提出图结构在线难度估计以优化RLVR调度 reinforcement learning large language model
10 rl-triton: High-Performance Triton GPU Kernels for Reinforcement Learning Credit Assignment 提出rl-triton以解决强化学习信用分配问题 reinforcement learning
11 Evaluating RL Explainability Methods by How Much They Help Fix Bugs in Agents 提出EvalXRL基准以评估可解释强化学习方法的有效性 reinforcement learning large language model
12 Integrating Novelty and Surprise for Experience Prioritization and Exploration in Image-Based Reinforcement Learning 提出NSPER以提升图像基础强化学习的样本效率 reinforcement learning

🔬 支柱九:具身大模型 (Embodied Foundation Models) (6 篇)

#题目一句话要点标签🔗
13 Understanding the Surprising Generalization Properties of Tabular Foundation Models 提出任务中心视角以提升表格基础模型的泛化能力 foundation model
14 GUPO: Gradient Uncertainty-aware Policy Optimization for Post-Training Large Language Models 提出GUPO以解决GRPO中梯度冲突问题 large language model
15 Recirculation 提出Recirculation以提升生成与推理任务的准确性 foundation model chain-of-thought
16 SIGMA: SHAP-Guided Implicit-Trajectory Generation for Metadata-Free LLM-Based AutoFE 提出SIGMA以解决长时间优化中的元数据缺失问题 large language model
17 Leveraging Association Context Retrieval in Knowledge Edit- ing to Build White-Box Attacks on LLMs 提出基于知识编辑的白盒攻击方法以诱导LLMs不安全行为 large language model
18 Rethinking Irregular Time Series Forecasting from the Perspective of Basis Functions 提出Debiased Neural Basis-Function Network以解决不规则时间序列预测问题 TAMP

⬅️ 返回 cs.LG 首页 · 🏠 返回主页