| 1 |
RxnCLF: Contrastive Transformation-Aware Reaction Foundation Model for Improved Reactivity Prediction |
提出RxnCLF以解决反应产率预测难题 |
representation learning contrastive learning foundation model |
|
|
| 2 |
BioM-JEPA: joint-embedding prediction of graph-connected gene blocks in single cells |
提出BioM-JEPA以解决单细胞基因块预测问题 |
JEPA Joint-Embedding Predictive Architecture joint-embedding predictive architecture |
|
|
| 3 |
Does Latent Context Help? A Controlled Evaluation of Inverse Reinforcement Learning in Arctic Shipping |
评估潜在上下文对反向强化学习在北极航运中的帮助 |
reinforcement learning inverse reinforcement learning |
|
|
| 4 |
BioKD: Selective Physiology-to-Video Knowledge Distillation via Reliability Gate for Emotion Recognition |
提出BioKD以解决模糊行为线索下的情感识别问题 |
distillation privileged information multimodal |
|
|
| 5 |
On-Policy Self-Distillation without Any Supervision |
提出无监督的在线自蒸馏方法以提升模型性能 |
distillation large language model |
|
|
| 6 |
ProDVI: Programmatic Dynamics Priors for Value Network Initialization |
提出ProDVI以解决深度强化学习样本效率低下问题 |
reinforcement learning deep reinforcement learning large language model |
|
|
| 7 |
RRC: Unlocking Generative Reward Models in LLM Reinforcement Learning via Ranking-Based Reward Construction |
提出RRC方法以解决生成奖励模型在强化学习中的应用问题 |
reinforcement learning |
✅ |
|
| 8 |
Stochastic Dynamics on Persistence Diagram Space via Reinforcement Learning |
提出强化学习框架以实现持久性图的随机动态演化 |
reinforcement learning |
|
|
| 9 |
SAGA: Score-Weighted Adaptive Generation Alignment for Low-Resource Nordic Language Models |
提出SAGA框架以解决低资源北欧语言模型的偏好优化问题 |
DPO large language model |
|
|
| 10 |
Hybrid-Adaptive Thread Tuning to Mitigate Simulation Execution Bottlenecks in High-Performance Reinforcement Learning Inference |
提出AutoThread以解决高性能强化学习推理中的仿真执行瓶颈问题 |
reinforcement learning |
✅ |
|
| 11 |
Flowing Through States: Neural ODE Regularization for Reinforcement Learning |
提出神经ODE正则化以解决强化学习中的状态表示问题 |
reinforcement learning PPO latent dynamics |
|
|
| 12 |
Game-Theoretic Inverse Reinforcement Learning for Modeling Competitive Human Driving: A Cut-in Prediction Study |
提出博弈论逆强化学习以解决竞争性人类驾驶建模问题 |
reinforcement learning inverse reinforcement learning |
|
|
| 13 |
Retrofitting Linear Attention into Diffusion Language Models |
提出块混合注意力以加速扩散语言模型推理 |
linear attention |
✅ |
|
| 14 |
CrystalGRPO: Target-Aligned and Coverage-Preserving Reinforcement Learning for Flow-Based Crystal Structure Prediction |
提出CrystalGRPO以解决晶体结构预测中的目标对齐与覆盖问题 |
reinforcement learning |
|
|
| 15 |
FedTransKD-IDS: Robust Federated Transfer Learning with Knowledge Distillation for Intrusion Detection in IoT |
提出FedTransKD-IDS以解决物联网入侵检测中的隐私与效率问题 |
distillation |
|
|