TraCeS: Trajectory Based Credit Assignment From Sparse Safety Feedback
Fuente:
arXiv
Guardado en:
| Autores principales: | Low, Siow Meng, Kumar, Akshat |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Safe Reinforcement Learning with Learned Non-Markovian Safety Constraints
por: Low, Siow Meng, et al.
Publicado: (2024)
por: Low, Siow Meng, et al.
Publicado: (2024)
Beyond Uniform Credit: Causal Credit Assignment for Policy Optimization
por: Khandoga, Mykola, et al.
Publicado: (2026)
por: Khandoga, Mykola, et al.
Publicado: (2026)
MURPHY: Feedback-Aware GRPO with Retrospective Credit Assignment for Multi-Turn Code Generation
por: Ekbote, Chanakya, et al.
Publicado: (2025)
por: Ekbote, Chanakya, et al.
Publicado: (2025)
Offline Safe Reinforcement Learning Using Trajectory Classification
por: Gong, Ze, et al.
Publicado: (2024)
por: Gong, Ze, et al.
Publicado: (2024)
Search-Based Credit Assignment for Offline Preference-Based Reinforcement Learning
por: Gao, Xiancheng, et al.
Publicado: (2025)
por: Gao, Xiancheng, et al.
Publicado: (2025)
Intrinsic Credit Assignment for Long Horizon Interaction
por: Auzina, Ilze Amanda, et al.
Publicado: (2026)
por: Auzina, Ilze Amanda, et al.
Publicado: (2026)
Score Broadcast and Decorrelation: A General Framework for Broadcast-Based Credit Assignment
por: Uzun, Mustafa, et al.
Publicado: (2026)
por: Uzun, Mustafa, et al.
Publicado: (2026)
GRPO-$λ$: Credit Assignment improves LLM Reasoning
por: Parthasarathi, Prasanna, et al.
Publicado: (2025)
por: Parthasarathi, Prasanna, et al.
Publicado: (2025)
Hindsight Credit Assignment for Long-Horizon LLM Agents
por: Tan, Hui-Ze, et al.
Publicado: (2026)
por: Tan, Hui-Ze, et al.
Publicado: (2026)
Exact Is Easier: Credit Assignment for Cooperative LLM Agents
por: Chen, Yanjun, et al.
Publicado: (2026)
por: Chen, Yanjun, et al.
Publicado: (2026)
Sequence Compression Speeds Up Credit Assignment in Reinforcement Learning
por: Ramesh, Aditya A., et al.
Publicado: (2024)
por: Ramesh, Aditya A., et al.
Publicado: (2024)
RTMC: Step-Level Credit Assignment via Rollout Trees
por: Wang, Tao, et al.
Publicado: (2026)
por: Wang, Tao, et al.
Publicado: (2026)
A Survey of Temporal Credit Assignment in Deep Reinforcement Learning
por: Pignatelli, Eduardo, et al.
Publicado: (2023)
por: Pignatelli, Eduardo, et al.
Publicado: (2023)
Beyond Uniform Credit Assignment: Selective Eligibility Traces for RLVR
por: Mou, Chaoli, et al.
Publicado: (2026)
por: Mou, Chaoli, et al.
Publicado: (2026)
A Practical Approach to using Supervised Machine Learning Models to Classify Aviation Safety Occurrences
por: Siow, Bryan Y.
Publicado: (2025)
por: Siow, Bryan Y.
Publicado: (2025)
ARCA: Adapter-Residual Credit Assignment When Token Signals Degenerate
por: Lafuente-Mercado, Rodney
Publicado: (2026)
por: Lafuente-Mercado, Rodney
Publicado: (2026)
DGPO: Distribution Guided Policy Optimization for Fine Grained Credit Assignment
por: Jin, Hongbo, et al.
Publicado: (2026)
por: Jin, Hongbo, et al.
Publicado: (2026)
Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
por: Qu, Yun, et al.
Publicado: (2024)
por: Qu, Yun, et al.
Publicado: (2024)
InT: Self-Proposed Interventions Enable Credit Assignment in LLM Reasoning
por: Yang, Matthew Y. R., et al.
Publicado: (2026)
por: Yang, Matthew Y. R., et al.
Publicado: (2026)
TraSCE: Trajectory Steering for Concept Erasure
por: Jain, Anubhav, et al.
Publicado: (2024)
por: Jain, Anubhav, et al.
Publicado: (2024)
Pinpointing crucial steps: Attribution-based Credit Assignment for Verifiable Reinforcement Learning
por: Yin, Junxi, et al.
Publicado: (2025)
por: Yin, Junxi, et al.
Publicado: (2025)
OPPO: Bayesian Value Recursion for Token-Level Credit Assignment in LLM Reasoning
por: Li, Yu, et al.
Publicado: (2026)
por: Li, Yu, et al.
Publicado: (2026)
Dictionary Learning: The Complexity of Learning Sparse Superposed Features with Feedback
por: Kumar, Akash
Publicado: (2025)
por: Kumar, Akash
Publicado: (2025)
Credit Assignment via Neural Manifold Noise Correlation
por: Kang, Byungwoo, et al.
Publicado: (2026)
por: Kang, Byungwoo, et al.
Publicado: (2026)
COSAC: Counterfactual Credit Assignment in Sequential Cooperative Teams
por: Deshmukh, Shripad, et al.
Publicado: (2026)
por: Deshmukh, Shripad, et al.
Publicado: (2026)
Stepwise Credit Assignment for GRPO on Flow-Matching Models
por: Savani, Yash, et al.
Publicado: (2026)
por: Savani, Yash, et al.
Publicado: (2026)
Forward Target Propagation: A Forward-Only Approach to Global Error Credit Assignment via Local Losses
por: As-Saquib, Nazmus Saadat, et al.
Publicado: (2025)
por: As-Saquib, Nazmus Saadat, et al.
Publicado: (2025)
In-Context Credit Assignment via the Core
por: Harris, Keegan, et al.
Publicado: (2026)
por: Harris, Keegan, et al.
Publicado: (2026)
Reducing Credit Assignment Variance via Counterfactual Reasoning Paths
por: Ding, Fei, et al.
Publicado: (2026)
por: Ding, Fei, et al.
Publicado: (2026)
Not All Turns Matter: Credit Assignment for Multi-Turn Jailbreaking
por: He, Zhida, et al.
Publicado: (2026)
por: He, Zhida, et al.
Publicado: (2026)
Stop Summation: Min-Form Credit Assignment Is All Process Reward Model Needs for Reasoning
por: Cheng, Jie, et al.
Publicado: (2025)
por: Cheng, Jie, et al.
Publicado: (2025)
ICA: Information-Aware Credit Assignment for Visually Grounded Long-Horizon Information-Seeking Agents
por: Pang, Cong, et al.
Publicado: (2026)
por: Pang, Cong, et al.
Publicado: (2026)
HiPER: Hierarchical Reinforcement Learning with Explicit Credit Assignment for Large Language Model Agents
por: Peng, Jiangweizhi, et al.
Publicado: (2026)
por: Peng, Jiangweizhi, et al.
Publicado: (2026)
From Reasoning Chains to Verifiable Subproblems: Curriculum Reinforcement Learning Enables Credit Assignment for LLM Reasoning
por: Jiang, Xitai, et al.
Publicado: (2026)
por: Jiang, Xitai, et al.
Publicado: (2026)
VeTraSS: Vehicle Trajectory Similarity Search Through Graph Modeling and Representation Learning
por: Cheng, Ming, et al.
Publicado: (2024)
por: Cheng, Ming, et al.
Publicado: (2024)
Neural Dueling Bandits: Preference-Based Optimization with Human Feedback
por: Verma, Arun, et al.
Publicado: (2024)
por: Verma, Arun, et al.
Publicado: (2024)
CAPO: Towards Enhancing LLM Reasoning through Generative Credit Assignment
por: Xie, Guofu, et al.
Publicado: (2025)
por: Xie, Guofu, et al.
Publicado: (2025)
A Timeline and Analysis for Representation Plasticity in Large Language Models
por: Kannan, Akshat
Publicado: (2024)
por: Kannan, Akshat
Publicado: (2024)
Challenges in Credit Assignment for Multi-Agent Reinforcement Learning in Open Agent Systems
por: Abadi, Alireza Saleh, et al.
Publicado: (2025)
por: Abadi, Alireza Saleh, et al.
Publicado: (2025)
Beyond Hard Constraints: Budget-Conditioned Reachability For Safe Offline Reinforcement Learning
por: Brahmanage, Janaka Chathuranga, et al.
Publicado: (2026)
por: Brahmanage, Janaka Chathuranga, et al.
Publicado: (2026)
Ejemplares similares
-
Safe Reinforcement Learning with Learned Non-Markovian Safety Constraints
por: Low, Siow Meng, et al.
Publicado: (2024) -
Beyond Uniform Credit: Causal Credit Assignment for Policy Optimization
por: Khandoga, Mykola, et al.
Publicado: (2026) -
MURPHY: Feedback-Aware GRPO with Retrospective Credit Assignment for Multi-Turn Code Generation
por: Ekbote, Chanakya, et al.
Publicado: (2025) -
Offline Safe Reinforcement Learning Using Trajectory Classification
por: Gong, Ze, et al.
Publicado: (2024) -
Search-Based Credit Assignment for Offline Preference-Based Reinforcement Learning
por: Gao, Xiancheng, et al.
Publicado: (2025)