CLIP-RL: Aligning Language and Policy Representations for Task Transfer in Reinforcement Learning
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Gautam, Chainesh, Diddigi, Raghuram Bharadwaj |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Learning Distinguishable Representations in Deep Q-Networks for Linear Transfer
von: Sathish, Sooraj, et al.
Veröffentlicht: (2025)
von: Sathish, Sooraj, et al.
Veröffentlicht: (2025)
Generalisation in Multitask Fitted Q-Iteration and Offline Q-learning
von: Manda, Kausthubh, et al.
Veröffentlicht: (2025)
von: Manda, Kausthubh, et al.
Veröffentlicht: (2025)
Full-Gradient Successor Feature Representations
von: Shrirao, Ritish, et al.
Veröffentlicht: (2026)
von: Shrirao, Ritish, et al.
Veröffentlicht: (2026)
Image Generation from Image Captioning -- Invertible Approach
von: Menon, Nandakishore S, et al.
Veröffentlicht: (2024)
von: Menon, Nandakishore S, et al.
Veröffentlicht: (2024)
Understanding Transferable Representation Learning and Zero-shot Transfer in CLIP
von: Chen, Zixiang, et al.
Veröffentlicht: (2023)
von: Chen, Zixiang, et al.
Veröffentlicht: (2023)
Spreadsheet-RL: Advancing Large Language Model Agents on Realistic Spreadsheet Tasks via Reinforcement Learning
von: Chi, Banghao, et al.
Veröffentlicht: (2026)
von: Chi, Banghao, et al.
Veröffentlicht: (2026)
CLIP-RLDrive: Human-Aligned Autonomous Driving via CLIP-Based Reward Shaping in Reinforcement Learning
von: Doroudian, Erfan, et al.
Veröffentlicht: (2024)
von: Doroudian, Erfan, et al.
Veröffentlicht: (2024)
HypRL: Reinforcement Learning of Control Policies for Hyperproperties
von: Hsu, Tzu-Han, et al.
Veröffentlicht: (2025)
von: Hsu, Tzu-Han, et al.
Veröffentlicht: (2025)
CLIP-RL: Surgical Scene Segmentation Using Contrastive Language-Vision Pretraining & Reinforcement Learning
von: Ahmed, Fatmaelzahraa Ali, et al.
Veröffentlicht: (2025)
von: Ahmed, Fatmaelzahraa Ali, et al.
Veröffentlicht: (2025)
Geometrically Aligned Transfer Encoder for Inductive Transfer in Regression Tasks
von: Ko, Sung Moon, et al.
Veröffentlicht: (2023)
von: Ko, Sung Moon, et al.
Veröffentlicht: (2023)
Chart-RL: Policy Optimization Reinforcement Learning for Enhanced Visual Reasoning in Chart Question Answering with Vision Language Models
von: Bai, Yunfei, et al.
Veröffentlicht: (2026)
von: Bai, Yunfei, et al.
Veröffentlicht: (2026)
Align and Filter: Improving Performance in Asynchronous On-Policy RL
von: Honari, Homayoun, et al.
Veröffentlicht: (2026)
von: Honari, Homayoun, et al.
Veröffentlicht: (2026)
Offline Multi-task Transfer RL with Representational Penalization
von: Bose, Avinandan, et al.
Veröffentlicht: (2024)
von: Bose, Avinandan, et al.
Veröffentlicht: (2024)
AgentRL: Scaling Agentic Reinforcement Learning with a Multi-Turn, Multi-Task Framework
von: Zhang, Hanchen, et al.
Veröffentlicht: (2025)
von: Zhang, Hanchen, et al.
Veröffentlicht: (2025)
SuperRL: Reinforcement Learning with Supervision to Boost Language Model Reasoning
von: Liu, Yihao, et al.
Veröffentlicht: (2025)
von: Liu, Yihao, et al.
Veröffentlicht: (2025)
SPEC-RL: Accelerating On-Policy Reinforcement Learning with Speculative Rollouts
von: Liu, Bingshuai, et al.
Veröffentlicht: (2025)
von: Liu, Bingshuai, et al.
Veröffentlicht: (2025)
LPPG-RL: Lexicographically Projected Policy Gradient Reinforcement Learning with Subproblem Exploration
von: Qiu, Ruiyu, et al.
Veröffentlicht: (2025)
von: Qiu, Ruiyu, et al.
Veröffentlicht: (2025)
SAFE-RL: Saliency-Aware Counterfactual Explainer for Deep Reinforcement Learning Policies
von: Samadi, Amir, et al.
Veröffentlicht: (2024)
von: Samadi, Amir, et al.
Veröffentlicht: (2024)
Efficient Multi-Task Reinforcement Learning with Cross-Task Policy Guidance
von: He, Jinmin, et al.
Veröffentlicht: (2025)
von: He, Jinmin, et al.
Veröffentlicht: (2025)
When are LLMs Sufficient Policy Optimizers for Sequential RL Tasks?
von: Hatgis-Kessell, Stephane, et al.
Veröffentlicht: (2026)
von: Hatgis-Kessell, Stephane, et al.
Veröffentlicht: (2026)
First-Order Representation Languages for Goal-Conditioned RL
von: Ståhlberg, Simon, et al.
Veröffentlicht: (2025)
von: Ståhlberg, Simon, et al.
Veröffentlicht: (2025)
Efficiently Aligned Cross-Lingual Transfer Learning for Conversational Tasks using Prompt-Tuning
von: Tu, Lifu, et al.
Veröffentlicht: (2023)
von: Tu, Lifu, et al.
Veröffentlicht: (2023)
RL-BioAug: Label-Efficient Reinforcement Learning for Self-Supervised EEG Representation Learning
von: Lee, Cheol-Hui, et al.
Veröffentlicht: (2026)
von: Lee, Cheol-Hui, et al.
Veröffentlicht: (2026)
World4RL: Diffusion World Models for Policy Refinement with Reinforcement Learning for Robotic Manipulation
von: Jiang, Zhennan, et al.
Veröffentlicht: (2025)
von: Jiang, Zhennan, et al.
Veröffentlicht: (2025)
SCOPE-RL: A Python Library for Offline Reinforcement Learning and Off-Policy Evaluation
von: Kiyohara, Haruka, et al.
Veröffentlicht: (2023)
von: Kiyohara, Haruka, et al.
Veröffentlicht: (2023)
Multi-Task Reinforcement Learning with Language-Encoded Gated Policy Networks
von: Arora, Rushiv
Veröffentlicht: (2025)
von: Arora, Rushiv
Veröffentlicht: (2025)
Knowledge Transfer in Deep Reinforcement Learning via an RL-Specific GAN-Based Correspondence Function
von: Ruman, Marko, et al.
Veröffentlicht: (2022)
von: Ruman, Marko, et al.
Veröffentlicht: (2022)
Human-Aligned Procedural Level Generation Reinforcement Learning via Text-Level-Sketch Shared Representation
von: Baek, In-Chang, et al.
Veröffentlicht: (2025)
von: Baek, In-Chang, et al.
Veröffentlicht: (2025)
Aligning Paralinguistic Understanding and Generation in Speech LLMs via Multi-Task Reinforcement Learning
von: Chen, Jingxiang, et al.
Veröffentlicht: (2026)
von: Chen, Jingxiang, et al.
Veröffentlicht: (2026)
RL$^3$: Boosting Meta Reinforcement Learning via RL inside RL$^2$
von: Bhatia, Abhinav, et al.
Veröffentlicht: (2023)
von: Bhatia, Abhinav, et al.
Veröffentlicht: (2023)
On-Policy RL Meets Off-Policy Experts: Harmonizing Supervised Fine-Tuning and Reinforcement Learning via Dynamic Weighting
von: Zhang, Wenhao, et al.
Veröffentlicht: (2025)
von: Zhang, Wenhao, et al.
Veröffentlicht: (2025)
ProRL: Effective Reinforcement Learning for Proactive Recommendation via Rectified Policy Gradient Estimation
von: Hou, Hongru, et al.
Veröffentlicht: (2026)
von: Hou, Hongru, et al.
Veröffentlicht: (2026)
Target-Aligned Reinforcement Learning
von: Pleiss, Leonard S., et al.
Veröffentlicht: (2026)
von: Pleiss, Leonard S., et al.
Veröffentlicht: (2026)
DAIL: Beyond Task Ambiguity for Language-Conditioned Reinforcement Learning
von: Xie, Runpeng, et al.
Veröffentlicht: (2025)
von: Xie, Runpeng, et al.
Veröffentlicht: (2025)
OmniReflect: Discovering Transferable Constitutions for LLM agents via Neuro-Symbolic Reflections
von: Bharadwaj, Manasa, et al.
Veröffentlicht: (2025)
von: Bharadwaj, Manasa, et al.
Veröffentlicht: (2025)
SpeakRL: Synergizing Reasoning, Speaking, and Acting in Language Models with Reinforcement Learning
von: Acikgoz, Emre Can, et al.
Veröffentlicht: (2025)
von: Acikgoz, Emre Can, et al.
Veröffentlicht: (2025)
Using Curiosity for an Even Representation of Tasks in Continual Offline Reinforcement Learning
von: Pathmanathan, Pankayaraj, et al.
Veröffentlicht: (2023)
von: Pathmanathan, Pankayaraj, et al.
Veröffentlicht: (2023)
Ensemble Successor Representations for Task Generalization in Offline-to-Online Reinforcement Learning
von: Wang, Changhong, et al.
Veröffentlicht: (2024)
von: Wang, Changhong, et al.
Veröffentlicht: (2024)
Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning
von: Reizinger, Patrik, et al.
Veröffentlicht: (2025)
von: Reizinger, Patrik, et al.
Veröffentlicht: (2025)
Forward versus Backward: Comparing Reasoning Objectives in Direct Preference Optimization
von: Nikzad, Murtaza, et al.
Veröffentlicht: (2026)
von: Nikzad, Murtaza, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Learning Distinguishable Representations in Deep Q-Networks for Linear Transfer
von: Sathish, Sooraj, et al.
Veröffentlicht: (2025) -
Generalisation in Multitask Fitted Q-Iteration and Offline Q-learning
von: Manda, Kausthubh, et al.
Veröffentlicht: (2025) -
Full-Gradient Successor Feature Representations
von: Shrirao, Ritish, et al.
Veröffentlicht: (2026) -
Image Generation from Image Captioning -- Invertible Approach
von: Menon, Nandakishore S, et al.
Veröffentlicht: (2024) -
Understanding Transferable Representation Learning and Zero-shot Transfer in CLIP
von: Chen, Zixiang, et al.
Veröffentlicht: (2023)