CAREL: Instruction-guided reinforcement learning with cross-modal auxiliary objectives
Fuente:
arXiv
Salvato in:
| Autori principali: | Saghafian, Armin, Izadi, Amirmohammad, Dijujin, Negin Hashemi, Baghshah, Mahdieh Soleymani |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PreND: Enhancing Intrinsic Motivation in Reinforcement Learning through Pre-trained Network Distillation
di: Davoodabadi, Mohammadamin, et al.
Pubblicazione: (2024)
di: Davoodabadi, Mohammadamin, et al.
Pubblicazione: (2024)
Inductive Biases for Zero-shot Systematic Generalization in Language-informed Reinforcement Learning
di: Dijujin, Negin Hashemi, et al.
Pubblicazione: (2025)
di: Dijujin, Negin Hashemi, et al.
Pubblicazione: (2025)
SUSD: Structured Unsupervised Skill Discovery through State Factorization
di: Hosseini, Seyed Mohammad Hadi, et al.
Pubblicazione: (2026)
di: Hosseini, Seyed Mohammad Hadi, et al.
Pubblicazione: (2026)
Visual Structures Helps Visual Reasoning: Addressing the Binding Problem in VLMs
di: Izadi, Amirmohammad, et al.
Pubblicazione: (2025)
di: Izadi, Amirmohammad, et al.
Pubblicazione: (2025)
Efficient Adversarial Attacks on High-dimensional Offline Bandits
di: Hosseini, Seyed Mohammad Hadi, et al.
Pubblicazione: (2026)
di: Hosseini, Seyed Mohammad Hadi, et al.
Pubblicazione: (2026)
LibraGrad: Balancing Gradient Flow for Universally Better Vision Transformer Attributions
di: Mehri, Faridoun, et al.
Pubblicazione: (2024)
di: Mehri, Faridoun, et al.
Pubblicazione: (2024)
Limits and Gains of Test-Time Scaling in Vision-Language Reasoning
di: Ahmadpour, Mohammadjavad, et al.
Pubblicazione: (2025)
di: Ahmadpour, Mohammadjavad, et al.
Pubblicazione: (2025)
Understanding Counting Mechanisms in Large Language and Vision-Language Models
di: Hasani, Hosein, et al.
Pubblicazione: (2025)
di: Hasani, Hosein, et al.
Pubblicazione: (2025)
Uncovering Grounding IDs: How External Cues Shape Multimodal Binding
di: Hasani, Hosein, et al.
Pubblicazione: (2025)
di: Hasani, Hosein, et al.
Pubblicazione: (2025)
Fine-Grained Alignment and Noise Refinement for Compositional Text-to-Image Generation
di: Izadi, Amir Mohammad, et al.
Pubblicazione: (2025)
di: Izadi, Amir Mohammad, et al.
Pubblicazione: (2025)
Improving 3D Few-Shot Segmentation with Inference-Time Pseudo-Labeling
di: Mozafari, Mohammad, et al.
Pubblicazione: (2024)
di: Mozafari, Mohammad, et al.
Pubblicazione: (2024)
Bridging Reasoning to Learning: Unmasking Illusions using Complexity Out of Distribution Generalization
di: Paqaleh, Mohammad Mahdi Samiei, et al.
Pubblicazione: (2025)
di: Paqaleh, Mohammad Mahdi Samiei, et al.
Pubblicazione: (2025)
The Illusion of Procedural Reasoning: Measuring Long-Horizon FSM Execution in LLMs
di: Samiei, Mahdi, et al.
Pubblicazione: (2025)
di: Samiei, Mahdi, et al.
Pubblicazione: (2025)
Effective Generative AI: The Human-Algorithm Centaur
di: Saghafian, Soroush, et al.
Pubblicazione: (2024)
di: Saghafian, Soroush, et al.
Pubblicazione: (2024)
ComAlign: Compositional Alignment in Vision-Language Models
di: Abdollah, Ali, et al.
Pubblicazione: (2024)
di: Abdollah, Ali, et al.
Pubblicazione: (2024)
Dilated Balanced Cross Entropy Loss for Medical Image Segmentation
di: Hosseini, Seyed Mohsen, et al.
Pubblicazione: (2024)
di: Hosseini, Seyed Mohsen, et al.
Pubblicazione: (2024)
Effect of a Process Mining based Pre-processing Step in Prediction of the Critical Health Outcomes
di: Ashrafi, Negin, et al.
Pubblicazione: (2024)
di: Ashrafi, Negin, et al.
Pubblicazione: (2024)
MEENA (PersianMMMU): Multimodal-Multilingual Educational Exams for N-level Assessment
di: Ghahroodi, Omid, et al.
Pubblicazione: (2025)
di: Ghahroodi, Omid, et al.
Pubblicazione: (2025)
Large Language Models for Sequential Decision-Making: Improving In-Context Learning via Supervised Fine-Tuning
di: Zhang, Minmin, et al.
Pubblicazione: (2026)
di: Zhang, Minmin, et al.
Pubblicazione: (2026)
T2I-FineEval: Fine-Grained Compositional Metric for Text-to-Image Evaluation
di: Hosseini, Seyed Mohammad Hadi, et al.
Pubblicazione: (2025)
di: Hosseini, Seyed Mohammad Hadi, et al.
Pubblicazione: (2025)
Trained Models Tell Us How to Make Them Robust to Spurious Correlation without Group Annotation
di: Ghaznavi, Mahdi, et al.
Pubblicazione: (2024)
di: Ghaznavi, Mahdi, et al.
Pubblicazione: (2024)
CER: Confidence Enhanced Reasoning in LLMs
di: Razghandi, Ali, et al.
Pubblicazione: (2025)
di: Razghandi, Ali, et al.
Pubblicazione: (2025)
VQEL: Enabling Self-Play in Emergent Language Games via Agent-Internal Vector Quantization
di: Paqaleh, Mohammad Mahdi Samiei, et al.
Pubblicazione: (2025)
di: Paqaleh, Mohammad Mahdi Samiei, et al.
Pubblicazione: (2025)
Logic-informed reinforcement learning for cross-domain optimization of large-scale cyber-physical systems
di: Wan, Guangxi, et al.
Pubblicazione: (2025)
di: Wan, Guangxi, et al.
Pubblicazione: (2025)
Classification of Breast Cancer Histopathology Images using a Modified Supervised Contrastive Learning Method
di: Sani, Matina Mahdizadeh, et al.
Pubblicazione: (2024)
di: Sani, Matina Mahdizadeh, et al.
Pubblicazione: (2024)
GABInsight: Exploring Gender-Activity Binding Bias in Vision-Language Models
di: Abdollahi, Ali, et al.
Pubblicazione: (2024)
di: Abdollahi, Ali, et al.
Pubblicazione: (2024)
ASDFormer: A Transformer with Mixtures of Pooling-Classifier Experts for Robust Autism Diagnosis and Biomarker Discovery
di: Izadi, Mohammad, et al.
Pubblicazione: (2025)
di: Izadi, Mohammad, et al.
Pubblicazione: (2025)
Normalization and effective learning rates in reinforcement learning
di: Lyle, Clare, et al.
Pubblicazione: (2024)
di: Lyle, Clare, et al.
Pubblicazione: (2024)
LLM-Agent-Controller: A Universal Multi-Agent Large Language Model System as a Control Engineer
di: Zahedifar, Rasoul, et al.
Pubblicazione: (2025)
di: Zahedifar, Rasoul, et al.
Pubblicazione: (2025)
Curriculum reinforcement learning with measurable task representation learning
di: Wen, Yongyan, et al.
Pubblicazione: (2026)
di: Wen, Yongyan, et al.
Pubblicazione: (2026)
Bridging the phenotype-target gap for molecular generation via multi-objective reinforcement learning
di: Guo, Haotian, et al.
Pubblicazione: (2025)
di: Guo, Haotian, et al.
Pubblicazione: (2025)
Adaptive traffic signal safety and efficiency improvement by multi objective deep reinforcement learning approach
di: Mirbakhsh, Shahin, et al.
Pubblicazione: (2024)
di: Mirbakhsh, Shahin, et al.
Pubblicazione: (2024)
Knowledge Distillation on Spatial-Temporal Graph Convolutional Network for Traffic Prediction
di: Izadi, Mohammad, et al.
Pubblicazione: (2024)
di: Izadi, Mohammad, et al.
Pubblicazione: (2024)
Causal prompting model-based offline reinforcement learning
di: Yu, Xuehui, et al.
Pubblicazione: (2024)
di: Yu, Xuehui, et al.
Pubblicazione: (2024)
Deep reinforcement learning with time-scale invariant memory
di: Kabir, Md Rysul, et al.
Pubblicazione: (2024)
di: Kabir, Md Rysul, et al.
Pubblicazione: (2024)
Offline reinforcement learning for job-shop scheduling problems
di: Echeverria, Imanol, et al.
Pubblicazione: (2024)
di: Echeverria, Imanol, et al.
Pubblicazione: (2024)
Counterfactual experience augmented off-policy reinforcement learning
di: Lee, Sunbowen, et al.
Pubblicazione: (2025)
di: Lee, Sunbowen, et al.
Pubblicazione: (2025)
Delayed homomorphic reinforcement learning for environments with delayed feedback
di: Lee, Jongsoo, et al.
Pubblicazione: (2026)
di: Lee, Jongsoo, et al.
Pubblicazione: (2026)
Bellman operator convergence enhancements in reinforcement learning algorithms
di: Kadurha, David Krame, et al.
Pubblicazione: (2025)
di: Kadurha, David Krame, et al.
Pubblicazione: (2025)
Dynamic feature selection in medical predictive monitoring by reinforcement learning
di: Chen, Yutong, et al.
Pubblicazione: (2024)
di: Chen, Yutong, et al.
Pubblicazione: (2024)
Documenti analoghi
-
PreND: Enhancing Intrinsic Motivation in Reinforcement Learning through Pre-trained Network Distillation
di: Davoodabadi, Mohammadamin, et al.
Pubblicazione: (2024) -
Inductive Biases for Zero-shot Systematic Generalization in Language-informed Reinforcement Learning
di: Dijujin, Negin Hashemi, et al.
Pubblicazione: (2025) -
SUSD: Structured Unsupervised Skill Discovery through State Factorization
di: Hosseini, Seyed Mohammad Hadi, et al.
Pubblicazione: (2026) -
Visual Structures Helps Visual Reasoning: Addressing the Binding Problem in VLMs
di: Izadi, Amirmohammad, et al.
Pubblicazione: (2025) -
Efficient Adversarial Attacks on High-dimensional Offline Bandits
di: Hosseini, Seyed Mohammad Hadi, et al.
Pubblicazione: (2026)