Saved in:
| Main Author: | Parab, Mandar |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2601.00885 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Enhancing Creativity in Large Language Models through Associative Thinking Strategies
by: Mehrotra, Pronita, et al.
Published: (2024)
by: Mehrotra, Pronita, et al.
Published: (2024)
Counterfactual Credit Policy Optimization for Multi-Agent Collaboration
by: Li, Zhongyi, et al.
Published: (2026)
by: Li, Zhongyi, et al.
Published: (2026)
Training Emergent Joint Associations: A Reinforcement Learning Approach to Creative Thinking in Language Models
by: Singh, Mukul, et al.
Published: (2025)
by: Singh, Mukul, et al.
Published: (2025)
Self-Questioning Language Models
by: Chen, Lili, et al.
Published: (2025)
by: Chen, Lili, et al.
Published: (2025)
Efficient Learning for Product Attributes with Compact Multimodal Models
by: Kulkarni, Mandar
Published: (2025)
by: Kulkarni, Mandar
Published: (2025)
Diffusion-based Surrogate Model for Time-varying Underwater Acoustic Channels
by: Li, Kexin, et al.
Published: (2025)
by: Li, Kexin, et al.
Published: (2025)
Chart-RL: Policy Optimization Reinforcement Learning for Enhanced Visual Reasoning in Chart Question Answering with Vision Language Models
by: Bai, Yunfei, et al.
Published: (2026)
by: Bai, Yunfei, et al.
Published: (2026)
Reinforcement Learning for Optimizing RAG for Domain Chatbots
by: Kulkarni, Mandar, et al.
Published: (2024)
by: Kulkarni, Mandar, et al.
Published: (2024)
Self-Blinding and Counterfactual Self-Simulation Mitigate Biases and Sycophancy in Large Language Models
by: Christian, Brian, et al.
Published: (2026)
by: Christian, Brian, et al.
Published: (2026)
Causal Discovery and Counterfactual Reasoning to Optimize Persuasive Dialogue Policies
by: Zeng, Donghuo, et al.
Published: (2025)
by: Zeng, Donghuo, et al.
Published: (2025)
Counterfactual Multi-Agent Policy Gradients
by: Foerster, Jakob, et al.
Published: (2017)
by: Foerster, Jakob, et al.
Published: (2017)
A Rolling Stone Gathers No Moss: Adaptive Policy Optimization for Stable Self-Evaluation in Large Multimodal Models
by: Wang, Wenkai, et al.
Published: (2025)
by: Wang, Wenkai, et al.
Published: (2025)
Aligning Large Language Models with Counterfactual DPO
by: Butcher, Bradley
Published: (2024)
by: Butcher, Bradley
Published: (2024)
Information Guided Regularization for Fine-tuning Language Models
by: Sharma, Mandar, et al.
Published: (2024)
by: Sharma, Mandar, et al.
Published: (2024)
Laying Anchors: Semantically Priming Numerals in Language Modeling
by: Sharma, Mandar, et al.
Published: (2024)
by: Sharma, Mandar, et al.
Published: (2024)
Inherent Diverse Redundant Safety Mechanisms for AI-based Software Elements in Automotive Applications
by: Pitale, Mandar, et al.
Published: (2024)
by: Pitale, Mandar, et al.
Published: (2024)
A Mathematical Framework for Temporal Modeling and Counterfactual Policy Simulation of Student Dropout
by: da Silva, Rafael, et al.
Published: (2026)
by: da Silva, Rafael, et al.
Published: (2026)
CLOMO: Counterfactual Logical Modification with Large Language Models
by: Huang, Yinya, et al.
Published: (2023)
by: Huang, Yinya, et al.
Published: (2023)
Integrating Counterfactual Simulations with Language Models for Explaining Multi-Agent Behaviour
by: Gyevnár, Bálint, et al.
Published: (2025)
by: Gyevnár, Bálint, et al.
Published: (2025)
Think before You Simulate: Symbolic Reasoning to Orchestrate Neural Computation for Counterfactual Question Answering
by: Ishay, Adam, et al.
Published: (2025)
by: Ishay, Adam, et al.
Published: (2025)
Natural Language Counterfactual Explanations for Graphs Using Large Language Models
by: Giorgi, Flavio, et al.
Published: (2024)
by: Giorgi, Flavio, et al.
Published: (2024)
Self-Distilled Disentangled Learning for Counterfactual Prediction
by: Li, Xinshu, et al.
Published: (2024)
by: Li, Xinshu, et al.
Published: (2024)
Gumbel Counterfactual Generation From Language Models
by: Ravfogel, Shauli, et al.
Published: (2024)
by: Ravfogel, Shauli, et al.
Published: (2024)
Counterfactual Token Generation in Large Language Models
by: Chatzi, Ivi, et al.
Published: (2024)
by: Chatzi, Ivi, et al.
Published: (2024)
Counterfactual Language Reasoning for Explainable Recommendation Systems
by: Li, Guanrong, et al.
Published: (2025)
by: Li, Guanrong, et al.
Published: (2025)
M-GRPO: Stabilizing Self-Supervised Reinforcement Learning for Large Language Models with Momentum-Anchored Policy Optimization
by: Bai, Bizhe, et al.
Published: (2025)
by: Bai, Bizhe, et al.
Published: (2025)
Leveraging Counterfactual Paths for Contrastive Explanations of POMDP Policies
by: Kraske, Benjamin, et al.
Published: (2024)
by: Kraske, Benjamin, et al.
Published: (2024)
OPSDL: On-Policy Self-Distillation for Long-Context Language Models
by: Zhang, Xinsen, et al.
Published: (2026)
by: Zhang, Xinsen, et al.
Published: (2026)
SocialCounterfactuals: Probing and Mitigating Intersectional Social Biases in Vision-Language Models with Counterfactual Examples
by: Howard, Phillip, et al.
Published: (2023)
by: Howard, Phillip, et al.
Published: (2023)
Counterfactual Probing for Hallucination Detection and Mitigation in Large Language Models
by: Feng, Yijun
Published: (2025)
by: Feng, Yijun
Published: (2025)
WMPO: World Model-based Policy Optimization for Vision-Language-Action Models
by: Zhu, Fangqi, et al.
Published: (2025)
by: Zhu, Fangqi, et al.
Published: (2025)
Aligning Large Language Models by On-Policy Self-Judgment
by: Lee, Sangkyu, et al.
Published: (2024)
by: Lee, Sangkyu, et al.
Published: (2024)
Constrained Language Model Policy Optimization via Risk-aware Stepwise Alignment
by: Zhang, Lijun, et al.
Published: (2025)
by: Zhang, Lijun, et al.
Published: (2025)
dTRPO: Trajectory Reduction in Policy Optimization of Diffusion Large Language Models
by: Zhang, Wenxuan, et al.
Published: (2026)
by: Zhang, Wenxuan, et al.
Published: (2026)
LEPO: Latent Reasoning Policy Optimization for Large Language Models
by: Zhou, Yuyan, et al.
Published: (2026)
by: Zhou, Yuyan, et al.
Published: (2026)
Not All Memories Age the Same: Autodiscovery of Adaptive Decay in Knowledge Graphs
by: Karhade, Mandar
Published: (2026)
by: Karhade, Mandar
Published: (2026)
Uncovering Bias in Large Vision-Language Models with Counterfactuals
by: Howard, Phillip, et al.
Published: (2024)
by: Howard, Phillip, et al.
Published: (2024)
Reasoning Elicitation in Language Models via Counterfactual Feedback
by: Hüyük, Alihan, et al.
Published: (2024)
by: Hüyük, Alihan, et al.
Published: (2024)
Online Causal Kalman Filtering for Stable and Effective Policy Optimization
by: He, Shuo, et al.
Published: (2026)
by: He, Shuo, et al.
Published: (2026)
ACTER: Diverse and Actionable Counterfactual Sequences for Explaining and Diagnosing RL Policies
by: Gajcin, Jasmina, et al.
Published: (2024)
by: Gajcin, Jasmina, et al.
Published: (2024)
Similar Items
-
Enhancing Creativity in Large Language Models through Associative Thinking Strategies
by: Mehrotra, Pronita, et al.
Published: (2024) -
Counterfactual Credit Policy Optimization for Multi-Agent Collaboration
by: Li, Zhongyi, et al.
Published: (2026) -
Training Emergent Joint Associations: A Reinforcement Learning Approach to Creative Thinking in Language Models
by: Singh, Mukul, et al.
Published: (2025) -
Self-Questioning Language Models
by: Chen, Lili, et al.
Published: (2025) -
Efficient Learning for Product Attributes with Compact Multimodal Models
by: Kulkarni, Mandar
Published: (2025)