When Domains Interact: Asymmetric and Order-Sensitive Cross-Domain Effects in Reinforcement Learning for Reasoning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Wang, Wang, Shouren, Song, Chaoda, Ma, Chuang, Li, Xinpeng, Wang, Nengbo, Zhou, Kaixiong, Chaudhary, Vipin, Han, Xiaotian |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Mid-Think: Training-Free Intermediate-Budget Reasoning via Token-Level Triggers
par: Yang, Wang, et autres
Publié: (2026)
par: Yang, Wang, et autres
Publié: (2026)
Path-Lock Expert: Separating Reasoning Mode in Hybrid Thinking via Architecture-Level Separation
par: Wang, Shouren, et autres
Publié: (2026)
par: Wang, Shouren, et autres
Publié: (2026)
AgentCE-Bench: Agent Configurable Evaluation with Scalable Horizons and Controllable Difficulty under Lightweight Environments
par: Yang, Wang, et autres
Publié: (2026)
par: Yang, Wang, et autres
Publié: (2026)
CausalRAG: Integrating Causal Graphs into Retrieval-Augmented Generation
par: Wang, Nengbo, et autres
Publié: (2025)
par: Wang, Nengbo, et autres
Publié: (2025)
Demystifying Hybrid Thinking: Can LLMs Truly Switch Between Think and No-Think?
par: Wang, Shouren, et autres
Publié: (2025)
par: Wang, Shouren, et autres
Publié: (2025)
HugRAG: Hierarchical Causal Knowledge Graph Design for RAG
par: Wang, Nengbo, et autres
Publié: (2026)
par: Wang, Nengbo, et autres
Publié: (2026)
Speculative Thinking: Enhancing Small-Model Reasoning with Large Model Guidance at Inference Time
par: Yang, Wang, et autres
Publié: (2025)
par: Yang, Wang, et autres
Publié: (2025)
CausalGuard: Conformal Inference under Graph Uncertainty
par: Singh, Vikash, et autres
Publié: (2026)
par: Singh, Vikash, et autres
Publié: (2026)
Asymmetric Advantage Modulation Calibrates Entropy Dynamics in RLVR
par: Gu, Hengrui, et autres
Publié: (2026)
par: Gu, Hengrui, et autres
Publié: (2026)
LRD-Net: A Lightweight Real-Centered Detection Network for Cross-Domain Face Forgery Detection
par: Zhang, Xuecen, et autres
Publié: (2026)
par: Zhang, Xuecen, et autres
Publié: (2026)
FedCCRL: Federated Domain Generalization with Cross-Client Representation Learning
par: Wang, Xinpeng, et autres
Publié: (2024)
par: Wang, Xinpeng, et autres
Publié: (2024)
Longer Context, Deeper Thinking: Uncovering the Role of Long-Context Ability in Reasoning
par: Yang, Wang, et autres
Publié: (2025)
par: Yang, Wang, et autres
Publié: (2025)
Overcoming Dynamics-Blindness: Training-Free Pace-and-Path Correction for VLA Models
par: Zhang, Yanyan, et autres
Publié: (2026)
par: Zhang, Yanyan, et autres
Publié: (2026)
Thinking Preference Optimization
par: Yang, Wang, et autres
Publié: (2025)
par: Yang, Wang, et autres
Publié: (2025)
Landscapes of realism: Rethinking literary realism in comparative perspectives. Volume II: Pathways through realism. Svend ErikLarsen, Steen BilleJørgensen and Margaret R.Higonnet (Eds.), Amsterdam/Philadelphia: John Benjamins Publishing Company, 2022. pp. 780. €190/$285 (hbk). ISBN: 978 90 272 1085 2
par: Shouren Wang
Publié: (2024)
par: Shouren Wang
Publié: (2024)
100-LongBench: Are de facto Long-Context Benchmarks Literally Evaluating Long-Context Ability?
par: Yang, Wang, et autres
Publié: (2025)
par: Yang, Wang, et autres
Publié: (2025)
Grammars of Formal Uncertainty: When to Trust LLMs in Automated Reasoning Tasks
par: Ganguly, Debargha, et autres
Publié: (2025)
par: Ganguly, Debargha, et autres
Publié: (2025)
SELF: Self-Extend the Context Length With Logistic Growth Function
par: Dang, Phat Thanh, et autres
Publié: (2025)
par: Dang, Phat Thanh, et autres
Publié: (2025)
PokeMQA: Programmable knowledge editing for Multi-hop Question Answering
par: Gu, Hengrui, et autres
Publié: (2023)
par: Gu, Hengrui, et autres
Publié: (2023)
Revisiting Reinforcement Learning for LLM Reasoning from A Cross-Domain Perspective
par: Cheng, Zhoujun, et autres
Publié: (2025)
par: Cheng, Zhoujun, et autres
Publié: (2025)
MAVR-Net: Robust Multi-View Learning for MAV Action Recognition with Cross-View Attention
par: Zhang, Nengbo, et autres
Publié: (2025)
par: Zhang, Nengbo, et autres
Publié: (2025)
Reinforcement Learning for Tool-Integrated Interleaved Thinking towards Cross-Domain Generalization
par: Chen, Zhengyu, et autres
Publié: (2025)
par: Chen, Zhengyu, et autres
Publié: (2025)
You Only Debias Once: Towards Flexible Accuracy-Fairness Trade-offs at Inference Time
par: Han, Xiaotian, et autres
Publié: (2025)
par: Han, Xiaotian, et autres
Publié: (2025)
Ranking Reasoning LLMs under Test-Time Scaling
par: Hariri, Mohsen, et autres
Publié: (2026)
par: Hariri, Mohsen, et autres
Publié: (2026)
HOPPS: Hardware-Aware Optimal Phase Polynomial Synthesis with Blockwise Optimization for Quantum Circuits
par: Li, Xinpeng, et autres
Publié: (2025)
par: Li, Xinpeng, et autres
Publié: (2025)
Simulation Method of Microscale Fluid-Structure Interactions: Diffuse-Resistance-Domain Approach
par: Gao, Min, et autres
Publié: (2024)
par: Gao, Min, et autres
Publié: (2024)
Detecting AI-Generated Texts in Cross-Domains
par: Zhou, You, et autres
Publié: (2024)
par: Zhou, You, et autres
Publié: (2024)
Contrastive Representation for Data Filtering in Cross-Domain Offline Reinforcement Learning
par: Wen, Xiaoyu, et autres
Publié: (2024)
par: Wen, Xiaoyu, et autres
Publié: (2024)
SRPO: A Cross-Domain Implementation of Large-Scale Reinforcement Learning on LLM
par: Zhang, Xiaojiang, et autres
Publié: (2025)
par: Zhang, Xiaojiang, et autres
Publié: (2025)
VeloGauss: Learning Physically Consistent Gaussian Velocity Fields from Videos
par: Lu, Nengbo, et autres
Publié: (2026)
par: Lu, Nengbo, et autres
Publié: (2026)
CausalGS: Learning Physical Causality of 3D Dynamic Scenes with Gaussian Representations
par: Lu, Nengbo, et autres
Publié: (2026)
par: Lu, Nengbo, et autres
Publié: (2026)
Learning Domain-Invariant Representations for Cross-Domain Image Registration via Scene-Appearance Disentanglement
par: Qin, Jiahao, et autres
Publié: (2026)
par: Qin, Jiahao, et autres
Publié: (2026)
Rethinking Independent Cross-Entropy Loss For Graph-Structured Data
par: Miao, Rui, et autres
Publié: (2024)
par: Miao, Rui, et autres
Publié: (2024)
Reinforced Context Order Recovery for Adaptive Reasoning and Planning
par: Ma, Long, et autres
Publié: (2025)
par: Ma, Long, et autres
Publié: (2025)
Atomic Skills are the Prerequisite: When Reinforcement Learning Synthesizes Compositional Reasoning, and When It Only Amplifies
par: Cheng, Sitao, et autres
Publié: (2025)
par: Cheng, Sitao, et autres
Publié: (2025)
Domain Generalization via Causal Adjustment for Cross-Domain Sentiment Analysis
par: Wang, Siyin, et autres
Publié: (2024)
par: Wang, Siyin, et autres
Publié: (2024)
Federated Graph Learning for Cross-Domain Recommendation
par: Yang, Ziqi, et autres
Publié: (2024)
par: Yang, Ziqi, et autres
Publié: (2024)
Unifying Value Alignment and Assignment in Cross-Domain Offline Reinforcement Learning with Heterogeneous Datasets
par: Qiao, Zhongjian, et autres
Publié: (2026)
par: Qiao, Zhongjian, et autres
Publié: (2026)
QuMod: Parallel Quantum Job Scheduling on Modular QPUs using Circuit Cutting
par: Kulkarni, Vinooth, et autres
Publié: (2026)
par: Kulkarni, Vinooth, et autres
Publié: (2026)
MGDIL: Multi-Granularity Summarization and Domain-Invariant Learning for Cross-Domain Social Bot Detection
par: Qiao, Boyu, et autres
Publié: (2026)
par: Qiao, Boyu, et autres
Publié: (2026)
Documents similaires
-
Mid-Think: Training-Free Intermediate-Budget Reasoning via Token-Level Triggers
par: Yang, Wang, et autres
Publié: (2026) -
Path-Lock Expert: Separating Reasoning Mode in Hybrid Thinking via Architecture-Level Separation
par: Wang, Shouren, et autres
Publié: (2026) -
AgentCE-Bench: Agent Configurable Evaluation with Scalable Horizons and Controllable Difficulty under Lightweight Environments
par: Yang, Wang, et autres
Publié: (2026) -
CausalRAG: Integrating Causal Graphs into Retrieval-Augmented Generation
par: Wang, Nengbo, et autres
Publié: (2025) -
Demystifying Hybrid Thinking: Can LLMs Truly Switch Between Think and No-Think?
par: Wang, Shouren, et autres
Publié: (2025)