Salvato in:
| Autori principali: | Qiu, Yiwen, Wu, Linjuan, Liu, Yizhou, Yan, Yuchen, Ma, Jin, Tan, Xu, Hu, Yao, Zhang, Daoxin, Zhang, Wenqi, Lu, Weiming, Xiao, Jun, Shen, Yongliang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2604.19656 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LAPO: Internalizing Reasoning Efficiency via Length-Adaptive Policy Optimization
di: Wu, Xingyu, et al.
Pubblicazione: (2025)
di: Wu, Xingyu, et al.
Pubblicazione: (2025)
TimeToM: Temporal Space is the Key to Unlocking the Door of Large Language Models' Theory-of-Mind
di: Hou, Guiyang, et al.
Pubblicazione: (2024)
di: Hou, Guiyang, et al.
Pubblicazione: (2024)
AskToAct: Enhancing LLMs Tool Use via Self-Correcting Clarification
di: Zhang, Xuan, et al.
Pubblicazione: (2025)
di: Zhang, Xuan, et al.
Pubblicazione: (2025)
Self-Contrast: Better Reflection Through Inconsistent Solving Perspectives
di: Zhang, Wenqi, et al.
Pubblicazione: (2024)
di: Zhang, Wenqi, et al.
Pubblicazione: (2024)
SpatialLadder: Progressive Training for Spatial Reasoning in Vision-Language Models
di: Li, Hongxing, et al.
Pubblicazione: (2025)
di: Li, Hongxing, et al.
Pubblicazione: (2025)
Hierarchical Budget Policy Optimization for Adaptive Reasoning
di: Lyu, Shangke, et al.
Pubblicazione: (2025)
di: Lyu, Shangke, et al.
Pubblicazione: (2025)
CoVerRL: Breaking the Consensus Trap in Label-Free Reasoning via Generator-Verifier Co-Evolution
di: Pan, Teng, et al.
Pubblicazione: (2026)
di: Pan, Teng, et al.
Pubblicazione: (2026)
GroundAct: Can LLM Agents Ground Actions in Environmental States?
di: Wang, Zixuan, et al.
Pubblicazione: (2025)
di: Wang, Zixuan, et al.
Pubblicazione: (2025)
STaR-SQL: Self-Taught Reasoner for Text-to-SQL
di: He, Mingqian, et al.
Pubblicazione: (2025)
di: He, Mingqian, et al.
Pubblicazione: (2025)
Cooper: Co-Optimizing Policy and Reward Models in Reinforcement Learning for Large Language Models
di: Hong, Haitao, et al.
Pubblicazione: (2025)
di: Hong, Haitao, et al.
Pubblicazione: (2025)
Advancing Process Verification for Large Language Models via Tree-Based Preference Learning
di: He, Mingqian, et al.
Pubblicazione: (2024)
di: He, Mingqian, et al.
Pubblicazione: (2024)
Language as a Latent Variable for Reasoning Optimization
di: Wu, Linjuan, et al.
Pubblicazione: (2026)
di: Wu, Linjuan, et al.
Pubblicazione: (2026)
EgoSocialArena: Benchmarking the Social Intelligence of Large Language Models from a First-person Perspective
di: Hou, Guiyang, et al.
Pubblicazione: (2024)
di: Hou, Guiyang, et al.
Pubblicazione: (2024)
Data-Copilot: Bridging Billions of Data and Humans with Autonomous Workflow
di: Zhang, Wenqi, et al.
Pubblicazione: (2023)
di: Zhang, Wenqi, et al.
Pubblicazione: (2023)
EasySteer: A Unified Framework for High-Performance and Extensible LLM Steering
di: Xu, Haolei, et al.
Pubblicazione: (2025)
di: Xu, Haolei, et al.
Pubblicazione: (2025)
SVGenius: Benchmarking LLMs in SVG Understanding, Editing and Generation
di: Chen, Siqi, et al.
Pubblicazione: (2025)
di: Chen, Siqi, et al.
Pubblicazione: (2025)
Let LRMs Break Free from Overthinking via Self-Braking Tuning
di: Zhao, Haoran, et al.
Pubblicazione: (2025)
di: Zhao, Haoran, et al.
Pubblicazione: (2025)
Mind the Gap: Bridging Thought Leap for Improved Chain-of-Thought Tuning
di: Xu, Haolei, et al.
Pubblicazione: (2025)
di: Xu, Haolei, et al.
Pubblicazione: (2025)
UI-Copilot: Advancing Long-Horizon GUI Automation via Tool-Integrated Policy Optimization
di: Lu, Zhengxi, et al.
Pubblicazione: (2026)
di: Lu, Zhengxi, et al.
Pubblicazione: (2026)
GUI-G$^2$: Gaussian Reward Modeling for GUI Grounding
di: Tang, Fei, et al.
Pubblicazione: (2025)
di: Tang, Fei, et al.
Pubblicazione: (2025)
ClawGUI: A Unified Framework for Training, Evaluating, and Deploying GUI Agents
di: Tang, Fei, et al.
Pubblicazione: (2026)
di: Tang, Fei, et al.
Pubblicazione: (2026)
Active Confusion Expression in Large Language Models: Leveraging World Models toward Better Social Reasoning
di: Du, Jialu, et al.
Pubblicazione: (2025)
di: Du, Jialu, et al.
Pubblicazione: (2025)
Test-Time Reinforcement Learning for GUI Grounding via Region Consistency
di: Du, Yong, et al.
Pubblicazione: (2025)
di: Du, Yong, et al.
Pubblicazione: (2025)
DB-Explore: Automated Database Exploration and Instruction Synthesis for Text-to-SQL
di: Ma, Haoyuan, et al.
Pubblicazione: (2025)
di: Ma, Haoyuan, et al.
Pubblicazione: (2025)
Code-A1: Adversarial Evolving of Code LLM and Test LLM via Reinforcement Learning
di: Wang, Aozhe, et al.
Pubblicazione: (2026)
di: Wang, Aozhe, et al.
Pubblicazione: (2026)
KnowU-Bench: Towards Interactive, Proactive, and Personalized Mobile Agent Evaluation
di: Chen, Tongbo, et al.
Pubblicazione: (2026)
di: Chen, Tongbo, et al.
Pubblicazione: (2026)
Think Twice, Click Once: Enhancing GUI Grounding via Fast and Slow Systems
di: Tang, Fei, et al.
Pubblicazione: (2025)
di: Tang, Fei, et al.
Pubblicazione: (2025)
Multimodal Self-Instruct: Synthetic Abstract Image and Visual Reasoning Instruction Using Language Model
di: Zhang, Wenqi, et al.
Pubblicazione: (2024)
di: Zhang, Wenqi, et al.
Pubblicazione: (2024)
GSM8K-V: Can Vision Language Models Solve Grade School Math Word Problems in Visual Contexts
di: Yuan, Fan, et al.
Pubblicazione: (2025)
di: Yuan, Fan, et al.
Pubblicazione: (2025)
GaVaMoE: Gaussian-Variational Gated Mixture of Experts for Explainable Recommendation
di: Tang, Fei, et al.
Pubblicazione: (2024)
di: Tang, Fei, et al.
Pubblicazione: (2024)
Insert or Attach: Taxonomy Completion via Box Embedding
di: Xue, Wei, et al.
Pubblicazione: (2023)
di: Xue, Wei, et al.
Pubblicazione: (2023)
A Survey on (M)LLM-Based GUI Agents
di: Tang, Fei, et al.
Pubblicazione: (2025)
di: Tang, Fei, et al.
Pubblicazione: (2025)
Milestone-Guided Policy Learning for Long-Horizon Language Agents
di: Wang, Zixuan, et al.
Pubblicazione: (2026)
di: Wang, Zixuan, et al.
Pubblicazione: (2026)
TaskBench: Benchmarking Large Language Models for Task Automation
di: Shen, Yongliang, et al.
Pubblicazione: (2023)
di: Shen, Yongliang, et al.
Pubblicazione: (2023)
InftyThink: Breaking the Length Limits of Long-Context Reasoning in Large Language Models
di: Yan, Yuchen, et al.
Pubblicazione: (2025)
di: Yan, Yuchen, et al.
Pubblicazione: (2025)
ViewSpatial-Bench: Evaluating Multi-perspective Spatial Localization in Vision-Language Models
di: Li, Dingming, et al.
Pubblicazione: (2025)
di: Li, Dingming, et al.
Pubblicazione: (2025)
MathFimer: Enhancing Mathematical Reasoning by Expanding Reasoning Steps through Fill-in-the-Middle Task
di: Yan, Yuchen, et al.
Pubblicazione: (2025)
di: Yan, Yuchen, et al.
Pubblicazione: (2025)
Listen, Pause, and Reason: Toward Perception-Grounded Hybrid Reasoning for Audio Understanding
di: Wang, Jieyi, et al.
Pubblicazione: (2026)
di: Wang, Jieyi, et al.
Pubblicazione: (2026)
Embodied-Reasoner: Synergizing Visual Search, Reasoning, and Action for Embodied Interactive Tasks
di: Zhang, Wenqi, et al.
Pubblicazione: (2025)
di: Zhang, Wenqi, et al.
Pubblicazione: (2025)
UI-Zoomer: Uncertainty-Driven Adaptive Zoom-In for GUI Grounding
di: Tang, Fei, et al.
Pubblicazione: (2026)
di: Tang, Fei, et al.
Pubblicazione: (2026)
Documenti analoghi
-
LAPO: Internalizing Reasoning Efficiency via Length-Adaptive Policy Optimization
di: Wu, Xingyu, et al.
Pubblicazione: (2025) -
TimeToM: Temporal Space is the Key to Unlocking the Door of Large Language Models' Theory-of-Mind
di: Hou, Guiyang, et al.
Pubblicazione: (2024) -
AskToAct: Enhancing LLMs Tool Use via Self-Correcting Clarification
di: Zhang, Xuan, et al.
Pubblicazione: (2025) -
Self-Contrast: Better Reflection Through Inconsistent Solving Perspectives
di: Zhang, Wenqi, et al.
Pubblicazione: (2024) -
SpatialLadder: Progressive Training for Spatial Reasoning in Vision-Language Models
di: Li, Hongxing, et al.
Pubblicazione: (2025)