OSCAR: Operating System Control via State-Aware Reasoning and Re-Planning
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Xiaoqiang, Liu, Bang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
R$^3$Mem: Bridging Memory Retention and Retrieval via Reversible Compression
por: Wang, Xiaoqiang, et al.
Publicado: (2025)
por: Wang, Xiaoqiang, et al.
Publicado: (2025)
ReCode: Unify Plan and Action for Universal Granularity Control
por: Yu, Zhaoyang, et al.
Publicado: (2025)
por: Yu, Zhaoyang, et al.
Publicado: (2025)
ReFeed: Multi-dimensional Summarization Refinement with Reflective Reasoning on Feedback
por: Yun, Taewon, et al.
Publicado: (2025)
por: Yun, Taewon, et al.
Publicado: (2025)
AdaCtrl: Towards Adaptive and Controllable Reasoning via Difficulty-Aware Budgeting
por: Huang, Shijue, et al.
Publicado: (2025)
por: Huang, Shijue, et al.
Publicado: (2025)
IMAGINE: Integrating Multi-Agent System into One Model for Complex Reasoning and Planning
por: Zhang, Xikai, et al.
Publicado: (2025)
por: Zhang, Xikai, et al.
Publicado: (2025)
Improving Context Fidelity via Native Retrieval-Augmented Reasoning
por: Wang, Suyuchen, et al.
Publicado: (2025)
por: Wang, Suyuchen, et al.
Publicado: (2025)
OSCAR: Orchestrated Self-verification and Cross-path Refinement
por: Shah, Yash, et al.
Publicado: (2026)
por: Shah, Yash, et al.
Publicado: (2026)
Mem-$π$: Adaptive Memory through Learning When and What to Generate
por: Wang, Xiaoqiang, et al.
Publicado: (2026)
por: Wang, Xiaoqiang, et al.
Publicado: (2026)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
por: Chen, Mingyang, et al.
Publicado: (2025)
por: Chen, Mingyang, et al.
Publicado: (2025)
Explainable Chain-of-Thought Reasoning: An Empirical Analysis on State-Aware Reasoning Dynamics
por: Yu, Sheldon, et al.
Publicado: (2025)
por: Yu, Sheldon, et al.
Publicado: (2025)
Latent Chain-of-Thought as Planning: Decoupling Reasoning from Verbalization
por: Wang, Jiecong, et al.
Publicado: (2026)
por: Wang, Jiecong, et al.
Publicado: (2026)
OSCAR: Online Soft Compression And Reranking
por: Louis, Maxime, et al.
Publicado: (2025)
por: Louis, Maxime, et al.
Publicado: (2025)
Controllable LLM Reasoning via Sparse Autoencoder-Based Steering
por: Fang, Yi, et al.
Publicado: (2026)
por: Fang, Yi, et al.
Publicado: (2026)
DiReCT: Diagnostic Reasoning for Clinical Notes via Large Language Models
por: Wang, Bowen, et al.
Publicado: (2024)
por: Wang, Bowen, et al.
Publicado: (2024)
ReFlect: An Effective Harness System for Complex Long-Horizon LLM Reasoning
por: Huang, Fan
Publicado: (2026)
por: Huang, Fan
Publicado: (2026)
GraCoRe: Benchmarking Graph Comprehension and Complex Reasoning in Large Language Models
por: Yuan, Zike, et al.
Publicado: (2024)
por: Yuan, Zike, et al.
Publicado: (2024)
ReCrit: Transition-Aware Reinforcement Learning for Scientific Critic Reasoning
por: Xu, Wanghan, et al.
Publicado: (2026)
por: Xu, Wanghan, et al.
Publicado: (2026)
PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization
por: Cao, Zouying, et al.
Publicado: (2025)
por: Cao, Zouying, et al.
Publicado: (2025)
RAG+: Enhancing Retrieval-Augmented Generation with Application-Aware Reasoning
por: Wang, Yu, et al.
Publicado: (2025)
por: Wang, Yu, et al.
Publicado: (2025)
Stop Before You Fail: Operational Capability Boundaries for Mitigating Unproductive Reasoning in Large Reasoning Models
por: Zhang, Qingjie, et al.
Publicado: (2025)
por: Zhang, Qingjie, et al.
Publicado: (2025)
ReIn: Conversational Error Recovery with Reasoning Inception
por: Kim, Takyoung, et al.
Publicado: (2026)
por: Kim, Takyoung, et al.
Publicado: (2026)
ReasonOps: Operator Segmentation for LLM Reasoning Traces
por: Lee, Daniel, et al.
Publicado: (2026)
por: Lee, Daniel, et al.
Publicado: (2026)
ReCo: Reliable Causal Chain Reasoning via Structural Causal Recurrent Neural Networks
por: Xiong, Kai, et al.
Publicado: (2022)
por: Xiong, Kai, et al.
Publicado: (2022)
Reinforced Context Order Recovery for Adaptive Reasoning and Planning
por: Ma, Long, et al.
Publicado: (2025)
por: Ma, Long, et al.
Publicado: (2025)
DS@GT at CheckThat! 2025: Detecting Subjectivity via Transfer-Learning and Corrective Data Augmentation
por: Heil, Maximilian, et al.
Publicado: (2025)
por: Heil, Maximilian, et al.
Publicado: (2025)
MSCoRe: A Benchmark for Multi-Stage Collaborative Reasoning in LLM Agents
por: Lei, Yuzhen, et al.
Publicado: (2025)
por: Lei, Yuzhen, et al.
Publicado: (2025)
ReProbe: Efficient Test-Time Scaling of Multi-Step Reasoning by Probing Internal States of Large Language Models
por: Ni, Jingwei, et al.
Publicado: (2025)
por: Ni, Jingwei, et al.
Publicado: (2025)
Mitigating Shortcut Reasoning in Language Models: A Gradient-Aware Training Approach
por: Cao, Hongyu, et al.
Publicado: (2026)
por: Cao, Hongyu, et al.
Publicado: (2026)
Outdated Issue Aware Decoding for Reasoning Questions on Edited Knowledge
por: Sun, Zengkui, et al.
Publicado: (2024)
por: Sun, Zengkui, et al.
Publicado: (2024)
How Reliable are LLMs for Reasoning on the Re-ranking task?
por: Islam, Nafis Tanveer, et al.
Publicado: (2025)
por: Islam, Nafis Tanveer, et al.
Publicado: (2025)
Plan Then Action:High-Level Planning Guidance Reinforcement Learning for LLM Reasoning
por: Dou, Zhihao, et al.
Publicado: (2025)
por: Dou, Zhihao, et al.
Publicado: (2025)
AstroReason-Bench: Evaluating Unified Agentic Planning across Heterogeneous Space Planning Problems
por: Wang, Weiyi, et al.
Publicado: (2026)
por: Wang, Weiyi, et al.
Publicado: (2026)
OVM, Outcome-supervised Value Models for Planning in Mathematical Reasoning
por: Yu, Fei, et al.
Publicado: (2023)
por: Yu, Fei, et al.
Publicado: (2023)
PlanGEN: A Multi-Agent Framework for Generating Planning and Reasoning Trajectories for Complex Problem Solving
por: Parmar, Mihir, et al.
Publicado: (2025)
por: Parmar, Mihir, et al.
Publicado: (2025)
ReAttn: Improving Attention-based Re-ranking via Attention Re-weighting
por: Tian, Yuxing, et al.
Publicado: (2026)
por: Tian, Yuxing, et al.
Publicado: (2026)
OraPlan-SQL: A Planning-Centric Framework for Complex Bilingual NL2SQL Reasoning
por: Liu, Marianne Menglin, et al.
Publicado: (2025)
por: Liu, Marianne Menglin, et al.
Publicado: (2025)
Harder Is Better: Boosting Mathematical Reasoning via Difficulty-Aware GRPO and Multi-Aspect Question Reformulation
por: Dai, Yanqi, et al.
Publicado: (2026)
por: Dai, Yanqi, et al.
Publicado: (2026)
Learning to Plan & Reason for Evaluation with Thinking-LLM-as-a-Judge
por: Saha, Swarnadeep, et al.
Publicado: (2025)
por: Saha, Swarnadeep, et al.
Publicado: (2025)
BoostTaxo: Zero-Shot Taxonomy Induction via Boosting-Style Agentic Reasoning and Constraint-Aware Calibration
por: Ling, Yancheng, et al.
Publicado: (2026)
por: Ling, Yancheng, et al.
Publicado: (2026)
Matrix as Plan: Structured Logical Reasoning with Feedback-Driven Replanning
por: Chen, Ke, et al.
Publicado: (2026)
por: Chen, Ke, et al.
Publicado: (2026)
Ejemplares similares
-
R$^3$Mem: Bridging Memory Retention and Retrieval via Reversible Compression
por: Wang, Xiaoqiang, et al.
Publicado: (2025) -
ReCode: Unify Plan and Action for Universal Granularity Control
por: Yu, Zhaoyang, et al.
Publicado: (2025) -
ReFeed: Multi-dimensional Summarization Refinement with Reflective Reasoning on Feedback
por: Yun, Taewon, et al.
Publicado: (2025) -
AdaCtrl: Towards Adaptive and Controllable Reasoning via Difficulty-Aware Budgeting
por: Huang, Shijue, et al.
Publicado: (2025) -
IMAGINE: Integrating Multi-Agent System into One Model for Complex Reasoning and Planning
por: Zhang, Xikai, et al.
Publicado: (2025)