Sibyl: Simple yet Effective Agent Framework for Complex Real-world Reasoning
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Yulong, Shen, Tianhao, Liu, Lifeng, Xie, Jian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DMON: A Simple yet Effective Approach for Argument Structure Learning
di: Sun, Wei, et al.
Pubblicazione: (2024)
di: Sun, Wei, et al.
Pubblicazione: (2024)
ReasonAny: Incorporating Reasoning Capability to Any Model via Simple and Effective Model Merging
di: Yang, Junyao, et al.
Pubblicazione: (2026)
di: Yang, Junyao, et al.
Pubblicazione: (2026)
MapGuide: A Simple yet Effective Method to Reconstruct Continuous Language from Brain Activities
di: Zhao, Xinpei, et al.
Pubblicazione: (2024)
di: Zhao, Xinpei, et al.
Pubblicazione: (2024)
Deep Associations, High Creativity: A Simple yet Effective Metric for Evaluating Large Language Models
di: Qiu, Ziliang, et al.
Pubblicazione: (2025)
di: Qiu, Ziliang, et al.
Pubblicazione: (2025)
PruneTIR: Inference-Time Tool Call Pruning for Effective yet Efficient Tool-Integrated Reasoning
di: Zhang, Luan, et al.
Pubblicazione: (2026)
di: Zhang, Luan, et al.
Pubblicazione: (2026)
Less is More: A Simple yet Effective Token Reduction Method for Efficient Multi-modal LLMs
di: Song, Dingjie, et al.
Pubblicazione: (2024)
di: Song, Dingjie, et al.
Pubblicazione: (2024)
SibylSense: Adaptive Rubric Learning via Memory Tuning and Adversarial Probing
di: Xu, Yifei, et al.
Pubblicazione: (2026)
di: Xu, Yifei, et al.
Pubblicazione: (2026)
MedAgentsBench: Benchmarking Thinking Models and Agent Frameworks for Complex Medical Reasoning
di: Tang, Xiangru, et al.
Pubblicazione: (2025)
di: Tang, Xiangru, et al.
Pubblicazione: (2025)
SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-Scaling
di: Kim, Dahyun, et al.
Pubblicazione: (2023)
di: Kim, Dahyun, et al.
Pubblicazione: (2023)
OAgents: An Empirical Study of Building Effective Agents
di: Zhu, He, et al.
Pubblicazione: (2025)
di: Zhu, He, et al.
Pubblicazione: (2025)
Teaching LLMs According to Their Aptitude: Adaptive Reasoning for Mathematical Problem Solving
di: Xu, Xin, et al.
Pubblicazione: (2025)
di: Xu, Xin, et al.
Pubblicazione: (2025)
Reinforcing Real-world Service Agents: Balancing Utility and Cost in Task-oriented Dialogue
di: Gao, Ning, et al.
Pubblicazione: (2026)
di: Gao, Ning, et al.
Pubblicazione: (2026)
PlanGEN: A Multi-Agent Framework for Generating Planning and Reasoning Trajectories for Complex Problem Solving
di: Parmar, Mihir, et al.
Pubblicazione: (2025)
di: Parmar, Mihir, et al.
Pubblicazione: (2025)
IMAGINE: Integrating Multi-Agent System into One Model for Complex Reasoning and Planning
di: Zhang, Xikai, et al.
Pubblicazione: (2025)
di: Zhang, Xikai, et al.
Pubblicazione: (2025)
Attr-Int: A Simple and Effective Entity Alignment Framework for Heterogeneous Knowledge Graphs
di: Yang, Linyan, et al.
Pubblicazione: (2024)
di: Yang, Linyan, et al.
Pubblicazione: (2024)
Interpreting Key Mechanisms of Factual Recall in Transformer-Based Language Models
di: Lv, Ang, et al.
Pubblicazione: (2024)
di: Lv, Ang, et al.
Pubblicazione: (2024)
$\texttt{LM}^\texttt{2}$: A Simple Society of Language Models Solves Complex Reasoning
di: Juneja, Gurusha, et al.
Pubblicazione: (2024)
di: Juneja, Gurusha, et al.
Pubblicazione: (2024)
SymAgent: A Neural-Symbolic Self-Learning Agent Framework for Complex Reasoning over Knowledge Graphs
di: Liu, Ben, et al.
Pubblicazione: (2025)
di: Liu, Ben, et al.
Pubblicazione: (2025)
VitaBench: Benchmarking LLM Agents with Versatile Interactive Tasks in Real-world Applications
di: He, Wei, et al.
Pubblicazione: (2025)
di: He, Wei, et al.
Pubblicazione: (2025)
Beyond Perfect APIs: A Comprehensive Evaluation of LLM Agents Under Real-World API Complexity
di: Kim, Doyoung, et al.
Pubblicazione: (2026)
di: Kim, Doyoung, et al.
Pubblicazione: (2026)
ChatSOP: An SOP-Guided MCTS Planning Framework for Controllable LLM Dialogue Agents
di: Li, Zhigen, et al.
Pubblicazione: (2024)
di: Li, Zhigen, et al.
Pubblicazione: (2024)
ReFlect: An Effective Harness System for Complex Long-Horizon LLM Reasoning
di: Huang, Fan
Pubblicazione: (2026)
di: Huang, Fan
Pubblicazione: (2026)
InftyThink+: Effective and Efficient Infinite-Horizon Reasoning via Reinforcement Learning
di: Yan, Yuchen, et al.
Pubblicazione: (2026)
di: Yan, Yuchen, et al.
Pubblicazione: (2026)
QueryAgent: A Reliable and Efficient Reasoning Framework with Environmental Feedback-based Self-Correction
di: Huang, Xiang, et al.
Pubblicazione: (2024)
di: Huang, Xiang, et al.
Pubblicazione: (2024)
Improving Complex Reasoning with Dynamic Prompt Corruption: A soft prompt Optimization Approach
di: Fan, Sinan, et al.
Pubblicazione: (2025)
di: Fan, Sinan, et al.
Pubblicazione: (2025)
Planning Beyond Text: Graph-based Reasoning for Complex Narrative Generation
di: Gu, Hanwen, et al.
Pubblicazione: (2026)
di: Gu, Hanwen, et al.
Pubblicazione: (2026)
SEP-Attack: A Simple and Effective Paradigm for Transfer-Based Textual Adversarial Attack
di: Liu, Han, et al.
Pubblicazione: (2026)
di: Liu, Han, et al.
Pubblicazione: (2026)
ColorBench: Benchmarking Mobile Agents with Graph-Structured Framework for Complex Long-Horizon Tasks
di: Song, Yuanyi, et al.
Pubblicazione: (2025)
di: Song, Yuanyi, et al.
Pubblicazione: (2025)
LLMEval-Med: A Real-world Clinical Benchmark for Medical LLMs with Physician Validation
di: Zhang, Ming, et al.
Pubblicazione: (2025)
di: Zhang, Ming, et al.
Pubblicazione: (2025)
Lissard: Long and Simple Sequential Reasoning Datasets
di: Bueno, Mirelle, et al.
Pubblicazione: (2024)
di: Bueno, Mirelle, et al.
Pubblicazione: (2024)
Causal Graphs Meet Thoughts: Enhancing Complex Reasoning in Graph-Augmented LLMs
di: Luo, Hang, et al.
Pubblicazione: (2025)
di: Luo, Hang, et al.
Pubblicazione: (2025)
A Simple "Motivation" Can Enhance Reinforcement Finetuning of Large Reasoning Models
di: Zhang, Junjie, et al.
Pubblicazione: (2025)
di: Zhang, Junjie, et al.
Pubblicazione: (2025)
AgentOccam: A Simple Yet Strong Baseline for LLM-Based Web Agents
di: Yang, Ke, et al.
Pubblicazione: (2024)
di: Yang, Ke, et al.
Pubblicazione: (2024)
MSCoRe: A Benchmark for Multi-Stage Collaborative Reasoning in LLM Agents
di: Lei, Yuzhen, et al.
Pubblicazione: (2025)
di: Lei, Yuzhen, et al.
Pubblicazione: (2025)
Gradually Excavating External Knowledge for Implicit Complex Question Answering
di: Liu, Chang, et al.
Pubblicazione: (2026)
di: Liu, Chang, et al.
Pubblicazione: (2026)
Table-Critic: A Multi-Agent Framework for Collaborative Criticism and Refinement in Table Reasoning
di: Yu, Peiying, et al.
Pubblicazione: (2025)
di: Yu, Peiying, et al.
Pubblicazione: (2025)
Edit Once, Update Everywhere: A Simple Framework for Cross-Lingual Knowledge Synchronization in LLMs
di: Wu, Yuchen, et al.
Pubblicazione: (2025)
di: Wu, Yuchen, et al.
Pubblicazione: (2025)
Pay Attention to Real World Perturbations! Natural Robustness Evaluation in Machine Reading Comprehension
di: Wu, Yulong, et al.
Pubblicazione: (2025)
di: Wu, Yulong, et al.
Pubblicazione: (2025)
Do Theory of Mind Benchmarks Need Explicit Human-like Reasoning in Language Models?
di: Lu, Yi-Long, et al.
Pubblicazione: (2025)
di: Lu, Yi-Long, et al.
Pubblicazione: (2025)
SWE-AGILE: A Software Agent Framework for Efficiently Managing Dynamic Reasoning Context
di: Lian, Shuquan, et al.
Pubblicazione: (2026)
di: Lian, Shuquan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
DMON: A Simple yet Effective Approach for Argument Structure Learning
di: Sun, Wei, et al.
Pubblicazione: (2024) -
ReasonAny: Incorporating Reasoning Capability to Any Model via Simple and Effective Model Merging
di: Yang, Junyao, et al.
Pubblicazione: (2026) -
MapGuide: A Simple yet Effective Method to Reconstruct Continuous Language from Brain Activities
di: Zhao, Xinpei, et al.
Pubblicazione: (2024) -
Deep Associations, High Creativity: A Simple yet Effective Metric for Evaluating Large Language Models
di: Qiu, Ziliang, et al.
Pubblicazione: (2025) -
PruneTIR: Inference-Time Tool Call Pruning for Effective yet Efficient Tool-Integrated Reasoning
di: Zhang, Luan, et al.
Pubblicazione: (2026)