Enforcing Monotonic Progress in Legal Cross-Examination: Preventing Long-Horizon Stagnation in LLM-Based Inquiry
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Liao, Hsien-Jyh |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Intrinsic Stability Limits of Autoregressive Reasoning: Structural Consequences for Long-Horizon Execution
par: Liao, Hsien-Jyh
Publié: (2026)
par: Liao, Hsien-Jyh
Publié: (2026)
Causal Intervention-Based Memory Selection for Long-Horizon LLM Agents
par: Srivastava, Saksham Sahai
Publié: (2026)
par: Srivastava, Saksham Sahai
Publié: (2026)
GPTs and Language Barrier: A Cross-Lingual Legal QA Examination
par: Nguyen, Ha-Thanh, et autres
Publié: (2024)
par: Nguyen, Ha-Thanh, et autres
Publié: (2024)
Legal Documents Drafting with Fine-Tuned Pre-Trained Large Language Model
par: Lin, Chun-Hsien, et autres
Publié: (2024)
par: Lin, Chun-Hsien, et autres
Publié: (2024)
Cooperative Memory Paging with Keyword Bookmarks for Long-Horizon LLM Conversations
par: Liu, Ziyang
Publié: (2026)
par: Liu, Ziyang
Publié: (2026)
Dynamic Long Short-Term Memory Based Memory Storage For Long Horizon LLM Interaction
par: Lou, Yuyang, et autres
Publié: (2025)
par: Lou, Yuyang, et autres
Publié: (2025)
HorizonBench: Long-Horizon Personalization with Evolving Preferences
par: Li, Shuyue Stella, et autres
Publié: (2026)
par: Li, Shuyue Stella, et autres
Publié: (2026)
ReFlect: An Effective Harness System for Complex Long-Horizon LLM Reasoning
par: Huang, Fan
Publié: (2026)
par: Huang, Fan
Publié: (2026)
Beyond Reactive Safety: Risk-Aware LLM Alignment via Long-Horizon Simulation
par: Sun, Chenkai, et autres
Publié: (2025)
par: Sun, Chenkai, et autres
Publié: (2025)
LeMAJ (Legal LLM-as-a-Judge): Bridging Legal Reasoning and LLM Evaluation
par: Enguehard, Joseph, et autres
Publié: (2025)
par: Enguehard, Joseph, et autres
Publié: (2025)
UltraHorizon: Benchmarking Agent Capabilities in Ultra Long-Horizon Scenarios
par: Luo, Haotian, et autres
Publié: (2025)
par: Luo, Haotian, et autres
Publié: (2025)
IterResearch: Rethinking Long-Horizon Agents with Interaction Scaling
par: Chen, Guoxin, et autres
Publié: (2025)
par: Chen, Guoxin, et autres
Publié: (2025)
Enforcing Temporal Constraints for LLM Agents
par: Kamath, Adharsh, et autres
Publié: (2025)
par: Kamath, Adharsh, et autres
Publié: (2025)
Long-Context Long-Form Question Answering for Legal Domain
par: Kulkarni, Anagha, et autres
Publié: (2026)
par: Kulkarni, Anagha, et autres
Publié: (2026)
The Lock-in Hypothesis: Stagnation by Algorithm
par: Qiu, Tianyi Alex, et autres
Publié: (2025)
par: Qiu, Tianyi Alex, et autres
Publié: (2025)
It's Not the Capability: Harness Sensitivity Is Non-Monotone Across LLM Agent Tiers
par: Cho, Yong-eun
Publié: (2026)
par: Cho, Yong-eun
Publié: (2026)
BenGER: Benchmarking LLM Systems on Subsumption-Based Legal Reasoning in German Law
par: Nagl, Sebastian, et autres
Publié: (2026)
par: Nagl, Sebastian, et autres
Publié: (2026)
The Text Uncanny Valley: Non-Monotonic Performance Degradation in LLM Information Retrieval
par: Tong, Zekai, et autres
Publié: (2026)
par: Tong, Zekai, et autres
Publié: (2026)
Align Once, Benefit Multilingually: Enforcing Multilingual Consistency for LLM Safety Alignment
par: Bu, Yuyan, et autres
Publié: (2026)
par: Bu, Yuyan, et autres
Publié: (2026)
Wide-Horizon Thinking and Simulation-Based Evaluation for Real-World LLM Planning with Multifaceted Constraints
par: Yang, Dongjie, et autres
Publié: (2025)
par: Yang, Dongjie, et autres
Publié: (2025)
Evaluating Long-Horizon Memory for Multi-Party Collaborative Dialogues
par: Hu, Chuanrui, et autres
Publié: (2026)
par: Hu, Chuanrui, et autres
Publié: (2026)
Connecting the Dots: Benchmarking Reflective Memory in Long-Horizon Dialogue
par: Lin, Jingjie, et autres
Publié: (2026)
par: Lin, Jingjie, et autres
Publié: (2026)
GTA: Generating Long-Horizon Tasks for Web Agents at Scale
par: Huang, Tenghao, et autres
Publié: (2026)
par: Huang, Tenghao, et autres
Publié: (2026)
Milestone-Guided Policy Learning for Long-Horizon Language Agents
par: Wang, Zixuan, et autres
Publié: (2026)
par: Wang, Zixuan, et autres
Publié: (2026)
Place Matters: Comparing LLM Hallucination Rates for Place-Based Legal Queries
par: Curran, Damian, et autres
Publié: (2025)
par: Curran, Damian, et autres
Publié: (2025)
COMPASS: Enhancing Agent Long-Horizon Reasoning with Evolving Context
par: Wan, Guangya, et autres
Publié: (2025)
par: Wan, Guangya, et autres
Publié: (2025)
MAGE: Safeguarding LLM Agents against Long-Horizon Threats via Shadow Memory
par: Wang, Yuhui, et autres
Publié: (2026)
par: Wang, Yuhui, et autres
Publié: (2026)
Improving Legal Judgement Prediction in Romanian with Long Text Encoders
par: Masala, Mihai, et autres
Publié: (2024)
par: Masala, Mihai, et autres
Publié: (2024)
COCORELI: Enforcing Execution Preconditions for Reliable Collaborative Instruction Following
par: Bhar, Swarnadeep, et autres
Publié: (2025)
par: Bhar, Swarnadeep, et autres
Publié: (2025)
AgentGym-RL: Training LLM Agents for Long-Horizon Decision Making through Multi-Turn Reinforcement Learning
par: Xi, Zhiheng, et autres
Publié: (2025)
par: Xi, Zhiheng, et autres
Publié: (2025)
AMemGym: Interactive Memory Benchmarking for Assistants in Long-Horizon Conversations
par: Jiayang, Cheng, et autres
Publié: (2026)
par: Jiayang, Cheng, et autres
Publié: (2026)
Can RL Teach Long-Horizon Reasoning to LLMs? Expressiveness Is Key
par: Wang, Tianle, et autres
Publié: (2026)
par: Wang, Tianle, et autres
Publié: (2026)
DeepPlanning: Benchmarking Long-Horizon Agentic Planning with Verifiable Constraints
par: Zhang, Yinger, et autres
Publié: (2026)
par: Zhang, Yinger, et autres
Publié: (2026)
GRAVITY: Architecture-Agnostic Structured Anchoring for Long-Horizon Conversational Memory
par: Sun, Yushi, et autres
Publié: (2026)
par: Sun, Yushi, et autres
Publié: (2026)
Temporal Preferences in Language Models for Long-Horizon Assistance
par: Mazyaki, Ali, et autres
Publié: (2025)
par: Mazyaki, Ali, et autres
Publié: (2025)
`Keep it Together': Enforcing Cohesion in Extractive Summaries by Simulating Human Memory
par: Cardenas, Ronald, et autres
Publié: (2024)
par: Cardenas, Ronald, et autres
Publié: (2024)
REDSearcher: A Scalable and Cost-Efficient Framework for Long-Horizon Search Agents
par: Chu, Zheng, et autres
Publié: (2026)
par: Chu, Zheng, et autres
Publié: (2026)
EcoGym: Evaluating LLMs for Long-Horizon Plan-and-Execute in Interactive Economies
par: Hu, Xavier, et autres
Publié: (2026)
par: Hu, Xavier, et autres
Publié: (2026)
TiMem: Temporal-Hierarchical Memory Consolidation for Long-Horizon Conversational Agents
par: Li, Kai, et autres
Publié: (2026)
par: Li, Kai, et autres
Publié: (2026)
AgentFugue: Agent Scaling for Long-Horizon Tasks through Collective Reasoning
par: Hu, Yuyang, et autres
Publié: (2026)
par: Hu, Yuyang, et autres
Publié: (2026)
Documents similaires
-
Intrinsic Stability Limits of Autoregressive Reasoning: Structural Consequences for Long-Horizon Execution
par: Liao, Hsien-Jyh
Publié: (2026) -
Causal Intervention-Based Memory Selection for Long-Horizon LLM Agents
par: Srivastava, Saksham Sahai
Publié: (2026) -
GPTs and Language Barrier: A Cross-Lingual Legal QA Examination
par: Nguyen, Ha-Thanh, et autres
Publié: (2024) -
Legal Documents Drafting with Fine-Tuned Pre-Trained Large Language Model
par: Lin, Chun-Hsien, et autres
Publié: (2024) -
Cooperative Memory Paging with Keyword Bookmarks for Long-Horizon LLM Conversations
par: Liu, Ziyang
Publié: (2026)