TRiMS: Real-Time Tracking of Minimal Sufficient Length for Efficient Reasoning via RL
Fuente:
arXiv
Guardado en:
| Autores principales: | Bian, Tingcheng, Luo, Jinchang, Cheng, Mingquan, Zhang, Jinyu, Xia, Xiaoling, Li, Ni, Tao, Yan, Wang, Haiwei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
JURY-RL: Votes Propose, Proofs Dispose for Label-Free RLVR
por: Chen, Xinjie, et al.
Publicado: (2026)
por: Chen, Xinjie, et al.
Publicado: (2026)
Overclocking LLM Reasoning: Monitoring and Controlling Thinking Path Lengths in LLMs
por: Eisenstadt, Roy, et al.
Publicado: (2025)
por: Eisenstadt, Roy, et al.
Publicado: (2025)
OSCToM: RL-Guided Adversarial Generation for High-Order Theory of Mind
por: Srishty, Sharmin Sultana, et al.
Publicado: (2026)
por: Srishty, Sharmin Sultana, et al.
Publicado: (2026)
Planning vs Reasoning: Ablations to Test Capabilities of LoRA layers
por: Redkar, Neel
Publicado: (2024)
por: Redkar, Neel
Publicado: (2024)
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
por: Fadli, Samih
Publicado: (2025)
por: Fadli, Samih
Publicado: (2025)
Mean-Pooled Cosine Similarity is Not Length-Invariant: Theory and Cross-Domain Evidence for a Length-Invariant Alternative
por: Mitra, Sibayan, et al.
Publicado: (2026)
por: Mitra, Sibayan, et al.
Publicado: (2026)
Evaluating the Systematic Reasoning Abilities of Large Language Models through Graph Coloring
por: Heyman, Alex, et al.
Publicado: (2025)
por: Heyman, Alex, et al.
Publicado: (2025)
Physics-R1: An Audited Olympiad Corpus and Recipe for Visual Physics Reasoning
por: Yang, Shan
Publicado: (2026)
por: Yang, Shan
Publicado: (2026)
BitCal-TTS: Bit-Calibrated Test-Time Scaling for Quantized Reasoning Models
por: Patarlapalli, Sai Babu, et al.
Publicado: (2026)
por: Patarlapalli, Sai Babu, et al.
Publicado: (2026)
Induce, Align, Predict: Zero-Shot Stance Detection via Cognitive Inductive Reasoning
por: Zhang, Bowen, et al.
Publicado: (2025)
por: Zhang, Bowen, et al.
Publicado: (2025)
D-COT: Disciplined Chain-of-Thought Learning for Efficient Reasoning in Small Language Models
por: Ubukata, Shunsuke
Publicado: (2026)
por: Ubukata, Shunsuke
Publicado: (2026)
HIP Network: Historical Information Passing Network for Extrapolation Reasoning on Temporal Knowledge Graph
por: He, Yongquan, et al.
Publicado: (2024)
por: He, Yongquan, et al.
Publicado: (2024)
Survey Transfer Learning: Recycling Data with Silicon Responses
por: Amini, Ali
Publicado: (2025)
por: Amini, Ali
Publicado: (2025)
Synergy over Discrepancy: A Partition-Based Approach to Multi-Domain LLM Fine-Tuning
por: Ye, Hua, et al.
Publicado: (2025)
por: Ye, Hua, et al.
Publicado: (2025)
Bayesian Attention Mechanism: A Probabilistic Framework for Positional Encoding and Context Length Extrapolation
por: Bianchessi, Arthur S., et al.
Publicado: (2025)
por: Bianchessi, Arthur S., et al.
Publicado: (2025)
Grokking in the Wild: Data Augmentation for Real-World Multi-Hop Reasoning with Transformers
por: Abramov, Roman, et al.
Publicado: (2025)
por: Abramov, Roman, et al.
Publicado: (2025)
Stratified Hazard Sampling: Minimal-Variance Event Scheduling for CTMC/DTMC Discrete Diffusion and Flow Models
por: Jang, Seunghwan, et al.
Publicado: (2026)
por: Jang, Seunghwan, et al.
Publicado: (2026)
Automated Bug Triaging using Instruction-Tuned Large Language Models
por: Kiashemshaki, Kiana, et al.
Publicado: (2025)
por: Kiashemshaki, Kiana, et al.
Publicado: (2025)
Merge-Bench: Resolve Merge Conflicts with Large Language Models
por: Schesch, Benedikt, et al.
Publicado: (2026)
por: Schesch, Benedikt, et al.
Publicado: (2026)
The Reasoning-Creativity Trade-off: Toward Creativity-Driven Problem Solving
por: Luyten, Max Ruiz, et al.
Publicado: (2026)
por: Luyten, Max Ruiz, et al.
Publicado: (2026)
SURE-RAG: Sufficiency and Uncertainty-Aware Evidence Verification for Selective Retrieval-Augmented Generation
por: Qiu, Jingxi, et al.
Publicado: (2026)
por: Qiu, Jingxi, et al.
Publicado: (2026)
SCULPT: Constraint-Guided Pruned MCTS that Carves Efficient Paths for Mathematical Reasoning
por: Fang, Qitong, et al.
Publicado: (2026)
por: Fang, Qitong, et al.
Publicado: (2026)
Scaling Trends for Multi-Hop Contextual Reasoning in Mid-Scale Language Models
por: Steele, Brady, et al.
Publicado: (2026)
por: Steele, Brady, et al.
Publicado: (2026)
Enhancing Large Language Models through Neuro-Symbolic Integration and Ontological Reasoning
por: Vsevolodovna, Ruslan Idelfonso Magana, et al.
Publicado: (2025)
por: Vsevolodovna, Ruslan Idelfonso Magana, et al.
Publicado: (2025)
Intention Collapse: Intention-Level Metrics for Reasoning in Language Models
por: Vera, Patricio
Publicado: (2026)
por: Vera, Patricio
Publicado: (2026)
ACE: Exploring Activation Cosine Similarity and Variance for Accurate and Calibration-Efficient LLM Pruning
por: Mi, Zhendong, et al.
Publicado: (2025)
por: Mi, Zhendong, et al.
Publicado: (2025)
Layer-Aware Embedding Fusion for LLMs in Text Classifications
por: Gwak, Jiho, et al.
Publicado: (2025)
por: Gwak, Jiho, et al.
Publicado: (2025)
KSHSeek: Data-Driven Approaches to Mitigating and Detecting Knowledge-Shortcut Hallucinations in Generative Models
por: Liu, Zhongxin, et al.
Publicado: (2025)
por: Liu, Zhongxin, et al.
Publicado: (2025)
On the Influence of Discourse Relations in Persuasive Texts
por: Turk, Nawar, et al.
Publicado: (2025)
por: Turk, Nawar, et al.
Publicado: (2025)
Latent Instruction Representation Alignment: defending against jailbreaks, backdoors and undesired knowledge in LLMs
por: Easley, Eric, et al.
Publicado: (2026)
por: Easley, Eric, et al.
Publicado: (2026)
Calibrated Confidence Estimation for Tabular Question Answering
por: Voss, Lukas
Publicado: (2026)
por: Voss, Lukas
Publicado: (2026)
Automated CAD Modeling Sequence Generation from Text Descriptions via Transformer-Based Large Language Models
por: Liao, Jianxing, et al.
Publicado: (2025)
por: Liao, Jianxing, et al.
Publicado: (2025)
Scalable GPU-Accelerated Euler Characteristic Curves: Optimization and Differentiable Learning for PyTorch
por: Saxena, Udit
Publicado: (2025)
por: Saxena, Udit
Publicado: (2025)
Descriptive Collision in Sparse Autoencoder Auto-Interpretability: When One Explanation Describes Many Features
por: McCann, Jordan F.
Publicado: (2026)
por: McCann, Jordan F.
Publicado: (2026)
Super Apriel: One Checkpoint, Many Speeds
por: Labs, SLAM, et al.
Publicado: (2026)
por: Labs, SLAM, et al.
Publicado: (2026)
Towards Alignment-Centric Paradigm: A Survey of Instruction Tuning in Large Language Models
por: Han, Xudong, et al.
Publicado: (2025)
por: Han, Xudong, et al.
Publicado: (2025)
Emergent Lexical Semantics in Neural Language Models: Testing Martin's Law on LLM-Generated Text
por: Kugler, Kai
Publicado: (2025)
por: Kugler, Kai
Publicado: (2025)
Character-Level Transformer for Tajik-Persian Transliteration with a Parallel Lexical Corpus
por: Arabov, Mullosharaf K.
Publicado: (2026)
por: Arabov, Mullosharaf K.
Publicado: (2026)
Mitigating Cross-Lingual Cultural Inconsistencies in LLMs via Consensus-Driven Preference Optimisation
por: Resck, Lucas, et al.
Publicado: (2026)
por: Resck, Lucas, et al.
Publicado: (2026)
KerZOO: Kernel Function Informed Zeroth-Order Optimization for Accurate and Accelerated LLM Fine-Tuning
por: Mi, Zhendong, et al.
Publicado: (2025)
por: Mi, Zhendong, et al.
Publicado: (2025)
Ejemplares similares
-
JURY-RL: Votes Propose, Proofs Dispose for Label-Free RLVR
por: Chen, Xinjie, et al.
Publicado: (2026) -
Overclocking LLM Reasoning: Monitoring and Controlling Thinking Path Lengths in LLMs
por: Eisenstadt, Roy, et al.
Publicado: (2025) -
OSCToM: RL-Guided Adversarial Generation for High-Order Theory of Mind
por: Srishty, Sharmin Sultana, et al.
Publicado: (2026) -
Planning vs Reasoning: Ablations to Test Capabilities of LoRA layers
por: Redkar, Neel
Publicado: (2024) -
Entropy-Based Measurement of Value Drift and Alignment Work in Large Language Models
por: Fadli, Samih
Publicado: (2025)