Salvato in:
| Autori principali: | Zeng, Boyi, Hao, Yiqin, Li, He, Song, Shixiang, Song, Feichen, Wang, Zitong, Huang, Siyuan, Xu, Yi, He, ZiWei, Wang, Xinbing, Lin, Zhouhan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.08220 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PonderLM-2: Pretraining LLM with Latent Thoughts in Continuous Space
di: Zeng, Boyi, et al.
Pubblicazione: (2025)
di: Zeng, Boyi, et al.
Pubblicazione: (2025)
AdaPonderLM: Gated Pondering Language Models with Token-Wise Adaptive Depth
di: Song, Shixiang, et al.
Pubblicazione: (2026)
di: Song, Shixiang, et al.
Pubblicazione: (2026)
PonderLM-3: Adaptive Token-Wise Pondering with Differentiable Masking
di: Li, He, et al.
Pubblicazione: (2026)
di: Li, He, et al.
Pubblicazione: (2026)
PonderLM: Pretraining Language Models to Ponder in Continuous Space
di: Zeng, Boyi, et al.
Pubblicazione: (2025)
di: Zeng, Boyi, et al.
Pubblicazione: (2025)
AWM: Accurate Weight-Matrix Fingerprint for Large Language Models
di: Zeng, Boyi, et al.
Pubblicazione: (2025)
di: Zeng, Boyi, et al.
Pubblicazione: (2025)
Graph Parsing Networks
di: Song, Yunchong, et al.
Pubblicazione: (2024)
di: Song, Yunchong, et al.
Pubblicazione: (2024)
HuRef: HUman-REadable Fingerprint for Large Language Models
di: Zeng, Boyi, et al.
Pubblicazione: (2023)
di: Zeng, Boyi, et al.
Pubblicazione: (2023)
Cluster-wise Graph Transformer with Dual-granularity Kernelized Attention
di: Huang, Siyuan, et al.
Pubblicazione: (2024)
di: Huang, Siyuan, et al.
Pubblicazione: (2024)
FreqKV: Key-Value Compression in Frequency Domain for Context Window Extension
di: Kai, Jushi, et al.
Pubblicazione: (2025)
di: Kai, Jushi, et al.
Pubblicazione: (2025)
Diagnosing Memorization in Chain-of-Thought Reasoning, One Token at a Time
di: Li, Huihan, et al.
Pubblicazione: (2025)
di: Li, Huihan, et al.
Pubblicazione: (2025)
Fourier Transformer: Fast Long Range Modeling by Removing Sequence Redundancy with FFT Operator
di: He, Ziwei, et al.
Pubblicazione: (2023)
di: He, Ziwei, et al.
Pubblicazione: (2023)
Effects of Perceived Control in the Relationship Between Psychological Distress and Posttraumatic Growth After Glioma Diagnosis: A Longitudinal Mediation Analysis
di: Xu ZiWei, et al.
Pubblicazione: (2025)
di: Xu ZiWei, et al.
Pubblicazione: (2025)
Flow of Spans: Generalizing Language Models to Dynamic Span-Vocabulary via GFlowNets
di: Xue, Bo, et al.
Pubblicazione: (2026)
di: Xue, Bo, et al.
Pubblicazione: (2026)
One Size Does Not Fit All: Token-Wise Adaptive Compression for KV Cache
di: Lu, Liming, et al.
Pubblicazione: (2026)
di: Lu, Liming, et al.
Pubblicazione: (2026)
CoT-X: An Adaptive Framework for Cross-Model Chain-of-Thought Transfer and Optimization
di: Bi, Ziqian, et al.
Pubblicazione: (2025)
di: Bi, Ziqian, et al.
Pubblicazione: (2025)
LLM Reasoning Is Latent, Not the Chain of Thought
di: Wang, Wenshuo
Pubblicazione: (2026)
di: Wang, Wenshuo
Pubblicazione: (2026)
Context-level Language Modeling by Learning Predictive Context Embeddings
di: Dai, Beiya, et al.
Pubblicazione: (2025)
di: Dai, Beiya, et al.
Pubblicazione: (2025)
Latent Chain-of-Thought as Planning: Decoupling Reasoning from Verbalization
di: Wang, Jiecong, et al.
Pubblicazione: (2026)
di: Wang, Jiecong, et al.
Pubblicazione: (2026)
Towards Controlled Table-to-Text Generation with Scientific Reasoning
di: Guo, Zhixin, et al.
Pubblicazione: (2023)
di: Guo, Zhixin, et al.
Pubblicazione: (2023)
Fourier Compressor: Frequency-Domain Visual Token Compression for Vision-Language Models
di: Wang, Huanyu, et al.
Pubblicazione: (2025)
di: Wang, Huanyu, et al.
Pubblicazione: (2025)
Amplify Adjacent Token Differences: Enhancing Long Chain-of-Thought Reasoning with Shift-FFN
di: Xu, Yao, et al.
Pubblicazione: (2025)
di: Xu, Yao, et al.
Pubblicazione: (2025)
GeoGalactica: A Scientific Large Language Model in Geoscience
di: Lin, Zhouhan, et al.
Pubblicazione: (2023)
di: Lin, Zhouhan, et al.
Pubblicazione: (2023)
Accelerating Structured Chain-of-Thought in Autonomous Vehicles
di: Gu, Yi, et al.
Pubblicazione: (2026)
di: Gu, Yi, et al.
Pubblicazione: (2026)
Learning Modal-Mixed Chain-of-Thought Reasoning with Latent Embeddings
di: Shao, Yifei, et al.
Pubblicazione: (2026)
di: Shao, Yifei, et al.
Pubblicazione: (2026)
Prehabilitation enhances functional and structural recovery following anterior cruciate ligament reconstruction: A randomized controlled trial
di: Yuping Fu, et al.
Pubblicazione: (2025)
di: Yuping Fu, et al.
Pubblicazione: (2025)
Rethinking Token-Level Policy Optimization for Multimodal Chain-of-Thought
di: Li, Yunheng, et al.
Pubblicazione: (2026)
di: Li, Yunheng, et al.
Pubblicazione: (2026)
Toward the $p$-adic Hodge parameters in the potentially crystalline representations of $\mathrm{GL}_n$
di: He, Yiqin
Pubblicazione: (2026)
di: He, Yiqin
Pubblicazione: (2026)
Companion points and locally analytic socle conjecture for Steinberg case
di: He, Yiqin
Pubblicazione: (2024)
di: He, Yiqin
Pubblicazione: (2024)
Towards the $p$-adic Hodge parameters in semistable representations of $\mathrm{GL}_n(\mathrm{Q}_p)$
di: He, Yiqin
Pubblicazione: (2026)
di: He, Yiqin
Pubblicazione: (2026)
Chain-of-Thought Tokens are Computer Program Variables
di: Zhu, Fangwei, et al.
Pubblicazione: (2025)
di: Zhu, Fangwei, et al.
Pubblicazione: (2025)
Latent Chain-of-Thought for Visual Reasoning
di: Sun, Guohao, et al.
Pubblicazione: (2025)
di: Sun, Guohao, et al.
Pubblicazione: (2025)
FaithCoT-Bench: Benchmarking Instance-Level Faithfulness of Chain-of-Thought Reasoning
di: Shen, Xu, et al.
Pubblicazione: (2025)
di: Shen, Xu, et al.
Pubblicazione: (2025)
Mirror-Consistency: Harnessing Inconsistency in Majority Voting
di: Huang, Siyuan, et al.
Pubblicazione: (2024)
di: Huang, Siyuan, et al.
Pubblicazione: (2024)
Investigating the Fundamental Limit: A Feasibility Study of Hybrid-Neural Archival
di: Armstrong, Marcus, et al.
Pubblicazione: (2026)
di: Armstrong, Marcus, et al.
Pubblicazione: (2026)
Towards Enhanced Image Generation Via Multi-modal Chain of Thought in Unified Generative Models
di: Wang, Yi, et al.
Pubblicazione: (2025)
di: Wang, Yi, et al.
Pubblicazione: (2025)
Imbalanced Graph-Level Anomaly Detection via Counterfactual Augmentation and Feature Learning
di: Wang, Zitong, et al.
Pubblicazione: (2024)
di: Wang, Zitong, et al.
Pubblicazione: (2024)
Mitigating Premature Discretization with Progressive Quantization for Robust Vector Tokenization
di: Zhao, Wenhao, et al.
Pubblicazione: (2026)
di: Zhao, Wenhao, et al.
Pubblicazione: (2026)
Rethinking Chain-of-Thought Reasoning for Videos
di: Zhong, Yiwu, et al.
Pubblicazione: (2025)
di: Zhong, Yiwu, et al.
Pubblicazione: (2025)
Inference-Time Chain-of-Thought Pruning with Latent Informativeness Signals
di: Li, Sophie, et al.
Pubblicazione: (2025)
di: Li, Sophie, et al.
Pubblicazione: (2025)
SemCoT: Accelerating Chain-of-Thought Reasoning through Semantically-Aligned Implicit Tokens
di: He, Yinhan, et al.
Pubblicazione: (2025)
di: He, Yinhan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
PonderLM-2: Pretraining LLM with Latent Thoughts in Continuous Space
di: Zeng, Boyi, et al.
Pubblicazione: (2025) -
AdaPonderLM: Gated Pondering Language Models with Token-Wise Adaptive Depth
di: Song, Shixiang, et al.
Pubblicazione: (2026) -
PonderLM-3: Adaptive Token-Wise Pondering with Differentiable Masking
di: Li, He, et al.
Pubblicazione: (2026) -
PonderLM: Pretraining Language Models to Ponder in Continuous Space
di: Zeng, Boyi, et al.
Pubblicazione: (2025) -
AWM: Accurate Weight-Matrix Fingerprint for Large Language Models
di: Zeng, Boyi, et al.
Pubblicazione: (2025)