Technologies on Effectiveness and Efficiency: A Survey of State Spaces Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Lv, Xingtai, Sun, Youbang, Zhang, Kaiyan, Qu, Shang, Zhu, Xuekai, Fan, Yuchen, Wu, Yi, Hua, Ermo, Long, Xinwei, Ding, Ning, Zhou, Bowen |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fourier Position Embedding: Enhancing Attention's Periodic Extension for Length Generalization
di: Hua, Ermo, et al.
Pubblicazione: (2024)
di: Hua, Ermo, et al.
Pubblicazione: (2024)
Scalable Efficient Training of Large Language Models with Low-dimensional Projected Attention
di: Lv, Xingtai, et al.
Pubblicazione: (2024)
di: Lv, Xingtai, et al.
Pubblicazione: (2024)
Fast and Slow Generating: An Empirical Study on Large and Small Language Models Collaborative Decoding
di: Zhang, Kaiyan, et al.
Pubblicazione: (2024)
di: Zhang, Kaiyan, et al.
Pubblicazione: (2024)
Intuitive Fine-Tuning: Towards Simplifying Alignment into a Single Process
di: Hua, Ermo, et al.
Pubblicazione: (2024)
di: Hua, Ermo, et al.
Pubblicazione: (2024)
How to Synthesize Text Data without Model Collapse?
di: Zhu, Xuekai, et al.
Pubblicazione: (2024)
di: Zhu, Xuekai, et al.
Pubblicazione: (2024)
TTRL: Test-Time Reinforcement Learning
di: Zuo, Yuxin, et al.
Pubblicazione: (2025)
di: Zuo, Yuxin, et al.
Pubblicazione: (2025)
MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding
di: Zuo, Yuxin, et al.
Pubblicazione: (2025)
di: Zuo, Yuxin, et al.
Pubblicazione: (2025)
Towards a Unified View of Large Language Model Post-Training
di: Lv, Xingtai, et al.
Pubblicazione: (2025)
di: Lv, Xingtai, et al.
Pubblicazione: (2025)
Automating Exploratory Proteomics Research via Language Models
di: Ding, Ning, et al.
Pubblicazione: (2024)
di: Ding, Ning, et al.
Pubblicazione: (2024)
Automating Exploratory Multiomics Research via Language Models
di: Qu, Shang, et al.
Pubblicazione: (2025)
di: Qu, Shang, et al.
Pubblicazione: (2025)
Retrieval-Augmented Visual Question Answering via Built-in Autoregressive Search Engines
di: Long, Xinwei, et al.
Pubblicazione: (2025)
di: Long, Xinwei, et al.
Pubblicazione: (2025)
UltraMedical: Building Specialized Generalists in Biomedicine
di: Zhang, Kaiyan, et al.
Pubblicazione: (2024)
di: Zhang, Kaiyan, et al.
Pubblicazione: (2024)
CoGenesis: A Framework Collaborating Large and Small Language Models for Secure Context-Aware Instruction Following
di: Zhang, Kaiyan, et al.
Pubblicazione: (2024)
di: Zhang, Kaiyan, et al.
Pubblicazione: (2024)
PaD: Program-aided Distillation Can Teach Small Models Reasoning Better than Chain-of-thought Fine-tuning
di: Zhu, Xuekai, et al.
Pubblicazione: (2023)
di: Zhu, Xuekai, et al.
Pubblicazione: (2023)
A Survey of Reinforcement Learning for Large Reasoning Models
di: Zhang, Kaiyan, et al.
Pubblicazione: (2025)
di: Zhang, Kaiyan, et al.
Pubblicazione: (2025)
Post-Trained MoE Can Skip Half Experts via Self-Distillation
di: Lv, Xingtai, et al.
Pubblicazione: (2026)
di: Lv, Xingtai, et al.
Pubblicazione: (2026)
How Far Can Unsupervised RLVR Scale LLM Training?
di: He, Bingxiang, et al.
Pubblicazione: (2026)
di: He, Bingxiang, et al.
Pubblicazione: (2026)
FlowRL: Matching Reward Distributions for LLM Reasoning
di: Zhu, Xuekai, et al.
Pubblicazione: (2025)
di: Zhu, Xuekai, et al.
Pubblicazione: (2025)
SSRL: Self-Search Reinforcement Learning
di: Fan, Yuchen, et al.
Pubblicazione: (2025)
di: Fan, Yuchen, et al.
Pubblicazione: (2025)
SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning
di: Li, Haozhan, et al.
Pubblicazione: (2025)
di: Li, Haozhan, et al.
Pubblicazione: (2025)
Emotion-Director: Bridging Affective Shortcut in Emotion-Oriented Image Generation
di: Jia, Guoli, et al.
Pubblicazione: (2025)
di: Jia, Guoli, et al.
Pubblicazione: (2025)
DePass: Unified Feature Attributing by Simple Decomposed Forward Pass
di: Hong, Xiangyu, et al.
Pubblicazione: (2025)
di: Hong, Xiangyu, et al.
Pubblicazione: (2025)
Mastering Text, Code and Math Simultaneously via Fusing Highly Specialized Language Models
di: Ding, Ning, et al.
Pubblicazione: (2024)
di: Ding, Ning, et al.
Pubblicazione: (2024)
Large Language Models as Biomedical Hypothesis Generators: A Comprehensive Evaluation
di: Qi, Biqing, et al.
Pubblicazione: (2024)
di: Qi, Biqing, et al.
Pubblicazione: (2024)
Self-Reflective Reinforcement Learning for Diffusion-based Image Reasoning Generation
di: Pan, Jiadong, et al.
Pubblicazione: (2025)
di: Pan, Jiadong, et al.
Pubblicazione: (2025)
LFQA-E: Carefully Benchmarking Long-form QA Evaluation
di: Fan, Yuchen, et al.
Pubblicazione: (2024)
di: Fan, Yuchen, et al.
Pubblicazione: (2024)
Generative Multi-Modal Knowledge Retrieval with Large Language Models
di: Long, Xinwei, et al.
Pubblicazione: (2024)
di: Long, Xinwei, et al.
Pubblicazione: (2024)
Improving LoRA in Privacy-preserving Federated Learning
di: Sun, Youbang, et al.
Pubblicazione: (2024)
di: Sun, Youbang, et al.
Pubblicazione: (2024)
\texttt{R$^\textbf{2}$AI}: Towards Resistant and Resilient AI in an Evolving World
di: Sun, Youbang, et al.
Pubblicazione: (2025)
di: Sun, Youbang, et al.
Pubblicazione: (2025)
Critical Data Size of Language Models from a Grokking Perspective
di: Zhu, Xuekai, et al.
Pubblicazione: (2024)
di: Zhu, Xuekai, et al.
Pubblicazione: (2024)
Finite-Time Analysis of Stochastic Nonconvex Nonsmooth Optimization on the Riemannian Manifolds
di: Sahinoglu, Emre, et al.
Pubblicazione: (2025)
di: Sahinoglu, Emre, et al.
Pubblicazione: (2025)
EVA-Score: Evaluating Abstractive Long-form Summarization on Informativeness through Extraction and Validation
di: Fan, Yuchen, et al.
Pubblicazione: (2024)
di: Fan, Yuchen, et al.
Pubblicazione: (2024)
The Price of a Second Thought: On the Evaluation of Reasoning Efficiency in Large Language Models
di: Fan, Siqi, et al.
Pubblicazione: (2025)
di: Fan, Siqi, et al.
Pubblicazione: (2025)
Towards Building Specialized Generalist AI with System 1 and System 2 Fusion
di: Zhang, Kaiyan, et al.
Pubblicazione: (2024)
di: Zhang, Kaiyan, et al.
Pubblicazione: (2024)
Process Reinforcement through Implicit Rewards
di: Cui, Ganqu, et al.
Pubblicazione: (2025)
di: Cui, Ganqu, et al.
Pubblicazione: (2025)
SSD4Rec: A Structured State Space Duality Model for Efficient Sequential Recommendation
di: Qu, Haohao, et al.
Pubblicazione: (2024)
di: Qu, Haohao, et al.
Pubblicazione: (2024)
Government Subsidies and Operational Efficiency: Evidence From the United States
di: Hua Sun, et al.
Pubblicazione: (2024)
di: Hua Sun, et al.
Pubblicazione: (2024)
Local Linear Convergence of Infeasible Optimization with Orthogonal Constraints
di: Sun, Youbang, et al.
Pubblicazione: (2024)
di: Sun, Youbang, et al.
Pubblicazione: (2024)
Retraction-Free Decentralized Non-convex Optimization with Orthogonal Constraints
di: Sun, Youbang, et al.
Pubblicazione: (2024)
di: Sun, Youbang, et al.
Pubblicazione: (2024)
High‐Efficiency and Full‐Space Indoor Holographic Communication System Assisted by Complex‐Amplitude Metasurface
di: Lei Zhu, et al.
Pubblicazione: (2025)
di: Lei Zhu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Fourier Position Embedding: Enhancing Attention's Periodic Extension for Length Generalization
di: Hua, Ermo, et al.
Pubblicazione: (2024) -
Scalable Efficient Training of Large Language Models with Low-dimensional Projected Attention
di: Lv, Xingtai, et al.
Pubblicazione: (2024) -
Fast and Slow Generating: An Empirical Study on Large and Small Language Models Collaborative Decoding
di: Zhang, Kaiyan, et al.
Pubblicazione: (2024) -
Intuitive Fine-Tuning: Towards Simplifying Alignment into a Single Process
di: Hua, Ermo, et al.
Pubblicazione: (2024) -
How to Synthesize Text Data without Model Collapse?
di: Zhu, Xuekai, et al.
Pubblicazione: (2024)