Technologies on Effectiveness and Efficiency: A Survey of State Spaces Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Lv, Xingtai, Sun, Youbang, Zhang, Kaiyan, Qu, Shang, Zhu, Xuekai, Fan, Yuchen, Wu, Yi, Hua, Ermo, Long, Xinwei, Ding, Ning, Zhou, Bowen |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Fourier Position Embedding: Enhancing Attention's Periodic Extension for Length Generalization
por: Hua, Ermo, et al.
Publicado: (2024)
por: Hua, Ermo, et al.
Publicado: (2024)
Scalable Efficient Training of Large Language Models with Low-dimensional Projected Attention
por: Lv, Xingtai, et al.
Publicado: (2024)
por: Lv, Xingtai, et al.
Publicado: (2024)
Fast and Slow Generating: An Empirical Study on Large and Small Language Models Collaborative Decoding
por: Zhang, Kaiyan, et al.
Publicado: (2024)
por: Zhang, Kaiyan, et al.
Publicado: (2024)
Intuitive Fine-Tuning: Towards Simplifying Alignment into a Single Process
por: Hua, Ermo, et al.
Publicado: (2024)
por: Hua, Ermo, et al.
Publicado: (2024)
How to Synthesize Text Data without Model Collapse?
por: Zhu, Xuekai, et al.
Publicado: (2024)
por: Zhu, Xuekai, et al.
Publicado: (2024)
TTRL: Test-Time Reinforcement Learning
por: Zuo, Yuxin, et al.
Publicado: (2025)
por: Zuo, Yuxin, et al.
Publicado: (2025)
MedXpertQA: Benchmarking Expert-Level Medical Reasoning and Understanding
por: Zuo, Yuxin, et al.
Publicado: (2025)
por: Zuo, Yuxin, et al.
Publicado: (2025)
Towards a Unified View of Large Language Model Post-Training
por: Lv, Xingtai, et al.
Publicado: (2025)
por: Lv, Xingtai, et al.
Publicado: (2025)
Automating Exploratory Proteomics Research via Language Models
por: Ding, Ning, et al.
Publicado: (2024)
por: Ding, Ning, et al.
Publicado: (2024)
Automating Exploratory Multiomics Research via Language Models
por: Qu, Shang, et al.
Publicado: (2025)
por: Qu, Shang, et al.
Publicado: (2025)
Retrieval-Augmented Visual Question Answering via Built-in Autoregressive Search Engines
por: Long, Xinwei, et al.
Publicado: (2025)
por: Long, Xinwei, et al.
Publicado: (2025)
UltraMedical: Building Specialized Generalists in Biomedicine
por: Zhang, Kaiyan, et al.
Publicado: (2024)
por: Zhang, Kaiyan, et al.
Publicado: (2024)
CoGenesis: A Framework Collaborating Large and Small Language Models for Secure Context-Aware Instruction Following
por: Zhang, Kaiyan, et al.
Publicado: (2024)
por: Zhang, Kaiyan, et al.
Publicado: (2024)
PaD: Program-aided Distillation Can Teach Small Models Reasoning Better than Chain-of-thought Fine-tuning
por: Zhu, Xuekai, et al.
Publicado: (2023)
por: Zhu, Xuekai, et al.
Publicado: (2023)
A Survey of Reinforcement Learning for Large Reasoning Models
por: Zhang, Kaiyan, et al.
Publicado: (2025)
por: Zhang, Kaiyan, et al.
Publicado: (2025)
Post-Trained MoE Can Skip Half Experts via Self-Distillation
por: Lv, Xingtai, et al.
Publicado: (2026)
por: Lv, Xingtai, et al.
Publicado: (2026)
How Far Can Unsupervised RLVR Scale LLM Training?
por: He, Bingxiang, et al.
Publicado: (2026)
por: He, Bingxiang, et al.
Publicado: (2026)
FlowRL: Matching Reward Distributions for LLM Reasoning
por: Zhu, Xuekai, et al.
Publicado: (2025)
por: Zhu, Xuekai, et al.
Publicado: (2025)
SSRL: Self-Search Reinforcement Learning
por: Fan, Yuchen, et al.
Publicado: (2025)
por: Fan, Yuchen, et al.
Publicado: (2025)
SimpleVLA-RL: Scaling VLA Training via Reinforcement Learning
por: Li, Haozhan, et al.
Publicado: (2025)
por: Li, Haozhan, et al.
Publicado: (2025)
Emotion-Director: Bridging Affective Shortcut in Emotion-Oriented Image Generation
por: Jia, Guoli, et al.
Publicado: (2025)
por: Jia, Guoli, et al.
Publicado: (2025)
DePass: Unified Feature Attributing by Simple Decomposed Forward Pass
por: Hong, Xiangyu, et al.
Publicado: (2025)
por: Hong, Xiangyu, et al.
Publicado: (2025)
Mastering Text, Code and Math Simultaneously via Fusing Highly Specialized Language Models
por: Ding, Ning, et al.
Publicado: (2024)
por: Ding, Ning, et al.
Publicado: (2024)
Large Language Models as Biomedical Hypothesis Generators: A Comprehensive Evaluation
por: Qi, Biqing, et al.
Publicado: (2024)
por: Qi, Biqing, et al.
Publicado: (2024)
Self-Reflective Reinforcement Learning for Diffusion-based Image Reasoning Generation
por: Pan, Jiadong, et al.
Publicado: (2025)
por: Pan, Jiadong, et al.
Publicado: (2025)
LFQA-E: Carefully Benchmarking Long-form QA Evaluation
por: Fan, Yuchen, et al.
Publicado: (2024)
por: Fan, Yuchen, et al.
Publicado: (2024)
Generative Multi-Modal Knowledge Retrieval with Large Language Models
por: Long, Xinwei, et al.
Publicado: (2024)
por: Long, Xinwei, et al.
Publicado: (2024)
Improving LoRA in Privacy-preserving Federated Learning
por: Sun, Youbang, et al.
Publicado: (2024)
por: Sun, Youbang, et al.
Publicado: (2024)
\texttt{R$^\textbf{2}$AI}: Towards Resistant and Resilient AI in an Evolving World
por: Sun, Youbang, et al.
Publicado: (2025)
por: Sun, Youbang, et al.
Publicado: (2025)
Critical Data Size of Language Models from a Grokking Perspective
por: Zhu, Xuekai, et al.
Publicado: (2024)
por: Zhu, Xuekai, et al.
Publicado: (2024)
Finite-Time Analysis of Stochastic Nonconvex Nonsmooth Optimization on the Riemannian Manifolds
por: Sahinoglu, Emre, et al.
Publicado: (2025)
por: Sahinoglu, Emre, et al.
Publicado: (2025)
EVA-Score: Evaluating Abstractive Long-form Summarization on Informativeness through Extraction and Validation
por: Fan, Yuchen, et al.
Publicado: (2024)
por: Fan, Yuchen, et al.
Publicado: (2024)
The Price of a Second Thought: On the Evaluation of Reasoning Efficiency in Large Language Models
por: Fan, Siqi, et al.
Publicado: (2025)
por: Fan, Siqi, et al.
Publicado: (2025)
Towards Building Specialized Generalist AI with System 1 and System 2 Fusion
por: Zhang, Kaiyan, et al.
Publicado: (2024)
por: Zhang, Kaiyan, et al.
Publicado: (2024)
Process Reinforcement through Implicit Rewards
por: Cui, Ganqu, et al.
Publicado: (2025)
por: Cui, Ganqu, et al.
Publicado: (2025)
SSD4Rec: A Structured State Space Duality Model for Efficient Sequential Recommendation
por: Qu, Haohao, et al.
Publicado: (2024)
por: Qu, Haohao, et al.
Publicado: (2024)
Government Subsidies and Operational Efficiency: Evidence From the United States
por: Hua Sun, et al.
Publicado: (2024)
por: Hua Sun, et al.
Publicado: (2024)
Local Linear Convergence of Infeasible Optimization with Orthogonal Constraints
por: Sun, Youbang, et al.
Publicado: (2024)
por: Sun, Youbang, et al.
Publicado: (2024)
Retraction-Free Decentralized Non-convex Optimization with Orthogonal Constraints
por: Sun, Youbang, et al.
Publicado: (2024)
por: Sun, Youbang, et al.
Publicado: (2024)
High‐Efficiency and Full‐Space Indoor Holographic Communication System Assisted by Complex‐Amplitude Metasurface
por: Lei Zhu, et al.
Publicado: (2025)
por: Lei Zhu, et al.
Publicado: (2025)
Ejemplares similares
-
Fourier Position Embedding: Enhancing Attention's Periodic Extension for Length Generalization
por: Hua, Ermo, et al.
Publicado: (2024) -
Scalable Efficient Training of Large Language Models with Low-dimensional Projected Attention
por: Lv, Xingtai, et al.
Publicado: (2024) -
Fast and Slow Generating: An Empirical Study on Large and Small Language Models Collaborative Decoding
por: Zhang, Kaiyan, et al.
Publicado: (2024) -
Intuitive Fine-Tuning: Towards Simplifying Alignment into a Single Process
por: Hua, Ermo, et al.
Publicado: (2024) -
How to Synthesize Text Data without Model Collapse?
por: Zhu, Xuekai, et al.
Publicado: (2024)