ModRWKV: Transformer Multimodality in Linear Time
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kang, Jiale, Yue, Ziyin, Yin, Qingyu, Rui, Jiang, Li, Weile, Lu, Zening, Ji, Zhouran |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MiSS: Revisiting the Trade-off in LoRA with an Efficient Shard-Sharing Structure
par: Kang, Jiale, et autres
Publié: (2024)
par: Kang, Jiale, et autres
Publié: (2024)
A Survey of RWKV
par: Li, Zhiyuan, et autres
Publié: (2024)
par: Li, Zhiyuan, et autres
Publié: (2024)
GoldFinch: High Performance RWKV/Transformer Hybrid with Linear Pre-Fill and Extreme KV-Cache Compression
par: Goldstein, Daniel, et autres
Publié: (2024)
par: Goldstein, Daniel, et autres
Publié: (2024)
From Black Box to Transparency: Enhancing Automated Interpreting Assessment with Explainable AI in College Classrooms
par: Jiang, Zhaokun, et autres
Publié: (2025)
par: Jiang, Zhaokun, et autres
Publié: (2025)
RRWKV: Capturing Long-range Dependencies in RWKV
par: Wang, Leilei
Publié: (2023)
par: Wang, Leilei
Publié: (2023)
The Evolution of RWKV: Advancements in Efficient Language Modeling
par: Datta, Akul
Publié: (2024)
par: Datta, Akul
Publié: (2024)
Eagle and Finch: RWKV with Matrix-Valued States and Dynamic Recurrence
par: Peng, Bo, et autres
Publié: (2024)
par: Peng, Bo, et autres
Publié: (2024)
Enhancing RWKV-based Language Models for Long-Sequence Text Generation
par: Pan, Xinghan
Publié: (2025)
par: Pan, Xinghan
Publié: (2025)
Convergences and Divergences between Automatic Assessment and Human Evaluation: Insights from Comparing ChatGPT-Generated Translation and Neural Machine Translation
par: Jiang, Zhaokun, et autres
Publié: (2024)
par: Jiang, Zhaokun, et autres
Publié: (2024)
GALLa: Graph Aligned Large Language Models for Improved Source Code Understanding
par: Zhang, Ziyin, et autres
Publié: (2024)
par: Zhang, Ziyin, et autres
Publié: (2024)
StableMask: Refining Causal Masking in Decoder-only Transformer
par: Yin, Qingyu, et autres
Publié: (2024)
par: Yin, Qingyu, et autres
Publié: (2024)
ML-Embed: Inclusive and Efficient Embeddings for a Multilingual World
par: Zhang, Ziyin, et autres
Publié: (2026)
par: Zhang, Ziyin, et autres
Publié: (2026)
F2LLM-v2: Inclusive, Performant, and Efficient Embeddings for a Multilingual World
par: Zhang, Ziyin, et autres
Publié: (2026)
par: Zhang, Ziyin, et autres
Publié: (2026)
F2LLM Technical Report: Matching SOTA Embedding Performance with 6 Million Open-Source Data
par: Zhang, Ziyin, et autres
Publié: (2025)
par: Zhang, Ziyin, et autres
Publié: (2025)
L3TC: Leveraging RWKV for Learned Lossless Low-Complexity Text Compression
par: Zhang, Junxuan, et autres
Publié: (2024)
par: Zhang, Junxuan, et autres
Publié: (2024)
Enhanced Multi-Tuple Extraction for Alloys: Integrating Pointer Networks and Augmented Attention
par: Hei, Mengzhe, et autres
Publié: (2025)
par: Hei, Mengzhe, et autres
Publié: (2025)
VisualRWKV-HD and UHD: Advancing High-Resolution Processing for Visual Language Models
par: Li, Zihang, et autres
Publié: (2024)
par: Li, Zihang, et autres
Publié: (2024)
Understanding Inter-Session Intentions via Complex Logical Reasoning
par: Bai, Jiaxin, et autres
Publié: (2023)
par: Bai, Jiaxin, et autres
Publié: (2023)
MELA: Multilingual Evaluation of Linguistic Acceptability
par: Zhang, Ziyin, et autres
Publié: (2023)
par: Zhang, Ziyin, et autres
Publié: (2023)
C2LLM Technical Report: A New Frontier in Code Retrieval via Adaptive Cross-Attention Pooling
par: Qin, Jin, et autres
Publié: (2025)
par: Qin, Jin, et autres
Publié: (2025)
EduMod-LLM: A Modular Approach for Designing Flexible and Transparent Educational Assistants
par: Mittal, Meenakshi, et autres
Publié: (2025)
par: Mittal, Meenakshi, et autres
Publié: (2025)
TUMIX: Multi-Agent Test-Time Scaling with Tool-Use Mixture
par: Chen, Yongchao, et autres
Publié: (2025)
par: Chen, Yongchao, et autres
Publié: (2025)
Draft Model Knows When to Stop: Self-Verification Speculative Decoding for Long-Form Generation
par: Zhang, Ziyin, et autres
Publié: (2024)
par: Zhang, Ziyin, et autres
Publié: (2024)
POPI: Personalizing LLMs via Optimized Natural Language Preference Inference
par: Chen, Yizhuo, et autres
Publié: (2025)
par: Chen, Yizhuo, et autres
Publié: (2025)
TingIS: Real-time Risk Event Discovery from Noisy Customer Incidents at Enterprise Scale
par: Wang, Jun, et autres
Publié: (2026)
par: Wang, Jun, et autres
Publié: (2026)
Multimodal Inconsistency Reasoning (MMIR): A New Benchmark for Multimodal Reasoning Models
par: Yan, Qianqi, et autres
Publié: (2025)
par: Yan, Qianqi, et autres
Publié: (2025)
Can Language Models Follow Multiple Turns of Entangled Instructions?
par: Han, Chi, et autres
Publié: (2025)
par: Han, Chi, et autres
Publié: (2025)
Optimus-1: Hybrid Multimodal Memory Empowered Agents Excel in Long-Horizon Tasks
par: Li, Zaijing, et autres
Publié: (2024)
par: Li, Zaijing, et autres
Publié: (2024)
Linear Chain Transformation: Expanding Optimization Dynamics for Fine-Tuning Large Language Models
par: Wang, Yulong, et autres
Publié: (2024)
par: Wang, Yulong, et autres
Publié: (2024)
Induction Head Toxicity Mechanistically Explains Repetition Curse in Large Language Models
par: Wang, Shuxun, et autres
Publié: (2025)
par: Wang, Shuxun, et autres
Publié: (2025)
Why Safeguarded Ships Run Aground? Aligned Large Language Models' Safety Mechanisms Tend to Be Anchored in The Template Region
par: Leong, Chak Tou, et autres
Publié: (2025)
par: Leong, Chak Tou, et autres
Publié: (2025)
Tug-of-War within A Decade: Conflict Resolution in Vulnerability Analysis via Teacher-Guided Retrieval-Augmented Generations
par: Zhou, Ziyin, et autres
Publié: (2026)
par: Zhou, Ziyin, et autres
Publié: (2026)
SWAA: Sliding Window Attention Adaptation for Efficient and Quality Preserving Long Context Processing
par: Yu, Yijiong, et autres
Publié: (2025)
par: Yu, Yijiong, et autres
Publié: (2025)
Multi-Layer Transformers Gradient Can be Approximated in Almost Linear Time
par: Liang, Yingyu, et autres
Publié: (2024)
par: Liang, Yingyu, et autres
Publié: (2024)
DeepPlanner: Scaling Planning Capability for Deep Research Agents via Advantage Shaping
par: Fan, Wei, et autres
Publié: (2025)
par: Fan, Wei, et autres
Publié: (2025)
Constrain Alignment with Sparse Autoencoders
par: Yin, Qingyu, et autres
Publié: (2024)
par: Yin, Qingyu, et autres
Publié: (2024)
GeneGPT: Augmenting Large Language Models with Domain Tools for Improved Access to Biomedical Information
par: Jin, Qiao, et autres
Publié: (2023)
par: Jin, Qiao, et autres
Publié: (2023)
Can't say cant? Measuring and Reasoning of Dark Jargons in Large Language Models
par: Ji, Xu, et autres
Publié: (2024)
par: Ji, Xu, et autres
Publié: (2024)
BrowseConf: Confidence-Guided Test-Time Scaling for Web Agents
par: Ou, Litu, et autres
Publié: (2025)
par: Ou, Litu, et autres
Publié: (2025)
The Devil Is in the Details: Tackling Unimodal Spurious Correlations for Generalizable Multimodal Reward Models
par: Li, Zichao, et autres
Publié: (2025)
par: Li, Zichao, et autres
Publié: (2025)
Documents similaires
-
MiSS: Revisiting the Trade-off in LoRA with an Efficient Shard-Sharing Structure
par: Kang, Jiale, et autres
Publié: (2024) -
A Survey of RWKV
par: Li, Zhiyuan, et autres
Publié: (2024) -
GoldFinch: High Performance RWKV/Transformer Hybrid with Linear Pre-Fill and Extreme KV-Cache Compression
par: Goldstein, Daniel, et autres
Publié: (2024) -
From Black Box to Transparency: Enhancing Automated Interpreting Assessment with Explainable AI in College Classrooms
par: Jiang, Zhaokun, et autres
Publié: (2025) -
RRWKV: Capturing Long-range Dependencies in RWKV
par: Wang, Leilei
Publié: (2023)