Triplet-Block Diffusion RWKV
Fuente:
arXiv
Guardado en:
| Autores principales: | Lin, Ke, Luo, Yiyang, Su, Zhaolong, Song, Yunya, Rao, Anyi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
A Survey of RWKV
por: Li, Zhiyuan, et al.
Publicado: (2024)
por: Li, Zhiyuan, et al.
Publicado: (2024)
Zero-shot Generative Linguistic Steganography
por: Lin, Ke, et al.
Publicado: (2024)
por: Lin, Ke, et al.
Publicado: (2024)
Cross-attention for State-based model RWKV-7
por: Xiao, Liu, et al.
Publicado: (2025)
por: Xiao, Liu, et al.
Publicado: (2025)
RWKVTTS: Yet another TTS based on RWKV-7
por: yueyu, Lin, et al.
Publicado: (2025)
por: yueyu, Lin, et al.
Publicado: (2025)
State Tuning: State-based Test-Time Scaling on RWKV-7
por: Xiao, Liu, et al.
Publicado: (2025)
por: Xiao, Liu, et al.
Publicado: (2025)
RRWKV: Capturing Long-range Dependencies in RWKV
por: Wang, Leilei
Publicado: (2023)
por: Wang, Leilei
Publicado: (2023)
ModRWKV: Transformer Multimodality in Linear Time
por: Kang, Jiale, et al.
Publicado: (2025)
por: Kang, Jiale, et al.
Publicado: (2025)
The Evolution of RWKV: Advancements in Efficient Language Modeling
por: Datta, Akul
Publicado: (2024)
por: Datta, Akul
Publicado: (2024)
RWKV-X: A Linear Complexity Hybrid Language Model
por: Hou, Haowen, et al.
Publicado: (2025)
por: Hou, Haowen, et al.
Publicado: (2025)
Eagle and Finch: RWKV with Matrix-Valued States and Dynamic Recurrence
por: Peng, Bo, et al.
Publicado: (2024)
por: Peng, Bo, et al.
Publicado: (2024)
Lost in Overlap: Exploring Logit-based Watermark Collision in LLMs
por: Luo, Yiyang, et al.
Publicado: (2024)
por: Luo, Yiyang, et al.
Publicado: (2024)
DSB: Dynamic Sliding Block Scheduling for Diffusion LLMs
por: Luo, Lizhuo, et al.
Publicado: (2026)
por: Luo, Lizhuo, et al.
Publicado: (2026)
EmbeddingRWKV: State-Centric Retrieval with Reusable States
por: Hou, Haowen, et al.
Publicado: (2026)
por: Hou, Haowen, et al.
Publicado: (2026)
Millions of States: Designing a Scalable MoE Architecture with RWKV-7 Meta-learner
por: Xiao, Liu, et al.
Publicado: (2025)
por: Xiao, Liu, et al.
Publicado: (2025)
Fast-dLLM v2: Efficient Block-Diffusion LLM
por: Wu, Chengyue, et al.
Publicado: (2025)
por: Wu, Chengyue, et al.
Publicado: (2025)
Experimentation in Content Moderation using RWKV
por: Yildirim, Umut, et al.
Publicado: (2024)
por: Yildirim, Umut, et al.
Publicado: (2024)
GoldFinch: High Performance RWKV/Transformer Hybrid with Linear Pre-Fill and Extreme KV-Cache Compression
por: Goldstein, Daniel, et al.
Publicado: (2024)
por: Goldstein, Daniel, et al.
Publicado: (2024)
Enhancing RWKV-based Language Models for Long-Sequence Text Generation
por: Pan, Xinghan
Publicado: (2025)
por: Pan, Xinghan
Publicado: (2025)
DFlare: Scaling Up Draft Capacity for Block Diffusion Speculative Decoding
por: Zhang, Jiebin, et al.
Publicado: (2026)
por: Zhang, Jiebin, et al.
Publicado: (2026)
Diffusion-RWKV: Scaling RWKV-Like Architectures for Diffusion Models
por: Fei, Zhengcong, et al.
Publicado: (2024)
por: Fei, Zhengcong, et al.
Publicado: (2024)
CrossGET: Cross-Guided Ensemble of Tokens for Accelerating Vision-Language Transformers
por: Shi, Dachuan, et al.
Publicado: (2023)
por: Shi, Dachuan, et al.
Publicado: (2023)
RWKV-7 "Goose" with Expressive Dynamic State Evolution
por: Peng, Bo, et al.
Publicado: (2025)
por: Peng, Bo, et al.
Publicado: (2025)
L3TC: Leveraging RWKV for Learned Lossless Low-Complexity Text Compression
por: Zhang, Junxuan, et al.
Publicado: (2024)
por: Zhang, Junxuan, et al.
Publicado: (2024)
VisualRWKV: Exploring Recurrent Neural Networks for Visual Language Models
por: Hou, Haowen, et al.
Publicado: (2024)
por: Hou, Haowen, et al.
Publicado: (2024)
Fast-dVLM: Efficient Block-Diffusion VLM via Direct Conversion from Autoregressive VLM
por: Wu, Chengyue, et al.
Publicado: (2026)
por: Wu, Chengyue, et al.
Publicado: (2026)
Generative Meta-Learning for Zero-Shot Relation Triplet Extraction
por: Li, Wanli, et al.
Publicado: (2023)
por: Li, Wanli, et al.
Publicado: (2023)
DFlash: Block Diffusion for Flash Speculative Decoding
por: Chen, Jian, et al.
Publicado: (2026)
por: Chen, Jian, et al.
Publicado: (2026)
Multimodal Conditioned Diffusive Time Series Forecasting
por: Su, Chen, et al.
Publicado: (2025)
por: Su, Chen, et al.
Publicado: (2025)
Accelerating Speculative Decoding with Block Diffusion Draft Trees
por: Ringel, Liran, et al.
Publicado: (2026)
por: Ringel, Liran, et al.
Publicado: (2026)
Breaking Block Boundaries: Anchor-based History-stable Decoding for Diffusion Large Language Models
por: Zou, Shun, et al.
Publicado: (2026)
por: Zou, Shun, et al.
Publicado: (2026)
VisualRWKV-HD and UHD: Advancing High-Resolution Processing for Visual Language Models
por: Li, Zihang, et al.
Publicado: (2024)
por: Li, Zihang, et al.
Publicado: (2024)
Knowledge-Augmented Multimodal Clinical Rationale Generation for Disease Diagnosis with Small Language Models
por: Niu, Shuai, et al.
Publicado: (2024)
por: Niu, Shuai, et al.
Publicado: (2024)
Advancing Block Diffusion Language Models for Test-Time Scaling
por: Lu, Yi, et al.
Publicado: (2026)
por: Lu, Yi, et al.
Publicado: (2026)
Diagnosing Retrieval Bias Under Multiple In-Context Knowledge Updates in Large Language Models
por: Qiao, Boyu, et al.
Publicado: (2026)
por: Qiao, Boyu, et al.
Publicado: (2026)
GeoBlock: Inferring Block Granularity from Dependency Geometry in Diffusion Language Models
por: Wan, Lipeng, et al.
Publicado: (2026)
por: Wan, Lipeng, et al.
Publicado: (2026)
FlashBlock: Attention Caching for Efficient Long-Context Block Diffusion
por: Chen, Zhuokun, et al.
Publicado: (2026)
por: Chen, Zhuokun, et al.
Publicado: (2026)
TriCon-Fair: Triplet Contrastive Learning for Mitigating Social Bias in Pre-trained Language Models
por: Lyu, Chong, et al.
Publicado: (2025)
por: Lyu, Chong, et al.
Publicado: (2025)
LLM-based Triplet Extraction from Financial Reports
por: Wesslund, Dante, et al.
Publicado: (2026)
por: Wesslund, Dante, et al.
Publicado: (2026)
Swordsman: Entropy-Driven Adaptive Block Partition for Efficient Diffusion Language Models
por: Zhang, Yu, et al.
Publicado: (2026)
por: Zhang, Yu, et al.
Publicado: (2026)
Adaptive Block-Scaled Data Types
por: Cook, Jack, et al.
Publicado: (2026)
por: Cook, Jack, et al.
Publicado: (2026)
Ejemplares similares
-
A Survey of RWKV
por: Li, Zhiyuan, et al.
Publicado: (2024) -
Zero-shot Generative Linguistic Steganography
por: Lin, Ke, et al.
Publicado: (2024) -
Cross-attention for State-based model RWKV-7
por: Xiao, Liu, et al.
Publicado: (2025) -
RWKVTTS: Yet another TTS based on RWKV-7
por: yueyu, Lin, et al.
Publicado: (2025) -
State Tuning: State-based Test-Time Scaling on RWKV-7
por: Xiao, Liu, et al.
Publicado: (2025)