Linear Attention for Efficient Bidirectional Sequence Modeling
Fuente:
arXiv
Salvato in:
| Autori principali: | Afzal, Arshia, Rocamora, Elias Abad, Candogan, Leyla Naz, Puigdemont, Pol, Tonin, Francesco, Wu, Yongtao, Shoaran, Mahsa, Cevher, Volkan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MT-NAM: An Efficient and Adaptive Model for Epileptic Seizure Detection
di: Afzal, Arshia, et al.
Pubblicazione: (2025)
di: Afzal, Arshia, et al.
Pubblicazione: (2025)
Single-pass Detection of Jailbreaking Input in Large Language Models
di: Candogan, Leyla Naz, et al.
Pubblicazione: (2025)
di: Candogan, Leyla Naz, et al.
Pubblicazione: (2025)
REST: Efficient and Accelerated EEG Seizure Analysis through Residual State Updates
di: Afzal, Arshia, et al.
Pubblicazione: (2024)
di: Afzal, Arshia, et al.
Pubblicazione: (2024)
Membership Inference Attacks against Large Vision-Language Models
di: Li, Zhan, et al.
Pubblicazione: (2024)
di: Li, Zhan, et al.
Pubblicazione: (2024)
Quantum-PEFT: Ultra parameter-efficient fine-tuning
di: Koike-Akino, Toshiaki, et al.
Pubblicazione: (2025)
di: Koike-Akino, Toshiaki, et al.
Pubblicazione: (2025)
Efficient Large Language Model Inference with Neural Block Linearization
di: Erdogan, Mete, et al.
Pubblicazione: (2025)
di: Erdogan, Mete, et al.
Pubblicazione: (2025)
Revisiting Character-level Adversarial Attacks for Language Models
di: Rocamora, Elias Abad, et al.
Pubblicazione: (2024)
di: Rocamora, Elias Abad, et al.
Pubblicazione: (2024)
Certified Robustness Under Bounded Levenshtein Distance
di: Rocamora, Elias Abad, et al.
Pubblicazione: (2025)
di: Rocamora, Elias Abad, et al.
Pubblicazione: (2025)
Ascent Fails to Forget
di: Mavrothalassitis, Ioannis, et al.
Pubblicazione: (2025)
di: Mavrothalassitis, Ioannis, et al.
Pubblicazione: (2025)
Learning to Remove Cuts in Integer Linear Programming
di: Puigdemont, Pol, et al.
Pubblicazione: (2024)
di: Puigdemont, Pol, et al.
Pubblicazione: (2024)
Robustness in Both Domains: CLIP Needs a Robust Text Encoder
di: Rocamora, Elias Abad, et al.
Pubblicazione: (2025)
di: Rocamora, Elias Abad, et al.
Pubblicazione: (2025)
Efficient local linearity regularization to overcome catastrophic overfitting
di: Rocamora, Elias Abad, et al.
Pubblicazione: (2024)
di: Rocamora, Elias Abad, et al.
Pubblicazione: (2024)
Easy Data Unlearning Bench
di: Rinberg, Roy, et al.
Pubblicazione: (2026)
di: Rinberg, Roy, et al.
Pubblicazione: (2026)
Chameleon: A Flexible Data-mixing Framework for Language Model Pretraining and Finetuning
di: Xie, Wanyun, et al.
Pubblicazione: (2025)
di: Xie, Wanyun, et al.
Pubblicazione: (2025)
MaD-Mix: Multi-Modal Data Mixtures via Latent Space Coupling for Vision-Language Model Training
di: Xie, Wanyun, et al.
Pubblicazione: (2026)
di: Xie, Wanyun, et al.
Pubblicazione: (2026)
Robust NAS under adversarial training: benchmark, theory, and beyond
di: Wu, Yongtao, et al.
Pubblicazione: (2024)
di: Wu, Yongtao, et al.
Pubblicazione: (2024)
BiND: A Neural Discriminator-Decoder for Accurate Bimanual Trajectory Prediction in Brain-Computer Interfaces
di: Robert, Timothee, et al.
Pubblicazione: (2025)
di: Robert, Timothee, et al.
Pubblicazione: (2025)
Selective Rotary Position Embedding
di: Movahedi, Sajad, et al.
Pubblicazione: (2025)
di: Movahedi, Sajad, et al.
Pubblicazione: (2025)
Accelerating Spectral Clustering under Fairness Constraints
di: Tonin, Francesco, et al.
Pubblicazione: (2025)
di: Tonin, Francesco, et al.
Pubblicazione: (2025)
Multi-Step Alignment as Markov Games: An Optimistic Online Gradient Descent Approach with Convergence Guarantees
di: Wu, Yongtao, et al.
Pubblicazione: (2025)
di: Wu, Yongtao, et al.
Pubblicazione: (2025)
DiffCAP: Diffusion-based Cumulative Adversarial Purification for Vision Language Models
di: Fu, Jia, et al.
Pubblicazione: (2025)
di: Fu, Jia, et al.
Pubblicazione: (2025)
rETF-semiSL: Semi-Supervised Learning for Neural Collapse in Temporal Data
di: Xie, Yuhan, et al.
Pubblicazione: (2025)
di: Xie, Yuhan, et al.
Pubblicazione: (2025)
Machine-Learning-Powered Neural Interfaces for Smart Prosthetics and Diagnostics
di: Shaeri, MohammadAli, et al.
Pubblicazione: (2025)
di: Shaeri, MohammadAli, et al.
Pubblicazione: (2025)
Adversarial Training for Defense Against Label Poisoning Attacks
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2025)
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2025)
Universal Gradient Methods for Stochastic Convex Optimization
di: Rodomanov, Anton, et al.
Pubblicazione: (2024)
di: Rodomanov, Anton, et al.
Pubblicazione: (2024)
Stable Nonconvex-Nonconcave Training via Linear Interpolation
di: Pethick, Thomas, et al.
Pubblicazione: (2023)
di: Pethick, Thomas, et al.
Pubblicazione: (2023)
Addressing Label Shift in Distributed Learning via Entropy Regularization
di: Wu, Zhiyuan, et al.
Pubblicazione: (2025)
di: Wu, Zhiyuan, et al.
Pubblicazione: (2025)
Imitation Learning in Discounted Linear MDPs without exploration assumptions
di: Viano, Luca, et al.
Pubblicazione: (2024)
di: Viano, Luca, et al.
Pubblicazione: (2024)
Going beyond Compositions, DDPMs Can Produce Zero-Shot Interpolations
di: Deschenaux, Justin, et al.
Pubblicazione: (2024)
di: Deschenaux, Justin, et al.
Pubblicazione: (2024)
HeNCler: Node Clustering in Heterophilous Graphs via Learned Asymmetric Similarity
di: Achten, Sonny, et al.
Pubblicazione: (2024)
di: Achten, Sonny, et al.
Pubblicazione: (2024)
Hadamard product in deep learning: Introduction, Advances and Challenges
di: Chrysos, Grigorios G, et al.
Pubblicazione: (2025)
di: Chrysos, Grigorios G, et al.
Pubblicazione: (2025)
Leveraging the Context through Multi-Round Interactions for Jailbreaking Attacks
di: Cheng, Yixin, et al.
Pubblicazione: (2024)
di: Cheng, Yixin, et al.
Pubblicazione: (2024)
GRASP: Deterministic argument ranking in interaction graphs
di: Misra, Diganta, et al.
Pubblicazione: (2026)
di: Misra, Diganta, et al.
Pubblicazione: (2026)
ESLM: Risk-Averse Selective Language Modeling for Efficient Pretraining
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2025)
di: Bal, Melis Ilayda, et al.
Pubblicazione: (2025)
Self-Attention through Kernel-Eigen Pair Sparse Variational Gaussian Processes
di: Chen, Yingyi, et al.
Pubblicazione: (2024)
di: Chen, Yingyi, et al.
Pubblicazione: (2024)
Optimal Kernel Tuning Parameter Prediction using Deep Sequence Models
di: Mahmood, Khawir, et al.
Pubblicazione: (2024)
di: Mahmood, Khawir, et al.
Pubblicazione: (2024)
Native Hybrid Attention for Efficient Sequence Modeling
di: Du, Jusen, et al.
Pubblicazione: (2025)
di: Du, Jusen, et al.
Pubblicazione: (2025)
Rate optimal learning of equilibria from data
di: Freihaut, Till, et al.
Pubblicazione: (2025)
di: Freihaut, Till, et al.
Pubblicazione: (2025)
Intelligent and Miniaturized Neural Interfaces: An Emerging Era in Neurotechnology
di: Shoaran, Mahsa, et al.
Pubblicazione: (2024)
di: Shoaran, Mahsa, et al.
Pubblicazione: (2024)
Sequence-to-Sequence Multi-Modal Speech In-Painting
di: Elyaderani, Mahsa Kadkhodaei, et al.
Pubblicazione: (2024)
di: Elyaderani, Mahsa Kadkhodaei, et al.
Pubblicazione: (2024)
Documenti analoghi
-
MT-NAM: An Efficient and Adaptive Model for Epileptic Seizure Detection
di: Afzal, Arshia, et al.
Pubblicazione: (2025) -
Single-pass Detection of Jailbreaking Input in Large Language Models
di: Candogan, Leyla Naz, et al.
Pubblicazione: (2025) -
REST: Efficient and Accelerated EEG Seizure Analysis through Residual State Updates
di: Afzal, Arshia, et al.
Pubblicazione: (2024) -
Membership Inference Attacks against Large Vision-Language Models
di: Li, Zhan, et al.
Pubblicazione: (2024) -
Quantum-PEFT: Ultra parameter-efficient fine-tuning
di: Koike-Akino, Toshiaki, et al.
Pubblicazione: (2025)