Beyond Uniform Query Distribution: Key-Driven Grouped Query Attention
Fuente:
arXiv
Salvato in:
| Autori principali: | Khan, Zohaib, Khaquan, Muhammad, Tafveez, Omer, Samiwala, Burhanuddin, Raza, Agha Ali |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
GQKVA: Efficient Pre-training of Transformers by Grouping Queries, Keys, and Values
di: Javadi, Farnoosh, et al.
Pubblicazione: (2023)
di: Javadi, Farnoosh, et al.
Pubblicazione: (2023)
LDA-AQU: Adaptive Query-guided Upsampling via Local Deformable Attention
di: Du, Zewen, et al.
Pubblicazione: (2024)
di: Du, Zewen, et al.
Pubblicazione: (2024)
Masked Multi-Query Slot Attention for Unsupervised Object Discovery
di: Pramanik, Rishav, et al.
Pubblicazione: (2024)
di: Pramanik, Rishav, et al.
Pubblicazione: (2024)
KOPPA: Improving Prompt-based Continual Learning with Key-Query Orthogonal Projection and Prototype-based One-Versus-All
di: Tran, Quyen, et al.
Pubblicazione: (2023)
di: Tran, Quyen, et al.
Pubblicazione: (2023)
Video-Based MPAA Rating Prediction: An Attention-Driven Hybrid Architecture Using Contrastive Learning
di: Neogi, Dipta, et al.
Pubblicazione: (2025)
di: Neogi, Dipta, et al.
Pubblicazione: (2025)
QuARI: Query Adaptive Retrieval Improvement
di: Xing, Eric, et al.
Pubblicazione: (2025)
di: Xing, Eric, et al.
Pubblicazione: (2025)
Attention Based Simple Primitives for Open World Compositional Zero-Shot Learning
di: Munir, Ans, et al.
Pubblicazione: (2024)
di: Munir, Ans, et al.
Pubblicazione: (2024)
An Enhanced Large Language Model For Cross Modal Query Understanding System Using DL-KeyBERT Based CAZSSCL-MPGPT
di: Singh, Shreya
Pubblicazione: (2025)
di: Singh, Shreya
Pubblicazione: (2025)
Graph Query Networks for Object Detection with Automotive Radar
di: Saini, Loveneet, et al.
Pubblicazione: (2025)
di: Saini, Loveneet, et al.
Pubblicazione: (2025)
AttentionDrop: A Novel Regularization Method for Transformer Models
di: Baig, Mirza Samad Ahmed, et al.
Pubblicazione: (2025)
di: Baig, Mirza Samad Ahmed, et al.
Pubblicazione: (2025)
Countdown-Code: A Testbed for Studying The Emergence and Generalization of Reward Hacking in RLVR
di: Khalifa, Muhammad, et al.
Pubblicazione: (2026)
di: Khalifa, Muhammad, et al.
Pubblicazione: (2026)
Multimodal Object Query Initialization for 3D Object Detection
di: van Geerenstein, Mathijs R., et al.
Pubblicazione: (2023)
di: van Geerenstein, Mathijs R., et al.
Pubblicazione: (2023)
Enhancing Cost Efficiency in Active Learning with Candidate Set Query
di: Gwon, Yeho, et al.
Pubblicazione: (2025)
di: Gwon, Yeho, et al.
Pubblicazione: (2025)
SketchQL Demonstration: Zero-shot Video Moment Querying with Sketches
di: Wu, Renzhi, et al.
Pubblicazione: (2024)
di: Wu, Renzhi, et al.
Pubblicazione: (2024)
Noise-Tolerant Few-Shot Unsupervised Adapter for Vision-Language Models
di: Ali, Eman, et al.
Pubblicazione: (2023)
di: Ali, Eman, et al.
Pubblicazione: (2023)
PQDT: Pseudo-Query Dual Transformer for Robust Point Cloud Restoration
di: Wu, Haoqing, et al.
Pubblicazione: (2026)
di: Wu, Haoqing, et al.
Pubblicazione: (2026)
Hausdorff Distance Matching with Adaptive Query Denoising for Rotated Detection Transformer
di: Lee, Hakjin, et al.
Pubblicazione: (2023)
di: Lee, Hakjin, et al.
Pubblicazione: (2023)
Recommender Engine Driven Client Selection in Federated Brain Tumor Segmentation
di: Khan, Muhammad Irfan, et al.
Pubblicazione: (2024)
di: Khan, Muhammad Irfan, et al.
Pubblicazione: (2024)
Structure Disruption: Subverting Malicious Diffusion-Based Inpainting via Self-Attention Query Perturbation
di: He, Yuhao, et al.
Pubblicazione: (2025)
di: He, Yuhao, et al.
Pubblicazione: (2025)
LifelongMemory: Leveraging LLMs for Answering Queries in Long-form Egocentric Videos
di: Wang, Ying, et al.
Pubblicazione: (2023)
di: Wang, Ying, et al.
Pubblicazione: (2023)
Matryoshka Query Transformer for Large Vision-Language Models
di: Hu, Wenbo, et al.
Pubblicazione: (2024)
di: Hu, Wenbo, et al.
Pubblicazione: (2024)
RAVEN: Query-Guided Representation Alignment for Question Answering over Audio, Video, Embedded Sensors, and Natural Language
di: Biswas, Subrata, et al.
Pubblicazione: (2025)
di: Biswas, Subrata, et al.
Pubblicazione: (2025)
Plasticity vs. Rigidity: The Impact of Low-Rank Adapters on Reasoning on a Micro-Budget
di: Khan, Zohaib, et al.
Pubblicazione: (2026)
di: Khan, Zohaib, et al.
Pubblicazione: (2026)
A Deep Learning Pipeline for Epilepsy Genomic Analysis Using GPT-2 XL and NVIDIA H100
di: Latif, Muhammad Omer, et al.
Pubblicazione: (2025)
di: Latif, Muhammad Omer, et al.
Pubblicazione: (2025)
A Tumor Aware DenseNet Swin Hybrid Learning with Boosted and Hierarchical Feature Spaces for Large-Scale Brain MRI Classification
di: Shah, Muhammad Ali, et al.
Pubblicazione: (2026)
di: Shah, Muhammad Ali, et al.
Pubblicazione: (2026)
Accelerating Targeted Hard-Label Adversarial Attacks in Low-Query Black-Box Settings
di: Swaminathan, Arjhun, et al.
Pubblicazione: (2025)
di: Swaminathan, Arjhun, et al.
Pubblicazione: (2025)
VQPP: Video Query Performance Prediction Benchmark
di: Lutu, Adrian Catalin, et al.
Pubblicazione: (2026)
di: Lutu, Adrian Catalin, et al.
Pubblicazione: (2026)
Opportunistic Target Selection: Early Directional Commitment for Query-Efficient Black-Box Adversarial Attacks
di: Tariolle, Florent, et al.
Pubblicazione: (2026)
di: Tariolle, Florent, et al.
Pubblicazione: (2026)
Towards High-Fidelity Gaussian Splatting with Queried-Convolution Neural Networks
di: Kumar, Abhinav, et al.
Pubblicazione: (2025)
di: Kumar, Abhinav, et al.
Pubblicazione: (2025)
How Deep is Your Art: An Experimental Study on the Limits of Artistic Understanding in a Single-Task, Single-Modality Neural Network
di: Zahedi, Mahan Agha, et al.
Pubblicazione: (2022)
di: Zahedi, Mahan Agha, et al.
Pubblicazione: (2022)
Attention-Guided Dual-Stream Learning for Group Engagement Recognition: Fusing Transformer-Encoded Motion Dynamics with Scene Context via Adaptive Gating
di: Chowdhury, Saniah Kayenat, et al.
Pubblicazione: (2026)
di: Chowdhury, Saniah Kayenat, et al.
Pubblicazione: (2026)
Annotation-Free Reinforcement Learning Query Rewriting via Verifiable Search Reward
di: Cha, Sungguk, et al.
Pubblicazione: (2025)
di: Cha, Sungguk, et al.
Pubblicazione: (2025)
PARCEL: Pool-Anchored Resampling with Conditioned Elastic Queries for Efficient Vision-Language Understanding
di: Kuzucu, Selim, et al.
Pubblicazione: (2026)
di: Kuzucu, Selim, et al.
Pubblicazione: (2026)
Gated-Attention Feature-Fusion Based Framework for Poverty Prediction
di: Ramzan, Muhammad Umer, et al.
Pubblicazione: (2024)
di: Ramzan, Muhammad Umer, et al.
Pubblicazione: (2024)
UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models
di: Wang, Jiaqi, et al.
Pubblicazione: (2026)
di: Wang, Jiaqi, et al.
Pubblicazione: (2026)
Scratching Visual Transformer's Back with Uniform Attention
di: Hyeon-Woo, Nam, et al.
Pubblicazione: (2022)
di: Hyeon-Woo, Nam, et al.
Pubblicazione: (2022)
Learning Semantic Segmentation with Query Points Supervision on Aerial Images
di: Rivier, Santiago, et al.
Pubblicazione: (2023)
di: Rivier, Santiago, et al.
Pubblicazione: (2023)
Reproducing DragDiffusion: Interactive Point-Based Editing with Diffusion Models
di: Subhan, Ali, et al.
Pubblicazione: (2026)
di: Subhan, Ali, et al.
Pubblicazione: (2026)
Latent Geometric Chords for Query-Efficient Decision-Based Adversarial Attacks
di: Khine, Ei Hmue, et al.
Pubblicazione: (2026)
di: Khine, Ei Hmue, et al.
Pubblicazione: (2026)
Align Your Query: Representation Alignment for Multimodality Medical Object Detection
di: Seo, Ara, et al.
Pubblicazione: (2025)
di: Seo, Ara, et al.
Pubblicazione: (2025)
Documenti analoghi
-
GQKVA: Efficient Pre-training of Transformers by Grouping Queries, Keys, and Values
di: Javadi, Farnoosh, et al.
Pubblicazione: (2023) -
LDA-AQU: Adaptive Query-guided Upsampling via Local Deformable Attention
di: Du, Zewen, et al.
Pubblicazione: (2024) -
Masked Multi-Query Slot Attention for Unsupervised Object Discovery
di: Pramanik, Rishav, et al.
Pubblicazione: (2024) -
KOPPA: Improving Prompt-based Continual Learning with Key-Query Orthogonal Projection and Prototype-based One-Versus-All
di: Tran, Quyen, et al.
Pubblicazione: (2023) -
Video-Based MPAA Rating Prediction: An Attention-Driven Hybrid Architecture Using Contrastive Learning
di: Neogi, Dipta, et al.
Pubblicazione: (2025)