Lizard: An Efficient Linearization Framework for Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Van Nguyen, Chien, Nguyen, Huy, Zhang, Ruiyi, Deilamsalehy, Hanieh, Mathur, Puneet, Lai, Viet Dac, Wang, Haoliang, Subramanian, Jayakumar, Rossi, Ryan A., Bui, Trung, Vlassis, Nikos, Dernoncourt, Franck, Nguyen, Thien Huu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Taipan: Efficient and Expressive State Space Language Models with Selective Attention
por: Van Nguyen, Chien, et al.
Publicado: (2024)
por: Van Nguyen, Chien, et al.
Publicado: (2024)
Identifying Speakers in Dialogue Transcripts: A Text-based Approach Using Pretrained Language Models
por: Nguyen, Minh, et al.
Publicado: (2024)
por: Nguyen, Minh, et al.
Publicado: (2024)
LUSIFER: Language Universal Space Integration for Enhanced Multilingual Embeddings with Large Language Models
por: Man, Hieu, et al.
Publicado: (2025)
por: Man, Hieu, et al.
Publicado: (2025)
Comprehensive and Practical Evaluation of Retrieval-Augmented Generation Systems for Medical Question Answering
por: Ngo, Nghia Trung, et al.
Publicado: (2024)
por: Ngo, Nghia Trung, et al.
Publicado: (2024)
mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning
por: Ngo, Nghia Trung, et al.
Publicado: (2025)
por: Ngo, Nghia Trung, et al.
Publicado: (2025)
DynaSaur: Large Language Agents Beyond Predefined Actions
por: Nguyen, Dang, et al.
Publicado: (2024)
por: Nguyen, Dang, et al.
Publicado: (2024)
SlimLM: An Efficient Small Language Model for On-Device Document Assistance
por: Pham, Thang M., et al.
Publicado: (2024)
por: Pham, Thang M., et al.
Publicado: (2024)
Towards Enhancing Coherence in Extractive Summarization: Dataset and Experiments with LLMs
por: Parmar, Mihir, et al.
Publicado: (2024)
por: Parmar, Mihir, et al.
Publicado: (2024)
ULLME: A Unified Framework for Large Language Model Embeddings with Generation-Augmented Learning
por: Man, Hieu, et al.
Publicado: (2024)
por: Man, Hieu, et al.
Publicado: (2024)
NoLiMa: Long-Context Evaluation Beyond Literal Matching
por: Modarressi, Ali, et al.
Publicado: (2025)
por: Modarressi, Ali, et al.
Publicado: (2025)
ViT-AdaLA: Adapting Vision Transformers with Linear Attention
por: Li, Yifan, et al.
Publicado: (2026)
por: Li, Yifan, et al.
Publicado: (2026)
Understanding Generative AI Capabilities in Everyday Image Editing Tasks
por: Taesiri, Mohammad Reza, et al.
Publicado: (2025)
por: Taesiri, Mohammad Reza, et al.
Publicado: (2025)
LongLaMP: A Benchmark for Personalized Long-form Text Generation
por: Kumar, Ishita, et al.
Publicado: (2024)
por: Kumar, Ishita, et al.
Publicado: (2024)
Orthrus: Memory-Efficient Parallel Token Generation via Dual-View Diffusion
por: Van Nguyen, Chien, et al.
Publicado: (2026)
por: Van Nguyen, Chien, et al.
Publicado: (2026)
Steering MoE LLMs via Expert (De)Activation
por: Fayyaz, Mohsen, et al.
Publicado: (2025)
por: Fayyaz, Mohsen, et al.
Publicado: (2025)
Explainable Disentangled Representation Learning for Generalizable Authorship Attribution in the Era of Generative AI
por: Man, Hieu, et al.
Publicado: (2026)
por: Man, Hieu, et al.
Publicado: (2026)
Blind to the Human Touch: Overlap Bias in LLM-Based Summary Evaluation
por: Fang, Jiangnan, et al.
Publicado: (2026)
por: Fang, Jiangnan, et al.
Publicado: (2026)
ChartCitor: Multi-Agent Framework for Fine-Grained Chart Visual Attribution
por: Goswami, Kanika, et al.
Publicado: (2025)
por: Goswami, Kanika, et al.
Publicado: (2025)
PlotEdit: Natural Language-Driven Accessible Chart Editing in PDFs via Multimodal LLM Agents
por: Goswami, Kanika, et al.
Publicado: (2025)
por: Goswami, Kanika, et al.
Publicado: (2025)
PlotGen: Multi-Agent LLM-based Scientific Data Visualization via Multimodal Feedback
por: Goswami, Kanika, et al.
Publicado: (2025)
por: Goswami, Kanika, et al.
Publicado: (2025)
COSAC: Counterfactual Credit Assignment in Sequential Cooperative Teams
por: Deshmukh, Shripad, et al.
Publicado: (2026)
por: Deshmukh, Shripad, et al.
Publicado: (2026)
Zero-shot Cross-lingual Transfer Learning with Multiple Source and Target Languages for Information Extraction: Language Selection and Adversarial Training
por: Ngo, Nghia Trung, et al.
Publicado: (2024)
por: Ngo, Nghia Trung, et al.
Publicado: (2024)
Partial Policy Gradients for RL in LLMs
por: Mathur, Puneet, et al.
Publicado: (2026)
por: Mathur, Puneet, et al.
Publicado: (2026)
Bridging Classification and Segmentation in Osteosarcoma Assessment via Foundation and Discrete Diffusion Models
por: Nguyen, Manh Duong, et al.
Publicado: (2025)
por: Nguyen, Manh Duong, et al.
Publicado: (2025)
CT to PET Translation: A Large-scale Dataset and Domain-Knowledge-Guided Diffusion Approach
por: Nguyen, Dac Thai, et al.
Publicado: (2024)
por: Nguyen, Dac Thai, et al.
Publicado: (2024)
Offline RL by Reward-Weighted Fine-Tuning for Conversation Optimization
por: Mukherjee, Subhojyoti, et al.
Publicado: (2025)
por: Mukherjee, Subhojyoti, et al.
Publicado: (2025)
StreamGaze: Gaze-Guided Temporal Reasoning and Proactive Understanding in Streaming Videos
por: Lee, Daeun, et al.
Publicado: (2025)
por: Lee, Daeun, et al.
Publicado: (2025)
Scaling Up Video Summarization Pretraining with Large Language Models
por: Argaw, Dawit Mureja, et al.
Publicado: (2024)
por: Argaw, Dawit Mureja, et al.
Publicado: (2024)
Lean and Mean Adaptive Optimization via Subset-Norm and Subspace-Momentum with Convergence Guarantees
por: Nguyen, Thien Hang, et al.
Publicado: (2024)
por: Nguyen, Thien Hang, et al.
Publicado: (2024)
Self-Debiasing Large Language Models: Zero-Shot Recognition and Reduction of Stereotypes
por: Gallegos, Isabel O., et al.
Publicado: (2024)
por: Gallegos, Isabel O., et al.
Publicado: (2024)
An Analysis of Multilingual FActScore
por: Vu, Kim Trong, et al.
Publicado: (2024)
por: Vu, Kim Trong, et al.
Publicado: (2024)
Explaining Graph Neural Networks via Structure-aware Interaction Index
por: Bui, Ngoc, et al.
Publicado: (2024)
por: Bui, Ngoc, et al.
Publicado: (2024)
OWLViz: An Open-World Benchmark for Visual Question Answering
por: Nguyen, Thuy, et al.
Publicado: (2025)
por: Nguyen, Thuy, et al.
Publicado: (2025)
A Multi-LLM Debiasing Framework
por: Owens, Deonna M., et al.
Publicado: (2024)
por: Owens, Deonna M., et al.
Publicado: (2024)
Toward a Vision-Language Foundation Model for Medical Data: Multimodal Dataset and Benchmarks for Vietnamese PET/CT Report Generation
por: Nguyen, Huu Tien, et al.
Publicado: (2025)
por: Nguyen, Huu Tien, et al.
Publicado: (2025)
InfinityStory: Unlimited Video Generation with World Consistency and Character-Aware Shot Transitions
por: Elmoghany, Mohamed, et al.
Publicado: (2026)
por: Elmoghany, Mohamed, et al.
Publicado: (2026)
Multi-LLM Text Summarization
por: Fang, Jiangnan, et al.
Publicado: (2024)
por: Fang, Jiangnan, et al.
Publicado: (2024)
High Atherogenic Index of Plasma Associated With Delayed Graft Function in Living Donor Renal Transplant Recipients: A Single‐Center Study in Vietnam
por: Dung Pham Thai, et al.
Publicado: (2024)
por: Dung Pham Thai, et al.
Publicado: (2024)
Structured Pruning for Diverse Best-of-N Reasoning Optimization
por: Nguyen, Hieu Trung, et al.
Publicado: (2025)
por: Nguyen, Hieu Trung, et al.
Publicado: (2025)
VisDoM: Multi-Document QA with Visually Rich Elements Using Multimodal Retrieval-Augmented Generation
por: Suri, Manan, et al.
Publicado: (2024)
por: Suri, Manan, et al.
Publicado: (2024)
Ejemplares similares
-
Taipan: Efficient and Expressive State Space Language Models with Selective Attention
por: Van Nguyen, Chien, et al.
Publicado: (2024) -
Identifying Speakers in Dialogue Transcripts: A Text-based Approach Using Pretrained Language Models
por: Nguyen, Minh, et al.
Publicado: (2024) -
LUSIFER: Language Universal Space Integration for Enhanced Multilingual Embeddings with Large Language Models
por: Man, Hieu, et al.
Publicado: (2025) -
Comprehensive and Practical Evaluation of Retrieval-Augmented Generation Systems for Medical Question Answering
por: Ngo, Nghia Trung, et al.
Publicado: (2024) -
mSCoRe: a $M$ultilingual and Scalable Benchmark for $S$kill-based $Co$mmonsense $Re$asoning
por: Ngo, Nghia Trung, et al.
Publicado: (2025)