Enregistré dans:
| Auteurs principaux: | Bae, Sangmin, Acun, Bilge, Lin, Chien-Yu, Habeeb, Haroun, Kim, Seungyeon, Luo, Liang, Wang, Junjie, Wu, Carole-Jean |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2510.04800 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Composer: A Search Framework for Hybrid Neural Architecture Design
par: Acun, Bilge, et autres
Publié: (2025)
par: Acun, Bilge, et autres
Publié: (2025)
Agentic Discovery of Neural Architectures: AIRA-Compose and AIRA-Design
par: Pepe, Alberto, et autres
Publié: (2026)
par: Pepe, Alberto, et autres
Publié: (2026)
Beyond Efficiency: Scaling AI Sustainably
par: Wu, Carole-Jean, et autres
Publié: (2024)
par: Wu, Carole-Jean, et autres
Publié: (2024)
Accelerating Large Language Model Inference via Early-Exiting Algorithms
par: Bae, Sangmin
Publié: (2025)
par: Bae, Sangmin
Publié: (2025)
CHAI: Clustered Head Attention for Efficient LLM Inference
par: Agarwal, Saurabh, et autres
Publié: (2024)
par: Agarwal, Saurabh, et autres
Publié: (2024)
Relaxed Recursive Transformers: Effective Parameter Sharing with Layer-wise LoRA
par: Bae, Sangmin, et autres
Publié: (2024)
par: Bae, Sangmin, et autres
Publié: (2024)
Gecko: An Efficient Neural Architecture Inherently Processing Sequences with Arbitrary Lengths
par: Ma, Xuezhe, et autres
Publié: (2026)
par: Ma, Xuezhe, et autres
Publié: (2026)
Scalable LLM Reasoning Acceleration with Low-rank Distillation
par: Dong, Harry, et autres
Publié: (2025)
par: Dong, Harry, et autres
Publié: (2025)
Unlocking the Potential of Renewable Energy Through Curtailment Prediction
par: Acun, Bilge, et autres
Publié: (2024)
par: Acun, Bilge, et autres
Publié: (2024)
Unlocking the Potential of Diffusion Language Models through Template Infilling
par: Lee, Junhoo, et autres
Publié: (2025)
par: Lee, Junhoo, et autres
Publié: (2025)
LayerSkip: Enabling Early Exit Inference and Self-Speculative Decoding
par: Elhoushi, Mostafa, et autres
Publié: (2024)
par: Elhoushi, Mostafa, et autres
Publié: (2024)
Carpe Diem: On the Evaluation of World Knowledge in Lifelong Language Models
par: Kim, Yujin, et autres
Publié: (2023)
par: Kim, Yujin, et autres
Publié: (2023)
SLURP-TN : Resource for Tunisian Dialect Spoken Language Understanding
par: Elleuch, Haroun, et autres
Publié: (2026)
par: Elleuch, Haroun, et autres
Publié: (2026)
Learning Video Temporal Dynamics with Cross-Modal Attention for Robust Audio-Visual Speech Recognition
par: Kim, Sungnyun, et autres
Publié: (2024)
par: Kim, Sungnyun, et autres
Publié: (2024)
MoHAVE: Mixture of Hierarchical Audio-Visual Experts for Robust Speech Recognition
par: Kim, Sungnyun, et autres
Publié: (2025)
par: Kim, Sungnyun, et autres
Publié: (2025)
Block Transformer: Global-to-Local Language Modeling for Fast Inference
par: Ho, Namgyu, et autres
Publié: (2024)
par: Ho, Namgyu, et autres
Publié: (2024)
DiagESC: Dialogue Synthesis for Integrating Depression Diagnosis into Emotional Support Conversation
par: Seo, Seungyeon, et autres
Publié: (2024)
par: Seo, Seungyeon, et autres
Publié: (2024)
CV-18 NER: Augmented Common Voice for Named Entity Recognition from Arabic Speech
par: Saidi, Youssef, et autres
Publié: (2026)
par: Saidi, Youssef, et autres
Publié: (2026)
SPIN: SE(3)-Invariant Physics Informed Network for Binding Affinity Prediction
par: Choi, Seungyeon, et autres
Publié: (2024)
par: Choi, Seungyeon, et autres
Publié: (2024)
Performance Analysis of Speech Encoders for Low-Resource SLU and ASR in Tunisian Dialect
par: Mdhaffar, Salima, et autres
Publié: (2024)
par: Mdhaffar, Salima, et autres
Publié: (2024)
Uncovering the Potential Risks in Unlearning: Danger of English-only Unlearning in Multilingual LLMs
par: Hwang, Kyomin, et autres
Publié: (2025)
par: Hwang, Kyomin, et autres
Publié: (2025)
Natural Language Declarative Prompting (NLD-P): A Modular Governance Method for Prompt Design Under Model Drift
par: Kim, Hyunwoo, et autres
Publié: (2026)
par: Kim, Hyunwoo, et autres
Publié: (2026)
MAD Max Beyond Single-Node: Enabling Large Machine Learning Model Acceleration on Distributed Systems
par: Hsia, Samuel, et autres
Publié: (2023)
par: Hsia, Samuel, et autres
Publié: (2023)
CATransformers: Carbon Aware Transformers Through Joint Model-Hardware Optimization
par: Wang, Irene, et autres
Publié: (2025)
par: Wang, Irene, et autres
Publié: (2025)
Analysis of Plan-based Retrieval for Grounded Text Generation
par: Godbole, Ameya, et autres
Publié: (2024)
par: Godbole, Ameya, et autres
Publié: (2024)
OffsetBias: Leveraging Debiased Data for Tuning Evaluators
par: Park, Junsoo, et autres
Publié: (2024)
par: Park, Junsoo, et autres
Publié: (2024)
Design Principle Transfer in Neural Architecture Search via Large Language Models
par: Zhou, Xun, et autres
Publié: (2024)
par: Zhou, Xun, et autres
Publié: (2024)
SAGE-LD: Towards Scalable and Generalizable End-to-End Language Diarization via Simulated Data Augmentation
par: Lee, Sangmin, et autres
Publié: (2025)
par: Lee, Sangmin, et autres
Publié: (2025)
Beyond Single-User Dialogue: Assessing Multi-User Dialogue State Tracking Capabilities of Large Language Models
par: Song, Sangmin, et autres
Publié: (2025)
par: Song, Sangmin, et autres
Publié: (2025)
ADI-20: Arabic Dialect Identification dataset and models
par: Elleuch, Haroun, et autres
Publié: (2025)
par: Elleuch, Haroun, et autres
Publié: (2025)
Augmented Vision-Language Models: A Systematic Review
par: Davis, Anthony C, et autres
Publié: (2025)
par: Davis, Anthony C, et autres
Publié: (2025)
Becoming Experienced Judges: Selective Test-Time Learning for Evaluators
par: Jwa, Seungyeon, et autres
Publié: (2025)
par: Jwa, Seungyeon, et autres
Publié: (2025)
Language Model as an Annotator: Unsupervised Context-aware Quality Phrase Generation
par: Zhang, Zhihao, et autres
Publié: (2023)
par: Zhang, Zhihao, et autres
Publié: (2023)
ERUPD -- English to Roman Urdu Parallel Dataset
par: Furqan, Mohammed, et autres
Publié: (2024)
par: Furqan, Mohammed, et autres
Publié: (2024)
A Systematic Analysis of Hybrid Linear Attention
par: Wang, Dustin, et autres
Publié: (2025)
par: Wang, Dustin, et autres
Publié: (2025)
Natural Language Embedded Programs for Hybrid Language Symbolic Reasoning
par: Zhang, Tianhua, et autres
Publié: (2023)
par: Zhang, Tianhua, et autres
Publié: (2023)
Enhancing Gluten‐Free Cake Quality With Germinated and Ungerminated Mung Bean Flours: A Comparative Analysis
par: Sultan Acun
Publié: (2026)
par: Sultan Acun
Publié: (2026)
Surprisal from Larger Transformer-based Language Models Predicts fMRI Data More Poorly
par: Lin, Yi-Chien, et autres
Publié: (2025)
par: Lin, Yi-Chien, et autres
Publié: (2025)
Beyond Natural Language Perplexity: Detecting Dead Code Poisoning in Code Generation Datasets
par: Tsai, Chi-Chien, et autres
Publié: (2025)
par: Tsai, Chi-Chien, et autres
Publié: (2025)
TEDxTN: A Three-way Speech Translation Corpus for Code-Switched Tunisian Arabic - English
par: Bougares, Fethi, et autres
Publié: (2025)
par: Bougares, Fethi, et autres
Publié: (2025)
Documents similaires
-
Composer: A Search Framework for Hybrid Neural Architecture Design
par: Acun, Bilge, et autres
Publié: (2025) -
Agentic Discovery of Neural Architectures: AIRA-Compose and AIRA-Design
par: Pepe, Alberto, et autres
Publié: (2026) -
Beyond Efficiency: Scaling AI Sustainably
par: Wu, Carole-Jean, et autres
Publié: (2024) -
Accelerating Large Language Model Inference via Early-Exiting Algorithms
par: Bae, Sangmin
Publié: (2025) -
CHAI: Clustered Head Attention for Efficient LLM Inference
par: Agarwal, Saurabh, et autres
Publié: (2024)