Micro Language Models Enable Instant Responses
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cheng, Wen, Chen, Tuochao, Helwani, Karim, Srinivasan, Sriram, Zettlemoyer, Luke, Gollakota, Shyamnath |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AV-Dialog: Spoken Dialogue Models with Audio-Visual Input
par: Chen, Tuochao, et autres
Publié: (2025)
par: Chen, Tuochao, et autres
Publié: (2025)
Proactive Hearing Assistants that Isolate Egocentric Conversations
par: Hu, Guilin, et autres
Publié: (2025)
par: Hu, Guilin, et autres
Publié: (2025)
LLAMAPIE: Proactive In-Ear Conversation Assistants
par: Chen, Tuochao, et autres
Publié: (2025)
par: Chen, Tuochao, et autres
Publié: (2025)
Reading Between the Lines: The One-Sided Conversation Problem
par: Ebert, Victoria, et autres
Publié: (2025)
par: Ebert, Victoria, et autres
Publié: (2025)
TF-MLPNet: Tiny Real-Time Neural Speech Separation
par: Itani, Malek, et autres
Publié: (2025)
par: Itani, Malek, et autres
Publié: (2025)
Target conversation extraction: Source separation using turn-taking dynamics
par: Chen, Tuochao, et autres
Publié: (2024)
par: Chen, Tuochao, et autres
Publié: (2024)
Spatial Speech Translation: Translating Across Space With Binaural Hearables
par: Chen, Tuochao, et autres
Publié: (2025)
par: Chen, Tuochao, et autres
Publié: (2025)
Wireless Hearables With Programmable Speech AI Accelerators
par: Itani, Malek, et autres
Publié: (2025)
par: Itani, Malek, et autres
Publié: (2025)
Look Once to Hear: Target Speech Hearing with Noisy Examples
par: Veluri, Bandhav, et autres
Publié: (2024)
par: Veluri, Bandhav, et autres
Publié: (2024)
Beyond Turn-Based Interfaces: Synchronous LLMs as Full-Duplex Dialogue Agents
par: Veluri, Bandhav, et autres
Publié: (2024)
par: Veluri, Bandhav, et autres
Publié: (2024)
A Hierarchical End-of-Turn Model with Primary Speaker Segmentation for Real-Time Conversational AI
par: Helwani, Karim, et autres
Publié: (2026)
par: Helwani, Karim, et autres
Publié: (2026)
Anchored Decoding: Provably Reducing Copyright Risk for Any Language Model
par: He, Jacqueline, et autres
Publié: (2026)
par: He, Jacqueline, et autres
Publié: (2026)
Knowledge boosting during low-latency inference
par: Srinivas, Vidya, et autres
Publié: (2024)
par: Srinivas, Vidya, et autres
Publié: (2024)
Demystifying Prompts in Language Models via Perplexity Estimation
par: Gonen, Hila, et autres
Publié: (2022)
par: Gonen, Hila, et autres
Publié: (2022)
Do LLMs Overthink Basic Math Reasoning? Benchmarking the Accuracy-Efficiency Tradeoff in Language Models
par: Srivastava, Gaurav, et autres
Publié: (2025)
par: Srivastava, Gaurav, et autres
Publié: (2025)
Instant Personalized Large Language Model Adaptation via Hypernetwork
par: Tan, Zhaoxuan, et autres
Publié: (2025)
par: Tan, Zhaoxuan, et autres
Publié: (2025)
Does Liking Yellow Imply Driving a School Bus? Semantic Leakage in Language Models
par: Gonen, Hila, et autres
Publié: (2024)
par: Gonen, Hila, et autres
Publié: (2024)
Reliable, Adaptable, and Attributable Language Models with Retrieval
par: Asai, Akari, et autres
Publié: (2024)
par: Asai, Akari, et autres
Publié: (2024)
Comparing Hallucination Detection Metrics for Multilingual Generation
par: Kang, Haoqiang, et autres
Publié: (2024)
par: Kang, Haoqiang, et autres
Publié: (2024)
MYTE: Morphology-Driven Byte Encoding for Better and Fairer Multilingual Language Modeling
par: Limisiewicz, Tomasz, et autres
Publié: (2024)
par: Limisiewicz, Tomasz, et autres
Publié: (2024)
Breaking the Curse of Multilinguality with Cross-lingual Expert Language Models
par: Blevins, Terra, et autres
Publié: (2024)
par: Blevins, Terra, et autres
Publié: (2024)
Infini-gram: Scaling Unbounded n-gram Language Models to a Trillion Tokens
par: Liu, Jiacheng, et autres
Publié: (2024)
par: Liu, Jiacheng, et autres
Publié: (2024)
Mixture-of-Transformers: A Sparse and Scalable Architecture for Multi-Modal Foundation Models
par: Liang, Weixin, et autres
Publié: (2024)
par: Liang, Weixin, et autres
Publié: (2024)
Generative Adapter: Contextualizing Language Models in Parameters with A Single Forward Pass
par: Chen, Tong, et autres
Publié: (2024)
par: Chen, Tong, et autres
Publié: (2024)
(Mis)Fitting: A Survey of Scaling Laws
par: Li, Margaret, et autres
Publié: (2025)
par: Li, Margaret, et autres
Publié: (2025)
Bolmo: Byteifying the Next Generation of Language Models
par: Minixhofer, Benjamin, et autres
Publié: (2025)
par: Minixhofer, Benjamin, et autres
Publié: (2025)
Slicing and Dicing: Configuring Optimal Mixtures of Experts
par: Li, Margaret, et autres
Publié: (2026)
par: Li, Margaret, et autres
Publié: (2026)
Detecting Pretraining Data from Large Language Models
par: Shi, Weijia, et autres
Publié: (2023)
par: Shi, Weijia, et autres
Publié: (2023)
Evaluating Copyright Takedown Methods for Language Models
par: Wei, Boyi, et autres
Publié: (2024)
par: Wei, Boyi, et autres
Publié: (2024)
Train for Truth, Keep the Skills: Binary Retrieval-Augmented Reward Mitigates Hallucinations
par: Chen, Tong, et autres
Publié: (2025)
par: Chen, Tong, et autres
Publié: (2025)
Representation Deficiency in Masked Language Modeling
par: Meng, Yu, et autres
Publié: (2023)
par: Meng, Yu, et autres
Publié: (2023)
Do Membership Inference Attacks Work on Large Language Models?
par: Duan, Michael, et autres
Publié: (2024)
par: Duan, Michael, et autres
Publié: (2024)
The Root Shapes the Fruit: On the Persistence of Gender-Exclusive Harms in Aligned Language Models
par: Ovalle, Anaelia, et autres
Publié: (2024)
par: Ovalle, Anaelia, et autres
Publié: (2024)
Visual Sketchpad: Sketching as a Visual Chain of Thought for Multimodal Language Models
par: Hu, Yushi, et autres
Publié: (2024)
par: Hu, Yushi, et autres
Publié: (2024)
Improving Factuality with Explicit Working Memory
par: Chen, Mingda, et autres
Publié: (2024)
par: Chen, Mingda, et autres
Publié: (2024)
Bears, all bears, and some bears. Language Constraints on Language Models' Inductive Inferences
par: Padmanabhan, Sriram, et autres
Publié: (2026)
par: Padmanabhan, Sriram, et autres
Publié: (2026)
Recycling the Web: A Method to Enhance Pre-training Data Quality and Quantity for Language Models
par: Nguyen, Thao, et autres
Publié: (2025)
par: Nguyen, Thao, et autres
Publié: (2025)
SILO Language Models: Isolating Legal Risk In a Nonparametric Datastore
par: Min, Sewon, et autres
Publié: (2023)
par: Min, Sewon, et autres
Publié: (2023)
LMFusion: Adapting Pretrained Language Models for Multimodal Generation
par: Shi, Weijia, et autres
Publié: (2024)
par: Shi, Weijia, et autres
Publié: (2024)
Early-Exit and Instant Confidence Translation Quality Estimation
par: Zouhar, Vilém, et autres
Publié: (2025)
par: Zouhar, Vilém, et autres
Publié: (2025)
Documents similaires
-
AV-Dialog: Spoken Dialogue Models with Audio-Visual Input
par: Chen, Tuochao, et autres
Publié: (2025) -
Proactive Hearing Assistants that Isolate Egocentric Conversations
par: Hu, Guilin, et autres
Publié: (2025) -
LLAMAPIE: Proactive In-Ear Conversation Assistants
par: Chen, Tuochao, et autres
Publié: (2025) -
Reading Between the Lines: The One-Sided Conversation Problem
par: Ebert, Victoria, et autres
Publié: (2025) -
TF-MLPNet: Tiny Real-Time Neural Speech Separation
par: Itani, Malek, et autres
Publié: (2025)