Beyond the Turn-Based Game: Enabling Real-Time Conversations with Duplex Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Zhang, Xinrong, Chen, Yingfa, Hu, Shengding, Han, Xu, Xu, Zihang, Xu, Yuanwei, Zhao, Weilin, Sun, Maosong, Liu, Zhiyuan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Stuffed Mamba: Oversized States Lead to the Inability to Forget
von: Chen, Yingfa, et al.
Veröffentlicht: (2024)
von: Chen, Yingfa, et al.
Veröffentlicht: (2024)
$\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens
von: Zhang, Xinrong, et al.
Veröffentlicht: (2024)
von: Zhang, Xinrong, et al.
Veröffentlicht: (2024)
Enabling Real-Time Conversations with Minimal Training Costs
von: Xu, Wang, et al.
Veröffentlicht: (2024)
von: Xu, Wang, et al.
Veröffentlicht: (2024)
BlockFFN: Towards End-Side Acceleration-Friendly Mixture-of-Experts with Chunk-Level Activation Sparsity
von: Song, Chenyang, et al.
Veröffentlicht: (2025)
von: Song, Chenyang, et al.
Veröffentlicht: (2025)
States Hidden in Hidden States: LLMs Emerge Discrete State Representations Implicitly
von: Chen, Junhao, et al.
Veröffentlicht: (2024)
von: Chen, Junhao, et al.
Veröffentlicht: (2024)
Predicting Emergent Abilities with Infinite Resolution Evaluation
von: Hu, Shengding, et al.
Veröffentlicht: (2023)
von: Hu, Shengding, et al.
Veröffentlicht: (2023)
DECO: Sparse Mixture-of-Experts with Dense-Comparable Performance on End-Side Devices
von: Song, Chenyang, et al.
Veröffentlicht: (2026)
von: Song, Chenyang, et al.
Veröffentlicht: (2026)
StateX: Enhancing RNN Recall via Post-training State Expansion
von: Shen, Xingyu, et al.
Veröffentlicht: (2025)
von: Shen, Xingyu, et al.
Veröffentlicht: (2025)
Ouroboros: Generating Longer Drafts Phrase by Phrase for Faster Speculative Decoding
von: Zhao, Weilin, et al.
Veröffentlicht: (2024)
von: Zhao, Weilin, et al.
Veröffentlicht: (2024)
Robust and Scalable Model Editing for Large Language Models
von: Chen, Yingfa, et al.
Veröffentlicht: (2024)
von: Chen, Yingfa, et al.
Veröffentlicht: (2024)
Multi-Modal Multi-Granularity Tokenizer for Chu Bamboo Slip Scripts
von: Chen, Yingfa, et al.
Veröffentlicht: (2024)
von: Chen, Yingfa, et al.
Veröffentlicht: (2024)
DuplexMamba: Enhancing Real-time Speech Conversations with Duplex and Streaming Capabilities
von: Lu, Xiangyu, et al.
Veröffentlicht: (2025)
von: Lu, Xiangyu, et al.
Veröffentlicht: (2025)
CA-LoRA: Adapting Existing LoRA for Compressed LLMs to Enable Efficient Multi-Tasking on Personal Devices
von: Zhao, Weilin, et al.
Veröffentlicht: (2023)
von: Zhao, Weilin, et al.
Veröffentlicht: (2023)
Cost-Optimal Grouped-Query Attention for Long-Context Modeling
von: Chen, Yingfa, et al.
Veröffentlicht: (2025)
von: Chen, Yingfa, et al.
Veröffentlicht: (2025)
UltraEval: A Lightweight Platform for Flexible and Comprehensive Evaluation for LLMs
von: He, Chaoqun, et al.
Veröffentlicht: (2024)
von: He, Chaoqun, et al.
Veröffentlicht: (2024)
Unified View of Grokking, Double Descent and Emergent Abilities: A Perspective from Circuits Competition
von: Huang, Yufei, et al.
Veröffentlicht: (2024)
von: Huang, Yufei, et al.
Veröffentlicht: (2024)
Student-in-the-Loop Chain-of-Thought Distillation via Generation-Time Selection
von: He, Chaoqun, et al.
Veröffentlicht: (2026)
von: He, Chaoqun, et al.
Veröffentlicht: (2026)
Sparsing Law: Towards Large Language Models with Greater Activation Sparsity
von: Luo, Yuqi, et al.
Veröffentlicht: (2024)
von: Luo, Yuqi, et al.
Veröffentlicht: (2024)
MiniCPM-o 4.5: Towards Real-Time Full-Duplex Omni-Modal Interaction
von: Cui, Junbo, et al.
Veröffentlicht: (2026)
von: Cui, Junbo, et al.
Veröffentlicht: (2026)
ProSparse: Introducing and Enhancing Intrinsic Activation Sparsity within Large Language Models
von: Song, Chenyang, et al.
Veröffentlicht: (2024)
von: Song, Chenyang, et al.
Veröffentlicht: (2024)
DecorateLM: Data Engineering through Corpus Rating, Tagging, and Editing with Language Models
von: Zhao, Ranchi, et al.
Veröffentlicht: (2024)
von: Zhao, Ranchi, et al.
Veröffentlicht: (2024)
A Multi-Power Law for Loss Curve Prediction Across Learning Rate Schedules
von: Luo, Kairong, et al.
Veröffentlicht: (2025)
von: Luo, Kairong, et al.
Veröffentlicht: (2025)
Seq1F1B: Efficient Sequence-Level Pipeline Parallelism for Large Language Model Training
von: Sun, Ao, et al.
Veröffentlicht: (2024)
von: Sun, Ao, et al.
Veröffentlicht: (2024)
FastFiD: Improve Inference Efficiency of Open Domain Question Answering via Sentence Selection
von: Huang, Yufei, et al.
Veröffentlicht: (2024)
von: Huang, Yufei, et al.
Veröffentlicht: (2024)
APB: Accelerating Distributed Long-Context Inference by Passing Compressed Context Blocks across GPUs
von: Huang, Yuxiang, et al.
Veröffentlicht: (2025)
von: Huang, Yuxiang, et al.
Veröffentlicht: (2025)
LoRA-Flow: Dynamic LoRA Fusion for Large Language Models in Generative Tasks
von: Wang, Hanqing, et al.
Veröffentlicht: (2024)
von: Wang, Hanqing, et al.
Veröffentlicht: (2024)
JAL-Turn: Joint Acoustic-Linguistic Modeling for Real-Time and Robust Turn-Taking Detection in Full-Duplex Spoken Dialogue Systems
von: Yang, Guangzhao, et al.
Veröffentlicht: (2026)
von: Yang, Guangzhao, et al.
Veröffentlicht: (2026)
Beyond Turn-Based Interfaces: Synchronous LLMs as Full-Duplex Dialogue Agents
von: Veluri, Bandhav, et al.
Veröffentlicht: (2024)
von: Veluri, Bandhav, et al.
Veröffentlicht: (2024)
Densing Law of LLMs
von: Xiao, Chaojun, et al.
Veröffentlicht: (2024)
von: Xiao, Chaojun, et al.
Veröffentlicht: (2024)
FR-Spec: Accelerating Large-Vocabulary Language Models via Frequency-Ranked Speculative Sampling
von: Zhao, Weilin, et al.
Veröffentlicht: (2025)
von: Zhao, Weilin, et al.
Veröffentlicht: (2025)
MiniCPM: Unveiling the Potential of Small Language Models with Scalable Training Strategies
von: Hu, Shengding, et al.
Veröffentlicht: (2024)
von: Hu, Shengding, et al.
Veröffentlicht: (2024)
OlympiadBench: A Challenging Benchmark for Promoting AGI with Olympiad-Level Bilingual Multimodal Scientific Problems
von: He, Chaoqun, et al.
Veröffentlicht: (2024)
von: He, Chaoqun, et al.
Veröffentlicht: (2024)
Delta-CoMe: Training-Free Delta-Compression with Mixed-Precision for Large Language Models
von: Ping, Bowen, et al.
Veröffentlicht: (2024)
von: Ping, Bowen, et al.
Veröffentlicht: (2024)
ConPET: Continual Parameter-Efficient Tuning for Large Language Models
von: Song, Chenyang, et al.
Veröffentlicht: (2023)
von: Song, Chenyang, et al.
Veröffentlicht: (2023)
Enabling Conversational Behavior Reasoning Capabilities in Full-Duplex Speech
von: Pan, Shuchang, et al.
Veröffentlicht: (2025)
von: Pan, Shuchang, et al.
Veröffentlicht: (2025)
Mastering Text, Code and Math Simultaneously via Fusing Highly Specialized Language Models
von: Ding, Ning, et al.
Veröffentlicht: (2024)
von: Ding, Ning, et al.
Veröffentlicht: (2024)
MTR-DuplexBench: Towards a Comprehensive Evaluation of Multi-Round Conversations for Full-Duplex Speech Language Models
von: Zhang, He, et al.
Veröffentlicht: (2025)
von: Zhang, He, et al.
Veröffentlicht: (2025)
Synchronization and Turn-Taking in Full-Duplex Speech Dialogue Models
von: Riera, Pablo, et al.
Veröffentlicht: (2026)
von: Riera, Pablo, et al.
Veröffentlicht: (2026)
LEGENT: Open Platform for Embodied Agents
von: Cheng, Zhili, et al.
Veröffentlicht: (2024)
von: Cheng, Zhili, et al.
Veröffentlicht: (2024)
A*-Thought: Efficient Reasoning via Bidirectional Compression for Low-Resource Settings
von: Xu, Xiaoang, et al.
Veröffentlicht: (2025)
von: Xu, Xiaoang, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Stuffed Mamba: Oversized States Lead to the Inability to Forget
von: Chen, Yingfa, et al.
Veröffentlicht: (2024) -
$\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens
von: Zhang, Xinrong, et al.
Veröffentlicht: (2024) -
Enabling Real-Time Conversations with Minimal Training Costs
von: Xu, Wang, et al.
Veröffentlicht: (2024) -
BlockFFN: Towards End-Side Acceleration-Friendly Mixture-of-Experts with Chunk-Level Activation Sparsity
von: Song, Chenyang, et al.
Veröffentlicht: (2025) -
States Hidden in Hidden States: LLMs Emerge Discrete State Representations Implicitly
von: Chen, Junhao, et al.
Veröffentlicht: (2024)