Gespeichert in:
| Hauptverfasser: | Zhang, Shaolei, Zhang, Kehao, Fang, Qingkai, Guo, Shoutao, Zhou, Yan, Liu, Xiaodong, Feng, Yang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | https://arxiv.org/abs/2411.16300 |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Stream-Omni: Simultaneous Multimodal Interactions with Large Language-Vision-Speech Model
von: Zhang, Shaolei, et al.
Veröffentlicht: (2025)
von: Zhang, Shaolei, et al.
Veröffentlicht: (2025)
LLaMA-Omni: Seamless Speech Interaction with Large Language Models
von: Fang, Qingkai, et al.
Veröffentlicht: (2024)
von: Fang, Qingkai, et al.
Veröffentlicht: (2024)
LLaMA-Omni2: LLM-based Real-time Spoken Chatbot with Autoregressive Streaming Speech Synthesis
von: Fang, Qingkai, et al.
Veröffentlicht: (2025)
von: Fang, Qingkai, et al.
Veröffentlicht: (2025)
StreamSpeech: Simultaneous Speech-to-Speech Translation with Multi-task Learning
von: Zhang, Shaolei, et al.
Veröffentlicht: (2024)
von: Zhang, Shaolei, et al.
Veröffentlicht: (2024)
A Non-autoregressive Generation Framework for End-to-End Simultaneous Speech-to-Speech Translation
von: Ma, Zhengrui, et al.
Veröffentlicht: (2024)
von: Ma, Zhengrui, et al.
Veröffentlicht: (2024)
Glancing Future for Simultaneous Machine Translation
von: Guo, Shoutao, et al.
Veröffentlicht: (2023)
von: Guo, Shoutao, et al.
Veröffentlicht: (2023)
FastLongSpeech: Enhancing Large Speech-Language Models for Efficient Long-Speech Processing
von: Guo, Shoutao, et al.
Veröffentlicht: (2025)
von: Guo, Shoutao, et al.
Veröffentlicht: (2025)
LLaVA-Mini: Efficient Image and Video Large Multimodal Models with One Vision Token
von: Zhang, Shaolei, et al.
Veröffentlicht: (2025)
von: Zhang, Shaolei, et al.
Veröffentlicht: (2025)
Efficient Training for Cross-lingual Speech Language Models
von: Zhou, Yan, et al.
Veröffentlicht: (2026)
von: Zhou, Yan, et al.
Veröffentlicht: (2026)
Large Language Models Are Read/Write Policy-Makers for Simultaneous Generation
von: Guo, Shoutao, et al.
Veröffentlicht: (2025)
von: Guo, Shoutao, et al.
Veröffentlicht: (2025)
SiLLM: Large Language Models for Simultaneous Machine Translation
von: Guo, Shoutao, et al.
Veröffentlicht: (2024)
von: Guo, Shoutao, et al.
Veröffentlicht: (2024)
TruthX: Alleviating Hallucinations by Editing Large Language Models in Truthful Space
von: Zhang, Shaolei, et al.
Veröffentlicht: (2024)
von: Zhang, Shaolei, et al.
Veröffentlicht: (2024)
PSO-Merging: Merging Models Based on Particle Swarm Optimization
von: Zhang, Kehao, et al.
Veröffentlicht: (2025)
von: Zhang, Kehao, et al.
Veröffentlicht: (2025)
Agent-SiMT: Agent-assisted Simultaneous Machine Translation with Large Language Models
von: Guo, Shoutao, et al.
Veröffentlicht: (2024)
von: Guo, Shoutao, et al.
Veröffentlicht: (2024)
Can We Achieve High-quality Direct Speech-to-Speech Translation without Parallel Speech Data?
von: Fang, Qingkai, et al.
Veröffentlicht: (2024)
von: Fang, Qingkai, et al.
Veröffentlicht: (2024)
Decoder-only Streaming Transformer for Simultaneous Translation
von: Guo, Shoutao, et al.
Veröffentlicht: (2024)
von: Guo, Shoutao, et al.
Veröffentlicht: (2024)
AlignX: Advancing Multilingual Large Language Models with Multilingual Representation Alignment
von: Bu, Mengyu, et al.
Veröffentlicht: (2025)
von: Bu, Mengyu, et al.
Veröffentlicht: (2025)
Synergetic Event Understanding: A Collaborative Approach to Cross-Document Event Coreference Resolution with Large Language Models
von: Min, Qingkai, et al.
Veröffentlicht: (2024)
von: Min, Qingkai, et al.
Veröffentlicht: (2024)
MuBench: Assessment of Multilingual Capabilities of Large Language Models Across 61 Languages
von: Han, Wenhan, et al.
Veröffentlicht: (2025)
von: Han, Wenhan, et al.
Veröffentlicht: (2025)
Focusing on Language: Revealing and Exploiting Language Attention Heads in Multilingual Large Language Models
von: Liu, Xin, et al.
Veröffentlicht: (2025)
von: Liu, Xin, et al.
Veröffentlicht: (2025)
Persona-judge: Personalized Alignment of Large Language Models via Token-level Self-judgment
von: Zhang, Xiaotian, et al.
Veröffentlicht: (2025)
von: Zhang, Xiaotian, et al.
Veröffentlicht: (2025)
DeepAnalyze: Agentic Large Language Models for Autonomous Data Science
von: Zhang, Shaolei, et al.
Veröffentlicht: (2025)
von: Zhang, Shaolei, et al.
Veröffentlicht: (2025)
SLAM: Towards Efficient Multilingual Reasoning via Selective Language Alignment
von: Fan, Yuchun, et al.
Veröffentlicht: (2025)
von: Fan, Yuchun, et al.
Veröffentlicht: (2025)
Exploring Polyglot Harmony: On Multilingual Data Allocation for Large Language Models Pretraining
von: Guo, Ping, et al.
Veröffentlicht: (2025)
von: Guo, Ping, et al.
Veröffentlicht: (2025)
A Survey on Multilingual Large Language Models: Corpora, Alignment, and Bias
von: Xu, Yuemei, et al.
Veröffentlicht: (2024)
von: Xu, Yuemei, et al.
Veröffentlicht: (2024)
Benchmarking Multi-National Value Alignment for Large Language Models
von: Shi, Weijie, et al.
Veröffentlicht: (2025)
von: Shi, Weijie, et al.
Veröffentlicht: (2025)
Multi-objective Large Language Model Alignment with Hierarchical Experts
von: Li, Zhuo, et al.
Veröffentlicht: (2025)
von: Li, Zhuo, et al.
Veröffentlicht: (2025)
MuRating: A High Quality Data Selecting Approach to Multilingual Large Language Model Pretraining
von: Chen, Zhixun, et al.
Veröffentlicht: (2025)
von: Chen, Zhixun, et al.
Veröffentlicht: (2025)
Protecting Privacy in Multimodal Large Language Models with MLLMU-Bench
von: Liu, Zheyuan, et al.
Veröffentlicht: (2024)
von: Liu, Zheyuan, et al.
Veröffentlicht: (2024)
Leveraging Importance Sampling to Detach Alignment Modules from Large Language Models
von: Liu, Yi, et al.
Veröffentlicht: (2025)
von: Liu, Yi, et al.
Veröffentlicht: (2025)
Language Lives in Sparse Dimensions: Toward Interpretable and Efficient Multilingual Control for Large Language Models
von: Zhong, Chengzhi, et al.
Veröffentlicht: (2025)
von: Zhong, Chengzhi, et al.
Veröffentlicht: (2025)
CTC-based Non-autoregressive Textless Speech-to-Speech Translation
von: Fang, Qingkai, et al.
Veröffentlicht: (2024)
von: Fang, Qingkai, et al.
Veröffentlicht: (2024)
How do Large Language Models Handle Multilingualism?
von: Zhao, Yiran, et al.
Veröffentlicht: (2024)
von: Zhao, Yiran, et al.
Veröffentlicht: (2024)
Computational Lesions in Multilingual Language Models Separate Shared and Language-specific Brain Alignment
von: Cui, Yang, et al.
Veröffentlicht: (2026)
von: Cui, Yang, et al.
Veröffentlicht: (2026)
A Survey on Large Language Models with Multilingualism: Recent Advances and New Frontiers
von: Huang, Kaiyu, et al.
Veröffentlicht: (2024)
von: Huang, Kaiyu, et al.
Veröffentlicht: (2024)
Efficient Large Language Models: A Survey
von: Wan, Zhongwei, et al.
Veröffentlicht: (2023)
von: Wan, Zhongwei, et al.
Veröffentlicht: (2023)
Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?
von: Chen, Pinzhen, et al.
Veröffentlicht: (2024)
von: Chen, Pinzhen, et al.
Veröffentlicht: (2024)
Efficient and Effective Vocabulary Expansion Towards Multilingual Large Language Models
von: Kim, Seungduk, et al.
Veröffentlicht: (2024)
von: Kim, Seungduk, et al.
Veröffentlicht: (2024)
Implicit Cross-Lingual Rewarding for Efficient Multilingual Preference Alignment
von: Yang, Wen, et al.
Veröffentlicht: (2025)
von: Yang, Wen, et al.
Veröffentlicht: (2025)
AgentAlign: Navigating Safety Alignment in the Shift from Informative to Agentic Large Language Models
von: Zhang, Jinchuan, et al.
Veröffentlicht: (2025)
von: Zhang, Jinchuan, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Stream-Omni: Simultaneous Multimodal Interactions with Large Language-Vision-Speech Model
von: Zhang, Shaolei, et al.
Veröffentlicht: (2025) -
LLaMA-Omni: Seamless Speech Interaction with Large Language Models
von: Fang, Qingkai, et al.
Veröffentlicht: (2024) -
LLaMA-Omni2: LLM-based Real-time Spoken Chatbot with Autoregressive Streaming Speech Synthesis
von: Fang, Qingkai, et al.
Veröffentlicht: (2025) -
StreamSpeech: Simultaneous Speech-to-Speech Translation with Multi-task Learning
von: Zhang, Shaolei, et al.
Veröffentlicht: (2024) -
A Non-autoregressive Generation Framework for End-to-End Simultaneous Speech-to-Speech Translation
von: Ma, Zhengrui, et al.
Veröffentlicht: (2024)