Pluggable Neural Machine Translation Models via Memory-augmented Adapters
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Yuzhuang, Wang, Shuo, Li, Peng, Liu, Xuebo, Wang, Xiaolong, Liu, Weidong, Liu, Yang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Exploring Large Language Models for Communication Games: An Empirical Study on Werewolf
di: Xu, Yuzhuang, et al.
Pubblicazione: (2023)
di: Xu, Yuzhuang, et al.
Pubblicazione: (2023)
OneBit: Towards Extremely Low-bit Large Language Models
di: Xu, Yuzhuang, et al.
Pubblicazione: (2024)
di: Xu, Yuzhuang, et al.
Pubblicazione: (2024)
Perspective Transition of Large Language Models for Solving Subjective Tasks
di: Wang, Xiaolong, et al.
Pubblicazione: (2025)
di: Wang, Xiaolong, et al.
Pubblicazione: (2025)
Syntax-Aware Complex-Valued Neural Machine Translation
di: Liu, Yang, et al.
Pubblicazione: (2023)
di: Liu, Yang, et al.
Pubblicazione: (2023)
Enhancing Multilingual Capabilities of Large Language Models through Self-Distillation from Resource-Rich Languages
di: Zhang, Yuanchi, et al.
Pubblicazione: (2024)
di: Zhang, Yuanchi, et al.
Pubblicazione: (2024)
F-MALLOC: Feed-forward Memory Allocation for Continual Learning in Neural Machine Translation
di: Wu, Junhong, et al.
Pubblicazione: (2024)
di: Wu, Junhong, et al.
Pubblicazione: (2024)
DelTA: An Online Document-Level Translation Agent Based on Multi-Level Memory
di: Wang, Yutong, et al.
Pubblicazione: (2024)
di: Wang, Yutong, et al.
Pubblicazione: (2024)
Lookahead Q-Cache: Achieving More Consistent KV Cache Eviction via Pseudo Query
di: Wang, Yixuan, et al.
Pubblicazione: (2025)
di: Wang, Yixuan, et al.
Pubblicazione: (2025)
Delta-CoMe: Training-Free Delta-Compression with Mixed-Precision for Large Language Models
di: Ping, Bowen, et al.
Pubblicazione: (2024)
di: Ping, Bowen, et al.
Pubblicazione: (2024)
The Box is in the Pen: Evaluating Commonsense Reasoning in Neural Machine Translation
di: He, Jie, et al.
Pubblicazione: (2025)
di: He, Jie, et al.
Pubblicazione: (2025)
UltraLink: An Open-Source Knowledge-Enhanced Multilingual Supervised Fine-tuning Dataset
di: Wang, Haoyu, et al.
Pubblicazione: (2024)
di: Wang, Haoyu, et al.
Pubblicazione: (2024)
DEEM: Dynamic Experienced Expert Modeling for Stance Detection
di: Wang, Xiaolong, et al.
Pubblicazione: (2024)
di: Wang, Xiaolong, et al.
Pubblicazione: (2024)
TasTe: Teaching Large Language Models to Translate through Self-Reflection
di: Wang, Yutong, et al.
Pubblicazione: (2024)
di: Wang, Yutong, et al.
Pubblicazione: (2024)
SCOI: Syntax-augmented Coverage-based In-context Example Selection for Machine Translation
di: Tang, Chenming, et al.
Pubblicazione: (2024)
di: Tang, Chenming, et al.
Pubblicazione: (2024)
CAMERA: Multi-Matrix Joint Compression for MoE Models via Micro-Expert Redundancy Analysis
di: Xu, Yuzhuang, et al.
Pubblicazione: (2025)
di: Xu, Yuzhuang, et al.
Pubblicazione: (2025)
Fixed and Adaptive Simultaneous Machine Translation Strategies Using Adapters
di: Issam, Abderrahmane, et al.
Pubblicazione: (2024)
di: Issam, Abderrahmane, et al.
Pubblicazione: (2024)
Towards Understanding and Improving Knowledge Distillation for Neural Machine Translation
di: Zhang, Songming, et al.
Pubblicazione: (2023)
di: Zhang, Songming, et al.
Pubblicazione: (2023)
Deterministic Reversible Data Augmentation for Neural Machine Translation
di: Yao, Jiashu, et al.
Pubblicazione: (2024)
di: Yao, Jiashu, et al.
Pubblicazione: (2024)
Leveraging Diverse Modeling Contexts with Collaborating Learning for Neural Machine Translation
di: Liao, Yusheng, et al.
Pubblicazione: (2024)
di: Liao, Yusheng, et al.
Pubblicazione: (2024)
Judge Q: Trainable Queries for Optimized Information Retention in KV Cache Eviction
di: Liu, Yijun, et al.
Pubblicazione: (2025)
di: Liu, Yijun, et al.
Pubblicazione: (2025)
Rethinking Targeted Adversarial Attacks For Neural Machine Translation
di: Wu, Junjie, et al.
Pubblicazione: (2024)
di: Wu, Junjie, et al.
Pubblicazione: (2024)
Exposing the Cracks: Vulnerabilities of Retrieval-Augmented LLM-based Machine Translation
di: Sun, Yanming, et al.
Pubblicazione: (2025)
di: Sun, Yanming, et al.
Pubblicazione: (2025)
Redefining Machine Translation on Social Network Services with Large Language Models
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
LPZero: Language Model Zero-cost Proxy Search from Zero
di: Dong, Peijie, et al.
Pubblicazione: (2024)
di: Dong, Peijie, et al.
Pubblicazione: (2024)
Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models
di: Nie, Shuo, et al.
Pubblicazione: (2026)
di: Nie, Shuo, et al.
Pubblicazione: (2026)
ArcLight: A Lightweight LLM Inference Architecture for Many-Core CPUs
di: Xu, Yuzhuang, et al.
Pubblicazione: (2026)
di: Xu, Yuzhuang, et al.
Pubblicazione: (2026)
Relay Decoding: Concatenating Large Language Models for Machine Translation
di: Fu, Chengpeng, et al.
Pubblicazione: (2024)
di: Fu, Chengpeng, et al.
Pubblicazione: (2024)
Memory-augmented Query Reconstruction for LLM-based Knowledge Graph Reasoning
di: Xu, Mufan, et al.
Pubblicazione: (2025)
di: Xu, Mufan, et al.
Pubblicazione: (2025)
Scalable Multilingual Multimodal Machine Translation with Speech-Text Fusion
di: Du, Yexing, et al.
Pubblicazione: (2026)
di: Du, Yexing, et al.
Pubblicazione: (2026)
HUOZIIME: An On-Device LLM-enhanced Input Method for Deep Personalization
di: Shan, Baocai, et al.
Pubblicazione: (2026)
di: Shan, Baocai, et al.
Pubblicazione: (2026)
ChunkLLM: A Lightweight Pluggable Framework for Accelerating LLMs Inference
di: Ouyang, Haojie, et al.
Pubblicazione: (2025)
di: Ouyang, Haojie, et al.
Pubblicazione: (2025)
Reasoning in Conversation: Solving Subjective Tasks through Dialogue Simulation for Large Language Models
di: Wang, Xiaolong, et al.
Pubblicazione: (2024)
di: Wang, Xiaolong, et al.
Pubblicazione: (2024)
A Pluggable Multi-Task Learning Framework for Sentiment-Aware Financial Relation Extraction
di: Luo, Jinming, et al.
Pubblicazione: (2025)
di: Luo, Jinming, et al.
Pubblicazione: (2025)
Mitigating Context-Memory Conflicts in LLMs through Dynamic Cognitive Reconciliation Decoding
di: Zhou, Yigeng, et al.
Pubblicazione: (2026)
di: Zhou, Yigeng, et al.
Pubblicazione: (2026)
Towards Transparent RAG: Fostering Evidence Traceability in LLM Generation via Reinforcement Learning
di: Ren, Jingyi, et al.
Pubblicazione: (2025)
di: Ren, Jingyi, et al.
Pubblicazione: (2025)
New Trends for Modern Machine Translation with Large Reasoning Models
di: Liu, Sinuo, et al.
Pubblicazione: (2025)
di: Liu, Sinuo, et al.
Pubblicazione: (2025)
FlexDuo: A Pluggable System for Enabling Full-Duplex Capabilities in Speech Dialogue Systems
di: Liao, Borui, et al.
Pubblicazione: (2025)
di: Liao, Borui, et al.
Pubblicazione: (2025)
FedMosaic: Federated Retrieval-Augmented Generation via Parametric Adapters
di: Liang, Zhilin, et al.
Pubblicazione: (2026)
di: Liang, Zhilin, et al.
Pubblicazione: (2026)
On the Hallucination in Simultaneous Machine Translation
di: Zhong, Meizhi, et al.
Pubblicazione: (2024)
di: Zhong, Meizhi, et al.
Pubblicazione: (2024)
Improving Attributed Text Generation of Large Language Models via Preference Learning
di: Li, Dongfang, et al.
Pubblicazione: (2024)
di: Li, Dongfang, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Exploring Large Language Models for Communication Games: An Empirical Study on Werewolf
di: Xu, Yuzhuang, et al.
Pubblicazione: (2023) -
OneBit: Towards Extremely Low-bit Large Language Models
di: Xu, Yuzhuang, et al.
Pubblicazione: (2024) -
Perspective Transition of Large Language Models for Solving Subjective Tasks
di: Wang, Xiaolong, et al.
Pubblicazione: (2025) -
Syntax-Aware Complex-Valued Neural Machine Translation
di: Liu, Yang, et al.
Pubblicazione: (2023) -
Enhancing Multilingual Capabilities of Large Language Models through Self-Distillation from Resource-Rich Languages
di: Zhang, Yuanchi, et al.
Pubblicazione: (2024)