F-MALLOC: Feed-forward Memory Allocation for Continual Learning in Neural Machine Translation
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Junhong, Liu, Yuchen, Zong, Chengqing |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Self-Modifying State Modeling for Simultaneous Machine Translation
por: Yu, Donglei, et al.
Publicado: (2024)
por: Yu, Donglei, et al.
Publicado: (2024)
Boosting LLM Translation Skills without General Ability Loss via Rationale Distillation
por: Wu, Junhong, et al.
Publicado: (2024)
por: Wu, Junhong, et al.
Publicado: (2024)
BLSP: Bootstrapping Language-Speech Pre-training via Behavior Alignment of Continuation Writing
por: Wang, Chen, et al.
Publicado: (2023)
por: Wang, Chen, et al.
Publicado: (2023)
Language Imbalance Driven Rewarding for Multilingual Self-improving
por: Yang, Wen, et al.
Publicado: (2024)
por: Yang, Wen, et al.
Publicado: (2024)
Parallel Scaling Law: Unveiling Reasoning Generalization through A Cross-Linguistic Perspective
por: Yang, Wen, et al.
Publicado: (2025)
por: Yang, Wen, et al.
Publicado: (2025)
Implicit Cross-Lingual Rewarding for Efficient Multilingual Preference Alignment
por: Yang, Wen, et al.
Publicado: (2025)
por: Yang, Wen, et al.
Publicado: (2025)
SimulPL: Aligning Human Preferences in Simultaneous Machine Translation
por: Yu, Donglei, et al.
Publicado: (2025)
por: Yu, Donglei, et al.
Publicado: (2025)
BLSP-Emo: Towards Empathetic Large Speech-Language Models
por: Wang, Chen, et al.
Publicado: (2024)
por: Wang, Chen, et al.
Publicado: (2024)
Self-generated Replay Memories for Continual Neural Machine Translation
por: Resta, Michele, et al.
Publicado: (2024)
por: Resta, Michele, et al.
Publicado: (2024)
TokAlign: Efficient Vocabulary Adaptation via Token Alignment
por: Li, Chong, et al.
Publicado: (2025)
por: Li, Chong, et al.
Publicado: (2025)
Improving In-context Learning of Multilingual Generative Language Models with Cross-lingual Alignment
por: Li, Chong, et al.
Publicado: (2023)
por: Li, Chong, et al.
Publicado: (2023)
Single-to-mix Modality Alignment with Multimodal Large Language Model for Document Image Machine Translation
por: Liang, Yupu, et al.
Publicado: (2025)
por: Liang, Yupu, et al.
Publicado: (2025)
Empirical Study on Updating Key-Value Memories in Transformer Feed-forward Layers
por: Qiu, Zihan, et al.
Publicado: (2024)
por: Qiu, Zihan, et al.
Publicado: (2024)
Pluggable Neural Machine Translation Models via Memory-augmented Adapters
por: Xu, Yuzhuang, et al.
Publicado: (2023)
por: Xu, Yuzhuang, et al.
Publicado: (2023)
Decoding the Multimodal Mind: Generalizable Brain-to-Text Translation via Multimodal Alignment and Adaptive Routing
por: Ye, Chunyu, et al.
Publicado: (2025)
por: Ye, Chunyu, et al.
Publicado: (2025)
Navigating Brain Language Representations: A Comparative Analysis of Neural Language Models and Psychologically Plausible Models
por: Zhang, Yunhao, et al.
Publicado: (2024)
por: Zhang, Yunhao, et al.
Publicado: (2024)
Improving MLLM's Document Image Machine Translation via Synchronously Self-reviewing Its OCR Proficiency
por: Liang, Yupu, et al.
Publicado: (2025)
por: Liang, Yupu, et al.
Publicado: (2025)
SweetieChat: A Strategy-Enhanced Role-playing Framework for Diverse Scenarios Handling Emotional Support Agent
por: Ye, Jing, et al.
Publicado: (2024)
por: Ye, Jing, et al.
Publicado: (2024)
A Survey of Large Language Models in Discipline-specific Research: Challenges, Methods and Opportunities
por: Xiang, Lu, et al.
Publicado: (2025)
por: Xiang, Lu, et al.
Publicado: (2025)
From Generic Empathy to Personalized Emotional Support: A Self-Evolution Framework for User Preference Alignment
por: Ye, Jing, et al.
Publicado: (2025)
por: Ye, Jing, et al.
Publicado: (2025)
HTAM: Hierarchical Transition-Attended Memory for Operator Optimization
por: Zhang, Yining, et al.
Publicado: (2026)
por: Zhang, Yining, et al.
Publicado: (2026)
EmoHarbor: Evaluating Personalized Emotional Support by Simulating the User's Internal World
por: Ye, Jing, et al.
Publicado: (2026)
por: Ye, Jing, et al.
Publicado: (2026)
Rethinking Targeted Adversarial Attacks For Neural Machine Translation
por: Wu, Junjie, et al.
Publicado: (2024)
por: Wu, Junjie, et al.
Publicado: (2024)
MapGuide: A Simple yet Effective Method to Reconstruct Continuous Language from Brain Activities
por: Zhao, Xinpei, et al.
Publicado: (2024)
por: Zhao, Xinpei, et al.
Publicado: (2024)
Group then Scale: Dynamic Mixture-of-Experts Multilingual Language Model
por: Li, Chong, et al.
Publicado: (2025)
por: Li, Chong, et al.
Publicado: (2025)
Efficient Continual Learning in Neural Machine Translation: A Low-Rank Adaptation Approach
por: Carrión, Salvador, et al.
Publicado: (2025)
por: Carrión, Salvador, et al.
Publicado: (2025)
Memory Reviving, Continuing Learning and Beyond: Evaluation of Pre-trained Encoders and Decoders for Multimodal Machine Translation
por: Yu, Zhuang, et al.
Publicado: (2025)
por: Yu, Zhuang, et al.
Publicado: (2025)
MulCogBench: A Multi-modal Cognitive Benchmark Dataset for Evaluating Chinese and English Computational Language Models
por: Zhang, Yunhao, et al.
Publicado: (2024)
por: Zhang, Yunhao, et al.
Publicado: (2024)
TokAlign++: Advancing Vocabulary Adaptation via Better Token Alignment
por: Li, Chong, et al.
Publicado: (2026)
por: Li, Chong, et al.
Publicado: (2026)
Retrieving Examples from Memory for Retrieval Augmented Neural Machine Translation: A Systematic Comparison
por: Bouthors, Maxime, et al.
Publicado: (2024)
por: Bouthors, Maxime, et al.
Publicado: (2024)
Syntax-Aware Complex-Valued Neural Machine Translation
por: Liu, Yang, et al.
Publicado: (2023)
por: Liu, Yang, et al.
Publicado: (2023)
On the Shortcut Learning in Multilingual Neural Machine Translation
por: Wang, Wenxuan, et al.
Publicado: (2024)
por: Wang, Wenxuan, et al.
Publicado: (2024)
Deterministic Reversible Data Augmentation for Neural Machine Translation
por: Yao, Jiashu, et al.
Publicado: (2024)
por: Yao, Jiashu, et al.
Publicado: (2024)
Listen, Correct, and Feed Back: Spoken Pedagogical Feedback Generation
por: Liang, Junhong, et al.
Publicado: (2026)
por: Liang, Junhong, et al.
Publicado: (2026)
Leveraging Diverse Modeling Contexts with Collaborating Learning for Neural Machine Translation
por: Liao, Yusheng, et al.
Publicado: (2024)
por: Liao, Yusheng, et al.
Publicado: (2024)
Reinforcement Learning for Edit-Based Non-Autoregressive Neural Machine Translation
por: Wang, Hao, et al.
Publicado: (2024)
por: Wang, Hao, et al.
Publicado: (2024)
The Unreasonable Effectiveness of Random Target Embeddings for Continuous-Output Neural Machine Translation
por: Tokarchuk, Evgeniia, et al.
Publicado: (2023)
por: Tokarchuk, Evgeniia, et al.
Publicado: (2023)
The Box is in the Pen: Evaluating Commonsense Reasoning in Neural Machine Translation
por: He, Jie, et al.
Publicado: (2025)
por: He, Jie, et al.
Publicado: (2025)
Discovering Semantic Subdimensions through Disentangled Conceptual Representations
por: Zhang, Yunhao, et al.
Publicado: (2025)
por: Zhang, Yunhao, et al.
Publicado: (2025)
TROVE: A Challenge for Fine-Grained Text Provenance via Source Sentence Tracing and Relationship Classification
por: Zhu, Junnan, et al.
Publicado: (2025)
por: Zhu, Junnan, et al.
Publicado: (2025)
Ejemplares similares
-
Self-Modifying State Modeling for Simultaneous Machine Translation
por: Yu, Donglei, et al.
Publicado: (2024) -
Boosting LLM Translation Skills without General Ability Loss via Rationale Distillation
por: Wu, Junhong, et al.
Publicado: (2024) -
BLSP: Bootstrapping Language-Speech Pre-training via Behavior Alignment of Continuation Writing
por: Wang, Chen, et al.
Publicado: (2023) -
Language Imbalance Driven Rewarding for Multilingual Self-improving
por: Yang, Wen, et al.
Publicado: (2024) -
Parallel Scaling Law: Unveiling Reasoning Generalization through A Cross-Linguistic Perspective
por: Yang, Wen, et al.
Publicado: (2025)