TEAL: Tokenize and Embed ALL for Multi-modal Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yang, Zhen, Zhang, Yingxue, Meng, Fandong, Zhou, Jie |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
par: Shao, Chenze, et autres
Publié: (2024)
par: Shao, Chenze, et autres
Publié: (2024)
Retrieval-Augmented Machine Translation with Unstructured Knowledge
par: Wang, Jiaan, et autres
Publié: (2024)
par: Wang, Jiaan, et autres
Publié: (2024)
EAG: Extract and Generate Multi-way Aligned Corpus for Complete Multi-lingual Neural Machine Translation
par: Xu, Yulin, et autres
Publié: (2022)
par: Xu, Yulin, et autres
Publié: (2022)
LLaVE: Large Language and Vision Embedding Models with Hardness-Weighted Contrastive Learning
par: Lan, Zhibin, et autres
Publié: (2025)
par: Lan, Zhibin, et autres
Publié: (2025)
TasTe: Teaching Large Language Models to Translate through Self-Reflection
par: Wang, Yutong, et autres
Publié: (2024)
par: Wang, Yutong, et autres
Publié: (2024)
Continuous Autoregressive Language Models
par: Shao, Chenze, et autres
Publié: (2025)
par: Shao, Chenze, et autres
Publié: (2025)
CSCD-NS: a Chinese Spelling Check Dataset for Native Speakers
par: Hu, Yong, et autres
Publié: (2022)
par: Hu, Yong, et autres
Publié: (2022)
DeepTrans: Deep Reasoning Translation via Reinforcement Learning
par: Wang, Jiaan, et autres
Publié: (2025)
par: Wang, Jiaan, et autres
Publié: (2025)
ExTrans: Multilingual Deep Reasoning Translation via Exemplar-Enhanced Reinforcement Learning
par: Wang, Jiaan, et autres
Publié: (2025)
par: Wang, Jiaan, et autres
Publié: (2025)
An Empirical Study of Many-to-Many Summarization with Large Language Models
par: Wang, Jiaan, et autres
Publié: (2025)
par: Wang, Jiaan, et autres
Publié: (2025)
A Dual-Space Framework for General Knowledge Distillation of Large Language Models
par: Zhang, Xue, et autres
Publié: (2025)
par: Zhang, Xue, et autres
Publié: (2025)
CRAT: A Multi-Agent Framework for Causality-Enhanced Reflective and Retrieval-Augmented Translation with Large Language Models
par: Chen, Meiqi, et autres
Publié: (2024)
par: Chen, Meiqi, et autres
Publié: (2024)
On Prompt-Driven Safeguarding for Large Language Models
par: Zheng, Chujie, et autres
Publié: (2024)
par: Zheng, Chujie, et autres
Publié: (2024)
Cross-Lingual Knowledge Editing in Large Language Models
par: Wang, Jiaan, et autres
Publié: (2023)
par: Wang, Jiaan, et autres
Publié: (2023)
Unsupervised Information Refinement Training of Large Language Models for Retrieval-Augmented Generation
par: Xu, Shicheng, et autres
Publié: (2024)
par: Xu, Shicheng, et autres
Publié: (2024)
DRT: Deep Reasoning Translation via Long Chain-of-Thought
par: Wang, Jiaan, et autres
Publié: (2024)
par: Wang, Jiaan, et autres
Publié: (2024)
Translatotron-V(ison): An End-to-End Model for In-Image Machine Translation
par: Lan, Zhibin, et autres
Publié: (2024)
par: Lan, Zhibin, et autres
Publié: (2024)
LCS: A Language Converter Strategy for Zero-Shot Neural Machine Translation
par: Sun, Zengkui, et autres
Publié: (2024)
par: Sun, Zengkui, et autres
Publié: (2024)
HGMEM: Hypergraph-based Working Memory to Improve Multi-step RAG for Long-Context Complex Relational Modeling
par: Zhou, Chulun, et autres
Publié: (2025)
par: Zhou, Chulun, et autres
Publié: (2025)
DeepRAG: Thinking to Retrieve Step by Step for Large Language Models
par: Guan, Xinyan, et autres
Publié: (2025)
par: Guan, Xinyan, et autres
Publié: (2025)
AVG-LLaVA: An Efficient Large Multimodal Model with Adaptive Visual Granularity
par: Lan, Zhibin, et autres
Publié: (2024)
par: Lan, Zhibin, et autres
Publié: (2024)
DelTA: An Online Document-Level Translation Agent Based on Multi-Level Memory
par: Wang, Yutong, et autres
Publié: (2024)
par: Wang, Yutong, et autres
Publié: (2024)
General learned delegation by clones
par: Li, Darren, et autres
Publié: (2026)
par: Li, Darren, et autres
Publié: (2026)
Hybrid-Level Instruction Injection for Video Token Compression in Multi-modal Large Language Models
par: Liu, Zhihang, et autres
Publié: (2025)
par: Liu, Zhihang, et autres
Publié: (2025)
Compressing Sequences in the Latent Embedding Space: $K$-Token Merging for Large Language Models
par: Xu, Zihao, et autres
Publié: (2026)
par: Xu, Zihao, et autres
Publié: (2026)
Tokenization Matters! Degrading Large Language Models through Challenging Their Tokenization
par: Wang, Dixuan, et autres
Publié: (2024)
par: Wang, Dixuan, et autres
Publié: (2024)
AlignGPT: Multi-modal Large Language Models with Adaptive Alignment Capability
par: Zhao, Fei, et autres
Publié: (2024)
par: Zhao, Fei, et autres
Publié: (2024)
Speed and Conversational Large Language Models: Not All Is About Tokens per Second
par: Conde, Javier, et autres
Publié: (2025)
par: Conde, Javier, et autres
Publié: (2025)
Hijacking Context in Large Multi-modal Models
par: Jeong, Joonhyun
Publié: (2023)
par: Jeong, Joonhyun
Publié: (2023)
CORBA: Contagious Recursive Blocking Attacks on Multi-Agent Systems Based on Large Language Models
par: Zhou, Zhenhong, et autres
Publié: (2025)
par: Zhou, Zhenhong, et autres
Publié: (2025)
Counting Ability of Large Language Models and Impact of Tokenization
par: Zhang, Xiang, et autres
Publié: (2024)
par: Zhang, Xiang, et autres
Publié: (2024)
SuperPos-Prompt: Enhancing Soft Prompt Tuning of Language Models with Superposition of Multi Token Embeddings
par: SadraeiJavaeri, MohammadAli, et autres
Publié: (2024)
par: SadraeiJavaeri, MohammadAli, et autres
Publié: (2024)
On the token distance modeling ability of higher RoPE attention dimension
par: Hong, Xiangyu, et autres
Publié: (2024)
par: Hong, Xiangyu, et autres
Publié: (2024)
Memory Tokens: Large Language Models Can Generate Reversible Sentence Embeddings
par: Sastre, Ignacio, et autres
Publié: (2025)
par: Sastre, Ignacio, et autres
Publié: (2025)
GlitchProber: Advancing Effective Detection and Mitigation of Glitch Tokens in Large Language Models
par: Zhang, Zhibo, et autres
Publié: (2024)
par: Zhang, Zhibo, et autres
Publié: (2024)
MathGLM-Vision: Solving Mathematical Problems with Multi-Modal Large Language Model
par: Yang, Zhen, et autres
Publié: (2024)
par: Yang, Zhen, et autres
Publié: (2024)
VisScience: An Extensive Benchmark for Evaluating K12 Educational Multi-modal Scientific Reasoning
par: Jiang, Zhihuan, et autres
Publié: (2024)
par: Jiang, Zhihuan, et autres
Publié: (2024)
Persona-judge: Personalized Alignment of Large Language Models via Token-level Self-judgment
par: Zhang, Xiaotian, et autres
Publié: (2025)
par: Zhang, Xiaotian, et autres
Publié: (2025)
Outdated Issue Aware Decoding for Reasoning Questions on Edited Knowledge
par: Sun, Zengkui, et autres
Publié: (2024)
par: Sun, Zengkui, et autres
Publié: (2024)
Memory Retrieval and Consolidation in Large Language Models through Function Tokens
par: Zhang, Shaohua, et autres
Publié: (2025)
par: Zhang, Shaohua, et autres
Publié: (2025)
Documents similaires
-
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
par: Shao, Chenze, et autres
Publié: (2024) -
Retrieval-Augmented Machine Translation with Unstructured Knowledge
par: Wang, Jiaan, et autres
Publié: (2024) -
EAG: Extract and Generate Multi-way Aligned Corpus for Complete Multi-lingual Neural Machine Translation
par: Xu, Yulin, et autres
Publié: (2022) -
LLaVE: Large Language and Vision Embedding Models with Hardness-Weighted Contrastive Learning
par: Lan, Zhibin, et autres
Publié: (2025) -
TasTe: Teaching Large Language Models to Translate through Self-Reflection
par: Wang, Yutong, et autres
Publié: (2024)