E2S2: Encoding-Enhanced Sequence-to-Sequence Pretraining for Language Understanding and Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhong, Qihuang, Ding, Liang, Liu, Juhua, Du, Bo, Tao, Dacheng |
|---|---|
| Format: | Preprint |
| Publié: |
2022
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ROSE Doesn't Do That: Boosting the Safety of Instruction-Tuned Large Language Models with Reverse Prompt Contrastive Decoding
par: Zhong, Qihuang, et autres
Publié: (2024)
par: Zhong, Qihuang, et autres
Publié: (2024)
PANDA: Prompt Transfer Meets Knowledge Distillation for Efficient Model Adaptation
par: Zhong, Qihuang, et autres
Publié: (2022)
par: Zhong, Qihuang, et autres
Publié: (2022)
Revisiting Knowledge Distillation for Autoregressive Language Models
par: Zhong, Qihuang, et autres
Publié: (2024)
par: Zhong, Qihuang, et autres
Publié: (2024)
Learning from Imperfect Data: Towards Efficient Knowledge Distillation of Autoregressive Language Models for Text-to-SQL
par: Zhong, Qihuang, et autres
Publié: (2024)
par: Zhong, Qihuang, et autres
Publié: (2024)
Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning
par: Zhong, Qihuang, et autres
Publié: (2025)
par: Zhong, Qihuang, et autres
Publié: (2025)
KaFT: Knowledge-aware Fine-tuning for Boosting LLMs' Domain-specific Question-Answering Performance
par: Zhong, Qihuang, et autres
Publié: (2025)
par: Zhong, Qihuang, et autres
Publié: (2025)
Better, Faster: Harnessing Self-Improvement in Large Reasoning Models
par: Zhong, Qihuang, et autres
Publié: (2026)
par: Zhong, Qihuang, et autres
Publié: (2026)
Try, Check and Retry: A Divide-and-Conquer Framework for Boosting Long-context Tool-Calling Performance of LLMs
par: Chen, Kunfeng, et autres
Publié: (2026)
par: Chen, Kunfeng, et autres
Publié: (2026)
Iterative Data Generation with Large Language Models for Aspect-based Sentiment Analysis
par: Zhong, Qihuang, et autres
Publié: (2024)
par: Zhong, Qihuang, et autres
Publié: (2024)
Achieving >97% on GSM8K: Deeply Understanding the Problems Makes LLMs Better Solvers for Math Word Problems
par: Zhong, Qihuang, et autres
Publié: (2024)
par: Zhong, Qihuang, et autres
Publié: (2024)
ConRAG: Consensus-Driven Multi-View Retrieval for Multi-Hop Question Answering
par: Zhu, Yikai, et autres
Publié: (2026)
par: Zhu, Yikai, et autres
Publié: (2026)
Learn to Think: Improving Multimodal Reasoning through Vision-Aware Self-Improvement Training
par: Zhong, Qihuang, et autres
Publié: (2026)
par: Zhong, Qihuang, et autres
Publié: (2026)
LogicOCR: Do Your Large Multimodal Models Excel at Logical Reasoning on Text-Rich Images?
par: Ye, Maoyuan, et autres
Publié: (2025)
par: Ye, Maoyuan, et autres
Publié: (2025)
OOP: Object-Oriented Programming Evaluation Benchmark for Large Language Models
par: Wang, Shuai, et autres
Publié: (2024)
par: Wang, Shuai, et autres
Publié: (2024)
Entropy-Guided Watermarking for LLMs: A Test-Time Framework for Robust and Traceable Text Generation
par: Cai, Shizhan, et autres
Publié: (2025)
par: Cai, Shizhan, et autres
Publié: (2025)
Pretrained Generative Language Models as General Learning Frameworks for Sequence-Based Tasks
par: Fauber, Ben
Publié: (2024)
par: Fauber, Ben
Publié: (2024)
Exploring and Enhancing the Transfer of Distribution in Knowledge Distillation for Autoregressive Language Models
par: Rao, Jun, et autres
Publié: (2024)
par: Rao, Jun, et autres
Publié: (2024)
Improving Complex Reasoning over Knowledge Graph with Logic-Aware Curriculum Tuning
par: Xia, Tianle, et autres
Publié: (2024)
par: Xia, Tianle, et autres
Publié: (2024)
Learning Evaluation Models from Large Language Models for Sequence Generation
par: Wang, Chenglong, et autres
Publié: (2023)
par: Wang, Chenglong, et autres
Publié: (2023)
GenomeQA: Benchmarking General Large Language Models for Genome Sequence Understanding
par: Long, Weicai, et autres
Publié: (2026)
par: Long, Weicai, et autres
Publié: (2026)
Revisiting Catastrophic Forgetting in Large Language Model Tuning
par: Li, Hongyu, et autres
Publié: (2024)
par: Li, Hongyu, et autres
Publié: (2024)
R2T: Rule-Encoded Loss Functions for Low-Resource Sequence Tagging
par: Keita, Mamadou K., et autres
Publié: (2025)
par: Keita, Mamadou K., et autres
Publié: (2025)
Sequence Repetition Enhances Token Embeddings and Improves Sequence Labeling with Decoder-only Language Models
par: Kukić, Matija Luka, et autres
Publié: (2026)
par: Kukić, Matija Luka, et autres
Publié: (2026)
Rethink Sparse Signals for Pose-guided Text-to-image Generation
par: Xuan, Wenjie, et autres
Publié: (2025)
par: Xuan, Wenjie, et autres
Publié: (2025)
PrahokBART: A Pre-trained Sequence-to-Sequence Model for Khmer Natural Language Generation
par: Kaing, Hour, et autres
Publié: (2025)
par: Kaing, Hour, et autres
Publié: (2025)
Healthcare Copilot: Eliciting the Power of General LLMs for Medical Consultation
par: Ren, Zhiyao, et autres
Publié: (2024)
par: Ren, Zhiyao, et autres
Publié: (2024)
The Bitter Lesson of Diffusion Language Models for Agentic Workflows: A Comprehensive Reality Check
par: Lu, Qingyu, et autres
Publié: (2026)
par: Lu, Qingyu, et autres
Publié: (2026)
Enhancing RWKV-based Language Models for Long-Sequence Text Generation
par: Pan, Xinghan
Publié: (2025)
par: Pan, Xinghan
Publié: (2025)
Contextualized Sequence Likelihood: Enhanced Confidence Scores for Natural Language Generation
par: Lin, Zhen, et autres
Publié: (2024)
par: Lin, Zhen, et autres
Publié: (2024)
Encoding Agent Trajectories as Representations with Sequence Transformers
par: Tsiligkaridis, Athanasios, et autres
Publié: (2024)
par: Tsiligkaridis, Athanasios, et autres
Publié: (2024)
Enhancing Input-Label Mapping in In-Context Learning with Contrastive Decoding
par: Peng, Keqin, et autres
Publié: (2025)
par: Peng, Keqin, et autres
Publié: (2025)
Neural Sequence-to-Sequence Modeling with Attention by Leveraging Deep Learning Architectures for Enhanced Contextual Understanding in Abstractive Text Summarization
par: Challagundla, Bhavith Chandra, et autres
Publié: (2024)
par: Challagundla, Bhavith Chandra, et autres
Publié: (2024)
Reason-KE++: Aligning the Process, Not Just the Outcome, for Faithful LLM Knowledge Editing
par: Wu, Yuchen, et autres
Publié: (2025)
par: Wu, Yuchen, et autres
Publié: (2025)
Robust Knowledge Editing via Explicit Reasoning Chains for Distractor-Resilient Multi-Hop QA
par: Wu, Yuchen, et autres
Publié: (2025)
par: Wu, Yuchen, et autres
Publié: (2025)
Intention Analysis Makes LLMs A Good Jailbreak Defender
par: Zhang, Yuqi, et autres
Publié: (2024)
par: Zhang, Yuqi, et autres
Publié: (2024)
Uncertainty Aware Learning for Language Model Alignment
par: Wang, Yikun, et autres
Publié: (2024)
par: Wang, Yikun, et autres
Publié: (2024)
IT5: Text-to-text Pretraining for Italian Language Understanding and Generation
par: Sarti, Gabriele, et autres
Publié: (2022)
par: Sarti, Gabriele, et autres
Publié: (2022)
Code-Driven Inductive Synthesis: Enhancing Reasoning Abilities of Large Language Models with Sequences
par: Chen, Kedi, et autres
Publié: (2025)
par: Chen, Kedi, et autres
Publié: (2025)
Task Structure Reverses Layerwise State Encoding in Sequence Models
par: Jiang, Yuhang
Publié: (2026)
par: Jiang, Yuhang
Publié: (2026)
2D-TPE: Two-Dimensional Positional Encoding Enhances Table Understanding for Large Language Models
par: Li, Jia-Nan, et autres
Publié: (2024)
par: Li, Jia-Nan, et autres
Publié: (2024)
Documents similaires
-
ROSE Doesn't Do That: Boosting the Safety of Instruction-Tuned Large Language Models with Reverse Prompt Contrastive Decoding
par: Zhong, Qihuang, et autres
Publié: (2024) -
PANDA: Prompt Transfer Meets Knowledge Distillation for Efficient Model Adaptation
par: Zhong, Qihuang, et autres
Publié: (2022) -
Revisiting Knowledge Distillation for Autoregressive Language Models
par: Zhong, Qihuang, et autres
Publié: (2024) -
Learning from Imperfect Data: Towards Efficient Knowledge Distillation of Autoregressive Language Models for Text-to-SQL
par: Zhong, Qihuang, et autres
Publié: (2024) -
Resolving Knowledge Conflicts in Domain-specific Data Selection: A Case Study on Medical Instruction-tuning
par: Zhong, Qihuang, et autres
Publié: (2025)