A Survey on Long Text Modeling with Transformers
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Dong, Zican, Tang, Tianyi, Li, Junyi, Zhao, Wayne Xin |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2023
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
BAMBOO: A Comprehensive Benchmark for Evaluating Long Text Modeling Capacities of Large Language Models
von: Dong, Zican, et al.
Veröffentlicht: (2023)
von: Dong, Zican, et al.
Veröffentlicht: (2023)
LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation
von: Dong, Zican, et al.
Veröffentlicht: (2025)
von: Dong, Zican, et al.
Veröffentlicht: (2025)
ForesightKV: Optimizing KV Cache Eviction for Reasoning Models by Learning Long-Term Contribution
von: Dong, Zican, et al.
Veröffentlicht: (2026)
von: Dong, Zican, et al.
Veröffentlicht: (2026)
How Efficient Are Diffusion Language Models? A Critical Examination of Efficiency Evaluation Practices
von: Peng, Han, et al.
Veröffentlicht: (2025)
von: Peng, Han, et al.
Veröffentlicht: (2025)
Exploring Context Window of Large Language Models via Decomposed Positional Vectors
von: Dong, Zican, et al.
Veröffentlicht: (2024)
von: Dong, Zican, et al.
Veröffentlicht: (2024)
CAFE: Retrieval Head-based Coarse-to-Fine Information Seeking to Enhance Multi-Document QA Capability
von: Peng, Han, et al.
Veröffentlicht: (2025)
von: Peng, Han, et al.
Veröffentlicht: (2025)
A Survey of Large Language Models
von: Zhao, Wayne Xin, et al.
Veröffentlicht: (2023)
von: Zhao, Wayne Xin, et al.
Veröffentlicht: (2023)
Domain-Specific Pruning of Large Mixture-of-Experts Models with Few-shot Demonstrations
von: Dong, Zican, et al.
Veröffentlicht: (2025)
von: Dong, Zican, et al.
Veröffentlicht: (2025)
ChainLM: Empowering Large Language Models with Improved Chain-of-Thought Prompting
von: Cheng, Xiaoxue, et al.
Veröffentlicht: (2024)
von: Cheng, Xiaoxue, et al.
Veröffentlicht: (2024)
Think More, Hallucinate Less: Mitigating Hallucinations via Dual Process of Fast and Slow Thinking
von: Cheng, Xiaoxue, et al.
Veröffentlicht: (2025)
von: Cheng, Xiaoxue, et al.
Veröffentlicht: (2025)
Beyond Imitation: Leveraging Fine-grained Quality Signals for Alignment
von: Guo, Geyang, et al.
Veröffentlicht: (2023)
von: Guo, Geyang, et al.
Veröffentlicht: (2023)
LLMBox: A Comprehensive Library for Large Language Models
von: Tang, Tianyi, et al.
Veröffentlicht: (2024)
von: Tang, Tianyi, et al.
Veröffentlicht: (2024)
Neuron-based Personality Trait Induction in Large Language Models
von: Deng, Jia, et al.
Veröffentlicht: (2024)
von: Deng, Jia, et al.
Veröffentlicht: (2024)
Enhancing Cross-task Transfer of Large Language Models via Activation Steering
von: Tang, Xinyu, et al.
Veröffentlicht: (2025)
von: Tang, Xinyu, et al.
Veröffentlicht: (2025)
Incentivizing Dual Process Thinking for Efficient Large Language Model Reasoning
von: Cheng, Xiaoxue, et al.
Veröffentlicht: (2025)
von: Cheng, Xiaoxue, et al.
Veröffentlicht: (2025)
YuLan-Mini: An Open Data-efficient Language Model
von: Hu, Yiwen, et al.
Veröffentlicht: (2024)
von: Hu, Yiwen, et al.
Veröffentlicht: (2024)
Sticker-TTS: Learn to Utilize Historical Experience with a Sticker-driven Test-Time Scaling Framework
von: Chen, Jie, et al.
Veröffentlicht: (2025)
von: Chen, Jie, et al.
Veröffentlicht: (2025)
Language Models can Self-Lengthen to Generate Long Texts
von: Quan, Shanghaoran, et al.
Veröffentlicht: (2024)
von: Quan, Shanghaoran, et al.
Veröffentlicht: (2024)
ManuSearch: Democratizing Deep Search in Large Language Models with a Transparent and Open Multi-Agent Framework
von: Huang, Lisheng, et al.
Veröffentlicht: (2025)
von: Huang, Lisheng, et al.
Veröffentlicht: (2025)
Mix-CPT: A Domain Adaptation Framework via Decoupling Knowledge Learning and Format Alignment
von: Jiang, Jinhao, et al.
Veröffentlicht: (2024)
von: Jiang, Jinhao, et al.
Veröffentlicht: (2024)
Estimating the Error of Large Language Models at Pairwise Text Comparison
von: Li, Tianyi
Veröffentlicht: (2025)
von: Li, Tianyi
Veröffentlicht: (2025)
The Dawn After the Dark: An Empirical Study on Factuality Hallucination in Large Language Models
von: Li, Junyi, et al.
Veröffentlicht: (2024)
von: Li, Junyi, et al.
Veröffentlicht: (2024)
On The Role of Pretrained Language Models in General-Purpose Text Embeddings: A Survey
von: Zhang, Meishan, et al.
Veröffentlicht: (2025)
von: Zhang, Meishan, et al.
Veröffentlicht: (2025)
Think&Cite: Improving Attributed Text Generation with Self-Guided Tree Search and Progress Reward Modeling
von: Li, Junyi, et al.
Veröffentlicht: (2024)
von: Li, Junyi, et al.
Veröffentlicht: (2024)
Experience-Guided Reflective Co-Evolution of Prompts and Heuristics for Automatic Algorithm Design
von: Liu, Yihong, et al.
Veröffentlicht: (2025)
von: Liu, Yihong, et al.
Veröffentlicht: (2025)
Unlocking General Long Chain-of-Thought Reasoning Capabilities of Large Language Models via Representation Engineering
von: Tang, Xinyu, et al.
Veröffentlicht: (2025)
von: Tang, Xinyu, et al.
Veröffentlicht: (2025)
Towards Coarse-to-Fine Evaluation of Inference Efficiency for Large Language Models
von: Chen, Yushuo, et al.
Veröffentlicht: (2024)
von: Chen, Yushuo, et al.
Veröffentlicht: (2024)
MemLong: Memory-Augmented Retrieval for Long Text Modeling
von: Liu, Weijie, et al.
Veröffentlicht: (2024)
von: Liu, Weijie, et al.
Veröffentlicht: (2024)
Small Agent Can Also Rock! Empowering Small Language Models as Hallucination Detector
von: Cheng, Xiaoxue, et al.
Veröffentlicht: (2024)
von: Cheng, Xiaoxue, et al.
Veröffentlicht: (2024)
REAR: A Relevance-Aware Retrieval-Augmented Framework for Open-Domain Question Answering
von: Wang, Yuhao, et al.
Veröffentlicht: (2024)
von: Wang, Yuhao, et al.
Veröffentlicht: (2024)
Unleashing the Potential of Large Language Models as Prompt Optimizers: Analogical Analysis with Gradient-based Model Optimizers
von: Tang, Xinyu, et al.
Veröffentlicht: (2024)
von: Tang, Xinyu, et al.
Veröffentlicht: (2024)
A Survey on Employing Large Language Models for Text-to-SQL Tasks
von: Shi, Liang, et al.
Veröffentlicht: (2024)
von: Shi, Liang, et al.
Veröffentlicht: (2024)
Not All Metrics Are Guilty: Improving NLG Evaluation by Diversifying References
von: Tang, Tianyi, et al.
Veröffentlicht: (2023)
von: Tang, Tianyi, et al.
Veröffentlicht: (2023)
Sentiment-Aware Extractive and Abstractive Summarization for Unstructured Text Mining
von: Liu, Junyi, et al.
Veröffentlicht: (2025)
von: Liu, Junyi, et al.
Veröffentlicht: (2025)
Entropy-Guided Token Dropout: Training Autoregressive Language Models with Limited Domain Data
von: Wang, Jiapeng, et al.
Veröffentlicht: (2025)
von: Wang, Jiapeng, et al.
Veröffentlicht: (2025)
Search-Based Interaction For Conversation Recommendation via Generative Reward Model Based Simulated User
von: Wang, Xiaolei, et al.
Veröffentlicht: (2025)
von: Wang, Xiaolei, et al.
Veröffentlicht: (2025)
DAWN-ICL: Strategic Planning of Problem-solving Trajectories for Zero-Shot In-Context Learning
von: Tang, Xinyu, et al.
Veröffentlicht: (2024)
von: Tang, Xinyu, et al.
Veröffentlicht: (2024)
LongAlign: A Recipe for Long Context Alignment of Large Language Models
von: Bai, Yushi, et al.
Veröffentlicht: (2024)
von: Bai, Yushi, et al.
Veröffentlicht: (2024)
mGTE: Generalized Long-Context Text Representation and Reranking Models for Multilingual Text Retrieval
von: Zhang, Xin, et al.
Veröffentlicht: (2024)
von: Zhang, Xin, et al.
Veröffentlicht: (2024)
A Survey on Large Language Model based Autonomous Agents
von: Wang, Lei, et al.
Veröffentlicht: (2023)
von: Wang, Lei, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
BAMBOO: A Comprehensive Benchmark for Evaluating Long Text Modeling Capacities of Large Language Models
von: Dong, Zican, et al.
Veröffentlicht: (2023) -
LongReD: Mitigating Short-Text Degradation of Long-Context Large Language Models via Restoration Distillation
von: Dong, Zican, et al.
Veröffentlicht: (2025) -
ForesightKV: Optimizing KV Cache Eviction for Reasoning Models by Learning Long-Term Contribution
von: Dong, Zican, et al.
Veröffentlicht: (2026) -
How Efficient Are Diffusion Language Models? A Critical Examination of Efficiency Evaluation Practices
von: Peng, Han, et al.
Veröffentlicht: (2025) -
Exploring Context Window of Large Language Models via Decomposed Positional Vectors
von: Dong, Zican, et al.
Veröffentlicht: (2024)