SentenceVAE: Enable Next-sentence Prediction for Large Language Models with Faster Speed, Higher Accuracy and Longer Context
Fuente:
arXiv
Guardado en:
| Autores principales: | An, Hongjun, Chen, Yifan, Sun, Zhe, Li, Xuelong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Physics in Next-token Prediction
por: An, Hongjun, et al.
Publicado: (2024)
por: An, Hongjun, et al.
Publicado: (2024)
Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference
por: Warner, Benjamin, et al.
Publicado: (2024)
por: Warner, Benjamin, et al.
Publicado: (2024)
Beyond the Sentence: A Survey on Context-Aware Machine Translation with Large Language Models
por: Appicharla, Ramakrishna, et al.
Publicado: (2025)
por: Appicharla, Ramakrishna, et al.
Publicado: (2025)
Predicting Sentence Acceptability Judgments in Multimodal Contexts
por: Jang, Hyewon, et al.
Publicado: (2026)
por: Jang, Hyewon, et al.
Publicado: (2026)
On the Relationship between Sentence Analogy Identification and Sentence Structure Encoding in Large Language Models
por: Wijesiriwardene, Thilini, et al.
Publicado: (2023)
por: Wijesiriwardene, Thilini, et al.
Publicado: (2023)
SpecFuse: Ensembling Large Language Models via Next-Segment Prediction
por: Lv, Bo, et al.
Publicado: (2024)
por: Lv, Bo, et al.
Publicado: (2024)
Jailbreak Instruction-Tuned LLMs via end-of-sentence MLP Re-weighting
por: Luo, Yifan, et al.
Publicado: (2024)
por: Luo, Yifan, et al.
Publicado: (2024)
Think in Sentences: Explicit Sentence Boundaries Enhance Language Model's Capabilities
por: Liu, Zhichen, et al.
Publicado: (2026)
por: Liu, Zhichen, et al.
Publicado: (2026)
EpMAN: Episodic Memory AttentioN for Generalizing to Longer Contexts
por: Chaudhury, Subhajit, et al.
Publicado: (2025)
por: Chaudhury, Subhajit, et al.
Publicado: (2025)
Moving Beyond Next-Token Prediction: Transformers are Context-Sensitive Language Generators
por: Rhee, Phill Kyu
Publicado: (2025)
por: Rhee, Phill Kyu
Publicado: (2025)
A Law of Next-Token Prediction in Large Language Models
por: He, Hangfeng, et al.
Publicado: (2024)
por: He, Hangfeng, et al.
Publicado: (2024)
Longer Context, Deeper Thinking: Uncovering the Role of Long-Context Ability in Reasoning
por: Yang, Wang, et al.
Publicado: (2025)
por: Yang, Wang, et al.
Publicado: (2025)
Single-Pixel Vision-Language Model for Intrinsic Privacy-Preserving Behavioral Intelligence
por: An, Hongjun, et al.
Publicado: (2026)
por: An, Hongjun, et al.
Publicado: (2026)
Context-level Language Modeling by Learning Predictive Context Embeddings
por: Dai, Beiya, et al.
Publicado: (2025)
por: Dai, Beiya, et al.
Publicado: (2025)
APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding
por: Yang, Xinyu, et al.
Publicado: (2025)
por: Yang, Xinyu, et al.
Publicado: (2025)
An In-depth Evaluation of Large Language Models in Sentence Simplification with Error-based Human Assessment
por: Wu, Xuanxin, et al.
Publicado: (2024)
por: Wu, Xuanxin, et al.
Publicado: (2024)
Contextual Refinement of Translations: Large Language Models for Sentence and Document-Level Post-Editing
por: Koneru, Sai, et al.
Publicado: (2023)
por: Koneru, Sai, et al.
Publicado: (2023)
On Speeding Up Language Model Evaluation
por: Zhou, Jin Peng, et al.
Publicado: (2024)
por: Zhou, Jin Peng, et al.
Publicado: (2024)
You Only Fine-tune Once: Many-Shot In-Context Fine-Tuning for Large Language Models
por: He, Wenchong, et al.
Publicado: (2025)
por: He, Wenchong, et al.
Publicado: (2025)
Do Influence Functions Work on Large Language Models?
por: Li, Zhe, et al.
Publicado: (2024)
por: Li, Zhe, et al.
Publicado: (2024)
Information Capacity: Evaluating the Efficiency of Large Language Models via Text Compression
por: Yuan, Cheng, et al.
Publicado: (2025)
por: Yuan, Cheng, et al.
Publicado: (2025)
Timeline-based Sentence Decomposition with In-Context Learning for Temporal Fact Extraction
por: Chen, Jianhao, et al.
Publicado: (2024)
por: Chen, Jianhao, et al.
Publicado: (2024)
Contextual Clarity: Generating Sentences with Transformer Models using Context-Reverso Data
por: Musaev, Ruslan
Publicado: (2024)
por: Musaev, Ruslan
Publicado: (2024)
LangVAE and LangSpace: Building and Probing for Language Model VAEs
por: Carvalho, Danilo S., et al.
Publicado: (2025)
por: Carvalho, Danilo S., et al.
Publicado: (2025)
A Comparative Study of Demonstration Selection for Practical Large Language Models-based Next POI Prediction
por: Nishida, Ryo, et al.
Publicado: (2026)
por: Nishida, Ryo, et al.
Publicado: (2026)
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
por: Shao, Chenze, et al.
Publicado: (2024)
por: Shao, Chenze, et al.
Publicado: (2024)
Next Concept Prediction in Discrete Latent Space Leads to Stronger Language Models
por: Liu, Yuliang, et al.
Publicado: (2026)
por: Liu, Yuliang, et al.
Publicado: (2026)
SegNSP: Revisiting Next Sentence Prediction for Linear Text Segmentation
por: Isidro, José, et al.
Publicado: (2026)
por: Isidro, José, et al.
Publicado: (2026)
Silicon Bureaucracy and AI Test-Oriented Education: Contamination Sensitivity and Score Confidence in LLM Benchmarks
por: Song, Yiliang, et al.
Publicado: (2026)
por: Song, Yiliang, et al.
Publicado: (2026)
Unveiling Trust in Multimodal Large Language Models: Evaluation, Analysis, and Mitigation
por: Zhang, Yichi, et al.
Publicado: (2025)
por: Zhang, Yichi, et al.
Publicado: (2025)
AgentMD: Empowering Language Agents for Risk Prediction with Large-Scale Clinical Tool Learning
por: Jin, Qiao, et al.
Publicado: (2024)
por: Jin, Qiao, et al.
Publicado: (2024)
Latent Reasoning via Sentence Embedding Prediction
por: Hwang, Hyeonbin, et al.
Publicado: (2025)
por: Hwang, Hyeonbin, et al.
Publicado: (2025)
The Accuracy Paradox in RLHF: When Better Reward Models Don't Yield Better Language Models
por: Chen, Yanjun, et al.
Publicado: (2024)
por: Chen, Yanjun, et al.
Publicado: (2024)
Memory Tokens: Large Language Models Can Generate Reversible Sentence Embeddings
por: Sastre, Ignacio, et al.
Publicado: (2025)
por: Sastre, Ignacio, et al.
Publicado: (2025)
Speed and Conversational Large Language Models: Not All Is About Tokens per Second
por: Conde, Javier, et al.
Publicado: (2025)
por: Conde, Javier, et al.
Publicado: (2025)
Beyond Accuracy: The Role of Calibration in Self-Improving Large Language Models
por: Huang, Liangjie, et al.
Publicado: (2025)
por: Huang, Liangjie, et al.
Publicado: (2025)
CASE-Bench: Context-Aware SafEty Benchmark for Large Language Models
por: Sun, Guangzhi, et al.
Publicado: (2025)
por: Sun, Guangzhi, et al.
Publicado: (2025)
CRANE: Causal Relevance Analysis of Language-Specific Neurons in Multilingual Large Language Models
por: Le, Yifan, et al.
Publicado: (2026)
por: Le, Yifan, et al.
Publicado: (2026)
Near-Lossless Model Compression Enables Longer Context Inference in DNA Large Language Models
por: Zhu, Rui, et al.
Publicado: (2025)
por: Zhu, Rui, et al.
Publicado: (2025)
Large Language Models are In-Context Molecule Learners
por: Li, Jiatong, et al.
Publicado: (2024)
por: Li, Jiatong, et al.
Publicado: (2024)
Ejemplares similares
-
Physics in Next-token Prediction
por: An, Hongjun, et al.
Publicado: (2024) -
Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference
por: Warner, Benjamin, et al.
Publicado: (2024) -
Beyond the Sentence: A Survey on Context-Aware Machine Translation with Large Language Models
por: Appicharla, Ramakrishna, et al.
Publicado: (2025) -
Predicting Sentence Acceptability Judgments in Multimodal Contexts
por: Jang, Hyewon, et al.
Publicado: (2026) -
On the Relationship between Sentence Analogy Identification and Sentence Structure Encoding in Large Language Models
por: Wijesiriwardene, Thilini, et al.
Publicado: (2023)