Salvato in:
| Autori principali: | An, Hongjun, Chen, Yifan, Sun, Zhe, Li, Xuelong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2408.00655 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Physics in Next-token Prediction
di: An, Hongjun, et al.
Pubblicazione: (2024)
di: An, Hongjun, et al.
Pubblicazione: (2024)
Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference
di: Warner, Benjamin, et al.
Pubblicazione: (2024)
di: Warner, Benjamin, et al.
Pubblicazione: (2024)
Beyond the Sentence: A Survey on Context-Aware Machine Translation with Large Language Models
di: Appicharla, Ramakrishna, et al.
Pubblicazione: (2025)
di: Appicharla, Ramakrishna, et al.
Pubblicazione: (2025)
Predicting Sentence Acceptability Judgments in Multimodal Contexts
di: Jang, Hyewon, et al.
Pubblicazione: (2026)
di: Jang, Hyewon, et al.
Pubblicazione: (2026)
On the Relationship between Sentence Analogy Identification and Sentence Structure Encoding in Large Language Models
di: Wijesiriwardene, Thilini, et al.
Pubblicazione: (2023)
di: Wijesiriwardene, Thilini, et al.
Pubblicazione: (2023)
SpecFuse: Ensembling Large Language Models via Next-Segment Prediction
di: Lv, Bo, et al.
Pubblicazione: (2024)
di: Lv, Bo, et al.
Pubblicazione: (2024)
Jailbreak Instruction-Tuned LLMs via end-of-sentence MLP Re-weighting
di: Luo, Yifan, et al.
Pubblicazione: (2024)
di: Luo, Yifan, et al.
Pubblicazione: (2024)
Single-Pixel Vision-Language Model for Intrinsic Privacy-Preserving Behavioral Intelligence
di: An, Hongjun, et al.
Pubblicazione: (2026)
di: An, Hongjun, et al.
Pubblicazione: (2026)
Think in Sentences: Explicit Sentence Boundaries Enhance Language Model's Capabilities
di: Liu, Zhichen, et al.
Pubblicazione: (2026)
di: Liu, Zhichen, et al.
Pubblicazione: (2026)
EpMAN: Episodic Memory AttentioN for Generalizing to Longer Contexts
di: Chaudhury, Subhajit, et al.
Pubblicazione: (2025)
di: Chaudhury, Subhajit, et al.
Pubblicazione: (2025)
Moving Beyond Next-Token Prediction: Transformers are Context-Sensitive Language Generators
di: Rhee, Phill Kyu
Pubblicazione: (2025)
di: Rhee, Phill Kyu
Pubblicazione: (2025)
A Law of Next-Token Prediction in Large Language Models
di: He, Hangfeng, et al.
Pubblicazione: (2024)
di: He, Hangfeng, et al.
Pubblicazione: (2024)
Longer Context, Deeper Thinking: Uncovering the Role of Long-Context Ability in Reasoning
di: Yang, Wang, et al.
Pubblicazione: (2025)
di: Yang, Wang, et al.
Pubblicazione: (2025)
Information Capacity: Evaluating the Efficiency of Large Language Models via Text Compression
di: Yuan, Cheng, et al.
Pubblicazione: (2025)
di: Yuan, Cheng, et al.
Pubblicazione: (2025)
Silicon Bureaucracy and AI Test-Oriented Education: Contamination Sensitivity and Score Confidence in LLM Benchmarks
di: Song, Yiliang, et al.
Pubblicazione: (2026)
di: Song, Yiliang, et al.
Pubblicazione: (2026)
APE: Faster and Longer Context-Augmented Generation via Adaptive Parallel Encoding
di: Yang, Xinyu, et al.
Pubblicazione: (2025)
di: Yang, Xinyu, et al.
Pubblicazione: (2025)
SegNSP: Revisiting Next Sentence Prediction for Linear Text Segmentation
di: Isidro, José, et al.
Pubblicazione: (2026)
di: Isidro, José, et al.
Pubblicazione: (2026)
Do Influence Functions Work on Large Language Models?
di: Li, Zhe, et al.
Pubblicazione: (2024)
di: Li, Zhe, et al.
Pubblicazione: (2024)
Context-level Language Modeling by Learning Predictive Context Embeddings
di: Dai, Beiya, et al.
Pubblicazione: (2025)
di: Dai, Beiya, et al.
Pubblicazione: (2025)
You Only Fine-tune Once: Many-Shot In-Context Fine-Tuning for Large Language Models
di: He, Wenchong, et al.
Pubblicazione: (2025)
di: He, Wenchong, et al.
Pubblicazione: (2025)
On Speeding Up Language Model Evaluation
di: Zhou, Jin Peng, et al.
Pubblicazione: (2024)
di: Zhou, Jin Peng, et al.
Pubblicazione: (2024)
An In-depth Evaluation of Large Language Models in Sentence Simplification with Error-based Human Assessment
di: Wu, Xuanxin, et al.
Pubblicazione: (2024)
di: Wu, Xuanxin, et al.
Pubblicazione: (2024)
Contextual Refinement of Translations: Large Language Models for Sentence and Document-Level Post-Editing
di: Koneru, Sai, et al.
Pubblicazione: (2023)
di: Koneru, Sai, et al.
Pubblicazione: (2023)
Theoretical Foundations of Scaling Law in Familial Models
di: Song, Huan, et al.
Pubblicazione: (2025)
di: Song, Huan, et al.
Pubblicazione: (2025)
Timeline-based Sentence Decomposition with In-Context Learning for Temporal Fact Extraction
di: Chen, Jianhao, et al.
Pubblicazione: (2024)
di: Chen, Jianhao, et al.
Pubblicazione: (2024)
Contextual Clarity: Generating Sentences with Transformer Models using Context-Reverso Data
di: Musaev, Ruslan
Pubblicazione: (2024)
di: Musaev, Ruslan
Pubblicazione: (2024)
LangVAE and LangSpace: Building and Probing for Language Model VAEs
di: Carvalho, Danilo S., et al.
Pubblicazione: (2025)
di: Carvalho, Danilo S., et al.
Pubblicazione: (2025)
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
di: Shao, Chenze, et al.
Pubblicazione: (2024)
di: Shao, Chenze, et al.
Pubblicazione: (2024)
Unveiling Trust in Multimodal Large Language Models: Evaluation, Analysis, and Mitigation
di: Zhang, Yichi, et al.
Pubblicazione: (2025)
di: Zhang, Yichi, et al.
Pubblicazione: (2025)
A Comparative Study of Demonstration Selection for Practical Large Language Models-based Next POI Prediction
di: Nishida, Ryo, et al.
Pubblicazione: (2026)
di: Nishida, Ryo, et al.
Pubblicazione: (2026)
SQLong: Enhanced NL2SQL for Longer Contexts with LLMs
di: Nguyen, Dai Quoc, et al.
Pubblicazione: (2025)
di: Nguyen, Dai Quoc, et al.
Pubblicazione: (2025)
CreditAudit: 2$^\text{nd}$ Dimension for LLM Evaluation and Selection
di: Song, Yiliang, et al.
Pubblicazione: (2026)
di: Song, Yiliang, et al.
Pubblicazione: (2026)
AgentMD: Empowering Language Agents for Risk Prediction with Large-Scale Clinical Tool Learning
di: Jin, Qiao, et al.
Pubblicazione: (2024)
di: Jin, Qiao, et al.
Pubblicazione: (2024)
Next Concept Prediction in Discrete Latent Space Leads to Stronger Language Models
di: Liu, Yuliang, et al.
Pubblicazione: (2026)
di: Liu, Yuliang, et al.
Pubblicazione: (2026)
Memory Tokens: Large Language Models Can Generate Reversible Sentence Embeddings
di: Sastre, Ignacio, et al.
Pubblicazione: (2025)
di: Sastre, Ignacio, et al.
Pubblicazione: (2025)
Latent Reasoning via Sentence Embedding Prediction
di: Hwang, Hyeonbin, et al.
Pubblicazione: (2025)
di: Hwang, Hyeonbin, et al.
Pubblicazione: (2025)
VisionZip: Longer is Better but Not Necessary in Vision Language Models
di: Yang, Senqiao, et al.
Pubblicazione: (2024)
di: Yang, Senqiao, et al.
Pubblicazione: (2024)
Faster-GCG: Efficient Discrete Optimization Jailbreak Attacks against Aligned Large Language Models
di: Li, Xiao, et al.
Pubblicazione: (2024)
di: Li, Xiao, et al.
Pubblicazione: (2024)
MEXMA: Token-level objectives improve sentence representations
di: Janeiro, João Maria, et al.
Pubblicazione: (2024)
di: Janeiro, João Maria, et al.
Pubblicazione: (2024)
The Accuracy Paradox in RLHF: When Better Reward Models Don't Yield Better Language Models
di: Chen, Yanjun, et al.
Pubblicazione: (2024)
di: Chen, Yanjun, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Physics in Next-token Prediction
di: An, Hongjun, et al.
Pubblicazione: (2024) -
Smarter, Better, Faster, Longer: A Modern Bidirectional Encoder for Fast, Memory Efficient, and Long Context Finetuning and Inference
di: Warner, Benjamin, et al.
Pubblicazione: (2024) -
Beyond the Sentence: A Survey on Context-Aware Machine Translation with Large Language Models
di: Appicharla, Ramakrishna, et al.
Pubblicazione: (2025) -
Predicting Sentence Acceptability Judgments in Multimodal Contexts
di: Jang, Hyewon, et al.
Pubblicazione: (2026) -
On the Relationship between Sentence Analogy Identification and Sentence Structure Encoding in Large Language Models
di: Wijesiriwardene, Thilini, et al.
Pubblicazione: (2023)