LongRecipe: Recipe for Efficient Long Context Generalization in Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Hu, Zhiyuan, Liu, Yuliang, Zhao, Jinman, Wang, Suyuchen, Wang, Yan, Shen, Wei, Gu, Qing, Luu, Anh Tuan, Ng, See-Kiong, Jiang, Zhiwei, Hooi, Bryan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Temporal-Oriented Recipe for Transferring Large Vision-Language Model to Video Understanding
von: Nguyen, Thong, et al.
Veröffentlicht: (2025)
von: Nguyen, Thong, et al.
Veröffentlicht: (2025)
Guiding VLM Agents with Process Rewards at Inference Time for GUI Navigation
von: Hu, Zhiyuan, et al.
Veröffentlicht: (2025)
von: Hu, Zhiyuan, et al.
Veröffentlicht: (2025)
Encoding and Controlling Global Semantics for Long-form Video Question Answering
von: Nguyen, Thong Thanh, et al.
Veröffentlicht: (2024)
von: Nguyen, Thong Thanh, et al.
Veröffentlicht: (2024)
Uncertainty of Thoughts: Uncertainty-Aware Planning Enhances Information Seeking in Large Language Models
von: Hu, Zhiyuan, et al.
Veröffentlicht: (2024)
von: Hu, Zhiyuan, et al.
Veröffentlicht: (2024)
How Does Response Length Affect Long-Form Factuality
von: Zhao, James Xu, et al.
Veröffentlicht: (2025)
von: Zhao, James Xu, et al.
Veröffentlicht: (2025)
Test-Time Scaling in Reasoning Models Is Not Effective for Knowledge-Intensive Tasks Yet
von: Zhao, James Xu, et al.
Veröffentlicht: (2025)
von: Zhao, James Xu, et al.
Veröffentlicht: (2025)
Mercury: A Code Efficiency Benchmark for Code Large Language Models
von: Du, Mingzhe, et al.
Veröffentlicht: (2024)
von: Du, Mingzhe, et al.
Veröffentlicht: (2024)
Rewarding the Rare: Uniqueness-Aware RL for Creative Problem Solving in LLMs
von: Hu, Zhiyuan, et al.
Veröffentlicht: (2026)
von: Hu, Zhiyuan, et al.
Veröffentlicht: (2026)
LongAlign: A Recipe for Long Context Alignment of Large Language Models
von: Bai, Yushi, et al.
Veröffentlicht: (2024)
von: Bai, Yushi, et al.
Veröffentlicht: (2024)
LongSkywork: A Training Recipe for Efficiently Extending Context Length in Large Language Models
von: Zhao, Liang, et al.
Veröffentlicht: (2024)
von: Zhao, Liang, et al.
Veröffentlicht: (2024)
Spatio-Temporal Foundation Models: Vision, Challenges, and Opportunities
von: Goodge, Adam, et al.
Veröffentlicht: (2025)
von: Goodge, Adam, et al.
Veröffentlicht: (2025)
QwenLong-L1.5: Post-Training Recipe for Long-Context Reasoning and Memory Management
von: Shen, Weizhou, et al.
Veröffentlicht: (2025)
von: Shen, Weizhou, et al.
Veröffentlicht: (2025)
Tracking the Truth: Object-Centric Spatio-Temporal Monitoring for Video Large Language Models
von: Cao, Tri, et al.
Veröffentlicht: (2026)
von: Cao, Tri, et al.
Veröffentlicht: (2026)
Geneshift: Impact of different scenario shift on Jailbreaking LLM
von: Wu, Tianyi, et al.
Veröffentlicht: (2025)
von: Wu, Tianyi, et al.
Veröffentlicht: (2025)
An Efficient Recipe for Long Context Extension via Middle-Focused Positional Encoding
von: Wu, Tong, et al.
Veröffentlicht: (2024)
von: Wu, Tong, et al.
Veröffentlicht: (2024)
READ: Recurrent Adapter with Partial Video-Language Alignment for Parameter-Efficient Transfer Learning in Low-Resource Video-Language Modeling
von: Nguyen, Thong, et al.
Veröffentlicht: (2023)
von: Nguyen, Thong, et al.
Veröffentlicht: (2023)
SemRoDe: Macro Adversarial Training to Learn Representations That are Robust to Word-Level Attacks
von: Formento, Brian, et al.
Veröffentlicht: (2024)
von: Formento, Brian, et al.
Veröffentlicht: (2024)
Vision-and-Language Pretraining
von: Nguyen, Thong, et al.
Veröffentlicht: (2022)
von: Nguyen, Thong, et al.
Veröffentlicht: (2022)
Collaborative Multi-Agent Test-Time Reinforcement Learning for Reasoning
von: Hu, Zhiyuan, et al.
Veröffentlicht: (2026)
von: Hu, Zhiyuan, et al.
Veröffentlicht: (2026)
Multi-Scale Contrastive Learning for Video Temporal Grounding
von: Nguyen, Thong Thanh, et al.
Veröffentlicht: (2024)
von: Nguyen, Thong Thanh, et al.
Veröffentlicht: (2024)
AllMem: A Memory-centric Recipe for Efficient Long-context Modeling
von: Wang, Ziming, et al.
Veröffentlicht: (2026)
von: Wang, Ziming, et al.
Veröffentlicht: (2026)
DemaFormer: Damped Exponential Moving Average Transformer with Energy-Based Modeling for Temporal Language Grounding
von: Nguyen, Thong, et al.
Veröffentlicht: (2023)
von: Nguyen, Thong, et al.
Veröffentlicht: (2023)
Topic Modeling as Multi-Objective Contrastive Optimization
von: Nguyen, Thong, et al.
Veröffentlicht: (2024)
von: Nguyen, Thong, et al.
Veröffentlicht: (2024)
CHiP: Cross-modal Hierarchical Direct Preference Optimization for Multimodal LLMs
von: Fu, Jinlan, et al.
Veröffentlicht: (2025)
von: Fu, Jinlan, et al.
Veröffentlicht: (2025)
Motion-aware Contrastive Learning for Temporal Panoptic Scene Graph Generation
von: Nguyen, Thong Thanh, et al.
Veröffentlicht: (2024)
von: Nguyen, Thong Thanh, et al.
Veröffentlicht: (2024)
OmChat: A Recipe to Train Multimodal Language Models with Strong Long Context and Video Understanding
von: Zhao, Tiancheng, et al.
Veröffentlicht: (2024)
von: Zhao, Tiancheng, et al.
Veröffentlicht: (2024)
MAMA: Meta-optimized Angular Margin Contrastive Framework for Video-Language Representation Learning
von: Nguyen, Thong, et al.
Veröffentlicht: (2024)
von: Nguyen, Thong, et al.
Veröffentlicht: (2024)
Paper Espresso: From Paper Overload to Research Insight
von: Du, Mingzhe, et al.
Veröffentlicht: (2026)
von: Du, Mingzhe, et al.
Veröffentlicht: (2026)
TimeRecipe: A Time-Series Forecasting Recipe via Benchmarking Module Level Effectiveness
von: Zhao, Zhiyuan, et al.
Veröffentlicht: (2025)
von: Zhao, Zhiyuan, et al.
Veröffentlicht: (2025)
A Recipe for Improved Certifiable Robustness
von: Hu, Kai, et al.
Veröffentlicht: (2023)
von: Hu, Kai, et al.
Veröffentlicht: (2023)
RecipeGen: A Benchmark for Real-World Recipe Image Generation
von: Zhang, Ruoxuan, et al.
Veröffentlicht: (2025)
von: Zhang, Ruoxuan, et al.
Veröffentlicht: (2025)
Recipe for Success.
von: Shafer, Marilyn
Veröffentlicht: (2002)
von: Shafer, Marilyn
Veröffentlicht: (2002)
Chapter TransRecipe for Translating Recipes through Machine Processing
von: Sin-wai, Chan
Veröffentlicht: (2026)
von: Sin-wai, Chan
Veröffentlicht: (2026)
Chapter TransRecipe for Translating Recipes through Machine Processing
von: Sin-wai, Chan
Veröffentlicht: (2026)
von: Sin-wai, Chan
Veröffentlicht: (2026)
Chapter VisualRecipe for Visualizing Recipes through Image Technology
von: Sin-wai, Chan
Veröffentlicht: (2026)
von: Sin-wai, Chan
Veröffentlicht: (2026)
A Design Recipe and Recipe-Based Errors for Regular Expressions
von: Morazán, Marco T., et al.
Veröffentlicht: (2025)
von: Morazán, Marco T., et al.
Veröffentlicht: (2025)
Chapter VisualRecipe for Visualizing Recipes through Image Technology
von: Sin-wai, Chan
Veröffentlicht: (2026)
von: Sin-wai, Chan
Veröffentlicht: (2026)
From Repertoires to Recipes: Rethinking Political Organisation in the Long 19th Century*
von: Richard Huzzey, et al.
Veröffentlicht: (2026)
von: Richard Huzzey, et al.
Veröffentlicht: (2026)
CodeArena: A Collective Evaluation Platform for LLM Code Generation
von: Du, Mingzhe, et al.
Veröffentlicht: (2025)
von: Du, Mingzhe, et al.
Veröffentlicht: (2025)
When In-Distribution Gains Fail: Evaluating Weak-to-Strong Reward Models under Preference Shift
von: Le, Khoi, et al.
Veröffentlicht: (2026)
von: Le, Khoi, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
Temporal-Oriented Recipe for Transferring Large Vision-Language Model to Video Understanding
von: Nguyen, Thong, et al.
Veröffentlicht: (2025) -
Guiding VLM Agents with Process Rewards at Inference Time for GUI Navigation
von: Hu, Zhiyuan, et al.
Veröffentlicht: (2025) -
Encoding and Controlling Global Semantics for Long-form Video Question Answering
von: Nguyen, Thong Thanh, et al.
Veröffentlicht: (2024) -
Uncertainty of Thoughts: Uncertainty-Aware Planning Enhances Information Seeking in Large Language Models
von: Hu, Zhiyuan, et al.
Veröffentlicht: (2024) -
How Does Response Length Affect Long-Form Factuality
von: Zhao, James Xu, et al.
Veröffentlicht: (2025)