Scaling Video-Language Models to 10K Frames via Hierarchical Differential Distillation
Fuente:
arXiv
Guardado en:
| Autores principales: | Cheng, Chuanqi, Guan, Jian, Wu, Wei, Yan, Rui |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
From the Least to the Most: Building a Plug-and-Play Visual Reasoner via Data Synthesis
por: Cheng, Chuanqi, et al.
Publicado: (2024)
por: Cheng, Chuanqi, et al.
Publicado: (2024)
Weaving Context Across Images: Improving Vision-Language Models through Focus-Centric Visual Chains
por: Zhang, Juntian, et al.
Publicado: (2025)
por: Zhang, Juntian, et al.
Publicado: (2025)
From 1,000,000 Users to Every User: Scaling Up Personalized Preference for User-level Alignment
por: Li, Jia-Nan, et al.
Publicado: (2025)
por: Li, Jia-Nan, et al.
Publicado: (2025)
"In Dialogues We Learn": Towards Personalized Dialogue Without Pre-defined Profiles through In-Dialogue Learning
por: Cheng, Chuanqi, et al.
Publicado: (2024)
por: Cheng, Chuanqi, et al.
Publicado: (2024)
Extended Inductive Reasoning for Personalized Preference Inference from Behavioral Signals
por: Li, Jia-Nan, et al.
Publicado: (2025)
por: Li, Jia-Nan, et al.
Publicado: (2025)
Improving Mathematical Reasoning Capabilities of Small Language Models via Feedback-Driven Distillation
por: Zhu, Xunyu, et al.
Publicado: (2024)
por: Zhu, Xunyu, et al.
Publicado: (2024)
Black-Box On-Policy Distillation of Large Language Models
por: Ye, Tianzhu, et al.
Publicado: (2025)
por: Ye, Tianzhu, et al.
Publicado: (2025)
Distilling Mathematical Reasoning Capabilities into Small Language Models
por: Zhu, Xunyu, et al.
Publicado: (2024)
por: Zhu, Xunyu, et al.
Publicado: (2024)
TextAtari: 100K Frames Game Playing with Language Agents
por: Li, Wenhao, et al.
Publicado: (2025)
por: Li, Wenhao, et al.
Publicado: (2025)
Fact-Checking with Large Language Models via Probabilistic Certainty and Consistency
por: Wang, Haoran, et al.
Publicado: (2026)
por: Wang, Haoran, et al.
Publicado: (2026)
PromptCoT: Synthesizing Olympiad-level Problems for Mathematical Reasoning in Large Language Models
por: Zhao, Xueliang, et al.
Publicado: (2025)
por: Zhao, Xueliang, et al.
Publicado: (2025)
Distilling the Essence: Efficient Reasoning Distillation via Sequence Truncation
por: Chen, Wei-Rui, et al.
Publicado: (2025)
por: Chen, Wei-Rui, et al.
Publicado: (2025)
DeFrame: Debiasing Large Language Models Against Framing Effects
por: Lim, Kahee, et al.
Publicado: (2026)
por: Lim, Kahee, et al.
Publicado: (2026)
ViPER: Empowering the Self-Evolution of Visual Perception Abilities in Vision-Language Model
por: Zhang, Juntian, et al.
Publicado: (2025)
por: Zhang, Juntian, et al.
Publicado: (2025)
EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models
por: Wang, Chengyu, et al.
Publicado: (2025)
por: Wang, Chengyu, et al.
Publicado: (2025)
Distilling Event Sequence Knowledge From Large Language Models
por: Wadhwa, Somin, et al.
Publicado: (2024)
por: Wadhwa, Somin, et al.
Publicado: (2024)
Key-Point-Driven Mathematical Reasoning Distillation of Large Language Model
por: Zhu, Xunyu, et al.
Publicado: (2024)
por: Zhu, Xunyu, et al.
Publicado: (2024)
Execution-Verified Reinforcement Learning for Optimization Modeling
por: Guan, Runda, et al.
Publicado: (2026)
por: Guan, Runda, et al.
Publicado: (2026)
ReFusion: A Diffusion Large Language Model with Parallel Autoregressive Decoding
por: Li, Jia-Nan, et al.
Publicado: (2025)
por: Li, Jia-Nan, et al.
Publicado: (2025)
DP-OPD: Differentially Private On-Policy Distillation for Language Models
por: Khadem, Fatemeh, et al.
Publicado: (2026)
por: Khadem, Fatemeh, et al.
Publicado: (2026)
MiniLLM: On-Policy Distillation of Large Language Models
por: Gu, Yuxian, et al.
Publicado: (2023)
por: Gu, Yuxian, et al.
Publicado: (2023)
VideoEspresso: A Large-Scale Chain-of-Thought Dataset for Fine-Grained Video Reasoning via Core Frame Selection
por: Han, Songhao, et al.
Publicado: (2024)
por: Han, Songhao, et al.
Publicado: (2024)
Data Engineering for Scaling Language Models to 128K Context
por: Fu, Yao, et al.
Publicado: (2024)
por: Fu, Yao, et al.
Publicado: (2024)
Eliciting Trustworthiness Priors of Large Language Models via Economic Games
por: Yan, Siyu, et al.
Publicado: (2026)
por: Yan, Siyu, et al.
Publicado: (2026)
UltraLLaDA: Scaling the Context Length to 128K for Diffusion Large Language Models
por: He, Guangxin, et al.
Publicado: (2025)
por: He, Guangxin, et al.
Publicado: (2025)
ReAD: Reinforcement-Guided Capability Distillation for Large Language Models
por: Cheng, Xueqi, et al.
Publicado: (2026)
por: Cheng, Xueqi, et al.
Publicado: (2026)
Medical Dialogue Generation via Intuitive-then-Analytical Differential Diagnosis
por: Xu, Kaishuai, et al.
Publicado: (2024)
por: Xu, Kaishuai, et al.
Publicado: (2024)
Chunk-Distilled Language Modeling
por: Li, Yanhong, et al.
Publicado: (2024)
por: Li, Yanhong, et al.
Publicado: (2024)
Theoretical Benefit and Limitation of Diffusion Language Model
por: Feng, Guhao, et al.
Publicado: (2025)
por: Feng, Guhao, et al.
Publicado: (2025)
ALaRM: Align Language Models via Hierarchical Rewards Modeling
por: Lai, Yuhang, et al.
Publicado: (2024)
por: Lai, Yuhang, et al.
Publicado: (2024)
Recovering Event Probabilities from Large Language Model Embeddings via Axiomatic Constraints
por: Zhu, Jian-Qiao, et al.
Publicado: (2025)
por: Zhu, Jian-Qiao, et al.
Publicado: (2025)
Making Language Model a Hierarchical Classifier
por: Wang, Yihong, et al.
Publicado: (2025)
por: Wang, Yihong, et al.
Publicado: (2025)
Interpretable Differential Diagnosis with Dual-Inference Large Language Models
por: Zhou, Shuang, et al.
Publicado: (2024)
por: Zhou, Shuang, et al.
Publicado: (2024)
Emergent Hierarchical Structure in Large Language Models: An Information-Theoretic Framework for Multi-Scale Representation
por: Zhang, Yukin, et al.
Publicado: (2025)
por: Zhang, Yukin, et al.
Publicado: (2025)
Generative Pretrained Structured Transformers: Unsupervised Syntactic Language Models at Scale
por: Hu, Xiang, et al.
Publicado: (2024)
por: Hu, Xiang, et al.
Publicado: (2024)
FedCoT: Federated Chain-of-Thought Distillation for Large Language Models
por: Fan, Tao, et al.
Publicado: (2024)
por: Fan, Tao, et al.
Publicado: (2024)
Survey on Knowledge Distillation for Large Language Models: Methods, Evaluation, and Application
por: Yang, Chuanpeng, et al.
Publicado: (2024)
por: Yang, Chuanpeng, et al.
Publicado: (2024)
Towards the Law of Capacity Gap in Distilling Language Models
por: Zhang, Chen, et al.
Publicado: (2023)
por: Zhang, Chen, et al.
Publicado: (2023)
PLPP: Prompt Learning with Perplexity Is Self-Distillation for Vision-Language Models
por: Liu, Biao, et al.
Publicado: (2024)
por: Liu, Biao, et al.
Publicado: (2024)
Rethinking Kullback-Leibler Divergence in Knowledge Distillation for Large Language Models
por: Wu, Taiqiang, et al.
Publicado: (2024)
por: Wu, Taiqiang, et al.
Publicado: (2024)
Ejemplares similares
-
From the Least to the Most: Building a Plug-and-Play Visual Reasoner via Data Synthesis
por: Cheng, Chuanqi, et al.
Publicado: (2024) -
Weaving Context Across Images: Improving Vision-Language Models through Focus-Centric Visual Chains
por: Zhang, Juntian, et al.
Publicado: (2025) -
From 1,000,000 Users to Every User: Scaling Up Personalized Preference for User-level Alignment
por: Li, Jia-Nan, et al.
Publicado: (2025) -
"In Dialogues We Learn": Towards Personalized Dialogue Without Pre-defined Profiles through In-Dialogue Learning
por: Cheng, Chuanqi, et al.
Publicado: (2024) -
Extended Inductive Reasoning for Personalized Preference Inference from Behavioral Signals
por: Li, Jia-Nan, et al.
Publicado: (2025)