Scalable Language Model with Generalized Continual Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Peng, Bohao, Tian, Zhuotao, Liu, Shu, Yang, Mingchang, Jia, Jiaya |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model
di: Yang, Senqiao, et al.
Pubblicazione: (2023)
di: Yang, Senqiao, et al.
Pubblicazione: (2023)
Prompt Highlighter: Interactive Control for Multi-Modal LLMs
di: Zhang, Yuechen, et al.
Pubblicazione: (2023)
di: Zhang, Yuechen, et al.
Pubblicazione: (2023)
Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs
di: Lai, Xin, et al.
Pubblicazione: (2024)
di: Lai, Xin, et al.
Pubblicazione: (2024)
VisionZip: Longer is Better but Not Necessary in Vision Language Models
di: Yang, Senqiao, et al.
Pubblicazione: (2024)
di: Yang, Senqiao, et al.
Pubblicazione: (2024)
Unified Language-driven Zero-shot Domain Adaptation
di: Yang, Senqiao, et al.
Pubblicazione: (2024)
di: Yang, Senqiao, et al.
Pubblicazione: (2024)
MR-GSM8K: A Meta-Reasoning Benchmark for Large Language Model Evaluation
di: Zeng, Zhongshen, et al.
Pubblicazione: (2023)
di: Zeng, Zhongshen, et al.
Pubblicazione: (2023)
GroupContrast: Semantic-aware Self-supervised Representation Learning for 3D Understanding
di: Wang, Chengyao, et al.
Pubblicazione: (2024)
di: Wang, Chengyao, et al.
Pubblicazione: (2024)
OA-CNNs: Omni-Adaptive Sparse CNNs for 3D Semantic Segmentation
di: Peng, Bohao, et al.
Pubblicazione: (2024)
di: Peng, Bohao, et al.
Pubblicazione: (2024)
LISA: Reasoning Segmentation via Large Language Model
di: Lai, Xin, et al.
Pubblicazione: (2023)
di: Lai, Xin, et al.
Pubblicazione: (2023)
Mind the Interference: Retaining Pre-trained Knowledge in Parameter Efficient Continual Learning of Vision-Language Models
di: Tang, Longxiang, et al.
Pubblicazione: (2024)
di: Tang, Longxiang, et al.
Pubblicazione: (2024)
VisionThink: Smart and Efficient Vision Language Model via Reinforcement Learning
di: Yang, Senqiao, et al.
Pubblicazione: (2025)
di: Yang, Senqiao, et al.
Pubblicazione: (2025)
Does Your Vision-Language Model Get Lost in the Long Video Sampling Dilemma?
di: Qu, Tianyuan, et al.
Pubblicazione: (2025)
di: Qu, Tianyuan, et al.
Pubblicazione: (2025)
Enhancing LLM Knowledge Learning through Generalization
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)
Can Large Language Models Resolve Semantic Discrepancy in Self-Destructive Subcultures? Evidence from Jirai Kei
di: Wang, Peng, et al.
Pubblicazione: (2026)
di: Wang, Peng, et al.
Pubblicazione: (2026)
MGM-Omni: Scaling Omni LLMs to Personalized Long-Horizon Speech
di: Wang, Chengyao, et al.
Pubblicazione: (2025)
di: Wang, Chengyao, et al.
Pubblicazione: (2025)
VisionReasoner: Unified Reasoning-Integrated Visual Perception via Reinforcement Learning
di: Liu, Yuqi, et al.
Pubblicazione: (2025)
di: Liu, Yuqi, et al.
Pubblicazione: (2025)
LongLoRA: Efficient Fine-tuning of Long-Context Large Language Models
di: Chen, Yukang, et al.
Pubblicazione: (2023)
di: Chen, Yukang, et al.
Pubblicazione: (2023)
SLIDE: A Framework Integrating Small and Large Language Models for Open-Domain Dialogues Evaluation
di: Zhao, Kun, et al.
Pubblicazione: (2024)
di: Zhao, Kun, et al.
Pubblicazione: (2024)
Is Parameter Collision Hindering Continual Learning in LLMs?
di: Yang, Shuo, et al.
Pubblicazione: (2024)
di: Yang, Shuo, et al.
Pubblicazione: (2024)
Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models
di: Li, Yanwei, et al.
Pubblicazione: (2024)
di: Li, Yanwei, et al.
Pubblicazione: (2024)
From Curated Data to Scalable Models: Continual Pre-training of Dense and MoE Large Language Models for Tibetan
di: Yang, Lei, et al.
Pubblicazione: (2025)
di: Yang, Lei, et al.
Pubblicazione: (2025)
ControlNeXt: Powerful and Efficient Control for Image and Video Generation
di: Peng, Bohao, et al.
Pubblicazione: (2024)
di: Peng, Bohao, et al.
Pubblicazione: (2024)
Learning Attentional Mixture of LoRAs for Language Model Continual Learning
di: Liu, Jialin, et al.
Pubblicazione: (2024)
di: Liu, Jialin, et al.
Pubblicazione: (2024)
Stratified GRPO: Handling Structural Heterogeneity in Reinforcement Learning of LLM Search Agents
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)
Gated Integration of Low-Rank Adaptation for Continual Learning of Large Language Models
di: Liang, Yan-Shuo, et al.
Pubblicazione: (2025)
di: Liang, Yan-Shuo, et al.
Pubblicazione: (2025)
Training Large Language Models to Reason in a Continuous Latent Space
di: Hao, Shibo, et al.
Pubblicazione: (2024)
di: Hao, Shibo, et al.
Pubblicazione: (2024)
EmotionHallucer: Evaluating Emotion Hallucinations in Multimodal Large Language Models
di: Xing, Bohao, et al.
Pubblicazione: (2025)
di: Xing, Bohao, et al.
Pubblicazione: (2025)
FlashVID: Efficient Video Large Language Models via Training-free Tree-based Spatiotemporal Token Merging
di: Fan, Ziyang, et al.
Pubblicazione: (2026)
di: Fan, Ziyang, et al.
Pubblicazione: (2026)
GPT-4o as the Gold Standard: A Scalable and General Purpose Approach to Filter Language Model Pretraining Data
di: Zhang, Jifan, et al.
Pubblicazione: (2024)
di: Zhang, Jifan, et al.
Pubblicazione: (2024)
From Noisy Traces to Stable Gradients: Bias-Variance Optimized Preference Optimization for Aligning Large Reasoning Models
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)
di: Zhu, Mingkang, et al.
Pubblicazione: (2025)
Scalable MatMul-free Language Modeling
di: Zhu, Rui-Jie, et al.
Pubblicazione: (2024)
di: Zhu, Rui-Jie, et al.
Pubblicazione: (2024)
A Survey on Large Language Models for Mathematical Reasoning
di: Wang, Peng-Yuan, et al.
Pubblicazione: (2025)
di: Wang, Peng-Yuan, et al.
Pubblicazione: (2025)
Towards Training A Chinese Large Language Model for Anesthesiology
di: Wang, Zhonghai, et al.
Pubblicazione: (2024)
di: Wang, Zhonghai, et al.
Pubblicazione: (2024)
MagicMirror: ID-Preserved Video Generation in Video Diffusion Transformers
di: Zhang, Yuechen, et al.
Pubblicazione: (2025)
di: Zhang, Yuechen, et al.
Pubblicazione: (2025)
Auto-RAG: Autonomous Retrieval-Augmented Generation for Large Language Models
di: Yu, Tian, et al.
Pubblicazione: (2024)
di: Yu, Tian, et al.
Pubblicazione: (2024)
Are Large Language Models Capable of Generating Human-Level Narratives?
di: Tian, Yufei, et al.
Pubblicazione: (2024)
di: Tian, Yufei, et al.
Pubblicazione: (2024)
Recent Advances of Foundation Language Models-based Continual Learning: A Survey
di: Yang, Yutao, et al.
Pubblicazione: (2024)
di: Yang, Yutao, et al.
Pubblicazione: (2024)
From RAG to Memory: Non-Parametric Continual Learning for Large Language Models
di: Gutiérrez, Bernal Jiménez, et al.
Pubblicazione: (2025)
di: Gutiérrez, Bernal Jiménez, et al.
Pubblicazione: (2025)
RLCD: Reinforcement Learning from Contrastive Distillation for Language Model Alignment
di: Yang, Kevin, et al.
Pubblicazione: (2023)
di: Yang, Kevin, et al.
Pubblicazione: (2023)
DRE: An Effective Dual-Refined Method for Integrating Small and Large Language Models in Open-Domain Dialogue Evaluation
di: Zhao, Kun, et al.
Pubblicazione: (2025)
di: Zhao, Kun, et al.
Pubblicazione: (2025)
Documenti analoghi
-
LISA++: An Improved Baseline for Reasoning Segmentation with Large Language Model
di: Yang, Senqiao, et al.
Pubblicazione: (2023) -
Prompt Highlighter: Interactive Control for Multi-Modal LLMs
di: Zhang, Yuechen, et al.
Pubblicazione: (2023) -
Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs
di: Lai, Xin, et al.
Pubblicazione: (2024) -
VisionZip: Longer is Better but Not Necessary in Vision Language Models
di: Yang, Senqiao, et al.
Pubblicazione: (2024) -
Unified Language-driven Zero-shot Domain Adaptation
di: Yang, Senqiao, et al.
Pubblicazione: (2024)