Guardado en:
| Autores principales: | Ma, Ziyu, Gou, Chenhui, Hu, Yiming, Wang, Yong, Chu, Xiangxiang, Zhuang, Bohan, Cai, Jianfei |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2511.08246 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Multimodal Task Vectors Enable Many-Shot Multimodal In-Context Learning
por: Huang, Brandon, et al.
Publicado: (2024)
por: Huang, Brandon, et al.
Publicado: (2024)
An Empirical Study on How Video-LLMs Answer Video Questions
por: Gou, Chenhui, et al.
Publicado: (2025)
por: Gou, Chenhui, et al.
Publicado: (2025)
FlashBlock: Attention Caching for Efficient Long-Context Block Diffusion
por: Chen, Zhuokun, et al.
Publicado: (2026)
por: Chen, Zhuokun, et al.
Publicado: (2026)
CoEvolve: Training LLM Agents via Agent-Data Mutual Evolution
por: Yang, Shidong, et al.
Publicado: (2026)
por: Yang, Shidong, et al.
Publicado: (2026)
DrVideo: Document Retrieval Based Long Video Understanding
por: Ma, Ziyu, et al.
Publicado: (2024)
por: Ma, Ziyu, et al.
Publicado: (2024)
Robust MAE-Driven NAS: From Mask Reconstruction to Architecture Innovation
por: Hu, Yiming, et al.
Publicado: (2023)
por: Hu, Yiming, et al.
Publicado: (2023)
Efficient Stitchable Task Adaptation
por: He, Haoyu, et al.
Publicado: (2023)
por: He, Haoyu, et al.
Publicado: (2023)
D$^2$Evo: Dual Difficulty-Aware Self-Evolution for Data-Efficient Reinforcement Learning
por: Zhang, Ru, et al.
Publicado: (2026)
por: Zhang, Ru, et al.
Publicado: (2026)
Many-Shot In-Context Learning
por: Agarwal, Rishabh, et al.
Publicado: (2024)
por: Agarwal, Rishabh, et al.
Publicado: (2024)
Selecting Demonstrations for Many-Shot In-Context Learning via Gradient Matching
por: Zhang, Jianfei, et al.
Publicado: (2025)
por: Zhang, Jianfei, et al.
Publicado: (2025)
Many-Shot In-Context Learning in Multimodal Foundation Models
por: Jiang, Yixing, et al.
Publicado: (2024)
por: Jiang, Yixing, et al.
Publicado: (2024)
SkillClaw: Let Skills Evolve Collectively with Agentic Evolver
por: Ma, Ziyu, et al.
Publicado: (2026)
por: Ma, Ziyu, et al.
Publicado: (2026)
Tree Search for LLM Agent Reinforcement Learning
por: Ji, Yuxiang, et al.
Publicado: (2025)
por: Ji, Yuxiang, et al.
Publicado: (2025)
Thinking with Map: Reinforced Parallel Map-Augmented Agent for Geolocalization
por: Ji, Yuxiang, et al.
Publicado: (2026)
por: Ji, Yuxiang, et al.
Publicado: (2026)
What Really Matters in Many-Shot Attacks? An Empirical Study of Long-Context Vulnerabilities in LLMs
por: Kim, Sangyeop, et al.
Publicado: (2025)
por: Kim, Sangyeop, et al.
Publicado: (2025)
Evaluating and Advancing Multimodal Large Language Models in Perception Ability Lens
por: Chen, Feng, et al.
Publicado: (2024)
por: Chen, Feng, et al.
Publicado: (2024)
Understanding the Prompt Sensitivity
por: Liu, Yang, et al.
Publicado: (2026)
por: Liu, Yang, et al.
Publicado: (2026)
Sparsity Forcing: Reinforcing Token Sparsity of MLLMs
por: Chen, Feng, et al.
Publicado: (2025)
por: Chen, Feng, et al.
Publicado: (2025)
Compressing Many-Shots in In-Context Learning
por: Khatri, Devvrit, et al.
Publicado: (2025)
por: Khatri, Devvrit, et al.
Publicado: (2025)
MARS Policy: Multimodality Only When It Matters
por: Jia, Jindou, et al.
Publicado: (2026)
por: Jia, Jindou, et al.
Publicado: (2026)
AdapShot: Adaptive Many-Shot In-Context Learning with Semantic-Aware KV Cache Reuse
por: Ou, Jie, et al.
Publicado: (2026)
por: Ou, Jie, et al.
Publicado: (2026)
GeReA: Question-Aware Prompt Captions for Knowledge-based Visual Question Answering
por: Ma, Ziyu, et al.
Publicado: (2024)
por: Ma, Ziyu, et al.
Publicado: (2024)
On Many-Shot In-Context Learning for Long-Context Evaluation
por: Zou, Kaijian, et al.
Publicado: (2024)
por: Zou, Kaijian, et al.
Publicado: (2024)
Point-Cache: Test-time Dynamic and Hierarchical Cache for Robust and Generalizable Point Cloud Analysis
por: Sun, Hongyu, et al.
Publicado: (2025)
por: Sun, Hongyu, et al.
Publicado: (2025)
Semantic Context Matters: Improving Conditioning for Autoregressive Models
por: Jin, Dongyang, et al.
Publicado: (2025)
por: Jin, Dongyang, et al.
Publicado: (2025)
JRDB-PanoTrack: An Open-world Panoptic Segmentation and Tracking Robotic Dataset in Crowded Human Environments
por: Le, Duy-Tho, et al.
Publicado: (2024)
por: Le, Duy-Tho, et al.
Publicado: (2024)
How Well Can Vision Language Models See Image Details?
por: Gou, Chenhui, et al.
Publicado: (2024)
por: Gou, Chenhui, et al.
Publicado: (2024)
Label Words as Local Task Vectors in In-Context Learning
por: Zheng, Bowen, et al.
Publicado: (2024)
por: Zheng, Bowen, et al.
Publicado: (2024)
QLLM: Accurate and Efficient Low-Bitwidth Quantization for Large Language Models
por: Liu, Jing, et al.
Publicado: (2023)
por: Liu, Jing, et al.
Publicado: (2023)
ME-Switch: A Memory-Efficient Expert Switching Framework for Large Language Models
por: Liu, Jing, et al.
Publicado: (2024)
por: Liu, Jing, et al.
Publicado: (2024)
Adaptive Task Balancing for Visual Instruction Tuning via Inter-Task Contribution and Intra-Task Difficulty
por: Dai, Yanqi, et al.
Publicado: (2024)
por: Dai, Yanqi, et al.
Publicado: (2024)
Many-Shot In-Context Learning for Molecular Inverse Design
por: Moayedpour, Saeed, et al.
Publicado: (2024)
por: Moayedpour, Saeed, et al.
Publicado: (2024)
Towards Compute-Optimal Many-Shot In-Context Learning
por: Golchin, Shahriar, et al.
Publicado: (2025)
por: Golchin, Shahriar, et al.
Publicado: (2025)
Is One-Shot In-Context Learning Helpful for Data Selection in Task-Specific Fine-Tuning of Multimodal LLMs?
por: An, Xiao, et al.
Publicado: (2026)
por: An, Xiao, et al.
Publicado: (2026)
Learning Agentic Policy from Action Guidance
por: Ji, Yuxiang, et al.
Publicado: (2026)
por: Ji, Yuxiang, et al.
Publicado: (2026)
Mimic In-Context Learning for Multimodal Tasks
por: Jiang, Yuchu, et al.
Publicado: (2025)
por: Jiang, Yuchu, et al.
Publicado: (2025)
Drive-1-to-3: Enriching Diffusion Priors for Novel View Synthesis of Real Vehicles
por: Lin, Chuang, et al.
Publicado: (2024)
por: Lin, Chuang, et al.
Publicado: (2024)
Distilling Many-Shot In-Context Learning into a Cheat Sheet
por: Honda, Ukyo, et al.
Publicado: (2025)
por: Honda, Ukyo, et al.
Publicado: (2025)
MAPLE: Many-Shot Adaptive Pseudo-Labeling for In-Context Learning
por: Chen, Zihan, et al.
Publicado: (2025)
por: Chen, Zihan, et al.
Publicado: (2025)
Global Context with Discrete Diffusion in Vector Quantised Modelling for Image Generation
por: Hu, Minghui, et al.
Publicado: (2021)
por: Hu, Minghui, et al.
Publicado: (2021)
Ejemplares similares
-
Multimodal Task Vectors Enable Many-Shot Multimodal In-Context Learning
por: Huang, Brandon, et al.
Publicado: (2024) -
An Empirical Study on How Video-LLMs Answer Video Questions
por: Gou, Chenhui, et al.
Publicado: (2025) -
FlashBlock: Attention Caching for Efficient Long-Context Block Diffusion
por: Chen, Zhuokun, et al.
Publicado: (2026) -
CoEvolve: Training LLM Agents via Agent-Data Mutual Evolution
por: Yang, Shidong, et al.
Publicado: (2026) -
DrVideo: Document Retrieval Based Long Video Understanding
por: Ma, Ziyu, et al.
Publicado: (2024)