LensVLM: Selective Context Expansion for Compressed Visual Representation of Text
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xie, Roy, Friedman, Dan, Yu, Donghan, Pan, Bowen, Fifty, Christopher, Kim, Jang-Hyun, Du, Xianzhi, Gan, Zhe, Rathod, Vivek, Dhingra, Bhuwan |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
GenEOL: Harnessing the Generative Power of LLMs for Training-Free Sentence Embeddings
par: Thirukovalluru, Raghuveer, et autres
Publié: (2024)
par: Thirukovalluru, Raghuveer, et autres
Publié: (2024)
Coding Agents are Effective Long-Context Processors
par: Cao, Weili, et autres
Publié: (2026)
par: Cao, Weili, et autres
Publié: (2026)
To Trust or Not to Trust? Enhancing Large Language Models' Situated Faithfulness to External Contexts
par: Huang, Yukun, et autres
Publié: (2024)
par: Huang, Yukun, et autres
Publié: (2024)
Adversarial Math Word Problem Generation
par: Xie, Roy, et autres
Publié: (2024)
par: Xie, Roy, et autres
Publié: (2024)
Raccoon: Prompt Extraction Benchmark of LLM-Integrated Applications
par: Wang, Junlin, et autres
Publié: (2024)
par: Wang, Junlin, et autres
Publié: (2024)
Compressing LLMs: The Truth is Rarely Pure and Never Simple
par: Jaiswal, Ajay, et autres
Publié: (2023)
par: Jaiswal, Ajay, et autres
Publié: (2023)
Document-as-Image Representations Fall Short for Scientific Retrieval
par: Khalighinejad, Ghazal, et autres
Publié: (2026)
par: Khalighinejad, Ghazal, et autres
Publié: (2026)
Text-Guided Semantic Image Encoder
par: Thirukovalluru, Raghuveer, et autres
Publié: (2025)
par: Thirukovalluru, Raghuveer, et autres
Publié: (2025)
Real-time Factuality Assessment from Adversarial Feedback
par: Chen, Sanxing, et autres
Publié: (2024)
par: Chen, Sanxing, et autres
Publié: (2024)
Atomic Self-Consistency for Better Long Form Generations
par: Thirukovalluru, Raghuveer, et autres
Publié: (2024)
par: Thirukovalluru, Raghuveer, et autres
Publié: (2024)
RVPO: Risk-Sensitive Alignment via Variance Regularization
par: Montero, Ivan, et autres
Publié: (2026)
par: Montero, Ivan, et autres
Publié: (2026)
ChatShop: Interactive Information Seeking with Language Agents
par: Chen, Sanxing, et autres
Publié: (2024)
par: Chen, Sanxing, et autres
Publié: (2024)
Fuzzy Speculative Decoding for a Tunable Accuracy-Runtime Tradeoff
par: Holsman, Maximilian, et autres
Publié: (2025)
par: Holsman, Maximilian, et autres
Publié: (2025)
Knowing When to Stop: Efficient Context Processing via Latent Sufficiency Signals
par: Xie, Roy, et autres
Publié: (2025)
par: Xie, Roy, et autres
Publié: (2025)
When Greedy Wins: Emergent Exploitation Bias in Meta-Bandit LLM Training
par: Chen, Sanxing, et autres
Publié: (2025)
par: Chen, Sanxing, et autres
Publié: (2025)
Vision2Code: A Multi-Domain Benchmark for Evaluating Image-to-Code Generation
par: Periasami, Ajay Vikram, et autres
Publié: (2026)
par: Periasami, Ajay Vikram, et autres
Publié: (2026)
Hierarchical Multi-Label Classification of Online Vaccine Concerns
par: Zhu, Chloe Qinyu, et autres
Publié: (2024)
par: Zhu, Chloe Qinyu, et autres
Publié: (2024)
A Platform for Investigating Public Health Content with Efficient Concern Classification
par: Li, Christopher, et autres
Publié: (2025)
par: Li, Christopher, et autres
Publié: (2025)
Generalizability of Large Language Model-Based Agents: A Comprehensive Survey
par: Zhang, Minxing, et autres
Publié: (2025)
par: Zhang, Minxing, et autres
Publié: (2025)
Compressed Context Memory For Online Language Model Interaction
par: Kim, Jang-Hyun, et autres
Publié: (2023)
par: Kim, Jang-Hyun, et autres
Publié: (2023)
Extracting Polymer Nanocomposite Samples from Full-Length Documents
par: Khalighinejad, Ghazal, et autres
Publié: (2024)
par: Khalighinejad, Ghazal, et autres
Publié: (2024)
InData: Towards Secure Multi-Step, Tool-Based Data Analysis
par: K, Karthikeyan, et autres
Publié: (2025)
par: K, Karthikeyan, et autres
Publié: (2025)
How Much Backtracking is Enough? Exploring the Interplay of SFT and RL in Enhancing LLM Reasoning
par: Cai, Hongyi James, et autres
Publié: (2025)
par: Cai, Hongyi James, et autres
Publié: (2025)
Glyph: Scaling Context Windows via Visual-Text Compression
par: Cheng, Jiale, et autres
Publié: (2025)
par: Cheng, Jiale, et autres
Publié: (2025)
Equichordal Points of Convex Bodies
par: Jang, Leo, et autres
Publié: (2025)
par: Jang, Leo, et autres
Publié: (2025)
Atomic Consistency Preference Optimization for Long-Form Question Answering
par: Chen, Jingfeng, et autres
Publié: (2025)
par: Chen, Jingfeng, et autres
Publié: (2025)
Cite Pretrain: Retrieval-Free Knowledge Attribution for Large Language Models
par: Huang, Yukun, et autres
Publié: (2025)
par: Huang, Yukun, et autres
Publié: (2025)
Calibrating Long-form Generations from Large Language Models
par: Huang, Yukun, et autres
Publié: (2024)
par: Huang, Yukun, et autres
Publié: (2024)
IsoBench: Benchmarking Multimodal Foundation Models on Isomorphic Representations
par: Fu, Deqing, et autres
Publié: (2024)
par: Fu, Deqing, et autres
Publié: (2024)
Over-Searching in Search-Augmented Large Language Models
par: Xie, Roy, et autres
Publié: (2026)
par: Xie, Roy, et autres
Publié: (2026)
MatViX: Multimodal Information Extraction from Visually Rich Articles
par: Khalighinejad, Ghazal, et autres
Publié: (2024)
par: Khalighinejad, Ghazal, et autres
Publié: (2024)
FlashVLM: Text-Guided Visual Token Selection for Large Multimodal Models
par: Cai, Kaitong, et autres
Publié: (2025)
par: Cai, Kaitong, et autres
Publié: (2025)
Rethinking Model Selection in VLM Through the Lens of Gromov-Wasserstein Distance
par: Li, Muyang, et autres
Publié: (2026)
par: Li, Muyang, et autres
Publié: (2026)
KVzip: Query-Agnostic KV Cache Compression with Context Reconstruction
par: Kim, Jang-Hyun, et autres
Publié: (2025)
par: Kim, Jang-Hyun, et autres
Publié: (2025)
Context-Aware Meta-Learning
par: Fifty, Christopher, et autres
Publié: (2023)
par: Fifty, Christopher, et autres
Publié: (2023)
MOFI: Learning Image Representations from Noisy Entity Annotated Images
par: Wu, Wentao, et autres
Publié: (2023)
par: Wu, Wentao, et autres
Publié: (2023)
Interleaved Reasoning for Large Language Models via Reinforcement Learning
par: Xie, Roy, et autres
Publié: (2025)
par: Xie, Roy, et autres
Publié: (2025)
CStream: Parallel Data Stream Compression on Multicore Edge Devices
par: Zeng, Xianzhi, et autres
Publié: (2023)
par: Zeng, Xianzhi, et autres
Publié: (2023)
Poison Once, Control Anywhere: Clean-Text Visual Backdoors in VLM-based Mobile Agents
par: Wang, Xuan, et autres
Publié: (2025)
par: Wang, Xuan, et autres
Publié: (2025)
VLM-driven Skill Selection for Robotic Assembly Tasks
par: Kim, Jeong-Jung, et autres
Publié: (2025)
par: Kim, Jeong-Jung, et autres
Publié: (2025)
Documents similaires
-
GenEOL: Harnessing the Generative Power of LLMs for Training-Free Sentence Embeddings
par: Thirukovalluru, Raghuveer, et autres
Publié: (2024) -
Coding Agents are Effective Long-Context Processors
par: Cao, Weili, et autres
Publié: (2026) -
To Trust or Not to Trust? Enhancing Large Language Models' Situated Faithfulness to External Contexts
par: Huang, Yukun, et autres
Publié: (2024) -
Adversarial Math Word Problem Generation
par: Xie, Roy, et autres
Publié: (2024) -
Raccoon: Prompt Extraction Benchmark of LLM-Integrated Applications
par: Wang, Junlin, et autres
Publié: (2024)