Less Redundancy: Boosting Practicality of Vision Language Model in Walking Assistants
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Chongyang, Yuan, Zhiqiang, Bi, Hanbo, Jia, Zexi, Zhang, Jinchao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
F2RVLM: Boosting Fine-grained Fragment Retrieval for Multi-Modal Long-form Dialogue with Vision Language Model
por: Bi, Hanbo, et al.
Publicado: (2025)
por: Bi, Hanbo, et al.
Publicado: (2025)
WalkVLM:Aid Visually Impaired People Walking by Vision Language Model
por: Yuan, Zhiqiang, et al.
Publicado: (2024)
por: Yuan, Zhiqiang, et al.
Publicado: (2024)
ThinkLess: A Training-Free Inference-Efficient Method for Reducing Reasoning Redundancy
por: Li, Gengyang, et al.
Publicado: (2025)
por: Li, Gengyang, et al.
Publicado: (2025)
SQ-LLaVA: Self-Questioning for Large Vision-Language Assistant
por: Sun, Guohao, et al.
Publicado: (2024)
por: Sun, Guohao, et al.
Publicado: (2024)
FlowCut: Rethinking Redundancy via Information Flow for Efficient Vision-Language Models
por: Tong, Jintao, et al.
Publicado: (2025)
por: Tong, Jintao, et al.
Publicado: (2025)
StyleDecoupler: Generalizable Artistic Style Disentanglement
por: Jia, Zexi, et al.
Publicado: (2026)
por: Jia, Zexi, et al.
Publicado: (2026)
Improving Phishing Email Detection Performance of Small Large Language Models
por: Lin, Zijie, et al.
Publicado: (2025)
por: Lin, Zijie, et al.
Publicado: (2025)
Personalized Large Language Model Assistant with Evolving Conditional Memory
por: Yuan, Ruifeng, et al.
Publicado: (2023)
por: Yuan, Ruifeng, et al.
Publicado: (2023)
Revealing and Reducing Gender Biases in Vision and Language Assistants (VLAs)
por: Girrbach, Leander, et al.
Publicado: (2024)
por: Girrbach, Leander, et al.
Publicado: (2024)
Agentic Tool Use in Large Language Models
por: Hu, Jinchao, et al.
Publicado: (2026)
por: Hu, Jinchao, et al.
Publicado: (2026)
AssistRAG: Boosting the Potential of Large Language Models with an Intelligent Information Assistant
por: Zhou, Yujia, et al.
Publicado: (2024)
por: Zhou, Yujia, et al.
Publicado: (2024)
PyramidDrop: Accelerating Your Large Vision-Language Models via Pyramid Visual Redundancy Reduction
por: Xing, Long, et al.
Publicado: (2024)
por: Xing, Long, et al.
Publicado: (2024)
Over-Reasoning and Redundant Calculation of Large Language Models
por: Chiang, Cheng-Han, et al.
Publicado: (2024)
por: Chiang, Cheng-Han, et al.
Publicado: (2024)
UniEDU: A Unified Language and Vision Assistant for Education Applications
por: Chu, Zhendong, et al.
Publicado: (2025)
por: Chu, Zhendong, et al.
Publicado: (2025)
Pay Less Attention to Function Words for Free Robustness of Vision-Language Models
por: Tian, Qiwei, et al.
Publicado: (2025)
por: Tian, Qiwei, et al.
Publicado: (2025)
Generator-Assistant Stepwise Rollback Framework for Large Language Model Agent
por: Li, Xingzuo, et al.
Publicado: (2025)
por: Li, Xingzuo, et al.
Publicado: (2025)
Evaluating Fairness in Large Vision-Language Models Across Diverse Demographic Attributes and Prompts
por: Wu, Xuyang, et al.
Publicado: (2024)
por: Wu, Xuyang, et al.
Publicado: (2024)
CoDA: Color Distribution Probing for Efficient and Generalizable AI-Generated Image Detection
por: Jia, Zexi, et al.
Publicado: (2026)
por: Jia, Zexi, et al.
Publicado: (2026)
CFBenchmark: Chinese Financial Assistant Benchmark for Large Language Model
por: Lei, Yang, et al.
Publicado: (2023)
por: Lei, Yang, et al.
Publicado: (2023)
Streamlining Redundant Layers to Compress Large Language Models
por: Chen, Xiaodong, et al.
Publicado: (2024)
por: Chen, Xiaodong, et al.
Publicado: (2024)
Large Language Models as Misleading Assistants in Conversation
por: Hou, Betty Li, et al.
Publicado: (2024)
por: Hou, Betty Li, et al.
Publicado: (2024)
Boosting Neural Language Inference via Cascaded Interactive Reasoning
por: Li, Min, et al.
Publicado: (2025)
por: Li, Min, et al.
Publicado: (2025)
Leveraging Large Language Models for NLG Evaluation: Advances and Challenges
por: Li, Zhen, et al.
Publicado: (2024)
por: Li, Zhen, et al.
Publicado: (2024)
PediatricsGPT: Large Language Models as Chinese Medical Assistants for Pediatric Applications
por: Yang, Dingkang, et al.
Publicado: (2024)
por: Yang, Dingkang, et al.
Publicado: (2024)
EyeGPT: Ophthalmic Assistant with Large Language Models
por: Chen, Xiaolan, et al.
Publicado: (2024)
por: Chen, Xiaolan, et al.
Publicado: (2024)
ShortGPT: Layers in Large Language Models are More Redundant Than You Expect
por: Men, Xin, et al.
Publicado: (2024)
por: Men, Xin, et al.
Publicado: (2024)
Less Languages, Less Tokens: An Efficient Unified Logic Cross-lingual Chain-of-Thought Reasoning Framework
por: Zhang, Chenyuan, et al.
Publicado: (2026)
por: Zhang, Chenyuan, et al.
Publicado: (2026)
Talk Less, Verify More: Improving LLM Assistants with Semantic Checks and Execution Feedback
por: Sun, Yan, et al.
Publicado: (2026)
por: Sun, Yan, et al.
Publicado: (2026)
Chatlaw: A Multi-Agent Collaborative Legal Assistant with Knowledge Graph Enhanced Mixture-of-Experts Large Language Model
por: Cui, Jiaxi, et al.
Publicado: (2023)
por: Cui, Jiaxi, et al.
Publicado: (2023)
Less Is More? Examining Fairness in Pruned Large Language Models for Summarising Opinions
por: Huang, Nannan, et al.
Publicado: (2025)
por: Huang, Nannan, et al.
Publicado: (2025)
On the Cultural Anachronism and Temporal Reasoning in Vision Language Models
por: Ranjan, Mukul, et al.
Publicado: (2026)
por: Ranjan, Mukul, et al.
Publicado: (2026)
Building A Coding Assistant via the Retrieval-Augmented Language Model
por: Li, Xinze, et al.
Publicado: (2024)
por: Li, Xinze, et al.
Publicado: (2024)
Semantic to Structure: Learning Structural Representations for Infringement Detection
por: Huang, Chuanwei, et al.
Publicado: (2025)
por: Huang, Chuanwei, et al.
Publicado: (2025)
Control-CLIP: Decoupling Category and Style Guidance in CLIP for Specific-Domain Generation
por: Jia, Zexi, et al.
Publicado: (2025)
por: Jia, Zexi, et al.
Publicado: (2025)
CFBenchmark-MM: Chinese Financial Assistant Benchmark for Multimodal Large Language Model
por: Li, Jiangtong, et al.
Publicado: (2025)
por: Li, Jiangtong, et al.
Publicado: (2025)
A Hybrid Defense Strategy for Boosting Adversarial Robustness in Vision-Language Models
por: Liang, Yuhan, et al.
Publicado: (2024)
por: Liang, Yuhan, et al.
Publicado: (2024)
BBA: Bi-Modal Behavioral Alignment for Reasoning with Large Vision-Language Models
por: Zhao, Xueliang, et al.
Publicado: (2024)
por: Zhao, Xueliang, et al.
Publicado: (2024)
Evaluating LLMs Robustness in Less Resourced Languages with Proxy Models
por: Chrabąszcz, Maciej, et al.
Publicado: (2025)
por: Chrabąszcz, Maciej, et al.
Publicado: (2025)
Language Models Grow Less Humanlike beyond Phase Transition
por: Aoyama, Tatsuya, et al.
Publicado: (2025)
por: Aoyama, Tatsuya, et al.
Publicado: (2025)
Generative Model for Less-Resourced Language with 1 billion parameters
por: Vreš, Domen, et al.
Publicado: (2024)
por: Vreš, Domen, et al.
Publicado: (2024)
Ejemplares similares
-
F2RVLM: Boosting Fine-grained Fragment Retrieval for Multi-Modal Long-form Dialogue with Vision Language Model
por: Bi, Hanbo, et al.
Publicado: (2025) -
WalkVLM:Aid Visually Impaired People Walking by Vision Language Model
por: Yuan, Zhiqiang, et al.
Publicado: (2024) -
ThinkLess: A Training-Free Inference-Efficient Method for Reducing Reasoning Redundancy
por: Li, Gengyang, et al.
Publicado: (2025) -
SQ-LLaVA: Self-Questioning for Large Vision-Language Assistant
por: Sun, Guohao, et al.
Publicado: (2024) -
FlowCut: Rethinking Redundancy via Information Flow for Efficient Vision-Language Models
por: Tong, Jintao, et al.
Publicado: (2025)