AI for Service: Proactive Assistance with AI Glasses
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wen, Zichen, Wang, Yiyu, Liao, Chenfei, Yang, Boxue, Li, Junxian, Liu, Weifeng, He, Haocong, Feng, Bolong, Liu, Xuyang, Lyu, Yuanhuiyi, Zheng, Xu, Hu, Xuming, Zhang, Linfeng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Are We Using the Right Benchmark: An Evaluation Framework for Visual Token Compression Methods
par: Liao, Chenfei, et autres
Publié: (2025)
par: Liao, Chenfei, et autres
Publié: (2025)
EvoStreaming: Your Offline Video Model Is a Natively Streaming Assistant
par: Wen, Zichen, et autres
Publié: (2026)
par: Wen, Zichen, et autres
Publié: (2026)
Accelerating Streaming Video Large Language Models via Hierarchical Token Compression
par: Wang, Yiyu, et autres
Publié: (2025)
par: Wang, Yiyu, et autres
Publié: (2025)
Flash-Unified: A Training-Free and Task-Aware Acceleration Framework for Native Unified Models
par: Ke, Junlong, et autres
Publié: (2026)
par: Ke, Junlong, et autres
Publié: (2026)
Shifting AI Efficiency From Model-Centric to Data-Centric Compression
par: Liu, Xuyang, et autres
Publié: (2025)
par: Liu, Xuyang, et autres
Publié: (2025)
PANORAMA: The Rise of Omnidirectional Vision in the Embodied AI Era
par: Zheng, Xu, et autres
Publié: (2025)
par: Zheng, Xu, et autres
Publié: (2025)
OmniSAM: Omnidirectional Segment Anything Model for UDA in Panoramic Semantic Segmentation
par: Zhong, Ding, et autres
Publié: (2025)
par: Zhong, Ding, et autres
Publié: (2025)
Understanding-in-Generation: Reinforcing Generative Capability of Unified Model via Infusing Understanding into Generation
par: Lyu, Yuanhuiyi, et autres
Publié: (2025)
par: Lyu, Yuanhuiyi, et autres
Publié: (2025)
MemorySAM: Memorize Modalities and Semantics with Segment Anything Model 2 for Multi-modal Semantic Segmentation
par: Liao, Chenfei, et autres
Publié: (2025)
par: Liao, Chenfei, et autres
Publié: (2025)
Video Compression Commander: Plug-and-Play Inference Acceleration for Video Large Language Models
par: Liu, Xuyang, et autres
Publié: (2025)
par: Liu, Xuyang, et autres
Publié: (2025)
Variation-aware Vision Token Dropping for Faster Large Vision-Language Models
par: Chen, Junjie, et autres
Publié: (2025)
par: Chen, Junjie, et autres
Publié: (2025)
Don't Just Chase "Highlighted Tokens" in MLLMs: Revisiting Visual Holistic Context Retention
par: Zou, Xin, et autres
Publié: (2025)
par: Zou, Xin, et autres
Publié: (2025)
RealRAG: Retrieval-augmented Realistic Image Generation via Self-reflective Contrastive Learning
par: Lyu, Yuanhuiyi, et autres
Publié: (2025)
par: Lyu, Yuanhuiyi, et autres
Publié: (2025)
From Reusing to Forecasting: Accelerating Diffusion Models with TaylorSeers
par: Liu, Jiacheng, et autres
Publié: (2025)
par: Liu, Jiacheng, et autres
Publié: (2025)
MAGIC++: Efficient and Resilient Modality-Agnostic Semantic Segmentation via Hierarchical Modality Selection
par: Zheng, Xu, et autres
Publié: (2024)
par: Zheng, Xu, et autres
Publié: (2024)
Bridging Visual Representation and Reinforcement Learning from Verifiable Rewards in Large Vision-Language Models
par: Han, Yuhang, et autres
Publié: (2026)
par: Han, Yuhang, et autres
Publié: (2026)
StreamMeCo: Long-Term Agent Memory Compression for Efficient Streaming Video Understanding
par: Wang, Junxi, et autres
Publié: (2026)
par: Wang, Junxi, et autres
Publié: (2026)
SAVEn-Vid: Synergistic Audio-Visual Integration for Enhanced Understanding in Long Video Context
par: Li, Jungang, et autres
Publié: (2024)
par: Li, Jungang, et autres
Publié: (2024)
Learning Robust Anymodal Segmentor with Unimodal and Cross-modal Distillation
par: Zheng, Xu, et autres
Publié: (2024)
par: Zheng, Xu, et autres
Publié: (2024)
Learning Modality-agnostic Representation for Semantic Segmentation from Any Modalities
par: Zheng, Xu, et autres
Publié: (2024)
par: Zheng, Xu, et autres
Publié: (2024)
VideoCompressa: Data-Efficient Video Understanding via Joint Temporal Compression and Spatial Reconstruction
par: Wang, Shaobo, et autres
Publié: (2025)
par: Wang, Shaobo, et autres
Publié: (2025)
Image Anything: Towards Reasoning-coherent and Training-free Multi-modal Image Generation
par: Lyu, Yuanhuiyi, et autres
Publié: (2024)
par: Lyu, Yuanhuiyi, et autres
Publié: (2024)
StruVis: Enhancing Reasoning-based Text-to-Image Generation via Thinking with Structured Vision
par: Lyu, Yuanhuiyi, et autres
Publié: (2026)
par: Lyu, Yuanhuiyi, et autres
Publié: (2026)
A Survey of Mathematical Reasoning in the Era of Multimodal Large Language Model: Benchmark, Method & Challenges
par: Yan, Yibo, et autres
Publié: (2024)
par: Yan, Yibo, et autres
Publié: (2024)
Reducing Unimodal Bias in Multi-Modal Semantic Segmentation with Multi-Scale Functional Entropy Regularization
par: Zheng, Xu, et autres
Publié: (2025)
par: Zheng, Xu, et autres
Publié: (2025)
MMUnlearner: Reformulating Multimodal Machine Unlearning in the Era of Multimodal Large Language Models
par: Huo, Jiahao, et autres
Publié: (2025)
par: Huo, Jiahao, et autres
Publié: (2025)
Assistance or Disruption? Exploring and Evaluating the Design and Trade-offs of Proactive AI Programming Support
par: Pu, Kevin, et autres
Publié: (2025)
par: Pu, Kevin, et autres
Publié: (2025)
Token Pruning in Multimodal Large Language Models: Are We Solving the Right Problem?
par: Wen, Zichen, et autres
Publié: (2025)
par: Wen, Zichen, et autres
Publié: (2025)
Human Resilience in the AI Era -- What Machines Can't Replace
par: Liu, Shaoshan, et autres
Publié: (2025)
par: Liu, Shaoshan, et autres
Publié: (2025)
Gnothi Seauton: Empowering Faithful Self-Interpretability in Black-Box Transformers
par: Wang, Shaobo, et autres
Publié: (2024)
par: Wang, Shaobo, et autres
Publié: (2024)
Centering the Value of Every Modality: Towards Efficient and Resilient Modality-agnostic Semantic Segmentation
par: Zheng, Xu, et autres
Publié: (2024)
par: Zheng, Xu, et autres
Publié: (2024)
EventBind: Learning a Unified Representation to Bind Them All for Event-based Open-world Understanding
par: Zhou, Jiazhou, et autres
Publié: (2023)
par: Zhou, Jiazhou, et autres
Publié: (2023)
OmniBind: Teach to Build Unequal-Scale Modality Interaction for Omni-Bind of All
par: Lyu, Yuanhuiyi, et autres
Publié: (2024)
par: Lyu, Yuanhuiyi, et autres
Publié: (2024)
UniBind: LLM-Augmented Unified and Balanced Representation Space to Bind Them All
par: Lyu, Yuanhuiyi, et autres
Publié: (2024)
par: Lyu, Yuanhuiyi, et autres
Publié: (2024)
ExACT: Language-guided Conceptual Reasoning and Uncertainty Estimation for Event-based Action Recognition and More
par: Zhou, Jiazhou, et autres
Publié: (2024)
par: Zhou, Jiazhou, et autres
Publié: (2024)
IPCV: Information-Preserving Compression for MLLM Visual Encoders
par: Chen, Yuan, et autres
Publié: (2025)
par: Chen, Yuan, et autres
Publié: (2025)
A Survey on Proactive Defense Strategies Against Misinformation in Large Language Models
par: Liu, Shuliang, et autres
Publié: (2025)
par: Liu, Shuliang, et autres
Publié: (2025)
More AI Assistance Reduces Cognitive Engagement: Examining the AI Assistance Dilemma in AI-Supported Note-Taking
par: Chen, Xinyue, et autres
Publié: (2025)
par: Chen, Xinyue, et autres
Publié: (2025)
SpeCa: Accelerating Diffusion Transformers with Speculative Feature Caching
par: Liu, Jiacheng, et autres
Publié: (2025)
par: Liu, Jiacheng, et autres
Publié: (2025)
PACT: Proactive Asking for Continual Task Assistance in Human-Robot Collaboration
par: He, Chengbo, et autres
Publié: (2026)
par: He, Chengbo, et autres
Publié: (2026)
Documents similaires
-
Are We Using the Right Benchmark: An Evaluation Framework for Visual Token Compression Methods
par: Liao, Chenfei, et autres
Publié: (2025) -
EvoStreaming: Your Offline Video Model Is a Natively Streaming Assistant
par: Wen, Zichen, et autres
Publié: (2026) -
Accelerating Streaming Video Large Language Models via Hierarchical Token Compression
par: Wang, Yiyu, et autres
Publié: (2025) -
Flash-Unified: A Training-Free and Task-Aware Acceleration Framework for Native Unified Models
par: Ke, Junlong, et autres
Publié: (2026) -
Shifting AI Efficiency From Model-Centric to Data-Centric Compression
par: Liu, Xuyang, et autres
Publié: (2025)