Vision Language Model-Empowered Contract Theory for AIGC Task Allocation in Teleoperation
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhan, Zijun, Dong, Yaxian, Hu, Yuqing, Li, Shuai, Cao, Shaohua, Han, Zhu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Learning to Incentivize: LLM-Empowered Contract for AIGC Offloading in Teleoperation
por: Zhan, Zijun, et al.
Publicado: (2025)
por: Zhan, Zijun, et al.
Publicado: (2025)
Distributionally Robust Contract Theory for Edge AIGC Services in Teleoperation
por: Zhan, Zijun, et al.
Publicado: (2025)
por: Zhan, Zijun, et al.
Publicado: (2025)
Matching-with-Contracts for the AI-RAN Market: AIGC-as-a-Service for Teleoperation
por: Zhan, Zijun, et al.
Publicado: (2026)
por: Zhan, Zijun, et al.
Publicado: (2026)
Human-AI Collaboration Mechanism Study on AIGC Assisted Image Production for Special Coverage
por: Yang, Yajie, et al.
Publicado: (2025)
por: Yang, Yajie, et al.
Publicado: (2025)
SimpleLLM4AD: An End-to-End Vision-Language Model with Graph Visual Question Answering for Autonomous Driving
por: Zheng, Peiru, et al.
Publicado: (2024)
por: Zheng, Peiru, et al.
Publicado: (2024)
VisionCLIP: An Med-AIGC based Ethical Language-Image Foundation Model for Generalizable Retina Image Analysis
por: Wei, Hao, et al.
Publicado: (2024)
por: Wei, Hao, et al.
Publicado: (2024)
AVA: Towards Agentic Video Analytics with Vision Language Models
por: Yan, Yuxuan, et al.
Publicado: (2025)
por: Yan, Yuxuan, et al.
Publicado: (2025)
TIER: Text-Image Encoder-based Regression for AIGC Image Quality Assessment
por: Yuan, Jiquan, et al.
Publicado: (2024)
por: Yuan, Jiquan, et al.
Publicado: (2024)
MC-GPT: Empowering Vision-and-Language Navigation with Memory Map and Reasoning Chains
por: Zhan, Zhaohuan, et al.
Publicado: (2024)
por: Zhan, Zhaohuan, et al.
Publicado: (2024)
VLM4VLA: Revisiting Vision-Language-Models in Vision-Language-Action Models
por: Zhang, Jianke, et al.
Publicado: (2026)
por: Zhang, Jianke, et al.
Publicado: (2026)
NoRD: A Data-Efficient Vision-Language-Action Model that Drives without Reasoning
por: Rawal, Ishaan, et al.
Publicado: (2026)
por: Rawal, Ishaan, et al.
Publicado: (2026)
Harnessing Large Vision and Language Models in Agriculture: A Review
por: Zhu, Hongyan, et al.
Publicado: (2024)
por: Zhu, Hongyan, et al.
Publicado: (2024)
Segment Any RGB-Thermal Model with Language-aided Distillation
por: Xing, Dong, et al.
Publicado: (2025)
por: Xing, Dong, et al.
Publicado: (2025)
Vision-R1: Evolving Human-Free Alignment in Large Vision-Language Models via Vision-Guided Reinforcement Learning
por: Zhan, Yufei, et al.
Publicado: (2025)
por: Zhan, Yufei, et al.
Publicado: (2025)
FILA: Fine-Grained Vision Language Models
por: Zhu, Shiding, et al.
Publicado: (2024)
por: Zhu, Shiding, et al.
Publicado: (2024)
A-VL: Adaptive Attention for Large Vision-Language Models
por: Zhang, Junyang, et al.
Publicado: (2024)
por: Zhang, Junyang, et al.
Publicado: (2024)
Empower Vision Applications with LoRA LMM
por: Mi, Liang, et al.
Publicado: (2024)
por: Mi, Liang, et al.
Publicado: (2024)
SimpleBEV: Improved LiDAR-Camera Fusion Architecture for 3D Object Detection
por: Zhao, Yun, et al.
Publicado: (2024)
por: Zhao, Yun, et al.
Publicado: (2024)
Ivy-Fake: A Unified Explainable Framework and Benchmark for Image and Video AIGC Detection
por: Jiang, Changjiang, et al.
Publicado: (2025)
por: Jiang, Changjiang, et al.
Publicado: (2025)
Refer to Any Segmentation Mask Group With Vision-Language Prompts
por: Cao, Shengcao, et al.
Publicado: (2025)
por: Cao, Shengcao, et al.
Publicado: (2025)
Mitigating Object Hallucinations in Large Vision-Language Models via Attention Calibration
por: Zhu, Younan, et al.
Publicado: (2025)
por: Zhu, Younan, et al.
Publicado: (2025)
Hierarchical Question-Answering for Driving Scene Understanding Using Vision-Language Models
por: Mohamud, Safaa Abdullahi Moallim, et al.
Publicado: (2025)
por: Mohamud, Safaa Abdullahi Moallim, et al.
Publicado: (2025)
Low-hallucination Synthetic Captions for Large-Scale Vision-Language Model Pre-training
por: Zhang, Xinsong, et al.
Publicado: (2025)
por: Zhang, Xinsong, et al.
Publicado: (2025)
Swarm Intelligence in Geo-Localization: A Multi-Agent Large Vision-Language Model Collaborative Framework
por: Han, Xiao, et al.
Publicado: (2024)
por: Han, Xiao, et al.
Publicado: (2024)
SketchRef: a Multi-Task Evaluation Benchmark for Sketch Synthesis
por: Lin, Xingyue, et al.
Publicado: (2024)
por: Lin, Xingyue, et al.
Publicado: (2024)
CorrectNav: Self-Correction Flywheel Empowers Vision-Language-Action Navigation Model
por: Yu, Zhuoyuan, et al.
Publicado: (2025)
por: Yu, Zhuoyuan, et al.
Publicado: (2025)
AerialVLA: A Vision-Language-Action Model for UAV Navigation via Minimalist End-to-End Control
por: Xu, Peng, et al.
Publicado: (2026)
por: Xu, Peng, et al.
Publicado: (2026)
VF-Eval: Evaluating Multimodal LLMs for Generating Feedback on AIGC Videos
por: Song, Tingyu, et al.
Publicado: (2025)
por: Song, Tingyu, et al.
Publicado: (2025)
Physical Prompt Injection Attacks on Large Vision-Language Models
por: Ling, Chen, et al.
Publicado: (2026)
por: Ling, Chen, et al.
Publicado: (2026)
ImgTrojan: Jailbreaking Vision-Language Models with ONE Image
por: Tao, Xijia, et al.
Publicado: (2024)
por: Tao, Xijia, et al.
Publicado: (2024)
Griffon-G: Bridging Vision-Language and Vision-Centric Tasks via Large Multimodal Models
por: Zhan, Yufei, et al.
Publicado: (2024)
por: Zhan, Yufei, et al.
Publicado: (2024)
Vision Enhancing LLMs: Empowering Multimodal Knowledge Storage and Sharing in LLMs
por: Li, Yunxin, et al.
Publicado: (2023)
por: Li, Yunxin, et al.
Publicado: (2023)
Jack of All Tasks, Master of Many: Designing General-purpose Coarse-to-Fine Vision-Language Model
por: Pramanick, Shraman, et al.
Publicado: (2023)
por: Pramanick, Shraman, et al.
Publicado: (2023)
Generalized Category Discovery under Domain Shifts: From Vision to Vision-Language Models
por: Wang, Hongjun, et al.
Publicado: (2026)
por: Wang, Hongjun, et al.
Publicado: (2026)
Vision Language Models in Autonomous Driving: A Survey and Outlook
por: Zhou, Xingcheng, et al.
Publicado: (2023)
por: Zhou, Xingcheng, et al.
Publicado: (2023)
Can GPT tell us why these images are synthesized? Empowering Multimodal Large Language Models for Forensics
por: He, Yiran, et al.
Publicado: (2025)
por: He, Yiran, et al.
Publicado: (2025)
HEIE: MLLM-Based Hierarchical Explainable AIGC Image Implausibility Evaluator
por: Yang, Fan, et al.
Publicado: (2024)
por: Yang, Fan, et al.
Publicado: (2024)
Vision-Language Models in Remote Sensing: Current Progress and Future Trends
por: Li, Xiang, et al.
Publicado: (2023)
por: Li, Xiang, et al.
Publicado: (2023)
LPT: Less-overfitting Prompt Tuning for Vision-Language Model
por: Ding, Chenhao, et al.
Publicado: (2024)
por: Ding, Chenhao, et al.
Publicado: (2024)
Vision Inference Former: Sustaining Visual Consistency in Multimodal Large Language Models
por: Dong, Xinpeng, et al.
Publicado: (2026)
por: Dong, Xinpeng, et al.
Publicado: (2026)
Ejemplares similares
-
Learning to Incentivize: LLM-Empowered Contract for AIGC Offloading in Teleoperation
por: Zhan, Zijun, et al.
Publicado: (2025) -
Distributionally Robust Contract Theory for Edge AIGC Services in Teleoperation
por: Zhan, Zijun, et al.
Publicado: (2025) -
Matching-with-Contracts for the AI-RAN Market: AIGC-as-a-Service for Teleoperation
por: Zhan, Zijun, et al.
Publicado: (2026) -
Human-AI Collaboration Mechanism Study on AIGC Assisted Image Production for Special Coverage
por: Yang, Yajie, et al.
Publicado: (2025) -
SimpleLLM4AD: An End-to-End Vision-Language Model with Graph Visual Question Answering for Autonomous Driving
por: Zheng, Peiru, et al.
Publicado: (2024)