Enregistré dans:
| Auteurs principaux: | Zhu, Shipeng, Chen, Ang, Nie, Na, Fang, Pengfei, Zhang, Min-Ling, Xue, Hui |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2604.09367 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Text-Phase Synergy Network with Dual Priors for Unsupervised Cross-Domain Image Retrieval
par: Yang, Jing, et autres
Publié: (2026)
par: Yang, Jing, et autres
Publié: (2026)
PEAN: A Diffusion-Based Prior-Enhanced Attention Network for Scene Text Image Super-Resolution
par: Zhao, Zuoyan, et autres
Publié: (2023)
par: Zhao, Zuoyan, et autres
Publié: (2023)
MAIL++: Multi-Modal Bi-directional Agent Layer for Vision-Language Models
par: Chen, Kaixiang, et autres
Publié: (2026)
par: Chen, Kaixiang, et autres
Publié: (2026)
Text Image Inpainting via Global Structure-Guided Diffusion Models
par: Zhu, Shipeng, et autres
Publié: (2024)
par: Zhu, Shipeng, et autres
Publié: (2024)
MESA: A Training-Free Multi-Exemplar Deep Framework for Restoring Ancient Inscription Textures
par: Toulatzis, Vasileios, et autres
Publié: (2026)
par: Toulatzis, Vasileios, et autres
Publié: (2026)
VaseVQA: Multimodal Agent and Benchmark for Ancient Greek Pottery
par: Ge, Jinchao, et autres
Publié: (2025)
par: Ge, Jinchao, et autres
Publié: (2025)
Integrated Framework for Selecting and Enhancing Ancient Marathi Inscription Images from Stone, Metal Plate, and Paper Documents
par: Chendage, Bapu D., et autres
Publié: (2026)
par: Chendage, Bapu D., et autres
Publié: (2026)
PresentAgent: Multimodal Agent for Presentation Video Generation
par: Shi, Jingwei, et autres
Publié: (2025)
par: Shi, Jingwei, et autres
Publié: (2025)
RestoreAgent: Autonomous Image Restoration Agent via Multimodal Large Language Models
par: Chen, Haoyu, et autres
Publié: (2024)
par: Chen, Haoyu, et autres
Publié: (2024)
Multi-Agent Image Restoration
par: Jiang, Xu, et autres
Publié: (2025)
par: Jiang, Xu, et autres
Publié: (2025)
TIR-Agent: Training an Explorative and Efficient Agent for Image Restoration
par: Zhang, Yisheng, et autres
Publié: (2026)
par: Zhang, Yisheng, et autres
Publié: (2026)
Scan Clusters, Not Pixels: A Cluster-Centric Paradigm for Efficient Ultra-high-definition Image Restoration
par: Wu, Chen, et autres
Publié: (2026)
par: Wu, Chen, et autres
Publié: (2026)
Derain-Agent: A Plug-and-Play Agent Framework for Rainy Image Restoration
par: Yu, Zhaocheng, et autres
Publié: (2026)
par: Yu, Zhaocheng, et autres
Publié: (2026)
MAI-UI Technical Report: Real-World Centric Foundation GUI Agents
par: Zhou, Hanzhang, et autres
Publié: (2025)
par: Zhou, Hanzhang, et autres
Publié: (2025)
SRasP: Self-Reorientation Adversarial Style Perturbation for Cross-Domain Few-Shot Learning
par: Li, Wenqian, et autres
Publié: (2026)
par: Li, Wenqian, et autres
Publié: (2026)
PEARL: Input-Agnostic Prompt Enhancement with Negative Feedback Regulation for Class-Incremental Learning
par: Qin, Yongchun, et autres
Publié: (2024)
par: Qin, Yongchun, et autres
Publié: (2024)
On Distilling the Displacement Knowledge for Few-Shot Class-Incremental Learning
par: Fang, Pengfei, et autres
Publié: (2024)
par: Fang, Pengfei, et autres
Publié: (2024)
SVasP: Self-Versatility Adversarial Style Perturbation for Cross-Domain Few-Shot Learning
par: Li, Wenqian, et autres
Publié: (2024)
par: Li, Wenqian, et autres
Publié: (2024)
Hybrid Agents for Image Restoration
par: Li, Bingchen, et autres
Publié: (2025)
par: Li, Bingchen, et autres
Publié: (2025)
OBIFormer: A Fast Attentive Denoising Framework for Oracle Bone Inscriptions
par: Li, Jinhao, et autres
Publié: (2025)
par: Li, Jinhao, et autres
Publié: (2025)
Oracle Bone Inscriptions Multi-modal Dataset
par: Li, Bang, et autres
Publié: (2024)
par: Li, Bang, et autres
Publié: (2024)
OPERA: An Agent for Image Restoration with End-to-End Joint Planning-Execution Optimization
par: Zhu, Feng, et autres
Publié: (2026)
par: Zhu, Feng, et autres
Publié: (2026)
VQ-Jarvis: Retrieval-Augmented Video Restoration Agent with Sharp Vision and Fast Thought
par: Zhang, Xuanyu, et autres
Publié: (2026)
par: Zhang, Xuanyu, et autres
Publié: (2026)
IC-Mapper: Instance-Centric Spatio-Temporal Modeling for Online Vectorized Map Construction
par: Zhu, Jiangtong, et autres
Publié: (2025)
par: Zhu, Jiangtong, et autres
Publié: (2025)
MoA-VR: A Mixture-of-Agents System Towards All-in-One Video Restoration
par: Liu, Lu, et autres
Publié: (2025)
par: Liu, Lu, et autres
Publié: (2025)
Multi-Modal Semantic Parsing for the Interpretation of Tombstone Inscriptions
par: Zhang, Xiao, et autres
Publié: (2025)
par: Zhang, Xiao, et autres
Publié: (2025)
Mitigating Long-tail Distribution in Oracle Bone Inscriptions: Dataset, Model, and Benchmark
par: Li, Jinhao, et autres
Publié: (2025)
par: Li, Jinhao, et autres
Publié: (2025)
PaAgent: Portrait-Aware Image Restoration Agent via Subjective-Objective Reinforcement Learning
par: Wang, Yijian, et autres
Publié: (2026)
par: Wang, Yijian, et autres
Publié: (2026)
WaterVideoQA: ASV-Centric Perception and Rule-Compliant Reasoning via Multi-Modal Agents
par: Guan, Runwei, et autres
Publié: (2026)
par: Guan, Runwei, et autres
Publié: (2026)
VidEmo: Affective-Tree Reasoning for Emotion-Centric Video Foundation Models
par: Zhang, Zhicheng, et autres
Publié: (2025)
par: Zhang, Zhicheng, et autres
Publié: (2025)
EchoAgent: Guideline-Centric Reasoning Agent for Echocardiography Measurement and Interpretation
par: Daghyani, Matin, et autres
Publié: (2025)
par: Daghyani, Matin, et autres
Publié: (2025)
AgentPose: Progressive Distribution Alignment via Feature Agent for Human Pose Distillation
par: Zhang, Feng, et autres
Publié: (2025)
par: Zhang, Feng, et autres
Publié: (2025)
ECHO: Event-Centric Hypergraph Operations via Multi-Agent Collaboration for Multimedia Event Extraction
par: Chu, Hailong, et autres
Publié: (2026)
par: Chu, Hailong, et autres
Publié: (2026)
Refer-Agent: A Collaborative Multi-Agent System with Reasoning and Reflection for Referring Video Object Segmentation
par: Jiang, Haichao, et autres
Publié: (2026)
par: Jiang, Haichao, et autres
Publié: (2026)
LadderMoE: Ladder-Side Mixture of Experts Adapters for Bronze Inscription Recognition
par: Zhou, Rixin, et autres
Publié: (2025)
par: Zhou, Rixin, et autres
Publié: (2025)
Rethinking Pruning for Vision-Language Models: Strategies for Effective Sparsity and Performance Restoration
par: He, Shwai, et autres
Publié: (2024)
par: He, Shwai, et autres
Publié: (2024)
Restoring Ancient Ideograph: A Multimodal Multitask Neural Network Approach
par: Duan, Siyu, et autres
Publié: (2024)
par: Duan, Siyu, et autres
Publié: (2024)
PersonalAlign: Hierarchical Implicit Intent Alignment for Personalized GUI Agent with Long-Term User-Centric Records
par: Lyu, Yibo, et autres
Publié: (2026)
par: Lyu, Yibo, et autres
Publié: (2026)
DVFace: Spatio-Temporal Dual-Prior Diffusion for Video Face Restoration
par: Chen, Zheng, et autres
Publié: (2026)
par: Chen, Zheng, et autres
Publié: (2026)
Restore-R1: Efficient Image Restoration Agents via Reinforcement Learning with Multimodal LLM Perceptual Feedback
par: Lu, Jianglin, et autres
Publié: (2025)
par: Lu, Jianglin, et autres
Publié: (2025)
Documents similaires
-
Text-Phase Synergy Network with Dual Priors for Unsupervised Cross-Domain Image Retrieval
par: Yang, Jing, et autres
Publié: (2026) -
PEAN: A Diffusion-Based Prior-Enhanced Attention Network for Scene Text Image Super-Resolution
par: Zhao, Zuoyan, et autres
Publié: (2023) -
MAIL++: Multi-Modal Bi-directional Agent Layer for Vision-Language Models
par: Chen, Kaixiang, et autres
Publié: (2026) -
Text Image Inpainting via Global Structure-Guided Diffusion Models
par: Zhu, Shipeng, et autres
Publié: (2024) -
MESA: A Training-Free Multi-Exemplar Deep Framework for Restoring Ancient Inscription Textures
par: Toulatzis, Vasileios, et autres
Publié: (2026)