Generation Navigator: A State-Aware Agentic Framework for Image Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Jinming, Feng, Ruoyu, Wang, Yuqi, Zeng, Wenjun, Jin, Xin |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Diff-ICMH: Harmonizing Machine and Human Vision in Image Compression with Generative Prior
por: Feng, Ruoyu, et al.
Publicado: (2025)
por: Feng, Ruoyu, et al.
Publicado: (2025)
Rate-Distortion-Cognition Controllable Versatile Neural Image Compression
por: Liu, Jinming, et al.
Publicado: (2024)
por: Liu, Jinming, et al.
Publicado: (2024)
An Efficient Streaming Video Understanding Framework with Agentic Control
por: Liu, Jinming, et al.
Publicado: (2026)
por: Liu, Jinming, et al.
Publicado: (2026)
Semantics Disentanglement and Composition for Universal Image Coding with Efficiently LLM Reasoning and Generative Diffusion
por: Liu, Jinming, et al.
Publicado: (2024)
por: Liu, Jinming, et al.
Publicado: (2024)
Scene Graph Disentanglement and Composition for Generalizable Complex Image Generation
por: Wang, Yunnan, et al.
Publicado: (2024)
por: Wang, Yunnan, et al.
Publicado: (2024)
Tell Codec What Worth Compressing: Semantically Disentangled Image Coding for Machine with LMMs
por: Liu, Jinming, et al.
Publicado: (2024)
por: Liu, Jinming, et al.
Publicado: (2024)
When MLLMs Meet Compression Distortion: A Coding Paradigm Tailored to MLLMs
por: Liu, Jinming, et al.
Publicado: (2025)
por: Liu, Jinming, et al.
Publicado: (2025)
A Unified Agentic Framework for Evaluating Conditional Image Generation
por: Wang, Jifang, et al.
Publicado: (2025)
por: Wang, Jifang, et al.
Publicado: (2025)
One at a Time: Progressive Multi-step Volumetric Probability Learning for Reliable 3D Scene Perception
por: Li, Bohan, et al.
Publicado: (2023)
por: Li, Bohan, et al.
Publicado: (2023)
Rethinking Domain Adaptation and Generalization in the Era of CLIP
por: Feng, Ruoyu, et al.
Publicado: (2024)
por: Feng, Ruoyu, et al.
Publicado: (2024)
DiffusionAgent: Navigating Expert Models for Agentic Image Generation
por: Qin, Jie, et al.
Publicado: (2024)
por: Qin, Jie, et al.
Publicado: (2024)
Compression Tells Intelligence: Visual Coding, Visual Token Technology, and the Unification
por: Jin, Xin, et al.
Publicado: (2026)
por: Jin, Xin, et al.
Publicado: (2026)
Gen-Searcher: Reinforcing Agentic Search for Image Generation
por: Feng, Kaituo, et al.
Publicado: (2026)
por: Feng, Kaituo, et al.
Publicado: (2026)
Few Exemplar-Based General Medical Image Segmentation via Domain-Aware Selective Adaptation
por: Xu, Chen, et al.
Publicado: (2024)
por: Xu, Chen, et al.
Publicado: (2024)
Diffusion Models for Image Restoration and Enhancement: A Comprehensive Survey
por: Li, Xin, et al.
Publicado: (2023)
por: Li, Xin, et al.
Publicado: (2023)
EvoGuard: An Extensible Agentic RL-based Framework for Practical and Evolving AI-Generated Image Detection
por: Zhu, Chenyang, et al.
Publicado: (2026)
por: Zhu, Chenyang, et al.
Publicado: (2026)
Scenethesis: A Language and Vision Agentic Framework for 3D Scene Generation
por: Ling, Lu, et al.
Publicado: (2025)
por: Ling, Lu, et al.
Publicado: (2025)
ExpoCM: Exposure-Aware One-Step Generative Single-Image HDR Reconstruction
por: Liu, Aoyu, et al.
Publicado: (2026)
por: Liu, Aoyu, et al.
Publicado: (2026)
A Framework for Generating Semantically Ambiguous Images to Probe Human and Machine Perception
por: Hu, Yuqi, et al.
Publicado: (2026)
por: Hu, Yuqi, et al.
Publicado: (2026)
OmniNWM: Omniscient Driving Navigation World Models
por: Li, Bohan, et al.
Publicado: (2025)
por: Li, Bohan, et al.
Publicado: (2025)
NaviNeRF: NeRF-based 3D Representation Disentanglement by Latent Semantic Navigation
por: Xie, Baao, et al.
Publicado: (2023)
por: Xie, Baao, et al.
Publicado: (2023)
NEWTON: Agentic Planning for Physically Grounded Video Generation
por: Feng, Yuxiang, et al.
Publicado: (2026)
por: Feng, Yuxiang, et al.
Publicado: (2026)
SeD: Semantic-Aware Discriminator for Image Super-Resolution
por: Li, Bingchen, et al.
Publicado: (2024)
por: Li, Bingchen, et al.
Publicado: (2024)
APE: Agentic Prompt Enhancer for Image Generation and Editing
por: Huang, Zijian, et al.
Publicado: (2026)
por: Huang, Zijian, et al.
Publicado: (2026)
EyeWorld: A Generative World Model of Ocular State and Dynamics
por: Gao, Ziyu, et al.
Publicado: (2026)
por: Gao, Ziyu, et al.
Publicado: (2026)
A Dual-Branch CNN for Robust Detection of AI-Generated Facial Forgeries
por: Zhang, Xin, et al.
Publicado: (2025)
por: Zhang, Xin, et al.
Publicado: (2025)
MetaSSL: A General Heterogeneous Loss for Semi-Supervised Medical Image Segmentation
por: Zhao, Weiren, et al.
Publicado: (2025)
por: Zhao, Weiren, et al.
Publicado: (2025)
LAVID: An Agentic LVLM Framework for Diffusion-Generated Video Detection
por: Liu, Qingyuan, et al.
Publicado: (2025)
por: Liu, Qingyuan, et al.
Publicado: (2025)
The Silent Assistant: NoiseQuery as Implicit Guidance for Goal-Driven Image Generation
por: Wang, Ruoyu, et al.
Publicado: (2024)
por: Wang, Ruoyu, et al.
Publicado: (2024)
Scaling Up AI-Generated Image Detection with Generator-Aware Prototypes
por: Qin, Ziheng, et al.
Publicado: (2025)
por: Qin, Ziheng, et al.
Publicado: (2025)
Semantically Structured Image Compression via Irregular Group-Based Decoupling
por: Feng, Ruoyu, et al.
Publicado: (2023)
por: Feng, Ruoyu, et al.
Publicado: (2023)
AgenticIQA: An Agentic Framework for Adaptive and Interpretable Image Quality Assessment
por: Zhu, Hanwei, et al.
Publicado: (2025)
por: Zhu, Hanwei, et al.
Publicado: (2025)
GenClaw: Code-Driven Agentic Image Generation
por: Ye, Junyan, et al.
Publicado: (2026)
por: Ye, Junyan, et al.
Publicado: (2026)
Closed-Loop Unsupervised Representation Disentanglement with $β$-VAE Distillation and Diffusion Probabilistic Feedback
por: Jin, Xin, et al.
Publicado: (2024)
por: Jin, Xin, et al.
Publicado: (2024)
GenAgent: Scaling Text-to-Image Generation via Agentic Multimodal Reasoning
por: Jiang, Kaixun, et al.
Publicado: (2026)
por: Jiang, Kaixun, et al.
Publicado: (2026)
Frequency-Aware Vision-Language Multimodality Generalization Network for Remote Sensing Image Classification
por: Zhang, Junjie, et al.
Publicado: (2025)
por: Zhang, Junjie, et al.
Publicado: (2025)
Self-Reasoning Agentic Framework for Narrative Product Grid-Collage Generation
por: Luo, Minyan, et al.
Publicado: (2026)
por: Luo, Minyan, et al.
Publicado: (2026)
Manifold-Aware Local Feature Modeling for Semi-Supervised Medical Image Segmentation
por: Shen, Sicheng, et al.
Publicado: (2024)
por: Shen, Sicheng, et al.
Publicado: (2024)
PKU-AIGIQA-4K: A Perceptual Quality Assessment Database for Both Text-to-Image and Image-to-Image AI-Generated Images
por: Yuan, Jiquan, et al.
Publicado: (2024)
por: Yuan, Jiquan, et al.
Publicado: (2024)
MangaFlow: An End-to-End Agentic Framework for Controllable Story to Manga Generation
por: Wang, Muyao, et al.
Publicado: (2026)
por: Wang, Muyao, et al.
Publicado: (2026)
Ejemplares similares
-
Diff-ICMH: Harmonizing Machine and Human Vision in Image Compression with Generative Prior
por: Feng, Ruoyu, et al.
Publicado: (2025) -
Rate-Distortion-Cognition Controllable Versatile Neural Image Compression
por: Liu, Jinming, et al.
Publicado: (2024) -
An Efficient Streaming Video Understanding Framework with Agentic Control
por: Liu, Jinming, et al.
Publicado: (2026) -
Semantics Disentanglement and Composition for Universal Image Coding with Efficiently LLM Reasoning and Generative Diffusion
por: Liu, Jinming, et al.
Publicado: (2024) -
Scene Graph Disentanglement and Composition for Generalizable Complex Image Generation
por: Wang, Yunnan, et al.
Publicado: (2024)