Inference-time Trajectory Optimization for Manga Image Editing
Fuente:
arXiv
Enregistré dans:
| Auteur principal: | Furuta, Ryosuke |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Learning Gaussian Data Augmentation in Feature Space for One-shot Object Detection in Manga
par: Taniguchi, Takara, et autres
Publié: (2024)
par: Taniguchi, Takara, et autres
Publié: (2024)
Seeking Flat Minima with Mean Teacher on Semi- and Weakly-Supervised Domain Generalization for Object Detection
par: Furuta, Ryosuke, et autres
Publié: (2023)
par: Furuta, Ryosuke, et autres
Publié: (2023)
MangaFlow: An End-to-End Agentic Framework for Controllable Story to Manga Generation
par: Wang, Muyao, et autres
Publié: (2026)
par: Wang, Muyao, et autres
Publié: (2026)
Diffusion-Based Conditional Image Editing through Optimized Inference with Guidance
par: Lee, Hyunsoo, et autres
Publié: (2024)
par: Lee, Hyunsoo, et autres
Publié: (2024)
EgoInstruct: An Egocentric Video Dataset of Face-to-face Instructional Interactions with Multi-modal LLM Benchmarking
par: Sakai, Yuki, et autres
Publié: (2025)
par: Sakai, Yuki, et autres
Publié: (2025)
Learning Multiple Object States from Actions via Large Language Models
par: Tateno, Masatoshi, et autres
Publié: (2024)
par: Tateno, Masatoshi, et autres
Publié: (2024)
MangaUB: A Manga Understanding Benchmark for Large Multimodal Models
par: Ikuta, Hikaru, et autres
Publié: (2024)
par: Ikuta, Hikaru, et autres
Publié: (2024)
Manga109-v2026: Revisiting Manga109 Annotations for Modern Manga Understanding
par: Baek, Jeonghun, et autres
Publié: (2026)
par: Baek, Jeonghun, et autres
Publié: (2026)
MangaVQA and MangaLMM: A Benchmark and Specialized Model for Multimodal Manga Understanding
par: Baek, Jeonghun, et autres
Publié: (2025)
par: Baek, Jeonghun, et autres
Publié: (2025)
Region-Wise Correspondence Prediction between Manga Line Art Images
par: Li, Yingxuan, et autres
Publié: (2025)
par: Li, Yingxuan, et autres
Publié: (2025)
Pre-Training for 3D Hand Pose Estimation with Contrastive Learning on Large-Scale Hand Images in the Wild
par: Lin, Nie, et autres
Publié: (2024)
par: Lin, Nie, et autres
Publié: (2024)
ActionVOS: Actions as Prompts for Video Object Segmentation
par: Ouyang, Liangyang, et autres
Publié: (2024)
par: Ouyang, Liangyang, et autres
Publié: (2024)
AssemblyHands-X: Modeling 3D Hand-Body Coordination for Understanding Bimanual Human Activities
par: Banno, Tatsuro, et autres
Publié: (2025)
par: Banno, Tatsuro, et autres
Publié: (2025)
The Manga Whisperer: Automatically Generating Transcriptions for Comics
par: Sachdeva, Ragav, et autres
Publié: (2024)
par: Sachdeva, Ragav, et autres
Publié: (2024)
Manga Generation via Layout-controllable Diffusion
par: Chen, Siyu, et autres
Publié: (2024)
par: Chen, Siyu, et autres
Publié: (2024)
Number it: Temporal Grounding Videos like Flipping Manga
par: Wu, Yongliang, et autres
Publié: (2024)
par: Wu, Yongliang, et autres
Publié: (2024)
Doubly Abductive Counterfactual Inference for Text-based Image Editing
par: Song, Xue, et autres
Publié: (2024)
par: Song, Xue, et autres
Publié: (2024)
FlowBypass: Rectified Flow Trajectory Bypass for Training-Free Image Editing
par: Han, Menglin, et autres
Publié: (2026)
par: Han, Menglin, et autres
Publié: (2026)
Inference-Time Text-to-Video Alignment with Diffusion Latent Beam Search
par: Oshima, Yuta, et autres
Publié: (2025)
par: Oshima, Yuta, et autres
Publié: (2025)
MangaNinja: Line Art Colorization with Precise Reference Following
par: Liu, Zhiheng, et autres
Publié: (2025)
par: Liu, Zhiheng, et autres
Publié: (2025)
InstaFace: Identity-Preserving Facial Editing with Single Image Inference
par: Khan, MD Wahiduzzaman, et autres
Publié: (2025)
par: Khan, MD Wahiduzzaman, et autres
Publié: (2025)
Leadership Assessment in Pediatric Intensive Care Unit Team Training
par: Ouyang, Liangyang, et autres
Publié: (2025)
par: Ouyang, Liangyang, et autres
Publié: (2025)
Affordance-Guided Diffusion Prior for 3D Hand Reconstruction
par: Suzuki, Naru, et autres
Publié: (2025)
par: Suzuki, Naru, et autres
Publié: (2025)
Multi-speaker Attention Alignment for Multimodal Social Interaction
par: Ouyang, Liangyang, et autres
Publié: (2025)
par: Ouyang, Liangyang, et autres
Publié: (2025)
Tails Tell Tales: Chapter-Wide Manga Transcriptions with Character Names
par: Sachdeva, Ragav, et autres
Publié: (2024)
par: Sachdeva, Ragav, et autres
Publié: (2024)
Accelerating Text-to-Image Editing via Cache-Enabled Sparse Diffusion Inference
par: Yu, Zihao, et autres
Publié: (2023)
par: Yu, Zihao, et autres
Publié: (2023)
Follow-Your-Shape: Shape-Aware Image Editing via Trajectory-Guided Region Control
par: Long, Zeqian, et autres
Publié: (2025)
par: Long, Zeqian, et autres
Publié: (2025)
Re:Verse -- Can Your VLM Read a Manga?
par: Baranwal, Aaditya, et autres
Publié: (2025)
par: Baranwal, Aaditya, et autres
Publié: (2025)
How Panel Layouts Define Manga: Insights from Visual Ablation Experiments
par: Feng, Siyuan, et autres
Publié: (2024)
par: Feng, Siyuan, et autres
Publié: (2024)
FineBio: A Fine-Grained Video Dataset of Biological Experiments with Hierarchical Annotation
par: Yagi, Takuma, et autres
Publié: (2024)
par: Yagi, Takuma, et autres
Publié: (2024)
Energy-Guided Optimization for Personalized Image Editing with Pretrained Text-to-Image Diffusion Models
par: Jiang, Rui, et autres
Publié: (2025)
par: Jiang, Rui, et autres
Publié: (2025)
Manga109Dialog: A Large-scale Dialogue Dataset for Comics Speaker Detection
par: Li, Yingxuan, et autres
Publié: (2023)
par: Li, Yingxuan, et autres
Publié: (2023)
MangaDiT: Reference-Guided Line Art Colorization with Hierarchical Attention in Diffusion Transformers
par: Qiu, Qianru, et autres
Publié: (2025)
par: Qiu, Qianru, et autres
Publié: (2025)
DiffSensei: Bridging Multi-Modal LLMs and Diffusion Models for Customized Manga Generation
par: Wu, Jianzong, et autres
Publié: (2024)
par: Wu, Jianzong, et autres
Publié: (2024)
Perturb-and-Revise: Flexible 3D Editing with Generative Trajectories
par: Hong, Susung, et autres
Publié: (2024)
par: Hong, Susung, et autres
Publié: (2024)
Training-Free Reward-Guided Image Editing via Trajectory Optimal Control
par: Chang, Jinho, et autres
Publié: (2025)
par: Chang, Jinho, et autres
Publié: (2025)
Region-Constrained Group Relative Policy Optimization for Flow-Based Image Editing
par: Ouyang, Zhuohan, et autres
Publié: (2026)
par: Ouyang, Zhuohan, et autres
Publié: (2026)
Edit-GRPO: A Locality-Preserving Policy Optimization Framework for Image Editing
par: Xu, Shaodong, et autres
Publié: (2026)
par: Xu, Shaodong, et autres
Publié: (2026)
DiffVax: Optimization-Free Image Immunization Against Diffusion-Based Editing
par: Ozden, Tarik Can, et autres
Publié: (2024)
par: Ozden, Tarik Can, et autres
Publié: (2024)
CogniEdit: Dense Gradient Flow Optimization for Fine-Grained Image Editing
par: Li, Yan, et autres
Publié: (2025)
par: Li, Yan, et autres
Publié: (2025)
Documents similaires
-
Learning Gaussian Data Augmentation in Feature Space for One-shot Object Detection in Manga
par: Taniguchi, Takara, et autres
Publié: (2024) -
Seeking Flat Minima with Mean Teacher on Semi- and Weakly-Supervised Domain Generalization for Object Detection
par: Furuta, Ryosuke, et autres
Publié: (2023) -
MangaFlow: An End-to-End Agentic Framework for Controllable Story to Manga Generation
par: Wang, Muyao, et autres
Publié: (2026) -
Diffusion-Based Conditional Image Editing through Optimized Inference with Guidance
par: Lee, Hyunsoo, et autres
Publié: (2024) -
EgoInstruct: An Egocentric Video Dataset of Face-to-face Instructional Interactions with Multi-modal LLM Benchmarking
par: Sakai, Yuki, et autres
Publié: (2025)