PosBridge: Multi-View Positional Embedding Transplant for Identity-Aware Image Editing
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Xiong, Peilin, Chen, Junwen, Yuan, Honghui, Yanai, Keiji |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
BRIDGE: Background Routing and Isolated Discrete Gating for Coarse-Mask Local Editing
par: Xiong, Peilin, et autres
Publié: (2026)
par: Xiong, Peilin, et autres
Publié: (2026)
HOI-R1: Exploring the Potential of Multimodal Large Language Models for Human-Object Interaction Detection
par: Chen, Junwen, et autres
Publié: (2025)
par: Chen, Junwen, et autres
Publié: (2025)
SceneTextStylizer: A Training-Free Scene Text Style Transfer Framework with Diffusion Model
par: Yuan, Honghui, et autres
Publié: (2025)
par: Yuan, Honghui, et autres
Publié: (2025)
Focusing on what to decode and what to train: SOV Decoding with Specific Target Guided DeNoising and Vision Language Advisor
par: Chen, Junwen, et autres
Publié: (2023)
par: Chen, Junwen, et autres
Publié: (2023)
Point-MF: One-step Point Cloud Generation from a Single Image via Mean Flows
par: Baba, Yuta, et autres
Publié: (2026)
par: Baba, Yuta, et autres
Publié: (2026)
PrismLayers: Open Data for High-Quality Multi-Layer Transparent Image Generative Models
par: Chen, Junwen, et autres
Publié: (2025)
par: Chen, Junwen, et autres
Publié: (2025)
Efficient Spatial-Temporal Focal Adapter with SSM for Temporal Action Detection
par: Qiu, Yicheng, et autres
Publié: (2026)
par: Qiu, Yicheng, et autres
Publié: (2026)
SIMMER: Cross-Modal Food Image--Recipe Retrieval via MLLM-Based Embedding
par: Gomi, Keisuke, et autres
Publié: (2026)
par: Gomi, Keisuke, et autres
Publié: (2026)
RCNet: Deep Recurrent Collaborative Network for Multi-View Low-Light Image Enhancement
par: Luo, Hao, et autres
Publié: (2024)
par: Luo, Hao, et autres
Publié: (2024)
Plasticine3D: 3D Non-Rigid Editing with Text Guidance by Multi-View Embedding Optimization
par: Chen, Yige, et autres
Publié: (2023)
par: Chen, Yige, et autres
Publié: (2023)
ViCA-NeRF: View-Consistency-Aware 3D Editing of Neural Radiance Fields
par: Dong, Jiahua, et autres
Publié: (2024)
par: Dong, Jiahua, et autres
Publié: (2024)
Multi-View Large Reconstruction Model via Geometry-Aware Positional Encoding and Attention
par: Li, Mengfei, et autres
Publié: (2024)
par: Li, Mengfei, et autres
Publié: (2024)
DVPE: Divided View Position Embedding for Multi-View 3D Object Detection
par: Wang, Jiasen, et autres
Publié: (2024)
par: Wang, Jiasen, et autres
Publié: (2024)
MVInpainter: Learning Multi-View Consistent Inpainting to Bridge 2D and 3D Editing
par: Cao, Chenjie, et autres
Publié: (2024)
par: Cao, Chenjie, et autres
Publié: (2024)
Positional Embedding-Aware Activations
par: Shah, Kathan, et autres
Publié: (2023)
par: Shah, Kathan, et autres
Publié: (2023)
LangBridge: Interpreting Image as a Combination of Language Embeddings
par: Liao, Jiaqi, et autres
Publié: (2025)
par: Liao, Jiaqi, et autres
Publié: (2025)
ViewBridge:Revisiting Cross-View Localization from Image Matching
par: Xia, Panwang, et autres
Publié: (2025)
par: Xia, Panwang, et autres
Publié: (2025)
FQ-PETR: Fully Quantized Position Embedding Transformation for Multi-View 3D Object Detection
par: Yu, Jiangyong, et autres
Publié: (2025)
par: Yu, Jiangyong, et autres
Publié: (2025)
Coupled Diffusion Sampling for Training-Free Multi-View Image Editing
par: Alzayer, Hadi, et autres
Publié: (2025)
par: Alzayer, Hadi, et autres
Publié: (2025)
PositionIC: Unified Position and Identity Consistency for Image Customization
par: Hu, Junjie, et autres
Publié: (2025)
par: Hu, Junjie, et autres
Publié: (2025)
FreqPDE: Rethinking Positional Depth Embedding for Multi-View 3D Object Detection Transformers
par: Su, Haisheng, et autres
Publié: (2025)
par: Su, Haisheng, et autres
Publié: (2025)
Localized Gaussian Splatting Editing with Contextual Awareness
par: Xiao, Hanyuan, et autres
Publié: (2024)
par: Xiao, Hanyuan, et autres
Publié: (2024)
GeoBridge: A Semantic-Anchored Multi-View Foundation Model Bridging Images and Text for Geo-Localization
par: Song, Zixuan, et autres
Publié: (2025)
par: Song, Zixuan, et autres
Publié: (2025)
CAMEO: A Conditional and Quality-Aware Multi-Agent Image Editing Orchestrator
par: Pu, Yuhan, et autres
Publié: (2026)
par: Pu, Yuhan, et autres
Publié: (2026)
EarthBridge: A Solution for 4th Multi-modal Aerial View Image Challenge Translation Track
par: Chen, Zhenyuan, et autres
Publié: (2026)
par: Chen, Zhenyuan, et autres
Publié: (2026)
InstaFace: Identity-Preserving Facial Editing with Single Image Inference
par: Khan, MD Wahiduzzaman, et autres
Publié: (2025)
par: Khan, MD Wahiduzzaman, et autres
Publié: (2025)
LIPE: Learning Personalized Identity Prior for Non-rigid Image Editing
par: Liu, Aoyang, et autres
Publié: (2024)
par: Liu, Aoyang, et autres
Publié: (2024)
Advanced Image Segmentation Techniques for Neural Activity Detection via C-fos Immediate Early Gene Expression
par: Cai, Peilin
Publié: (2023)
par: Cai, Peilin
Publié: (2023)
SGEdit: Bridging LLM with Text2Image Generative Model for Scene Graph-based Image Editing
par: Zhang, Zhiyuan, et autres
Publié: (2024)
par: Zhang, Zhiyuan, et autres
Publié: (2024)
SceneCrafter: Controllable Multi-View Driving Scene Editing
par: Zhu, Zehao, et autres
Publié: (2025)
par: Zhu, Zehao, et autres
Publié: (2025)
Addressing Text Embedding Leakage in Diffusion-based Image Editing
par: Mun, Sunung, et autres
Publié: (2024)
par: Mun, Sunung, et autres
Publié: (2024)
PASTE: Physics-Aware Scattering Topology Embedding Framework for SAR Object Detection
par: Chen, Jiacheng, et autres
Publié: (2026)
par: Chen, Jiacheng, et autres
Publié: (2026)
MagicView: Multi-View Consistent Identity Customization via Priors-Guided In-Context Learning
par: Li, Hengjia, et autres
Publié: (2025)
par: Li, Hengjia, et autres
Publié: (2025)
FQ-PETR: Fully Quantized Position Embedding Transformation for Multi-View 3D Object Detection
par: Yu, Jiangyong, et autres
Publié: (2025)
par: Yu, Jiangyong, et autres
Publié: (2025)
Physically Aware 360$^\circ$ View Generation from a Single Image using Disentangled Scene Embeddings
par: KV, Karthikeya, et autres
Publié: (2025)
par: KV, Karthikeya, et autres
Publié: (2025)
InstructMix2Mix: Consistent Sparse-View Editing Through Multi-View Model Personalization
par: Gilo, Daniel, et autres
Publié: (2025)
par: Gilo, Daniel, et autres
Publié: (2025)
Learning Where to Embed: Noise-Aware Positional Embedding for Query Retrieval in Small-Object Detection
par: Zeng, Yangchen, et autres
Publié: (2026)
par: Zeng, Yangchen, et autres
Publié: (2026)
Multi-turn Consistent Image Editing
par: Zhou, Zijun, et autres
Publié: (2025)
par: Zhou, Zijun, et autres
Publié: (2025)
AnyPhoto: Multi-Person Identity Preserving Image Generation with ID Adaptive Modulation on Location Canvas
par: Yuan, Longhui
Publié: (2026)
par: Yuan, Longhui
Publié: (2026)
BridgeIV: Bridging Customized Image and Video Generation through Test-Time Autoregressive Identity Propagation
par: Hu, Panwen, et autres
Publié: (2025)
par: Hu, Panwen, et autres
Publié: (2025)
Documents similaires
-
BRIDGE: Background Routing and Isolated Discrete Gating for Coarse-Mask Local Editing
par: Xiong, Peilin, et autres
Publié: (2026) -
HOI-R1: Exploring the Potential of Multimodal Large Language Models for Human-Object Interaction Detection
par: Chen, Junwen, et autres
Publié: (2025) -
SceneTextStylizer: A Training-Free Scene Text Style Transfer Framework with Diffusion Model
par: Yuan, Honghui, et autres
Publié: (2025) -
Focusing on what to decode and what to train: SOV Decoding with Specific Target Guided DeNoising and Vision Language Advisor
par: Chen, Junwen, et autres
Publié: (2023) -
Point-MF: One-step Point Cloud Generation from a Single Image via Mean Flows
par: Baba, Yuta, et autres
Publié: (2026)