SCORP: Scene-Consistent Object Refinement via Proxy Generation and Tuning
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Ziwei, Liu, Ziling, Huang, Zitong, Gao, Mingqi, Zheng, Feng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Leveraging Geometric Priors for Unaligned Scene Change Detection
por: Liu, Ziling, et al.
Publicado: (2025)
por: Liu, Ziling, et al.
Publicado: (2025)
Place Anything into Any Video
por: Liu, Ziling, et al.
Publicado: (2024)
por: Liu, Ziling, et al.
Publicado: (2024)
Free4D: Tuning-free 4D Scene Generation with Spatial-Temporal Consistency
por: Liu, Tianqi, et al.
Publicado: (2025)
por: Liu, Tianqi, et al.
Publicado: (2025)
ArtiWorld: LLM-Driven Articulation of 3D Objects in Scenes
por: Yang, Yixuan, et al.
Publicado: (2025)
por: Yang, Yixuan, et al.
Publicado: (2025)
Point Linguist Model: Segment Any Object via Bridged Large 3D-Language Model
por: Huang, Zhuoxu, et al.
Publicado: (2025)
por: Huang, Zhuoxu, et al.
Publicado: (2025)
Few-Shot Referring Video Single- and Multi-Object Segmentation via Cross-Modal Affinity with Instance Sequence Matching
por: Liu, Heng, et al.
Publicado: (2025)
por: Liu, Heng, et al.
Publicado: (2025)
TIGeR: Text-Instructed Generation and Refinement for Template-Free Hand-Object Interaction
por: Huang, Yiyao, et al.
Publicado: (2025)
por: Huang, Yiyao, et al.
Publicado: (2025)
InfBaGel: Human-Object-Scene Interaction Generation with Dynamic Perception and Iterative Refinement
por: Zou, Yude, et al.
Publicado: (2026)
por: Zou, Yude, et al.
Publicado: (2026)
GIFT: Generated Indoor video frames for Texture-less point tracking
por: Huang, Jianzheng, et al.
Publicado: (2025)
por: Huang, Jianzheng, et al.
Publicado: (2025)
OptiScene: LLM-driven Indoor Scene Layout Generation via Scaled Human-aligned Data Synthesis and Multi-Stage Preference Optimization
por: Yang, Yixuan, et al.
Publicado: (2025)
por: Yang, Yixuan, et al.
Publicado: (2025)
Re-Prompting SAM 3 via Object Retrieval: 3rd of the 5th PVUW MOSE Track
por: Gao, Mingqi, et al.
Publicado: (2026)
por: Gao, Mingqi, et al.
Publicado: (2026)
ProxyTransformation: Preshaping Point Cloud Manifold With Proxy Attention For 3D Visual Grounding
por: Peng, Qihang, et al.
Publicado: (2025)
por: Peng, Qihang, et al.
Publicado: (2025)
PCSR: Pseudo-label Consistency-Guided Sample Refinement for Noisy Correspondence Learning
por: Liu, Zhuoyao, et al.
Publicado: (2025)
por: Liu, Zhuoyao, et al.
Publicado: (2025)
Delving into Dynamic Scene Cue-Consistency for Robust 3D Multi-Object Tracking
por: Zhang, Haonan, et al.
Publicado: (2025)
por: Zhang, Haonan, et al.
Publicado: (2025)
PhyScene3D: Physically Consistent Interactive 3D Tabletop Scene Generation
por: Chen, Weixing, et al.
Publicado: (2026)
por: Chen, Weixing, et al.
Publicado: (2026)
Show Me When and Where: Towards Referring Video Object Segmentation in the Wild
por: Gao, Mingqi, et al.
Publicado: (2026)
por: Gao, Mingqi, et al.
Publicado: (2026)
Material Anything: Generating Materials for Any 3D Object via Diffusion
por: Huang, Xin, et al.
Publicado: (2024)
por: Huang, Xin, et al.
Publicado: (2024)
3D Scene Generation: A Survey
por: Wen, Beichen, et al.
Publicado: (2025)
por: Wen, Beichen, et al.
Publicado: (2025)
Style-Consistent 3D Indoor Scene Synthesis with Decoupled Objects
por: Zhang, Yunfan, et al.
Publicado: (2024)
por: Zhang, Yunfan, et al.
Publicado: (2024)
Learning Trajectory-Aware Multimodal Large Language Models for Video Reasoning Segmentation
por: Luo, Jingnan, et al.
Publicado: (2026)
por: Luo, Jingnan, et al.
Publicado: (2026)
SceneDecorator: Towards Scene-Oriented Story Generation with Scene Planning and Scene Consistency
por: Song, Quanjian, et al.
Publicado: (2025)
por: Song, Quanjian, et al.
Publicado: (2025)
ReSeDis: A Dataset for Referring-based Object Search across Large-Scale Image Collections
por: Huang, Ziling, et al.
Publicado: (2025)
por: Huang, Ziling, et al.
Publicado: (2025)
Generative Photographic Control for Scene-Consistent Video Cinematic Editing
por: Sun, Huiqiang, et al.
Publicado: (2025)
por: Sun, Huiqiang, et al.
Publicado: (2025)
ProxyDet: Synthesizing Proxy Novel Classes via Classwise Mixup for Open-Vocabulary Object Detection
por: Jeong, Joonhyun, et al.
Publicado: (2023)
por: Jeong, Joonhyun, et al.
Publicado: (2023)
THU-Warwick Submission for EPIC-KITCHEN Challenge 2025: Semi-Supervised Video Object Segmentation
por: Gao, Mingqi, et al.
Publicado: (2025)
por: Gao, Mingqi, et al.
Publicado: (2025)
Crowd-SAM: SAM as a Smart Annotator for Object Detection in Crowded Scenes
por: Cai, Zhi, et al.
Publicado: (2024)
por: Cai, Zhi, et al.
Publicado: (2024)
Scene123: One Prompt to 3D Scene Generation via Video-Assisted and Consistency-Enhanced MAE
por: Yang, Yiying, et al.
Publicado: (2024)
por: Yang, Yiying, et al.
Publicado: (2024)
ConsistentRFT: Reducing Visual Hallucinations in Flow-based Reinforcement Fine-Tuning
por: Tan, Xiaofeng, et al.
Publicado: (2026)
por: Tan, Xiaofeng, et al.
Publicado: (2026)
MVPainter: Accurate and Detailed 3D Texture Generation via Multi-View Diffusion with Geometric Control
por: Shao, Mingqi, et al.
Publicado: (2025)
por: Shao, Mingqi, et al.
Publicado: (2025)
Interpretable Logical Anomaly Classification via Constraint Decomposition and Instruction Fine-Tuning
por: Zhang, Xufei, et al.
Publicado: (2026)
por: Zhang, Xufei, et al.
Publicado: (2026)
Vectorized Video Representation with Easy Editing via Hierarchical Spatio-Temporally Consistent Proxy Embedding
por: Chen, Ye, et al.
Publicado: (2025)
por: Chen, Ye, et al.
Publicado: (2025)
Ensemble Foreground Management for Unsupervised Object Discovery
por: Wu, Ziling, et al.
Publicado: (2025)
por: Wu, Ziling, et al.
Publicado: (2025)
Shape-for-Motion: Precise and Consistent Video Editing with 3D Proxy
por: Liu, Yuhao, et al.
Publicado: (2025)
por: Liu, Yuhao, et al.
Publicado: (2025)
CineVerse: Consistent Keyframe Synthesis for Cinematic Scene Composition
por: Phung, Quynh, et al.
Publicado: (2025)
por: Phung, Quynh, et al.
Publicado: (2025)
Setting the Stage: Text-Driven Scene-Consistent Image Generation
por: Xie, Cong, et al.
Publicado: (2025)
por: Xie, Cong, et al.
Publicado: (2025)
GBR: Generative Bundle Refinement for High-fidelity Gaussian Splatting with Enhanced Mesh Reconstruction
por: Zhang, Jianing, et al.
Publicado: (2024)
por: Zhang, Jianing, et al.
Publicado: (2024)
Consistent Instance Field for Dynamic Scene Understanding
por: Wu, Junyi, et al.
Publicado: (2025)
por: Wu, Junyi, et al.
Publicado: (2025)
ScenePainter: Semantically Consistent Perpetual 3D Scene Generation with Concept Relation Alignment
por: Xia, Chong, et al.
Publicado: (2025)
por: Xia, Chong, et al.
Publicado: (2025)
1st Place Solution for MeViS Track in CVPR 2024 PVUW Workshop: Motion Expression guided Video Segmentation
por: Gao, Mingqi, et al.
Publicado: (2024)
por: Gao, Mingqi, et al.
Publicado: (2024)
Object-level Scene Deocclusion
por: Liu, Zhengzhe, et al.
Publicado: (2024)
por: Liu, Zhengzhe, et al.
Publicado: (2024)
Ejemplares similares
-
Leveraging Geometric Priors for Unaligned Scene Change Detection
por: Liu, Ziling, et al.
Publicado: (2025) -
Place Anything into Any Video
por: Liu, Ziling, et al.
Publicado: (2024) -
Free4D: Tuning-free 4D Scene Generation with Spatial-Temporal Consistency
por: Liu, Tianqi, et al.
Publicado: (2025) -
ArtiWorld: LLM-Driven Articulation of 3D Objects in Scenes
por: Yang, Yixuan, et al.
Publicado: (2025) -
Point Linguist Model: Segment Any Object via Bridged Large 3D-Language Model
por: Huang, Zhuoxu, et al.
Publicado: (2025)