Syllables to Scenes: Literary-Guided Free-Viewpoint 3D Scene Synthesis from Japanese Haiku
Fuente:
arXiv
Salvato in:
| Autori principali: | Yu, Chunan, Han, Yidong, Ding, Chaotao, Zang, Ying, Zhu, Lanyun, Chen, Xinhao, Li, Zejian, Xu, Renjun, Chen, Tianrun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Magic3DSketch: Create Colorful 3D Models From Sketch-Based 3D Modeling Guided by Text and Language-Image Pre-Training
di: Zang, Ying, et al.
Pubblicazione: (2024)
di: Zang, Ying, et al.
Pubblicazione: (2024)
xLSTM-UNet can be an Effective 2D & 3D Medical Image Segmentation Backbone with Vision-LSTM (ViL) better than its Mamba Counterpart
di: Chen, Tianrun, et al.
Pubblicazione: (2024)
di: Chen, Tianrun, et al.
Pubblicazione: (2024)
SAM2-Adapter: Evaluating & Adapting Segment Anything 2 in Downstream Tasks: Camouflage, Shadow, Medical Image Segmentation, and More
di: Chen, Tianrun, et al.
Pubblicazione: (2024)
di: Chen, Tianrun, et al.
Pubblicazione: (2024)
Robust 4D Visual Geometry Transformer with Uncertainty-Aware Priors
di: Zang, Ying, et al.
Pubblicazione: (2026)
di: Zang, Ying, et al.
Pubblicazione: (2026)
HD-VGGT: High-Resolution Visual Geometry Transformer
di: Chen, Tianrun, et al.
Pubblicazione: (2026)
di: Chen, Tianrun, et al.
Pubblicazione: (2026)
Reasoning3D -- Grounding and Reasoning in 3D: Fine-Grained Zero-Shot Open-Vocabulary 3D Reasoning Part Segmentation via Large Vision-Language Models
di: Chen, Tianrun, et al.
Pubblicazione: (2024)
di: Chen, Tianrun, et al.
Pubblicazione: (2024)
4DVGGT-D: 4D Visual Geometry Transformer with Improved Dynamic Depth Estimation
di: Zang, Ying, et al.
Pubblicazione: (2026)
di: Zang, Ying, et al.
Pubblicazione: (2026)
Img2CAD: Conditioned 3D CAD Model Generation from Single Image with Structured Visual Geometry
di: Chen, Tianrun, et al.
Pubblicazione: (2024)
di: Chen, Tianrun, et al.
Pubblicazione: (2024)
From Air to Wear: Personalized 3D Digital Fashion with AR/VR Immersive 3D Sketching
di: Zang, Ying, et al.
Pubblicazione: (2025)
di: Zang, Ying, et al.
Pubblicazione: (2025)
SAM3-Adapter: Efficient Adaptation of Segment Anything 3 for Camouflage Object Segmentation, Shadow Detection, and Medical Image Segmentation
di: Chen, Tianrun, et al.
Pubblicazione: (2025)
di: Chen, Tianrun, et al.
Pubblicazione: (2025)
Let Human Sketches Help: Empowering Challenging Image Segmentation Task with Freehand Sketches
di: Zang, Ying, et al.
Pubblicazione: (2025)
di: Zang, Ying, et al.
Pubblicazione: (2025)
Breaking the Box: Enhancing Remote Sensing Image Segmentation with Freehand Sketches
di: Zang, Ying, et al.
Pubblicazione: (2025)
di: Zang, Ying, et al.
Pubblicazione: (2025)
FreeGen: Feed-Forward Reconstruction-Generation Co-Training for Free-Viewpoint Driving Scene Synthesis
di: Chen, Shijie, et al.
Pubblicazione: (2025)
di: Chen, Shijie, et al.
Pubblicazione: (2025)
Distilling Diffusion Models to Efficient 3D LiDAR Scene Completion
di: Zhang, Shengyuan, et al.
Pubblicazione: (2024)
di: Zhang, Shengyuan, et al.
Pubblicazione: (2024)
StreamCacheVGGT: Streaming Visual Geometry Transformers with Robust Scoring and Hybrid Cache Compression
di: Liu, Xuanyi, et al.
Pubblicazione: (2026)
di: Liu, Xuanyi, et al.
Pubblicazione: (2026)
RESMatch: Referring Expression Segmentation in a Semi-Supervised Manner
di: Zang, Ying, et al.
Pubblicazione: (2024)
di: Zang, Ying, et al.
Pubblicazione: (2024)
FreeScene: Mixed Graph Diffusion for 3D Scene Synthesis from Free Prompts
di: Bai, Tongyuan, et al.
Pubblicazione: (2025)
di: Bai, Tongyuan, et al.
Pubblicazione: (2025)
Optimizing 3D Gaussian Splatting for Sparse Viewpoint Scene Reconstruction
di: Chen, Shen, et al.
Pubblicazione: (2024)
di: Chen, Shen, et al.
Pubblicazione: (2024)
Fusing in 3D: Free-Viewpoint Fusion Rendering with a 3D Infrared-Visible Scene Representation
di: Yang, Chao, et al.
Pubblicazione: (2026)
di: Yang, Chao, et al.
Pubblicazione: (2026)
Retrv-R1: A Reasoning-Driven MLLM Framework for Universal and Efficient Multimodal Retrieval
di: Zhu, Lanyun, et al.
Pubblicazione: (2025)
di: Zhu, Lanyun, et al.
Pubblicazione: (2025)
Not Every Patch is Needed: Towards a More Efficient and Effective Backbone for Video-based Person Re-identification
di: Zhu, Lanyun, et al.
Pubblicazione: (2025)
di: Zhu, Lanyun, et al.
Pubblicazione: (2025)
LLaFS: When Large Language Models Meet Few-Shot Segmentation
di: Zhu, Lanyun, et al.
Pubblicazione: (2023)
di: Zhu, Lanyun, et al.
Pubblicazione: (2023)
VIZOR: Viewpoint-Invariant Zero-Shot Scene Graph Generation for 3D Scene Reasoning
di: Madhavaram, Vivek, et al.
Pubblicazione: (2026)
di: Madhavaram, Vivek, et al.
Pubblicazione: (2026)
Multiview Scene Graph
di: Zhang, Juexiao, et al.
Pubblicazione: (2024)
di: Zhang, Juexiao, et al.
Pubblicazione: (2024)
IBD: Alleviating Hallucinations in Large Vision-Language Models via Image-Biased Decoding
di: Zhu, Lanyun, et al.
Pubblicazione: (2024)
di: Zhu, Lanyun, et al.
Pubblicazione: (2024)
SceneCraft: Layout-Guided 3D Scene Generation
di: Yang, Xiuyu, et al.
Pubblicazione: (2024)
di: Yang, Xiuyu, et al.
Pubblicazione: (2024)
Painting 3D Nature in 2D: View Synthesis of Natural Scenes from a Single Semantic Mask
di: Zhang, Shangzan, et al.
Pubblicazione: (2023)
di: Zhang, Shangzan, et al.
Pubblicazione: (2023)
Functional 3D Scene Synthesis through Human-Scene Optimization
di: Wei, Yao, et al.
Pubblicazione: (2025)
di: Wei, Yao, et al.
Pubblicazione: (2025)
Graph-Guided Dual-Level Augmentation for 3D Scene Segmentation
di: Lin, Hongbin, et al.
Pubblicazione: (2025)
di: Lin, Hongbin, et al.
Pubblicazione: (2025)
Text‐Guided Interactive Scene Synthesis with Scene Prior Guidance
di: Shaoheng Fang, et al.
Pubblicazione: (2025)
di: Shaoheng Fang, et al.
Pubblicazione: (2025)
RAVEN: Robust Advertisement Video Violation Temporal Grounding via Reinforcement Reasoning
di: Ji, Deyi, et al.
Pubblicazione: (2025)
di: Ji, Deyi, et al.
Pubblicazione: (2025)
GraphDreamer: Compositional 3D Scene Synthesis from Scene Graphs
di: Gao, Gege, et al.
Pubblicazione: (2023)
di: Gao, Gege, et al.
Pubblicazione: (2023)
PanopticNeRF-360: Panoramic 3D-to-2D Label Transfer in Urban Scenes
di: Fu, Xiao, et al.
Pubblicazione: (2023)
di: Fu, Xiao, et al.
Pubblicazione: (2023)
Human Motion Synthesis in 3D Scenes via Unified Scene Semantic Occupancy
di: Jingyu, Gong, et al.
Pubblicazione: (2025)
di: Jingyu, Gong, et al.
Pubblicazione: (2025)
Seen2Scene: Completing Realistic 3D Scenes with Visibility-Guided Flow
di: Meng, Quan, et al.
Pubblicazione: (2026)
di: Meng, Quan, et al.
Pubblicazione: (2026)
Dense Point Clouds Matter: Dust-GS for Scene Reconstruction from Sparse Viewpoints
di: Chen, Shan, et al.
Pubblicazione: (2024)
di: Chen, Shan, et al.
Pubblicazione: (2024)
Modeling Ambient Scene Dynamics for Free-view Synthesis
di: Shih, Meng-Li, et al.
Pubblicazione: (2024)
di: Shih, Meng-Li, et al.
Pubblicazione: (2024)
BetterScene: 3D Scene Synthesis with Representation-Aligned Generative Model
di: Han, Yuci, et al.
Pubblicazione: (2026)
di: Han, Yuci, et al.
Pubblicazione: (2026)
FreeSplat: Generalizable 3D Gaussian Splatting Towards Free-View Synthesis of Indoor Scenes
di: Wang, Yunsong, et al.
Pubblicazione: (2024)
di: Wang, Yunsong, et al.
Pubblicazione: (2024)
SceneCompleter: Dense 3D Scene Completion for Generative Novel View Synthesis
di: Chen, Weiliang, et al.
Pubblicazione: (2025)
di: Chen, Weiliang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Magic3DSketch: Create Colorful 3D Models From Sketch-Based 3D Modeling Guided by Text and Language-Image Pre-Training
di: Zang, Ying, et al.
Pubblicazione: (2024) -
xLSTM-UNet can be an Effective 2D & 3D Medical Image Segmentation Backbone with Vision-LSTM (ViL) better than its Mamba Counterpart
di: Chen, Tianrun, et al.
Pubblicazione: (2024) -
SAM2-Adapter: Evaluating & Adapting Segment Anything 2 in Downstream Tasks: Camouflage, Shadow, Medical Image Segmentation, and More
di: Chen, Tianrun, et al.
Pubblicazione: (2024) -
Robust 4D Visual Geometry Transformer with Uncertainty-Aware Priors
di: Zang, Ying, et al.
Pubblicazione: (2026) -
HD-VGGT: High-Resolution Visual Geometry Transformer
di: Chen, Tianrun, et al.
Pubblicazione: (2026)