HiGS: Hierarchical Generative Scene Framework for Multi-Step Associative Semantic Spatial Composition
Fuente:
arXiv
Guardado en:
| Autores principales: | Hong, Jiacheng, Wu, Kunzhen, Yu, Mingrui, Gu, Yichao, Xue, Shengze, Xiao, Shuangjiu, Dong, Deli |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Real-Time Interactive Hybrid Ocean: Spectrum-Consistent Wave Particle-FFT Coupling
por: Xue, Shengze, et al.
Publicado: (2025)
por: Xue, Shengze, et al.
Publicado: (2025)
HiScene: Creating Hierarchical 3D Scenes with Isometric View Generation
por: Dong, Wenqi, et al.
Publicado: (2025)
por: Dong, Wenqi, et al.
Publicado: (2025)
GTLR-GS: Geometry-Texture Aware LiDAR-Regularized 3D Gaussian Splatting for Realistic Scene Reconstruction
por: Fang, Yan, et al.
Publicado: (2026)
por: Fang, Yan, et al.
Publicado: (2026)
Evolutionary Multimodal Reasoning via Hierarchical Semantic Representation for Intent Recognition
por: Zhou, Qianrui, et al.
Publicado: (2026)
por: Zhou, Qianrui, et al.
Publicado: (2026)
HiQuE: Hierarchical Question Embedding Network for Multimodal Depression Detection
por: Jung, Juho, et al.
Publicado: (2024)
por: Jung, Juho, et al.
Publicado: (2024)
Traits Run Deep: Enhancing Personality Assessment via Psychology-Guided LLM Representations and Multimodal Apparent Behaviors
por: Li, Jia, et al.
Publicado: (2025)
por: Li, Jia, et al.
Publicado: (2025)
Multi-modal and Metadata Capture Model for Micro Video Popularity Prediction
por: Lu, Jiacheng, et al.
Publicado: (2025)
por: Lu, Jiacheng, et al.
Publicado: (2025)
Automated Radiology Report Generation Based on Topic-Keyword Semantic Guidance
por: Xiao, Jing, et al.
Publicado: (2025)
por: Xiao, Jing, et al.
Publicado: (2025)
DiffCL: A Diffusion-Based Contrastive Learning Framework with Semantic Alignment for Multimodal Recommendations
por: Song, Qiya, et al.
Publicado: (2025)
por: Song, Qiya, et al.
Publicado: (2025)
Agent Journey Beyond RGB: Hierarchical Semantic-Spatial Representation Enrichment for Vision-and-Language Navigation
por: Zhang, Xuesong, et al.
Publicado: (2024)
por: Zhang, Xuesong, et al.
Publicado: (2024)
L3GS: Layered 3D Gaussian Splats for Efficient 3D Scene Delivery
por: Tsai, Yi-Zhen, et al.
Publicado: (2025)
por: Tsai, Yi-Zhen, et al.
Publicado: (2025)
Short-Form Video Viewing Behavior Analysis and Multi-Step Viewing Time Prediction
por: Yen, Vu Thi Hai, et al.
Publicado: (2026)
por: Yen, Vu Thi Hai, et al.
Publicado: (2026)
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
por: Zhang, Zhenxing, et al.
Publicado: (2024)
por: Zhang, Zhenxing, et al.
Publicado: (2024)
SRA: Semantic Relation-Aware Flowchart Question Answering
por: Li, Xinyu, et al.
Publicado: (2026)
por: Li, Xinyu, et al.
Publicado: (2026)
HiGS: A Hierarchical Rendering Architecture for Real-Time 3D Gaussian Splatting
por: Pająk, Dawid, et al.
Publicado: (2026)
por: Pająk, Dawid, et al.
Publicado: (2026)
Voxel-GS: Quantized Scaffold Gaussian Splatting Compression with Run-Length Coding
por: Fu, Chunyang, et al.
Publicado: (2025)
por: Fu, Chunyang, et al.
Publicado: (2025)
AdaptaGen: Domain-Specific Image Generation through Hierarchical Semantic Optimization Framework
por: Zhang, Suoxiang, et al.
Publicado: (2025)
por: Zhang, Suoxiang, et al.
Publicado: (2025)
MViR: Multi-View Visual-Semantic Representation for Fake News Detection
por: Liang, Haochen, et al.
Publicado: (2026)
por: Liang, Haochen, et al.
Publicado: (2026)
Hierarchical Action Recognition: A Contrastive Video-Language Approach with Hierarchical Interactions
por: Zhang, Rui, et al.
Publicado: (2024)
por: Zhang, Rui, et al.
Publicado: (2024)
CineAGI: Character-Consistent Movie Creation through LLM-Orchestrated Multi-Modal Generation and Cross-Scene Integration
por: Xie, Tianyidan, et al.
Publicado: (2026)
por: Xie, Tianyidan, et al.
Publicado: (2026)
HiDE: Hierarchical Dictionary-Based Entropy Modeling for Learned Image Compression
por: Xiong, Haoxuan, et al.
Publicado: (2026)
por: Xiong, Haoxuan, et al.
Publicado: (2026)
Multi Agents Semantic Emotion Aligned Music to Image Generation with Music Derived Captions
por: Shi, Junchang, et al.
Publicado: (2025)
por: Shi, Junchang, et al.
Publicado: (2025)
CPSL: Representing Volumetric Video via Content-Promoted Scene Layers
por: Hu, Kaiyuan, et al.
Publicado: (2025)
por: Hu, Kaiyuan, et al.
Publicado: (2025)
Robust Symbolic Reasoning for Visual Narratives via Hierarchical and Semantically Normalized Knowledge Graphs
por: Chen, Yi-Chun
Publicado: (2025)
por: Chen, Yi-Chun
Publicado: (2025)
ConvBench: A Multi-Turn Conversation Evaluation Benchmark with Hierarchical Capability for Large Vision-Language Models
por: Liu, Shuo, et al.
Publicado: (2024)
por: Liu, Shuo, et al.
Publicado: (2024)
FLARE: Full-Modality Long-Video Audiovisual Retrieval Benchmark with User-Simulated Queries
por: You, Qijie, et al.
Publicado: (2026)
por: You, Qijie, et al.
Publicado: (2026)
ProMSC-MIS: Prompt-based Multimodal Semantic Communication for Multi-Spectral Image Segmentation
por: Zhang, Haoshuo, et al.
Publicado: (2025)
por: Zhang, Haoshuo, et al.
Publicado: (2025)
UniScene: Multi-Camera Unified Pre-training via 3D Scene Reconstruction for Autonomous Driving
por: Min, Chen, et al.
Publicado: (2023)
por: Min, Chen, et al.
Publicado: (2023)
Dynamic Interaction-Aware and Causality-Disentangled Framework for Multimodal Sentiment Analysis
por: Dong, Guangyuan, et al.
Publicado: (2026)
por: Dong, Guangyuan, et al.
Publicado: (2026)
Think before You Leap: Content-Aware Low-Cost Edge-Assisted Video Semantic Segmentation
por: Yan, Mingxuan, et al.
Publicado: (2024)
por: Yan, Mingxuan, et al.
Publicado: (2024)
M3TR: Temporal Retrieval Enhanced Multi-Modal Micro-video Popularity Prediction
por: Lu, Jiacheng, et al.
Publicado: (2024)
por: Lu, Jiacheng, et al.
Publicado: (2024)
SimLabel: Similarity-Weighted Iterative Framework for Multi-annotator Learning with Missing Annotations
por: Zhang, Liyun, et al.
Publicado: (2025)
por: Zhang, Liyun, et al.
Publicado: (2025)
Efficient Prompt Tuning for Hierarchical Ingredient Recognition
por: Gui, Yinxuan, et al.
Publicado: (2025)
por: Gui, Yinxuan, et al.
Publicado: (2025)
SVD: Spatial Video Dataset
por: Izadimehr, M. H., et al.
Publicado: (2025)
por: Izadimehr, M. H., et al.
Publicado: (2025)
GaussianForest: Hierarchical-Hybrid 3D Gaussian Splatting for Compressed Scene Modeling
por: Zhang, Fengyi, et al.
Publicado: (2024)
por: Zhang, Fengyi, et al.
Publicado: (2024)
SCENEFORGE: Enhancing 3D-text alignment with Structured Scene Compositions
por: Sbrolli, Cristian, et al.
Publicado: (2025)
por: Sbrolli, Cristian, et al.
Publicado: (2025)
Multimodal Interaction Modeling via Self-Supervised Multi-Task Learning for Review Helpfulness Prediction
por: Gong, HongLin, et al.
Publicado: (2024)
por: Gong, HongLin, et al.
Publicado: (2024)
Mixture-of-Prompt-Experts for Multi-modal Semantic Understanding
por: Wu, Zichen, et al.
Publicado: (2024)
por: Wu, Zichen, et al.
Publicado: (2024)
QuMATL: Query-based Multi-annotator Tendency Learning
por: Zhang, Liyun, et al.
Publicado: (2025)
por: Zhang, Liyun, et al.
Publicado: (2025)
HiGS: History-Guided Sampling for Plug-and-Play Enhancement of Diffusion Models
por: Sadat, Seyedmorteza, et al.
Publicado: (2025)
por: Sadat, Seyedmorteza, et al.
Publicado: (2025)
Ejemplares similares
-
Real-Time Interactive Hybrid Ocean: Spectrum-Consistent Wave Particle-FFT Coupling
por: Xue, Shengze, et al.
Publicado: (2025) -
HiScene: Creating Hierarchical 3D Scenes with Isometric View Generation
por: Dong, Wenqi, et al.
Publicado: (2025) -
GTLR-GS: Geometry-Texture Aware LiDAR-Regularized 3D Gaussian Splatting for Realistic Scene Reconstruction
por: Fang, Yan, et al.
Publicado: (2026) -
Evolutionary Multimodal Reasoning via Hierarchical Semantic Representation for Intent Recognition
por: Zhou, Qianrui, et al.
Publicado: (2026) -
HiQuE: Hierarchical Question Embedding Network for Multimodal Depression Detection
por: Jung, Juho, et al.
Publicado: (2024)