Salvato in:
| Autori principali: | Gao, Jialu, Gupta, Mithun Das, Li, Qun, Kshatriya, Raveena, Wilson, Andrew D., Chang, Keng-hao, Kumaravel, Balasaravanan Thoravi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2603.13745 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Grounding Task Assistance with Multimodal Cues from a Single Demonstration
di: Sarch, Gabriel, et al.
Pubblicazione: (2025)
di: Sarch, Gabriel, et al.
Pubblicazione: (2025)
Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames
di: Ravi, Sahithya, et al.
Pubblicazione: (2025)
di: Ravi, Sahithya, et al.
Pubblicazione: (2025)
Doc To The Future: Infomorphs for Interactive, Multimodal Document Transformation and Generation
di: Kumaravel, Balasaravanan Thoravi
Pubblicazione: (2025)
di: Kumaravel, Balasaravanan Thoravi
Pubblicazione: (2025)
BlendScape: Enabling End-User Customization of Video-Conferencing Environments through Generative AI
di: Rajaram, Shwetha, et al.
Pubblicazione: (2024)
di: Rajaram, Shwetha, et al.
Pubblicazione: (2024)
SpaceBlender: Creating Context-Rich Collaborative Spaces Through Generative 3D Scene Blending
di: Numan, Nels, et al.
Pubblicazione: (2024)
di: Numan, Nels, et al.
Pubblicazione: (2024)
Determinantal Point Process as an alternative to NMS
di: Some, Samik, et al.
Pubblicazione: (2020)
di: Some, Samik, et al.
Pubblicazione: (2020)
Creative4U: MLLMs-based Advertising Creative Image Selector with Comparative Reasoning
di: Lin, Yukang, et al.
Pubblicazione: (2025)
di: Lin, Yukang, et al.
Pubblicazione: (2025)
MineNPC-Task: Task Suite for Memory-Aware Minecraft Agents
di: Doss, Tamil Sudaravan Mohan, et al.
Pubblicazione: (2026)
di: Doss, Tamil Sudaravan Mohan, et al.
Pubblicazione: (2026)
Leveraging Large Models to Evaluate Novel Content: A Case Study on Advertisement Creativity
di: Hou, Zhaoyi Joey, et al.
Pubblicazione: (2025)
di: Hou, Zhaoyi Joey, et al.
Pubblicazione: (2025)
Chirpy3D: Part-Aware Multi-View Diffusion for Creative Fine-Grained Object Generation
di: Ng, Kam Woh, et al.
Pubblicazione: (2025)
di: Ng, Kam Woh, et al.
Pubblicazione: (2025)
Unified Unsupervised Salient Object Detection via Knowledge Transfer
di: Yuan, Yao, et al.
Pubblicazione: (2024)
di: Yuan, Yao, et al.
Pubblicazione: (2024)
Uncertainty Guided Refinement for Fine-Grained Salient Object Detection
di: Yuan, Yao, et al.
Pubblicazione: (2025)
di: Yuan, Yao, et al.
Pubblicazione: (2025)
Self-Creative Text-to-Object Generation using Semantic-Aware Spatial Weighting
di: Yu, Yue, et al.
Pubblicazione: (2026)
di: Yu, Yue, et al.
Pubblicazione: (2026)
Dual-Perspective Knowledge Enrichment for Semi-Supervised 3D Object Detection
di: Han, Yucheng, et al.
Pubblicazione: (2024)
di: Han, Yucheng, et al.
Pubblicazione: (2024)
PartCraft: Crafting Creative Objects by Parts
di: Ng, Kam Woh, et al.
Pubblicazione: (2024)
di: Ng, Kam Woh, et al.
Pubblicazione: (2024)
SceneDiff: A Benchmark and Method for Multiview Object Change Detection
di: Wu, Yuqun, et al.
Pubblicazione: (2025)
di: Wu, Yuqun, et al.
Pubblicazione: (2025)
VC-LLM: Automated Advertisement Video Creation from Raw Footage using Multi-modal LLMs
di: Qian, Dongjun, et al.
Pubblicazione: (2025)
di: Qian, Dongjun, et al.
Pubblicazione: (2025)
TP2O: Creative Text Pair-to-Object Generation using Balance Swap-Sampling
di: Li, Jun, et al.
Pubblicazione: (2023)
di: Li, Jun, et al.
Pubblicazione: (2023)
HydraMamba: Multi-Head State Space Model for Global Point Cloud Learning
di: Qu, Kanglin, et al.
Pubblicazione: (2025)
di: Qu, Kanglin, et al.
Pubblicazione: (2025)
A$^3$: Towards Advertising Aesthetic Assessment
di: Ji, Kaiyuan, et al.
Pubblicazione: (2026)
di: Ji, Kaiyuan, et al.
Pubblicazione: (2026)
WSCLoc: Weakly-Supervised Sparse-View Camera Relocalization
di: Wang, Jialu, et al.
Pubblicazione: (2024)
di: Wang, Jialu, et al.
Pubblicazione: (2024)
CRAFT: Designing Creative and Functional 3D Objects
di: Guo, Michelle, et al.
Pubblicazione: (2024)
di: Guo, Michelle, et al.
Pubblicazione: (2024)
Strictly-ID-Preserved and Controllable Accessory Advertising Image Generation
di: Xue, Youze, et al.
Pubblicazione: (2024)
di: Xue, Youze, et al.
Pubblicazione: (2024)
Towards Reliable Advertising Image Generation Using Human Feedback
di: Du, Zhenbang, et al.
Pubblicazione: (2024)
di: Du, Zhenbang, et al.
Pubblicazione: (2024)
Uncertainty-Encoded Multi-Modal Fusion for Robust Object Detection in Autonomous Driving
di: Lou, Yang, et al.
Pubblicazione: (2023)
di: Lou, Yang, et al.
Pubblicazione: (2023)
CREA: A Collaborative Multi-Agent Framework for Creative Image Editing and Generation
di: Venkatesh, Kavana, et al.
Pubblicazione: (2025)
di: Venkatesh, Kavana, et al.
Pubblicazione: (2025)
KeyGS: A Keyframe-Centric Gaussian Splatting Method for Monocular Image Sequences
di: Chang, Keng-Wei, et al.
Pubblicazione: (2024)
di: Chang, Keng-Wei, et al.
Pubblicazione: (2024)
Automated Prompt Generation for Creative and Counterfactual Text-to-image Synthesis
di: Jelaca, Aleksa, et al.
Pubblicazione: (2025)
di: Jelaca, Aleksa, et al.
Pubblicazione: (2025)
Vibe Spaces for Creatively Connecting and Expressing Visual Concepts
di: Yang, Huzheng, et al.
Pubblicazione: (2025)
di: Yang, Huzheng, et al.
Pubblicazione: (2025)
Unified Domain Generalization and Adaptation for Multi-View 3D Object Detection
di: Chang, Gyusam, et al.
Pubblicazione: (2024)
di: Chang, Gyusam, et al.
Pubblicazione: (2024)
Creative Image Generation with Diffusion Models
di: Song, Kunpeng, et al.
Pubblicazione: (2026)
di: Song, Kunpeng, et al.
Pubblicazione: (2026)
Teleportraits: Training-Free People Insertion into Any Scene
di: Gao, Jialu, et al.
Pubblicazione: (2025)
di: Gao, Jialu, et al.
Pubblicazione: (2025)
Efficient Domain-Adaptive Multi-Task Dense Prediction with Vision Foundation Models
di: Kang, Beomseok, et al.
Pubblicazione: (2025)
di: Kang, Beomseok, et al.
Pubblicazione: (2025)
Automatic Teaching Platform on Vision Language Retrieval Augmented Generation
di: Gokhman, Ruslan, et al.
Pubblicazione: (2025)
di: Gokhman, Ruslan, et al.
Pubblicazione: (2025)
G-HOP: Generative Hand-Object Prior for Interaction Reconstruction and Grasp Synthesis
di: Ye, Yufei, et al.
Pubblicazione: (2024)
di: Ye, Yufei, et al.
Pubblicazione: (2024)
Distribution-Conditional Generation: From Class Distribution to Creative Generation
di: Feng, Fu, et al.
Pubblicazione: (2025)
di: Feng, Fu, et al.
Pubblicazione: (2025)
Siamese-DETR for Generic Multi-Object Tracking
di: Liu, Qiankun, et al.
Pubblicazione: (2023)
di: Liu, Qiankun, et al.
Pubblicazione: (2023)
MambaLoc: Efficient Camera Localisation via State Space Model
di: Wang, Jialu, et al.
Pubblicazione: (2024)
di: Wang, Jialu, et al.
Pubblicazione: (2024)
AG-TAL: Anatomically-Guided Topology-Aware Loss for Multiclass Segmentation of the Circle of Willis Using Large-Scale Multi-Center Datasets
di: Liu, Jialu, et al.
Pubblicazione: (2026)
di: Liu, Jialu, et al.
Pubblicazione: (2026)
DOS: Directional Object Separation in Text Embeddings for Multi-Object Image Generation
di: Byun, Dongnam, et al.
Pubblicazione: (2025)
di: Byun, Dongnam, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Grounding Task Assistance with Multimodal Cues from a Single Demonstration
di: Sarch, Gabriel, et al.
Pubblicazione: (2025) -
Out of Sight, Not Out of Context? Egocentric Spatial Reasoning in VLMs Across Disjoint Frames
di: Ravi, Sahithya, et al.
Pubblicazione: (2025) -
Doc To The Future: Infomorphs for Interactive, Multimodal Document Transformation and Generation
di: Kumaravel, Balasaravanan Thoravi
Pubblicazione: (2025) -
BlendScape: Enabling End-User Customization of Video-Conferencing Environments through Generative AI
di: Rajaram, Shwetha, et al.
Pubblicazione: (2024) -
SpaceBlender: Creating Context-Rich Collaborative Spaces Through Generative 3D Scene Blending
di: Numan, Nels, et al.
Pubblicazione: (2024)