Text-guided Synthetic Geometric Augmentation for Zero-shot 3D Understanding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Torimi, Kohei, Yamada, Ryosuke, Otsuka, Daichi, Hara, Kensho, Asano, Yuki M., Kataoka, Hirokatsu, Aoki, Yoshimitsu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Pre-training with 3D Synthetic Data: Learning 3D Point Cloud Instance Segmentation from 3D Synthetic Scenes
par: Otsuka, Daichi, et autres
Publié: (2025)
par: Otsuka, Daichi, et autres
Publié: (2025)
Can masking background and object reduce static bias for zero-shot action recognition?
par: Fukuzawa, Takumi, et autres
Publié: (2025)
par: Fukuzawa, Takumi, et autres
Publié: (2025)
Formula-Supervised Visual-Geometric Pre-training
par: Yamada, Ryosuke, et autres
Publié: (2024)
par: Yamada, Ryosuke, et autres
Publié: (2024)
Human Action Recognition without Human
par: Kataoka, Hirokatsu, et autres
Publié: (2016)
par: Kataoka, Hirokatsu, et autres
Publié: (2016)
Leveraging LLMs with Iterative Loop Structure for Enhanced Social Intelligence in Video Question Answering
par: Mori, Erika, et autres
Publié: (2025)
par: Mori, Erika, et autres
Publié: (2025)
Rethinking Image Super-Resolution from Training Data Perspectives
par: Ohtani, Go, et autres
Publié: (2024)
par: Ohtani, Go, et autres
Publié: (2024)
Industrial Synthetic Segment Pre-training
par: Mae, Shinichi, et autres
Publié: (2025)
par: Mae, Shinichi, et autres
Publié: (2025)
Scaling Backwards: Minimal Synthetic Pre-training?
par: Nakamura, Ryo, et autres
Publié: (2024)
par: Nakamura, Ryo, et autres
Publié: (2024)
Primitive Geometry Segment Pre-training for 3D Medical Image Segmentation
par: Tadokoro, Ryu, et autres
Publié: (2024)
par: Tadokoro, Ryu, et autres
Publié: (2024)
3D sans 3D Scans: Scalable Pre-training from Video-Generated Point Clouds
par: Yamada, Ryousuke, et autres
Publié: (2025)
par: Yamada, Ryousuke, et autres
Publié: (2025)
Exploring Limits of Diffusion-Synthetic Training with Weakly Supervised Semantic Segmentation
par: Yoshihashi, Ryota, et autres
Publié: (2023)
par: Yoshihashi, Ryota, et autres
Publié: (2023)
S3OD: Towards Generalizable Salient Object Detection with Synthetic Data
par: Kupyn, Orest, et autres
Publié: (2025)
par: Kupyn, Orest, et autres
Publié: (2025)
MoireMix: A Formula-Based Data Augmentation for Improving Image Classification Robustness
par: Matsuo, Yuto, et autres
Publié: (2026)
par: Matsuo, Yuto, et autres
Publié: (2026)
BasketLiDAR: The First LiDAR-Camera Multimodal Dataset for Professional Basketball MOT
par: Hayashi, Ryunosuke, et autres
Publié: (2025)
par: Hayashi, Ryunosuke, et autres
Publié: (2025)
Simple Visual Artifact Detection in Sora-Generated Videos
par: Sugiyama, Misora, et autres
Publié: (2025)
par: Sugiyama, Misora, et autres
Publié: (2025)
Geometric-Photometric Event-based 3D Gaussian Ray Tracing
par: Kohyama, Kai, et autres
Publié: (2025)
par: Kohyama, Kai, et autres
Publié: (2025)
Geometrically-driven Aggregation for Zero-shot 3D Point Cloud Understanding
par: Mei, Guofeng, et autres
Publié: (2023)
par: Mei, Guofeng, et autres
Publié: (2023)
Pre-training with Synthetic Patterns for Audio
par: Ishikawa, Yuchi, et autres
Publié: (2024)
par: Ishikawa, Yuchi, et autres
Publié: (2024)
3D Human Scan With A Moving Event Camera
par: Kohyama, Kai, et autres
Publié: (2024)
par: Kohyama, Kai, et autres
Publié: (2024)
A Fast Geometric Regularizer to Mitigate Event Collapse in the Contrast Maximization Framework
par: Shiba, Shintaro, et autres
Publié: (2022)
par: Shiba, Shintaro, et autres
Publié: (2022)
Watermark-embedded Adversarial Examples for Copyright Protection against Diffusion Models
par: Zhu, Peifei, et autres
Publié: (2024)
par: Zhu, Peifei, et autres
Publié: (2024)
FAGStyle: Feature Augmentation on Geodesic Surface for Zero-shot Text-guided Diffusion Image Style Transfer
par: Han, Yuexing, et autres
Publié: (2024)
par: Han, Yuexing, et autres
Publié: (2024)
Agent3D-Zero: An Agent for Zero-shot 3D Understanding
par: Zhang, Sha, et autres
Publié: (2024)
par: Zhang, Sha, et autres
Publié: (2024)
Formula-Supervised Sound Event Detection: Pre-Training Without Real Data
par: Shibata, Yuto, et autres
Publié: (2025)
par: Shibata, Yuto, et autres
Publié: (2025)
BoundMatch: Boundary detection applied to semi-supervised segmentation
par: Ishikawa, Haruya, et autres
Publié: (2025)
par: Ishikawa, Haruya, et autres
Publié: (2025)
MaskDiffusion: Exploiting Pre-trained Diffusion Models for Semantic Segmentation
par: Kawano, Yasufumi, et autres
Publié: (2024)
par: Kawano, Yasufumi, et autres
Publié: (2024)
TAG: Guidance-free Open-Vocabulary Semantic Segmentation
par: Kawano, Yasufumi, et autres
Publié: (2024)
par: Kawano, Yasufumi, et autres
Publié: (2024)
FDIF: Formula-Driven supervised Learning with Implicit Functions for 3D Medical Image Segmentation
par: Yamamoto, Yukinori, et autres
Publié: (2026)
par: Yamamoto, Yukinori, et autres
Publié: (2026)
Reference-Free Image Quality Assessment for Virtual Try-On via Human Feedback
par: Hirakawa, Yuki, et autres
Publié: (2026)
par: Hirakawa, Yuki, et autres
Publié: (2026)
Zero-shot Text-guided Infinite Image Synthesis with LLM guidance
par: Kwon, Soyeong, et autres
Publié: (2024)
par: Kwon, Soyeong, et autres
Publié: (2024)
Self-supervised Normality Learning and Divergence Vector-guided Model Merging for Zero-shot Congenital Heart Disease Detection in Fetal Ultrasound Videos
par: Saha, Pramit, et autres
Publié: (2025)
par: Saha, Pramit, et autres
Publié: (2025)
MoireDB: Formula-generated Interference-fringe Image Dataset
par: Matsuo, Yuto, et autres
Publié: (2025)
par: Matsuo, Yuto, et autres
Publié: (2025)
Pre-training Vision Transformers with Formula-driven Supervised Learning
par: Kataoka, Hirokatsu, et autres
Publié: (2022)
par: Kataoka, Hirokatsu, et autres
Publié: (2022)
Free-Editor: Zero-shot Text-driven 3D Scene Editing
par: Karim, Nazmul, et autres
Publié: (2023)
par: Karim, Nazmul, et autres
Publié: (2023)
Data Collection-free Masked Video Modeling
par: Ishikawa, Yuchi, et autres
Publié: (2024)
par: Ishikawa, Yuchi, et autres
Publié: (2024)
Learning Gaussian Data Augmentation in Feature Space for One-shot Object Detection in Manga
par: Taniguchi, Takara, et autres
Publié: (2024)
par: Taniguchi, Takara, et autres
Publié: (2024)
CLIPtortionist: Zero-shot Text-driven Deformation for Manufactured 3D Shapes
par: Xu, Xianghao, et autres
Publié: (2024)
par: Xu, Xianghao, et autres
Publié: (2024)
HanDyVQA: A Video QA Benchmark for Fine-Grained Hand-Object Interaction Dynamics
par: Tateno, Masatoshi, et autres
Publié: (2025)
par: Tateno, Masatoshi, et autres
Publié: (2025)
AnimalClue: Recognizing Animals by their Traces
par: Shinoda, Risa, et autres
Publié: (2025)
par: Shinoda, Risa, et autres
Publié: (2025)
AgroBench: Vision-Language Model Benchmark in Agriculture
par: Shinoda, Risa, et autres
Publié: (2025)
par: Shinoda, Risa, et autres
Publié: (2025)
Documents similaires
-
Pre-training with 3D Synthetic Data: Learning 3D Point Cloud Instance Segmentation from 3D Synthetic Scenes
par: Otsuka, Daichi, et autres
Publié: (2025) -
Can masking background and object reduce static bias for zero-shot action recognition?
par: Fukuzawa, Takumi, et autres
Publié: (2025) -
Formula-Supervised Visual-Geometric Pre-training
par: Yamada, Ryosuke, et autres
Publié: (2024) -
Human Action Recognition without Human
par: Kataoka, Hirokatsu, et autres
Publié: (2016) -
Leveraging LLMs with Iterative Loop Structure for Enhanced Social Intelligence in Video Question Answering
par: Mori, Erika, et autres
Publié: (2025)