Pre-training Vision Transformers with Formula-driven Supervised Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Kataoka, Hirokatsu, Takashima, Sora, Hayamizu, Ryo, Yamada, Ryosuke, Nakashima, Kodai, Zhang, Xinyu, Martinez-Noriega, Edgar Josafat, Inoue, Nakamasa, Yokota, Rio |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Formula-Supervised Visual-Geometric Pre-training
di: Yamada, Ryosuke, et al.
Pubblicazione: (2024)
di: Yamada, Ryosuke, et al.
Pubblicazione: (2024)
Primitive Geometry Segment Pre-training for 3D Medical Image Segmentation
di: Tadokoro, Ryu, et al.
Pubblicazione: (2024)
di: Tadokoro, Ryu, et al.
Pubblicazione: (2024)
Scaling Backwards: Minimal Synthetic Pre-training?
di: Nakamura, Ryo, et al.
Pubblicazione: (2024)
di: Nakamura, Ryo, et al.
Pubblicazione: (2024)
PowerCLIP: Powerset Alignment for Contrastive Pre-Training
di: Kawamura, Masaki, et al.
Pubblicazione: (2025)
di: Kawamura, Masaki, et al.
Pubblicazione: (2025)
On the Relationship Between Double Descent of CNNs and Shape/Texture Bias Under Learning Process
di: Iwase, Shun, et al.
Pubblicazione: (2025)
di: Iwase, Shun, et al.
Pubblicazione: (2025)
MoireDB: Formula-generated Interference-fringe Image Dataset
di: Matsuo, Yuto, et al.
Pubblicazione: (2025)
di: Matsuo, Yuto, et al.
Pubblicazione: (2025)
Industrial Synthetic Segment Pre-training
di: Mae, Shinichi, et al.
Pubblicazione: (2025)
di: Mae, Shinichi, et al.
Pubblicazione: (2025)
Pre-training with 3D Synthetic Data: Learning 3D Point Cloud Instance Segmentation from 3D Synthetic Scenes
di: Otsuka, Daichi, et al.
Pubblicazione: (2025)
di: Otsuka, Daichi, et al.
Pubblicazione: (2025)
AgroBench: Vision-Language Model Benchmark in Agriculture
di: Shinoda, Risa, et al.
Pubblicazione: (2025)
di: Shinoda, Risa, et al.
Pubblicazione: (2025)
Rethinking Image Super-Resolution from Training Data Perspectives
di: Ohtani, Go, et al.
Pubblicazione: (2024)
di: Ohtani, Go, et al.
Pubblicazione: (2024)
AnimalClue: Recognizing Animals by their Traces
di: Shinoda, Risa, et al.
Pubblicazione: (2025)
di: Shinoda, Risa, et al.
Pubblicazione: (2025)
Formula-Supervised Sound Event Detection: Pre-Training Without Real Data
di: Shibata, Yuto, et al.
Pubblicazione: (2025)
di: Shibata, Yuto, et al.
Pubblicazione: (2025)
Approximate Domain Unlearning for Vision-Language Models
di: Kawamura, Kodai, et al.
Pubblicazione: (2025)
di: Kawamura, Kodai, et al.
Pubblicazione: (2025)
Masked Gated Linear Unit
di: Tajima, Yukito, et al.
Pubblicazione: (2025)
di: Tajima, Yukito, et al.
Pubblicazione: (2025)
3D sans 3D Scans: Scalable Pre-training from Video-Generated Point Clouds
di: Yamada, Ryousuke, et al.
Pubblicazione: (2025)
di: Yamada, Ryousuke, et al.
Pubblicazione: (2025)
Simple Visual Artifact Detection in Sora-Generated Videos
di: Sugiyama, Misora, et al.
Pubblicazione: (2025)
di: Sugiyama, Misora, et al.
Pubblicazione: (2025)
STATUS Bench: A Rigorous Benchmark for Evaluating Object State Understanding in Vision-Language Models
di: Ukai, Mahiro, et al.
Pubblicazione: (2025)
di: Ukai, Mahiro, et al.
Pubblicazione: (2025)
Text-guided Synthetic Geometric Augmentation for Zero-shot 3D Understanding
di: Torimi, Kohei, et al.
Pubblicazione: (2025)
di: Torimi, Kohei, et al.
Pubblicazione: (2025)
FDIF: Formula-Driven supervised Learning with Implicit Functions for 3D Medical Image Segmentation
di: Yamamoto, Yukinori, et al.
Pubblicazione: (2026)
di: Yamamoto, Yukinori, et al.
Pubblicazione: (2026)
Exploring Limits of Diffusion-Synthetic Training with Weakly Supervised Semantic Segmentation
di: Yoshihashi, Ryota, et al.
Pubblicazione: (2023)
di: Yoshihashi, Ryota, et al.
Pubblicazione: (2023)
MoireMix: A Formula-Based Data Augmentation for Improving Image Classification Robustness
di: Matsuo, Yuto, et al.
Pubblicazione: (2026)
di: Matsuo, Yuto, et al.
Pubblicazione: (2026)
Human Action Recognition without Human
di: Kataoka, Hirokatsu, et al.
Pubblicazione: (2016)
di: Kataoka, Hirokatsu, et al.
Pubblicazione: (2016)
Watermark-embedded Adversarial Examples for Copyright Protection against Diffusion Models
di: Zhu, Peifei, et al.
Pubblicazione: (2024)
di: Zhu, Peifei, et al.
Pubblicazione: (2024)
S3OD: Towards Generalizable Salient Object Detection with Synthetic Data
di: Kupyn, Orest, et al.
Pubblicazione: (2025)
di: Kupyn, Orest, et al.
Pubblicazione: (2025)
Local Loss Optimization in the Infinite Width: Stable Parameterization of Predictive Coding Networks and Target Propagation
di: Ishikawa, Satoki, et al.
Pubblicazione: (2024)
di: Ishikawa, Satoki, et al.
Pubblicazione: (2024)
Multi-modal, Multi-task, Multi-criteria Automatic Evaluation with Vision Language Models
di: Ohi, Masanari, et al.
Pubblicazione: (2024)
di: Ohi, Masanari, et al.
Pubblicazione: (2024)
A Complete Proof of the Limit Formula for Observable Diameter
di: Yokota, Shigeaki
Pubblicazione: (2024)
di: Yokota, Shigeaki
Pubblicazione: (2024)
Supercomputing Frontiers 4th Asian Conference, SCFA 2018, Singapore, March 26-29, 2018, Proceedings
di: Rio Yokota
di: Rio Yokota
Free Random Projection for In-Context Reinforcement Learning
di: Hayase, Tomohiro, et al.
Pubblicazione: (2025)
di: Hayase, Tomohiro, et al.
Pubblicazione: (2025)
Pyramid Coder: Hierarchical Code Generator for Compositional Visual Question Answering
di: Shen, Ruoyue, et al.
Pubblicazione: (2024)
di: Shen, Ruoyue, et al.
Pubblicazione: (2024)
Can masking background and object reduce static bias for zero-shot action recognition?
di: Fukuzawa, Takumi, et al.
Pubblicazione: (2025)
di: Fukuzawa, Takumi, et al.
Pubblicazione: (2025)
Leveraging LLMs with Iterative Loop Structure for Enhanced Social Intelligence in Video Question Answering
di: Mori, Erika, et al.
Pubblicazione: (2025)
di: Mori, Erika, et al.
Pubblicazione: (2025)
Enhancing Vision-Language Pre-training with Rich Supervisions
di: Gao, Yuan, et al.
Pubblicazione: (2024)
di: Gao, Yuan, et al.
Pubblicazione: (2024)
Blood flow restriction training attenuates changes in local muscle endurance: At odds with previous work?
di: William B. Hammert, et al.
Pubblicazione: (2024)
di: William B. Hammert, et al.
Pubblicazione: (2024)
Rectified Lagrangian for Out-of-Distribution Detection in Modern Hopfield Networks
di: Moriai, Ryo, et al.
Pubblicazione: (2025)
di: Moriai, Ryo, et al.
Pubblicazione: (2025)
Trace ideals of exterior powers of the module of differentials
di: Ishizuka, Ryo, et al.
Pubblicazione: (2026)
di: Ishizuka, Ryo, et al.
Pubblicazione: (2026)
Split Adaptation for Pre-trained Vision Transformers
di: Wang, Lixu, et al.
Pubblicazione: (2025)
di: Wang, Lixu, et al.
Pubblicazione: (2025)
PhysQuantAgent: An Inference Pipeline of Mass Estimation for Vision-Language Models
di: Yokomizo, Hisayuki, et al.
Pubblicazione: (2026)
di: Yokomizo, Hisayuki, et al.
Pubblicazione: (2026)
Domain-Specific Self-Supervised Pre-training for Agricultural Disease Classification: A Hierarchical Vision Transformer Study
di: Sonavane, Arnav S.
Pubblicazione: (2026)
di: Sonavane, Arnav S.
Pubblicazione: (2026)
Efficient Adaptation of Pre-trained Vision Transformer via Householder Transformation
di: Dong, Wei, et al.
Pubblicazione: (2024)
di: Dong, Wei, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Formula-Supervised Visual-Geometric Pre-training
di: Yamada, Ryosuke, et al.
Pubblicazione: (2024) -
Primitive Geometry Segment Pre-training for 3D Medical Image Segmentation
di: Tadokoro, Ryu, et al.
Pubblicazione: (2024) -
Scaling Backwards: Minimal Synthetic Pre-training?
di: Nakamura, Ryo, et al.
Pubblicazione: (2024) -
PowerCLIP: Powerset Alignment for Contrastive Pre-Training
di: Kawamura, Masaki, et al.
Pubblicazione: (2025) -
On the Relationship Between Double Descent of CNNs and Shape/Texture Bias Under Learning Process
di: Iwase, Shun, et al.
Pubblicazione: (2025)