Guardado en:
| Autores principales: | Lee, Jaewook, Park, Yoel, Lee, Seulki |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2408.03663 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
On-device Sora: Enabling Training-Free Diffusion-based Text-to-Video Generation for Mobile Devices
por: Kim, Bosung, et al.
Publicado: (2025)
por: Kim, Bosung, et al.
Publicado: (2025)
On-device Sora: Enabling Training-Free Diffusion-based Text-to-Video Generation for Mobile Devices
por: Kim, Bosung, et al.
Publicado: (2025)
por: Kim, Bosung, et al.
Publicado: (2025)
Partial Large Kernel CNNs for Efficient Super-Resolution
por: Lee, Dongheon, et al.
Publicado: (2024)
por: Lee, Dongheon, et al.
Publicado: (2024)
Free-Grained Hierarchical Visual Recognition
por: Park, Seulki, et al.
Publicado: (2025)
por: Park, Seulki, et al.
Publicado: (2025)
Leveraging Programmatically Generated Synthetic Data for Differentially Private Diffusion Training
por: Choi, Yujin, et al.
Publicado: (2024)
por: Choi, Yujin, et al.
Publicado: (2024)
Investigating and unmasking feature-level vulnerabilities of CNNs to adversarial perturbations
por: Coppola, Davide, et al.
Publicado: (2024)
por: Coppola, Davide, et al.
Publicado: (2024)
Lightweight Channel Attention for Efficient CNNs
por: Kanaparthi, Prem Babu, et al.
Publicado: (2026)
por: Kanaparthi, Prem Babu, et al.
Publicado: (2026)
Visually Consistent Hierarchical Image Classification
por: Park, Seulki, et al.
Publicado: (2024)
por: Park, Seulki, et al.
Publicado: (2024)
XStreamVGGT: Extremely Memory-Efficient Streaming Vision Geometry Grounded Transformer with KV Cache Compression
por: Su, Zunhai, et al.
Publicado: (2026)
por: Su, Zunhai, et al.
Publicado: (2026)
XStreamVGGT: Extremely Memory-Efficient Streaming Vision Geometry Grounded Transformer with KV Cache Compression
por: Su, Zunhai, et al.
Publicado: (2026)
por: Su, Zunhai, et al.
Publicado: (2026)
ViscNet: Vision-Based In-line Viscometry for Fluid Mixing Process
por: Sohn, Jongwon, et al.
Publicado: (2025)
por: Sohn, Jongwon, et al.
Publicado: (2025)
ExBluRF: Efficient Radiance Fields for Extreme Motion Blurred Images
por: Lee, Dongwoo, et al.
Publicado: (2023)
por: Lee, Dongwoo, et al.
Publicado: (2023)
SHViT: Single-Head Vision Transformer with Memory Efficient Macro Design
por: Yun, Seokju, et al.
Publicado: (2024)
por: Yun, Seokju, et al.
Publicado: (2024)
B-cos Alignment for Inherently Interpretable CNNs and Vision Transformers
por: Böhle, Moritz, et al.
Publicado: (2023)
por: Böhle, Moritz, et al.
Publicado: (2023)
ZIP: An Efficient Zeroth-order Prompt Tuning for Black-box Vision-Language Models
por: Park, Seonghwan, et al.
Publicado: (2025)
por: Park, Seonghwan, et al.
Publicado: (2025)
Parameter-Efficient Architectural Modifications for Translation-Invariant CNNs
por: Alabau-Bosque, Nuria, et al.
Publicado: (2026)
por: Alabau-Bosque, Nuria, et al.
Publicado: (2026)
CNNs, Transformers, Hybrid, and Vision Language Models for Skin Cancer Detection
por: Dey, Durjoy, et al.
Publicado: (2026)
por: Dey, Durjoy, et al.
Publicado: (2026)
KOALA: Empirical Lessons Toward Memory-Efficient and Fast Diffusion Models for Text-to-Image Synthesis
por: Lee, Youngwan, et al.
Publicado: (2023)
por: Lee, Youngwan, et al.
Publicado: (2023)
MEIL-NeRF: Memory-Efficient Incremental Learning of Neural Radiance Fields
por: Chung, Jaeyoung, et al.
Publicado: (2022)
por: Chung, Jaeyoung, et al.
Publicado: (2022)
TADFormer : Task-Adaptive Dynamic Transformer for Efficient Multi-Task Learning
por: Baek, Seungmin, et al.
Publicado: (2025)
por: Baek, Seungmin, et al.
Publicado: (2025)
BEM: Training-Free Background Embedding Memory for False-Positive Suppression in Real-Time Fixed-Background Camera
por: Park, Junwoo, et al.
Publicado: (2026)
por: Park, Junwoo, et al.
Publicado: (2026)
OA-CNNs: Omni-Adaptive Sparse CNNs for 3D Semantic Segmentation
por: Peng, Bohao, et al.
Publicado: (2024)
por: Peng, Bohao, et al.
Publicado: (2024)
Vehicle Classification under Extreme Imbalance: A Comparative Study of Ensemble Learning and CNNs
por: Syarubany, Abu Hanif Muhammad
Publicado: (2025)
por: Syarubany, Abu Hanif Muhammad
Publicado: (2025)
ReDistill: Residual Encoded Distillation for Peak Memory Reduction of CNNs
por: Chen, Fang, et al.
Publicado: (2024)
por: Chen, Fang, et al.
Publicado: (2024)
CAD: Memory Efficient Convolutional Adapter for Segment Anything
por: Kim, Joohyeok, et al.
Publicado: (2024)
por: Kim, Joohyeok, et al.
Publicado: (2024)
Extreme Point Supervised Instance Segmentation
por: Lee, Hyeonjun, et al.
Publicado: (2024)
por: Lee, Hyeonjun, et al.
Publicado: (2024)
MoRGS: Efficient Per-Gaussian Motion Reasoning for Streamable Dynamic 3D Scenes
por: Lee, Wonjoon, et al.
Publicado: (2026)
por: Lee, Wonjoon, et al.
Publicado: (2026)
Promoting CNNs with Cross-Architecture Knowledge Distillation for Efficient Monocular Depth Estimation
por: Zheng, Zhimeng, et al.
Publicado: (2024)
por: Zheng, Zhimeng, et al.
Publicado: (2024)
How Does Vision-Language Adaptation Impact the Safety of Vision Language Models?
por: Lee, Seongyun, et al.
Publicado: (2024)
por: Lee, Seongyun, et al.
Publicado: (2024)
ACM-UNet: Adaptive Integration of CNNs and Mamba for Efficient Medical Image Segmentation
por: Huang, Jing, et al.
Publicado: (2025)
por: Huang, Jing, et al.
Publicado: (2025)
Combining Transformers and CNNs for Efficient Object Detection in High-Resolution Satellite Imagery
por: Drapier, Nicolas, et al.
Publicado: (2025)
por: Drapier, Nicolas, et al.
Publicado: (2025)
Continuous Memory Representation for Anomaly Detection
por: Lee, Joo Chan, et al.
Publicado: (2024)
por: Lee, Joo Chan, et al.
Publicado: (2024)
Self-Supervised Vision Transformers Are Efficient Segmentation Learners for Imperfect Labels
por: Lee, Seungho, et al.
Publicado: (2024)
por: Lee, Seungho, et al.
Publicado: (2024)
Efficient Hyperparameter Importance Assessment for CNNs
por: Wang, Ruinan, et al.
Publicado: (2024)
por: Wang, Ruinan, et al.
Publicado: (2024)
The Role of Masking for Efficient Supervised Knowledge Distillation of Vision Transformers
por: Son, Seungwoo, et al.
Publicado: (2023)
por: Son, Seungwoo, et al.
Publicado: (2023)
EfficientViM: Efficient Vision Mamba with Hidden State Mixer based State Space Duality
por: Lee, Sanghyeok, et al.
Publicado: (2024)
por: Lee, Sanghyeok, et al.
Publicado: (2024)
RoCOCO: Robustness Benchmark of MS-COCO to Stress-test Image-Text Matching Models
por: Park, Seulki, et al.
Publicado: (2023)
por: Park, Seulki, et al.
Publicado: (2023)
Bridging Vision and Language Spaces with Assignment Prediction
por: Park, Jungin, et al.
Publicado: (2024)
por: Park, Jungin, et al.
Publicado: (2024)
MoE-GRPO: Optimizing Mixture-of-Experts via Reinforcement Learning in Vision-Language Models
por: Ko, Dohwan, et al.
Publicado: (2026)
por: Ko, Dohwan, et al.
Publicado: (2026)
Exploring Synergistic Ensemble Learning: Uniting CNNs, MLP-Mixers, and Vision Transformers to Enhance Image Classification
por: Bashar, Mk, et al.
Publicado: (2025)
por: Bashar, Mk, et al.
Publicado: (2025)
Ejemplares similares
-
On-device Sora: Enabling Training-Free Diffusion-based Text-to-Video Generation for Mobile Devices
por: Kim, Bosung, et al.
Publicado: (2025) -
On-device Sora: Enabling Training-Free Diffusion-based Text-to-Video Generation for Mobile Devices
por: Kim, Bosung, et al.
Publicado: (2025) -
Partial Large Kernel CNNs for Efficient Super-Resolution
por: Lee, Dongheon, et al.
Publicado: (2024) -
Free-Grained Hierarchical Visual Recognition
por: Park, Seulki, et al.
Publicado: (2025) -
Leveraging Programmatically Generated Synthetic Data for Differentially Private Diffusion Training
por: Choi, Yujin, et al.
Publicado: (2024)