Enregistré dans:
| Auteurs principaux: | Gu, Jeffrey, Jeon, Minkyu, Ma, Ambri, Yeung-Levy, Serena, Zhong, Ellen D. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2512.06332 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
CryoBench: Diverse and challenging datasets for the heterogeneity problem in cryo-EM
par: Jeon, Minkyu, et autres
Publié: (2024)
par: Jeon, Minkyu, et autres
Publié: (2024)
Foundation Models Secretly Understand Neural Network Weights: Enhancing Hypernetwork Architectures with Foundation Models
par: Gu, Jeffrey, et autres
Publié: (2025)
par: Gu, Jeffrey, et autres
Publié: (2025)
Downscaling Intelligence: Exploring Perception and Reasoning Bottlenecks in Small Multimodal Models
par: Endo, Mark, et autres
Publié: (2025)
par: Endo, Mark, et autres
Publié: (2025)
Cryo-forum: A framework for orientation recovery with uncertainty measure with the application in cryo-EM image analysis
par: Chung, Szu-Chi
Publié: (2023)
par: Chung, Szu-Chi
Publié: (2023)
Continuous Perception Matters: Diagnosing Temporal Integration Failures in Multimodal Models
par: Wang, Zeyu, et autres
Publié: (2024)
par: Wang, Zeyu, et autres
Publié: (2024)
Zero-shot Action Localization via the Confidence of Large Vision-Language Models
par: Aklilu, Josiah, et autres
Publié: (2024)
par: Aklilu, Josiah, et autres
Publié: (2024)
Multi-Human Mesh Recovery with Transformers
par: Wang, Zeyu, et autres
Publié: (2024)
par: Wang, Zeyu, et autres
Publié: (2024)
Feather the Throttle: Revisiting Visual Token Pruning for Vision-Language Model Acceleration
par: Endo, Mark, et autres
Publié: (2024)
par: Endo, Mark, et autres
Publié: (2024)
Revisiting Active Learning in the Era of Vision Foundation Models
par: Gupte, Sanket Rajan, et autres
Publié: (2024)
par: Gupte, Sanket Rajan, et autres
Publié: (2024)
Diffusion-HPC: Synthetic Data Generation for Human Mesh Recovery in Challenging Domains
par: Weng, Zhenzhen, et autres
Publié: (2023)
par: Weng, Zhenzhen, et autres
Publié: (2023)
CryoSplat: Gaussian Splatting for Cryo-EM Homogeneous Reconstruction
par: Chen, Suyi, et autres
Publié: (2025)
par: Chen, Suyi, et autres
Publié: (2025)
CryoFastAR: Fast Cryo-EM Ab Initio Reconstruction Made Easy
par: Zhang, Jiakai, et autres
Publié: (2025)
par: Zhang, Jiakai, et autres
Publié: (2025)
The Impact of Image Resolution on Biomedical Multimodal Large Language Models
par: Chen, Liangyu, et autres
Publié: (2025)
par: Chen, Liangyu, et autres
Publié: (2025)
Just Shift It: Test-Time Prototype Shifting for Zero-Shot Generalization with Vision-Language Models
par: Sui, Elaine, et autres
Publié: (2024)
par: Sui, Elaine, et autres
Publié: (2024)
DeforHMR: Vision Transformer with Deformable Cross-Attention for 3D Human Mesh Recovery
par: Heo, Jaewoo, et autres
Publié: (2024)
par: Heo, Jaewoo, et autres
Publié: (2024)
Connect, Collapse, Corrupt: Learning Cross-Modal Tasks with Uni-Modal Data
par: Zhang, Yuhui, et autres
Publié: (2024)
par: Zhang, Yuhui, et autres
Publié: (2024)
Multiscale guidance of protein structure prediction with heterogeneous cryo-EM data
par: Raghu, Rishwanth, et autres
Publié: (2025)
par: Raghu, Rishwanth, et autres
Publié: (2025)
Motion Diffusion-Guided 3D Global HMR from a Dynamic Camera
par: Heo, Jaewoo, et autres
Publié: (2024)
par: Heo, Jaewoo, et autres
Publié: (2024)
Viewpoint Textual Inversion: Discovering Scene Representations and 3D View Control in 2D Diffusion Models
par: Burgess, James, et autres
Publié: (2023)
par: Burgess, James, et autres
Publié: (2023)
Protein Graph Neural Networks for Heterogeneous Cryo-EM Reconstruction
par: Krook, Jonathan, et autres
Publié: (2026)
par: Krook, Jonathan, et autres
Publié: (2026)
CryoSPIN: Improving Ab-Initio Cryo-EM Reconstruction with Semi-Amortized Pose Inference
par: Shekarforoush, Shayan, et autres
Publié: (2024)
par: Shekarforoush, Shayan, et autres
Publié: (2024)
DRACO: A Denoising-Reconstruction Autoencoder for Cryo-EM
par: Shen, Yingjun, et autres
Publié: (2024)
par: Shen, Yingjun, et autres
Publié: (2024)
Robust single-particle cryo-EM image denoising and restoration
par: Zhang, Jing, et autres
Publié: (2024)
par: Zhang, Jing, et autres
Publié: (2024)
CHIMERA: Adaptive Cache Injection and Semantic Anchor Prompting for Zero-shot Image Morphing with Morphing-oriented Metrics
par: Kye, Dahyeon, et autres
Publié: (2025)
par: Kye, Dahyeon, et autres
Publié: (2025)
Depth-guided NeRF Training via Earth Mover's Distance
par: Rau, Anita, et autres
Publié: (2024)
par: Rau, Anita, et autres
Publié: (2024)
VideoAgent: Long-form Video Understanding with Large Language Model as Agent
par: Wang, Xiaohan, et autres
Publié: (2024)
par: Wang, Xiaohan, et autres
Publié: (2024)
μ-Bench: A Vision-Language Benchmark for Microscopy Understanding
par: Lozano, Alejandro, et autres
Publié: (2024)
par: Lozano, Alejandro, et autres
Publié: (2024)
Video-STaR: Self-Training Enables Video Instruction Tuning with Any Supervision
par: Zohar, Orr, et autres
Publié: (2024)
par: Zohar, Orr, et autres
Publié: (2024)
Seeing Is Believing? A Benchmark for Multimodal Large Language Models on Visual Illusions and Anomalies
par: Hou, Wenjin, et autres
Publié: (2026)
par: Hou, Wenjin, et autres
Publié: (2026)
NegVQA: Can Vision Language Models Understand Negation?
par: Zhang, Yuhui, et autres
Publié: (2025)
par: Zhang, Yuhui, et autres
Publié: (2025)
R3eVision: A Survey on Robust Rendering, Restoration, and Enhancement for 3D Low-Level Vision
par: Kwon, Weeyoung, et autres
Publié: (2025)
par: Kwon, Weeyoung, et autres
Publié: (2025)
Fine-tuning MLLMs Without Forgetting Is Easier Than You Think
par: Li, He, et autres
Publié: (2026)
par: Li, He, et autres
Publié: (2026)
Anny-Fit: All-Age Human Mesh Recovery
par: Bravo-Sánchez, Laura, et autres
Publié: (2026)
par: Bravo-Sánchez, Laura, et autres
Publié: (2026)
Resolving compositional and conformational heterogeneity in cryo-EM with deformable 3D Gaussian representations
par: He, Bintao, et autres
Publié: (2025)
par: He, Bintao, et autres
Publié: (2025)
CryoMAE: Few-Shot Cryo-EM Particle Picking with Masked Autoencoders
par: Xu, Chentianye, et autres
Publié: (2024)
par: Xu, Chentianye, et autres
Publié: (2024)
V-GRPO: Online Reinforcement Learning for Denoising Generative Models Is Easier than You Think
par: Tang, Bingda, et autres
Publié: (2026)
par: Tang, Bingda, et autres
Publié: (2026)
GEM: 3D Gaussian Splatting for Efficient and Accurate Cryo-EM Reconstruction
par: Qu, Huaizhi, et autres
Publié: (2025)
par: Qu, Huaizhi, et autres
Publié: (2025)
Template-Free Single-View 3D Human Digitalization with Diffusion-Guided LRM
par: Weng, Zhenzhen, et autres
Publié: (2024)
par: Weng, Zhenzhen, et autres
Publié: (2024)
Transductive Visual Programming: Evolving Tool Libraries from Experience for Spatial Reasoning
par: Wu, Shengguang, et autres
Publié: (2025)
par: Wu, Shengguang, et autres
Publié: (2025)
Data or Language Supervision: What Makes CLIP Better than DINO?
par: Liu, Yiming, et autres
Publié: (2025)
par: Liu, Yiming, et autres
Publié: (2025)
Documents similaires
-
CryoBench: Diverse and challenging datasets for the heterogeneity problem in cryo-EM
par: Jeon, Minkyu, et autres
Publié: (2024) -
Foundation Models Secretly Understand Neural Network Weights: Enhancing Hypernetwork Architectures with Foundation Models
par: Gu, Jeffrey, et autres
Publié: (2025) -
Downscaling Intelligence: Exploring Perception and Reasoning Bottlenecks in Small Multimodal Models
par: Endo, Mark, et autres
Publié: (2025) -
Cryo-forum: A framework for orientation recovery with uncertainty measure with the application in cryo-EM image analysis
par: Chung, Szu-Chi
Publié: (2023) -
Continuous Perception Matters: Diagnosing Temporal Integration Failures in Multimodal Models
par: Wang, Zeyu, et autres
Publié: (2024)