DiSciPLE: Learning Interpretable Programs for Scientific Visual Discovery
Fuente:
arXiv
Guardado en:
| Autores principales: | Mall, Utkarsh, Phoo, Cheng Perng, Chiquier, Mia, Hariharan, Bharath, Bala, Kavita, Vondrick, Carl |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Evolving Interpretable Visual Classifiers with Large Language Models
por: Chiquier, Mia, et al.
Publicado: (2024)
por: Chiquier, Mia, et al.
Publicado: (2024)
MONITRS: Multimodal Observations of Natural Incidents Through Remote Sensing
por: Revankar, Shreelekha, et al.
Publicado: (2025)
por: Revankar, Shreelekha, et al.
Publicado: (2025)
Scale-Aware Recognition in Satellite Images under Resource Constraints
por: Revankar, Shreelekha, et al.
Publicado: (2024)
por: Revankar, Shreelekha, et al.
Publicado: (2024)
AllClear: A Comprehensive Dataset and Benchmark for Cloud Removal in Satellite Imagery
por: Zhou, Hangyu, et al.
Publicado: (2024)
por: Zhou, Hangyu, et al.
Publicado: (2024)
How Video Meetings Change Your Expression
por: Sarin, Sumit, et al.
Publicado: (2024)
por: Sarin, Sumit, et al.
Publicado: (2024)
Towards LLM Agents for Earth Observation
por: Kao, Chia Hsiang, et al.
Publicado: (2025)
por: Kao, Chia Hsiang, et al.
Publicado: (2025)
Teaching Humans Subtle Differences with DIFFusion
por: Chiquier, Mia, et al.
Publicado: (2025)
por: Chiquier, Mia, et al.
Publicado: (2025)
Learning 3D Perception from Others' Predictions
por: Yoo, Jinsu, et al.
Publicado: (2024)
por: Yoo, Jinsu, et al.
Publicado: (2024)
Better Monocular 3D Detectors with LiDAR from the Past
por: You, Yurong, et al.
Publicado: (2024)
por: You, Yurong, et al.
Publicado: (2024)
Flat-Pack Bench: Evaluating Spatio-Temporal Understanding in Large Vision-Language Models through Furniture Assembly
por: Chetan, Aditya, et al.
Publicado: (2026)
por: Chetan, Aditya, et al.
Publicado: (2026)
MOD-UV: Learning Mobile Object Detectors from Unlabeled Videos
por: Sun, Yihong, et al.
Publicado: (2024)
por: Sun, Yihong, et al.
Publicado: (2024)
Pre-Training LiDAR-Based 3D Object Detectors Through Colorization
por: Pan, Tai-Yu, et al.
Publicado: (2023)
por: Pan, Tai-Yu, et al.
Publicado: (2023)
4D Gaussian Splatting as a Learned Dynamical System
por: Asiimwe, Arnold Caleb, et al.
Publicado: (2025)
por: Asiimwe, Arnold Caleb, et al.
Publicado: (2025)
New York Smells: A Large Multimodal Dataset for Olfaction
por: Ozguroglu, Ege, et al.
Publicado: (2025)
por: Ozguroglu, Ege, et al.
Publicado: (2025)
Learning Feature Descriptors using Camera Pose Supervision
por: Wang, Qianqian, et al.
Publicado: (2020)
por: Wang, Qianqian, et al.
Publicado: (2020)
Composing People Together: Iterative Pose-Image Generation for Multi-Person Interaction Scenes
por: Peng, Wenxuan, et al.
Publicado: (2026)
por: Peng, Wenxuan, et al.
Publicado: (2026)
SciFIBench: Benchmarking Large Multimodal Models for Scientific Figure Interpretation
por: Roberts, Jonathan, et al.
Publicado: (2024)
por: Roberts, Jonathan, et al.
Publicado: (2024)
EraseDraw: Learning to Draw Step-by-Step via Erasing Objects from Images
por: Canberk, Alper, et al.
Publicado: (2024)
por: Canberk, Alper, et al.
Publicado: (2024)
Sin3DM: Learning a Diffusion Model from a Single 3D Textured Shape
por: Wu, Rundi, et al.
Publicado: (2023)
por: Wu, Rundi, et al.
Publicado: (2023)
Whiteboard-of-Thought: Thinking Step-by-Step Across Modalities
por: Menon, Sachit, et al.
Publicado: (2024)
por: Menon, Sachit, et al.
Publicado: (2024)
C3Po: Cross-View Cross-Modality Correspondence by Pointmap Prediction
por: Huang, Kuan Wei, et al.
Publicado: (2025)
por: Huang, Kuan Wei, et al.
Publicado: (2025)
Tracking and Understanding Object Transformations
por: Sun, Yihong, et al.
Publicado: (2025)
por: Sun, Yihong, et al.
Publicado: (2025)
MedAutoCorrect: Image-Conditioned Autocorrection in Medical Reporting
por: Asiimwe, Arnold Caleb, et al.
Publicado: (2024)
por: Asiimwe, Arnold Caleb, et al.
Publicado: (2024)
VeriSciQA: An Auto-Verified Dataset for Scientific Visual Question Answering
por: Li, Yuyi, et al.
Publicado: (2025)
por: Li, Yuyi, et al.
Publicado: (2025)
MMFace-DiT: A Dual-Stream Diffusion Transformer for High-Fidelity Multimodal Face Generation
por: Krishnamurthy, Bharath, et al.
Publicado: (2026)
por: Krishnamurthy, Bharath, et al.
Publicado: (2026)
Differentiable Robot Rendering
por: Liu, Ruoshi, et al.
Publicado: (2024)
por: Liu, Ruoshi, et al.
Publicado: (2024)
Color Bind: Exploring Color Perception in Text-to-Image Models
por: Shomer-Chai, Shay, et al.
Publicado: (2025)
por: Shomer-Chai, Shay, et al.
Publicado: (2025)
MovieRecapsQA: A Multimodal Open-Ended Video Question-Answering Benchmark
por: Shaar, Shaden, et al.
Publicado: (2026)
por: Shaar, Shaden, et al.
Publicado: (2026)
Towards Open-Ended Visual Scientific Discovery with Sparse Autoencoders
por: Stevens, Samuel, et al.
Publicado: (2025)
por: Stevens, Samuel, et al.
Publicado: (2025)
Live Interactive Training for Video Segmentation
por: Yang, Xinyu, et al.
Publicado: (2026)
por: Yang, Xinyu, et al.
Publicado: (2026)
Controlling the World by Sleight of Hand
por: Sudhakar, Sruthi, et al.
Publicado: (2024)
por: Sudhakar, Sruthi, et al.
Publicado: (2024)
HiSciBench: A Hierarchical Multi-disciplinary Benchmark for Scientific Intelligence from Reading to Discovery
por: Zhang, Yaping, et al.
Publicado: (2025)
por: Zhang, Yaping, et al.
Publicado: (2025)
DC-DiT: Adaptive Compute and Elastic Inference for Visual Generation via Dynamic Chunking
por: Haridas, Akash, et al.
Publicado: (2026)
por: Haridas, Akash, et al.
Publicado: (2026)
CRAM: Large-scale Video Continual Learning with Bootstrapped Compression
por: Mall, Shivani, et al.
Publicado: (2025)
por: Mall, Shivani, et al.
Publicado: (2025)
Dreamitate: Real-World Visuomotor Policy Learning via Video Generation
por: Liang, Junbang, et al.
Publicado: (2024)
por: Liang, Junbang, et al.
Publicado: (2024)
Visually Interpretable Subtask Reasoning for Visual Question Answering
por: Cheng, Yu, et al.
Publicado: (2025)
por: Cheng, Yu, et al.
Publicado: (2025)
ObjectCarver: Semi-automatic segmentation, reconstruction and separation of 3D objects
por: Hassena, Gemmechu, et al.
Publicado: (2024)
por: Hassena, Gemmechu, et al.
Publicado: (2024)
BrainExplore: Large-Scale Discovery of Interpretable Visual Representations in the Human Brain
por: Wasserman, Navve, et al.
Publicado: (2025)
por: Wasserman, Navve, et al.
Publicado: (2025)
Accurate Differential Operators for Hybrid Neural Fields
por: Chetan, Aditya, et al.
Publicado: (2023)
por: Chetan, Aditya, et al.
Publicado: (2023)
CAViAR: Critic-Augmented Video Agentic Reasoning
por: Menon, Sachit, et al.
Publicado: (2025)
por: Menon, Sachit, et al.
Publicado: (2025)
Ejemplares similares
-
Evolving Interpretable Visual Classifiers with Large Language Models
por: Chiquier, Mia, et al.
Publicado: (2024) -
MONITRS: Multimodal Observations of Natural Incidents Through Remote Sensing
por: Revankar, Shreelekha, et al.
Publicado: (2025) -
Scale-Aware Recognition in Satellite Images under Resource Constraints
por: Revankar, Shreelekha, et al.
Publicado: (2024) -
AllClear: A Comprehensive Dataset and Benchmark for Cloud Removal in Satellite Imagery
por: Zhou, Hangyu, et al.
Publicado: (2024) -
How Video Meetings Change Your Expression
por: Sarin, Sumit, et al.
Publicado: (2024)