Explain with Visual Keypoints Like a Real Mentor! A Benchmark for Multimodal Solution Explanation
Fuente:
arXiv
Guardado en:
| Autores principales: | Park, Jaewoo, Park, Jungyang, Jang, Dongju, Chung, Jiwan, Yoo, Byungwoo, Shin, Jaewoo, Park, Seonjoon, Kim, Taehyeong, Yu, Youngjae |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Tracing Mathematical Proficiency Through Problem-Solving Processes
por: Park, Jungyang, et al.
Publicado: (2025)
por: Park, Jungyang, et al.
Publicado: (2025)
GuideDog: A Real-World Egocentric Multimodal Dataset for Blind and Low-Vision Accessibility-Aware Guidance
por: Kim, Junhyeok, et al.
Publicado: (2025)
por: Kim, Junhyeok, et al.
Publicado: (2025)
Teaching Metric Distance to Discrete Autoregressive Language Models
por: Chung, Jiwan, et al.
Publicado: (2025)
por: Chung, Jiwan, et al.
Publicado: (2025)
ToxReason: A Benchmark for Mechanistic Chemical Toxicity Reasoning via Adverse Outcome Pathway
por: Park, Jueon, et al.
Publicado: (2026)
por: Park, Jueon, et al.
Publicado: (2026)
Zero-shot Multimodal Document Retrieval via Cross-modal Question Generation
por: Choi, Yejin, et al.
Publicado: (2025)
por: Choi, Yejin, et al.
Publicado: (2025)
Background-Aware Defect Generation for Robust Industrial Anomaly Detection
por: Cho, Youngjae, et al.
Publicado: (2024)
por: Cho, Youngjae, et al.
Publicado: (2024)
Snell meets Fagnano. Path optimization through an imperfect mirror
por: Arnold, Maxim, et al.
Publicado: (2025)
por: Arnold, Maxim, et al.
Publicado: (2025)
Keep Away From It! Examining the Contamination Effect of Insect‐Based Foods in Retail Environments
por: Zining Wang, et al.
Publicado: (2025)
por: Zining Wang, et al.
Publicado: (2025)
Challenges and Lessons from MIDOG 2025: A Two-Stage Approach to Domain-Robust Mitotic Figure Detection
por: Song, Euiseop, et al.
Publicado: (2025)
por: Song, Euiseop, et al.
Publicado: (2025)
ASGuard: Activation-Scaling Guard to Mitigate Targeted Jailbreaking Attack
por: Park, Yein, et al.
Publicado: (2025)
por: Park, Yein, et al.
Publicado: (2025)
Ensuring Functional Correctness of Large Code Models with Selective Generation
por: Jeong, Jaewoo, et al.
Publicado: (2025)
por: Jeong, Jaewoo, et al.
Publicado: (2025)
MolDeTox: Evaluating Language Model's Stepwise Fragment Editing for Molecular Detoxification
por: Park, Jueon, et al.
Publicado: (2026)
por: Park, Jueon, et al.
Publicado: (2026)
On a lower bound of Hausdorff dimension of weighted singular vectors
por: Kim, Taehyeong, et al.
Publicado: (2022)
por: Kim, Taehyeong, et al.
Publicado: (2022)
Leveraging Positional Encoding for Robust Multi-Reference-Based Object 6D Pose Estimation
por: Park, Jaewoo, et al.
Publicado: (2024)
por: Park, Jaewoo, et al.
Publicado: (2024)
v1: Learning to Point Visual Tokens for Multimodal Grounded Reasoning
por: Chung, Jiwan, et al.
Publicado: (2025)
por: Chung, Jiwan, et al.
Publicado: (2025)
Persona Attack: Incremental Memory Injection Jailbreak Attack against Large Language Models
por: Park, Junyoung, et al.
Publicado: (2026)
por: Park, Junyoung, et al.
Publicado: (2026)
Beyond Attack Success Rate: Temporal Logit Observability for LLM Safety Failures
por: Park, Junyoung, et al.
Publicado: (2026)
por: Park, Junyoung, et al.
Publicado: (2026)
Are Any-to-Any Models More Consistent Across Modality Transfers Than Specialists?
por: Chung, Jiwan, et al.
Publicado: (2025)
por: Chung, Jiwan, et al.
Publicado: (2025)
On the rank index of projective curves of almost minimal degree
por: Jung, Jaewoo, et al.
Publicado: (2024)
por: Jung, Jaewoo, et al.
Publicado: (2024)
Algorithms for Models with Intractable Normalizing Functions
por: Haran, Murali, et al.
Publicado: (2026)
por: Haran, Murali, et al.
Publicado: (2026)
EP-HDC: Hyperdimensional Computing with Encrypted Parameters for High-Throughput Privacy-Preserving Inference
por: Park, Jaewoo, et al.
Publicado: (2025)
por: Park, Jaewoo, et al.
Publicado: (2025)
On quadratic persistence and Pythagoras numbers of totally real projective varieties
por: Han, Jong In, et al.
Publicado: (2025)
por: Han, Jong In, et al.
Publicado: (2025)
Adaptive Replay Buffer for Offline-to-Online Reinforcement Learning
por: Song, Chihyeon, et al.
Publicado: (2025)
por: Song, Chihyeon, et al.
Publicado: (2025)
Thinking Sparks!: Emergent Attention Heads in Reasoning Models During Post Training
por: Park, Yein, et al.
Publicado: (2025)
por: Park, Yein, et al.
Publicado: (2025)
Selective Vision is the Challenge for Visual Reasoning: A Benchmark for Visual Argument Understanding
por: Chung, Jiwan, et al.
Publicado: (2024)
por: Chung, Jiwan, et al.
Publicado: (2024)
A Stein Gradient Descent Approach for Doubly Intractable Distributions
por: Lee, Heesang, et al.
Publicado: (2024)
por: Lee, Heesang, et al.
Publicado: (2024)
Subtle Risks, Critical Failures: A Framework for Diagnosing Physical Safety of LLMs for Embodied Decision Making
por: Son, Yejin, et al.
Publicado: (2025)
por: Son, Yejin, et al.
Publicado: (2025)
A More Accurate Approximation of Activation Function with Few Spikes Neurons
por: Jeong, Dayena, et al.
Publicado: (2024)
por: Jeong, Dayena, et al.
Publicado: (2024)
Benchmarking Foundation Models on Exceptional Cases: Dataset Creation and Validation
por: Kang, Suho, et al.
Publicado: (2024)
por: Kang, Suho, et al.
Publicado: (2024)
Multi-agent Long-term 3D Human Pose Forecasting via Interaction-aware Trajectory Conditioning
por: Jeong, Jaewoo, et al.
Publicado: (2024)
por: Jeong, Jaewoo, et al.
Publicado: (2024)
Fast Computer Model Calibration using Annealed and Transformed Variational Inference
por: Cho, Dongkyu Derek, et al.
Publicado: (2022)
por: Cho, Dongkyu Derek, et al.
Publicado: (2022)
Understanding Open-Set Recognition by Jacobian Norm and Inter-Class Separation
por: Park, Jaewoo, et al.
Publicado: (2022)
por: Park, Jaewoo, et al.
Publicado: (2022)
Does Time Have Its Place? Temporal Heads: Where Language Models Recall Time-specific Information
por: Park, Yein, et al.
Publicado: (2025)
por: Park, Yein, et al.
Publicado: (2025)
Automated Kernel Discovery Towards Understanding High-dimensional Bayesian Optimization
por: Yun, Taeyoung, et al.
Publicado: (2026)
por: Yun, Taeyoung, et al.
Publicado: (2026)
Diffusion Fine-Tuning via Reparameterized Policy Gradient of the Soft Q-Function
por: Kang, Hyeongyu, et al.
Publicado: (2025)
por: Kang, Hyeongyu, et al.
Publicado: (2025)
Adversarial Feature Alignment: Balancing Robustness and Accuracy in Deep Learning via Adversarial Training
por: Park, Leo Hyun, et al.
Publicado: (2024)
por: Park, Leo Hyun, et al.
Publicado: (2024)
RefPose: Leveraging Reference Geometric Correspondences for Accurate 6D Pose Estimation of Unseen Objects
por: Kim, Jaeguk, et al.
Publicado: (2025)
por: Kim, Jaeguk, et al.
Publicado: (2025)
Families of Two-Impulse Optimal Rendezvous Transfers Between Elliptic Orbits
por: Park, Beom, et al.
Publicado: (2026)
por: Park, Beom, et al.
Publicado: (2026)
A Delayed Acceptance Auxiliary Variable MCMC for Spatial Models with Intractable Likelihood Function
por: Lee, Jong Hyeon, et al.
Publicado: (2025)
por: Lee, Jong Hyeon, et al.
Publicado: (2025)
SpatialBoost: Enhancing Visual Representation through Language-Guided Reasoning
por: Jeon, Byungwoo, et al.
Publicado: (2026)
por: Jeon, Byungwoo, et al.
Publicado: (2026)
Ejemplares similares
-
Tracing Mathematical Proficiency Through Problem-Solving Processes
por: Park, Jungyang, et al.
Publicado: (2025) -
GuideDog: A Real-World Egocentric Multimodal Dataset for Blind and Low-Vision Accessibility-Aware Guidance
por: Kim, Junhyeok, et al.
Publicado: (2025) -
Teaching Metric Distance to Discrete Autoregressive Language Models
por: Chung, Jiwan, et al.
Publicado: (2025) -
ToxReason: A Benchmark for Mechanistic Chemical Toxicity Reasoning via Adverse Outcome Pathway
por: Park, Jueon, et al.
Publicado: (2026) -
Zero-shot Multimodal Document Retrieval via Cross-modal Question Generation
por: Choi, Yejin, et al.
Publicado: (2025)