Failures Are Fated, But Can Be Faded: Characterizing and Mitigating Unwanted Behaviors in Large-Scale Vision and Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sagar, Som, Taparia, Aditya, Senanayake, Ransalu |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LLM-Assisted Red Teaming of Diffusion Models through "Failures Are Fated, But Can Be Faded"
par: Sagar, Som, et autres
Publié: (2024)
par: Sagar, Som, et autres
Publié: (2024)
Explainable Concept Generation through Vision-Language Preference Learning for Understanding Neural Networks' Internal Representations
par: Taparia, Aditya, et autres
Publié: (2024)
par: Taparia, Aditya, et autres
Publié: (2024)
BaTCAVe: Trustworthy Explanations for Robot Behaviors
par: Sagar, Som, et autres
Publié: (2024)
par: Sagar, Som, et autres
Publié: (2024)
ExpressivityBench: Can LLMs Communicate Implicitly?
par: Tint, Joshua, et autres
Publié: (2024)
par: Tint, Joshua, et autres
Publié: (2024)
PAC Bench: Do Foundation Models Understand Prerequisites for Executing Manipulation Policies?
par: Gundawar, Atharva, et autres
Publié: (2025)
par: Gundawar, Atharva, et autres
Publié: (2025)
Viewpoint-Agnostic Manipulation Policies with Strategic Vantage Selection
par: Vasudevan, Sreevishakh, et autres
Publié: (2025)
par: Vasudevan, Sreevishakh, et autres
Publié: (2025)
Multiple Distribution Shift -- Aerial (MDS-A): A Dataset for Test-Time Error Detection and Model Adaptation
par: Ngu, Noel, et autres
Publié: (2025)
par: Ngu, Noel, et autres
Publié: (2025)
Towards Adapting Reinforcement Learning Agents to New Tasks: Insights from Q-Values
par: Ramaswamy, Ashwin, et autres
Publié: (2024)
par: Ramaswamy, Ashwin, et autres
Publié: (2024)
RoboMD: Uncovering Robot Vulnerabilities through Semantic Potential Fields
par: Sagar, Som, et autres
Publié: (2024)
par: Sagar, Som, et autres
Publié: (2024)
CUPID in the Model Zoo: Online Matchmaking for Selecting Your Dream LLM
par: Nguyen, Son, et autres
Publié: (2026)
par: Nguyen, Son, et autres
Publié: (2026)
The Anatomy of Uncertainty in LLMs
par: Taparia, Aditya, et autres
Publié: (2026)
par: Taparia, Aditya, et autres
Publié: (2026)
Interpreting and Mitigating Unwanted Uncertainty in LLMs
par: Roy, Tiasa Singha, et autres
Publié: (2025)
par: Roy, Tiasa Singha, et autres
Publié: (2025)
Consistency-based Abductive Reasoning over Perceptual Errors of Multiple Pre-trained Models in Novel Environments
par: Leiva, Mario, et autres
Publié: (2025)
par: Leiva, Mario, et autres
Publié: (2025)
The Role of Predictive Uncertainty and Diversity in Embodied AI and Robot Learning
par: Senanayake, Ransalu
Publié: (2024)
par: Senanayake, Ransalu
Publié: (2024)
Modeling Multi-Objective Tradeoffs with Monotonic Utility Functions
par: Chen, Edward, et autres
Publié: (2024)
par: Chen, Edward, et autres
Publié: (2024)
VLC Fusion: Vision-Language Conditioned Sensor Fusion for Robust Object Detection
par: Taparia, Aditya, et autres
Publié: (2025)
par: Taparia, Aditya, et autres
Publié: (2025)
Cross-Modal Learning for Chemistry Property Prediction: Large Language Models Meet Graph Machine Learning
par: Srinivas, Sakhinana Sagar, et autres
Publié: (2024)
par: Srinivas, Sakhinana Sagar, et autres
Publié: (2024)
Expansion Span: Combining Fading Memory and Retrieval in Hybrid State Space Models
par: Nunez, Elvis, et autres
Publié: (2024)
par: Nunez, Elvis, et autres
Publié: (2024)
d1: Scaling Reasoning in Diffusion Large Language Models via Reinforcement Learning
par: Zhao, Siyan, et autres
Publié: (2025)
par: Zhao, Siyan, et autres
Publié: (2025)
Multi-Modal Instruction-Tuning Small-Scale Language-and-Vision Assistant for Semiconductor Electron Micrograph Analysis
par: Srinivas, Sakhinana Sagar, et autres
Publié: (2024)
par: Srinivas, Sakhinana Sagar, et autres
Publié: (2024)
Understanding and Mitigating Miscalibration in Prompt Tuning for Vision-Language Models
par: Wang, Shuoyuan, et autres
Publié: (2024)
par: Wang, Shuoyuan, et autres
Publié: (2024)
Revis: Sparse Latent Steering to Mitigate Object Hallucination in Large Vision-Language Models
par: Wu, Jialin, et autres
Publié: (2026)
par: Wu, Jialin, et autres
Publié: (2026)
Scaling Behavior of Discrete Diffusion Language Models
par: von Rütte, Dimitri, et autres
Publié: (2025)
par: von Rütte, Dimitri, et autres
Publié: (2025)
Analyzing and Mitigating Object Hallucination in Large Vision-Language Models
par: Zhou, Yiyang, et autres
Publié: (2023)
par: Zhou, Yiyang, et autres
Publié: (2023)
Localizing and Mitigating Memorization in Image Autoregressive Models
par: Kasliwal, Aditya, et autres
Publié: (2025)
par: Kasliwal, Aditya, et autres
Publié: (2025)
Manifold of Failure: Behavioral Attraction Basins in Language Models
par: Munshi, Sarthak, et autres
Publié: (2026)
par: Munshi, Sarthak, et autres
Publié: (2026)
Small-Scale-Fading-Aware Resource Allocation in Wireless Federated Learning
par: Wang, Jiacheng, et autres
Publié: (2025)
par: Wang, Jiacheng, et autres
Publié: (2025)
Self-Refining Vision Language Model for Robotic Failure Detection and Reasoning
par: Qi, Carl, et autres
Publié: (2026)
par: Qi, Carl, et autres
Publié: (2026)
Mitigate Position Bias in Large Language Models via Scaling a Single Dimension
par: Yu, Yijiong, et autres
Publié: (2024)
par: Yu, Yijiong, et autres
Publié: (2024)
Scaling Capability in Token Space: An Analysis of Large Vision Language Model
par: Li, Tenghui, et autres
Publié: (2024)
par: Li, Tenghui, et autres
Publié: (2024)
Foundational Model for Electron Micrograph Analysis: Instruction-Tuning Small-Scale Language-and-Vision Assistant for Enterprise Adoption
par: Srinivas, Sakhinana Sagar, et autres
Publié: (2024)
par: Srinivas, Sakhinana Sagar, et autres
Publié: (2024)
Large Language Model Reasoning Failures
par: Song, Peiyang, et autres
Publié: (2026)
par: Song, Peiyang, et autres
Publié: (2026)
Does Reasoning Emerge? Examining the Probabilities of Causation in Large Language Models
par: González, Javier, et autres
Publié: (2024)
par: González, Javier, et autres
Publié: (2024)
Can Language Models Explain Their Own Classification Behavior?
par: Sherburn, Dane, et autres
Publié: (2024)
par: Sherburn, Dane, et autres
Publié: (2024)
Consistent Diffusion Language Models
par: Amin, Hasan, et autres
Publié: (2026)
par: Amin, Hasan, et autres
Publié: (2026)
Quantile Activation: Correcting a Failure Mode of ML Models
par: Challa, Aditya, et autres
Publié: (2024)
par: Challa, Aditya, et autres
Publié: (2024)
Leveraging Large Language Models for Efficient Failure Analysis in Game Development
par: Marini, Leonardo, et autres
Publié: (2024)
par: Marini, Leonardo, et autres
Publié: (2024)
Generation Constraint Scaling Can Mitigate Hallucination
par: Kollias, Georgios, et autres
Publié: (2024)
par: Kollias, Georgios, et autres
Publié: (2024)
Rethinking Post-Unlearning Behavior of Large Vision-Language Models
par: Kim, Minsung, et autres
Publié: (2025)
par: Kim, Minsung, et autres
Publié: (2025)
Can Vision Language Models Learn Intuitive Physics from Interaction?
par: Buschoff, Luca M. Schulze, et autres
Publié: (2026)
par: Buschoff, Luca M. Schulze, et autres
Publié: (2026)
Documents similaires
-
LLM-Assisted Red Teaming of Diffusion Models through "Failures Are Fated, But Can Be Faded"
par: Sagar, Som, et autres
Publié: (2024) -
Explainable Concept Generation through Vision-Language Preference Learning for Understanding Neural Networks' Internal Representations
par: Taparia, Aditya, et autres
Publié: (2024) -
BaTCAVe: Trustworthy Explanations for Robot Behaviors
par: Sagar, Som, et autres
Publié: (2024) -
ExpressivityBench: Can LLMs Communicate Implicitly?
par: Tint, Joshua, et autres
Publié: (2024) -
PAC Bench: Do Foundation Models Understand Prerequisites for Executing Manipulation Policies?
par: Gundawar, Atharva, et autres
Publié: (2025)