Where Not to Learn: Prior-Aligned Training with Subset-based Attribution Constraints for Reliable Decision-Making
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Ruoyu, Sun, Shangquan, Guo, Xiaoqing, Zhang, Sanyi, Liu, Kangwei, Liu, Shiming, Wang, Zhangcheng, Zhang, Qunli, Zhang, Hua, Cao, Xiaochun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Where MLLMs Attend and What They Rely On: Explaining Autoregressive Token Generation
por: Chen, Ruoyu, et al.
Publicado: (2025)
por: Chen, Ruoyu, et al.
Publicado: (2025)
Did Models Sufficient Learn? Attribution-Guided Training via Subset-Selected Counterfactual Augmentation
por: Chen, Yannan, et al.
Publicado: (2025)
por: Chen, Yannan, et al.
Publicado: (2025)
Less is More: Efficient Black-box Attribution via Minimal Interpretable Subset Selection
por: Chen, Ruoyu, et al.
Publicado: (2025)
por: Chen, Ruoyu, et al.
Publicado: (2025)
Explaining multimodal LLMs via intra-modal token interactions
por: Liang, Jiawei, et al.
Publicado: (2025)
por: Liang, Jiawei, et al.
Publicado: (2025)
Less is More: Fewer Interpretable Region via Submodular Subset Selection
por: Chen, Ruoyu, et al.
Publicado: (2024)
por: Chen, Ruoyu, et al.
Publicado: (2024)
Interpreting Object-level Foundation Models via Visual Precision Search
por: Chen, Ruoyu, et al.
Publicado: (2024)
por: Chen, Ruoyu, et al.
Publicado: (2024)
Can Attribution Predict Risk? From Multi-View Attribution to Planning Risk Signals in End-to-End Autonomous Driving
por: Yang, Le, et al.
Publicado: (2026)
por: Yang, Le, et al.
Publicado: (2026)
EnsIR: An Ensemble Algorithm for Image Restoration via Gaussian Mixture Models
por: Sun, Shangquan, et al.
Publicado: (2024)
por: Sun, Shangquan, et al.
Publicado: (2024)
DI-Retinex: Digital-Imaging Retinex Theory for Low-Light Image Enhancement
por: Sun, Shangquan, et al.
Publicado: (2024)
por: Sun, Shangquan, et al.
Publicado: (2024)
Logit Standardization in Knowledge Distillation
por: Sun, Shangquan, et al.
Publicado: (2024)
por: Sun, Shangquan, et al.
Publicado: (2024)
Restoring Images in Adverse Weather Conditions via Histogram Transformer
por: Sun, Shangquan, et al.
Publicado: (2024)
por: Sun, Shangquan, et al.
Publicado: (2024)
World Models: The Safety Perspective
por: Zeng, Zifan, et al.
Publicado: (2024)
por: Zeng, Zifan, et al.
Publicado: (2024)
Generalized Semantic Contrastive Learning via Embedding Side Information for Few-Shot Object Detection
por: Chen, Ruoyu, et al.
Publicado: (2025)
por: Chen, Ruoyu, et al.
Publicado: (2025)
Beyond Progress Measures: Theoretical Insights into the Mechanism of Grokking
por: Gu, Zihan, et al.
Publicado: (2025)
por: Gu, Zihan, et al.
Publicado: (2025)
Prior Constraints-based Reward Model Training for Aligning Large Language Models
por: Zhou, Hang, et al.
Publicado: (2024)
por: Zhou, Hang, et al.
Publicado: (2024)
PhaseWin Search Framework Enable Efficient Object-Level Interpretation
por: Gu, Zihan, et al.
Publicado: (2025)
por: Gu, Zihan, et al.
Publicado: (2025)
Maximal regularity for fractional difference equations with finite delay on UMD space
por: Zhang, Jichao, et al.
Publicado: (2024)
por: Zhang, Jichao, et al.
Publicado: (2024)
Preparation and Characterization of Fluorescent Wood‐Plastic Composite 3D Printing Substrates
por: Weilin Wang, et al.
Publicado: (2025)
por: Weilin Wang, et al.
Publicado: (2025)
MAG: Multi-Modal Aligned Autoregressive Co-Speech Gesture Generation without Vector Quantization
por: Liu, Binjie, et al.
Publicado: (2025)
por: Liu, Binjie, et al.
Publicado: (2025)
A Hybrid Transformer-Mamba Network for Single Image Deraining
por: Sun, Shangquan, et al.
Publicado: (2024)
por: Sun, Shangquan, et al.
Publicado: (2024)
Semi-Supervised State-Space Model with Dynamic Stacking Filter for Real-World Video Deraining
por: Sun, Shangquan, et al.
Publicado: (2025)
por: Sun, Shangquan, et al.
Publicado: (2025)
Hybrid Attribution Priors for Explainable and Robust Model Training
por: Zhang, Zhuoran, et al.
Publicado: (2025)
por: Zhang, Zhuoran, et al.
Publicado: (2025)
Distributionally Preference Robust Optimization in Multi-Attribute Decision Making
por: Hu, Jian, et al.
Publicado: (2022)
por: Hu, Jian, et al.
Publicado: (2022)
Making Reliable and Flexible Decisions in Long-tailed Classification
por: Li, Bolian, et al.
Publicado: (2025)
por: Li, Bolian, et al.
Publicado: (2025)
Slogans or Stance? A Label-Light Diagnostic for Entrepreneurial-Discourse Measurement on Chinese SOE Speeches
por: Gong, Ting, et al.
Publicado: (2026)
por: Gong, Ting, et al.
Publicado: (2026)
SubCDM: Collective Decision-Making with a Swarm Subset
por: Fuady, Samratul, et al.
Publicado: (2025)
por: Fuady, Samratul, et al.
Publicado: (2025)
ASFT: Aligned Supervised Fine-Tuning through Absolute Likelihood
por: Wang, Ruoyu, et al.
Publicado: (2024)
por: Wang, Ruoyu, et al.
Publicado: (2024)
InvestAlign: Overcoming Data Scarcity in Aligning Large Language Models with Investor Decision-Making Processes under Herd Behavior
por: Wang, Huisheng, et al.
Publicado: (2025)
por: Wang, Huisheng, et al.
Publicado: (2025)
Frequency Perception Network for Camouflaged Object Detection
por: Cong, Runmin, et al.
Publicado: (2023)
por: Cong, Runmin, et al.
Publicado: (2023)
FaceInsight: A Multimodal Large Language Model for Face Perception
por: Li, Jingzhi, et al.
Publicado: (2025)
por: Li, Jingzhi, et al.
Publicado: (2025)
Case Law Grounding: Using Precedents to Align Decision-Making for Humans and AI
por: Chen, Quan Ze, et al.
Publicado: (2023)
por: Chen, Quan Ze, et al.
Publicado: (2023)
EmboAlign: Aligning Video Generation with Compositional Constraints for Zero-Shot Manipulation
por: Zhang, Gehao, et al.
Publicado: (2026)
por: Zhang, Gehao, et al.
Publicado: (2026)
Exploring Training Data Attribution under Limited Access Constraints
por: Zhang, Shiyuan, et al.
Publicado: (2025)
por: Zhang, Shiyuan, et al.
Publicado: (2025)
ALIGN: Prompt-based Attribute Alignment for Reliable, Responsible, and Personalized LLM-based Decision-Making
por: Ravichandran, Bharadwaj, et al.
Publicado: (2025)
por: Ravichandran, Bharadwaj, et al.
Publicado: (2025)
Ontology-Compliant Knowledge Graphs
por: Qiang, Zhangcheng
Publicado: (2026)
por: Qiang, Zhangcheng
Publicado: (2026)
Unlocking Crowdsourcing for Ontology Matching Validation
por: Qiang, Zhangcheng
Publicado: (2026)
por: Qiang, Zhangcheng
Publicado: (2026)
Ontology Interoperability: A Comprehensive Framework for Industrial-Scale Applications
por: Qiang, Zhangcheng
Publicado: (2025)
por: Qiang, Zhangcheng
Publicado: (2025)
Baichuan-M3: Modeling Clinical Inquiry for Reliable Medical Decision-Making
por: M3 Team, et al.
Publicado: (2026)
por: M3 Team, et al.
Publicado: (2026)
MAPPO-PIS: A Multi-Agent Proximal Policy Optimization Method with Prior Intent Sharing for CAVs' Cooperative Decision-Making
por: Guo, Yicheng, et al.
Publicado: (2024)
por: Guo, Yicheng, et al.
Publicado: (2024)
Degradation-Guided One-Step Image Super-Resolution with Diffusion Priors
por: Zhang, Aiping, et al.
Publicado: (2024)
por: Zhang, Aiping, et al.
Publicado: (2024)
Ejemplares similares
-
Where MLLMs Attend and What They Rely On: Explaining Autoregressive Token Generation
por: Chen, Ruoyu, et al.
Publicado: (2025) -
Did Models Sufficient Learn? Attribution-Guided Training via Subset-Selected Counterfactual Augmentation
por: Chen, Yannan, et al.
Publicado: (2025) -
Less is More: Efficient Black-box Attribution via Minimal Interpretable Subset Selection
por: Chen, Ruoyu, et al.
Publicado: (2025) -
Explaining multimodal LLMs via intra-modal token interactions
por: Liang, Jiawei, et al.
Publicado: (2025) -
Less is More: Fewer Interpretable Region via Submodular Subset Selection
por: Chen, Ruoyu, et al.
Publicado: (2024)