Bilinear representation mitigates reversal curse and enables consistent model editing
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Dong-Kyum, Kim, Minsung, Kwon, Jea, Yang, Nakyeong, Cha, Meeyoung |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Erase or Hide? Suppressing Spurious Unlearning Neurons for Robust Unlearning
par: Yang, Nakyeong, et autres
Publié: (2025)
par: Yang, Nakyeong, et autres
Publié: (2025)
How Training Data Shapes the Use of Parametric and In-Context Knowledge in Language Models
par: Kim, Minsung, et autres
Publié: (2025)
par: Kim, Minsung, et autres
Publié: (2025)
Rethinking Post-Unlearning Behavior of Large Vision-Language Models
par: Kim, Minsung, et autres
Publié: (2025)
par: Kim, Minsung, et autres
Publié: (2025)
Exploring Persona-dependent LLM Alignment for the Moral Machine Experiment
par: Kim, Jiseon, et autres
Publié: (2025)
par: Kim, Jiseon, et autres
Publié: (2025)
Dropouts in Confidence: Moral Uncertainty in Human-LLM Alignment
par: Kwon, Jea, et autres
Publié: (2025)
par: Kwon, Jea, et autres
Publié: (2025)
Uncovering Emergent Physics Representations Learned In-Context by Large Language Models
par: Song, Yeongwoo, et autres
Publié: (2025)
par: Song, Yeongwoo, et autres
Publié: (2025)
FaithUn: Toward Faithful Forgetting in Language Models by Investigating the Interconnectedness of Knowledge
par: Yang, Nakyeong, et autres
Publié: (2025)
par: Yang, Nakyeong, et autres
Publié: (2025)
Zero-knowledge LLM hallucination detection and mitigation through fine-grained cross-model consistency
par: Goel, Aman, et autres
Publié: (2025)
par: Goel, Aman, et autres
Publié: (2025)
Revisiting Softmax Masking: Stop Gradient for Enhancing Stability in Replay-based Continual Learning
par: Kim, Hoyong, et autres
Publié: (2023)
par: Kim, Hoyong, et autres
Publié: (2023)
Uncertainty Calibration with Energy Based Instance-wise Scaling in the Wild Dataset
par: Kim, Mijoo, et autres
Publié: (2024)
par: Kim, Mijoo, et autres
Publié: (2024)
Mitigating Biases for Instruction-following Language Models via Bias Neurons Elimination
par: Yang, Nakyeong, et autres
Publié: (2023)
par: Yang, Nakyeong, et autres
Publié: (2023)
KnapSpec: Self-Speculative Decoding via Adaptive Layer Selection as a Knapsack Problem
par: Cha, Seongjin, et autres
Publié: (2026)
par: Cha, Seongjin, et autres
Publié: (2026)
ROCM: RLHF on consistency models
par: Shekhar, Shivanshu, et autres
Publié: (2025)
par: Shekhar, Shivanshu, et autres
Publié: (2025)
MVMR: A New Framework for Evaluating Faithfulness of Video Moment Retrieval against Multiple Distractors
par: Yang, Nakyeong, et autres
Publié: (2023)
par: Yang, Nakyeong, et autres
Publié: (2023)
ScaleDiff: Higher-Resolution Image Synthesis via Efficient and Model-Agnostic Diffusion
par: Koh, Sungho, et autres
Publié: (2025)
par: Koh, Sungho, et autres
Publié: (2025)
Bilinear Convolution Decomposition for Causal RL Interpretability
par: Oozeer, Narmeen, et autres
Publié: (2024)
par: Oozeer, Narmeen, et autres
Publié: (2024)
PAC-Bayesian Generalization Bounds for Knowledge Graph Representation Learning
par: Lee, Jaejun, et autres
Publié: (2024)
par: Lee, Jaejun, et autres
Publié: (2024)
MOGAM: A Multimodal Object-oriented Graph Attention Model for Depression Detection
par: Cha, Junyeop, et autres
Publié: (2024)
par: Cha, Junyeop, et autres
Publié: (2024)
Weight-based Decomposition: A Case for Bilinear MLPs
par: Pearce, Michael T., et autres
Publié: (2024)
par: Pearce, Michael T., et autres
Publié: (2024)
Beyond Johnson-Lindenstrauss: Uniform Bounds for Sketched Bilinear Forms
par: Deb, Rohan, et autres
Publié: (2025)
par: Deb, Rohan, et autres
Publié: (2025)
Meta-Ensemble Learning with Diverse Data Splits for Improved Respiratory Sound Classification
par: Kim, June-Woo, et autres
Publié: (2026)
par: Kim, June-Woo, et autres
Publié: (2026)
Network-Aware Bilinear Tokenization for Brain Functional Connectivity Representation Learning
par: Milecki, Leo, et autres
Publié: (2026)
par: Milecki, Leo, et autres
Publié: (2026)
FOSSIL: Regret-Minimizing Curriculum Learning for Metadata-Free and Low-Data Mpox Diagnosis
par: Han, Sahng-Min, et autres
Publié: (2025)
par: Han, Sahng-Min, et autres
Publié: (2025)
Preserving Bilinear Weight Spectra with a Signed and Shrunk Quadratic Activation Function
par: Abohwo, Jason, et autres
Publié: (2025)
par: Abohwo, Jason, et autres
Publié: (2025)
BECAUSE: Bilinear Causal Representation for Generalizable Offline Model-based Reinforcement Learning
par: Lin, Haohong, et autres
Publié: (2024)
par: Lin, Haohong, et autres
Publié: (2024)
SIDA: Synthetic Image Driven Zero-shot Domain Adaptation
par: Kim, Ye-Chan, et autres
Publié: (2025)
par: Kim, Ye-Chan, et autres
Publié: (2025)
No Token Left Behind: Reliable KV Cache Compression via Importance-Aware Mixed Precision Quantization
par: Yang, June Yong, et autres
Publié: (2024)
par: Yang, June Yong, et autres
Publié: (2024)
Soup to go: mitigating forgetting during continual learning with model averaging
par: Kleiman, Anat, et autres
Publié: (2025)
par: Kleiman, Anat, et autres
Publié: (2025)
Objective drives the consistency of representational similarity across datasets
par: Ciernik, Laure, et autres
Publié: (2024)
par: Ciernik, Laure, et autres
Publié: (2024)
AnyBCQ: Hardware Efficient Flexible Binary-Coded Quantization for Multi-Precision LLMs
par: Park, Gunho, et autres
Publié: (2025)
par: Park, Gunho, et autres
Publié: (2025)
MIBP-Cert: Certified Training against Data Perturbations with Mixed-Integer Bilinear Programs
par: Lorenz, Tobias, et autres
Publié: (2024)
par: Lorenz, Tobias, et autres
Publié: (2024)
ASMR: Adaptive Skeleton-Mesh Rigging and Skinning via 2D Generative Prior
par: Hong, Seokhyeon, et autres
Publié: (2025)
par: Hong, Seokhyeon, et autres
Publié: (2025)
Mitigating Overfitting in Graph Neural Networks via Feature and Hyperplane Perturbation
par: Choi, Yoonhyuk, et autres
Publié: (2022)
par: Choi, Yoonhyuk, et autres
Publié: (2022)
Better Not to Propagate: Understanding Edge Uncertainty and Over-smoothing in Signed Graph Neural Networks
par: Choi, Yoonhyuk, et autres
Publié: (2024)
par: Choi, Yoonhyuk, et autres
Publié: (2024)
Hard-constraint physics-residual networks enable robust extrapolation for hydrogen crossover prediction in PEM water electrolyzers
par: Kim, Yong-Woon, et autres
Publié: (2025)
par: Kim, Yong-Woon, et autres
Publié: (2025)
Fitness aligned structural modeling enables scalable virtual screening with AuroBind
par: Zhang, Zhongyue, et autres
Publié: (2025)
par: Zhang, Zhongyue, et autres
Publié: (2025)
Addressing Selection Bias in Computerized Adaptive Testing: A User-Wise Aggregate Influence Function Approach
par: Kwon, Soonwoo, et autres
Publié: (2023)
par: Kwon, Soonwoo, et autres
Publié: (2023)
Adversarial Reinforcement Learning Framework for ESP Cheater Simulation
par: Park, Inkyu, et autres
Publié: (2025)
par: Park, Inkyu, et autres
Publié: (2025)
FlexRound: Learnable Rounding based on Element-wise Division for Post-Training Quantization
par: Lee, Jung Hyun, et autres
Publié: (2023)
par: Lee, Jung Hyun, et autres
Publié: (2023)
BLAST: Block-Level Adaptive Structured Matrices for Efficient Deep Neural Network Inference
par: Lee, Changwoo, et autres
Publié: (2024)
par: Lee, Changwoo, et autres
Publié: (2024)
Documents similaires
-
Erase or Hide? Suppressing Spurious Unlearning Neurons for Robust Unlearning
par: Yang, Nakyeong, et autres
Publié: (2025) -
How Training Data Shapes the Use of Parametric and In-Context Knowledge in Language Models
par: Kim, Minsung, et autres
Publié: (2025) -
Rethinking Post-Unlearning Behavior of Large Vision-Language Models
par: Kim, Minsung, et autres
Publié: (2025) -
Exploring Persona-dependent LLM Alignment for the Moral Machine Experiment
par: Kim, Jiseon, et autres
Publié: (2025) -
Dropouts in Confidence: Moral Uncertainty in Human-LLM Alignment
par: Kwon, Jea, et autres
Publié: (2025)