An Exploration of Self-Supervised Mutual Information Alignment for Multi-Task Settings
Fuente:
arXiv
Salvato in:
| Autore principale: | Govande, Soham V. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Self-Supervised Alignment with Mutual Information: Learning to Follow Principles without Preference Labels
di: Fränken, Jan-Philipp, et al.
Pubblicazione: (2024)
di: Fränken, Jan-Philipp, et al.
Pubblicazione: (2024)
Chipmunk: Training-Free Acceleration of Diffusion Transformers with Dynamic Column-Sparse Deltas
di: Silveria, Austin, et al.
Pubblicazione: (2025)
di: Silveria, Austin, et al.
Pubblicazione: (2025)
CARMA: Enhanced Compositionality in LLMs via Advanced Regularisation and Mutual Information Alignment
di: Aljaafari, Nura, et al.
Pubblicazione: (2025)
di: Aljaafari, Nura, et al.
Pubblicazione: (2025)
An Exploration of Mamba for Speech Self-Supervised Models
di: Lin, Tzu-Quan, et al.
Pubblicazione: (2025)
di: Lin, Tzu-Quan, et al.
Pubblicazione: (2025)
MAIN: Mutual Alignment Is Necessary for instruction tuning
di: Yang, Fanyi, et al.
Pubblicazione: (2025)
di: Yang, Fanyi, et al.
Pubblicazione: (2025)
$\texttt{COSMIC}$: Mutual Information for Task-Agnostic Summarization Evaluation
di: Darrin, Maxime, et al.
Pubblicazione: (2024)
di: Darrin, Maxime, et al.
Pubblicazione: (2024)
Shared and Private Information Learning in Multimodal Sentiment Analysis with Deep Modal Alignment and Self-supervised Multi-Task Learning
di: Lai, Songning, et al.
Pubblicazione: (2023)
di: Lai, Songning, et al.
Pubblicazione: (2023)
Learning Concepts, Not Tokens: Self-Supervised Semantic Alignment for Language Models
di: Zhang, Christine, et al.
Pubblicazione: (2026)
di: Zhang, Christine, et al.
Pubblicazione: (2026)
Data Alignment for Zero-Shot Concept Generation in Dermatology AI
di: Gadgil, Soham, et al.
Pubblicazione: (2024)
di: Gadgil, Soham, et al.
Pubblicazione: (2024)
Self-Supervised Visual Preference Alignment
di: Zhu, Ke, et al.
Pubblicazione: (2024)
di: Zhu, Ke, et al.
Pubblicazione: (2024)
Poor-Supervised Evaluation for SuperLLM via Mutual Consistency
di: Yuan, Peiwen, et al.
Pubblicazione: (2024)
di: Yuan, Peiwen, et al.
Pubblicazione: (2024)
Language Guided Exploration for RL Agents in Text Environments
di: Golchha, Hitesh, et al.
Pubblicazione: (2024)
di: Golchha, Hitesh, et al.
Pubblicazione: (2024)
STENCIL: Submodular Mutual Information Based Weak Supervision for Cold-Start Active Learning
di: Beck, Nathan, et al.
Pubblicazione: (2024)
di: Beck, Nathan, et al.
Pubblicazione: (2024)
SelfCite: Self-Supervised Alignment for Context Attribution in Large Language Models
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2025)
di: Chuang, Yung-Sung, et al.
Pubblicazione: (2025)
Efficient Multi-Task Inferencing: Model Merging with Gromov-Wasserstein Feature Alignment
di: Fang, Luyang, et al.
Pubblicazione: (2025)
di: Fang, Luyang, et al.
Pubblicazione: (2025)
Utilizing and Calibrating Hindsight Process Rewards via Reinforcement with Mutual Information Self-Evaluation
di: Yao, Jiashu, et al.
Pubblicazione: (2026)
di: Yao, Jiashu, et al.
Pubblicazione: (2026)
Anti-Self-Distillation for Reasoning RL via Pointwise Mutual Information
di: Shen, Guobin, et al.
Pubblicazione: (2026)
di: Shen, Guobin, et al.
Pubblicazione: (2026)
EMAFusion: A Self-Optimizing System for Seamless LLM Selection and Integration
di: Shah, Soham, et al.
Pubblicazione: (2025)
di: Shah, Soham, et al.
Pubblicazione: (2025)
Improving the Distributional Alignment of LLMs using Supervision
di: Kambhatla, Gauri, et al.
Pubblicazione: (2025)
di: Kambhatla, Gauri, et al.
Pubblicazione: (2025)
Demonstrating Mutual Reinforcement Effect through Information Flow
di: Gan, Chengguang, et al.
Pubblicazione: (2024)
di: Gan, Chengguang, et al.
Pubblicazione: (2024)
MAMI: Multi-Attentional Mutual-Information for Long Sequence Neuron Captioning
di: Fauzulhaq, Alfirsa Damasyifa, et al.
Pubblicazione: (2024)
di: Fauzulhaq, Alfirsa Damasyifa, et al.
Pubblicazione: (2024)
SafeInfer: Context Adaptive Decoding Time Safety Alignment for Large Language Models
di: Banerjee, Somnath, et al.
Pubblicazione: (2024)
di: Banerjee, Somnath, et al.
Pubblicazione: (2024)
Breaking mBad! Supervised Fine-tuning for Cross-Lingual Detoxification
di: Beniwal, Himanshu, et al.
Pubblicazione: (2025)
di: Beniwal, Himanshu, et al.
Pubblicazione: (2025)
RISE: Reasoning Enhancement via Iterative Self-Exploration in Multi-hop Question Answering
di: He, Bolei, et al.
Pubblicazione: (2025)
di: He, Bolei, et al.
Pubblicazione: (2025)
Word Sense Induction with Hierarchical Clustering and Mutual Information Maximization
di: Abdine, Hadi, et al.
Pubblicazione: (2022)
di: Abdine, Hadi, et al.
Pubblicazione: (2022)
Set the Clock: Temporal Alignment of Pretrained Language Models
di: Zhao, Bowen, et al.
Pubblicazione: (2024)
di: Zhao, Bowen, et al.
Pubblicazione: (2024)
Dissecting the Ledger: Locating and Suppressing "Liar Circuits" in Financial Large Language Models
di: Mirajkar, Soham
Pubblicazione: (2025)
di: Mirajkar, Soham
Pubblicazione: (2025)
Revisiting Self-supervised Learning of Speech Representation from a Mutual Information Perspective
di: Liu, Alexander H., et al.
Pubblicazione: (2024)
di: Liu, Alexander H., et al.
Pubblicazione: (2024)
Self-Alignment with Instruction Backtranslation
di: Li, Xian, et al.
Pubblicazione: (2023)
di: Li, Xian, et al.
Pubblicazione: (2023)
Empirical Study of Mutual Reinforcement Effect and Application in Few-shot Text Classification Tasks via Prompt
di: Gan, Chengguang, et al.
Pubblicazione: (2024)
di: Gan, Chengguang, et al.
Pubblicazione: (2024)
Interpreting and Steering LLMs with Mutual Information-based Explanations on Sparse Autoencoders
di: Wu, Xuansheng, et al.
Pubblicazione: (2025)
di: Wu, Xuansheng, et al.
Pubblicazione: (2025)
VOLTA: Improving Generative Diversity by Variational Mutual Information Maximizing Autoencoder
di: Ma, Yueen, et al.
Pubblicazione: (2023)
di: Ma, Yueen, et al.
Pubblicazione: (2023)
From Stars to Insights: Exploration and Implementation of Unified Sentiment Analysis with Distant Supervision
di: Li, Wenchang, et al.
Pubblicazione: (2023)
di: Li, Wenchang, et al.
Pubblicazione: (2023)
Selection-p: Self-Supervised Task-Agnostic Prompt Compression for Faithfulness and Transferability
di: Chung, Tsz Ting, et al.
Pubblicazione: (2024)
di: Chung, Tsz Ting, et al.
Pubblicazione: (2024)
Learning to Maximize Mutual Information for Chain-of-Thought Distillation
di: Chen, Xin, et al.
Pubblicazione: (2024)
di: Chen, Xin, et al.
Pubblicazione: (2024)
Intrinsic Mutual Information as a Modulator for Preference Optimization
di: Liao, Peng, et al.
Pubblicazione: (2026)
di: Liao, Peng, et al.
Pubblicazione: (2026)
Combining Supervised Learning and Reinforcement Learning for Multi-Label Classification Tasks with Partial Labels
di: Jia, Zixia, et al.
Pubblicazione: (2024)
di: Jia, Zixia, et al.
Pubblicazione: (2024)
Diver: Large Language Model Decoding with Span-Level Mutual Information Verification
di: Lu, Jinliang, et al.
Pubblicazione: (2024)
di: Lu, Jinliang, et al.
Pubblicazione: (2024)
A Multilingual Dataset and Empirical Validation for the Mutual Reinforcement Effect in Information Extraction
di: Gan, Chengguang, et al.
Pubblicazione: (2024)
di: Gan, Chengguang, et al.
Pubblicazione: (2024)
STARS: Synchronous Token Alignment for Robust Supervision in Large Language Models
di: Quamar, Mohammad Atif, et al.
Pubblicazione: (2025)
di: Quamar, Mohammad Atif, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Self-Supervised Alignment with Mutual Information: Learning to Follow Principles without Preference Labels
di: Fränken, Jan-Philipp, et al.
Pubblicazione: (2024) -
Chipmunk: Training-Free Acceleration of Diffusion Transformers with Dynamic Column-Sparse Deltas
di: Silveria, Austin, et al.
Pubblicazione: (2025) -
CARMA: Enhanced Compositionality in LLMs via Advanced Regularisation and Mutual Information Alignment
di: Aljaafari, Nura, et al.
Pubblicazione: (2025) -
An Exploration of Mamba for Speech Self-Supervised Models
di: Lin, Tzu-Quan, et al.
Pubblicazione: (2025) -
MAIN: Mutual Alignment Is Necessary for instruction tuning
di: Yang, Fanyi, et al.
Pubblicazione: (2025)