IPO: Your Language Model is Secretly a Preference Classifier
Fuente:
arXiv
Salvato in:
| Autori principali: | Garg, Shivank, Singh, Ayush, Singh, Shweta, Chopra, Paras |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Are VLMs Really Blind
di: Singh, Ayush, et al.
Pubblicazione: (2024)
di: Singh, Ayush, et al.
Pubblicazione: (2024)
LoRA-Mini : Adaptation Matrices Decomposition and Selective Training
di: Singh, Ayush, et al.
Pubblicazione: (2024)
di: Singh, Ayush, et al.
Pubblicazione: (2024)
Thinking About Thinking: Evaluating Reasoning in Post-Trained Language Models
di: Singla, Pratham, et al.
Pubblicazione: (2025)
di: Singla, Pratham, et al.
Pubblicazione: (2025)
Making Large Language Models Speak Tulu: Structured Prompting for an Extremely Low-Resource Language
di: Devadiga, Prathamesh, et al.
Pubblicazione: (2026)
di: Devadiga, Prathamesh, et al.
Pubblicazione: (2026)
Language Models Entangle Language and Culture
di: Jain, Shourya, et al.
Pubblicazione: (2026)
di: Jain, Shourya, et al.
Pubblicazione: (2026)
Beyond Captioning: Task-Specific Prompting for Improved VLM Performance in Mathematical Reasoning
di: Singh, Ayush, et al.
Pubblicazione: (2024)
di: Singh, Ayush, et al.
Pubblicazione: (2024)
Give me a hint: Can LLMs take a hint to solve math problems?
di: Agrawal, Vansh, et al.
Pubblicazione: (2024)
di: Agrawal, Vansh, et al.
Pubblicazione: (2024)
Text2Arch: A Dataset for Generating Scientific Architecture Diagrams from Natural Language Descriptions
di: Garg, Shivank, et al.
Pubblicazione: (2026)
di: Garg, Shivank, et al.
Pubblicazione: (2026)
Your Extreme Multi-label Classifier is Secretly a Hierarchical Text Classifier for Free
di: Bertalis, Nerijus, et al.
Pubblicazione: (2024)
di: Bertalis, Nerijus, et al.
Pubblicazione: (2024)
Direct Preference Optimization: Your Language Model is Secretly a Reward Model
di: Rafailov, Rafael, et al.
Pubblicazione: (2023)
di: Rafailov, Rafael, et al.
Pubblicazione: (2023)
When Prompt Optimization Becomes Jailbreaking: Adaptive Red-Teaming of Large Language Models
di: Shamsi, Zafir, et al.
Pubblicazione: (2026)
di: Shamsi, Zafir, et al.
Pubblicazione: (2026)
A-IPO: Adaptive Intent-driven Preference Optimization
di: Wang, Wenqing, et al.
Pubblicazione: (2025)
di: Wang, Wenqing, et al.
Pubblicazione: (2025)
Your Language Model Secretly Contains Personality Subnetworks
di: Ye, Ruimeng, et al.
Pubblicazione: (2026)
di: Ye, Ruimeng, et al.
Pubblicazione: (2026)
Robustness of Large Language Models to Perturbations in Text
di: Singh, Ayush, et al.
Pubblicazione: (2024)
di: Singh, Ayush, et al.
Pubblicazione: (2024)
Open-DeBias: Toward Mitigating Open-Set Bias in Language Models
di: Rani, Arti, et al.
Pubblicazione: (2025)
di: Rani, Arti, et al.
Pubblicazione: (2025)
LargePiG: Your Large Language Model is Secretly a Pointer Generator
di: Sun, Zhongxiang, et al.
Pubblicazione: (2024)
di: Sun, Zhongxiang, et al.
Pubblicazione: (2024)
Do GFlowNets Transfer? Case Study on the Game of 24/42
di: Gupta, Adesh, et al.
Pubblicazione: (2025)
di: Gupta, Adesh, et al.
Pubblicazione: (2025)
SIDiffAgent: Self-Improving Diffusion Agent
di: Garg, Shivank, et al.
Pubblicazione: (2026)
di: Garg, Shivank, et al.
Pubblicazione: (2026)
ViT Registers and Fractal ViT
di: Chou, Jason Chuan-Chih, et al.
Pubblicazione: (2026)
di: Chou, Jason Chuan-Chih, et al.
Pubblicazione: (2026)
Broken Tokens? Your Language Model can Secretly Handle Non-Canonical Tokenizations
di: Zheng, Brian Siyuan, et al.
Pubblicazione: (2025)
di: Zheng, Brian Siyuan, et al.
Pubblicazione: (2025)
IPO: Interpretable Prompt Optimization for Vision-Language Models
di: Du, Yingjun, et al.
Pubblicazione: (2024)
di: Du, Yingjun, et al.
Pubblicazione: (2024)
Do Biased Models Have Biased Thoughts?
di: Rajwal, Swati, et al.
Pubblicazione: (2025)
di: Rajwal, Swati, et al.
Pubblicazione: (2025)
SelfElicit: Your Language Model Secretly Knows Where is the Relevant Evidence
di: Liu, Zhining, et al.
Pubblicazione: (2025)
di: Liu, Zhining, et al.
Pubblicazione: (2025)
Self-supervised Preference Optimization: Enhance Your Language Model with Preference Degree Awareness
di: Li, Jian, et al.
Pubblicazione: (2024)
di: Li, Jian, et al.
Pubblicazione: (2024)
Your Weak LLM is Secretly a Strong Teacher for Alignment
di: Tao, Leitian, et al.
Pubblicazione: (2024)
di: Tao, Leitian, et al.
Pubblicazione: (2024)
Can GPT Redefine Medical Understanding? Evaluating GPT on Biomedical Machine Reading Comprehension
di: Vatsal, Shubham, et al.
Pubblicazione: (2024)
di: Vatsal, Shubham, et al.
Pubblicazione: (2024)
Adaptive Urban Planning: A Hybrid Framework for Balanced City Development
di: Singla, Pratham, et al.
Pubblicazione: (2024)
di: Singla, Pratham, et al.
Pubblicazione: (2024)
Geometry of Human Perceptual Domains Emerges Transiently in LLM Representations
di: Singh, Simardeep, et al.
Pubblicazione: (2026)
di: Singh, Simardeep, et al.
Pubblicazione: (2026)
Your Transformer is Secretly Linear
di: Razzhigaev, Anton, et al.
Pubblicazione: (2024)
di: Razzhigaev, Anton, et al.
Pubblicazione: (2024)
Your Mixture-of-Experts LLM Is Secretly an Embedding Model For Free
di: Li, Ziyue, et al.
Pubblicazione: (2024)
di: Li, Ziyue, et al.
Pubblicazione: (2024)
TrojanStego: Your Language Model Can Secretly Be A Steganographic Privacy Leaking Agent
di: Meier, Dominik, et al.
Pubblicazione: (2025)
di: Meier, Dominik, et al.
Pubblicazione: (2025)
Self-Verified Distillation: Your Language Model Is Secretly Its Own Synthetic Data Pipeline
di: Lee, Tony, et al.
Pubblicazione: (2026)
di: Lee, Tony, et al.
Pubblicazione: (2026)
IPO-Mine: A Toolkit and Dataset for Section-Structured Analysis of Long, Multimodal IPO Documents
di: Galarnyk, Michael, et al.
Pubblicazione: (2026)
di: Galarnyk, Michael, et al.
Pubblicazione: (2026)
Latent Thinking Optimization: Your Latent Reasoning Language Model Secretly Encodes Reward Signals in Its Latent Thoughts
di: Du, Hanwen, et al.
Pubblicazione: (2025)
di: Du, Hanwen, et al.
Pubblicazione: (2025)
It Takes Two: Your GRPO Is Secretly DPO
di: Wu, Yihong, et al.
Pubblicazione: (2025)
di: Wu, Yihong, et al.
Pubblicazione: (2025)
Entailed Opinion Matters: Improving the Fact-Checking Performance of Language Models by Relying on their Entailment Ability
di: Kumar, Gaurav, et al.
Pubblicazione: (2025)
di: Kumar, Gaurav, et al.
Pubblicazione: (2025)
Self-Evolved Preference Optimization for Enhancing Mathematical Reasoning in Small Language Models
di: Singh, Joykirat, et al.
Pubblicazione: (2025)
di: Singh, Joykirat, et al.
Pubblicazione: (2025)
Discovering Reinforcement Learning Interfaces with Large Language Models
di: Jaswal, Akshat Singh, et al.
Pubblicazione: (2026)
di: Jaswal, Akshat Singh, et al.
Pubblicazione: (2026)
LLM-Based Section Identifiers Excel on Open Source but Stumble in Real World Applications
di: Krishnamoorthy, Saranya, et al.
Pubblicazione: (2024)
di: Krishnamoorthy, Saranya, et al.
Pubblicazione: (2024)
An Optimized Machine Learning Classifier for Detecting Fake Reviews Using Extracted Features
di: Anees, Shabbir, et al.
Pubblicazione: (2025)
di: Anees, Shabbir, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Are VLMs Really Blind
di: Singh, Ayush, et al.
Pubblicazione: (2024) -
LoRA-Mini : Adaptation Matrices Decomposition and Selective Training
di: Singh, Ayush, et al.
Pubblicazione: (2024) -
Thinking About Thinking: Evaluating Reasoning in Post-Trained Language Models
di: Singla, Pratham, et al.
Pubblicazione: (2025) -
Making Large Language Models Speak Tulu: Structured Prompting for an Extremely Low-Resource Language
di: Devadiga, Prathamesh, et al.
Pubblicazione: (2026) -
Language Models Entangle Language and Culture
di: Jain, Shourya, et al.
Pubblicazione: (2026)