VLFeedback: A Large-Scale AI Feedback Dataset for Large Vision-Language Models Alignment
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Li, Lei, Xie, Zhihui, Li, Mukai, Chen, Shunian, Wang, Peiyi, Chen, Liang, Yang, Yazheng, Wang, Benyou, Kong, Lingpeng, Liu, Qi |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Multimodal ArXiv: A Dataset for Improving Scientific Comprehension of Large Vision-Language Models
von: Li, Lei, et al.
Veröffentlicht: (2024)
von: Li, Lei, et al.
Veröffentlicht: (2024)
VL-RewardBench: A Challenging Benchmark for Vision-Language Generative Reward Models
von: Li, Lei, et al.
Veröffentlicht: (2024)
von: Li, Lei, et al.
Veröffentlicht: (2024)
Developing and Utilizing a Large-Scale Cantonese Dataset for Multi-Tasking in Large Language Models
von: Jiang, Jiyue, et al.
Veröffentlicht: (2025)
von: Jiang, Jiyue, et al.
Veröffentlicht: (2025)
TalkVid: A Large-Scale Diversified Dataset for Audio-Driven Talking Head Synthesis
von: Chen, Shunian, et al.
Veröffentlicht: (2025)
von: Chen, Shunian, et al.
Veröffentlicht: (2025)
BlenderLLM: Training Large Language Models for Computer-Aided Design with Self-improvement
von: Du, Yuhao, et al.
Veröffentlicht: (2024)
von: Du, Yuhao, et al.
Veröffentlicht: (2024)
BBA: Bi-Modal Behavioral Alignment for Reasoning with Large Vision-Language Models
von: Zhao, Xueliang, et al.
Veröffentlicht: (2024)
von: Zhao, Xueliang, et al.
Veröffentlicht: (2024)
Dream 7B: Diffusion Large Language Models
von: Ye, Jiacheng, et al.
Veröffentlicht: (2025)
von: Ye, Jiacheng, et al.
Veröffentlicht: (2025)
Jailbreaking as a Reward Misspecification Problem
von: Xie, Zhihui, et al.
Veröffentlicht: (2024)
von: Xie, Zhihui, et al.
Veröffentlicht: (2024)
Humans or LLMs as the Judge? A Study on Judgement Biases
von: Chen, Guiming Hardy, et al.
Veröffentlicht: (2024)
von: Chen, Guiming Hardy, et al.
Veröffentlicht: (2024)
ImgTrojan: Jailbreaking Vision-Language Models with ONE Image
von: Tao, Xijia, et al.
Veröffentlicht: (2024)
von: Tao, Xijia, et al.
Veröffentlicht: (2024)
LongLLaVA: Scaling Multi-modal LLMs to 1000 Images Efficiently via a Hybrid Architecture
von: Wang, Xidong, et al.
Veröffentlicht: (2024)
von: Wang, Xidong, et al.
Veröffentlicht: (2024)
MedGen: Unlocking Medical Video Generation by Scaling Granularly-annotated Medical Videos
von: Wang, Rongsheng, et al.
Veröffentlicht: (2025)
von: Wang, Rongsheng, et al.
Veröffentlicht: (2025)
Diving into Mitigating Hallucinations from a Vision Perspective for Large Vision-Language Models
von: Wang, Weihang, et al.
Veröffentlicht: (2025)
von: Wang, Weihang, et al.
Veröffentlicht: (2025)
ALLaVA: Harnessing GPT4V-Synthesized Data for Lite Vision-Language Models
von: Chen, Guiming Hardy, et al.
Veröffentlicht: (2024)
von: Chen, Guiming Hardy, et al.
Veröffentlicht: (2024)
Less is More: A Simple yet Effective Token Reduction Method for Efficient Multi-modal LLMs
von: Song, Dingjie, et al.
Veröffentlicht: (2024)
von: Song, Dingjie, et al.
Veröffentlicht: (2024)
Exploring the Reliability of Large Language Models as Customized Evaluators for Diverse NLP Tasks
von: Li, Qintong, et al.
Veröffentlicht: (2023)
von: Li, Qintong, et al.
Veröffentlicht: (2023)
Teaching Language Models to Critique via Reinforcement Learning
von: Xie, Zhihui, et al.
Veröffentlicht: (2025)
von: Xie, Zhihui, et al.
Veröffentlicht: (2025)
Both Text and Images Leaked! A Systematic Analysis of Data Contamination in Multimodal LLM
von: Song, Dingjie, et al.
Veröffentlicht: (2024)
von: Song, Dingjie, et al.
Veröffentlicht: (2024)
TEMPLE: Incentivizing Temporal Understanding of Video Large Language Models via Progressive Pre-SFT Alignment
von: Li, Shicheng, et al.
Veröffentlicht: (2025)
von: Li, Shicheng, et al.
Veröffentlicht: (2025)
Towards Harmonized Uncertainty Estimation for Large Language Models
von: Li, Rui, et al.
Veröffentlicht: (2025)
von: Li, Rui, et al.
Veröffentlicht: (2025)
Multilingual Machine Translation with Large Language Models: Empirical Results and Analysis
von: Zhu, Wenhao, et al.
Veröffentlicht: (2023)
von: Zhu, Wenhao, et al.
Veröffentlicht: (2023)
How Well Do LLMs Handle Cantonese? Benchmarking Cantonese Capabilities of Large Language Models
von: Jiang, Jiyue, et al.
Veröffentlicht: (2024)
von: Jiang, Jiyue, et al.
Veröffentlicht: (2024)
Training-Free Long-Context Scaling of Large Language Models
von: An, Chenxin, et al.
Veröffentlicht: (2024)
von: An, Chenxin, et al.
Veröffentlicht: (2024)
MileBench: Benchmarking MLLMs in Long Context
von: Song, Dingjie, et al.
Veröffentlicht: (2024)
von: Song, Dingjie, et al.
Veröffentlicht: (2024)
PromptCoT 2.0: Scaling Prompt Synthesis for Large Language Model Reasoning
von: Zhao, Xueliang, et al.
Veröffentlicht: (2025)
von: Zhao, Xueliang, et al.
Veröffentlicht: (2025)
HuatuoGPT-Vision, Towards Injecting Medical Visual Knowledge into Multimodal LLMs at Scale
von: Chen, Junying, et al.
Veröffentlicht: (2024)
von: Chen, Junying, et al.
Veröffentlicht: (2024)
DynaAct: Large Language Model Reasoning with Dynamic Action Spaces
von: Zhao, Xueliang, et al.
Veröffentlicht: (2025)
von: Zhao, Xueliang, et al.
Veröffentlicht: (2025)
Med-Banana-50K: A Cross-modality Large-Scale Dataset for Text-guided Medical Image Editing
von: Chen, Zhihui, et al.
Veröffentlicht: (2025)
von: Chen, Zhihui, et al.
Veröffentlicht: (2025)
Online Training of Large Language Models: Learn while chatting
von: Liang, Juhao, et al.
Veröffentlicht: (2024)
von: Liang, Juhao, et al.
Veröffentlicht: (2024)
ITFormer: Bridging Time Series and Natural Language for Multi-Modal QA with Large-Scale Multitask Dataset
von: Wang, Yilin, et al.
Veröffentlicht: (2025)
von: Wang, Yilin, et al.
Veröffentlicht: (2025)
Feedback-Driven Vision-Language Alignment with Minimal Human Supervision
von: Giannone, Giorgio, et al.
Veröffentlicht: (2025)
von: Giannone, Giorgio, et al.
Veröffentlicht: (2025)
GIRAFFE: Design Choices for Extending the Context Length of Visual Language Models
von: Li, Mukai, et al.
Veröffentlicht: (2024)
von: Li, Mukai, et al.
Veröffentlicht: (2024)
Alignment for Efficient Tool Calling of Large Language Models
von: Xu, Hongshen, et al.
Veröffentlicht: (2025)
von: Xu, Hongshen, et al.
Veröffentlicht: (2025)
A Survey on Large Language Model-Based Social Agents in Game-Theoretic Scenarios
von: Feng, Xiachong, et al.
Veröffentlicht: (2024)
von: Feng, Xiachong, et al.
Veröffentlicht: (2024)
FGAIF: Aligning Large Vision-Language Models with Fine-grained AI Feedback
von: Jing, Liqiang, et al.
Veröffentlicht: (2024)
von: Jing, Liqiang, et al.
Veröffentlicht: (2024)
IterAlign: Iterative Constitutional Alignment of Large Language Models
von: Chen, Xiusi, et al.
Veröffentlicht: (2024)
von: Chen, Xiusi, et al.
Veröffentlicht: (2024)
Scaling Diffusion Language Models via Adaptation from Autoregressive Models
von: Gong, Shansan, et al.
Veröffentlicht: (2024)
von: Gong, Shansan, et al.
Veröffentlicht: (2024)
PromptCoT: Synthesizing Olympiad-level Problems for Mathematical Reasoning in Large Language Models
von: Zhao, Xueliang, et al.
Veröffentlicht: (2025)
von: Zhao, Xueliang, et al.
Veröffentlicht: (2025)
Task Preference Optimization: Improving Multimodal Large Language Models with Vision Task Alignment
von: Yan, Ziang, et al.
Veröffentlicht: (2024)
von: Yan, Ziang, et al.
Veröffentlicht: (2024)
Mol-Instructions: A Large-Scale Biomolecular Instruction Dataset for Large Language Models
von: Fang, Yin, et al.
Veröffentlicht: (2023)
von: Fang, Yin, et al.
Veröffentlicht: (2023)
Ähnliche Einträge
-
Multimodal ArXiv: A Dataset for Improving Scientific Comprehension of Large Vision-Language Models
von: Li, Lei, et al.
Veröffentlicht: (2024) -
VL-RewardBench: A Challenging Benchmark for Vision-Language Generative Reward Models
von: Li, Lei, et al.
Veröffentlicht: (2024) -
Developing and Utilizing a Large-Scale Cantonese Dataset for Multi-Tasking in Large Language Models
von: Jiang, Jiyue, et al.
Veröffentlicht: (2025) -
TalkVid: A Large-Scale Diversified Dataset for Audio-Driven Talking Head Synthesis
von: Chen, Shunian, et al.
Veröffentlicht: (2025) -
BlenderLLM: Training Large Language Models for Computer-Aided Design with Self-improvement
von: Du, Yuhao, et al.
Veröffentlicht: (2024)