ACT as Human: Multimodal Large Language Model Data Annotation with Critical Thinking
Fuente:
arXiv
Saved in:
| Main Authors: | Lin, Lequan, Shi, Dai, Han, Andi, Chen, Feng, Chen, Qiuzheng, Li, Jiawen, Li, Zhaoyang, Li, Jiyuan, Sun, Zhenbang, Gao, Junbin |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
SpecSTG: A Fast Spectral Diffusion Framework for Probabilistic Spatio-Temporal Traffic Forecasting
by: Lin, Lequan, et al.
Published: (2024)
by: Lin, Lequan, et al.
Published: (2024)
Unleash Graph Neural Networks from Heavy Tuning
by: Lin, Lequan, et al.
Published: (2024)
by: Lin, Lequan, et al.
Published: (2024)
Diffusing to the Top: Boost Graph Neural Networks with Minimal Hyperparameter Tuning
by: Lin, Lequan, et al.
Published: (2024)
by: Lin, Lequan, et al.
Published: (2024)
Evaluating and Advancing Multimodal Large Language Models in Perception Ability Lens
by: Chen, Feng, et al.
Published: (2024)
by: Chen, Feng, et al.
Published: (2024)
When Graph Neural Networks Meet Dynamic Mode Decomposition
by: Shi, Dai, et al.
Published: (2024)
by: Shi, Dai, et al.
Published: (2024)
Design Your Own Universe: A Physics-Informed Agnostic Method for Enhancing Graph Neural Networks
by: Shi, Dai, et al.
Published: (2024)
by: Shi, Dai, et al.
Published: (2024)
Effectively Enhancing Vision Language Large Models by Prompt Augmentation and Caption Utilization
by: Zhao, Minyi, et al.
Published: (2024)
by: Zhao, Minyi, et al.
Published: (2024)
LOFT: Low-Rank Orthogonal Fine-Tuning via Task-Aware Support Selection
by: Zhao, Lanxin, et al.
Published: (2026)
by: Zhao, Lanxin, et al.
Published: (2026)
On the Price of Privacy for Language Identification and Generation
by: Li, Xiaoyu, et al.
Published: (2026)
by: Li, Xiaoyu, et al.
Published: (2026)
Expanding the Chaos: Neural Operator for Stochastic (Partial) Differential Equations
by: Shi, Dai, et al.
Published: (2026)
by: Shi, Dai, et al.
Published: (2026)
S$^3$GNN: Efficient Global Mixing and Local Message Passing for Long-Range Graph Learning
by: Shi, Dai, et al.
Published: (2026)
by: Shi, Dai, et al.
Published: (2026)
Exploring the Role of Explicit Temporal Modeling in Multimodal Large Language Models for Video Understanding
by: Li, Yun, et al.
Published: (2025)
by: Li, Yun, et al.
Published: (2025)
Contrastive Identification and Generation in the Limit
by: Li, Xiaoyu, et al.
Published: (2026)
by: Li, Xiaoyu, et al.
Published: (2026)
OmniSparse: Training-Aware Fine-Grained Sparse Attention for Long-Video MLLMs
by: Chen, Feng, et al.
Published: (2025)
by: Chen, Feng, et al.
Published: (2025)
ATOM: A Pretrained Neural Operator for Multitask Molecular Dynamics
by: Thompson, Luke, et al.
Published: (2025)
by: Thompson, Luke, et al.
Published: (2025)
CoAnnotating: Uncertainty-Guided Work Allocation between Human and Large Language Models for Data Annotation
by: Li, Minzhi, et al.
Published: (2023)
by: Li, Minzhi, et al.
Published: (2023)
Wiener Chaos Expansion based Neural Operator for Singular Stochastic Partial Differential Equations
by: Shi, Dai, et al.
Published: (2026)
by: Shi, Dai, et al.
Published: (2026)
Large Language Models Are Effective Human Annotation Assistants, But Not Good Independent Annotators
by: Gu, Feng, et al.
Published: (2025)
by: Gu, Feng, et al.
Published: (2025)
Democratizing Large Language Model-Based Graph Data Augmentation via Latent Knowledge Graphs
by: Feng, Yushi, et al.
Published: (2025)
by: Feng, Yushi, et al.
Published: (2025)
CTR-Driven Advertising Image Generation with Multimodal Large Language Models
by: Chen, Xingye, et al.
Published: (2025)
by: Chen, Xingye, et al.
Published: (2025)
Towards Localized and Disentangled Knowledge Editing for Multimodal Large Language Models
by: Gu, Leijiang, et al.
Published: (2026)
by: Gu, Leijiang, et al.
Published: (2026)
Interior instability of naked singularities of a scalar field
by: Li, Junbin
Published: (2025)
by: Li, Junbin
Published: (2025)
Annotation-Free Visual Reasoning for High-Resolution Large Multimodal Models via Reinforcement Learning
by: Yang, Jiacheng, et al.
Published: (2026)
by: Yang, Jiacheng, et al.
Published: (2026)
Think in Safety: Unveiling and Mitigating Safety Alignment Collapse in Multimodal Large Reasoning Model
by: Lou, Xinyue, et al.
Published: (2025)
by: Lou, Xinyue, et al.
Published: (2025)
Visualising Policy-Reward Interplay to Inform Zeroth-Order Preference Optimisation of Large Language Models
by: Galatolo, Alessio, et al.
Published: (2025)
by: Galatolo, Alessio, et al.
Published: (2025)
You Think, You ACT: The New Task of Arbitrary Text to Motion Generation
by: Wang, Runqi, et al.
Published: (2024)
by: Wang, Runqi, et al.
Published: (2024)
Thinking in Dynamics: How Multimodal Large Language Models Perceive, Track, and Reason Dynamics in Physical 4D World
by: Huang, Yuzhi, et al.
Published: (2026)
by: Huang, Yuzhi, et al.
Published: (2026)
Thinking in Space: How Multimodal Large Language Models See, Remember, and Recall Spaces
by: Yang, Jihan, et al.
Published: (2024)
by: Yang, Jihan, et al.
Published: (2024)
Benchmarking the Thinking Mode of Multimodal Large Language Models in Clinical Tasks
by: Hong, Jindong, et al.
Published: (2025)
by: Hong, Jindong, et al.
Published: (2025)
MMIE: Massive Multimodal Interleaved Comprehension Benchmark for Large Vision-Language Models
by: Xia, Peng, et al.
Published: (2024)
by: Xia, Peng, et al.
Published: (2024)
Are Multimodal Large Language Models Good Annotators for Image Tagging?
by: Xie, Ming-Kun, et al.
Published: (2026)
by: Xie, Ming-Kun, et al.
Published: (2026)
From Perception to Reasoning: Deep Thinking Empowers Multimodal Large Language Models
by: Zhu, Wenxin, et al.
Published: (2025)
by: Zhu, Wenxin, et al.
Published: (2025)
RAP: Retrieval-Augmented Personalization for Multimodal Large Language Models
by: Hao, Haoran, et al.
Published: (2024)
by: Hao, Haoran, et al.
Published: (2024)
Identify Critical Nodes in Complex Network with Large Language Models
by: Mao, Jinzhu, et al.
Published: (2024)
by: Mao, Jinzhu, et al.
Published: (2024)
A Riemannian Approach to Ground Metric Learning for Optimal Transport
by: Jawanpuria, Pratik, et al.
Published: (2024)
by: Jawanpuria, Pratik, et al.
Published: (2024)
Graph Pseudotime Analysis and Neural Stochastic Differential Equations for Analyzing Retinal Degeneration Dynamics and Beyond
by: Shi, Dai, et al.
Published: (2025)
by: Shi, Dai, et al.
Published: (2025)
Identification of large polarons and exciton polarons in rutile and anatase polymorphs of titanium dioxide
by: Dai, Zhenbang, et al.
Published: (2024)
by: Dai, Zhenbang, et al.
Published: (2024)
ACT-Era Constraints on Single-Field Inflation in $f(T)$ Teleparallel Gravity
by: Zhang, Feng-Yi, et al.
Published: (2025)
by: Zhang, Feng-Yi, et al.
Published: (2025)
CellTypeAgent: Trustworthy cell type annotation with Large Language Models
by: Chen, Jiawen, et al.
Published: (2025)
by: Chen, Jiawen, et al.
Published: (2025)
Towards Large-scale Chemical Reaction Image Parsing via a Multimodal Large Language Model
by: Chen, Yufan, et al.
Published: (2025)
by: Chen, Yufan, et al.
Published: (2025)
Similar Items
-
SpecSTG: A Fast Spectral Diffusion Framework for Probabilistic Spatio-Temporal Traffic Forecasting
by: Lin, Lequan, et al.
Published: (2024) -
Unleash Graph Neural Networks from Heavy Tuning
by: Lin, Lequan, et al.
Published: (2024) -
Diffusing to the Top: Boost Graph Neural Networks with Minimal Hyperparameter Tuning
by: Lin, Lequan, et al.
Published: (2024) -
Evaluating and Advancing Multimodal Large Language Models in Perception Ability Lens
by: Chen, Feng, et al.
Published: (2024) -
When Graph Neural Networks Meet Dynamic Mode Decomposition
by: Shi, Dai, et al.
Published: (2024)