Can Multimodal Large Language Model Think Analogically?
Fuente:
arXiv
Salvato in:
| Autori principali: | Guo, Diandian, Cao, Cong, Yuan, Fangfang, Wang, Dakui, Ma, Wei, Liu, Yanbing, Fu, Jianhui |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MuVaC: A Variational Causal Framework for Multimodal Sarcasm Understanding in Dialogues
di: Guo, Diandian, et al.
Pubblicazione: (2026)
di: Guo, Diandian, et al.
Pubblicazione: (2026)
Multi-View Incongruity Learning for Multimodal Sarcasm Detection
di: Guo, Diandian, et al.
Pubblicazione: (2024)
di: Guo, Diandian, et al.
Pubblicazione: (2024)
CRAFT: Calibrated Reasoning with Answer-Faithful Traces via Reinforcement Learning for Multi-Hop Question Answering
di: Liu, Yu, et al.
Pubblicazione: (2026)
di: Liu, Yu, et al.
Pubblicazione: (2026)
StreamingThinker: Large Language Models Can Think While Reading
di: Tong, Junlong, et al.
Pubblicazione: (2025)
di: Tong, Junlong, et al.
Pubblicazione: (2025)
BLINK: Multimodal Large Language Models Can See but Not Perceive
di: Fu, Xingyu, et al.
Pubblicazione: (2024)
di: Fu, Xingyu, et al.
Pubblicazione: (2024)
Traj-MLLM: Can Multimodal Large Language Models Reform Trajectory Data Mining?
di: Liu, Shuo, et al.
Pubblicazione: (2025)
di: Liu, Shuo, et al.
Pubblicazione: (2025)
Thinking with Sound: Audio Chain-of-Thought Enables Multimodal Reasoning in Large Audio-Language Models
di: Xiong, Zhen, et al.
Pubblicazione: (2025)
di: Xiong, Zhen, et al.
Pubblicazione: (2025)
Fast Thinking for Large Language Models
di: Zheng, Haoyu, et al.
Pubblicazione: (2025)
di: Zheng, Haoyu, et al.
Pubblicazione: (2025)
THiNK: Can Large Language Models Think-aloud?
di: Yu, Yongan, et al.
Pubblicazione: (2025)
di: Yu, Yongan, et al.
Pubblicazione: (2025)
Have Multimodal Large Language Models (MLLMs) Really Learned to Tell the Time on Analog Clocks?
di: Fu, Tairan, et al.
Pubblicazione: (2025)
di: Fu, Tairan, et al.
Pubblicazione: (2025)
Can Large Vision-Language Models Understand Multimodal Sarcasm?
di: Wang, Xinyu, et al.
Pubblicazione: (2025)
di: Wang, Xinyu, et al.
Pubblicazione: (2025)
TypedThinker: Diversify Large Language Model Reasoning with Typed Thinking
di: Wang, Danqing, et al.
Pubblicazione: (2024)
di: Wang, Danqing, et al.
Pubblicazione: (2024)
The Curious Case of Analogies: Investigating Analogical Reasoning in Large Language Models
di: Lee, Taewhoo, et al.
Pubblicazione: (2025)
di: Lee, Taewhoo, et al.
Pubblicazione: (2025)
When Can Large Reasoning Models Save Thinking? Mechanistic Analysis of Behavioral Divergence in Reasoning
di: Zhu, Rongzhi, et al.
Pubblicazione: (2025)
di: Zhu, Rongzhi, et al.
Pubblicazione: (2025)
Past Meets Present: Creating Historical Analogy with Large Language Models
di: Li, Nianqi, et al.
Pubblicazione: (2024)
di: Li, Nianqi, et al.
Pubblicazione: (2024)
Cognitive Decision Routing in Large Language Models: When to Think Fast, When to Think Slow
di: Du, Y., et al.
Pubblicazione: (2025)
di: Du, Y., et al.
Pubblicazione: (2025)
Can Video Large Multimodal Models Think Like Doubters-or Double-Down: A Study on Defeasible Video Entailment
di: Zhang, Yue, et al.
Pubblicazione: (2025)
di: Zhang, Yue, et al.
Pubblicazione: (2025)
Actial: Activate Spatial Reasoning Ability of Multimodal Large Language Models
di: Zhan, Xiaoyu, et al.
Pubblicazione: (2025)
di: Zhan, Xiaoyu, et al.
Pubblicazione: (2025)
Can We Edit Multimodal Large Language Models?
di: Cheng, Siyuan, et al.
Pubblicazione: (2023)
di: Cheng, Siyuan, et al.
Pubblicazione: (2023)
On the Thinking-Language Modeling Gap in Large Language Models
di: Liu, Chenxi, et al.
Pubblicazione: (2025)
di: Liu, Chenxi, et al.
Pubblicazione: (2025)
ThinkDial: An Open Recipe for Controlling Reasoning Effort in Large Language Models
di: He, Qianyu, et al.
Pubblicazione: (2025)
di: He, Qianyu, et al.
Pubblicazione: (2025)
SNS-Bench-VL: Benchmarking Multimodal Large Language Models in Social Networking Services
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
di: Guo, Hongcheng, et al.
Pubblicazione: (2025)
Textual Steering Vectors Can Improve Visual Understanding in Multimodal Large Language Models
di: Gan, Woody Haosheng, et al.
Pubblicazione: (2025)
di: Gan, Woody Haosheng, et al.
Pubblicazione: (2025)
TextLDM: Language Modeling with Continuous Latent Diffusion
di: Jiang, Jiaxiu, et al.
Pubblicazione: (2026)
di: Jiang, Jiaxiu, et al.
Pubblicazione: (2026)
Importance Weighting Can Help Large Language Models Self-Improve
di: Jiang, Chunyang, et al.
Pubblicazione: (2024)
di: Jiang, Chunyang, et al.
Pubblicazione: (2024)
From Perception to Reasoning: Deep Thinking Empowers Multimodal Large Language Models
di: Zhu, Wenxin, et al.
Pubblicazione: (2025)
di: Zhu, Wenxin, et al.
Pubblicazione: (2025)
Can Thinking Models Think to Detect Hateful Memes?
di: Kmainasi, Mohamed Bayan, et al.
Pubblicazione: (2026)
di: Kmainasi, Mohamed Bayan, et al.
Pubblicazione: (2026)
"I See What You Did There": Can Large Vision-Language Models Understand Multimodal Puns?
di: Xu, Naen, et al.
Pubblicazione: (2026)
di: Xu, Naen, et al.
Pubblicazione: (2026)
Delving into the Reversal Curse: How Far Can Large Language Models Generalize?
di: Lin, Zhengkai, et al.
Pubblicazione: (2024)
di: Lin, Zhengkai, et al.
Pubblicazione: (2024)
How Can Large Language Models Understand Spatial-Temporal Data?
di: Liu, Lei, et al.
Pubblicazione: (2024)
di: Liu, Lei, et al.
Pubblicazione: (2024)
Can Large Language Models Understand Context?
di: Zhu, Yilun, et al.
Pubblicazione: (2024)
di: Zhu, Yilun, et al.
Pubblicazione: (2024)
Reasoning Models Can Be Effective Without Thinking
di: Ma, Wenjie, et al.
Pubblicazione: (2025)
di: Ma, Wenjie, et al.
Pubblicazione: (2025)
Think-on-Graph: Deep and Responsible Reasoning of Large Language Model on Knowledge Graph
di: Sun, Jiashuo, et al.
Pubblicazione: (2023)
di: Sun, Jiashuo, et al.
Pubblicazione: (2023)
Break the Chain: Large Language Models Can be Shortcut Reasoners
di: Ding, Mengru, et al.
Pubblicazione: (2024)
di: Ding, Mengru, et al.
Pubblicazione: (2024)
Position: Multimodal Large Language Models Can Significantly Advance Scientific Reasoning
di: Yan, Yibo, et al.
Pubblicazione: (2025)
di: Yan, Yibo, et al.
Pubblicazione: (2025)
CALM: Curiosity-Driven Auditing for Large Language Models
di: Zheng, Xiang, et al.
Pubblicazione: (2025)
di: Zheng, Xiang, et al.
Pubblicazione: (2025)
Learning Domain Knowledge in Multimodal Large Language Models through Reinforcement Fine-Tuning
di: Cao, Qinglong, et al.
Pubblicazione: (2026)
di: Cao, Qinglong, et al.
Pubblicazione: (2026)
Can Large Language Models Master Complex Card Games?
di: Wang, Wei, et al.
Pubblicazione: (2025)
di: Wang, Wei, et al.
Pubblicazione: (2025)
A Comprehensive Survey of Large Language Models and Multimodal Large Language Models in Medicine
di: Xiao, Hanguang, et al.
Pubblicazione: (2024)
di: Xiao, Hanguang, et al.
Pubblicazione: (2024)
Benchmarking the Thinking Mode of Multimodal Large Language Models in Clinical Tasks
di: Hong, Jindong, et al.
Pubblicazione: (2025)
di: Hong, Jindong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MuVaC: A Variational Causal Framework for Multimodal Sarcasm Understanding in Dialogues
di: Guo, Diandian, et al.
Pubblicazione: (2026) -
Multi-View Incongruity Learning for Multimodal Sarcasm Detection
di: Guo, Diandian, et al.
Pubblicazione: (2024) -
CRAFT: Calibrated Reasoning with Answer-Faithful Traces via Reinforcement Learning for Multi-Hop Question Answering
di: Liu, Yu, et al.
Pubblicazione: (2026) -
StreamingThinker: Large Language Models Can Think While Reading
di: Tong, Junlong, et al.
Pubblicazione: (2025) -
BLINK: Multimodal Large Language Models Can See but Not Perceive
di: Fu, Xingyu, et al.
Pubblicazione: (2024)