Enregistré dans:
| Auteurs principaux: | Shao, Hao, Qian, Shengju, Xiao, Han, Song, Guanglu, Zong, Zhuofan, Wang, Letian, Liu, Yu, Li, Hongsheng |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2403.16999 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DrivingGen: A Comprehensive Benchmark for Generative Video World Models in Autonomous Driving
par: Zhou, Yang, et autres
Publié: (2026)
par: Zhou, Yang, et autres
Publié: (2026)
Exploring the Role of Large Language Models in Prompt Encoding for Diffusion Models
par: Ma, Bingqi, et autres
Publié: (2024)
par: Ma, Bingqi, et autres
Publié: (2024)
MINT-CoT: Enabling Interleaved Visual Tokens in Mathematical Chain-of-Thought Reasoning
par: Chen, Xinyan, et autres
Publié: (2025)
par: Chen, Xinyan, et autres
Publié: (2025)
TIBSTC-CoT: A Multi-Domain Instruction Dataset for Chain-of-Thought Reasoning in Language Models
par: Gao, Fan, et autres
Publié: (2025)
par: Gao, Fan, et autres
Publié: (2025)
CoT-VLA: Visual Chain-of-Thought Reasoning for Vision-Language-Action Models
par: Zhao, Qingqing, et autres
Publié: (2025)
par: Zhao, Qingqing, et autres
Publié: (2025)
L2V-CoT: Cross-Modal Transfer of Chain-of-Thought Reasoning via Latent Intervention
par: Zhan, Yuliang, et autres
Publié: (2025)
par: Zhan, Yuliang, et autres
Publié: (2025)
MME-CoT: Benchmarking Chain-of-Thought in Large Multimodal Models for Reasoning Quality, Robustness, and Efficiency
par: Jiang, Dongzhi, et autres
Publié: (2025)
par: Jiang, Dongzhi, et autres
Publié: (2025)
Video-CoT: A Comprehensive Dataset for Spatiotemporal Understanding of Videos Based on Chain-of-Thought
par: Zhang, Shuyi, et autres
Publié: (2025)
par: Zhang, Shuyi, et autres
Publié: (2025)
EasyRef: Omni-Generalized Group Image Reference for Diffusion Models via Multimodal LLM
par: Zong, Zhuofan, et autres
Publié: (2024)
par: Zong, Zhuofan, et autres
Publié: (2024)
MoVA: Adapting Mixture of Vision Experts to Multimodal Context
par: Zong, Zhuofan, et autres
Publié: (2024)
par: Zong, Zhuofan, et autres
Publié: (2024)
The Curse of CoT: On the Limitations of Chain-of-Thought in In-Context Learning
par: Zheng, Tianshi, et autres
Publié: (2025)
par: Zheng, Tianshi, et autres
Publié: (2025)
CoMat: Aligning Text-to-Image Diffusion Model with Image-to-Text Concept Matching
par: Jiang, Dongzhi, et autres
Publié: (2024)
par: Jiang, Dongzhi, et autres
Publié: (2024)
VG-CoT: Towards Trustworthy Visual Reasoning via Grounded Chain-of-Thought
par: Lim, Byeonggeuk, et autres
Publié: (2026)
par: Lim, Byeonggeuk, et autres
Publié: (2026)
Audio-CoT: Exploring Chain-of-Thought Reasoning in Large Audio Language Model
par: Ma, Ziyang, et autres
Publié: (2025)
par: Ma, Ziyang, et autres
Publié: (2025)
CoT-Evo: Evolutionary Distillation of Chain-of-Thought for Scientific Reasoning
par: Feng, Kehua, et autres
Publié: (2025)
par: Feng, Kehua, et autres
Publié: (2025)
KAM-CoT: Knowledge Augmented Multimodal Chain-of-Thoughts Reasoning
par: Mondal, Debjyoti, et autres
Publié: (2024)
par: Mondal, Debjyoti, et autres
Publié: (2024)
CDW-CoT: Clustered Distance-Weighted Chain-of-Thoughts Reasoning
par: Fang, Yuanheng, et autres
Publié: (2025)
par: Fang, Yuanheng, et autres
Publié: (2025)
M$^3$CoT: A Novel Benchmark for Multi-Domain Multi-step Multi-modal Chain-of-Thought
par: Chen, Qiguang, et autres
Publié: (2024)
par: Chen, Qiguang, et autres
Publié: (2024)
T2I-R1: Reinforcing Image Generation with Collaborative Semantic-level and Token-level CoT
par: Jiang, Dongzhi, et autres
Publié: (2025)
par: Jiang, Dongzhi, et autres
Publié: (2025)
Chain-of-Tools: Utilizing Massive Unseen Tools in the CoT Reasoning of Frozen Language Models
par: Wu, Mengsong, et autres
Publié: (2025)
par: Wu, Mengsong, et autres
Publié: (2025)
Co-CoT: A Prompt-Based Framework for Collaborative Chain-of-Thought Reasoning
par: Yoo, Seunghyun
Publié: (2025)
par: Yoo, Seunghyun
Publié: (2025)
CoT4AD: A Vision-Language-Action Model with Explicit Chain-of-Thought Reasoning for Autonomous Driving
par: Wang, Zhaohui, et autres
Publié: (2025)
par: Wang, Zhaohui, et autres
Publié: (2025)
AIM-CoT: Active Information-driven Multimodal Chain-of-Thought for Vision-Language Reasoning
par: Li, Xiping, et autres
Publié: (2025)
par: Li, Xiping, et autres
Publié: (2025)
CoT-RVS: Zero-Shot Chain-of-Thought Reasoning Segmentation for Videos
par: Kao, Shiu-hong, et autres
Publié: (2025)
par: Kao, Shiu-hong, et autres
Publié: (2025)
CoT-Seg: Rethinking Segmentation with Chain-of-Thought Reasoning and Self-Correction
par: Kao, Shiu-hong, et autres
Publié: (2026)
par: Kao, Shiu-hong, et autres
Publié: (2026)
Step-CoT: Stepwise Visual Chain-of-Thought for Medical Visual Question Answering
par: Fan, Lin, et autres
Publié: (2026)
par: Fan, Lin, et autres
Publié: (2026)
VividFace: A Diffusion-Based Hybrid Framework for High-Fidelity Video Face Swapping
par: Shao, Hao, et autres
Publié: (2024)
par: Shao, Hao, et autres
Publié: (2024)
CoT-X: An Adaptive Framework for Cross-Model Chain-of-Thought Transfer and Optimization
par: Bi, Ziqian, et autres
Publié: (2025)
par: Bi, Ziqian, et autres
Publié: (2025)
Benchmarking Multi-Image Understanding in Vision and Language Models: Perception, Knowledge, Reasoning, and Multi-Hop Reasoning
par: Zhao, Bingchen, et autres
Publié: (2024)
par: Zhao, Bingchen, et autres
Publié: (2024)
DraCo: Draft as CoT for Text-to-Image Preview and Rare Concept Generation
par: Jiang, Dongzhi, et autres
Publié: (2025)
par: Jiang, Dongzhi, et autres
Publié: (2025)
SIM-CoT: Supervised Implicit Chain-of-Thought
par: Wei, Xilin, et autres
Publié: (2025)
par: Wei, Xilin, et autres
Publié: (2025)
LMGenDrive: Bridging Multimodal Understanding and Generative World Modeling for End-to-End Driving
par: Shao, Hao, et autres
Publié: (2026)
par: Shao, Hao, et autres
Publié: (2026)
CoT-Segmenter: Enhancing OOD Detection in Dense Road Scenes via Chain-of-Thought Reasoning
par: Song, Jeonghyo, et autres
Publié: (2025)
par: Song, Jeonghyo, et autres
Publié: (2025)
Vis-CoT: A Human-in-the-Loop Framework for Interactive Visualization and Intervention in LLM Chain-of-Thought Reasoning
par: Pather, Kaviraj, et autres
Publié: (2025)
par: Pather, Kaviraj, et autres
Publié: (2025)
CAP-CoT: Cycle Adversarial Prompt for Improving Chain of Thoughts in LLM Reasoning
par: Chen, Shuxu, et autres
Publié: (2026)
par: Chen, Shuxu, et autres
Publié: (2026)
Chain-of-Sanitized-Thoughts: Plugging PII Leakage in CoT of Large Reasoning Models
par: Das, Arghyadeep, et autres
Publié: (2026)
par: Das, Arghyadeep, et autres
Publié: (2026)
Deconstructing Long Chain-of-Thought: A Structured Reasoning Optimization Framework for Long CoT Distillation
par: Luo, Yijia, et autres
Publié: (2025)
par: Luo, Yijia, et autres
Publié: (2025)
GTR-CoT: Graph Traversal as Visual Chain of Thought for Molecular Structure Recognition
par: Wang, Jingchao, et autres
Publié: (2025)
par: Wang, Jingchao, et autres
Publié: (2025)
CoT-Valve: Length-Compressible Chain-of-Thought Tuning
par: Ma, Xinyin, et autres
Publié: (2025)
par: Ma, Xinyin, et autres
Publié: (2025)
R-CoT: A Reasoning-Layer Watermark via Redundant Chain-of-Thought in Large Language Models
par: Zhang, Ziming, et autres
Publié: (2026)
par: Zhang, Ziming, et autres
Publié: (2026)
Documents similaires
-
DrivingGen: A Comprehensive Benchmark for Generative Video World Models in Autonomous Driving
par: Zhou, Yang, et autres
Publié: (2026) -
Exploring the Role of Large Language Models in Prompt Encoding for Diffusion Models
par: Ma, Bingqi, et autres
Publié: (2024) -
MINT-CoT: Enabling Interleaved Visual Tokens in Mathematical Chain-of-Thought Reasoning
par: Chen, Xinyan, et autres
Publié: (2025) -
TIBSTC-CoT: A Multi-Domain Instruction Dataset for Chain-of-Thought Reasoning in Language Models
par: Gao, Fan, et autres
Publié: (2025) -
CoT-VLA: Visual Chain-of-Thought Reasoning for Vision-Language-Action Models
par: Zhao, Qingqing, et autres
Publié: (2025)