Beyond Chain-of-Thought: Rewrite as a Universal Interface for Generative Multimodal Embeddings
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Peixi, Mei, Ke, Ma, Feipeng, Chai, Bosong, Lan, Zhibin, Zhao, Chenxi, Yan, Shannan, Chen, Jie, Hu, Zhangchi, Peng, Yansong, Lin, Bo, Zhou, Junjie, Yin, Dacheng, Wang, Tianyi, Rao, Fengyun, Lyu, Jing, Li, Hebei, Sun, Xiaoyan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Efficient Spiking Point Mamba for Point Cloud Analysis
por: Wu, Peixi, et al.
Publicado: (2025)
por: Wu, Peixi, et al.
Publicado: (2025)
Spiking Point Transformer for Point Cloud Classification
por: Wu, Peixi, et al.
Publicado: (2025)
por: Wu, Peixi, et al.
Publicado: (2025)
Dome-DETR: DETR with Density-Oriented Feature-Query Manipulation for Efficient Tiny Object Detection
por: Hu, Zhangchi, et al.
Publicado: (2025)
por: Hu, Zhangchi, et al.
Publicado: (2025)
DASH: 4D Hash Encoding with Self-Supervised Decomposition for Real-Time Dynamic Scene Rendering
por: Chen, Jie, et al.
Publicado: (2025)
por: Chen, Jie, et al.
Publicado: (2025)
AdaMem: Adaptive User-Centric Memory for Long-Horizon Dialogue Agents
por: Yan, Shannan, et al.
Publicado: (2026)
por: Yan, Shannan, et al.
Publicado: (2026)
Enhanced Object Detection: A Study on Vast Vocabulary Object Detection Track for V3Det Challenge 2024
por: Wu, Peixi, et al.
Publicado: (2024)
por: Wu, Peixi, et al.
Publicado: (2024)
D-FINE: Redefine Regression Task in DETRs as Fine-grained Distribution Refinement
por: Peng, Yansong, et al.
Publicado: (2024)
por: Peng, Yansong, et al.
Publicado: (2024)
Efficient Event-Based Semantic Segmentation via Exploiting Frame-Event Fusion: A Hybrid Neural Network Approach
por: Li, Hebei, et al.
Publicado: (2025)
por: Li, Hebei, et al.
Publicado: (2025)
WAVE: Learning Unified & Versatile Audio-Visual Embeddings with Multimodal LLM
por: Tang, Changli, et al.
Publicado: (2025)
por: Tang, Changli, et al.
Publicado: (2025)
RiO-DETR: DETR for Real-time Oriented Object Detection
por: Hu, Zhangchi, et al.
Publicado: (2026)
por: Hu, Zhangchi, et al.
Publicado: (2026)
EE-MLLM: A Data-Efficient and Compute-Efficient Multimodal Large Language Model
por: Ma, Feipeng, et al.
Publicado: (2024)
por: Ma, Feipeng, et al.
Publicado: (2024)
HarmonySet: A Comprehensive Dataset for Understanding Video-Music Semantic Alignment and Temporal Synchronization
por: Zhou, Zitang, et al.
Publicado: (2025)
por: Zhou, Zitang, et al.
Publicado: (2025)
WeThink: Toward General-purpose Vision-Language Reasoning via Reinforcement Learning
por: Yang, Jie, et al.
Publicado: (2025)
por: Yang, Jie, et al.
Publicado: (2025)
Multi-Modal Generative Embedding Model
por: Ma, Feipeng, et al.
Publicado: (2024)
por: Ma, Feipeng, et al.
Publicado: (2024)
Scene Adaptive Sparse Transformer for Event-based Object Detection
por: Peng, Yansong, et al.
Publicado: (2024)
por: Peng, Yansong, et al.
Publicado: (2024)
D-ORCA: Dialogue-Centric Optimization for Robust Audio-Visual Captioning
por: Tang, Changli, et al.
Publicado: (2026)
por: Tang, Changli, et al.
Publicado: (2026)
ObjEmbed: Towards Universal Multimodal Object Embeddings
por: Fu, Shenghao, et al.
Publicado: (2026)
por: Fu, Shenghao, et al.
Publicado: (2026)
Create Anything Anywhere: Layout-Controllable Personalized Diffusion Model for Multiple Subjects
por: Li, Wei, et al.
Publicado: (2025)
por: Li, Wei, et al.
Publicado: (2025)
Think When You Need: Self-Adaptive Chain-of-Thought Learning
por: Yang, Junjie, et al.
Publicado: (2025)
por: Yang, Junjie, et al.
Publicado: (2025)
REVERSE: Reinforcing Evidence Verification and Search for Agentic Image geo-localization
por: Li, Yong, et al.
Publicado: (2026)
por: Li, Yong, et al.
Publicado: (2026)
FACM: Flow-Anchored Consistency Models
por: Peng, Yansong, et al.
Publicado: (2025)
por: Peng, Yansong, et al.
Publicado: (2025)
Learning Cross-View Object Correspondence via Cycle-Consistent Mask Prediction
por: Yan, Shannan, et al.
Publicado: (2026)
por: Yan, Shannan, et al.
Publicado: (2026)
Structured Style-Rewrite with Chain-of-Thought Planning for Low-Resource Character Dialogue
por: Zhu, Chanhui
Publicado: (2026)
por: Zhu, Chanhui
Publicado: (2026)
Public attitudes toward personalized medicine in breast cancer
por: Shannan, Ghassan
Publicado: (2026)
por: Shannan, Ghassan
Publicado: (2026)
El sonido y la furia: la persuasión multicultural en México y Estados Unidos, por José Antonio Aguilar Rivera, México, Santillana Ediciones Generales, 2004, 292 p.
por: Shannan Mattiace
Publicado: (2007)
por: Shannan Mattiace
Publicado: (2007)
Reformas multiculturales para los mayas de Yucatán
por: Shannan Mattiace
Publicado: (2015)
por: Shannan Mattiace
Publicado: (2015)
Visual Perception by Large Language Model's Weights
por: Ma, Feipeng, et al.
Publicado: (2024)
por: Ma, Feipeng, et al.
Publicado: (2024)
Deep Multi-Threshold Spiking-UNet for Image Processing
por: Li, Hebei, et al.
Publicado: (2023)
por: Li, Hebei, et al.
Publicado: (2023)
Retrieval-Augmented Self-Taught Reasoning Model with Adaptive Chain-of-Thought for ASR Named Entity Correction
por: An, Junjie, et al.
Publicado: (2026)
por: An, Junjie, et al.
Publicado: (2026)
AdvChain: Adversarial Chain-of-Thought Tuning for Robust Safety Alignment of Large Reasoning Models
por: Zhu, Zihao, et al.
Publicado: (2025)
por: Zhu, Zihao, et al.
Publicado: (2025)
Learning to Compress Graphs via Dual Agents for Consistent Topological Robustness Evaluation
por: Chai, Qisen, et al.
Publicado: (2025)
por: Chai, Qisen, et al.
Publicado: (2025)
Personalized Chain-of-Thought Summarization of Financial News for Investor Decision Support
por: Zhang, Tianyi, et al.
Publicado: (2025)
por: Zhang, Tianyi, et al.
Publicado: (2025)
CoTKR: Chain-of-Thought Enhanced Knowledge Rewriting for Complex Knowledge Graph Question Answering
por: Wu, Yike, et al.
Publicado: (2024)
por: Wu, Yike, et al.
Publicado: (2024)
Revisiting Overthinking in Long Chain-of-Thought from the Perspective of Self-Doubt
por: Peng, Keqin, et al.
Publicado: (2025)
por: Peng, Keqin, et al.
Publicado: (2025)
ExpLLM: Towards Chain of Thought for Facial Expression Recognition
por: Lan, Xing, et al.
Publicado: (2024)
por: Lan, Xing, et al.
Publicado: (2024)
Upfront Chain-of-Thought: A Cooperative Framework for Chain-of-Thought Compression
por: Li, Chengzhengxu, et al.
Publicado: (2025)
por: Li, Chengzhengxu, et al.
Publicado: (2025)
When the Chain Breaks: Interactive Diagnosis of LLM Chain-of-Thought Reasoning Errors
por: Chen, Shiwei, et al.
Publicado: (2026)
por: Chen, Shiwei, et al.
Publicado: (2026)
HQ-CLIP: Leveraging Large Vision-Language Models to Create High-Quality Image-Text Datasets and CLIP Models
por: Wei, Zhixiang, et al.
Publicado: (2025)
por: Wei, Zhixiang, et al.
Publicado: (2025)
Event-assisted Low-Light Video Object Segmentation
por: Li, Hebei, et al.
Publicado: (2024)
por: Li, Hebei, et al.
Publicado: (2024)
WeMMU: Enhanced Bridging of Vision-Language Models and Diffusion Models via Noisy Query Tokens
por: Yang, Jian, et al.
Publicado: (2025)
por: Yang, Jian, et al.
Publicado: (2025)
Ejemplares similares
-
Efficient Spiking Point Mamba for Point Cloud Analysis
por: Wu, Peixi, et al.
Publicado: (2025) -
Spiking Point Transformer for Point Cloud Classification
por: Wu, Peixi, et al.
Publicado: (2025) -
Dome-DETR: DETR with Density-Oriented Feature-Query Manipulation for Efficient Tiny Object Detection
por: Hu, Zhangchi, et al.
Publicado: (2025) -
DASH: 4D Hash Encoding with Self-Supervised Decomposition for Real-Time Dynamic Scene Rendering
por: Chen, Jie, et al.
Publicado: (2025) -
AdaMem: Adaptive User-Centric Memory for Long-Horizon Dialogue Agents
por: Yan, Shannan, et al.
Publicado: (2026)