TTE-Flash: Accelerating Reasoning-based Multimodal Representations via Think-Then-Embed Tokens
Fuente:
arXiv
Salvato in:
| Autori principali: | Cheng, Jianpeng, Wu, Xian, Zhang, Jiangfan, Bao, Wentao, Ahuja, Chaitanya, Mishra, Shlok Kumar, Yu, Hanchao, Gao, Yang, Xia, Fan, Guo, Qi, Zhai, Shaodan, Fan, Xiangjun, Xiao, Jun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Think Then Embed: Generative Context Improves Multimodal Embedding
di: Cui, Xuanming, et al.
Pubblicazione: (2025)
di: Cui, Xuanming, et al.
Pubblicazione: (2025)
Reason to Contrast: A Cascaded Multimodal Retrieval Framework
di: Cui, Xuanming, et al.
Pubblicazione: (2025)
di: Cui, Xuanming, et al.
Pubblicazione: (2025)
TTE GLP
di: TTE
Pubblicazione: (2024)
di: TTE
Pubblicazione: (2024)
FlashVLM: Text-Guided Visual Token Selection for Large Multimodal Models
di: Cai, Kaitong, et al.
Pubblicazione: (2025)
di: Cai, Kaitong, et al.
Pubblicazione: (2025)
FlashThink: An Early Exit Method For Efficient Reasoning
di: Jiang, Guochao, et al.
Pubblicazione: (2025)
di: Jiang, Guochao, et al.
Pubblicazione: (2025)
Representation Shift: Unifying Token Compression with FlashAttention
di: Choi, Joonmyung, et al.
Pubblicazione: (2025)
di: Choi, Joonmyung, et al.
Pubblicazione: (2025)
DutyTTE: Deciphering Uncertainty in Origin-Destination Travel Time Estimation
di: Mao, Xiaowei, et al.
Pubblicazione: (2024)
di: Mao, Xiaowei, et al.
Pubblicazione: (2024)
CAFe: Unifying Representation and Generation with Contrastive-Autoregressive Finetuning
di: Yu, Hao, et al.
Pubblicazione: (2025)
di: Yu, Hao, et al.
Pubblicazione: (2025)
Generic Multimodal Spatially Graph Network for Spatially Embedded Network Representation Learning
di: Fan, Xudong, et al.
Pubblicazione: (2025)
di: Fan, Xudong, et al.
Pubblicazione: (2025)
Unifying Contrastive and Generative Objectives for Visual Understanding and Text-to-Image Generation
di: Li, Chao, et al.
Pubblicazione: (2026)
di: Li, Chao, et al.
Pubblicazione: (2026)
VTool-R1: VLMs Learn to Think with Images via Reinforcement Learning on Multimodal Tool Use
di: Wu, Mingyuan, et al.
Pubblicazione: (2025)
di: Wu, Mingyuan, et al.
Pubblicazione: (2025)
Structured Abductive-Deductive-Inductive Reasoning for LLMs via Algebraic Invariants
di: Gilda, Sankalp, et al.
Pubblicazione: (2026)
di: Gilda, Sankalp, et al.
Pubblicazione: (2026)
EfficientXLang: Towards Improving Token Efficiency Through Cross-Lingual Reasoning
di: Ahuja, Sanchit, et al.
Pubblicazione: (2025)
di: Ahuja, Sanchit, et al.
Pubblicazione: (2025)
Understand, Think, and Answer: Advancing Visual Reasoning with Large Multimodal Models
di: Zhan, Yufei, et al.
Pubblicazione: (2025)
di: Zhan, Yufei, et al.
Pubblicazione: (2025)
AStar: Boosting Multimodal Reasoning with Automated Structured Thinking
di: Wu, Jinyang, et al.
Pubblicazione: (2025)
di: Wu, Jinyang, et al.
Pubblicazione: (2025)
Not All Tokens Learn Alike: Attention Entropy Reveals Heterogeneous Signals in RL Reasoning
di: Li, Gengyang, et al.
Pubblicazione: (2026)
di: Li, Gengyang, et al.
Pubblicazione: (2026)
Value, Representation, Information and Communication
di: Peng, Xiangjun
Pubblicazione: (2024)
di: Peng, Xiangjun
Pubblicazione: (2024)
LongCat-Flash-Thinking-2601 Technical Report
di: Meituan LongCat Team, et al.
Pubblicazione: (2026)
di: Meituan LongCat Team, et al.
Pubblicazione: (2026)
FlashSyn: Flash Loan Attack Synthesis via Counter Example Driven Approximation
di: Chen, Zhiyang, et al.
Pubblicazione: (2022)
di: Chen, Zhiyang, et al.
Pubblicazione: (2022)
Power Allocation for Coordinated Multi-Point Aided ISAC Systems
di: Zou, Jianpeng, et al.
Pubblicazione: (2025)
di: Zou, Jianpeng, et al.
Pubblicazione: (2025)
Xray-Visual Models: Scaling Vision models on Industry Scale Data
di: Mishra, Shlok, et al.
Pubblicazione: (2026)
di: Mishra, Shlok, et al.
Pubblicazione: (2026)
Magic-MM-Embedding: Towards Visual-Token-Efficient Universal Multimodal Embedding with MLLMs
di: Li, Qi, et al.
Pubblicazione: (2026)
di: Li, Qi, et al.
Pubblicazione: (2026)
OpenProposal Platform for Transparent Research Funding Review
di: Ahuja, Sakshi, et al.
Pubblicazione: (2025)
di: Ahuja, Sakshi, et al.
Pubblicazione: (2025)
Scaling Reasoning Tokens via RL and Parallel Thinking: Evidence From Competitive Programming
di: Zhang, Qianfan, et al.
Pubblicazione: (2026)
di: Zhang, Qianfan, et al.
Pubblicazione: (2026)
Thinking with Reasoning Skills: Fewer Tokens, More Accuracy
di: Zhao, Guangxiang, et al.
Pubblicazione: (2026)
di: Zhao, Guangxiang, et al.
Pubblicazione: (2026)
Dynamic Thinking-Token Selection for Efficient Reasoning in Large Reasoning Models
di: Guo, Zhenyuan, et al.
Pubblicazione: (2026)
di: Guo, Zhenyuan, et al.
Pubblicazione: (2026)
AtomThink: Multimodal Slow Thinking with Atomic Step Reasoning
di: Xiang, Kun, et al.
Pubblicazione: (2024)
di: Xiang, Kun, et al.
Pubblicazione: (2024)
FlashSloth: Lightning Multimodal Large Language Models via Embedded Visual Compression
di: Tong, Bo, et al.
Pubblicazione: (2024)
di: Tong, Bo, et al.
Pubblicazione: (2024)
SONAR-LLM: Autoregressive Transformer that Thinks in Sentence Embeddings and Speaks in Tokens
di: Dragunov, Nikita, et al.
Pubblicazione: (2025)
di: Dragunov, Nikita, et al.
Pubblicazione: (2025)
FlashVID: Efficient Video Large Language Models via Training-free Tree-based Spatiotemporal Token Merging
di: Fan, Ziyang, et al.
Pubblicazione: (2026)
di: Fan, Ziyang, et al.
Pubblicazione: (2026)
Introducing LongCat-Flash-Thinking: A Technical Report
di: Meituan LongCat Team, et al.
Pubblicazione: (2025)
di: Meituan LongCat Team, et al.
Pubblicazione: (2025)
Accelerating Production LLMs with Combined Token/Embedding Speculators
di: Wertheimer, Davis, et al.
Pubblicazione: (2024)
di: Wertheimer, Davis, et al.
Pubblicazione: (2024)
OMNIFLOW: A Physics-Grounded Multimodal Agent for Generalized Scientific Reasoning
di: Wu, Hao, et al.
Pubblicazione: (2026)
di: Wu, Hao, et al.
Pubblicazione: (2026)
MM-Verify: Enhancing Multimodal Reasoning with Chain-of-Thought Verification
di: Sun, Linzhuang, et al.
Pubblicazione: (2025)
di: Sun, Linzhuang, et al.
Pubblicazione: (2025)
Think When Needed: Adaptive Reasoning-Driven Multimodal Embeddings with a Dual-LoRA Architecture
di: Zhang, Longxiang, et al.
Pubblicazione: (2026)
di: Zhang, Longxiang, et al.
Pubblicazione: (2026)
Think Clearly: Improving Reasoning via Redundant Token Pruning
di: Choi, Daewon, et al.
Pubblicazione: (2025)
di: Choi, Daewon, et al.
Pubblicazione: (2025)
Position: Stop Anthropomorphizing Intermediate Tokens as Reasoning/Thinking Traces!
di: Kambhampati, Subbarao, et al.
Pubblicazione: (2025)
di: Kambhampati, Subbarao, et al.
Pubblicazione: (2025)
Multiplex Thinking: Reasoning via Token-wise Branch-and-Merge
di: Tang, Yao, et al.
Pubblicazione: (2026)
di: Tang, Yao, et al.
Pubblicazione: (2026)
Cohomological rigidity of manifolds with torus actions: I
di: Fan, Feifei, et al.
Pubblicazione: (2020)
di: Fan, Feifei, et al.
Pubblicazione: (2020)
Can the Establishment of Bankruptcy Courts Improve Firm Investment Efficiency? Evidence from China
di: Xiangjun Fan, et al.
Pubblicazione: (2026)
di: Xiangjun Fan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Think Then Embed: Generative Context Improves Multimodal Embedding
di: Cui, Xuanming, et al.
Pubblicazione: (2025) -
Reason to Contrast: A Cascaded Multimodal Retrieval Framework
di: Cui, Xuanming, et al.
Pubblicazione: (2025) -
TTE GLP
di: TTE
Pubblicazione: (2024) -
FlashVLM: Text-Guided Visual Token Selection for Large Multimodal Models
di: Cai, Kaitong, et al.
Pubblicazione: (2025) -
FlashThink: An Early Exit Method For Efficient Reasoning
di: Jiang, Guochao, et al.
Pubblicazione: (2025)