Vidi: Large Multimodal Models for Video Understanding and Editing
Fuente:
arXiv
Saved in:
| Main Authors: | Vidi Team, Liu, Celong, Kuo, Chia-Wen, Du, Dawei, Chen, Fan, Chen, Guang, Yuan, Jiamin, Zhang, Lingxi, Guo, Lu, Li, Lusha, Wen, Longyin, Chen, Qingyu, Deng, Rachel, Zhu, Sijie, Siew, Stuart, Jin, Tong, Lu, Wei, Zhong, Wen, Shen, Xiaohui, Gu, Xin, Mei, Xing, Qu, Xueqiong, Chen, Zhenfang |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Vidi2.5: Large Multimodal Models for Video Understanding and Creation
by: Vidi Team, et al.
Published: (2025)
by: Vidi Team, et al.
Published: (2025)
VEBench:Benchmarking Large Multimodal Models for Real-World Video Editing
by: Deng, Andong, et al.
Published: (2026)
by: Deng, Andong, et al.
Published: (2026)
D-Attn: Decomposed Attention for Large Vision-and-Language Models
by: Kuo, Chia-Wen, et al.
Published: (2025)
by: Kuo, Chia-Wen, et al.
Published: (2025)
Beyond Raw Videos: Understanding Edited Videos with Large Multimodal Model
by: Xu, Lu, et al.
Published: (2024)
by: Xu, Lu, et al.
Published: (2024)
SuperEdit: Rectifying and Facilitating Supervision for Instruction-Based Image Editing
by: Li, Ming, et al.
Published: (2025)
by: Li, Ming, et al.
Published: (2025)
CuMo: Scaling Multimodal LLM with Co-Upcycled Mixture-of-Experts
by: Li, Jiachen, et al.
Published: (2024)
by: Li, Jiachen, et al.
Published: (2024)
Multi-Reward as Condition for Instruction-based Image Editing
by: Gu, Xin, et al.
Published: (2024)
by: Gu, Xin, et al.
Published: (2024)
Edit3K: Universal Representation Learning for Video Editing Components
by: Gu, Xin, et al.
Published: (2024)
by: Gu, Xin, et al.
Published: (2024)
Where do Large Vision-Language Models Look at when Answering Questions?
by: Xing, Xiaoying, et al.
Published: (2025)
by: Xing, Xiaoying, et al.
Published: (2025)
Thinking With Bounding Boxes: Enhancing Spatio-Temporal Video Grounding via Reinforcement Fine-Tuning
by: Gu, Xin, et al.
Published: (2025)
by: Gu, Xin, et al.
Published: (2025)
Unraveling the Emotions of an English as a Foreign Language Teacher and Their Impact on Professional Identity in Teaching Reform
by: Wen Liu, et al.
Published: (2025)
by: Wen Liu, et al.
Published: (2025)
Referring Layer Decomposition
by: Chen, Fangyi, et al.
Published: (2026)
by: Chen, Fangyi, et al.
Published: (2026)
Comment on “Pregabalin in patients with post‐traumatic peripheral neuropathic pain: A meta‐analysis of randomized controlled trials”
by: I‐Wen Chen, et al.
Published: (2024)
by: I‐Wen Chen, et al.
Published: (2024)
Global well-posedness for a two-dimensional Navier-Stokes-Cahn-Hilliard-Boussinesq system with singular potential
by: Chen, Lingxi
Published: (2023)
by: Chen, Lingxi
Published: (2023)
Learning and Adaptation in Wire Arc Additive Manufacturing Bead Geometry Control
by: Lu, Chen-Lung, et al.
Published: (2026)
by: Lu, Chen-Lung, et al.
Published: (2026)
FSVideo: Fast Speed Video Diffusion Model in a Highly-Compressed Latent Space
by: FSVideo Team, et al.
Published: (2026)
by: FSVideo Team, et al.
Published: (2026)
Anti‐HER2 Immunoliposomes: Antitumor Efficacy Attributable to Targeted Delivery of Anthraquinone‐Fused Enediyne
by: Xueqiong Feng, et al.
Published: (2024)
by: Xueqiong Feng, et al.
Published: (2024)
Incentivizing Demand Response Using Auctions: Evidence From Steel Producers in Taiwan
by: Chia‐Wen Chen, et al.
Published: (2026)
by: Chia‐Wen Chen, et al.
Published: (2026)
Development of Calcium Alginate Microcarriers Encapsulated With Antibacterial Tea Tree Essential Oil
by: Chia-Lin Chen, et al.
Published: (2025)
by: Chia-Lin Chen, et al.
Published: (2025)
Enhanced Hydrophilicity of DAAQ‐TFP COFs via Sulfonate Modification for Air Water Harvesting in Arid Environment
by: Yueli Liu, et al.
Published: (2024)
by: Yueli Liu, et al.
Published: (2024)
Thermodynamic geometric analysis of 3D charged black holes under f(R) gravity
by: Chen, Wen-Xiang, et al.
Published: (2023)
by: Chen, Wen-Xiang, et al.
Published: (2023)
Verification of the First Law of Horizon Thermodynamics for Schwarzschild, Reissner-Nordström, Kerr, and Kerr-Newman Black Holes in Four-Dimensional f(R) Gravity with Dual Scalar Fields
by: Chen, Wen-Xiang, et al.
Published: (2024)
by: Chen, Wen-Xiang, et al.
Published: (2024)
Calculating the Hawking Temperatures of Kerr-Newman Black Holes in the f(R) Gravity Models with the RVB Method
by: Chen, Wen-Xiang, et al.
Published: (2023)
by: Chen, Wen-Xiang, et al.
Published: (2023)
Thermodynamic geometric analysis of RN black holes under f(R) gravity
by: Chen, Wen-Xiang, et al.
Published: (2024)
by: Chen, Wen-Xiang, et al.
Published: (2024)
Thermodynamic Properties of Modified Black Hole Metrics in $f(R)$ Gravity
by: Chen, Wen-Xiang, et al.
Published: (2024)
by: Chen, Wen-Xiang, et al.
Published: (2024)
Text-Driven Image Editing via Learnable Regions
by: Lin, Yuanze, et al.
Published: (2023)
by: Lin, Yuanze, et al.
Published: (2023)
Chinese young adults' emotion regulation and conflict resolution response profiles, and their associations with perceived partner responsiveness and romantic relationship satisfaction
by: Lu Ran Zhang, et al.
Published: (2024)
by: Lu Ran Zhang, et al.
Published: (2024)
Digital Workflow and Guided Surgery in Implant Therapy—Literature Review and Practical Tips to Optimize Precision
by: Chia‐Sheng Chen, et al.
Published: (2025)
by: Chia‐Sheng Chen, et al.
Published: (2025)
Transitional care interventions improve quality of life in both surgical and non‐surgical lung cancer patients: Insights from a subgroup analysis
by: I‐Wen Chen, et al.
Published: (2024)
by: I‐Wen Chen, et al.
Published: (2024)
Non‐pharmacological interventions improve sleep quality after cardiac surgery: Subgroup analysis based on care settings
by: I‐Wen Chen, et al.
Published: (2024)
by: I‐Wen Chen, et al.
Published: (2024)
Additional analyses support superior efficacy of nirmatrelvir/ritonavir over molnupiravir for COVID‐19
by: Li‐Chen Chang, et al.
Published: (2024)
by: Li‐Chen Chang, et al.
Published: (2024)
Unregulated Divergences of Feynman Integrals
by: Chen, Wen
Published: (2024)
by: Chen, Wen
Published: (2024)
Reduction of Feynman Integrals in the Parametric Representation IV: Integrals with Irregular Integration Regions
by: Chen, Wen
Published: (2025)
by: Chen, Wen
Published: (2025)
An Improvement of AmpRed: Analytic Continuation of Complex Integrals
by: Chen, Wen
Published: (2025)
by: Chen, Wen
Published: (2025)
A Representation Transformation of Parametric Feynman Integrals
by: Chen, Wen
Published: (2023)
by: Chen, Wen
Published: (2023)
Teaching Bio‐Layer Interferometry: Protein–Protein Versus Protein–Small Molecule Interaction Analysis on an Octet R8
by: Wen Chen
Published: (2026)
by: Wen Chen
Published: (2026)
Semi-automatic Calculations of Multi-loop Feynman Amplitudes with AmpRed
by: Chen, Wen
Published: (2024)
by: Chen, Wen
Published: (2024)
Dynamic Pricing Strategy for Imitative and Habit‐Forming Customers
by: Wen Chen
Published: (2024)
by: Wen Chen
Published: (2024)
Serious games for chronic pain management in older adults: A promising but uncertain intervention
by: Kuo‐Chuan Hung, et al.
Published: (2024)
by: Kuo‐Chuan Hung, et al.
Published: (2024)
1.58-bit FLUX
by: Yang, Chenglin, et al.
Published: (2024)
by: Yang, Chenglin, et al.
Published: (2024)
Similar Items
-
Vidi2.5: Large Multimodal Models for Video Understanding and Creation
by: Vidi Team, et al.
Published: (2025) -
VEBench:Benchmarking Large Multimodal Models for Real-World Video Editing
by: Deng, Andong, et al.
Published: (2026) -
D-Attn: Decomposed Attention for Large Vision-and-Language Models
by: Kuo, Chia-Wen, et al.
Published: (2025) -
Beyond Raw Videos: Understanding Edited Videos with Large Multimodal Model
by: Xu, Lu, et al.
Published: (2024) -
SuperEdit: Rectifying and Facilitating Supervision for Instruction-Based Image Editing
by: Li, Ming, et al.
Published: (2025)