HiLight: Technical Report on the Motern AI Video Language Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Zhiting, Zhou, Qiangong, Yang, Kangjie, Liu, Zongyang, Mao, Xin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HiDE: Hierarchical Dictionary-Based Entropy Modeling for Learned Image Compression
di: Xiong, Haoxuan, et al.
Pubblicazione: (2026)
di: Xiong, Haoxuan, et al.
Pubblicazione: (2026)
Temporal Inconsistency Guidance for Super-resolution Video Quality Assessment
di: Li, Yixiao, et al.
Pubblicazione: (2024)
di: Li, Yixiao, et al.
Pubblicazione: (2024)
CMTA: Leveraging Cross-Modal Temporal Artifacts for Generalizable AI-Generated Video Detection
di: Wang, Hang, et al.
Pubblicazione: (2026)
di: Wang, Hang, et al.
Pubblicazione: (2026)
Boosting Neural Video Representation via Online Structural Reparameterization
di: Li, Ziyi, et al.
Pubblicazione: (2025)
di: Li, Ziyi, et al.
Pubblicazione: (2025)
Context and Pixel Aware Large Language Model for Video Quality Assessment
di: Wen, Wen, et al.
Pubblicazione: (2025)
di: Wen, Wen, et al.
Pubblicazione: (2025)
Enhancing octree-based context models for point cloud geometry compression with attention-based child node number prediction
di: Sun, Chang, et al.
Pubblicazione: (2024)
di: Sun, Chang, et al.
Pubblicazione: (2024)
Object-Attribute-Relation Representation Based Video Semantic Communication
di: Du, Qiyuan, et al.
Pubblicazione: (2024)
di: Du, Qiyuan, et al.
Pubblicazione: (2024)
ICME 2025 Grand Challenge on Video Super-Resolution for Video Conferencing
di: Naderi, Babak, et al.
Pubblicazione: (2025)
di: Naderi, Babak, et al.
Pubblicazione: (2025)
Analysis of Video Quality Datasets via Design of Minimalistic Video Quality Models
di: Sun, Wei, et al.
Pubblicazione: (2023)
di: Sun, Wei, et al.
Pubblicazione: (2023)
Optimizing Multimodal LLMs for Egocentric Video Understanding: A Solution for the HD-EPIC VQA Challenge
di: Yang, Sicheng, et al.
Pubblicazione: (2026)
di: Yang, Sicheng, et al.
Pubblicazione: (2026)
Perceptual Video Quality Assessment: A Survey
di: Min, Xiongkuo, et al.
Pubblicazione: (2024)
di: Min, Xiongkuo, et al.
Pubblicazione: (2024)
MSVD-Indonesian: A Benchmark for Multimodal Video-Text Tasks in Indonesian
di: Hendria, Willy Fitra
Pubblicazione: (2023)
di: Hendria, Willy Fitra
Pubblicazione: (2023)
JND-Guided Light-Weight Neural Pre-Filter for Perceptual Image Coding
di: He, Chenlong, et al.
Pubblicazione: (2025)
di: He, Chenlong, et al.
Pubblicazione: (2025)
LFACon: Introducing Anglewise Attention to No-Reference Quality Assessment in Light Field Space
di: Qu, Qiang, et al.
Pubblicazione: (2023)
di: Qu, Qiang, et al.
Pubblicazione: (2023)
AIM 2024 Challenge on Video Super-Resolution Quality Assessment: Methods and Results
di: Molodetskikh, Ivan, et al.
Pubblicazione: (2024)
di: Molodetskikh, Ivan, et al.
Pubblicazione: (2024)
Scalable Event-Based Video Streaming for Machines with MoQ
di: Freeman, Andrew C.
Pubblicazione: (2025)
di: Freeman, Andrew C.
Pubblicazione: (2025)
Leveraging Compressed Frame Sizes For Ultra-Fast Video Classification
di: Han, Yuxing, et al.
Pubblicazione: (2024)
di: Han, Yuxing, et al.
Pubblicazione: (2024)
SANR: Scene-Aware Neural Representation for Light Field Image Compression with Rate-Distortion Optimization
di: Zhang, Gai, et al.
Pubblicazione: (2025)
di: Zhang, Gai, et al.
Pubblicazione: (2025)
In-Loop Filtering Using Learned Look-Up Tables for Video Coding
di: Li, Zhuoyuan, et al.
Pubblicazione: (2025)
di: Li, Zhuoyuan, et al.
Pubblicazione: (2025)
Benchmarking Conventional and Learned Video Codecs with a Low-Delay Configuration
di: Teng, Siyue, et al.
Pubblicazione: (2024)
di: Teng, Siyue, et al.
Pubblicazione: (2024)
Ensuring Reliable Participation in Subjective Video Quality Tests Across Platforms
di: Naderi, Babak, et al.
Pubblicazione: (2025)
di: Naderi, Babak, et al.
Pubblicazione: (2025)
MSNeRV: Neural Video Representation with Multi-Scale Feature Fusion
di: Zhu, Jun, et al.
Pubblicazione: (2025)
di: Zhu, Jun, et al.
Pubblicazione: (2025)
Enhancing Blind Video Quality Assessment with Rich Quality-aware Features
di: Sun, Wei, et al.
Pubblicazione: (2024)
di: Sun, Wei, et al.
Pubblicazione: (2024)
DIVA-VQA: Detecting Inter-frame Variations in UGC Video Quality
di: Wang, Xinyi, et al.
Pubblicazione: (2025)
di: Wang, Xinyi, et al.
Pubblicazione: (2025)
Releasing the Parameter Latency of Neural Representation for High-Efficiency Video Compression
di: Zhang, Gai, et al.
Pubblicazione: (2024)
di: Zhang, Gai, et al.
Pubblicazione: (2024)
AIM 2024 Challenge on Compressed Video Quality Assessment: Methods and Results
di: Smirnov, Maksim, et al.
Pubblicazione: (2024)
di: Smirnov, Maksim, et al.
Pubblicazione: (2024)
Towards Robust and Generalizable Continuous Space-Time Video Super-Resolution with Events
di: Wei, Shuoyan, et al.
Pubblicazione: (2025)
di: Wei, Shuoyan, et al.
Pubblicazione: (2025)
Sphere-GAN: a GAN-based Approach for Saliency Estimation in 360° Videos
di: Wahba, Mahmoud Z. A., et al.
Pubblicazione: (2025)
di: Wahba, Mahmoud Z. A., et al.
Pubblicazione: (2025)
Recent Advances of End-to-End Video Coding Technologies for AVS Standard Development
di: Sheng, Xihua, et al.
Pubblicazione: (2026)
di: Sheng, Xihua, et al.
Pubblicazione: (2026)
An Efficient Quality Metric for Video Frame Interpolation Based on Motion-Field Divergence
di: Daly, Conall, et al.
Pubblicazione: (2025)
di: Daly, Conall, et al.
Pubblicazione: (2025)
ICME 2025 Generalizable HDR and SDR Video Quality Measurement Grand Challenge
di: Chen, Yixu, et al.
Pubblicazione: (2025)
di: Chen, Yixu, et al.
Pubblicazione: (2025)
A Near-Raw Talking-Head Video Dataset for Various Computer Vision Tasks
di: Naderi, Babak, et al.
Pubblicazione: (2026)
di: Naderi, Babak, et al.
Pubblicazione: (2026)
Convolutions Need Registers Too: HVS-Inspired Dynamic Attention for Video Quality Assessment
di: Mithila, Mayesha Maliha R., et al.
Pubblicazione: (2026)
di: Mithila, Mayesha Maliha R., et al.
Pubblicazione: (2026)
NeRV360: Neural Representation for 360-Degree Videos with a Viewport Decoder
di: Arai, Daichi, et al.
Pubblicazione: (2025)
di: Arai, Daichi, et al.
Pubblicazione: (2025)
CAMP-VQA: Caption-Embedded Multimodal Perception for No-Reference Quality Assessment of Compressed Video
di: Wang, Xinyi, et al.
Pubblicazione: (2025)
di: Wang, Xinyi, et al.
Pubblicazione: (2025)
Learning Event-guided Exposure-agnostic Video Frame Interpolation via Adaptive Feature Blending
di: Jung, Junsik, et al.
Pubblicazione: (2025)
di: Jung, Junsik, et al.
Pubblicazione: (2025)
Beyond Alignment: Blind Video Face Restoration via Parsing-Guided Temporal-Coherent Transformer
di: Xu, Kepeng, et al.
Pubblicazione: (2024)
di: Xu, Kepeng, et al.
Pubblicazione: (2024)
Multi-task Just Recognizable Difference for Video Coding for Machines: Database, Model, and Coding Application
di: Liu, Junqi, et al.
Pubblicazione: (2026)
di: Liu, Junqi, et al.
Pubblicazione: (2026)
Perceptual Depth Quality Assessment of Stereoscopic Omnidirectional Images
di: Zhou, Wei, et al.
Pubblicazione: (2024)
di: Zhou, Wei, et al.
Pubblicazione: (2024)
ReLaX-VQA: Residual Fragment and Layer Stack Extraction for Enhancing Video Quality Assessment
di: Wang, Xinyi, et al.
Pubblicazione: (2024)
di: Wang, Xinyi, et al.
Pubblicazione: (2024)
Documenti analoghi
-
HiDE: Hierarchical Dictionary-Based Entropy Modeling for Learned Image Compression
di: Xiong, Haoxuan, et al.
Pubblicazione: (2026) -
Temporal Inconsistency Guidance for Super-resolution Video Quality Assessment
di: Li, Yixiao, et al.
Pubblicazione: (2024) -
CMTA: Leveraging Cross-Modal Temporal Artifacts for Generalizable AI-Generated Video Detection
di: Wang, Hang, et al.
Pubblicazione: (2026) -
Boosting Neural Video Representation via Online Structural Reparameterization
di: Li, Ziyi, et al.
Pubblicazione: (2025) -
Context and Pixel Aware Large Language Model for Video Quality Assessment
di: Wen, Wen, et al.
Pubblicazione: (2025)