CASTLE2026 Team WDL Technical Report
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Zhengyang, Du, Zhenglin, Wen, Yi, Liu, Fang, Li, Shuo, Liu, Xu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MARS: Technical Report for the CASTLE Challenge at EgoVis 2026
por: Zhang, Haoyu, et al.
Publicado: (2026)
por: Zhang, Haoyu, et al.
Publicado: (2026)
CuriosAI Submission to the CASTLE Challenge at EgoVis 2026
por: Kanda, Yuto, et al.
Publicado: (2026)
por: Kanda, Yuto, et al.
Publicado: (2026)
Technical Report: Masked Skeleton Sequence Modeling for Learning Larval Zebrafish Behavior Latent Embeddings
por: Xu, Lanxin, et al.
Publicado: (2024)
por: Xu, Lanxin, et al.
Publicado: (2024)
3rd Place at CVPR 2026 CASTLE Challenge: Agentic Multi-View Long-Context Video Understanding via Hierarchical Knowledge Graph Retrieval
por: Albusayes, Raghad, et al.
Publicado: (2026)
por: Albusayes, Raghad, et al.
Publicado: (2026)
Kling-MotionControl Technical Report
por: Kling Team, et al.
Publicado: (2026)
por: Kling Team, et al.
Publicado: (2026)
Logics-Parsing Technical Report
por: Chen, Xiangyang, et al.
Publicado: (2025)
por: Chen, Xiangyang, et al.
Publicado: (2025)
Step-GUI Technical Report
por: Yan, Haolong, et al.
Publicado: (2025)
por: Yan, Haolong, et al.
Publicado: (2025)
Team Samsung-RAL: Technical Report for 2024 RoboDrive Challenge-Robust Map Segmentation Track
por: Hao, Xiaoshuai, et al.
Publicado: (2024)
por: Hao, Xiaoshuai, et al.
Publicado: (2024)
Qwen-Image Technical Report
por: Wu, Chenfei, et al.
Publicado: (2025)
por: Wu, Chenfei, et al.
Publicado: (2025)
JFAA: Technical Report for the EPIC-KITCHENS-100 Action Anticipation Challenge at EgoVis 2026
por: Chu, Qiaohui, et al.
Publicado: (2026)
por: Chu, Qiaohui, et al.
Publicado: (2026)
Kimi-VL Technical Report
por: Kimi Team, et al.
Publicado: (2025)
por: Kimi Team, et al.
Publicado: (2025)
Kling-Omni Technical Report
por: Kling Team, et al.
Publicado: (2025)
por: Kling Team, et al.
Publicado: (2025)
ABot-OCR Technical Report
por: Jiang, Kaitao, et al.
Publicado: (2026)
por: Jiang, Kaitao, et al.
Publicado: (2026)
LoViF 2026 The First Challenge on Holistic Quality Assessment for 4D World Model (PhyScore)
por: Luo, Wei, et al.
Publicado: (2026)
por: Luo, Wei, et al.
Publicado: (2026)
Baichuan-Omni Technical Report
por: Li, Yadong, et al.
Publicado: (2024)
por: Li, Yadong, et al.
Publicado: (2024)
NTIRE 2023 Image Shadow Removal Challenge Technical Report: Team IIM_TTI
por: Kondo, Yuki, et al.
Publicado: (2024)
por: Kondo, Yuki, et al.
Publicado: (2024)
StreamingClaw Technical Report
por: Chen, Jiawei, et al.
Publicado: (2026)
por: Chen, Jiawei, et al.
Publicado: (2026)
NeuroClaw Technical Report
por: Wang, Cheng, et al.
Publicado: (2026)
por: Wang, Cheng, et al.
Publicado: (2026)
Uni-Parser Technical Report
por: Fang, Xi, et al.
Publicado: (2025)
por: Fang, Xi, et al.
Publicado: (2025)
KlingAvatar 2.0 Technical Report
por: Kling Team, et al.
Publicado: (2025)
por: Kling Team, et al.
Publicado: (2025)
Sakuga-42M Dataset: Scaling Up Cartoon Research
por: Pan, Zhenglin
Publicado: (2024)
por: Pan, Zhenglin
Publicado: (2024)
HunyuanImage 3.0 Technical Report
por: Cao, Siyu, et al.
Publicado: (2025)
por: Cao, Siyu, et al.
Publicado: (2025)
Kwai Keye-VL Technical Report
por: Kwai Keye Team, et al.
Publicado: (2025)
por: Kwai Keye Team, et al.
Publicado: (2025)
HunyuanVideo 1.5 Technical Report
por: Wu, Bing, et al.
Publicado: (2025)
por: Wu, Bing, et al.
Publicado: (2025)
Kelix Technical Report
por: Ding, Boyang, et al.
Publicado: (2026)
por: Ding, Boyang, et al.
Publicado: (2026)
Qwen-Image-2.0 Technical Report
por: Zhao, Bing, et al.
Publicado: (2026)
por: Zhao, Bing, et al.
Publicado: (2026)
The CASTLE 2024 Dataset: Advancing the Art of Multimodal Understanding
por: Rossetto, Luca, et al.
Publicado: (2025)
por: Rossetto, Luca, et al.
Publicado: (2025)
PaddleOCR 3.0 Technical Report
por: Cui, Cheng, et al.
Publicado: (2025)
por: Cui, Cheng, et al.
Publicado: (2025)
Singpath-VL Technical Report
por: Qiu, Zhen, et al.
Publicado: (2026)
por: Qiu, Zhen, et al.
Publicado: (2026)
Qwen-Image-VAE-2.0 Technical Report
por: Zhang, Zekai, et al.
Publicado: (2026)
por: Zhang, Zekai, et al.
Publicado: (2026)
Technical Report for Soccernet 2023 -- Dense Video Captioning
por: Ruan, Zheng, et al.
Publicado: (2024)
por: Ruan, Zheng, et al.
Publicado: (2024)
The Eleventh NTIRE 2026 Efficient Super-Resolution Challenge Report
por: Ren, Bin, et al.
Publicado: (2026)
por: Ren, Bin, et al.
Publicado: (2026)
BusterX++: Towards Unified Cross-Modal AI-Generated Content Detection and Explanation with MLLM
por: Wen, Haiquan, et al.
Publicado: (2025)
por: Wen, Haiquan, et al.
Publicado: (2025)
Seedream 3.0 Technical Report
por: Gao, Yu, et al.
Publicado: (2025)
por: Gao, Yu, et al.
Publicado: (2025)
Mano Technical Report
por: Fu, Tianyu, et al.
Publicado: (2025)
por: Fu, Tianyu, et al.
Publicado: (2025)
Falcon: A Remote Sensing Vision-Language Foundation Model (Technical Report)
por: Yao, Kelu, et al.
Publicado: (2025)
por: Yao, Kelu, et al.
Publicado: (2025)
LongCat-Video-Avatar 1.5 Technical Report
por: Meituan LongCat Team, et al.
Publicado: (2026)
por: Meituan LongCat Team, et al.
Publicado: (2026)
Kwai Keye-VL 1.5 Technical Report
por: Yang, Biao, et al.
Publicado: (2025)
por: Yang, Biao, et al.
Publicado: (2025)
Xiaomi MiMo-VL-Miloco Technical Report
por: Li, Jiaze, et al.
Publicado: (2025)
por: Li, Jiaze, et al.
Publicado: (2025)
Privacy-Aware Camera 2.0 Technical Report
por: Song, Huan, et al.
Publicado: (2026)
por: Song, Huan, et al.
Publicado: (2026)
Ejemplares similares
-
MARS: Technical Report for the CASTLE Challenge at EgoVis 2026
por: Zhang, Haoyu, et al.
Publicado: (2026) -
CuriosAI Submission to the CASTLE Challenge at EgoVis 2026
por: Kanda, Yuto, et al.
Publicado: (2026) -
Technical Report: Masked Skeleton Sequence Modeling for Learning Larval Zebrafish Behavior Latent Embeddings
por: Xu, Lanxin, et al.
Publicado: (2024) -
3rd Place at CVPR 2026 CASTLE Challenge: Agentic Multi-View Long-Context Video Understanding via Hierarchical Knowledge Graph Retrieval
por: Albusayes, Raghad, et al.
Publicado: (2026) -
Kling-MotionControl Technical Report
por: Kling Team, et al.
Publicado: (2026)