Weiter zum Inhalt
VuFind
  • Login
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Erweitert
  • Zitieren
  • SMS versenden
  • Als E-Mail versenden
  • Drucken
  • Datensatz exportieren
    • Exportieren nach RefWorks
    • Exportieren nach EndNoteWeb
    • Exportieren nach EndNote
  • Zu den Favoriten
  • Persistenter Link
Buchumschlag

Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: Cai, Zhongang, Wang, Yubo, Sun, Qingping, Wang, Ruisi, Gu, Chenyang, Yin, Wanqi, Lin, Zhiqian, Yang, Zhitao, Wei, Chen, Qian, Oscar, Pang, Hui En, Shi, Xuanke, Deng, Kewang, Han, Xiaoyang, Chen, Zukai, Li, Jiaqi, Fan, Xiangyu, Deng, Hanming, Lu, Lewei, Li, Bo, Liu, Ziwei, Wang, Quan, Lin, Dahua, Yang, Lei
Format: Preprint
Veröffentlicht: 2025
Schlagworte:
Computer Vision and Pattern Recognition
Computation and Language
Machine Learning
Multimedia
Robotics
Online-Zugang:https://arxiv.org/abs/2508.13142
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
  • Exemplare
  • Beschreibung
  • Inhaltsangabe
  • Kommentare
  • Ähnliche Einträge
  • Internformat

Online

https://arxiv.org/abs/2508.13142

Ähnliche Einträge

  • Scaling Spatial Intelligence with Multimodal Foundation Models
    von: Cai, Zhongang, et al.
    Veröffentlicht: (2025)
  • ConsistCompose: Unified Multimodal Layout Control for Image Composition
    von: Shi, Xuanke, et al.
    Veröffentlicht: (2025)
  • WHAC: World-grounded Humans and Cameras
    von: Yin, Wanqi, et al.
    Veröffentlicht: (2024)
  • Demystifying Video Reasoning
    von: Wang, Ruisi, et al.
    Veröffentlicht: (2026)
  • From Pixels to Words -- Towards Native Vision-Language Primitives at Scale
    von: Diao, Haiwen, et al.
    Veröffentlicht: (2025)

Suchoptionen

  • Suchhistorie
  • Erweiterte Suche

Weitere Suchoptionen

  • Katalog durchstöbern
  • Alphabetisch durchstöbern
  • Inhalte erkunden
  • Semesterapparat
  • Neuerscheinungen

Hilfe

  • Suchtipps
  • Fachauskunft der Bibliothek
  • Häufig gestellte Fragen