Salta al contenuto
VuFind
  • Entra
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Avanzata
  • Citazione
  • Invia SMS
  • Invia email
  • Stampa
  • Esporta il record
    • Esporta a RefWorks
    • Esporta a EndNoteWeb
    • Esporta a EndNote
  • Aggiungi alla lista
  • PLink permanente
Copertina

Salvato in:
Dettagli Bibliografici
Autori principali: Tong, Chengzhuo, Chang, Mingkun, Zhang, Shenglong, Wang, Yuran, Liang, Cheng, Zhao, Zhizheng, An, Ruichuan, Zeng, Bohan, Shi, Yang, Dai, Yifan, Zhao, Ziming, Li, Guanbin, Wan, Pengfei, Zhang, Yuanxing, Zhang, Wentao
Natura: Preprint
Pubblicazione: 2026
Soggetti:
Computer Vision and Pattern Recognition
Artificial Intelligence
Accesso online:https://arxiv.org/abs/2601.10061
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
  • Posseduto
  • Descrizione
  • Sommario
  • Commenti
  • Documenti analoghi
  • MARC21

Accesso online

https://arxiv.org/abs/2601.10061

Documenti analoghi

  • Scone: Bridging Composition and Distinction in Subject-Driven Image Generation via Unified Understanding-Generation Modeling
    di: Wang, Yuran, et al.
    Pubblicazione: (2025)
  • MME-CoF-Pro: Evaluating Reasoning Coherence in Video Generative Models with Text and Visual Hints
    di: Qi, Yu, et al.
    Pubblicazione: (2026)
  • Are Video Models Ready as Zero-Shot Reasoners? An Empirical Study with the MME-CoF Benchmark
    di: Guo, Ziyu, et al.
    Pubblicazione: (2025)
  • GRAN-TED: Generating Robust, Aligned, and Nuanced Text Embedding for Diffusion Models
    di: Li, Bozhou, et al.
    Pubblicazione: (2025)
  • LatentOmni: Rethinking Omni-Modal Understanding via Unified Audio-Visual Latent Reasoning
    di: Dai, Yifan, et al.
    Pubblicazione: (2026)

Opzioni di ricerca

  • Ultime ricerche
  • Ricerca avanzata

Cerca

  • Scorri il catalogo
  • Scorri in ordine alfabetico
  • Esplora selezioni
  • Materiali riservati (per i corsi)
  • Nuovi documenti

Serve aiuto?

  • Suggerimenti per la ricerca
  • Chiedi al bibliotecario
  • FAQ