Impact of Language Guidance: A Reproducibility Study
Fuente:
arXiv
Salvato in:
| Autori principali: | Puniani, Cherish, Sinha, Advika, Singhi, Shree, Yadav, Aayan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
B-DENSE: Branching For Dense Ensemble Network Supervision Efficiency
di: Puniani, Cherish, et al.
Pubblicazione: (2026)
di: Puniani, Cherish, et al.
Pubblicazione: (2026)
Provenance Detection for AI-Generated Images: Combining Perceptual Hashing, Homomorphic Encryption, and AI Detection Models
di: Singhi, Shree, et al.
Pubblicazione: (2025)
di: Singhi, Shree, et al.
Pubblicazione: (2025)
IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation
di: Tiwari, Amritanshu, et al.
Pubblicazione: (2025)
di: Tiwari, Amritanshu, et al.
Pubblicazione: (2025)
StegaVision: Enhancing Steganography with Attention Mechanism
di: Kumar, Abhinav, et al.
Pubblicazione: (2024)
di: Kumar, Abhinav, et al.
Pubblicazione: (2024)
Benchmarking Object Detectors with COCO: A New Path Forward
di: Singh, Shweta, et al.
Pubblicazione: (2024)
di: Singh, Shweta, et al.
Pubblicazione: (2024)
EMAG: Self-Rectifying Diffusion Sampling with Exponential Moving Average Guidance
di: Yadav, Ankit, et al.
Pubblicazione: (2025)
di: Yadav, Ankit, et al.
Pubblicazione: (2025)
Minimal Sensing for Orienting a Solar Panel
di: Klotz, Jeremy, et al.
Pubblicazione: (2025)
di: Klotz, Jeremy, et al.
Pubblicazione: (2025)
Hierarchical Material Recognition from Local Appearance
di: Beveridge, Matthew, et al.
Pubblicazione: (2025)
di: Beveridge, Matthew, et al.
Pubblicazione: (2025)
Forecasting Solar Energy Using a Single Image
di: Klotz, Jeremy, et al.
Pubblicazione: (2026)
di: Klotz, Jeremy, et al.
Pubblicazione: (2026)
Revisiting CroPA: A Reproducibility Study and Enhancements for Cross-Prompt Adversarial Transferability in Vision-Language Models
di: Mittal, Atharv, et al.
Pubblicazione: (2025)
di: Mittal, Atharv, et al.
Pubblicazione: (2025)
Edge-AI Perception Node for Cooperative Road-Safety Enforcement and Connected-Vehicle Integration
di: R, Shree Charran, et al.
Pubblicazione: (2026)
di: R, Shree Charran, et al.
Pubblicazione: (2026)
Reproducibility study of "LICO: Explainable Models with Language-Image Consistency"
di: Fletcher, Luan, et al.
Pubblicazione: (2024)
di: Fletcher, Luan, et al.
Pubblicazione: (2024)
Investigating the Impact of Randomness on Reproducibility in Computer Vision: A Study on Applications in Civil Engineering and Medicine
di: Eryılmaz, Bahadır, et al.
Pubblicazione: (2024)
di: Eryılmaz, Bahadır, et al.
Pubblicazione: (2024)
Reproducibility Study on Adversarial Attacks Against Robust Transformer Trackers
di: Nokabadi, Fatemeh Nourilenjan, et al.
Pubblicazione: (2024)
di: Nokabadi, Fatemeh Nourilenjan, et al.
Pubblicazione: (2024)
STRIDE: Training-Free Diversity Guidance via PCA-Directed Feature Perturbation in Single-Step Diffusion Models
di: Yadav, Ankit, et al.
Pubblicazione: (2026)
di: Yadav, Ankit, et al.
Pubblicazione: (2026)
Cricket: A Self-Powered Chirping Pixel
di: Nayar, Shree K., et al.
Pubblicazione: (2025)
di: Nayar, Shree K., et al.
Pubblicazione: (2025)
Generalizing Vision-Language Models with Dedicated Prompt Guidance
di: Li, Xinyao, et al.
Pubblicazione: (2025)
di: Li, Xinyao, et al.
Pubblicazione: (2025)
Reevaluating Automated Wildlife Species Detection: A Reproducibility Study on a Custom Image Dataset
di: Haider, Tobias Abraham
Pubblicazione: (2025)
di: Haider, Tobias Abraham
Pubblicazione: (2025)
FUSECAPS: Investigating Feature Fusion Based Framework for Capsule Endoscopy Image Classification
di: Chakraborty, Bidisha, et al.
Pubblicazione: (2024)
di: Chakraborty, Bidisha, et al.
Pubblicazione: (2024)
TextOCVP: Object-Centric Video Prediction with Language Guidance
di: Villar-Corrales, Angel, et al.
Pubblicazione: (2025)
di: Villar-Corrales, Angel, et al.
Pubblicazione: (2025)
AuthGuard: Generalizable Deepfake Detection via Language Guidance
di: Shen, Guangyu, et al.
Pubblicazione: (2025)
di: Shen, Guangyu, et al.
Pubblicazione: (2025)
Implicit and Explicit Language Guidance for Diffusion-based Visual Perception
di: Wang, Hefeng, et al.
Pubblicazione: (2024)
di: Wang, Hefeng, et al.
Pubblicazione: (2024)
COCO-Tree: Compositional Hierarchical Concept Trees for Enhanced Reasoning in Vision Language Models
di: Sinha, Sanchit, et al.
Pubblicazione: (2025)
di: Sinha, Sanchit, et al.
Pubblicazione: (2025)
Manifold-Optimal Guidance: A Unified Riemannian Control View of Diffusion Guidance
di: Jia, Zexi, et al.
Pubblicazione: (2026)
di: Jia, Zexi, et al.
Pubblicazione: (2026)
Disentangle Object and Non-object Infrared Features via Language Guidance
di: Liu, Fan, et al.
Pubblicazione: (2026)
di: Liu, Fan, et al.
Pubblicazione: (2026)
LG-CAV: Train Any Concept Activation Vector with Language Guidance
di: Huang, Qihan, et al.
Pubblicazione: (2024)
di: Huang, Qihan, et al.
Pubblicazione: (2024)
Generation Of Colors using Bidirectional Long Short Term Memory Networks
di: Sinha, A.
Pubblicazione: (2023)
di: Sinha, A.
Pubblicazione: (2023)
Decorrelation-based Self-Supervised Visual Representation Learning for Writer Identification
di: Maitra, Arkadip, et al.
Pubblicazione: (2024)
di: Maitra, Arkadip, et al.
Pubblicazione: (2024)
Mask & Match: Learning to Recognize Handwritten Math with Self-Supervised Attention
di: Mitra, Shree, et al.
Pubblicazione: (2025)
di: Mitra, Shree, et al.
Pubblicazione: (2025)
Normalized Attention Guidance: Universal Negative Guidance for Diffusion Models
di: Chen, Dar-Yen, et al.
Pubblicazione: (2025)
di: Chen, Dar-Yen, et al.
Pubblicazione: (2025)
Improving Intervention Efficacy via Concept Realignment in Concept Bottleneck Models
di: Singhi, Nishad, et al.
Pubblicazione: (2024)
di: Singhi, Nishad, et al.
Pubblicazione: (2024)
Light-VQA+: A Video Quality Assessment Model for Exposure Correction with Vision-Language Guidance
di: Zhou, Xunchu, et al.
Pubblicazione: (2024)
di: Zhou, Xunchu, et al.
Pubblicazione: (2024)
Minimalist Vision with Freeform Pixels
di: Klotz, Jeremy, et al.
Pubblicazione: (2024)
di: Klotz, Jeremy, et al.
Pubblicazione: (2024)
Dual-Granularity Semantic Prompting for Language Guidance Infrared Small Target Detection
di: Wang, Zixuan, et al.
Pubblicazione: (2025)
di: Wang, Zixuan, et al.
Pubblicazione: (2025)
Egocentric Action-aware Inertial Localization in Point Clouds with Vision-Language Guidance
di: Zhang, Mingfang, et al.
Pubblicazione: (2025)
di: Zhang, Mingfang, et al.
Pubblicazione: (2025)
Multi-modal Mutual-Guidance Conditional Prompt Learning for Vision-Language Models
di: Yang, Shijun, et al.
Pubblicazione: (2025)
di: Yang, Shijun, et al.
Pubblicazione: (2025)
Venus: Benchmarking and Empowering Multimodal Large Language Models for Aesthetic Guidance and Cropping
di: Du, Tianxiang, et al.
Pubblicazione: (2026)
di: Du, Tianxiang, et al.
Pubblicazione: (2026)
FlashSign: Pose-Free Guidance for Efficient Sign Language Video Generation
di: Zhang, Liuzhou, et al.
Pubblicazione: (2026)
di: Zhang, Liuzhou, et al.
Pubblicazione: (2026)
Language-Grounded Multi-Domain Image Translation via Semantic Difference Guidance
di: Ryu, Jongwon, et al.
Pubblicazione: (2026)
di: Ryu, Jongwon, et al.
Pubblicazione: (2026)
Universal 3D Shape Matching via Coarse-to-Fine Language Guidance
di: Xiao, Qinfeng, et al.
Pubblicazione: (2026)
di: Xiao, Qinfeng, et al.
Pubblicazione: (2026)
Documenti analoghi
-
B-DENSE: Branching For Dense Ensemble Network Supervision Efficiency
di: Puniani, Cherish, et al.
Pubblicazione: (2026) -
Provenance Detection for AI-Generated Images: Combining Perceptual Hashing, Homomorphic Encryption, and AI Detection Models
di: Singhi, Shree, et al.
Pubblicazione: (2025) -
IMAGE-ALCHEMY: Advancing subject fidelity in personalised text-to-image generation
di: Tiwari, Amritanshu, et al.
Pubblicazione: (2025) -
StegaVision: Enhancing Steganography with Attention Mechanism
di: Kumar, Abhinav, et al.
Pubblicazione: (2024) -
Benchmarking Object Detectors with COCO: A New Path Forward
di: Singh, Shweta, et al.
Pubblicazione: (2024)