Talk is Not Always Cheap: Promoting Wireless Sensing Models with Text Prompts
Fuente:
arXiv
Salvato in:
| Autori principali: | Yang, Zhenkui, Huang, Zeyi, Wang, Ge, Ding, Han, Han, Tony Xiao, Wang, Fei |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MobiDiary: Autoregressive Action Captioning with Wearable Devices and Wireless Signals
di: Deng, Fei, et al.
Pubblicazione: (2026)
di: Deng, Fei, et al.
Pubblicazione: (2026)
A Survey on Wi-Fi Sensing Generalizability: Taxonomy, Techniques, Datasets, and Future Research Prospects
di: Wang, Fei, et al.
Pubblicazione: (2025)
di: Wang, Fei, et al.
Pubblicazione: (2025)
DynaIP: Dynamic Image Prompt Adapter for Scalable Zero-shot Personalized Text-to-Image Generation
di: Wang, Zhizhong, et al.
Pubblicazione: (2025)
di: Wang, Zhizhong, et al.
Pubblicazione: (2025)
Text-based Talking Video Editing with Cascaded Conditional Diffusion
di: Han, Bo, et al.
Pubblicazione: (2024)
di: Han, Bo, et al.
Pubblicazione: (2024)
TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
GrOCE:Graph-Guided Online Concept Erasure for Text-to-Image Diffusion Models
di: Han, Ning, et al.
Pubblicazione: (2025)
di: Han, Ning, et al.
Pubblicazione: (2025)
Self-Rewarding Large Vision-Language Models for Optimizing Prompts in Text-to-Image Generation
di: Yang, Hongji, et al.
Pubblicazione: (2025)
di: Yang, Hongji, et al.
Pubblicazione: (2025)
Dynamic Prompting of Frozen Text-to-Image Diffusion Models for Panoptic Narrative Grounding
di: Li, Hongyu, et al.
Pubblicazione: (2024)
di: Li, Hongyu, et al.
Pubblicazione: (2024)
PoseTalk: Text-and-Audio-based Pose Control and Motion Refinement for One-Shot Talking Head Generation
di: Ling, Jun, et al.
Pubblicazione: (2024)
di: Ling, Jun, et al.
Pubblicazione: (2024)
Diversity Has Always Been There in Your Visual Autoregressive Models
di: Wang, Tong, et al.
Pubblicazione: (2025)
di: Wang, Tong, et al.
Pubblicazione: (2025)
Make a Cheap Scaling: A Self-Cascade Diffusion Model for Higher-Resolution Adaptation
di: Guo, Lanqing, et al.
Pubblicazione: (2024)
di: Guo, Lanqing, et al.
Pubblicazione: (2024)
XRF V2: A Dataset for Action Summarization with Wi-Fi Signals, and IMUs in Phones, Watches, Earbuds, and Glasses
di: Lan, Bo, et al.
Pubblicazione: (2025)
di: Lan, Bo, et al.
Pubblicazione: (2025)
BideDPO: Conditional Image Generation with Simultaneous Text and Condition Alignment
di: Zhou, Dewei, et al.
Pubblicazione: (2025)
di: Zhou, Dewei, et al.
Pubblicazione: (2025)
EMMA: Your Text-to-Image Diffusion Model Can Secretly Accept Multi-Modal Prompts
di: Han, Yucheng, et al.
Pubblicazione: (2024)
di: Han, Yucheng, et al.
Pubblicazione: (2024)
ConText: Driving In-context Learning for Text Removal and Segmentation
di: Zhang, Fei, et al.
Pubblicazione: (2025)
di: Zhang, Fei, et al.
Pubblicazione: (2025)
Prompt-Softbox-Prompt: A Free-Text Embedding Control for Image Editing
di: Yang, Yitong, et al.
Pubblicazione: (2024)
di: Yang, Yitong, et al.
Pubblicazione: (2024)
GuardT2I: Defending Text-to-Image Models from Adversarial Prompts
di: Yang, Yijun, et al.
Pubblicazione: (2024)
di: Yang, Yijun, et al.
Pubblicazione: (2024)
Fast Prompt Alignment for Text-to-Image Generation
di: Mrini, Khalil, et al.
Pubblicazione: (2024)
di: Mrini, Khalil, et al.
Pubblicazione: (2024)
WS-IMUBench: Can Weakly Supervised Methods from Audio, Image, and Video Be Adapted for IMU-based Temporal Action Localization?
di: Li, Pei, et al.
Pubblicazione: (2026)
di: Li, Pei, et al.
Pubblicazione: (2026)
Modality Prompts for Arbitrary Modality Salient Object Detection
di: Huang, Nianchang, et al.
Pubblicazione: (2024)
di: Huang, Nianchang, et al.
Pubblicazione: (2024)
One Snapshot is All You Need: A Generalized Method for mmWave Signal Generation
di: Huang, Teng, et al.
Pubblicazione: (2025)
di: Huang, Teng, et al.
Pubblicazione: (2025)
Cross-Modal Urban Sensing: Evaluating Sound-Vision Alignment Across Street-Level and Aerial Imagery
di: Chen, Pengyu, et al.
Pubblicazione: (2025)
di: Chen, Pengyu, et al.
Pubblicazione: (2025)
Beyond Open Vocabulary: Multimodal Prompting for Object Detection in Remote Sensing Images
di: Yang, Shuai, et al.
Pubblicazione: (2026)
di: Yang, Shuai, et al.
Pubblicazione: (2026)
Text-Driven Emotionally Continuous Talking Face Generation
di: Yang, Hao, et al.
Pubblicazione: (2026)
di: Yang, Hao, et al.
Pubblicazione: (2026)
GloTSFormer: Global Video Text Spotting Transformer
di: Wang, Han, et al.
Pubblicazione: (2024)
di: Wang, Han, et al.
Pubblicazione: (2024)
Edge Approximation Text Detector
di: Yang, Chuang, et al.
Pubblicazione: (2025)
di: Yang, Chuang, et al.
Pubblicazione: (2025)
Cross-domain EEG-based Emotion Recognition with Contrastive Learning
di: Yan, Rui, et al.
Pubblicazione: (2025)
di: Yan, Rui, et al.
Pubblicazione: (2025)
Advancing Pose-Guided Image Synthesis with Progressive Conditional Diffusion Models
di: Shen, Fei, et al.
Pubblicazione: (2023)
di: Shen, Fei, et al.
Pubblicazione: (2023)
Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering
di: Wang, Xu, et al.
Pubblicazione: (2025)
di: Wang, Xu, et al.
Pubblicazione: (2025)
DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
di: Ma, Yifeng, et al.
Pubblicazione: (2023)
HiLoTs: High-Low Temporal Sensitive Representation Learning for Semi-Supervised LiDAR Segmentation in Autonomous Driving
di: Lin, R. D., et al.
Pubblicazione: (2025)
di: Lin, R. D., et al.
Pubblicazione: (2025)
Text-Pass Filter: An Efficient Scene Text Detector
di: Yang, Chuang, et al.
Pubblicazione: (2026)
di: Yang, Chuang, et al.
Pubblicazione: (2026)
PromptSafe: Gated Prompt Tuning for Safe Text-to-Image Generation
di: Jing, Zonglei, et al.
Pubblicazione: (2025)
di: Jing, Zonglei, et al.
Pubblicazione: (2025)
TextGround4M: A Prompt-Aligned Dataset for Layout-Aware Text Rendering
di: Mao, Dongxing, et al.
Pubblicazione: (2026)
di: Mao, Dongxing, et al.
Pubblicazione: (2026)
StyleTalk++: A Unified Framework for Controlling the Speaking Styles of Talking Heads
di: Wang, Suzhen, et al.
Pubblicazione: (2024)
di: Wang, Suzhen, et al.
Pubblicazione: (2024)
Chat-Edit-3D: Interactive 3D Scene Editing via Text Prompts
di: Fang, Shuangkang, et al.
Pubblicazione: (2024)
di: Fang, Shuangkang, et al.
Pubblicazione: (2024)
AutoPrompt: Automated Red-Teaming of Text-to-Image Models via LLM-Driven Adversarial Prompts
di: Liu, Yufan, et al.
Pubblicazione: (2025)
di: Liu, Yufan, et al.
Pubblicazione: (2025)
Learning from Mistakes: Iterative Prompt Relabeling for Text-to-Image Diffusion Model Training
di: Chen, Xinyan, et al.
Pubblicazione: (2023)
di: Chen, Xinyan, et al.
Pubblicazione: (2023)
VMix: Improving Text-to-Image Diffusion Model with Cross-Attention Mixing Control
di: Wu, Shaojin, et al.
Pubblicazione: (2024)
di: Wu, Shaojin, et al.
Pubblicazione: (2024)
DGL: Dynamic Global-Local Prompt Tuning for Text-Video Retrieval
di: Yang, Xiangpeng, et al.
Pubblicazione: (2024)
di: Yang, Xiangpeng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
MobiDiary: Autoregressive Action Captioning with Wearable Devices and Wireless Signals
di: Deng, Fei, et al.
Pubblicazione: (2026) -
A Survey on Wi-Fi Sensing Generalizability: Taxonomy, Techniques, Datasets, and Future Research Prospects
di: Wang, Fei, et al.
Pubblicazione: (2025) -
DynaIP: Dynamic Image Prompt Adapter for Scalable Zero-shot Personalized Text-to-Image Generation
di: Wang, Zhizhong, et al.
Pubblicazione: (2025) -
Text-based Talking Video Editing with Cascaded Conditional Diffusion
di: Han, Bo, et al.
Pubblicazione: (2024) -
TalkCLIP: Talking Head Generation with Text-Guided Expressive Speaking Styles
di: Ma, Yifeng, et al.
Pubblicazione: (2023)