Saved in:
| Main Authors: | Dong, Xiaojing, Huang, Weilin, Li, Liang, Li, Yiying, Liu, Shu, Ou, Tongtong, Ouyang, Shuang, Tian, Yu, Zhao, Fengxuan |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2509.17907 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Text-guided Image Restoration and Semantic Enhancement for Text-to-Image Person Retrieval
by: Liu, Delong, et al.
Published: (2023)
by: Liu, Delong, et al.
Published: (2023)
Hierarchical Prompt Learning for Image- and Text-Based Person Re-Identification
by: Zhou, Linhan, et al.
Published: (2025)
by: Zhou, Linhan, et al.
Published: (2025)
PEER: Expertizing Domain-Specific Tasks with a Multi-Agent Framework and Tuning Methods
by: Wang, Yiying, et al.
Published: (2024)
by: Wang, Yiying, et al.
Published: (2024)
Segment Anything for Videos: A Systematic Survey
by: Zhang, Chunhui, et al.
Published: (2024)
by: Zhang, Chunhui, et al.
Published: (2024)
Evaluating Clinical Competencies of Large Language Models with a General Practice Benchmark
by: Li, Zheqing, et al.
Published: (2025)
by: Li, Zheqing, et al.
Published: (2025)
Can AI Make Energy Retrofit Decisions? An Evaluation of Large Language Models
by: Shu, Lei, et al.
Published: (2025)
by: Shu, Lei, et al.
Published: (2025)
Fuzz-Testing Meets LLM-Based Agents: An Automated and Efficient Framework for Jailbreaking Text-To-Image Generation Models
by: Dong, Yingkai, et al.
Published: (2024)
by: Dong, Yingkai, et al.
Published: (2024)
Hengqin-RA-v1: Advanced Large Language Model for Diagnosis and Treatment of Rheumatoid Arthritis with Dataset based Traditional Chinese Medicine
by: Liu, Yishen, et al.
Published: (2025)
by: Liu, Yishen, et al.
Published: (2025)
GPrune-LLM: Generalization-Aware Structured Pruning for Large Language Models
by: Liu, Xiaoyun, et al.
Published: (2026)
by: Liu, Xiaoyun, et al.
Published: (2026)
Evaluation Agent: Efficient and Promptable Evaluation Framework for Visual Generative Models
by: Zhang, Fan, et al.
Published: (2024)
by: Zhang, Fan, et al.
Published: (2024)
Leveraging GNN to Enhance MEF Method in Predicting ENSO
by: Ganji, Saghar, et al.
Published: (2025)
by: Ganji, Saghar, et al.
Published: (2025)
T2I-Eval-R1: Reinforcement Learning-Driven Reasoning for Interpretable Text-to-Image Evaluation
by: Ma, Zi-Ao, et al.
Published: (2025)
by: Ma, Zi-Ao, et al.
Published: (2025)
Circulating Proteomics and Risk of Atrial Fibrillation: A Systematic Review of Cohort Studies
by: Luxiang Shang, et al.
Published: (2025)
by: Luxiang Shang, et al.
Published: (2025)
DiffGraph: An Automated Agent-driven Model Merging Framework for In-the-Wild Text-to-Image Generation
by: Li, Zhuoling, et al.
Published: (2026)
by: Li, Zhuoling, et al.
Published: (2026)
Advances in Bio‐Optical Imaging Systems for Spatiotemporal Monitoring of Intestinal Bacteria
by: Tongtong Pan, et al.
Published: (2024)
by: Tongtong Pan, et al.
Published: (2024)
AtelierEval: Agentic Evaluation of Humans & LLMs as Text-to-Image Prompters
by: Luo, Hanjun, et al.
Published: (2026)
by: Luo, Hanjun, et al.
Published: (2026)
Speculative Decoding Meets Quantization: Compatibility Evaluation and Hierarchical Framework Design
by: Zhang, Yudi, et al.
Published: (2025)
by: Zhang, Yudi, et al.
Published: (2025)
Visual Reasoning over Time Series via Multi-Agent System
by: Ruan, Weilin, et al.
Published: (2026)
by: Ruan, Weilin, et al.
Published: (2026)
TextMatch: Enhancing Image-Text Consistency Through Multimodal Optimization
by: Luo, Yucong, et al.
Published: (2024)
by: Luo, Yucong, et al.
Published: (2024)
Uncovering the Text Embedding in Text-to-Image Diffusion Models
by: Yu, Hu, et al.
Published: (2024)
by: Yu, Hu, et al.
Published: (2024)
Socratic-PRMBench: Benchmarking Process Reward Models with Systematic Reasoning Patterns
by: Li, Xiang, et al.
Published: (2025)
by: Li, Xiang, et al.
Published: (2025)
Syn-Diag: An LLM-based Synergistic Framework for Generalizable Few-shot Fault Diagnosis on the Edge
by: Jia, Zijun, et al.
Published: (2025)
by: Jia, Zijun, et al.
Published: (2025)
Deep Reward Supervisions for Tuning Text-to-Image Diffusion Models
by: Wu, Xiaoshi, et al.
Published: (2024)
by: Wu, Xiaoshi, et al.
Published: (2024)
Cross Space and Time: A Spatio-Temporal Unitized Model for Traffic Flow Forecasting
by: Ruan, Weilin, et al.
Published: (2024)
by: Ruan, Weilin, et al.
Published: (2024)
Retinex-MEF: Retinex-based Glare Effects Aware Unsupervised Multi-Exposure Image Fusion
by: Bai, Haowen, et al.
Published: (2025)
by: Bai, Haowen, et al.
Published: (2025)
PHM-Bench: A Domain-Specific Benchmarking Framework for Systematic Evaluation of Large Models in Prognostics and Health Management
by: Yang, Puyu, et al.
Published: (2025)
by: Yang, Puyu, et al.
Published: (2025)
LACON: Training Text-to-Image Model from Uncurated Data
by: Liang, Zhiyang, et al.
Published: (2026)
by: Liang, Zhiyang, et al.
Published: (2026)
MetaLogic: Robustness Evaluation of Text-to-Image Models via Logically Equivalent Prompts
by: Shen, Yifan, et al.
Published: (2025)
by: Shen, Yifan, et al.
Published: (2025)
DDT: Decoupled Diffusion Transformer
by: Wang, Shuai, et al.
Published: (2025)
by: Wang, Shuai, et al.
Published: (2025)
PromptGuard: Soft Prompt-Guided Unsafe Content Moderation for Text-to-Image Models
by: Yuan, Lingzhi, et al.
Published: (2025)
by: Yuan, Lingzhi, et al.
Published: (2025)
MATEval: A Multi-Agent Discussion Framework for Advancing Open-Ended Text Evaluation
by: Li, Yu, et al.
Published: (2024)
by: Li, Yu, et al.
Published: (2024)
Mastering Text, Code and Math Simultaneously via Fusing Highly Specialized Language Models
by: Ding, Ning, et al.
Published: (2024)
by: Ding, Ning, et al.
Published: (2024)
INFELM: In-depth Fairness Evaluation of Large Text-To-Image Models
by: Jin, Di, et al.
Published: (2024)
by: Jin, Di, et al.
Published: (2024)
CoMat: Aligning Text-to-Image Diffusion Model with Image-to-Text Concept Matching
by: Jiang, Dongzhi, et al.
Published: (2024)
by: Jiang, Dongzhi, et al.
Published: (2024)
RAST: A Retrieval Augmented Spatio-Temporal Framework for Traffic Prediction
by: Ruan, Weilin, et al.
Published: (2025)
by: Ruan, Weilin, et al.
Published: (2025)
A Nerf-Based Color Consistency Method for Remote Sensing Images
by: Zuo, Zongcheng, et al.
Published: (2024)
by: Zuo, Zongcheng, et al.
Published: (2024)
NAG: A Unified Native Architecture for Encoder-free Text-Graph Modeling in Language Models
by: Gong, Haisong, et al.
Published: (2026)
by: Gong, Haisong, et al.
Published: (2026)
PROXYQA: An Alternative Framework for Evaluating Long-Form Text Generation with Large Language Models
by: Tan, Haochen, et al.
Published: (2024)
by: Tan, Haochen, et al.
Published: (2024)
A Systematic Evaluation of GPT-4V's Multimodal Capability for Medical Image Analysis
by: Li, Yingshu, et al.
Published: (2023)
by: Li, Yingshu, et al.
Published: (2023)
Evaluating Text-to-Visual Generation with Image-to-Text Generation
by: Lin, Zhiqiu, et al.
Published: (2024)
by: Lin, Zhiqiu, et al.
Published: (2024)
Similar Items
-
Text-guided Image Restoration and Semantic Enhancement for Text-to-Image Person Retrieval
by: Liu, Delong, et al.
Published: (2023) -
Hierarchical Prompt Learning for Image- and Text-Based Person Re-Identification
by: Zhou, Linhan, et al.
Published: (2025) -
PEER: Expertizing Domain-Specific Tasks with a Multi-Agent Framework and Tuning Methods
by: Wang, Yiying, et al.
Published: (2024) -
Segment Anything for Videos: A Systematic Survey
by: Zhang, Chunhui, et al.
Published: (2024) -
Evaluating Clinical Competencies of Large Language Models with a General Practice Benchmark
by: Li, Zheqing, et al.
Published: (2025)