Neural-Driven Image Editing
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhou, Pengfei, Xia, Jie, Peng, Xiaopeng, Zhao, Wangbo, Ye, Zilong, Li, Zekai, Yang, Suorong, Pan, Jiadong, Chen, Yuanxiang, Wang, Ziqiao, Wang, Kai, Zheng, Qian, Jin, Hao, Chang, Xiaojun, Pan, Gang, Dong, Shurong, Zhang, Kaipeng, You, Yang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
REPA Works Until It Doesn't: Early-Stopped, Holistic Alignment Supercharges Diffusion Training
por: Wang, Ziqiao, et al.
Publicado: (2025)
por: Wang, Ziqiao, et al.
Publicado: (2025)
Wearable Music2Emotion : Assessing Emotions Induced by AI-Generated Music through Portable EEG-fNIRS Fusion
por: Zhao, Sha, et al.
Publicado: (2025)
por: Zhao, Sha, et al.
Publicado: (2025)
Exposing Hallucinations To Suppress Them: VLMs Representation Editing With Generative Anchors
por: Shi, Youxu, et al.
Publicado: (2025)
por: Shi, Youxu, et al.
Publicado: (2025)
On-the-Fly Data Augmentation via Gradient-Guided and Sample-Aware Influence Estimation
por: Yang, Suorong, et al.
Publicado: (2025)
por: Yang, Suorong, et al.
Publicado: (2025)
Prioritize Alignment in Dataset Distillation
por: Li, Zekai, et al.
Publicado: (2024)
por: Li, Zekai, et al.
Publicado: (2024)
MDK12-Bench: A Comprehensive Evaluation of Multimodal Large Language Models on Multidisciplinary Exams
por: Zhou, Pengfei, et al.
Publicado: (2025)
por: Zhou, Pengfei, et al.
Publicado: (2025)
Human-Inspired Computing for Robust and Efficient Audio-Visual Speech Recognition
por: Liu, Qianhui, et al.
Publicado: (2024)
por: Liu, Qianhui, et al.
Publicado: (2024)
EntAugment: Entropy-Driven Adaptive Data Augmentation Framework for Image Classification
por: Yang, Suorong, et al.
Publicado: (2024)
por: Yang, Suorong, et al.
Publicado: (2024)
Ensemble Debiasing Across Class and Sample Levels for Fairer Prompting Accuracy
por: Lin, Ruixi, et al.
Publicado: (2025)
por: Lin, Ruixi, et al.
Publicado: (2025)
RASA: Replace Anyone, Say Anything -- A Training-Free Framework for Audio-Driven and Universal Portrait Video Editing
por: Pan, Tianrui, et al.
Publicado: (2025)
por: Pan, Tianrui, et al.
Publicado: (2025)
Towards Scalable and Consistent 3D Editing
por: Xia, Ruihao, et al.
Publicado: (2025)
por: Xia, Ruihao, et al.
Publicado: (2025)
Recurrent Diffusion for Large-Scale Parameter Generation
por: Wang, Kai, et al.
Publicado: (2025)
por: Wang, Kai, et al.
Publicado: (2025)
MPBench: A Comprehensive Multimodal Reasoning Benchmark for Process Errors Identification
por: Xu, Zhaopan, et al.
Publicado: (2025)
por: Xu, Zhaopan, et al.
Publicado: (2025)
FOCUS: Unified Vision-Language Modeling for Interactive Editing Driven by Referential Segmentation
por: Yang, Fan, et al.
Publicado: (2025)
por: Yang, Fan, et al.
Publicado: (2025)
MDK12-Bench: A Multi-Discipline Benchmark for Evaluating Reasoning in Multimodal Large Language Models
por: Zhou, Pengfei, et al.
Publicado: (2025)
por: Zhou, Pengfei, et al.
Publicado: (2025)
When Dynamic Data Selection Meets Data Augmentation
por: Yang, Suorong, et al.
Publicado: (2025)
por: Yang, Suorong, et al.
Publicado: (2025)
Structure-Level Disentangled Diffusion for Few-Shot Chinese Font Generation
por: Li, Jie, et al.
Publicado: (2026)
por: Li, Jie, et al.
Publicado: (2026)
Role-SynthCLIP: A Role Play Driven Diverse Synthetic Data Approach
por: Huangfu, Yuanxiang, et al.
Publicado: (2025)
por: Huangfu, Yuanxiang, et al.
Publicado: (2025)
PEBench: A Fictitious Dataset to Benchmark Machine Unlearning for Multimodal Large Language Models
por: Xu, Zhaopan, et al.
Publicado: (2025)
por: Xu, Zhaopan, et al.
Publicado: (2025)
RAPID^3: Tri-Level Reinforced Acceleration Policies for Diffusion Transformer
por: Zhao, Wangbo, et al.
Publicado: (2025)
por: Zhao, Wangbo, et al.
Publicado: (2025)
One-shot Optimized Steering Vector for Hallucination Mitigation for VLMs
por: Shi, Youxu, et al.
Publicado: (2026)
por: Shi, Youxu, et al.
Publicado: (2026)
$Δ$-AttnMask: Attention-Guided Masked Hidden States for Efficient Data Selection and Augmentation
por: Hu, Jucheng, et al.
Publicado: (2025)
por: Hu, Jucheng, et al.
Publicado: (2025)
Conditional LoRA Parameter Generation
por: Jin, Xiaolong, et al.
Publicado: (2024)
por: Jin, Xiaolong, et al.
Publicado: (2024)
Towards Lossless Dataset Distillation via Difficulty-Aligned Trajectory Matching
por: Guo, Ziyao, et al.
Publicado: (2023)
por: Guo, Ziyao, et al.
Publicado: (2023)
Frustrated Lewis pairs constructed on Cs‐Beta for aldol condensation of methyl acetate with formaldehyde
por: Kaipeng Cao, et al.
Publicado: (2025)
por: Kaipeng Cao, et al.
Publicado: (2025)
Faster Vision Mamba is Rebuilt in Minutes via Merged Token Re-training
por: Shi, Mingjia, et al.
Publicado: (2024)
por: Shi, Mingjia, et al.
Publicado: (2024)
Bidirectional Photoregulated Chromism in Pyridinium Derivatives via Secondary Excitation‐Driven Electron Transfer
por: Yun‐Rui Chen, et al.
Publicado: (2025)
por: Yun‐Rui Chen, et al.
Publicado: (2025)
Dynamic Diffusion Transformer
por: Zhao, Wangbo, et al.
Publicado: (2024)
por: Zhao, Wangbo, et al.
Publicado: (2024)
Dynamic Tuning Towards Parameter and Inference Efficiency for ViT Adaptation
por: Zhao, Wangbo, et al.
Publicado: (2024)
por: Zhao, Wangbo, et al.
Publicado: (2024)
A Stitch in Time Saves Nine: Small VLM is a Precise Guidance for Accelerating Large VLMs
por: Zhao, Wangbo, et al.
Publicado: (2024)
por: Zhao, Wangbo, et al.
Publicado: (2024)
World-to-Words: Grounded Open Vocabulary Acquisition through Fast Mapping in Vision-Language Models
por: Ma, Ziqiao, et al.
Publicado: (2023)
por: Ma, Ziqiao, et al.
Publicado: (2023)
GRE Suite: Geo-localization Inference via Fine-Tuned Vision-Language Models and Enhanced Reasoning Chains
por: Wang, Chun, et al.
Publicado: (2025)
por: Wang, Chun, et al.
Publicado: (2025)
Dragging with Geometry: From Pixels to Geometry-Guided Image Editing
por: Pu, Xinyu, et al.
Publicado: (2025)
por: Pu, Xinyu, et al.
Publicado: (2025)
Enhance-A-Video: Better Generated Video for Free
por: Luo, Yang, et al.
Publicado: (2025)
por: Luo, Yang, et al.
Publicado: (2025)
A CLIP-Powered Framework for Robust and Generalizable Data Selection
por: Yang, Suorong, et al.
Publicado: (2024)
por: Yang, Suorong, et al.
Publicado: (2024)
Finding and Editing Multi-Modal Neurons in Pre-Trained Transformers
por: Pan, Haowen, et al.
Publicado: (2023)
por: Pan, Haowen, et al.
Publicado: (2023)
AKEW: Assessing Knowledge Editing in the Wild
por: Wu, Xiaobao, et al.
Publicado: (2024)
por: Wu, Xiaobao, et al.
Publicado: (2024)
Unsupervised Learning for Class Distribution Mismatch
por: Du, Pan, et al.
Publicado: (2025)
por: Du, Pan, et al.
Publicado: (2025)
Memory-Driven Role-Playing: Evaluation and Enhancement of Persona Knowledge Utilization in LLMs
por: Wang, Kai, et al.
Publicado: (2026)
por: Wang, Kai, et al.
Publicado: (2026)
Knowdit: Agentic Smart Contract Vulnerability Detection with Auditing Knowledge Summarization
por: Kong, Ziqiao, et al.
Publicado: (2026)
por: Kong, Ziqiao, et al.
Publicado: (2026)
Ejemplares similares
-
REPA Works Until It Doesn't: Early-Stopped, Holistic Alignment Supercharges Diffusion Training
por: Wang, Ziqiao, et al.
Publicado: (2025) -
Wearable Music2Emotion : Assessing Emotions Induced by AI-Generated Music through Portable EEG-fNIRS Fusion
por: Zhao, Sha, et al.
Publicado: (2025) -
Exposing Hallucinations To Suppress Them: VLMs Representation Editing With Generative Anchors
por: Shi, Youxu, et al.
Publicado: (2025) -
On-the-Fly Data Augmentation via Gradient-Guided and Sample-Aware Influence Estimation
por: Yang, Suorong, et al.
Publicado: (2025) -
Prioritize Alignment in Dataset Distillation
por: Li, Zekai, et al.
Publicado: (2024)