CharCom: Composable Identity Control for Multi-Character Story Illustration
Fuente:
arXiv
Guardado en:
| Autores principales: | Wang, Zhongsheng, Lin, Ming, Lin, Zhedong, Shakib, Yaser, Liu, Qian, Liu, Jiamou |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
S2ED: From Story to Executable Descriptions for Consistency-Aware Story Illustration
por: Yin, Sijing, et al.
Publicado: (2026)
por: Yin, Sijing, et al.
Publicado: (2026)
ChatLogic: Integrating Logic Programming with Large Language Models for Multi-Step Reasoning
por: Wang, Zhongsheng, et al.
Publicado: (2024)
por: Wang, Zhongsheng, et al.
Publicado: (2024)
R-Debater: Retrieval-Augmented Debate Generation through Argumentative Memory
por: Li, Maoyuan, et al.
Publicado: (2025)
por: Li, Maoyuan, et al.
Publicado: (2025)
CoRA: Optimizing Low-Rank Adaptation with Common Subspace of Large Language Models
por: Xiao, Xiaojun, et al.
Publicado: (2024)
por: Xiao, Xiaojun, et al.
Publicado: (2024)
Weak Supervision Techniques towards Enhanced ASR Models in Industry-level CRM Systems
por: Wang, Zhongsheng, et al.
Publicado: (2025)
por: Wang, Zhongsheng, et al.
Publicado: (2025)
Generating Visual Stories with Grounded and Coreferent Characters
por: Liu, Danyang, et al.
Publicado: (2024)
por: Liu, Danyang, et al.
Publicado: (2024)
Scale Up Composed Image Retrieval Learning via Modification Text Generation
por: Zhou, Yinan, et al.
Publicado: (2025)
por: Zhou, Yinan, et al.
Publicado: (2025)
InteChar: A Unified Oracle Bone Character List for Ancient Chinese Language Modeling
por: Diao, Xiaolei, et al.
Publicado: (2025)
por: Diao, Xiaolei, et al.
Publicado: (2025)
CharDiff-LP: A Diffusion Model with Character-Level Guidance for License Plate Image Restoration
por: Na, Kihyun, et al.
Publicado: (2025)
por: Na, Kihyun, et al.
Publicado: (2025)
StoryVerse: Towards Co-authoring Dynamic Plot with LLM-based Character Simulation via Narrative Planning
por: Wang, Yi, et al.
Publicado: (2024)
por: Wang, Yi, et al.
Publicado: (2024)
OregairuChar: A Benchmark Dataset for Character Appearance Frequency Analysis in My Teen Romantic Comedy SNAFU
por: Sun, Qi, et al.
Publicado: (2025)
por: Sun, Qi, et al.
Publicado: (2025)
A Multi-Task Role-Playing Agent Capable of Imitating Character Linguistic Styles
por: Chen, Siyuan, et al.
Publicado: (2024)
por: Chen, Siyuan, et al.
Publicado: (2024)
StoryTeller: Improving Long Video Description through Global Audio-Visual Character Identification
por: He, Yichen, et al.
Publicado: (2024)
por: He, Yichen, et al.
Publicado: (2024)
ComAgent: Multi-LLM based Agentic AI Empowered Intelligent Wireless Networks
por: Li, Haoyun, et al.
Publicado: (2026)
por: Li, Haoyun, et al.
Publicado: (2026)
Inferring Reward Machines and Transition Machines from Partially Observable Markov Decision Processes
por: Wu, Yuly, et al.
Publicado: (2025)
por: Wu, Yuly, et al.
Publicado: (2025)
If an LLM Were a Character, Would It Know Its Own Story? Evaluating Lifelong Learning in LLMs
por: Fan, Siqi, et al.
Publicado: (2025)
por: Fan, Siqi, et al.
Publicado: (2025)
CharTool: Tool-Integrated Visual Reasoning for Chart Understanding
por: Zhang, Situo, et al.
Publicado: (2026)
por: Zhang, Situo, et al.
Publicado: (2026)
UMAIR-FPS: User-aware Multi-modal Animation Illustration Recommendation Fusion with Painting Style
por: Kang, Yan, et al.
Publicado: (2024)
por: Kang, Yan, et al.
Publicado: (2024)
Active Asymmetric Multi-Agent Multimodal Learning under Uncertainty
por: Liu, Rui, et al.
Publicado: (2026)
por: Liu, Rui, et al.
Publicado: (2026)
The Essence of Contextual Understanding in Theory of Mind: A Study on Question Answering with Story Characters
por: Zhou, Chulun, et al.
Publicado: (2025)
por: Zhou, Chulun, et al.
Publicado: (2025)
MOSAIC: Composable Safety Alignment with Modular Control Tokens
por: Peng, Jingyu, et al.
Publicado: (2026)
por: Peng, Jingyu, et al.
Publicado: (2026)
Masked Generative Story Transformer with Character Guidance and Caption Augmentation
por: Papadimitriou, Christos, et al.
Publicado: (2024)
por: Papadimitriou, Christos, et al.
Publicado: (2024)
Cognitive Alignment in Personality Reasoning: Leveraging Prototype Theory for MBTI Inference
por: Li, Haoyuan, et al.
Publicado: (2025)
por: Li, Haoyuan, et al.
Publicado: (2025)
Understanding Financial Reasoning in AI: A Multimodal Benchmark and Error Learning Approach
por: Deng, Shuangyan, et al.
Publicado: (2025)
por: Deng, Shuangyan, et al.
Publicado: (2025)
Learning Composable Chains-of-Thought
por: Yin, Fangcong, et al.
Publicado: (2025)
por: Yin, Fangcong, et al.
Publicado: (2025)
OSCAR: Optimization-Steered Agentic Planning for Composed Image Retrieval
por: Wang, Teng, et al.
Publicado: (2026)
por: Wang, Teng, et al.
Publicado: (2026)
Enhancing Student Performance Prediction on Learnersourced Questions with SGNN-LLM Synergy
por: Ni, Lin, et al.
Publicado: (2023)
por: Ni, Lin, et al.
Publicado: (2023)
Interactive Character Control with Auto-Regressive Motion Diffusion Models
por: Shi, Yi, et al.
Publicado: (2023)
por: Shi, Yi, et al.
Publicado: (2023)
Situational-Constrained Sequential Resources Allocation via Reinforcement Learning
por: Zhang, Libo, et al.
Publicado: (2025)
por: Zhang, Libo, et al.
Publicado: (2025)
Policy-regularized Offline Multi-objective Reinforcement Learning
por: Lin, Qian, et al.
Publicado: (2024)
por: Lin, Qian, et al.
Publicado: (2024)
SongComposer: A Large Language Model for Lyric and Melody Generation in Song Composition
por: Ding, Shuangrui, et al.
Publicado: (2024)
por: Ding, Shuangrui, et al.
Publicado: (2024)
An Offline Adaptation Framework for Constrained Multi-Objective Reinforcement Learning
por: Lin, Qian, et al.
Publicado: (2024)
por: Lin, Qian, et al.
Publicado: (2024)
ComPO: Preference Alignment via Comparison Oracles
por: Chen, Peter, et al.
Publicado: (2025)
por: Chen, Peter, et al.
Publicado: (2025)
StoryWriter: A Multi-Agent Framework for Long Story Generation
por: Xia, Haotian, et al.
Publicado: (2025)
por: Xia, Haotian, et al.
Publicado: (2025)
Mitigating Hallucination in Large Multi-Modal Models via Robust Instruction Tuning
por: Liu, Fuxiao, et al.
Publicado: (2023)
por: Liu, Fuxiao, et al.
Publicado: (2023)
FedMTFI: Feature Importance Based Optimized Multi Teacher Knowledge Distillation in Heterogeneous Federated Learning Environment
por: Shadin, Nazmus Shakib, et al.
Publicado: (2026)
por: Shadin, Nazmus Shakib, et al.
Publicado: (2026)
ComposerX: Multi-Agent Symbolic Music Composition with LLMs
por: Deng, Qixin, et al.
Publicado: (2024)
por: Deng, Qixin, et al.
Publicado: (2024)
Dual Relation Alignment for Composed Image Retrieval
por: Jiang, Xintong, et al.
Publicado: (2023)
por: Jiang, Xintong, et al.
Publicado: (2023)
FinMR: A Knowledge-Intensive Multimodal Benchmark for Advanced Financial Reasoning
por: Deng, Shuangyan, et al.
Publicado: (2025)
por: Deng, Shuangyan, et al.
Publicado: (2025)
2K-Characters-10K-Stories: A Quality-Gated Stylized Narrative Dataset with Disentangled Control and Sequence Consistency
por: Yin, Xingxi, et al.
Publicado: (2025)
por: Yin, Xingxi, et al.
Publicado: (2025)
Ejemplares similares
-
S2ED: From Story to Executable Descriptions for Consistency-Aware Story Illustration
por: Yin, Sijing, et al.
Publicado: (2026) -
ChatLogic: Integrating Logic Programming with Large Language Models for Multi-Step Reasoning
por: Wang, Zhongsheng, et al.
Publicado: (2024) -
R-Debater: Retrieval-Augmented Debate Generation through Argumentative Memory
por: Li, Maoyuan, et al.
Publicado: (2025) -
CoRA: Optimizing Low-Rank Adaptation with Common Subspace of Large Language Models
por: Xiao, Xiaojun, et al.
Publicado: (2024) -
Weak Supervision Techniques towards Enhanced ASR Models in Industry-level CRM Systems
por: Wang, Zhongsheng, et al.
Publicado: (2025)