Suchergebnisse - Huang, Linjiang
- Treffer 1 - 20 von 21
- Zur nächsten Seite
-
1
FR-TTS: Test-Time Scaling for NTP-based Image Generation with Effective Filling-based Reward Signal von Xu, Hang, Huang, Linjiang, Zhao, Feng
Veröffentlicht 2025Volltext
Preprint -
2
Highly Efficient Test-Time Scaling for T2I Diffusion Models with Text Embedding Perturbation von Xu, Hang, Huang, Linjiang, Zhao, Feng
Veröffentlicht 2025Volltext
Preprint -
3
GaussianPainter: Painting Point Cloud into 3D Gaussians with Normal Guidance von Zhou, Jingqiu, Fan, Lue, Chen, Xuesong, Huang, Linjiang, Liu, Si, Li, Hongsheng
Veröffentlicht 2024Volltext
Preprint -
4
SOLVE: Synergy of Language-Vision and End-to-End Networks for Autonomous Driving von Chen, Xuesong, Huang, Linjiang, Ma, Tao, Fang, Rongyao, Shi, Shaoshuai, Li, Hongsheng
Veröffentlicht 2025Volltext
Preprint -
5
-
6
"Hi AirStar, Guide Me to the Badminton Court." von Wang, Ziqin, Chen, Jinyu, Zheng, Xiangyi, Liao, Qinan, Huang, Linjiang, Liu, Si
Veröffentlicht 2025Volltext
Preprint -
7
AnyExperts: On-Demand Expert Allocation for Multimodal Language Models with Mixture of Expert von Gao, Yuting, Lan, Wang, Zhao, Hengyuan, Huang, Linjiang, Liu, Si, Guo, Qingpei
Veröffentlicht 2025Volltext
Preprint -
8
FouriScale: A Frequency Perspective on Training-Free High-Resolution Image Synthesis von Huang, Linjiang, Fang, Rongyao, Zhang, Aiping, Song, Guanglu, Liu, Si, Liu, Yu, Li, Hongsheng
Veröffentlicht 2024Volltext
Preprint -
9
FlexDrive: Toward Trajectory Flexibility in Driving Scene Reconstruction and Rendering von Zhou, Jingqiu, Fan, Lue, Huang, Linjiang, Shi, Xiaoyu, Liu, Si, Zhang, Zhaoxiang, Li, Hongsheng
Veröffentlicht 2025Volltext
Preprint -
10
-
11
-
12
SkeNa: Learning to Navigate Unseen Environments Based on Abstract Hand-Drawn Maps von Xu, Haojun, Xiang, Jiaqi, Wei, Wu, Chen, Jinyu, Zhong, Linqing, Huang, Linjiang, Yang, Hongyu, Liu, Si
Veröffentlicht 2025Volltext
Preprint -
13
AeroDuo: Aerial Duo for UAV-based Vision and Language Navigation von Wu, Ruipu, Zhang, Yige, Chen, Jinyu, Huang, Linjiang, Zhang, Shifeng, Zhou, Xu, Wang, Liang, Liu, Si
Veröffentlicht 2025Volltext
Preprint -
14
FreeEdit: Mask-free Reference-based Image Editing with Multi-modal Instruction von He, Runze, Ma, Kai, Huang, Linjiang, Huang, Shaofei, Gao, Jialin, Wei, Xiaoming, Dai, Jiao, Han, Jizhong, Liu, Si
Veröffentlicht 2024Volltext
Preprint -
15
VaccineRAG: Boosting Multimodal Large Language Models' Immunity to Harmful RAG Samples von Sun, Qixin, Wang, Ziqin, Zhao, Hengyuan, Li, Yilin, Song, Kaiyou, Huang, Linjiang, Hu, Xiaolin, Guo, Qingpei, Liu, Si
Veröffentlicht 2025Volltext
Preprint -
16
Group Critical-token Policy Optimization for Autoregressive Image Generation von Zhang, Guohui, Yu, Hu, Ma, Xiaoxiao, Zhang, JingHao, Pan, Yaning, Yao, Mingde, Xiao, Jie, Huang, Linjiang, Zhao, Feng
Veröffentlicht 2025Volltext
Preprint -
17
-
18
-
19
GoT: Unleashing Reasoning Capability of Multimodal Large Language Model for Visual Generation and Editing von Fang, Rongyao, Duan, Chengqi, Wang, Kun, Huang, Linjiang, Li, Hao, Yan, Shilin, Tian, Hao, Zeng, Xingyu, Zhao, Rui, Dai, Jifeng, Liu, Xihui, Li, Hongsheng
Veröffentlicht 2025Volltext
Preprint -
20
MathCanvas: Intrinsic Visual Chain-of-Thought for Multimodal Mathematical Reasoning von Shi, Weikang, Yu, Aldrich, Fang, Rongyao, Ren, Houxing, Wang, Ke, Zhou, Aojun, Tian, Changyao, Fu, Xinyu, Hu, Yuxuan, Lu, Zimu, Huang, Linjiang, Liu, Si, Liu, Rui, Li, Hongsheng
Veröffentlicht 2025Volltext
Preprint