Saved in:
| Main Authors: | Shen, Zhuokang, Wang, Yifan, Chen, Hanyu, Shen, Yunhang, Huang, Wenxuan, He, Gaoqi, Xie, Jiao, Ji, Rongrong, Lin, Shaohui |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2603.01059 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
A General and Efficient Training for Transformer via Token Expansion
by: Huang, Wenxuan, et al.
Published: (2024)
by: Huang, Wenxuan, et al.
Published: (2024)
MASA: Rethinking the Representational Bottleneck in LoRA with Multi-A Shared Adaptation
by: Dong, Qin, et al.
Published: (2025)
by: Dong, Qin, et al.
Published: (2025)
HUWSOD: Holistic Self-training for Unified Weakly Supervised Object Detection
by: Cao, Liujuan, et al.
Published: (2024)
by: Cao, Liujuan, et al.
Published: (2024)
What You Perceive Is What You Conceive: A Cognition-Inspired Framework for Open Vocabulary Image Segmentation
by: Lin, Jianghang, et al.
Published: (2025)
by: Lin, Jianghang, et al.
Published: (2025)
DF-LLaVA: Unlocking MLLMs for Synthetic Image Detection via Knowledge Injection and Conflict-Driven Self-Reflection
by: Shen, Zhuokang, et al.
Published: (2025)
by: Shen, Zhuokang, et al.
Published: (2025)
Rethinking Centered Kernel Alignment in Knowledge Distillation
by: Zhou, Zikai, et al.
Published: (2024)
by: Zhou, Zikai, et al.
Published: (2024)
Dynamic Contrastive Knowledge Distillation for Efficient Image Restoration
by: Zhou, Yunshuai, et al.
Published: (2024)
by: Zhou, Yunshuai, et al.
Published: (2024)
Multi-User Chat Assistant (MUCA): a Framework Using LLMs to Facilitate Group Conversations
by: Mao, Manqing, et al.
Published: (2024)
by: Mao, Manqing, et al.
Published: (2024)
Dynamic-LLaVA: Efficient Multimodal Large Language Models via Dynamic Vision-language Context Sparsification
by: Huang, Wenxuan, et al.
Published: (2024)
by: Huang, Wenxuan, et al.
Published: (2024)
Class-Imbalanced Semi-Supervised Learning for Large-Scale Point Cloud Semantic Segmentation via Decoupling Optimization
by: Li, Mengtian, et al.
Published: (2024)
by: Li, Mengtian, et al.
Published: (2024)
Pseudo-Label Quality Decoupling and Correction for Semi-Supervised Instance Segmentation
by: Lin, Jianghang, et al.
Published: (2025)
by: Lin, Jianghang, et al.
Published: (2025)
GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via Cipher
by: Yuan, Youliang, et al.
Published: (2023)
by: Yuan, Youliang, et al.
Published: (2023)
LLaVA-RadZ: Can Multimodal Large Language Models Effectively Tackle Zero-shot Radiology Recognition?
by: Li, Bangyan, et al.
Published: (2025)
by: Li, Bangyan, et al.
Published: (2025)
AI-Generated Content Enhanced Computer-Aided Diagnosis Model for Thyroid Nodules: A ChatGPT-Style Assistant
by: Yao, Jincao, et al.
Published: (2024)
by: Yao, Jincao, et al.
Published: (2024)
Long-VITA: Scaling Large Multi-modal Models to 1 Million Tokens with Leading Short-Context Accuracy
by: Shen, Yunhang, et al.
Published: (2025)
by: Shen, Yunhang, et al.
Published: (2025)
ChatGPT for Computational Topology
by: Liu, Jian, et al.
Published: (2023)
by: Liu, Jian, et al.
Published: (2023)
Exploring Culturally Informed AI Assistants: A Comparative Study of ChatBlackGPT and ChatGPT
by: Egede, Lisa, et al.
Published: (2025)
by: Egede, Lisa, et al.
Published: (2025)
Probability-density-aware Semi-supervised Learning
by: Liu, Shuyang, et al.
Published: (2024)
by: Liu, Shuyang, et al.
Published: (2024)
Acceptability of AI Assistants for Privacy: Perceptions of Experts and Users on Personalized Privacy Assistants
by: Xu, Meihe, et al.
Published: (2025)
by: Xu, Meihe, et al.
Published: (2025)
FlexiReID: Adaptive Mixture of Expert for Multi-Modal Person Re-Identification
by: Sun, Zhen, et al.
Published: (2025)
by: Sun, Zhen, et al.
Published: (2025)
VEGA: Learning Interleaved Image-Text Comprehension in Vision-Language Large Models
by: Zhou, Chenyu, et al.
Published: (2024)
by: Zhou, Chenyu, et al.
Published: (2024)
FlashSloth: Lightning Multimodal Large Language Models via Embedded Visual Compression
by: Tong, Bo, et al.
Published: (2024)
by: Tong, Bo, et al.
Published: (2024)
Few-Shot Image Quality Assessment via Adaptation of Vision-Language Models
by: Li, Xudong, et al.
Published: (2024)
by: Li, Xudong, et al.
Published: (2024)
Omni-Referring Image Segmentation
by: Zheng, Qiancheng, et al.
Published: (2025)
by: Zheng, Qiancheng, et al.
Published: (2025)
Towards Efficient Large Language Reasoning Models via Extreme-Ratio Chain-of-Thought Compression
by: Tang, Yuntian, et al.
Published: (2026)
by: Tang, Yuntian, et al.
Published: (2026)
DeOcc-1-to-3: 3D De-Occlusion from a Single Image via Self-Supervised Multi-View Diffusion
by: Qu, Yansong, et al.
Published: (2025)
by: Qu, Yansong, et al.
Published: (2025)
ChatIE: Zero-Shot Information Extraction via Chatting with ChatGPT
by: Wei, Xiang, et al.
Published: (2023)
by: Wei, Xiang, et al.
Published: (2023)
KDPM: Knowledge‐driven dynamic perception model for evacuation scene simulation
by: Kecheng Tang, et al.
Published: (2024)
by: Kecheng Tang, et al.
Published: (2024)
Fig. 4 in Three new species of Mecoptera (Insecta, Antliophora) from Yunnan, China
by: Xie, Jiao, et al.
Published: (2025)
by: Xie, Jiao, et al.
Published: (2025)
Jill Watson: A Virtual Teaching Assistant powered by ChatGPT
by: Taneja, Karan, et al.
Published: (2024)
by: Taneja, Karan, et al.
Published: (2024)
From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning
by: Zeng, Yuhui, et al.
Published: (2025)
by: Zeng, Yuhui, et al.
Published: (2025)
Beyond Benchmarks: How Users Evaluate AI Chat Assistants
by: Awan, Moiz Sadiq, et al.
Published: (2026)
by: Awan, Moiz Sadiq, et al.
Published: (2026)
VITA-Audio: Fast Interleaved Cross-Modal Token Generation for Efficient Large Speech-Language Model
by: Long, Zuwei, et al.
Published: (2025)
by: Long, Zuwei, et al.
Published: (2025)
VITA-1.5: Towards GPT-4o Level Real-Time Vision and Speech Interaction
by: Fu, Chaoyou, et al.
Published: (2025)
by: Fu, Chaoyou, et al.
Published: (2025)
"I Use ChatGPT to Humanize My Words": Affordances and Risks of ChatGPT to Autistic Users
by: Ma, Renkai, et al.
Published: (2026)
by: Ma, Renkai, et al.
Published: (2026)
Dynamic User-controllable Privacy-preserving Few-shot Sensing Framework
by: Chathoth, Ajesh Koyatan, et al.
Published: (2025)
by: Chathoth, Ajesh Koyatan, et al.
Published: (2025)
Security Analysis of ChatGPT: Threats and Privacy Risks
by: Xiang, Yushan, et al.
Published: (2025)
by: Xiang, Yushan, et al.
Published: (2025)
Gradable ChatGPT Translation Evaluation
by: Jiao, Hui, et al.
Published: (2024)
by: Jiao, Hui, et al.
Published: (2024)
Exploring ChatGPT's Capabilities on Vulnerability Management
by: Liu, Peiyu, et al.
Published: (2023)
by: Liu, Peiyu, et al.
Published: (2023)
Harnessing Large Language Models for Seed Generation in Greybox Fuzzing
by: Shi, Wenxuan, et al.
Published: (2024)
by: Shi, Wenxuan, et al.
Published: (2024)
Similar Items
-
A General and Efficient Training for Transformer via Token Expansion
by: Huang, Wenxuan, et al.
Published: (2024) -
MASA: Rethinking the Representational Bottleneck in LoRA with Multi-A Shared Adaptation
by: Dong, Qin, et al.
Published: (2025) -
HUWSOD: Holistic Self-training for Unified Weakly Supervised Object Detection
by: Cao, Liujuan, et al.
Published: (2024) -
What You Perceive Is What You Conceive: A Cognition-Inspired Framework for Open Vocabulary Image Segmentation
by: Lin, Jianghang, et al.
Published: (2025) -
DF-LLaVA: Unlocking MLLMs for Synthetic Image Detection via Knowledge Injection and Conflict-Driven Self-Reflection
by: Shen, Zhuokang, et al.
Published: (2025)