Enregistré dans:
| Auteurs principaux: | Shen, Zhuokang, Wang, Yifan, Chen, Hanyu, Shen, Yunhang, Huang, Wenxuan, He, Gaoqi, Xie, Jiao, Ji, Rongrong, Lin, Shaohui |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2603.01059 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A General and Efficient Training for Transformer via Token Expansion
par: Huang, Wenxuan, et autres
Publié: (2024)
par: Huang, Wenxuan, et autres
Publié: (2024)
MASA: Rethinking the Representational Bottleneck in LoRA with Multi-A Shared Adaptation
par: Dong, Qin, et autres
Publié: (2025)
par: Dong, Qin, et autres
Publié: (2025)
HUWSOD: Holistic Self-training for Unified Weakly Supervised Object Detection
par: Cao, Liujuan, et autres
Publié: (2024)
par: Cao, Liujuan, et autres
Publié: (2024)
What You Perceive Is What You Conceive: A Cognition-Inspired Framework for Open Vocabulary Image Segmentation
par: Lin, Jianghang, et autres
Publié: (2025)
par: Lin, Jianghang, et autres
Publié: (2025)
DF-LLaVA: Unlocking MLLMs for Synthetic Image Detection via Knowledge Injection and Conflict-Driven Self-Reflection
par: Shen, Zhuokang, et autres
Publié: (2025)
par: Shen, Zhuokang, et autres
Publié: (2025)
Rethinking Centered Kernel Alignment in Knowledge Distillation
par: Zhou, Zikai, et autres
Publié: (2024)
par: Zhou, Zikai, et autres
Publié: (2024)
Dynamic Contrastive Knowledge Distillation for Efficient Image Restoration
par: Zhou, Yunshuai, et autres
Publié: (2024)
par: Zhou, Yunshuai, et autres
Publié: (2024)
Multi-User Chat Assistant (MUCA): a Framework Using LLMs to Facilitate Group Conversations
par: Mao, Manqing, et autres
Publié: (2024)
par: Mao, Manqing, et autres
Publié: (2024)
Dynamic-LLaVA: Efficient Multimodal Large Language Models via Dynamic Vision-language Context Sparsification
par: Huang, Wenxuan, et autres
Publié: (2024)
par: Huang, Wenxuan, et autres
Publié: (2024)
Class-Imbalanced Semi-Supervised Learning for Large-Scale Point Cloud Semantic Segmentation via Decoupling Optimization
par: Li, Mengtian, et autres
Publié: (2024)
par: Li, Mengtian, et autres
Publié: (2024)
Pseudo-Label Quality Decoupling and Correction for Semi-Supervised Instance Segmentation
par: Lin, Jianghang, et autres
Publié: (2025)
par: Lin, Jianghang, et autres
Publié: (2025)
GPT-4 Is Too Smart To Be Safe: Stealthy Chat with LLMs via Cipher
par: Yuan, Youliang, et autres
Publié: (2023)
par: Yuan, Youliang, et autres
Publié: (2023)
LLaVA-RadZ: Can Multimodal Large Language Models Effectively Tackle Zero-shot Radiology Recognition?
par: Li, Bangyan, et autres
Publié: (2025)
par: Li, Bangyan, et autres
Publié: (2025)
AI-Generated Content Enhanced Computer-Aided Diagnosis Model for Thyroid Nodules: A ChatGPT-Style Assistant
par: Yao, Jincao, et autres
Publié: (2024)
par: Yao, Jincao, et autres
Publié: (2024)
Long-VITA: Scaling Large Multi-modal Models to 1 Million Tokens with Leading Short-Context Accuracy
par: Shen, Yunhang, et autres
Publié: (2025)
par: Shen, Yunhang, et autres
Publié: (2025)
ChatGPT for Computational Topology
par: Liu, Jian, et autres
Publié: (2023)
par: Liu, Jian, et autres
Publié: (2023)
Exploring Culturally Informed AI Assistants: A Comparative Study of ChatBlackGPT and ChatGPT
par: Egede, Lisa, et autres
Publié: (2025)
par: Egede, Lisa, et autres
Publié: (2025)
Probability-density-aware Semi-supervised Learning
par: Liu, Shuyang, et autres
Publié: (2024)
par: Liu, Shuyang, et autres
Publié: (2024)
Acceptability of AI Assistants for Privacy: Perceptions of Experts and Users on Personalized Privacy Assistants
par: Xu, Meihe, et autres
Publié: (2025)
par: Xu, Meihe, et autres
Publié: (2025)
FlexiReID: Adaptive Mixture of Expert for Multi-Modal Person Re-Identification
par: Sun, Zhen, et autres
Publié: (2025)
par: Sun, Zhen, et autres
Publié: (2025)
VEGA: Learning Interleaved Image-Text Comprehension in Vision-Language Large Models
par: Zhou, Chenyu, et autres
Publié: (2024)
par: Zhou, Chenyu, et autres
Publié: (2024)
FlashSloth: Lightning Multimodal Large Language Models via Embedded Visual Compression
par: Tong, Bo, et autres
Publié: (2024)
par: Tong, Bo, et autres
Publié: (2024)
Few-Shot Image Quality Assessment via Adaptation of Vision-Language Models
par: Li, Xudong, et autres
Publié: (2024)
par: Li, Xudong, et autres
Publié: (2024)
Omni-Referring Image Segmentation
par: Zheng, Qiancheng, et autres
Publié: (2025)
par: Zheng, Qiancheng, et autres
Publié: (2025)
Towards Efficient Large Language Reasoning Models via Extreme-Ratio Chain-of-Thought Compression
par: Tang, Yuntian, et autres
Publié: (2026)
par: Tang, Yuntian, et autres
Publié: (2026)
DeOcc-1-to-3: 3D De-Occlusion from a Single Image via Self-Supervised Multi-View Diffusion
par: Qu, Yansong, et autres
Publié: (2025)
par: Qu, Yansong, et autres
Publié: (2025)
ChatIE: Zero-Shot Information Extraction via Chatting with ChatGPT
par: Wei, Xiang, et autres
Publié: (2023)
par: Wei, Xiang, et autres
Publié: (2023)
KDPM: Knowledge‐driven dynamic perception model for evacuation scene simulation
par: Kecheng Tang, et autres
Publié: (2024)
par: Kecheng Tang, et autres
Publié: (2024)
Fig. 4 in Three new species of Mecoptera (Insecta, Antliophora) from Yunnan, China
par: Xie, Jiao, et autres
Publié: (2025)
par: Xie, Jiao, et autres
Publié: (2025)
Jill Watson: A Virtual Teaching Assistant powered by ChatGPT
par: Taneja, Karan, et autres
Publié: (2024)
par: Taneja, Karan, et autres
Publié: (2024)
From Objects to Events: Unlocking Complex Visual Understanding in Object Detectors via LLM-guided Symbolic Reasoning
par: Zeng, Yuhui, et autres
Publié: (2025)
par: Zeng, Yuhui, et autres
Publié: (2025)
Beyond Benchmarks: How Users Evaluate AI Chat Assistants
par: Awan, Moiz Sadiq, et autres
Publié: (2026)
par: Awan, Moiz Sadiq, et autres
Publié: (2026)
VITA-Audio: Fast Interleaved Cross-Modal Token Generation for Efficient Large Speech-Language Model
par: Long, Zuwei, et autres
Publié: (2025)
par: Long, Zuwei, et autres
Publié: (2025)
VITA-1.5: Towards GPT-4o Level Real-Time Vision and Speech Interaction
par: Fu, Chaoyou, et autres
Publié: (2025)
par: Fu, Chaoyou, et autres
Publié: (2025)
"I Use ChatGPT to Humanize My Words": Affordances and Risks of ChatGPT to Autistic Users
par: Ma, Renkai, et autres
Publié: (2026)
par: Ma, Renkai, et autres
Publié: (2026)
Dynamic User-controllable Privacy-preserving Few-shot Sensing Framework
par: Chathoth, Ajesh Koyatan, et autres
Publié: (2025)
par: Chathoth, Ajesh Koyatan, et autres
Publié: (2025)
Security Analysis of ChatGPT: Threats and Privacy Risks
par: Xiang, Yushan, et autres
Publié: (2025)
par: Xiang, Yushan, et autres
Publié: (2025)
Gradable ChatGPT Translation Evaluation
par: Jiao, Hui, et autres
Publié: (2024)
par: Jiao, Hui, et autres
Publié: (2024)
Exploring ChatGPT's Capabilities on Vulnerability Management
par: Liu, Peiyu, et autres
Publié: (2023)
par: Liu, Peiyu, et autres
Publié: (2023)
Harnessing Large Language Models for Seed Generation in Greybox Fuzzing
par: Shi, Wenxuan, et autres
Publié: (2024)
par: Shi, Wenxuan, et autres
Publié: (2024)
Documents similaires
-
A General and Efficient Training for Transformer via Token Expansion
par: Huang, Wenxuan, et autres
Publié: (2024) -
MASA: Rethinking the Representational Bottleneck in LoRA with Multi-A Shared Adaptation
par: Dong, Qin, et autres
Publié: (2025) -
HUWSOD: Holistic Self-training for Unified Weakly Supervised Object Detection
par: Cao, Liujuan, et autres
Publié: (2024) -
What You Perceive Is What You Conceive: A Cognition-Inspired Framework for Open Vocabulary Image Segmentation
par: Lin, Jianghang, et autres
Publié: (2025) -
DF-LLaVA: Unlocking MLLMs for Synthetic Image Detection via Knowledge Injection and Conflict-Driven Self-Reflection
par: Shen, Zhuokang, et autres
Publié: (2025)