Tokensome: Towards a Genetic Vision-Language GPT for Explainable and Cognitive Karyotyping
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Haoxi, Zhang, Xinxu, Lin, Yuanxin, Wang, Maiqi, Lai, Yi, Wang, Yu, Yu, Linfeng, Xu, Yufeng, Cheng, Ran, Szczerbicki, Edward |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Realistic Scene Generation with LiDAR Diffusion Models
par: Ran, Haoxi, et autres
Publié: (2024)
par: Ran, Haoxi, et autres
Publié: (2024)
X-Driver: Explainable Autonomous Driving with Vision-Language Models
par: Liu, Wei, et autres
Publié: (2025)
par: Liu, Wei, et autres
Publié: (2025)
Invisible Languages of the LLM Universe
par: Khanna, Saurabh, et autres
Publié: (2025)
par: Khanna, Saurabh, et autres
Publié: (2025)
Towards Transparent AI: A Survey on Explainable Large Language Models
par: Palikhe, Avash, et autres
Publié: (2025)
par: Palikhe, Avash, et autres
Publié: (2025)
Instant4D: 4D Gaussian Splatting in Minutes
par: Luo, Zhanpeng, et autres
Publié: (2025)
par: Luo, Zhanpeng, et autres
Publié: (2025)
Diffusion-Guided Pretraining for Brain Graph Foundation Models
par: Wei, Xinxu, et autres
Publié: (2026)
par: Wei, Xinxu, et autres
Publié: (2026)
Rec-GPT4V: Multimodal Recommendation with Large Vision-Language Models
par: Liu, Yuqing, et autres
Publié: (2024)
par: Liu, Yuqing, et autres
Publié: (2024)
Explainable Few-shot Knowledge Tracing
par: Li, Haoxuan, et autres
Publié: (2024)
par: Li, Haoxuan, et autres
Publié: (2024)
Resurgence number of matroid configuration
par: Hu, Haoxi
Publié: (2025)
par: Hu, Haoxi
Publié: (2025)
RegionGPT: Towards Region Understanding Vision Language Model
par: Guo, Qiushan, et autres
Publié: (2024)
par: Guo, Qiushan, et autres
Publié: (2024)
AgriGPT-VL: Agricultural Vision-Language Understanding Suite
par: Yang, Bo, et autres
Publié: (2025)
par: Yang, Bo, et autres
Publié: (2025)
Is Meta-Path Attention an Explanation? Evidence of Alignment and Decoupling in Heterogeneous GNNs
par: Jiang, Maiqi, et autres
Publié: (2026)
par: Jiang, Maiqi, et autres
Publié: (2026)
Think How to Think: Mitigating Overthinking with Autonomous Difficulty Cognition in Large Reasoning Models
par: Liu, Yongjiang, et autres
Publié: (2025)
par: Liu, Yongjiang, et autres
Publié: (2025)
Organic Gradient Homojunction via D‐A Engineering Enables Photoelectric/Photothermal Dual‐Assisted Catalysis Toward Full Spectrum Light‐Coupled Low‐Temperature Seawater Batteries
par: Yi Lin, et autres
Publié: (2025)
par: Yi Lin, et autres
Publié: (2025)
SurgXBench: Explainable Vision-Language Model Benchmark for Surgery
par: Cheng, Jiajun, et autres
Publié: (2025)
par: Cheng, Jiajun, et autres
Publié: (2025)
Evaluating Chromosomal Mosaicism in Prenatal Diagnosis: The Complementary Roles of Chromosomal Microarray Analysis and Karyotyping
par: Chenxia Xu, et autres
Publié: (2025)
par: Chenxia Xu, et autres
Publié: (2025)
OmniSpatial: Towards Comprehensive Spatial Reasoning Benchmark for Vision Language Models
par: Jia, Mengdi, et autres
Publié: (2025)
par: Jia, Mengdi, et autres
Publié: (2025)
Almost sure convergence of differentially positive systems on a globally orderable manifold
par: Niu, Lin, et autres
Publié: (2024)
par: Niu, Lin, et autres
Publié: (2024)
FlightGPT: Towards Generalizable and Interpretable UAV Vision-and-Language Navigation with Vision-Language Models
par: Cai, Hengxing, et autres
Publié: (2025)
par: Cai, Hengxing, et autres
Publié: (2025)
Simulation and Deformation Analysis of Construction Process of Large Eccentric Frame‐Core Tube Structure
par: Guanghua Yin, et autres
Publié: (2024)
par: Guanghua Yin, et autres
Publié: (2024)
A Brain Graph Foundation Model: Pre-Training and Prompt-Tuning across Broad Atlases and Disorders
par: Wei, Xinxu, et autres
Publié: (2025)
par: Wei, Xinxu, et autres
Publié: (2025)
VITA-1.5: Towards GPT-4o Level Real-Time Vision and Speech Interaction
par: Fu, Chaoyou, et autres
Publié: (2025)
par: Fu, Chaoyou, et autres
Publié: (2025)
Dynamic Retriever for In-Context Knowledge Editing via Policy Optimization
par: Nafee, Mahmud Wasif, et autres
Publié: (2025)
par: Nafee, Mahmud Wasif, et autres
Publié: (2025)
Toward Ultra-Long-Horizon Agentic Science: Cognitive Accumulation for Machine Learning Engineering
par: Zhu, Xinyu, et autres
Publié: (2026)
par: Zhu, Xinyu, et autres
Publié: (2026)
Seeing Sarcasm Through Different Eyes: Analyzing Multimodal Sarcasm Perception in Large Vision-Language Models
par: Chen, Junjie, et autres
Publié: (2025)
par: Chen, Junjie, et autres
Publié: (2025)
HarmoCLIP: Harmonizing Global and Regional Representations in Contrastive Vision-Language Models
par: Zeng, Haoxi, et autres
Publié: (2025)
par: Zeng, Haoxi, et autres
Publié: (2025)
Botulinum Toxin Type A as a Therapeutic Agent in Epilepsy: Attenuation of Neuronal Ferroptosis and Cognitive Dysfunction
par: Shuang Li, et autres
Publié: (2025)
par: Shuang Li, et autres
Publié: (2025)
Dissecting Role Cognition in Medical LLMs via Neuronal Ablation
par: Liang, Xun, et autres
Publié: (2025)
par: Liang, Xun, et autres
Publié: (2025)
GPT4AIGChip: Towards Next-Generation AI Accelerator Design Automation via Large Language Models
par: Fu, Yonggan, et autres
Publié: (2023)
par: Fu, Yonggan, et autres
Publié: (2023)
HuatuoGPT-Vision, Towards Injecting Medical Visual Knowledge into Multimodal LLMs at Scale
par: Chen, Junying, et autres
Publié: (2024)
par: Chen, Junying, et autres
Publié: (2024)
Multi-Stage Vision Token Dropping: Towards Efficient Multimodal Large Language Model
par: Liu, Ting, et autres
Publié: (2024)
par: Liu, Ting, et autres
Publié: (2024)
GPO-V: Jailbreak Diffusion Vision Language Model by Global Probability Optimization
par: Pan, Yu, et autres
Publié: (2026)
par: Pan, Yu, et autres
Publié: (2026)
MC-GPT: Empowering Vision-and-Language Navigation with Memory Map and Reasoning Chains
par: Zhan, Zhaohuan, et autres
Publié: (2024)
par: Zhan, Zhaohuan, et autres
Publié: (2024)
RoboRefer: Towards Spatial Referring with Reasoning in Vision-Language Models for Robotics
par: Zhou, Enshen, et autres
Publié: (2025)
par: Zhou, Enshen, et autres
Publié: (2025)
GestureGPT: Toward Zero-Shot Free-Form Hand Gesture Understanding with Large Language Model Agents
par: Zeng, Xin, et autres
Publié: (2023)
par: Zeng, Xin, et autres
Publié: (2023)
ProtChatGPT: Towards Understanding Proteins with Large Language Models
par: Wang, Chao, et autres
Publié: (2024)
par: Wang, Chao, et autres
Publié: (2024)
Towards Compatible Fine-tuning for Vision-Language Model Updates
par: Wang, Zhengbo, et autres
Publié: (2024)
par: Wang, Zhengbo, et autres
Publié: (2024)
Comment on “Diagnostic Performance of ChatGPT ‐4o and DeepSeek ‐3 Differential Diagnosis of Complex Oral Lesions: A Multimodal Imaging and Case Difficulty Analysis”
par: Yuxuan Zhang, et autres
Publié: (2025)
par: Yuxuan Zhang, et autres
Publié: (2025)
Identity-Aware Vision-Language Model for Explainable Face Forgery Detection
par: Xu, Junhao, et autres
Publié: (2025)
par: Xu, Junhao, et autres
Publié: (2025)
Towards Distribution Matching between Collaborative and Language Spaces for Generative Recommendation
par: Zhang, Yi, et autres
Publié: (2025)
par: Zhang, Yi, et autres
Publié: (2025)
Documents similaires
-
Towards Realistic Scene Generation with LiDAR Diffusion Models
par: Ran, Haoxi, et autres
Publié: (2024) -
X-Driver: Explainable Autonomous Driving with Vision-Language Models
par: Liu, Wei, et autres
Publié: (2025) -
Invisible Languages of the LLM Universe
par: Khanna, Saurabh, et autres
Publié: (2025) -
Towards Transparent AI: A Survey on Explainable Large Language Models
par: Palikhe, Avash, et autres
Publié: (2025) -
Instant4D: 4D Gaussian Splatting in Minutes
par: Luo, Zhanpeng, et autres
Publié: (2025)