CHASM: Cross-frequency Harmonized Axis-Separable Mixing for Spectral Token Operators
Fuente:
arXiv
Guardado en:
| Autores principales: | Fang, Pengcheng, Chen, Hongli, Chen, Yuxia, Sun, Tengjiao, Liu, Jiaxin, Cai, Xiaohao |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MOGO: Residual Quantized Hierarchical Causal Transformer for High-Quality and Real-Time 3D Human Motion Generation
por: Fu, Dongjie, et al.
Publicado: (2025)
por: Fu, Dongjie, et al.
Publicado: (2025)
HiFi-Mamba: Dual-Stream W-Laplacian Enhanced Mamba for High-Fidelity MRI Reconstruction
por: Chen, Hongli, et al.
Publicado: (2025)
por: Chen, Hongli, et al.
Publicado: (2025)
AnchorRoute: Human Motion Synthesis with Interval-Routed Sparse Contro
por: Fang, Pengcheng, et al.
Publicado: (2026)
por: Fang, Pengcheng, et al.
Publicado: (2026)
HiFi-MambaV2: Hierarchical Shared-Routed MoE for High-Fidelity MRI Reconstruction
por: Fang, Pengcheng, et al.
Publicado: (2025)
por: Fang, Pengcheng, et al.
Publicado: (2025)
When and What: Diffusion-Grounded VideoLLM with Entity Aware Segmentation for Long Video Understanding
por: Fang, Pengcheng, et al.
Publicado: (2025)
por: Fang, Pengcheng, et al.
Publicado: (2025)
CHASM: Unveiling Covert Advertisements on Chinese Social Media
por: Zheng, Jingyi, et al.
Publicado: (2026)
por: Zheng, Jingyi, et al.
Publicado: (2026)
UMo: Unified Sparse Motion Modeling for Real-Time Co-Speech Avatars
por: Zhan, Xiaoyu, et al.
Publicado: (2026)
por: Zhan, Xiaoyu, et al.
Publicado: (2026)
Hi-ResNet: Edge Detail Enhancement for High-Resolution Remote Sensing Segmentation
por: Chen, Yuxia, et al.
Publicado: (2023)
por: Chen, Yuxia, et al.
Publicado: (2023)
The CHASM-SWPC Dataset for Coronal Hole Detection & Analysis
por: Beck, Cutter, et al.
Publicado: (2025)
por: Beck, Cutter, et al.
Publicado: (2025)
Revisiting Cross-Domain Problem for LiDAR-based 3D Object Detection
por: Zhang, Ruixiao, et al.
Publicado: (2024)
por: Zhang, Ruixiao, et al.
Publicado: (2024)
GRASPTrack: Geometry-Reasoned Association via Segmentation and Projection for Multi-Object Tracking
por: Han, Xudong, et al.
Publicado: (2025)
por: Han, Xudong, et al.
Publicado: (2025)
Image Tokenizer Needs Post-Training
por: Qiu, Kai, et al.
Publicado: (2025)
por: Qiu, Kai, et al.
Publicado: (2025)
Detect Closer Surfaces that can be Seen: New Modeling and Evaluation in Cross-domain 3D Object Detection
por: Zhang, Ruixiao, et al.
Publicado: (2024)
por: Zhang, Ruixiao, et al.
Publicado: (2024)
IDPruner: Harmonizing Importance and Diversity in Visual Token Pruning for MLLMs
por: Tan, Yifan, et al.
Publicado: (2026)
por: Tan, Yifan, et al.
Publicado: (2026)
Exploring Unbiased Deepfake Detection via Token-Level Shuffling and Mixing
por: Fu, Xinghe, et al.
Publicado: (2025)
por: Fu, Xinghe, et al.
Publicado: (2025)
FSCA-Net: Feature-Separated Cross-Attention Network for Robust Multi-Dataset Training
por: Chen, Yuehai
Publicado: (2026)
por: Chen, Yuehai
Publicado: (2026)
G$^2$TR: Generation-Guided Visual Token Reduction for Separate-Encoder Unified Multimodal Models
por: Li, Junxian, et al.
Publicado: (2026)
por: Li, Junxian, et al.
Publicado: (2026)
UniToken: Harmonizing Multimodal Understanding and Generation through Unified Visual Encoding
por: Jiao, Yang, et al.
Publicado: (2025)
por: Jiao, Yang, et al.
Publicado: (2025)
Language-Guided Token Compression with Reinforcement Learning in Large Vision-Language Models
por: Cao, Sihan, et al.
Publicado: (2026)
por: Cao, Sihan, et al.
Publicado: (2026)
VIGOR: VIdeo Geometry-Oriented Reward for Temporal Generative Alignment
por: Yin, Tengjiao, et al.
Publicado: (2026)
por: Yin, Tengjiao, et al.
Publicado: (2026)
iVPT: Improving Task-relevant Information Sharing in Visual Prompt Tuning by Cross-layer Dynamic Connection
por: Zhou, Nan, et al.
Publicado: (2024)
por: Zhou, Nan, et al.
Publicado: (2024)
HYDRA: Unifying Multi-modal Generation and Understanding via Representation-Harmonized Tokenization
por: Qiu, Xuerui, et al.
Publicado: (2026)
por: Qiu, Xuerui, et al.
Publicado: (2026)
Graph-guided Cross-composition Feature Disentanglement for Compositional Zero-shot Learning
por: Geng, Yuxia, et al.
Publicado: (2024)
por: Geng, Yuxia, et al.
Publicado: (2024)
The Diffusion Duet: Harmonizing Dual Channels with Wavelet Suppression for Image Separation
por: Li, Jingwei, et al.
Publicado: (2026)
por: Li, Jingwei, et al.
Publicado: (2026)
SEIS: Subspace-based Equivariance and Invariance Scores for Neural Representations
por: Lin, Huahua, et al.
Publicado: (2026)
por: Lin, Huahua, et al.
Publicado: (2026)
Discrepancy-based Diffusion Models for Lesion Detection in Brain MRI
por: Fan, Keqiang, et al.
Publicado: (2024)
por: Fan, Keqiang, et al.
Publicado: (2024)
Non-negative Subspace Feature Representation for Few-shot Learning in Medical Imaging
por: Fan, Keqiang, et al.
Publicado: (2024)
por: Fan, Keqiang, et al.
Publicado: (2024)
MixReorg: Cross-Modal Mixed Patch Reorganization is a Good Mask Learner for Open-World Semantic Segmentation
por: Cai, Kaixin, et al.
Publicado: (2023)
por: Cai, Kaixin, et al.
Publicado: (2023)
Spectral Image Tokenizer
por: Esteves, Carlos, et al.
Publicado: (2024)
por: Esteves, Carlos, et al.
Publicado: (2024)
Rotation-Invariant Completion Network
por: Chen, Yu, et al.
Publicado: (2023)
por: Chen, Yu, et al.
Publicado: (2023)
Delving into Spectral Clustering with Vision-Language Representations
por: Peng, Bo, et al.
Publicado: (2026)
por: Peng, Bo, et al.
Publicado: (2026)
Halo Separation-guided Underwater Multi-scale Image Restoration
por: Yang, Jiaxin, et al.
Publicado: (2026)
por: Yang, Jiaxin, et al.
Publicado: (2026)
Spectral Normalization and Dual Contrastive Regularization for Image-to-Image Translation
por: Zhao, Chen, et al.
Publicado: (2023)
por: Zhao, Chen, et al.
Publicado: (2023)
Joint Architecture-Token-Bitwidth Multi-Axis Optimization of Vision Transformers for Semiconductor IC Packaging
por: Nguyen, Phat, et al.
Publicado: (2026)
por: Nguyen, Phat, et al.
Publicado: (2026)
MaxQ: Multi-Axis Query for N:M Sparsity Network
por: Xiang, Jingyang, et al.
Publicado: (2023)
por: Xiang, Jingyang, et al.
Publicado: (2023)
MAC-Lookup: Multi-Axis Conditional Lookup Model for Underwater Image Enhancement
por: Yi, Fanghai, et al.
Publicado: (2025)
por: Yi, Fanghai, et al.
Publicado: (2025)
Large Motion Video Autoencoding with Cross-modal Video VAE
por: Xing, Yazhou, et al.
Publicado: (2024)
por: Xing, Yazhou, et al.
Publicado: (2024)
VMDiff: Visual Mixing Diffusion for Limitless Cross-Object Synthesis
por: Xiong, Zeren, et al.
Publicado: (2025)
por: Xiong, Zeren, et al.
Publicado: (2025)
IVGF: The Fusion-Guided Infrared and Visible General Framework
por: Liu, Fangcen, et al.
Publicado: (2024)
por: Liu, Fangcen, et al.
Publicado: (2024)
Dual-Pathway Circuits of Object Hallucination in Vision-Language Models
por: Liu, Jiaxin, et al.
Publicado: (2026)
por: Liu, Jiaxin, et al.
Publicado: (2026)
Ejemplares similares
-
MOGO: Residual Quantized Hierarchical Causal Transformer for High-Quality and Real-Time 3D Human Motion Generation
por: Fu, Dongjie, et al.
Publicado: (2025) -
HiFi-Mamba: Dual-Stream W-Laplacian Enhanced Mamba for High-Fidelity MRI Reconstruction
por: Chen, Hongli, et al.
Publicado: (2025) -
AnchorRoute: Human Motion Synthesis with Interval-Routed Sparse Contro
por: Fang, Pengcheng, et al.
Publicado: (2026) -
HiFi-MambaV2: Hierarchical Shared-Routed MoE for High-Fidelity MRI Reconstruction
por: Fang, Pengcheng, et al.
Publicado: (2025) -
When and What: Diffusion-Grounded VideoLLM with Entity Aware Segmentation for Long Video Understanding
por: Fang, Pengcheng, et al.
Publicado: (2025)