Privacy-Aware Camera 2.0 Technical Report
Fuente:
arXiv
Guardado en:
| Autores principales: | Song, Huan, Tian, Shuyu, Long, Ting, Liu, Jiang, Yuan, Cheng, Jia, Zhenyu, Shao, Jiawei, Li, Xuelong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Ruyi2.5 Technical Report
por: Song, Huan, et al.
Publicado: (2026)
por: Song, Huan, et al.
Publicado: (2026)
Ruyi2 Technical Report
por: Song, Huan, et al.
Publicado: (2026)
por: Song, Huan, et al.
Publicado: (2026)
VARCO-VISION-2.0 Technical Report
por: Cha, Young-rok, et al.
Publicado: (2025)
por: Cha, Young-rok, et al.
Publicado: (2025)
Enhancing Neural Video Compression of Static Scenes with Positive-Incentive Noise
por: Yuan, Cheng, et al.
Publicado: (2026)
por: Yuan, Cheng, et al.
Publicado: (2026)
Theoretical Foundations of Scaling Law in Familial Models
por: Song, Huan, et al.
Publicado: (2025)
por: Song, Huan, et al.
Publicado: (2025)
PhysBrain 1.0 Technical Report
por: Lian, Shijie, et al.
Publicado: (2026)
por: Lian, Shijie, et al.
Publicado: (2026)
Mano Technical Report
por: Fu, Tianyu, et al.
Publicado: (2025)
por: Fu, Tianyu, et al.
Publicado: (2025)
KlingAvatar 2.0 Technical Report
por: Kling Team, et al.
Publicado: (2025)
por: Kling Team, et al.
Publicado: (2025)
Qwen2.5-VL Technical Report
por: Bai, Shuai, et al.
Publicado: (2025)
por: Bai, Shuai, et al.
Publicado: (2025)
Single-Pixel Vision-Language Model for Intrinsic Privacy-Preserving Behavioral Intelligence
por: An, Hongjun, et al.
Publicado: (2026)
por: An, Hongjun, et al.
Publicado: (2026)
Skywork-R1V3 Technical Report
por: Shen, Wei, et al.
Publicado: (2025)
por: Shen, Wei, et al.
Publicado: (2025)
Arctic-Extract Technical Report
por: Chiliński, Mateusz, et al.
Publicado: (2025)
por: Chiliński, Mateusz, et al.
Publicado: (2025)
Baichuan-Omni Technical Report
por: Li, Yadong, et al.
Publicado: (2024)
por: Li, Yadong, et al.
Publicado: (2024)
VLMQ: Token Saliency-Driven Post-Training Quantization for Vision-language Models
por: Xue, Yufei, et al.
Publicado: (2025)
por: Xue, Yufei, et al.
Publicado: (2025)
Falcon2-11B Technical Report
por: Malartic, Quentin, et al.
Publicado: (2024)
por: Malartic, Quentin, et al.
Publicado: (2024)
Qwen-Image-2.0 Technical Report
por: Zhao, Bing, et al.
Publicado: (2026)
por: Zhao, Bing, et al.
Publicado: (2026)
Debiasing Multimodal Large Language Models via Noise-Aware Preference Optimization
por: Zhang, Zefeng, et al.
Publicado: (2025)
por: Zhang, Zefeng, et al.
Publicado: (2025)
SliceWorld: A Predictive and Controllable World-State Model for CT Report Generation
por: Tian, Yuanhe, et al.
Publicado: (2026)
por: Tian, Yuanhe, et al.
Publicado: (2026)
Watch Out Your Album! On the Inadvertent Privacy Memorization in Multi-Modal Large Language Models
por: Ju, Tianjie, et al.
Publicado: (2025)
por: Ju, Tianjie, et al.
Publicado: (2025)
Docling Technical Report
por: Auer, Christoph, et al.
Publicado: (2024)
por: Auer, Christoph, et al.
Publicado: (2024)
UI-Venus-1.5 Technical Report
por: Venus Team, et al.
Publicado: (2026)
por: Venus Team, et al.
Publicado: (2026)
MiMo-Embodied: X-Embodied Foundation Model Technical Report
por: Hao, Xiaoshuai, et al.
Publicado: (2025)
por: Hao, Xiaoshuai, et al.
Publicado: (2025)
Recurrent Visual Feature Extraction and Stereo Attentions for CT Report Generation
por: Tian, Yuanhe, et al.
Publicado: (2025)
por: Tian, Yuanhe, et al.
Publicado: (2025)
A Systematic Review of Deep Learning-based Research on Radiology Report Generation
por: Liu, Chang, et al.
Publicado: (2023)
por: Liu, Chang, et al.
Publicado: (2023)
CameraBench: Benchmarking Visual Reasoning in MLLMs via Photography
por: Fang, I-Sheng, et al.
Publicado: (2025)
por: Fang, I-Sheng, et al.
Publicado: (2025)
MedGemma Technical Report
por: Sellergren, Andrew, et al.
Publicado: (2025)
por: Sellergren, Andrew, et al.
Publicado: (2025)
Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model
por: Ma, Guoqing, et al.
Publicado: (2025)
por: Ma, Guoqing, et al.
Publicado: (2025)
Phoenix-VL 1.5 Medium Technical Report
por: Phoenix, Team, et al.
Publicado: (2026)
por: Phoenix, Team, et al.
Publicado: (2026)
Qwen-Image-VAE-2.0 Technical Report
por: Zhang, Zekai, et al.
Publicado: (2026)
por: Zhang, Zekai, et al.
Publicado: (2026)
Dynamic Token Reweighting for Robust Vision-Language Models
por: Jiang, Tanqiu, et al.
Publicado: (2025)
por: Jiang, Tanqiu, et al.
Publicado: (2025)
Multimodal Structured Generation: CVPR's 2nd MMFM Challenge Technical Report
por: Cesista, Franz Louis
Publicado: (2024)
por: Cesista, Franz Louis
Publicado: (2024)
Step-Video-TI2V Technical Report: A State-of-the-Art Text-Driven Image-to-Video Generation Model
por: Huang, Haoyang, et al.
Publicado: (2025)
por: Huang, Haoyang, et al.
Publicado: (2025)
VLN-NF: Feasibility-Aware Vision-and-Language Navigation with False-Premise Instructions
por: Su, Hung-Ting, et al.
Publicado: (2026)
por: Su, Hung-Ting, et al.
Publicado: (2026)
Octopus v3: Technical Report for On-device Sub-billion Multimodal AI Agent
por: Chen, Wei, et al.
Publicado: (2024)
por: Chen, Wei, et al.
Publicado: (2024)
Qwen2.5-Omni Technical Report
por: Xu, Jin, et al.
Publicado: (2025)
por: Xu, Jin, et al.
Publicado: (2025)
ICON: Improving Inter-Report Consistency in Radiology Report Generation via Lesion-aware Mixup Augmentation
por: Hou, Wenjun, et al.
Publicado: (2024)
por: Hou, Wenjun, et al.
Publicado: (2024)
Little Data, Big Impact: Privacy-Aware Visual Language Models via Minimal Tuning
por: Samson, Laurens, et al.
Publicado: (2024)
por: Samson, Laurens, et al.
Publicado: (2024)
Pegasus-v1 Technical Report
por: Jung, Raehyuk, et al.
Publicado: (2024)
por: Jung, Raehyuk, et al.
Publicado: (2024)
Technical Report: Quantifying and Analyzing the Generalization Power of a DNN
por: He, Yuxuan, et al.
Publicado: (2025)
por: He, Yuxuan, et al.
Publicado: (2025)
Multimodal Reasoning for Science: Technical Report and 1st Place Solution to the ICML 2025 SeePhys Challenge
por: Liang, Hao, et al.
Publicado: (2025)
por: Liang, Hao, et al.
Publicado: (2025)
Ejemplares similares
-
Ruyi2.5 Technical Report
por: Song, Huan, et al.
Publicado: (2026) -
Ruyi2 Technical Report
por: Song, Huan, et al.
Publicado: (2026) -
VARCO-VISION-2.0 Technical Report
por: Cha, Young-rok, et al.
Publicado: (2025) -
Enhancing Neural Video Compression of Static Scenes with Positive-Incentive Noise
por: Yuan, Cheng, et al.
Publicado: (2026) -
Theoretical Foundations of Scaling Law in Familial Models
por: Song, Huan, et al.
Publicado: (2025)