Xray-Visual Models: Scaling Vision models on Industry Scale Data
Fuente:
arXiv
Guardado en:
| Autores principales: | Mishra, Shlok, Lin, Tsung-Yu, Wang, Linda, Xu, Hongli, Liu, Yimin, Hsu, Michael, Ahuja, Chaitanya, Yuan, Hao, Cheng, Jianpeng, Chen, Hong-You, Xu, Haoyuan, Li, Chao, Awasthi, Abhijeet, Moon, Jihye, Husa, Don, Ge, Michael, Singla, Sumedha, Chowdhury, Arkabandhu, Dingh, Phong, Shukla, Satya Narayan, Yang, Yonghuan, Jacobs, David, Guo, Qi, Xiao, Jun, Fan, Xiangjun, Singh, Aashu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Think Then Embed: Generative Context Improves Multimodal Embedding
por: Cui, Xuanming, et al.
Publicado: (2025)
por: Cui, Xuanming, et al.
Publicado: (2025)
Unifying Contrastive and Generative Objectives for Visual Understanding and Text-to-Image Generation
por: Li, Chao, et al.
Publicado: (2026)
por: Li, Chao, et al.
Publicado: (2026)
StreamMem: Query-Agnostic KV Cache Memory for Streaming Video Understanding
por: Yang, Yanlai, et al.
Publicado: (2025)
por: Yang, Yanlai, et al.
Publicado: (2025)
TTE-Flash: Accelerating Reasoning-based Multimodal Representations via Think-Then-Embed Tokens
por: Cheng, Jianpeng, et al.
Publicado: (2026)
por: Cheng, Jianpeng, et al.
Publicado: (2026)
Compositional Visual Planning via Inference-Time Diffusion Scaling
por: Zhang, Yixin, et al.
Publicado: (2026)
por: Zhang, Yixin, et al.
Publicado: (2026)
Socratic Students: Teaching Language Models to Learn by Asking Questions
por: Ambati, Rajeev Bhatt, et al.
Publicado: (2025)
por: Ambati, Rajeev Bhatt, et al.
Publicado: (2025)
A Simple and Effective Reinforcement Learning Method for Text-to-Image Diffusion Fine-tuning
por: Gupta, Shashank, et al.
Publicado: (2025)
por: Gupta, Shashank, et al.
Publicado: (2025)
Reason to Contrast: A Cascaded Multimodal Retrieval Framework
por: Cui, Xuanming, et al.
Publicado: (2025)
por: Cui, Xuanming, et al.
Publicado: (2025)
Sample, Scrutinize and Scale: Effective Inference-Time Search by Scaling Verification
por: Zhao, Eric, et al.
Publicado: (2025)
por: Zhao, Eric, et al.
Publicado: (2025)
Transfer between Modalities with MetaQueries
por: Pan, Xichen, et al.
Publicado: (2025)
por: Pan, Xichen, et al.
Publicado: (2025)
Xray2Xray: World Model from Chest X-rays with Volumetric Context
por: Yang, Zefan, et al.
Publicado: (2025)
por: Yang, Zefan, et al.
Publicado: (2025)
IceCube's Sensitivity Prospects to MeV-Scale Axion-Like Particles from Core-Collapse Supernovae
por: Valtonen-Mattila, Nora, et al.
Publicado: (2026)
por: Valtonen-Mattila, Nora, et al.
Publicado: (2026)
Lucknow: A Living Charm in the Modern Age: A Journey through the Lens of Cinema
por: Sumedha Dwivedi
Publicado: (2020)
por: Sumedha Dwivedi
Publicado: (2020)
Discriminating between native and phosphorylated tau proteins using fluid‐lipid bilayer‐coated nanopores
por: Saurabh Awasthi, et al.
Publicado: (2024)
por: Saurabh Awasthi, et al.
Publicado: (2024)
NoFunEval: Funny How Code LMs Falter on Requirements Beyond Functional Correctness
por: Singhal, Manav, et al.
Publicado: (2024)
por: Singhal, Manav, et al.
Publicado: (2024)
Robust Learning of Diverse Code Edits
por: Aggarwal, Tushar, et al.
Publicado: (2025)
por: Aggarwal, Tushar, et al.
Publicado: (2025)
Inverse transitions and disappearance of the λ-line in the asymmetric random field Ising and Blume-Capel models
por: Das, Santanu, et al.
Publicado: (2023)
por: Das, Santanu, et al.
Publicado: (2023)
Three state random energy model
por: Sumedha, et al.
Publicado: (2024)
por: Sumedha, et al.
Publicado: (2024)
A Robust Federated Learning Framework for Undependable Devices at Scale
por: Wang, Shilong, et al.
Publicado: (2024)
por: Wang, Shilong, et al.
Publicado: (2024)
Principled Synthetic Data Enables the First Scaling Laws for LLMs in Recommendation
por: Zhang, Benyu, et al.
Publicado: (2026)
por: Zhang, Benyu, et al.
Publicado: (2026)
BuildingsBench: A Large-Scale Dataset of 900K Buildings and Benchmark for Short-Term Load Forecasting
por: Emami, Patrick, et al.
Publicado: (2023)
por: Emami, Patrick, et al.
Publicado: (2023)
Expected Return Causes Outcome-Level Mode Collapse in Reinforcement Learning and How to Fix It with Inverse Probability Scaling
por: Sinha, Abhijeet, et al.
Publicado: (2026)
por: Sinha, Abhijeet, et al.
Publicado: (2026)
XrayClaw: Cooperative-Competitive Multi-Agent Alignment for Trustworthy Chest X-ray Diagnosis
por: Young, Shawn, et al.
Publicado: (2026)
por: Young, Shawn, et al.
Publicado: (2026)
An Attribute-Based Measure of Video Complexity
por: Sarkar, Aditya, et al.
Publicado: (2026)
por: Sarkar, Aditya, et al.
Publicado: (2026)
No-Human in the Loop: Agentic Evaluation at Scale for Recommendation
por: Zhang, Tao, et al.
Publicado: (2025)
por: Zhang, Tao, et al.
Publicado: (2025)
Scaling Laws Do Not Scale
por: Diaz, Fernando, et al.
Publicado: (2023)
por: Diaz, Fernando, et al.
Publicado: (2023)
Retrieval Mechanisms Surpass Long-Context Scaling in Time Series Forecasting
por: Ahuja, Rishi, et al.
Publicado: (2026)
por: Ahuja, Rishi, et al.
Publicado: (2026)
Distilled Pretraining: A modern lens of Data, In-Context Learning and Test-Time Scaling
por: Goyal, Sachin, et al.
Publicado: (2025)
por: Goyal, Sachin, et al.
Publicado: (2025)
Physical Principles of Size and Frequency Scaling of Active Cytoskeletal Spirals
por: Soni, Aman, et al.
Publicado: (2025)
por: Soni, Aman, et al.
Publicado: (2025)
Hofmeister Effect in Flexible Devices
por: Yonghuan Chen, et al.
Publicado: (2025)
por: Yonghuan Chen, et al.
Publicado: (2025)
Interface Engineering in Solid‐State Sodium Batteries: Advances in Materials Design, Interfacial Strategies, and Multiscale Characterization
por: Yonghuan Fu, et al.
Publicado: (2025)
por: Yonghuan Fu, et al.
Publicado: (2025)
Compress, Cross and Scale: Multi-Level Compression Cross Networks for Efficient Scaling in Recommender Systems
por: Yu, Heng, et al.
Publicado: (2026)
por: Yu, Heng, et al.
Publicado: (2026)
How to Measure Performance in Agile Software Development? A Mixed-Method Study
por: Pham, Kevin Phong, et al.
Publicado: (2024)
por: Pham, Kevin Phong, et al.
Publicado: (2024)
Learning to Localize Objects Improves Spatial Reasoning in Visual-LLMs
por: Ranasinghe, Kanchana, et al.
Publicado: (2024)
por: Ranasinghe, Kanchana, et al.
Publicado: (2024)
Scaling up machine learning-based chemical plant simulation: A method for fine-tuning a model to induce stable fixed points
por: Esders, Malte, et al.
Publicado: (2023)
por: Esders, Malte, et al.
Publicado: (2023)
MetricNet: Recovering Metric Scale in Generative Navigation Policies
por: Nayak, Abhijeet, et al.
Publicado: (2025)
por: Nayak, Abhijeet, et al.
Publicado: (2025)
ResLink: A Novel Deep Learning Architecture for Brain Tumor Classification with Area Attention and Residual Connections
por: Arya, Sumedha, et al.
Publicado: (2025)
por: Arya, Sumedha, et al.
Publicado: (2025)
Cross‐Sectional Links between Baseline Serum Cortisol Levels and Cognitive Performance, Sleep, and Brain MRI Findings in a Rural Aging South‐Indian Cohort
por: Sumedha Mitra, et al.
Publicado: (2025)
por: Sumedha Mitra, et al.
Publicado: (2025)
The impact of infrastructure provisioning on inequality: evidence from India
por: Sumedha Bajar, et al.
Publicado: (2015)
por: Sumedha Bajar, et al.
Publicado: (2015)
Experimental Investigation to Assess the Efficiency of Subsurface Barrier in Heterogeneous Aquifer With a Sloping Ocean‐Aquifer Boundary
por: Vikas Sharma, et al.
Publicado: (2024)
por: Vikas Sharma, et al.
Publicado: (2024)
Ejemplares similares
-
Think Then Embed: Generative Context Improves Multimodal Embedding
por: Cui, Xuanming, et al.
Publicado: (2025) -
Unifying Contrastive and Generative Objectives for Visual Understanding and Text-to-Image Generation
por: Li, Chao, et al.
Publicado: (2026) -
StreamMem: Query-Agnostic KV Cache Memory for Streaming Video Understanding
por: Yang, Yanlai, et al.
Publicado: (2025) -
TTE-Flash: Accelerating Reasoning-based Multimodal Representations via Think-Then-Embed Tokens
por: Cheng, Jianpeng, et al.
Publicado: (2026) -
Compositional Visual Planning via Inference-Time Diffusion Scaling
por: Zhang, Yixin, et al.
Publicado: (2026)