Enregistré dans:
| Auteurs principaux: | Wang, Tsai-Ning, Chen, Lin-Lin, Zeghidour, Neil, Saeed, Aaqib |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2505.01199 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Language Models as Semantic Teachers: Post-Training Alignment for Medical Audio Understanding
par: Wang, Tsai-Ning, et autres
Publié: (2025)
par: Wang, Tsai-Ning, et autres
Publié: (2025)
Adaptive Test-Time Scaling for Zero-Shot Respiratory Audio Classification
par: Wang, Tsai-Ning, et autres
Publié: (2026)
par: Wang, Tsai-Ning, et autres
Publié: (2026)
StethoLM: Audio Language Model for Cardiopulmonary Analysis Across Clinical Tasks
par: Wang, Yishan, et autres
Publié: (2026)
par: Wang, Yishan, et autres
Publié: (2026)
Electrocardiogram-Language Model for Few-Shot Question Answering with Meta Learning
par: Tang, Jialu, et autres
Publié: (2024)
par: Tang, Jialu, et autres
Publié: (2024)
Electrocardiogram Report Generation and Question Answering via Retrieval-Augmented Self-Supervised Modeling
par: Tang, Jialu, et autres
Publié: (2024)
par: Tang, Jialu, et autres
Publié: (2024)
UniPACT: A Multimodal Framework for Prognostic Question Answering on Raw ECG and Structured EHR
par: Tang, Jialu, et autres
Publié: (2026)
par: Tang, Jialu, et autres
Publié: (2026)
RespLLM: Unifying Audio and Text with Multimodal LLMs for Generalized Respiratory Health Prediction
par: Zhang, Yuwei, et autres
Publié: (2024)
par: Zhang, Yuwei, et autres
Publié: (2024)
A Semantic-Sampling Framework for Evaluating Calibration in Open-Ended Question Answering
par: Wang, Zhanliang, et autres
Publié: (2026)
par: Wang, Zhanliang, et autres
Publié: (2026)
Unified Acoustic Representations for Screening Neurological and Respiratory Pathologies from Voice
par: Piao, Ran, et autres
Publié: (2025)
par: Piao, Ran, et autres
Publié: (2025)
AQA-Bench: An Interactive Benchmark for Evaluating LLMs' Sequential Reasoning Ability
par: Yang, Siwei, et autres
Publié: (2024)
par: Yang, Siwei, et autres
Publié: (2024)
PedSleepMAE: Generative Model for Multimodal Pediatric Sleep Signals
par: Pandey, Saurav R., et autres
Publié: (2024)
par: Pandey, Saurav R., et autres
Publié: (2024)
Aligning Spoken Dialogue Models from User Interactions
par: Wu, Anne, et autres
Publié: (2025)
par: Wu, Anne, et autres
Publié: (2025)
RA-QA: A Benchmarking System for Respiratory Audio Question Answering Under Real-World Heterogeneity
par: Bertolino, Gaia A., et autres
Publié: (2026)
par: Bertolino, Gaia A., et autres
Publié: (2026)
Scaling Open-Ended Reasoning to Predict the Future
par: Chandak, Nikhil, et autres
Publié: (2025)
par: Chandak, Nikhil, et autres
Publié: (2025)
MoReVQA: Exploring Modular Reasoning Models for Video Question Answering
par: Min, Juhong, et autres
Publié: (2024)
par: Min, Juhong, et autres
Publié: (2024)
Collaboratively Learning Federated Models from Noisy Decentralized Data
par: Li, Haoyuan, et autres
Publié: (2024)
par: Li, Haoyuan, et autres
Publié: (2024)
Boosting Masked ECG-Text Auto-Encoders as Discriminative Learners
par: Pham, Hung Manh, et autres
Publié: (2024)
par: Pham, Hung Manh, et autres
Publié: (2024)
AQA-TTRL: Self-Adaptation in Audio Question Answering with Test-Time Reinforcement Learning
par: Zhang, Haoyu, et autres
Publié: (2025)
par: Zhang, Haoyu, et autres
Publié: (2025)
Beyond Prompting: An Efficient Embedding Framework for Open-Domain Question Answering
par: Hu, Zhanghao, et autres
Publié: (2025)
par: Hu, Zhanghao, et autres
Publié: (2025)
Federated Learning with a Single Shared Image
par: Soni, Sunny, et autres
Publié: (2024)
par: Soni, Sunny, et autres
Publié: (2024)
Self-Rewarding Rubric-Based Reinforcement Learning for Open-Ended Reasoning
par: Ye, Zhiling, et autres
Publié: (2025)
par: Ye, Zhiling, et autres
Publié: (2025)
FAST: Federated Active Learning with Foundation Models for Communication-efficient Sampling and Training
par: Li, Haoyuan, et autres
Publié: (2025)
par: Li, Haoyuan, et autres
Publié: (2025)
MCU: An Evaluation Framework for Open-Ended Game Agents
par: Zheng, Xinyue, et autres
Publié: (2023)
par: Zheng, Xinyue, et autres
Publié: (2023)
Robust Agents in Open-Ended Worlds
par: Samvelyan, Mikayel
Publié: (2025)
par: Samvelyan, Mikayel
Publié: (2025)
OWLViz: An Open-World Benchmark for Visual Question Answering
par: Nguyen, Thuy, et autres
Publié: (2025)
par: Nguyen, Thuy, et autres
Publié: (2025)
COREVQA: A Crowd Observation and Reasoning Entailment Visual Question Answering Benchmark
par: Chintapatla, Ishant, et autres
Publié: (2025)
par: Chintapatla, Ishant, et autres
Publié: (2025)
Communication-Efficient Federated Learning through Adaptive Weight Clustering and Server-Side Distillation
par: Tsouvalas, Vasileios, et autres
Publié: (2024)
par: Tsouvalas, Vasileios, et autres
Publié: (2024)
AQA: a multilingual Anaphora annotation scheme for Question Answering
par: E. Boldrini
Publié: (2009)
par: E. Boldrini
Publié: (2009)
Towards Multilingual Audio-Visual Question Answering
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
par: Phukan, Orchid Chetia, et autres
Publié: (2024)
A Curriculum Learning Approach to Reinforcement Learning: Leveraging RAG for Multimodal Question Answering
par: Zhang, Chenliang, et autres
Publié: (2025)
par: Zhang, Chenliang, et autres
Publié: (2025)
Knowing When to Answer: Adaptive Confidence Refinement for Reliable Audio-Visual Question Answering
par: Tran, Dinh Phu, et autres
Publié: (2026)
par: Tran, Dinh Phu, et autres
Publié: (2026)
Audio Question Answering with GRPO-Based Fine-Tuning and Calibrated Segment-Level Predictions
par: Gibier, Marcel, et autres
Publié: (2025)
par: Gibier, Marcel, et autres
Publié: (2025)
Biomedical Entity Linking as Multiple Choice Question Answering
par: Lin, Zhenxi, et autres
Publié: (2024)
par: Lin, Zhenxi, et autres
Publié: (2024)
MediFact at MEDIQA-M3G 2024: Medical Question Answering in Dermatology with Multimodal Learning
par: Saeed, Nadia
Publié: (2024)
par: Saeed, Nadia
Publié: (2024)
LongAudio-RAG: Event-Grounded Question Answering over Multi-Hour Long Audio
par: Vakada, Naveen, et autres
Publié: (2026)
par: Vakada, Naveen, et autres
Publié: (2026)
Learning under Label Noise through Few-Shot Human-in-the-Loop Refinement
par: Saeed, Aaqib, et autres
Publié: (2024)
par: Saeed, Aaqib, et autres
Publié: (2024)
CausalEvolve: Towards Open-Ended Discovery with Causal Scratchpad
par: Chen, Yongqiang, et autres
Publié: (2026)
par: Chen, Yongqiang, et autres
Publié: (2026)
InfiBench: Evaluating the Question-Answering Capabilities of Code Large Language Models
par: Li, Linyi, et autres
Publié: (2024)
par: Li, Linyi, et autres
Publié: (2024)
Grad2Reward: From Sparse Judgment to Dense Rewards for Improving Open-Ended LLM Reasoning
par: Zhang, Zheng, et autres
Publié: (2026)
par: Zhang, Zheng, et autres
Publié: (2026)
AQAScore: Evaluating Semantic Alignment in Text-to-Audio Generation via Audio Question Answering
par: Kuan, Chun-Yi, et autres
Publié: (2026)
par: Kuan, Chun-Yi, et autres
Publié: (2026)
Documents similaires
-
Language Models as Semantic Teachers: Post-Training Alignment for Medical Audio Understanding
par: Wang, Tsai-Ning, et autres
Publié: (2025) -
Adaptive Test-Time Scaling for Zero-Shot Respiratory Audio Classification
par: Wang, Tsai-Ning, et autres
Publié: (2026) -
StethoLM: Audio Language Model for Cardiopulmonary Analysis Across Clinical Tasks
par: Wang, Yishan, et autres
Publié: (2026) -
Electrocardiogram-Language Model for Few-Shot Question Answering with Meta Learning
par: Tang, Jialu, et autres
Publié: (2024) -
Electrocardiogram Report Generation and Question Answering via Retrieval-Augmented Self-Supervised Modeling
par: Tang, Jialu, et autres
Publié: (2024)