Dual-Agent Co-Training for Health Coaching via Implicit Adversarial Preference Optimization
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Long, Da, Fu, Lingyi, Rao, Diya Michelle, Carrera, Jasmine Ruales, Bai, Yang, Zhe, Shandian |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
StFT: Spatio-temporal Fourier Transformer for Long-term Dynamics Prediction
par: Long, Da, et autres
Publié: (2025)
par: Long, Da, et autres
Publié: (2025)
Arbitrarily-Conditioned Multi-Functional Diffusion for Multi-Physics Emulation
par: Long, Da, et autres
Publié: (2024)
par: Long, Da, et autres
Publié: (2024)
Invertible Fourier Neural Operators for Tackling Both Forward and Inverse Problems
par: Long, Da, et autres
Publié: (2024)
par: Long, Da, et autres
Publié: (2024)
Multi-Operator Few-Shot Learning for Generalization Across PDE Families
par: Li, Yile, et autres
Publié: (2025)
par: Li, Yile, et autres
Publié: (2025)
Graph-Based Operator Learning from Limited Data on Irregular Domains
par: Li, Yile, et autres
Publié: (2025)
par: Li, Yile, et autres
Publié: (2025)
Toward Efficient Kernel-Based Solvers for Nonlinear PDEs
par: Xu, Zhitong, et autres
Publié: (2024)
par: Xu, Zhitong, et autres
Publié: (2024)
Deep Gaussian Processes for Functional Maps
par: Lowery, Matthew, et autres
Publié: (2025)
par: Lowery, Matthew, et autres
Publié: (2025)
PresentCoach: Dual-Agent Presentation Coaching through Exemplars and Interactive Feedback
par: Chen, Sirui, et autres
Publié: (2025)
par: Chen, Sirui, et autres
Publié: (2025)
Solving High Frequency and Multi-Scale PDEs with Gaussian Processes
par: Fang, Shikai, et autres
Publié: (2023)
par: Fang, Shikai, et autres
Publié: (2023)
Detecting Clinical Discrepancies in Health Coaching Agents: A Dual-Stream Memory and Reconciliation Architecture
par: Pugh, Samuel L, et autres
Publié: (2026)
par: Pugh, Samuel L, et autres
Publié: (2026)
Adversarial Training against Location-Optimized Adversarial Patches
par: Rao, Sukrut, et autres
Publié: (2020)
par: Rao, Sukrut, et autres
Publié: (2020)
Standard Gaussian Process is All You Need for High-Dimensional Bayesian Optimization
par: Xu, Zhitong, et autres
Publié: (2024)
par: Xu, Zhitong, et autres
Publié: (2024)
Pseudo-Physics-Informed Neural Operators: Enhancing Operator Learning from Limited Data
par: Chen, Keyan, et autres
Publié: (2025)
par: Chen, Keyan, et autres
Publié: (2025)
Radiology Report Generation via Multi-objective Preference Optimization
par: Xiao, Ting, et autres
Publié: (2024)
par: Xiao, Ting, et autres
Publié: (2024)
Equation Discovery with Bayesian Spike-and-Slab Priors and Efficient Kernels
par: Long, Da, et autres
Publié: (2023)
par: Long, Da, et autres
Publié: (2023)
DEPO: Dual-Efficiency Preference Optimization for LLM Agents
par: Chen, Sirui, et autres
Publié: (2025)
par: Chen, Sirui, et autres
Publié: (2025)
Weighted-Reward Preference Optimization for Implicit Model Fusion
par: Yang, Ziyi, et autres
Publié: (2024)
par: Yang, Ziyi, et autres
Publié: (2024)
Skills-Coach: A Self-Evolving Skill Optimizer via Training-Free GRPO
par: Tian, Yu, et autres
Publié: (2026)
par: Tian, Yu, et autres
Publié: (2026)
InfiFPO: Implicit Model Fusion via Preference Optimization in Large Language Models
par: Gu, Yanggan, et autres
Publié: (2025)
par: Gu, Yanggan, et autres
Publié: (2025)
Infiltración grasa hepática difusa y su correlación con el índice de masa corporal, los triglicéridos y las transaminasas
par: Franco Ruales
Publié: (2012)
par: Franco Ruales
Publié: (2012)
Panel: Tendencias en servicios de salud y modelos de atención de la salud
par: José Ruales
Publié: (2004)
par: José Ruales
Publié: (2004)
La flora patrimonial de Quito descubierta por la expedición de Humboldt y Bonpland en el año 1802
par: Carlos Ruales
Publié: (2010)
par: Carlos Ruales
Publié: (2010)
Desafíos y perspectivas de los sistemas de salud y la gestión frente a las funciones esenciales de la salud pública
par: José Ruales
Publié: (2004)
par: José Ruales
Publié: (2004)
GOLD: Graph Out-of-Distribution Detection via Implicit Adversarial Latent Generation
par: Wang, Danny, et autres
Publié: (2025)
par: Wang, Danny, et autres
Publié: (2025)
AnchorNote: Exploring Speech-Driven Spatial Externalization for Co-Located Collaboration in Augmented Reality
par: Hundiwala, Diya, et autres
Publié: (2026)
par: Hundiwala, Diya, et autres
Publié: (2026)
SIFBench: An Extensive Benchmark for Fatigue Analysis
par: Gautam, Tushar, et autres
Publié: (2025)
par: Gautam, Tushar, et autres
Publié: (2025)
Diffusion-Based Symbolic Regression
par: Bastiani, Zachary, et autres
Publié: (2025)
par: Bastiani, Zachary, et autres
Publié: (2025)
HyResPINNs: A Hybrid Residual Physics-Informed Neural Network Architecture Designed to Balance Expressiveness and Trainability
par: Cooley, Madison, et autres
Publié: (2024)
par: Cooley, Madison, et autres
Publié: (2024)
Fourier PINNs: From Strong Boundary Conditions to Adaptive Fourier Bases
par: Cooley, Madison, et autres
Publié: (2024)
par: Cooley, Madison, et autres
Publié: (2024)
Polynomial-Augmented Neural Networks (PANNs) with Weak Orthogonality Constraints for Enhanced Function and PDE Approximation
par: Cooley, Madison, et autres
Publié: (2024)
par: Cooley, Madison, et autres
Publié: (2024)
Complexity-Aware Deep Symbolic Regression with Robust Risk-Seeking Policy Gradients
par: Bastiani, Zachary, et autres
Publié: (2024)
par: Bastiani, Zachary, et autres
Publié: (2024)
MidPO: Dual Preference Optimization for Safety and Helpfulness in Large Language Models via a Mixture of Experts Framework
par: Qi, Yupeng, et autres
Publié: (2025)
par: Qi, Yupeng, et autres
Publié: (2025)
Adversarial Preference Optimization: Enhancing Your Alignment via RM-LLM Game
par: Cheng, Pengyu, et autres
Publié: (2023)
par: Cheng, Pengyu, et autres
Publié: (2023)
SePA: A Search-enhanced Predictive Agent for Personalized Health Coaching
par: Ozolcer, Melik, et autres
Publié: (2025)
par: Ozolcer, Melik, et autres
Publié: (2025)
Q-learning as a monotone scheme
par: Yang, Lingyi
Publié: (2024)
par: Yang, Lingyi
Publié: (2024)
EPO: Hierarchical LLM Agents with Environment Preference Optimization
par: Zhao, Qi, et autres
Publié: (2024)
par: Zhao, Qi, et autres
Publié: (2024)
Generative Engine Optimization: A VLM and Agent Framework for Pinterest Acquisition Growth
par: Zhang, Faye, et autres
Publié: (2026)
par: Zhang, Faye, et autres
Publié: (2026)
Explicit Preference Optimization: No Need for an Implicit Reward Model
par: Hu, Xiangkun, et autres
Publié: (2025)
par: Hu, Xiangkun, et autres
Publié: (2025)
Enhancing Diffusion-based Unrestricted Adversarial Attacks via Adversary Preferences Alignment
par: Jiang, Kaixun, et autres
Publié: (2025)
par: Jiang, Kaixun, et autres
Publié: (2025)
Dual-IPO: Dual-Iterative Preference Optimization for Text-to-Video Generation
par: Yang, Xiaomeng, et autres
Publié: (2025)
par: Yang, Xiaomeng, et autres
Publié: (2025)
Documents similaires
-
StFT: Spatio-temporal Fourier Transformer for Long-term Dynamics Prediction
par: Long, Da, et autres
Publié: (2025) -
Arbitrarily-Conditioned Multi-Functional Diffusion for Multi-Physics Emulation
par: Long, Da, et autres
Publié: (2024) -
Invertible Fourier Neural Operators for Tackling Both Forward and Inverse Problems
par: Long, Da, et autres
Publié: (2024) -
Multi-Operator Few-Shot Learning for Generalization Across PDE Families
par: Li, Yile, et autres
Publié: (2025) -
Graph-Based Operator Learning from Limited Data on Irregular Domains
par: Li, Yile, et autres
Publié: (2025)