Weiter zum Inhalt
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Login
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Erweitert
  • AdvancedIF: Rubric-Based Benchmarking and Reinforcement Learning for Advancing LLM Instruction Following
Buchumschlag

AdvancedIF: Rubric-Based Benchmarking and Reinforcement Learning for Advancing LLM Instruction Following

Fuente: arXiv
Gespeichert in:
Bibliographische Detailangaben
Hauptverfasser: He, Yun, Li, Wenzhe, Zhang, Hejia, Li, Songlin, Mandyam, Karishma, Khosla, Sopan, Xiong, Yuanhao, Wang, Nanshu, Peng, Xiaoliang, Li, Beibin, Bi, Shengjie, Patil, Shishir G., Qi, Qi, Feng, Shengyu, Katz-Samuels, Julian, Pang, Richard Yuanzhe, Gonugondla, Sujan, Lang, Hunter, Yu, Yue, Qian, Yundi, Fazel-Zarandi, Maryam, Yu, Licheng, Benhalloum, Amine, Awadalla, Hany, Faruqui, Manaal
Format: Preprint
Veröffentlicht: 2025
Schlagworte:
Computation and Language
Online-Zugang:
Acceder al recurso
Tags: Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
  • Zitieren
  • SMS versenden
  • Als E-Mail versenden
  • Drucken
  • Datensatz exportieren
    • Exportieren nach RefWorks
    • Exportieren nach EndNoteWeb
    • Exportieren nach EndNote
  • Zu den Favoriten
  • Persistenter Link
  • Exemplare
  • Beschreibung
  • Kommentare
  • Ähnliche Einträge
  • Internformat

Online

https://arxiv.org/abs/2511.10507

Ähnliche Einträge

  • Bradley-Terry Policy Optimization for Generative Preference Modeling
    von: Feng, Shengyu, et al.
    Veröffentlicht: (2025)
  • Leave No Context Behind: Efficient Infinite Context Transformers with Infini-attention
    von: Munkhdalai, Tsendsuren, et al.
    Veröffentlicht: (2024)
  • Why did US urban homicide spike in 2020? A cross‐sectional data analysis for the largest American cities
    von: Mohammad M. Fazel‐Zarandi, et al.
    Veröffentlicht: (2024)
  • Bring Your Own KG: Self-Supervised Program Synthesis for Zero-Shot KGQA
    von: Agarwal, Dhruv, et al.
    Veröffentlicht: (2023)
  • The N-Grammys: Accelerating Autoregressive Inference with Learning-Free Batched Speculation
    von: Stewart, Lawrence, et al.
    Veröffentlicht: (2024)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 46,831© 2026 Universidad del Mar