Salta al contenuto
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Entra
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Avanzata
  • AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite
Copertina

AstaBench: Rigorous Benchmarking of AI Agents with a Scientific Research Suite

Fuente: arXiv
Salvato in:
Dettagli Bibliografici
Autori principali: Bragg, Jonathan, D'Arcy, Mike, Balepur, Nishant, Bareket, Dan, Dalvi, Bhavana, Feldman, Sergey, Haddad, Dany, Hwang, Jena D., Jansen, Peter, Kishore, Varsha, Majumder, Bodhisattwa Prasad, Naik, Aakanksha, Rahamimov, Sigal, Richardson, Kyle, Singh, Amanpreet, Surana, Harshit, Tiktinsky, Aryeh, Vasu, Rosni, Wiener, Guy, Anastasiades, Chloe, Candra, Stefan, Dunkelberger, Jason, Emery, Dan, Evans, Rob, Hamada, Malachi, Huff, Regan, Kinney, Rodney, Latzke, Matt, Lochner, Jaron, Lozano-Aguilera, Ruben, Nguyen, Cecile, Rao, Smita, Tanaka, Amber, Vlahos, Brooke, Clark, Peter, Downey, Doug, Goldberg, Yoav, Sabharwal, Ashish, Weld, Daniel S.
Natura: Preprint
Pubblicazione: 2025
Soggetti:
Artificial Intelligence
Computation and Language
Accesso online:
Acceder al recurso
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
  • Citazione
  • Invia SMS
  • Invia email
  • Stampa
  • Esporta il record
    • Esporta a RefWorks
    • Esporta a EndNoteWeb
    • Esporta a EndNote
  • Aggiungi alla lista
  • PLink permanente
  • Posseduto
  • Descrizione
  • Commenti
  • Documenti analoghi
  • MARC21
Lascia un commento!
Entra

Documenti analoghi

  • Understanding Usage and Engagement in AI-Powered Scientific Research Tools: The Asta Interaction Dataset
    di: Haddad, Dany, et al.
    Pubblicazione: (2026)
  • Ai2 Scholar QA: Organized Literature Synthesis with Attribution
    di: Singh, Amanpreet, et al.
    Pubblicazione: (2025)
  • Deep Research, Shallow Evaluation: A Case Study in Meta-Evaluation for Long-Form QA Benchmarks
    di: Hwang, Jena D., et al.
    Pubblicazione: (2026)
  • Data-driven Discovery with Large Generative Models
    di: Majumder, Bodhisattwa Prasad, et al.
    Pubblicazione: (2024)
  • Language Models Don't Know What You Want: Evaluating Personalization in Deep Research Needs Real Users
    di: Balepur, Nishant, et al.
    Pubblicazione: (2026)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 54,912© 2026 Universidad del Mar