Evaluating Human-Language Model Interaction
Fuente:
arXiv
Guardado en:
| Autores principales: | Lee, Mina, Srivastava, Megha, Hardy, Amelia, Thickstun, John, Durmus, Esin, Paranjape, Ashwin, Gerard-Ursin, Ines, Li, Xiang Lisa, Ladhak, Faisal, Rong, Frieda, Wang, Rose E., Kwon, Minae, Park, Joon Sung, Cao, Hancheng, Lee, Tony, Bommasani, Rishi, Bernstein, Michael, Liang, Percy |
|---|---|
| Formato: | Preprint |
| Publicado: |
2022
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Trustworthy Social Bias Measurement
por: Bommasani, Rishi, et al.
Publicado: (2022)
por: Bommasani, Rishi, et al.
Publicado: (2022)
The Societal Impact of Foundation Models: Advancing Evidence-based AI Policy
por: Bommasani, Rishi
Publicado: (2025)
por: Bommasani, Rishi
Publicado: (2025)
NeurIPS should lead scientific consensus on AI policy
por: Bommasani, Rishi
Publicado: (2025)
por: Bommasani, Rishi
Publicado: (2025)
Self-Verified Distillation: Your Language Model Is Secretly Its Own Synthetic Data Pipeline
por: Lee, Tony, et al.
Publicado: (2026)
por: Lee, Tony, et al.
Publicado: (2026)
Algorithmic Monocultures in Hiring
por: Bommasani, Rishi, et al.
Publicado: (2026)
por: Bommasani, Rishi, et al.
Publicado: (2026)
Ecosystem Graphs: The Social Footprint of Foundation Models
por: Bommasani, Rishi, et al.
Publicado: (2023)
por: Bommasani, Rishi, et al.
Publicado: (2023)
Anticipatory Music Transformer
por: Thickstun, John, et al.
Publicado: (2023)
por: Thickstun, John, et al.
Publicado: (2023)
Robust Distortion-free Watermarks for Language Models
por: Kuditipudi, Rohith, et al.
Publicado: (2023)
por: Kuditipudi, Rohith, et al.
Publicado: (2023)
Milton's Loves: From Amity to Caritas in the Paradise EpicsRosamundPaice. New York: Routledge, 2023. vii + 224 pp. ISBN 13: 9781032390215. $142.50 (hardback); $41.20 (paperback).
por: Margaret Thickstun
Publicado: (2025)
por: Margaret Thickstun
Publicado: (2025)
Ecosystem-level Analysis of Deployed Machine Learning Reveals Homogeneous Outcomes
por: Toups, Connor, et al.
Publicado: (2023)
por: Toups, Connor, et al.
Publicado: (2023)
The 2024 Foundation Model Transparency Index
por: Bommasani, Rishi, et al.
Publicado: (2024)
por: Bommasani, Rishi, et al.
Publicado: (2024)
Tranforming Finnish Higher Education: Institutional Mergers and Conflicting Academic Identities
por: Jani Ursin
Publicado: (2017)
por: Jani Ursin
Publicado: (2017)
Nordseemodell - Eine neue Grundlage für die Regulierung der Fischerei
por: Ursin, E.
Publicado: (1979)
por: Ursin, E.
Publicado: (1979)
Incorporating Human Explanations for Robust Hate Speech Detection
por: Chen, Jennifer L., et al.
Publicado: (2024)
por: Chen, Jennifer L., et al.
Publicado: (2024)
Language model developers should report train-test overlap
por: Zhang, Andy K, et al.
Publicado: (2024)
por: Zhang, Andy K, et al.
Publicado: (2024)
Do AI Companies Make Good on Voluntary Commitments to the White House?
por: Wang, Jennifer, et al.
Publicado: (2025)
por: Wang, Jennifer, et al.
Publicado: (2025)
Aligning Large Language Models via Fine-grained Supervision
por: Xu, Dehong, et al.
Publicado: (2024)
por: Xu, Dehong, et al.
Publicado: (2024)
Foundation Model Transparency Reports
por: Bommasani, Rishi, et al.
Publicado: (2024)
por: Bommasani, Rishi, et al.
Publicado: (2024)
The 2025 Foundation Model Transparency Index
por: Wan, Alexander, et al.
Publicado: (2025)
por: Wan, Alexander, et al.
Publicado: (2025)
Trabajo industrial a domicilio en los Estados Unidos
por: Frieda S. Miller
Publicado: (1941)
por: Frieda S. Miller
Publicado: (1941)
El trabajo doméstico en los Estados Unidos
por: Frieda S. Miller
Publicado: (1952)
por: Frieda S. Miller
Publicado: (1952)
Le travail industriel à domicile aux Etats-Unis
por: Frieda S. Miller
Publicado: (1941)
por: Frieda S. Miller
Publicado: (1941)
Le travail domestique aux Etats-Unis
por: Frieda S. Miller
Publicado: (1952)
por: Frieda S. Miller
Publicado: (1952)
Industrial home work in the United States
por: Frieda S. Miller
Publicado: (1941)
por: Frieda S. Miller
Publicado: (1941)
Household employment in the United States
por: Frieda S. Miller
Publicado: (1952)
por: Frieda S. Miller
Publicado: (1952)
Statistical Sources for Health Science Librarians.
por: Weise, Frieda
Publicado: (1978)
por: Weise, Frieda
Publicado: (1978)
Characterizing the Generalization Error of Random Feature Regression with Arbitrary Data-Augmentation
por: Morisset, Lucas, et al.
Publicado: (2026)
por: Morisset, Lucas, et al.
Publicado: (2026)
Non-Asymptotic Analysis of Data Augmentation for Precision Matrix Estimation
por: Morisset, Lucas, et al.
Publicado: (2025)
por: Morisset, Lucas, et al.
Publicado: (2025)
EDUCAÇÃO MUSEAL NA CIBERCULTURA: O USO DE MEMES NO PROJETO “CLUBE DE JOVENS CIENTISTAS” DA SEÇÃO DE ASSISTÊNCIA AO ENSINO (SAE) DO MUSEU NACIONAL/UFRJ
por: Frieda Maria Marti
Publicado: (2019)
por: Frieda Maria Marti
Publicado: (2019)
Learning Center Guide; Helene Fuld School of Nursing.
por: Rabkin, Frieda H.
Publicado: (1975)
por: Rabkin, Frieda H.
Publicado: (1975)
Developments in Health Sciences Libraries since 1974: From Physical Entity to the Virtual Library.
por: Weise, Frieda O.
Publicado: (1993)
por: Weise, Frieda O.
Publicado: (1993)
Observation of manganese deposits in the Cayman Trough, Caribbean Sea by the ALVIN submersible in 1977
por: Malcolm, Frieda L
Publicado: (1979)
por: Malcolm, Frieda L
Publicado: (1979)
Dumbing Down or Reaching Out? Norwegian News Coverage for Children During Election Periods
por: Linn Cathrin Lorgen, et al.
Publicado: (2025)
por: Linn Cathrin Lorgen, et al.
Publicado: (2025)
Effective Mitigations for Systemic Risks from General-Purpose AI
por: Uuk, Risto, et al.
Publicado: (2024)
por: Uuk, Risto, et al.
Publicado: (2024)
NLP Systems That Can't Tell Use from Mention Censor Counterspeech, but Teaching the Distinction Helps
por: Gligoric, Kristina, et al.
Publicado: (2024)
por: Gligoric, Kristina, et al.
Publicado: (2024)
Stress-Testing Model Specs Reveals Character Differences among Language Models
por: Zhang, Jifan, et al.
Publicado: (2025)
por: Zhang, Jifan, et al.
Publicado: (2025)
STORYSUMM: Evaluating Faithfulness in Story Summarization
por: Subbiah, Melanie, et al.
Publicado: (2024)
por: Subbiah, Melanie, et al.
Publicado: (2024)
L0-Reasoning Bench: Evaluating Procedural Correctness in Language Models via Simple Program Execution
por: Sun, Simeng, et al.
Publicado: (2025)
por: Sun, Simeng, et al.
Publicado: (2025)
Spatially Resolved Star Formation Rate and Dust Attenuation of Nearby Galaxies from CALIFA, GALEX, and WISE Data
por: Lee, Jong Chul, et al.
Publicado: (2025)
por: Lee, Jong Chul, et al.
Publicado: (2025)
The Theory and Applications of Instanton Calculations
por: Paranjape, Manu
Publicado: (2022)
por: Paranjape, Manu
Publicado: (2022)
Ejemplares similares
-
Trustworthy Social Bias Measurement
por: Bommasani, Rishi, et al.
Publicado: (2022) -
The Societal Impact of Foundation Models: Advancing Evidence-based AI Policy
por: Bommasani, Rishi
Publicado: (2025) -
NeurIPS should lead scientific consensus on AI policy
por: Bommasani, Rishi
Publicado: (2025) -
Self-Verified Distillation: Your Language Model Is Secretly Its Own Synthetic Data Pipeline
por: Lee, Tony, et al.
Publicado: (2026) -
Algorithmic Monocultures in Hiring
por: Bommasani, Rishi, et al.
Publicado: (2026)