Simple synthetic data reduces sycophancy in large language models
Fuente:
arXiv
Guardado en:
| Autores principales: | Wei, Jerry, Huang, Da, Lu, Yifeng, Zhou, Denny, Le, Quoc V. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Symbol tuning improves in-context learning in language models
por: Wei, Jerry, et al.
Publicado: (2023)
por: Wei, Jerry, et al.
Publicado: (2023)
Long-form factuality in large language models
por: Wei, Jerry, et al.
Publicado: (2024)
por: Wei, Jerry, et al.
Publicado: (2024)
Zero-shot generation of synthetic neurosurgical data with large language models
por: Barr, Austin A., et al.
Publicado: (2025)
por: Barr, Austin A., et al.
Publicado: (2025)
Ask don't tell: Reducing sycophancy in large language models
por: Dubois, Magda, et al.
Publicado: (2026)
por: Dubois, Magda, et al.
Publicado: (2026)
Large Language Models as Optimizers
por: Yang, Chengrun, et al.
Publicado: (2023)
por: Yang, Chengrun, et al.
Publicado: (2023)
Verbalizing LLMs' assumptions to explain and control sycophancy
por: Cheng, Myra, et al.
Publicado: (2026)
por: Cheng, Myra, et al.
Publicado: (2026)
ELEPHANT: Measuring and understanding social sycophancy in LLMs
por: Cheng, Myra, et al.
Publicado: (2025)
por: Cheng, Myra, et al.
Publicado: (2025)
Dynamic data sampler for cross-language transfer learning in large language models
por: Li, Yudong, et al.
Publicado: (2024)
por: Li, Yudong, et al.
Publicado: (2024)
Emergence of psychopathological computations in large language models
por: Lee, Soo Yong, et al.
Publicado: (2025)
por: Lee, Soo Yong, et al.
Publicado: (2025)
Generative adversarial networks vs large language models: a comparative study on synthetic tabular data generation
por: Barr, Austin A., et al.
Publicado: (2025)
por: Barr, Austin A., et al.
Publicado: (2025)
On the steerability of large language models toward data-driven personas
por: Li, Junyi, et al.
Publicado: (2023)
por: Li, Junyi, et al.
Publicado: (2023)
Retrieval augmentation of large language models for lay language generation
por: Guo, Yue, et al.
Publicado: (2022)
por: Guo, Yue, et al.
Publicado: (2022)
AugSumm: towards generalizable speech summarization using synthetic labels from large language model
por: Jung, Jee-weon, et al.
Publicado: (2024)
por: Jung, Jee-weon, et al.
Publicado: (2024)
Mathematics with large language models as provers and verifiers
por: Duc, Hieu Le, et al.
Publicado: (2025)
por: Duc, Hieu Le, et al.
Publicado: (2025)
The 20 questions game to distinguish large language models
por: Richardeau, Gurvan, et al.
Publicado: (2024)
por: Richardeau, Gurvan, et al.
Publicado: (2024)
Multi-round jailbreak attack on large language models
por: Zhou, Yihua, et al.
Publicado: (2024)
por: Zhou, Yihua, et al.
Publicado: (2024)
Measuring short-form factuality in large language models
por: Wei, Jason, et al.
Publicado: (2024)
por: Wei, Jason, et al.
Publicado: (2024)
Do large language models resemble humans in language use?
por: Cai, Zhenguang G., et al.
Publicado: (2023)
por: Cai, Zhenguang G., et al.
Publicado: (2023)
Dissociating language and thought in large language models
por: Mahowald, Kyle, et al.
Publicado: (2023)
por: Mahowald, Kyle, et al.
Publicado: (2023)
Developing ChemDFM as a large language foundation model for chemistry
por: Zhao, Zihan, et al.
Publicado: (2024)
por: Zhao, Zihan, et al.
Publicado: (2024)
Critic-CoT: Boosting the reasoning abilities of large language model via Chain-of-thoughts Critic
por: Zheng, Xin, et al.
Publicado: (2024)
por: Zheng, Xin, et al.
Publicado: (2024)
Prompting language influences diagnostic reasoning and accuracy of large language models
por: Bazoge, Adrien, et al.
Publicado: (2026)
por: Bazoge, Adrien, et al.
Publicado: (2026)
Quantifying perturbation impacts for large language models
por: Rauba, Paulius, et al.
Publicado: (2024)
por: Rauba, Paulius, et al.
Publicado: (2024)
Multilingual large language models leak human stereotypes across language boundaries
por: Cao, Yang Trista, et al.
Publicado: (2023)
por: Cao, Yang Trista, et al.
Publicado: (2023)
Evaluating large language models in medical applications: a survey
por: Chen, Xiaolan, et al.
Publicado: (2024)
por: Chen, Xiaolan, et al.
Publicado: (2024)
Correcting misinformation on social media with a large language model
por: Zhou, Xinyi, et al.
Publicado: (2024)
por: Zhou, Xinyi, et al.
Publicado: (2024)
On the attribution of confidence to large language models
por: Keeling, Geoff, et al.
Publicado: (2024)
por: Keeling, Geoff, et al.
Publicado: (2024)
AI-AI Bias: large language models favor communications generated by large language models
por: Laurito, Walter, et al.
Publicado: (2024)
por: Laurito, Walter, et al.
Publicado: (2024)
Streamlining evidence based clinical recommendations with large language models
por: Li, Dubai, et al.
Publicado: (2025)
por: Li, Dubai, et al.
Publicado: (2025)
Uncovering inequalities in new knowledge learning by large language models across different languages
por: Wang, Chenglong, et al.
Publicado: (2025)
por: Wang, Chenglong, et al.
Publicado: (2025)
Hyacinth6B: A large language model for Traditional Chinese
por: Song, Chih-Wei, et al.
Publicado: (2024)
por: Song, Chih-Wei, et al.
Publicado: (2024)
Can adversarial attacks by large language models be attributed?
por: Cebrian, Manuel, et al.
Publicado: (2024)
por: Cebrian, Manuel, et al.
Publicado: (2024)
Representation in large language models
por: Yetman, Cameron
Publicado: (2025)
por: Yetman, Cameron
Publicado: (2025)
Advancing bioinformatics with large language models: components, applications and perspectives
por: Liu, Jiajia, et al.
Publicado: (2024)
por: Liu, Jiajia, et al.
Publicado: (2024)
Biomedical knowledge graph-optimized prompt generation for large language models
por: Soman, Karthik, et al.
Publicado: (2023)
por: Soman, Karthik, et al.
Publicado: (2023)
World model inspired sarcasm reasoning with large language model agents
por: Inoshita, Keito, et al.
Publicado: (2025)
por: Inoshita, Keito, et al.
Publicado: (2025)
ThoughtSource: A central hub for large language model reasoning data
por: Ott, Simon, et al.
Publicado: (2023)
por: Ott, Simon, et al.
Publicado: (2023)
Failure of contextual invariance in large language models
por: Kumar, Sagar, et al.
Publicado: (2026)
por: Kumar, Sagar, et al.
Publicado: (2026)
Chain-of-Thought Reasoning Without Prompting
por: Wang, Xuezhi, et al.
Publicado: (2024)
por: Wang, Xuezhi, et al.
Publicado: (2024)
Fine-tuning large language models for domain adaptation: Exploration of training strategies, scaling, model merging and synergistic capabilities
por: Lu, Wei, et al.
Publicado: (2024)
por: Lu, Wei, et al.
Publicado: (2024)
Ejemplares similares
-
Symbol tuning improves in-context learning in language models
por: Wei, Jerry, et al.
Publicado: (2023) -
Long-form factuality in large language models
por: Wei, Jerry, et al.
Publicado: (2024) -
Zero-shot generation of synthetic neurosurgical data with large language models
por: Barr, Austin A., et al.
Publicado: (2025) -
Ask don't tell: Reducing sycophancy in large language models
por: Dubois, Magda, et al.
Publicado: (2026) -
Large Language Models as Optimizers
por: Yang, Chengrun, et al.
Publicado: (2023)