Saved in:
| Main Authors: | Shao, Yijia, Jiang, Yucheng, Kanell, Theodore A., Xu, Peter, Khattab, Omar, Lam, Monica S. |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2402.14207 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Into the Unknown Unknowns: Engaged Human Learning through Participation in Language Model Agent Conversations
by: Jiang, Yucheng, et al.
Published: (2024)
by: Jiang, Yucheng, et al.
Published: (2024)
Recursive Language Models
by: Zhang, Alex L., et al.
Published: (2025)
by: Zhang, Alex L., et al.
Published: (2025)
Problem-Oriented Segmentation and Retrieval: Case Study on Tutoring Conversations
by: Wang, Rose E., et al.
Published: (2024)
by: Wang, Rose E., et al.
Published: (2024)
Hoaxpedia: A Unified Wikipedia Hoax Articles Dataset
by: Borkakoty, Hsuvas, et al.
Published: (2024)
by: Borkakoty, Hsuvas, et al.
Published: (2024)
Assisting Research Proposal Writing with Large Language Models: Evaluation and Refinement
by: Ren, Jing, et al.
Published: (2025)
by: Ren, Jing, et al.
Published: (2025)
Collaborative Gym: A Framework for Enabling and Evaluating Human-Agent Collaboration
by: Shao, Yijia, et al.
Published: (2024)
by: Shao, Yijia, et al.
Published: (2024)
DSPy Assertions: Computational Constraints for Self-Refining Language Model Pipelines
by: Singhvi, Arnav, et al.
Published: (2023)
by: Singhvi, Arnav, et al.
Published: (2023)
Babysit A Language Model From Scratch: Interactive Language Learning by Trials and Demonstrations
by: Ma, Ziqiao, et al.
Published: (2024)
by: Ma, Ziqiao, et al.
Published: (2024)
Fine-Tuning and Prompt Optimization: Two Great Steps that Work Better Together
by: Soylu, Dilara, et al.
Published: (2024)
by: Soylu, Dilara, et al.
Published: (2024)
Performance Evaluation of Open-Source Large Language Models for Assisting Pathology Report Writing in Japanese
by: Kawai, Masataka, et al.
Published: (2026)
by: Kawai, Masataka, et al.
Published: (2026)
Can LLMs Automate Fact-Checking Article Writing?
by: Sahnan, Dhruv, et al.
Published: (2025)
by: Sahnan, Dhruv, et al.
Published: (2025)
On the Effectiveness of Large Language Models in Writing Alloy Formulas
by: Hong, Yang, et al.
Published: (2025)
by: Hong, Yang, et al.
Published: (2025)
An Open Source Data Contamination Report for Large Language Models
by: Li, Yucheng, et al.
Published: (2023)
by: Li, Yucheng, et al.
Published: (2023)
PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents
by: Gu, Zhuohan, et al.
Published: (2026)
by: Gu, Zhuohan, et al.
Published: (2026)
Optimizing Instructions and Demonstrations for Multi-Stage Language Model Programs
by: Opsahl-Ong, Krista, et al.
Published: (2024)
by: Opsahl-Ong, Krista, et al.
Published: (2024)
Generative Interfaces for Language Models
by: Chen, Jiaqi, et al.
Published: (2025)
by: Chen, Jiaqi, et al.
Published: (2025)
ARES: An Automated Evaluation Framework for Retrieval-Augmented Generation Systems
by: Saad-Falcon, Jon, et al.
Published: (2023)
by: Saad-Falcon, Jon, et al.
Published: (2023)
SozKZ: Training Efficient Small Language Models for Kazakh from Scratch
by: Tukenov, Saken
Published: (2026)
by: Tukenov, Saken
Published: (2026)
PrivacyLens: Evaluating Privacy Norm Awareness of Language Models in Action
by: Shao, Yijia, et al.
Published: (2024)
by: Shao, Yijia, et al.
Published: (2024)
Evaluating Large Language Models for Generalization and Robustness via Data Compression
by: Li, Yucheng, et al.
Published: (2024)
by: Li, Yucheng, et al.
Published: (2024)
$T^2$ of Thoughts: Temperature Tree Elicits Reasoning in Large Language Models
by: Cai, Chengkun, et al.
Published: (2024)
by: Cai, Chengkun, et al.
Published: (2024)
OverleafCopilot: Empowering Academic Writing in Overleaf with Large Language Models
by: Wen, Haomin, et al.
Published: (2024)
by: Wen, Haomin, et al.
Published: (2024)
RAG and RAU: A Survey on Retrieval-Augmented Language Model in Natural Language Processing
by: Hu, Yucheng, et al.
Published: (2024)
by: Hu, Yucheng, et al.
Published: (2024)
Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing
by: Xu, Zhangchen, et al.
Published: (2024)
by: Xu, Zhangchen, et al.
Published: (2024)
Assisted Debate Builder with Large Language Models
by: Faugier, Elliot, et al.
Published: (2024)
by: Faugier, Elliot, et al.
Published: (2024)
Who Reasons in the Large Language Models?
by: Shao, Jie, et al.
Published: (2025)
by: Shao, Jie, et al.
Published: (2025)
MENLO: From Preferences to Proficiency -- Evaluating and Modeling Native-like Quality Across 47 Languages
by: Whitehouse, Chenxi, et al.
Published: (2025)
by: Whitehouse, Chenxi, et al.
Published: (2025)
In-Context Learning for Extreme Multi-Label Classification
by: D'Oosterlinck, Karel, et al.
Published: (2024)
by: D'Oosterlinck, Karel, et al.
Published: (2024)
From Knowledge to Treatment: Large Language Model Assisted Biomedical Concept Representation for Drug Repurposing
by: Xiang, Chengrui, et al.
Published: (2025)
by: Xiang, Chengrui, et al.
Published: (2025)
High-throughput Biomedical Relation Extraction for Semi-Structured Web Articles Empowered by Large Language Models
by: Zhou, Songchi, et al.
Published: (2023)
by: Zhou, Songchi, et al.
Published: (2023)
Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
by: Li, Hang, et al.
Published: (2025)
by: Li, Hang, et al.
Published: (2025)
On the Worst Prompt Performance of Large Language Models
by: Cao, Bowen, et al.
Published: (2024)
by: Cao, Bowen, et al.
Published: (2024)
Large Language Model-Driven Dynamic Assessment of Grammatical Accuracy in English Language Learner Writing
by: Jaganov, Timur, et al.
Published: (2025)
by: Jaganov, Timur, et al.
Published: (2025)
Probing for Arithmetic Errors in Language Models
by: Sun, Yucheng, et al.
Published: (2025)
by: Sun, Yucheng, et al.
Published: (2025)
Hierarchical Memory Organization for Wikipedia Generation
by: Yu, Eugene J., et al.
Published: (2025)
by: Yu, Eugene J., et al.
Published: (2025)
Future of Work with AI Agents: Auditing Automation and Augmentation Potential across the U.S. Workforce
by: Shao, Yijia, et al.
Published: (2025)
by: Shao, Yijia, et al.
Published: (2025)
Route-and-Reason: Scaling Large Language Model Reasoning with Reinforced Model Router
by: Shao, Chenyang, et al.
Published: (2025)
by: Shao, Chenyang, et al.
Published: (2025)
EssayBench: Evaluating Large Language Models in Multi-Genre Chinese Essay Writing
by: Gao, Fan, et al.
Published: (2025)
by: Gao, Fan, et al.
Published: (2025)
Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking
by: Zelikman, Eric, et al.
Published: (2024)
by: Zelikman, Eric, et al.
Published: (2024)
Cheems: A Practical Guidance for Building and Evaluating Chinese Reward Models from Scratch
by: Wen, Xueru, et al.
Published: (2025)
by: Wen, Xueru, et al.
Published: (2025)
Similar Items
-
Into the Unknown Unknowns: Engaged Human Learning through Participation in Language Model Agent Conversations
by: Jiang, Yucheng, et al.
Published: (2024) -
Recursive Language Models
by: Zhang, Alex L., et al.
Published: (2025) -
Problem-Oriented Segmentation and Retrieval: Case Study on Tutoring Conversations
by: Wang, Rose E., et al.
Published: (2024) -
Hoaxpedia: A Unified Wikipedia Hoax Articles Dataset
by: Borkakoty, Hsuvas, et al.
Published: (2024) -
Assisting Research Proposal Writing with Large Language Models: Evaluation and Refinement
by: Ren, Jing, et al.
Published: (2025)