Enregistré dans:
| Auteurs principaux: | Shao, Yijia, Jiang, Yucheng, Kanell, Theodore A., Xu, Peter, Khattab, Omar, Lam, Monica S. |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2402.14207 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Into the Unknown Unknowns: Engaged Human Learning through Participation in Language Model Agent Conversations
par: Jiang, Yucheng, et autres
Publié: (2024)
par: Jiang, Yucheng, et autres
Publié: (2024)
Recursive Language Models
par: Zhang, Alex L., et autres
Publié: (2025)
par: Zhang, Alex L., et autres
Publié: (2025)
Problem-Oriented Segmentation and Retrieval: Case Study on Tutoring Conversations
par: Wang, Rose E., et autres
Publié: (2024)
par: Wang, Rose E., et autres
Publié: (2024)
Hoaxpedia: A Unified Wikipedia Hoax Articles Dataset
par: Borkakoty, Hsuvas, et autres
Publié: (2024)
par: Borkakoty, Hsuvas, et autres
Publié: (2024)
Assisting Research Proposal Writing with Large Language Models: Evaluation and Refinement
par: Ren, Jing, et autres
Publié: (2025)
par: Ren, Jing, et autres
Publié: (2025)
Collaborative Gym: A Framework for Enabling and Evaluating Human-Agent Collaboration
par: Shao, Yijia, et autres
Publié: (2024)
par: Shao, Yijia, et autres
Publié: (2024)
DSPy Assertions: Computational Constraints for Self-Refining Language Model Pipelines
par: Singhvi, Arnav, et autres
Publié: (2023)
par: Singhvi, Arnav, et autres
Publié: (2023)
Babysit A Language Model From Scratch: Interactive Language Learning by Trials and Demonstrations
par: Ma, Ziqiao, et autres
Publié: (2024)
par: Ma, Ziqiao, et autres
Publié: (2024)
Fine-Tuning and Prompt Optimization: Two Great Steps that Work Better Together
par: Soylu, Dilara, et autres
Publié: (2024)
par: Soylu, Dilara, et autres
Publié: (2024)
Performance Evaluation of Open-Source Large Language Models for Assisting Pathology Report Writing in Japanese
par: Kawai, Masataka, et autres
Publié: (2026)
par: Kawai, Masataka, et autres
Publié: (2026)
Can LLMs Automate Fact-Checking Article Writing?
par: Sahnan, Dhruv, et autres
Publié: (2025)
par: Sahnan, Dhruv, et autres
Publié: (2025)
On the Effectiveness of Large Language Models in Writing Alloy Formulas
par: Hong, Yang, et autres
Publié: (2025)
par: Hong, Yang, et autres
Publié: (2025)
An Open Source Data Contamination Report for Large Language Models
par: Li, Yucheng, et autres
Publié: (2023)
par: Li, Yucheng, et autres
Publié: (2023)
PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents
par: Gu, Zhuohan, et autres
Publié: (2026)
par: Gu, Zhuohan, et autres
Publié: (2026)
Optimizing Instructions and Demonstrations for Multi-Stage Language Model Programs
par: Opsahl-Ong, Krista, et autres
Publié: (2024)
par: Opsahl-Ong, Krista, et autres
Publié: (2024)
Generative Interfaces for Language Models
par: Chen, Jiaqi, et autres
Publié: (2025)
par: Chen, Jiaqi, et autres
Publié: (2025)
ARES: An Automated Evaluation Framework for Retrieval-Augmented Generation Systems
par: Saad-Falcon, Jon, et autres
Publié: (2023)
par: Saad-Falcon, Jon, et autres
Publié: (2023)
SozKZ: Training Efficient Small Language Models for Kazakh from Scratch
par: Tukenov, Saken
Publié: (2026)
par: Tukenov, Saken
Publié: (2026)
PrivacyLens: Evaluating Privacy Norm Awareness of Language Models in Action
par: Shao, Yijia, et autres
Publié: (2024)
par: Shao, Yijia, et autres
Publié: (2024)
Evaluating Large Language Models for Generalization and Robustness via Data Compression
par: Li, Yucheng, et autres
Publié: (2024)
par: Li, Yucheng, et autres
Publié: (2024)
$T^2$ of Thoughts: Temperature Tree Elicits Reasoning in Large Language Models
par: Cai, Chengkun, et autres
Publié: (2024)
par: Cai, Chengkun, et autres
Publié: (2024)
OverleafCopilot: Empowering Academic Writing in Overleaf with Large Language Models
par: Wen, Haomin, et autres
Publié: (2024)
par: Wen, Haomin, et autres
Publié: (2024)
RAG and RAU: A Survey on Retrieval-Augmented Language Model in Natural Language Processing
par: Hu, Yucheng, et autres
Publié: (2024)
par: Hu, Yucheng, et autres
Publié: (2024)
Magpie: Alignment Data Synthesis from Scratch by Prompting Aligned LLMs with Nothing
par: Xu, Zhangchen, et autres
Publié: (2024)
par: Xu, Zhangchen, et autres
Publié: (2024)
Assisted Debate Builder with Large Language Models
par: Faugier, Elliot, et autres
Publié: (2024)
par: Faugier, Elliot, et autres
Publié: (2024)
Who Reasons in the Large Language Models?
par: Shao, Jie, et autres
Publié: (2025)
par: Shao, Jie, et autres
Publié: (2025)
MENLO: From Preferences to Proficiency -- Evaluating and Modeling Native-like Quality Across 47 Languages
par: Whitehouse, Chenxi, et autres
Publié: (2025)
par: Whitehouse, Chenxi, et autres
Publié: (2025)
In-Context Learning for Extreme Multi-Label Classification
par: D'Oosterlinck, Karel, et autres
Publié: (2024)
par: D'Oosterlinck, Karel, et autres
Publié: (2024)
From Knowledge to Treatment: Large Language Model Assisted Biomedical Concept Representation for Drug Repurposing
par: Xiang, Chengrui, et autres
Publié: (2025)
par: Xiang, Chengrui, et autres
Publié: (2025)
High-throughput Biomedical Relation Extraction for Semi-Structured Web Articles Empowered by Large Language Models
par: Zhou, Songchi, et autres
Publié: (2023)
par: Zhou, Songchi, et autres
Publié: (2023)
Exploring Solution Divergence and Its Effect on Large Language Model Problem Solving
par: Li, Hang, et autres
Publié: (2025)
par: Li, Hang, et autres
Publié: (2025)
On the Worst Prompt Performance of Large Language Models
par: Cao, Bowen, et autres
Publié: (2024)
par: Cao, Bowen, et autres
Publié: (2024)
Large Language Model-Driven Dynamic Assessment of Grammatical Accuracy in English Language Learner Writing
par: Jaganov, Timur, et autres
Publié: (2025)
par: Jaganov, Timur, et autres
Publié: (2025)
Probing for Arithmetic Errors in Language Models
par: Sun, Yucheng, et autres
Publié: (2025)
par: Sun, Yucheng, et autres
Publié: (2025)
Hierarchical Memory Organization for Wikipedia Generation
par: Yu, Eugene J., et autres
Publié: (2025)
par: Yu, Eugene J., et autres
Publié: (2025)
Future of Work with AI Agents: Auditing Automation and Augmentation Potential across the U.S. Workforce
par: Shao, Yijia, et autres
Publié: (2025)
par: Shao, Yijia, et autres
Publié: (2025)
Route-and-Reason: Scaling Large Language Model Reasoning with Reinforced Model Router
par: Shao, Chenyang, et autres
Publié: (2025)
par: Shao, Chenyang, et autres
Publié: (2025)
EssayBench: Evaluating Large Language Models in Multi-Genre Chinese Essay Writing
par: Gao, Fan, et autres
Publié: (2025)
par: Gao, Fan, et autres
Publié: (2025)
Quiet-STaR: Language Models Can Teach Themselves to Think Before Speaking
par: Zelikman, Eric, et autres
Publié: (2024)
par: Zelikman, Eric, et autres
Publié: (2024)
Cheems: A Practical Guidance for Building and Evaluating Chinese Reward Models from Scratch
par: Wen, Xueru, et autres
Publié: (2025)
par: Wen, Xueru, et autres
Publié: (2025)
Documents similaires
-
Into the Unknown Unknowns: Engaged Human Learning through Participation in Language Model Agent Conversations
par: Jiang, Yucheng, et autres
Publié: (2024) -
Recursive Language Models
par: Zhang, Alex L., et autres
Publié: (2025) -
Problem-Oriented Segmentation and Retrieval: Case Study on Tutoring Conversations
par: Wang, Rose E., et autres
Publié: (2024) -
Hoaxpedia: A Unified Wikipedia Hoax Articles Dataset
par: Borkakoty, Hsuvas, et autres
Publié: (2024) -
Assisting Research Proposal Writing with Large Language Models: Evaluation and Refinement
par: Ren, Jing, et autres
Publié: (2025)