Enregistré dans:
| Auteurs principaux: | Qian, Cheng, Xiong, Chenyan, Liu, Zhenghao, Liu, Zhiyuan |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2310.05155 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
AutoRule: Reasoning Chain-of-thought Extracted Rule-based Rewards Improve Preference Learning
par: Wang, Tevin, et autres
Publié: (2025)
par: Wang, Tevin, et autres
Publié: (2025)
Reasoning Beyond Chain-of-Thought: A Latent Computational Mode in Large Language Models
par: He, Zhenghao, et autres
Publié: (2026)
par: He, Zhenghao, et autres
Publié: (2026)
ParamMute: Suppressing Knowledge-Critical FFNs for Faithful Retrieval-Augmented Generation
par: Huang, Pengcheng, et autres
Publié: (2025)
par: Huang, Pengcheng, et autres
Publié: (2025)
ResearchArena: Benchmarking Large Language Models' Ability to Collect and Organize Information as Research Agents
par: Kang, Hao, et autres
Publié: (2024)
par: Kang, Hao, et autres
Publié: (2024)
Linking Knowledge to Care: Knowledge Graph-Augmented Medical Follow-Up Question Generation
par: Sun, Liwen, et autres
Publié: (2026)
par: Sun, Liwen, et autres
Publié: (2026)
Generate, Not Recommend: Personalized Multimodal Content Generation
par: Liu, Jiongnan, et autres
Publié: (2025)
par: Liu, Jiongnan, et autres
Publié: (2025)
SinaTools: Open Source Toolkit for Arabic Natural Language Processing
par: Hammouda, Tymaa, et autres
Publié: (2024)
par: Hammouda, Tymaa, et autres
Publié: (2024)
Fabricator: An Open Source Toolkit for Generating Labeled Training Data with Teacher LLMs
par: Golde, Jonas, et autres
Publié: (2023)
par: Golde, Jonas, et autres
Publié: (2023)
Generating Pretraining Tokens from Organic Data for Data-Bound Scaling
par: Yu, Zichun, et autres
Publié: (2026)
par: Yu, Zichun, et autres
Publié: (2026)
RAGViz: Diagnose and Visualize Retrieval-Augmented Generation
par: Wang, Tevin, et autres
Publié: (2024)
par: Wang, Tevin, et autres
Publié: (2024)
EmbodiedMidtrain: Bridging the Gap between Vision-Language Models and Vision-Language-Action Models via Mid-training
par: Du, Yiyang, et autres
Publié: (2026)
par: Du, Yiyang, et autres
Publié: (2026)
GR-NLP-TOOLKIT: An Open-Source NLP Toolkit for Modern Greek
par: Loukas, Lefteris, et autres
Publié: (2024)
par: Loukas, Lefteris, et autres
Publié: (2024)
Understand User Opinions of Large Language Models via LLM-Powered In-the-Moment User Experience Interviews
par: Liu, Mengqiao, et autres
Publié: (2025)
par: Liu, Mengqiao, et autres
Publié: (2025)
Montessori-Instruct: Generate Influential Training Data Tailored for Student Learning
par: Li, Xiaochuan, et autres
Publié: (2024)
par: Li, Xiaochuan, et autres
Publié: (2024)
Lynx: An Open Source Hallucination Evaluation Model
par: Ravi, Selvan Sunitha, et autres
Publié: (2024)
par: Ravi, Selvan Sunitha, et autres
Publié: (2024)
Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents
par: Wang, Shuting, et autres
Publié: (2025)
par: Wang, Shuting, et autres
Publié: (2025)
Distilling Closed-Source LLM's Knowledge for Locally Stable and Economic Biomedical Entity Linking
par: Ai, Yihao, et autres
Publié: (2025)
par: Ai, Yihao, et autres
Publié: (2025)
SciEvalKit: An Open-source Evaluation Toolkit for Scientific General Intelligence
par: Wang, Yiheng, et autres
Publié: (2025)
par: Wang, Yiheng, et autres
Publié: (2025)
Ustnlp16 at SemEval-2025 Task 9: Improving Model Performance through Imbalance Handling and Focal Loss
par: Cai, Zhuoang, et autres
Publié: (2025)
par: Cai, Zhuoang, et autres
Publié: (2025)
Language Models are Few-Shot Graders
par: Zhao, Chenyan, et autres
Publié: (2025)
par: Zhao, Chenyan, et autres
Publié: (2025)
PersLLM: A Personified Training Approach for Large Language Models
par: Zeng, Zheni, et autres
Publié: (2024)
par: Zeng, Zheni, et autres
Publié: (2024)
Toward Faithful Retrieval-Augmented Generation with Sparse Autoencoders
par: Xiong, Guangzhi, et autres
Publié: (2025)
par: Xiong, Guangzhi, et autres
Publié: (2025)
LMFlow: An Extensible Toolkit for Finetuning and Inference of Large Foundation Models
par: Diao, Shizhe, et autres
Publié: (2023)
par: Diao, Shizhe, et autres
Publié: (2023)
AgentCPM-Report: Interleaving Drafting and Deepening for Open-Ended Deep Research
par: Li, Yishan, et autres
Publié: (2026)
par: Li, Yishan, et autres
Publié: (2026)
ED-Copilot: Reduce Emergency Department Wait Time with Language Model Diagnostic Assistance
par: Sun, Liwen, et autres
Publié: (2024)
par: Sun, Liwen, et autres
Publié: (2024)
Has It All Been Solved? Open NLP Research Questions Not Solved by Large Language Models
par: Ignat, Oana, et autres
Publié: (2023)
par: Ignat, Oana, et autres
Publié: (2023)
Resolving the Robustness-Precision Trade-off in Financial RAG through Hybrid Document-Routed Retrieval
par: Cheng, Zhiyuan, et autres
Publié: (2026)
par: Cheng, Zhiyuan, et autres
Publié: (2026)
Citekit: A Modular Toolkit for Large Language Model Citation Generation
par: Shen, Jiajun, et autres
Publié: (2024)
par: Shen, Jiajun, et autres
Publié: (2024)
Orchard: An Open-Source Agentic Modeling Framework
par: Peng, Baolin, et autres
Publié: (2026)
par: Peng, Baolin, et autres
Publié: (2026)
Conceptual In-Context Learning and Chain of Concepts: Solving Complex Conceptual Problems Using Large Language Models
par: Vaidya, Nishtha N., et autres
Publié: (2024)
par: Vaidya, Nishtha N., et autres
Publié: (2024)
OpenR: An Open Source Framework for Advanced Reasoning with Large Language Models
par: Wang, Jun, et autres
Publié: (2024)
par: Wang, Jun, et autres
Publié: (2024)
Cleaner Pretraining Corpus Curation with Neural Web Scraping
par: Xu, Zhipeng, et autres
Publié: (2024)
par: Xu, Zhipeng, et autres
Publié: (2024)
Efficient Data Learning for Open Information Extraction with Pre-trained Language Models
par: Fan, Zhiyuan, et autres
Publié: (2023)
par: Fan, Zhiyuan, et autres
Publié: (2023)
WisdomInterrogatory (LuWen): An Open-Source Legal Large Language Model Technical Report
par: Wu, Yiquan, et autres
Publié: (2026)
par: Wu, Yiquan, et autres
Publié: (2026)
Empowering Private Tutoring by Chaining Large Language Models
par: Chen, Yulin, et autres
Publié: (2023)
par: Chen, Yulin, et autres
Publié: (2023)
ToolLibGen: Scalable Automatic Tool Creation and Aggregation for LLM Reasoning
par: Yue, Murong, et autres
Publié: (2025)
par: Yue, Murong, et autres
Publié: (2025)
Mark Your LLM: Detecting the Misuse of Open-Source Large Language Models via Watermarking
par: Xu, Yijie, et autres
Publié: (2025)
par: Xu, Yijie, et autres
Publié: (2025)
Hunyuan-Large: An Open-Source MoE Model with 52 Billion Activated Parameters by Tencent
par: Sun, Xingwu, et autres
Publié: (2024)
par: Sun, Xingwu, et autres
Publié: (2024)
Optima: Optimizing Effectiveness and Efficiency for LLM-Based Multi-Agent System
par: Chen, Weize, et autres
Publié: (2024)
par: Chen, Weize, et autres
Publié: (2024)
Enhancing Agent Learning through World Dynamics Modeling
par: Sun, Zhiyuan, et autres
Publié: (2024)
par: Sun, Zhiyuan, et autres
Publié: (2024)
Documents similaires
-
AutoRule: Reasoning Chain-of-thought Extracted Rule-based Rewards Improve Preference Learning
par: Wang, Tevin, et autres
Publié: (2025) -
Reasoning Beyond Chain-of-Thought: A Latent Computational Mode in Large Language Models
par: He, Zhenghao, et autres
Publié: (2026) -
ParamMute: Suppressing Knowledge-Critical FFNs for Faithful Retrieval-Augmented Generation
par: Huang, Pengcheng, et autres
Publié: (2025) -
ResearchArena: Benchmarking Large Language Models' Ability to Collect and Organize Information as Research Agents
par: Kang, Hao, et autres
Publié: (2024) -
Linking Knowledge to Care: Knowledge Graph-Augmented Medical Follow-Up Question Generation
par: Sun, Liwen, et autres
Publié: (2026)