Enregistré dans:
| Auteurs principaux: | Pan, Yu, Yuan, Ye, Yin, Yichun, Shi, Jiaxin, Xu, Zenglin, Zhang, Ming, Shang, Lifeng, Jiang, Xin, Liu, Qun |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2401.09192 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification
par: Liu, Chengwu, et autres
Publié: (2025)
par: Liu, Chengwu, et autres
Publié: (2025)
Data Management For Training Large Language Models: A Survey
par: Wang, Zige, et autres
Publié: (2023)
par: Wang, Zige, et autres
Publié: (2023)
Prompt-Based Length Controlled Generation with Multiple Control Types
par: Jie, Renlong, et autres
Publié: (2024)
par: Jie, Renlong, et autres
Publié: (2024)
Teaching LLMs According to Their Aptitude: Adaptive Reasoning for Mathematical Problem Solving
par: Xu, Xin, et autres
Publié: (2025)
par: Xu, Xin, et autres
Publié: (2025)
YODA: Teacher-Student Progressive Learning for Language Models
par: Lu, Jianqiao, et autres
Publié: (2024)
par: Lu, Jianqiao, et autres
Publié: (2024)
Retrieval-based Disentangled Representation Learning with Natural Language Supervision
par: Zhou, Jiawei, et autres
Publié: (2022)
par: Zhou, Jiawei, et autres
Publié: (2022)
Discover and Prove: An Open-source Agentic Framework for Hard Mode Automated Theorem Proving in Lean 4
par: Liu, Chengwu, et autres
Publié: (2026)
par: Liu, Chengwu, et autres
Publié: (2026)
G-MAP: General Memory-Augmented Pre-trained Language Model for Domain Tasks
par: Wan, Zhongwei, et autres
Publié: (2022)
par: Wan, Zhongwei, et autres
Publié: (2022)
ToolACE-R: Model-aware Iterative Training and Adaptive Refinement for Tool Learning
par: Zeng, Xingshan, et autres
Publié: (2025)
par: Zeng, Xingshan, et autres
Publié: (2025)
Learning to Align Multi-Faceted Evaluation: A Unified and Robust Framework
par: Xu, Kaishuai, et autres
Publié: (2025)
par: Xu, Kaishuai, et autres
Publié: (2025)
Gradually Excavating External Knowledge for Implicit Complex Question Answering
par: Liu, Chang, et autres
Publié: (2026)
par: Liu, Chang, et autres
Publié: (2026)
PROXYQA: An Alternative Framework for Evaluating Long-Form Text Generation with Large Language Models
par: Tan, Haochen, et autres
Publié: (2024)
par: Tan, Haochen, et autres
Publié: (2024)
Evaluating the External and Parametric Knowledge Fusion of Large Language Models
par: Zhang, Hao, et autres
Publié: (2024)
par: Zhang, Hao, et autres
Publié: (2024)
IDInit: A Universal and Stable Initialization Method for Neural Network Training
par: Pan, Yu, et autres
Publié: (2025)
par: Pan, Yu, et autres
Publié: (2025)
Subtle Errors in Reasoning: Preference Learning via Error-injected Self-editing
par: Xu, Kaishuai, et autres
Publié: (2024)
par: Xu, Kaishuai, et autres
Publié: (2024)
Training an LLM-as-a-Judge Model: Pipeline, Insights, and Practical Lessons
par: Hu, Renjun, et autres
Publié: (2025)
par: Hu, Renjun, et autres
Publié: (2025)
ToolACE-MT: Non-Autoregressive Generation for Agentic Multi-Turn Interaction
par: Zeng, Xingshan, et autres
Publié: (2025)
par: Zeng, Xingshan, et autres
Publié: (2025)
Gaining Wisdom from Setbacks: Aligning Large Language Models via Mistake Analysis
par: Chen, Kai, et autres
Publié: (2023)
par: Chen, Kai, et autres
Publié: (2023)
Towards Localized and Disentangled Knowledge Editing for Multimodal Large Language Models
par: Gu, Leijiang, et autres
Publié: (2026)
par: Gu, Leijiang, et autres
Publié: (2026)
Test-Time Training on Graphs with Large Language Models (LLMs)
par: Zhang, Jiaxin, et autres
Publié: (2024)
par: Zhang, Jiaxin, et autres
Publié: (2024)
Progressively Label Enhancement for Large Language Model Alignment
par: Liu, Biao, et autres
Publié: (2024)
par: Liu, Biao, et autres
Publié: (2024)
SELF: Self-Evolution with Language Feedback
par: Lu, Jianqiao, et autres
Publié: (2023)
par: Lu, Jianqiao, et autres
Publié: (2023)
Efficient Network Automatic Relevance Determination
par: Zhang, Hongwei, et autres
Publié: (2025)
par: Zhang, Hongwei, et autres
Publié: (2025)
DrLLM: Prompt-Enhanced Distributed Denial-of-Service Resistance Method with Large Language Models
par: Yin, Zhenyu, et autres
Publié: (2024)
par: Yin, Zhenyu, et autres
Publié: (2024)
Boosting Jailbreak Transferability for Large Language Models
par: Liu, Hanqing, et autres
Publié: (2024)
par: Liu, Hanqing, et autres
Publié: (2024)
Parallels Between VLA Model Post-Training and Human Motor Learning: Progress, Challenges, and Trends
par: Xiang, Tian-Yu, et autres
Publié: (2025)
par: Xiang, Tian-Yu, et autres
Publié: (2025)
CrossCult-KIBench: A Benchmark for Cross-Cultural Knowledge Insertion in MLLMs
par: Zeng, Zhen, et autres
Publié: (2026)
par: Zeng, Zhen, et autres
Publié: (2026)
Enhancing Large Language Model for Knowledge Graph Completion via Structure-Aware Alignment-Tuning
par: Liu, Yu, et autres
Publié: (2025)
par: Liu, Yu, et autres
Publié: (2025)
On Diversified Preferences of Large Language Model Alignment
par: Zeng, Dun, et autres
Publié: (2023)
par: Zeng, Dun, et autres
Publié: (2023)
Towards Benign Memory Forgetting for Selective Multimodal Large Language Model Unlearning
par: Zeng, Zhen, et autres
Publié: (2025)
par: Zeng, Zhen, et autres
Publié: (2025)
Visual-Oriented Fine-Grained Knowledge Editing for MultiModal Large Language Models
par: Zeng, Zhen, et autres
Publié: (2024)
par: Zeng, Zhen, et autres
Publié: (2024)
Partial Differential Equations is All You Need for Generating Neural Architectures -- A Theory for Physical Artificial Intelligence Systems
par: Guo, Ping, et autres
Publié: (2021)
par: Guo, Ping, et autres
Publié: (2021)
Agent-R: Training Language Model Agents to Reflect via Iterative Self-Training
par: Yuan, Siyu, et autres
Publié: (2025)
par: Yuan, Siyu, et autres
Publié: (2025)
GRAMMAR: Grounded and Modular Methodology for Assessment of Closed-Domain Retrieval-Augmented Language Model
par: Li, Xinzhe, et autres
Publié: (2024)
par: Li, Xinzhe, et autres
Publié: (2024)
Tensorized Hypergraph Neural Networks
par: Wang, Maolin, et autres
Publié: (2023)
par: Wang, Maolin, et autres
Publié: (2023)
Graph-Augmented Large Language Model Agents: Current Progress and Future Prospects
par: Liu, Yixin, et autres
Publié: (2025)
par: Liu, Yixin, et autres
Publié: (2025)
ProFuser: Progressive Fusion of Large Language Models
par: Shi, Tianyuan, et autres
Publié: (2024)
par: Shi, Tianyuan, et autres
Publié: (2024)
POINT$^{2}$: A Polymer Informatics Training and Testing Database
par: Xu, Jiaxin, et autres
Publié: (2025)
par: Xu, Jiaxin, et autres
Publié: (2025)
Detail++: Training-Free Detail Enhancer for Text-to-Image Diffusion Models
par: Chen, Lifeng, et autres
Publié: (2025)
par: Chen, Lifeng, et autres
Publié: (2025)
IndexNet: Timestamp and Variable-Aware Modeling for Time Series Forecasting
par: Wu, Beiliang, et autres
Publié: (2025)
par: Wu, Beiliang, et autres
Publié: (2025)
Documents similaires
-
Safe: Enhancing Mathematical Reasoning in Large Language Models via Retrospective Step-aware Formal Verification
par: Liu, Chengwu, et autres
Publié: (2025) -
Data Management For Training Large Language Models: A Survey
par: Wang, Zige, et autres
Publié: (2023) -
Prompt-Based Length Controlled Generation with Multiple Control Types
par: Jie, Renlong, et autres
Publié: (2024) -
Teaching LLMs According to Their Aptitude: Adaptive Reasoning for Mathematical Problem Solving
par: Xu, Xin, et autres
Publié: (2025) -
YODA: Teacher-Student Progressive Learning for Language Models
par: Lu, Jianqiao, et autres
Publié: (2024)