DeepThink: Aligning Language Models with Domain-Specific User Intents
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Yang, Luo, Mingxuan, Gong, Yeyun, Lin, Chen, Jiao, Jian, Liu, Yi, Huang, Kaili |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Think-on-Graph: Deep and Responsible Reasoning of Large Language Model on Knowledge Graph
par: Sun, Jiashuo, et autres
Publié: (2023)
par: Sun, Jiashuo, et autres
Publié: (2023)
Task Oriented In-Domain Data Augmentation
par: Liang, Xiao, et autres
Publié: (2024)
par: Liang, Xiao, et autres
Publié: (2024)
Enhancing Chain-of-Thoughts Prompting with Iterative Bootstrapping in Large Language Models
par: Sun, Jiashuo, et autres
Publié: (2023)
par: Sun, Jiashuo, et autres
Publié: (2023)
HiCaM: A Hierarchical-Causal Modification Framework for Long-Form Text Modification
par: Shi, Yuntao, et autres
Publié: (2025)
par: Shi, Yuntao, et autres
Publié: (2025)
Audio-DeepThinker: Progressive Reasoning-Aware Reinforcement Learning for High-Quality Chain-of-Thought Emergence in Audio Language Models
par: He, Xiang, et autres
Publié: (2026)
par: He, Xiang, et autres
Publié: (2026)
Improving Data and Reward Design for Scientific Reasoning in Large Language Models
par: Chen, Zijie, et autres
Publié: (2026)
par: Chen, Zijie, et autres
Publié: (2026)
Process-based Self-Rewarding Language Models
par: Zhang, Shimao, et autres
Publié: (2025)
par: Zhang, Shimao, et autres
Publié: (2025)
Velocitune: A Velocity-based Dynamic Domain Reweighting Method for Continual Pre-training
par: Luo, Zheheng, et autres
Publié: (2024)
par: Luo, Zheheng, et autres
Publié: (2024)
AnnoLLM: Making Large Language Models to Be Better Crowdsourced Annotators
par: He, Xingwei, et autres
Publié: (2023)
par: He, Xingwei, et autres
Publié: (2023)
Ensuring Safe and High-Quality Outputs: A Guideline Library Approach for Language Models
par: Luo, Yi, et autres
Publié: (2024)
par: Luo, Yi, et autres
Publié: (2024)
Ensembling Large Language Models with Process Reward-Guided Tree Search for Better Complex Reasoning
par: Park, Sungjin, et autres
Publié: (2024)
par: Park, Sungjin, et autres
Publié: (2024)
ConsintBench: Evaluating Language Models on Real-World Consumer Intent Understanding
par: Li, Xiaozhe, et autres
Publié: (2025)
par: Li, Xiaozhe, et autres
Publié: (2025)
Overcoming Vocabulary Mismatch: Vocabulary-agnostic Teacher Guided Language Modeling
par: Shin, Haebin, et autres
Publié: (2025)
par: Shin, Haebin, et autres
Publié: (2025)
ThinkDial: An Open Recipe for Controlling Reasoning Effort in Large Language Models
par: He, Qianyu, et autres
Publié: (2025)
par: He, Qianyu, et autres
Publié: (2025)
A User-Centric Multi-Intent Benchmark for Evaluating Large Language Models
par: Wang, Jiayin, et autres
Publié: (2024)
par: Wang, Jiayin, et autres
Publié: (2024)
Aligning Translation-Specific Understanding to General Understanding in Large Language Models
par: Huang, Yichong, et autres
Publié: (2024)
par: Huang, Yichong, et autres
Publié: (2024)
From Intention To Implementation: Automating Biomedical Research via LLMs
par: Luo, Yi, et autres
Publié: (2024)
par: Luo, Yi, et autres
Publié: (2024)
Enhancing Large Language Model Performance with Gradient-Based Parameter Selection
par: Li, Haoling, et autres
Publié: (2024)
par: Li, Haoling, et autres
Publié: (2024)
SPILL: Domain-Adaptive Intent Clustering based on Selection and Pooling with Large Language Models
par: Lin, I-Fan, et autres
Publié: (2025)
par: Lin, I-Fan, et autres
Publié: (2025)
Fine-Tuned Language Models for Domain-Specific Summarization and Tagging
par: Wang, Jun, et autres
Publié: (2025)
par: Wang, Jun, et autres
Publié: (2025)
DeepThink3D: Enhancing Large Language Models with Programmatic Reasoning in Complex 3D Situated Reasoning Tasks
par: Song, Jiayi, et autres
Publié: (2025)
par: Song, Jiayi, et autres
Publié: (2025)
Think Deep, Not Just Long: Measuring LLM Reasoning Effort via Deep-Thinking Tokens
par: Chen, Wei-Lin, et autres
Publié: (2026)
par: Chen, Wei-Lin, et autres
Publié: (2026)
Rho-1: Not All Tokens Are What You Need
par: Lin, Zhenghao, et autres
Publié: (2024)
par: Lin, Zhenghao, et autres
Publié: (2024)
m3BERT: A Modern, Multi-lingual, Matryoshka Bidirectional Encoder
par: Wang, Yaoxiang, et autres
Publié: (2026)
par: Wang, Yaoxiang, et autres
Publié: (2026)
APOLLO: An Optimized Training Approach for Long-form Numerical Reasoning
par: Sun, Jiashuo, et autres
Publié: (2022)
par: Sun, Jiashuo, et autres
Publié: (2022)
CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing
par: Gou, Zhibin, et autres
Publié: (2023)
par: Gou, Zhibin, et autres
Publié: (2023)
Beyond Length: Quantifying Long-Range Information for Long-Context LLM Pretraining Data
par: Deng, Haoran, et autres
Publié: (2025)
par: Deng, Haoran, et autres
Publié: (2025)
BLADE: Enhancing Black-box Large Language Models with Small Domain-Specific Models
par: Li, Haitao, et autres
Publié: (2024)
par: Li, Haitao, et autres
Publié: (2024)
Aligning Large Language Models with Implicit Preferences from User-Generated Content
par: Tan, Zhaoxuan, et autres
Publié: (2025)
par: Tan, Zhaoxuan, et autres
Publié: (2025)
Examining Forgetting in Continual Pre-training of Aligned Large Language Models
par: Li, Chen-An, et autres
Publié: (2024)
par: Li, Chen-An, et autres
Publié: (2024)
Injecting Domain-Specific Knowledge into Large Language Models: A Comprehensive Survey
par: Song, Zirui, et autres
Publié: (2025)
par: Song, Zirui, et autres
Publié: (2025)
Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training
par: Yang, Kailai, et autres
Publié: (2025)
par: Yang, Kailai, et autres
Publié: (2025)
Optimizing Large Language Model Training Using FP4 Quantization
par: Wang, Ruizhe, et autres
Publié: (2025)
par: Wang, Ruizhe, et autres
Publié: (2025)
IntentCoding: Amplifying User Intent in Code Generation
par: Fang, Zheng, et autres
Publié: (2026)
par: Fang, Zheng, et autres
Publié: (2026)
How Does Alignment Enhance LLMs' Multilingual Capabilities? A Language Neurons Perspective
par: Zhang, Shimao, et autres
Publié: (2025)
par: Zhang, Shimao, et autres
Publié: (2025)
Respond Beyond Language: A Benchmark for Video Generation in Response to Realistic User Intents
par: Wang, Shuting, et autres
Publié: (2025)
par: Wang, Shuting, et autres
Publié: (2025)
Proactive Dialogue Model with Intent Prediction
par: Luo, Yang
Publié: (2026)
par: Luo, Yang
Publié: (2026)
Latent Preference Coding: Aligning Large Language Models via Discrete Latent Codes
par: Gong, Zhuocheng, et autres
Publié: (2025)
par: Gong, Zhuocheng, et autres
Publié: (2025)
Do We Need Domain-Specific Embedding Models? An Empirical Investigation
par: Tang, Yixuan, et autres
Publié: (2024)
par: Tang, Yixuan, et autres
Publié: (2024)
SalesSim: Benchmarking and Aligning Multimodal Language Models as Retail User Simulators
par: Pruksachatkun, Yada, et autres
Publié: (2026)
par: Pruksachatkun, Yada, et autres
Publié: (2026)
Documents similaires
-
Think-on-Graph: Deep and Responsible Reasoning of Large Language Model on Knowledge Graph
par: Sun, Jiashuo, et autres
Publié: (2023) -
Task Oriented In-Domain Data Augmentation
par: Liang, Xiao, et autres
Publié: (2024) -
Enhancing Chain-of-Thoughts Prompting with Iterative Bootstrapping in Large Language Models
par: Sun, Jiashuo, et autres
Publié: (2023) -
HiCaM: A Hierarchical-Causal Modification Framework for Long-Form Text Modification
par: Shi, Yuntao, et autres
Publié: (2025) -
Audio-DeepThinker: Progressive Reasoning-Aware Reinforcement Learning for High-Quality Chain-of-Thought Emergence in Audio Language Models
par: He, Xiang, et autres
Publié: (2026)