Salvato in:
| Autori principali: | Wang, Xiaohua, Huang, Zisu, Zhang, Feiran, Xu, Zhibo, Zhang, Cenyuan, Qian, Qi, Zheng, Xiaoqing, Huang, Xuanjing |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2407.01461 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Aligning Large Language Models with Human Preferences through Representation Engineering
di: Liu, Wenhao, et al.
Pubblicazione: (2023)
di: Liu, Wenhao, et al.
Pubblicazione: (2023)
SpikeBERT: A Language Spikformer Learned from BERT with Knowledge Distillation
di: Lv, Changze, et al.
Pubblicazione: (2023)
di: Lv, Changze, et al.
Pubblicazione: (2023)
Enhancing Model Privacy in Federated Learning with Random Masking and Quantization
di: Xu, Zhibo, et al.
Pubblicazione: (2025)
di: Xu, Zhibo, et al.
Pubblicazione: (2025)
Promoting Data and Model Privacy in Federated Learning through Quantized LoRA
di: Zhu, JianHao, et al.
Pubblicazione: (2024)
di: Zhu, JianHao, et al.
Pubblicazione: (2024)
Progressive Mastery: Customized Curriculum Learning with Guided Prompting for Mathematical Reasoning
di: Wu, Muling, et al.
Pubblicazione: (2025)
di: Wu, Muling, et al.
Pubblicazione: (2025)
IntentionReasoner: Facilitating Adaptive LLM Safeguards through Intent Reasoning and Selective Query Refinement
di: Shen, Yuanzhe, et al.
Pubblicazione: (2025)
di: Shen, Yuanzhe, et al.
Pubblicazione: (2025)
Advancing Parameter Efficiency in Fine-tuning via Representation Editing
di: Wu, Muling, et al.
Pubblicazione: (2024)
di: Wu, Muling, et al.
Pubblicazione: (2024)
Searching for Best Practices in Retrieval-Augmented Generation
di: Wang, Xiaohua, et al.
Pubblicazione: (2024)
di: Wang, Xiaohua, et al.
Pubblicazione: (2024)
Learning Query-Specific Rubrics from Human Preferences for DeepResearch Report Generation
di: Lv, Changze, et al.
Pubblicazione: (2026)
di: Lv, Changze, et al.
Pubblicazione: (2026)
SpikeCLIP: A Contrastive Language-Image Pretrained Spiking Neural Network
di: Lv, Changze, et al.
Pubblicazione: (2023)
di: Lv, Changze, et al.
Pubblicazione: (2023)
Explainable Synthetic Image Detection through Diffusion Timestep Ensembling
di: Wu, Yixin, et al.
Pubblicazione: (2025)
di: Wu, Yixin, et al.
Pubblicazione: (2025)
RoCoIns: Enhancing Robustness of Large Language Models through Code-Style Instructions
di: Zhang, Yuansen, et al.
Pubblicazione: (2024)
di: Zhang, Yuansen, et al.
Pubblicazione: (2024)
Decoding Continuous Character-based Language from Non-invasive Brain Recordings
di: Zhang, Cenyuan, et al.
Pubblicazione: (2024)
di: Zhang, Cenyuan, et al.
Pubblicazione: (2024)
Self-Polish: Enhance Reasoning in Large Language Models via Problem Refinement
di: Xi, Zhiheng, et al.
Pubblicazione: (2023)
di: Xi, Zhiheng, et al.
Pubblicazione: (2023)
On the Tip of the Tongue: Analyzing Conceptual Representation in Large Language Models with Reverse-Dictionary Probe
di: Xu, Ningyu, et al.
Pubblicazione: (2024)
di: Xu, Ningyu, et al.
Pubblicazione: (2024)
CSSG: Measuring Code Similarity with Semantic Graphs
di: Lu, Yiyang, et al.
Pubblicazione: (2026)
di: Lu, Yiyang, et al.
Pubblicazione: (2026)
Benchmark^2: Systematic Evaluation of LLM Benchmarks
di: Qian, Qi, et al.
Pubblicazione: (2026)
di: Qian, Qi, et al.
Pubblicazione: (2026)
Improving Continual Pre-training Through Seamless Data Packing
di: Yin, Ruicheng, et al.
Pubblicazione: (2025)
di: Yin, Ruicheng, et al.
Pubblicazione: (2025)
VIB-Probe: Detecting and Mitigating Hallucinations in Vision-Language Models via Variational Information Bottleneck
di: Zhang, Feiran, et al.
Pubblicazione: (2026)
di: Zhang, Feiran, et al.
Pubblicazione: (2026)
Emergent Structured Representations Support Flexible In-Context Inference in Large Language Models
di: Xu, Ningyu, et al.
Pubblicazione: (2026)
di: Xu, Ningyu, et al.
Pubblicazione: (2026)
Inverse-Q*: Token Level Reinforcement Learning for Aligning Large Language Models Without Preference Data
di: Xia, Han, et al.
Pubblicazione: (2024)
di: Xia, Han, et al.
Pubblicazione: (2024)
UPLex: Fine-Grained Personality Control in Large Language Models via Unsupervised Lexical Modulation
di: Li, Tianlong, et al.
Pubblicazione: (2023)
di: Li, Tianlong, et al.
Pubblicazione: (2023)
Revisiting Jailbreaking for Large Language Models: A Representation Engineering Perspective
di: Li, Tianlong, et al.
Pubblicazione: (2024)
di: Li, Tianlong, et al.
Pubblicazione: (2024)
LLaMA Beyond English: An Empirical Study on Language Capability Transfer
di: Zhao, Jun, et al.
Pubblicazione: (2024)
di: Zhao, Jun, et al.
Pubblicazione: (2024)
Unveiling Linguistic Regions in Large Language Models
di: Zhang, Zhihao, et al.
Pubblicazione: (2024)
di: Zhang, Zhihao, et al.
Pubblicazione: (2024)
BatCoder: Self-Supervised Bidirectional Code-Documentation Learning via Back-Translation
di: Xu, Jingwen, et al.
Pubblicazione: (2026)
di: Xu, Jingwen, et al.
Pubblicazione: (2026)
Layer-Specific Scaling of Positional Encodings for Superior Long-Context Modeling
di: Wang, Zhenghua, et al.
Pubblicazione: (2025)
di: Wang, Zhenghua, et al.
Pubblicazione: (2025)
ToolHop: A Query-Driven Benchmark for Evaluating Large Language Models in Multi-Hop Tool Use
di: Ye, Junjie, et al.
Pubblicazione: (2025)
di: Ye, Junjie, et al.
Pubblicazione: (2025)
ToolEyes: Fine-Grained Evaluation for Tool Learning Capabilities of Large Language Models in Real-world Scenarios
di: Ye, Junjie, et al.
Pubblicazione: (2024)
di: Ye, Junjie, et al.
Pubblicazione: (2024)
SATER: A Self-Aware and Token-Efficient Approach to Routing and Cascading
di: Shen, Yuanzhe, et al.
Pubblicazione: (2025)
di: Shen, Yuanzhe, et al.
Pubblicazione: (2025)
RoTBench: A Multi-Level Benchmark for Evaluating the Robustness of Large Language Models in Tool Learning
di: Ye, Junjie, et al.
Pubblicazione: (2024)
di: Ye, Junjie, et al.
Pubblicazione: (2024)
Exploring the Compositional Deficiency of Large Language Models in Mathematical Reasoning
di: Zhao, Jun, et al.
Pubblicazione: (2024)
di: Zhao, Jun, et al.
Pubblicazione: (2024)
Training Large Language Models for Reasoning through Reverse Curriculum Reinforcement Learning
di: Xi, Zhiheng, et al.
Pubblicazione: (2024)
di: Xi, Zhiheng, et al.
Pubblicazione: (2024)
Enhancing the Traditional Chinese Medicine Capabilities of Large Language Model through Reinforcement Learning from AI Feedback
di: Yu, Song, et al.
Pubblicazione: (2024)
di: Yu, Song, et al.
Pubblicazione: (2024)
Knowledge-to-SQL: Enhancing SQL Generation with Data Expert LLM
di: Hong, Zijin, et al.
Pubblicazione: (2024)
di: Hong, Zijin, et al.
Pubblicazione: (2024)
Critique-RL: Training Language Models for Critiquing through Two-Stage Reinforcement Learning
di: Xi, Zhiheng, et al.
Pubblicazione: (2025)
di: Xi, Zhiheng, et al.
Pubblicazione: (2025)
Improving RL Exploration for LLM Reasoning through Retrospective Replay
di: Dou, Shihan, et al.
Pubblicazione: (2025)
di: Dou, Shihan, et al.
Pubblicazione: (2025)
LLM-DA: Data Augmentation via Large Language Models for Few-Shot Named Entity Recognition
di: Ye, Junjie, et al.
Pubblicazione: (2024)
di: Ye, Junjie, et al.
Pubblicazione: (2024)
Structure Guided Large Language Model for SQL Generation
di: Zhang, Qinggang, et al.
Pubblicazione: (2024)
di: Zhang, Qinggang, et al.
Pubblicazione: (2024)
ErrorLLM: Modeling SQL Errors for Text-to-SQL Refinement
di: Hong, Zijin, et al.
Pubblicazione: (2026)
di: Hong, Zijin, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Aligning Large Language Models with Human Preferences through Representation Engineering
di: Liu, Wenhao, et al.
Pubblicazione: (2023) -
SpikeBERT: A Language Spikformer Learned from BERT with Knowledge Distillation
di: Lv, Changze, et al.
Pubblicazione: (2023) -
Enhancing Model Privacy in Federated Learning with Random Masking and Quantization
di: Xu, Zhibo, et al.
Pubblicazione: (2025) -
Promoting Data and Model Privacy in Federated Learning through Quantized LoRA
di: Zhu, JianHao, et al.
Pubblicazione: (2024) -
Progressive Mastery: Customized Curriculum Learning with Guided Prompting for Mathematical Reasoning
di: Wu, Muling, et al.
Pubblicazione: (2025)