An Overview on Language Models: Recent Developments and Outlook
Fuente:
arXiv
Guardado en:
| Autores principales: | Wei, Chengwei, Wang, Yun-Cheng, Wang, Bin, Kuo, C. -C. Jay |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Word Embedding Dimension Reduction via Weakly-Supervised Feature Selection
por: Xue, Jintang, et al.
Publicado: (2024)
por: Xue, Jintang, et al.
Publicado: (2024)
GWPT: A Green Word-Embedding-based POS Tagger
por: Wei, Chengwei, et al.
Publicado: (2024)
por: Wei, Chengwei, et al.
Publicado: (2024)
Self-Improvement of Large Language Models: A Technical Overview and Future Outlook
por: Yang, Haoyan, et al.
Publicado: (2026)
por: Yang, Haoyan, et al.
Publicado: (2026)
Resilience of Large Language Models for Noisy Instructions
por: Wang, Bin, et al.
Publicado: (2024)
por: Wang, Bin, et al.
Publicado: (2024)
IFEval-Audio: Benchmarking Instruction-Following Capability in Audio-based Large Language Models
por: Gao, Yiming, et al.
Publicado: (2025)
por: Gao, Yiming, et al.
Publicado: (2025)
Towards Spoken Mathematical Reasoning: Benchmarking Speech-based Models over Multi-faceted Math Problems
por: Wei, Chengwei, et al.
Publicado: (2025)
por: Wei, Chengwei, et al.
Publicado: (2025)
Large Language Models for Education: A Survey and Outlook
por: Wang, Shen, et al.
Publicado: (2024)
por: Wang, Shen, et al.
Publicado: (2024)
Promises, Outlooks and Challenges of Diffusion Language Modeling
por: Deschenaux, Justin, et al.
Publicado: (2024)
por: Deschenaux, Justin, et al.
Publicado: (2024)
Efficient Human-Object-Interaction (EHOI) Detection via Interaction Label Coding and Conditional Decision
por: Yang, Tsung-Shan, et al.
Publicado: (2024)
por: Yang, Tsung-Shan, et al.
Publicado: (2024)
CRAFT: Extracting and Tuning Cultural Instructions from the Wild
por: Wang, Bin, et al.
Publicado: (2024)
por: Wang, Bin, et al.
Publicado: (2024)
CoinMath: Harnessing the Power of Coding Instruction for Math LLMs
por: Wei, Chengwei, et al.
Publicado: (2024)
por: Wei, Chengwei, et al.
Publicado: (2024)
Data Mixing for Large Language Models Pretraining: A Survey and Outlook
por: Chen, Zhuo, et al.
Publicado: (2026)
por: Chen, Zhuo, et al.
Publicado: (2026)
Editing the Mind of Giants: An In-Depth Exploration of Pitfalls of Knowledge Editing in Large Language Models
por: Hsueh, Cheng-Hsun, et al.
Publicado: (2024)
por: Hsueh, Cheng-Hsun, et al.
Publicado: (2024)
DRQA: Dynamic Reasoning Quota Allocation for Controlling Overthinking in Reasoning Large Language Models
por: Yan, Kaiwen, et al.
Publicado: (2025)
por: Yan, Kaiwen, et al.
Publicado: (2025)
A Comprehensive Overview of Large Language Models
por: Naveed, Humza, et al.
Publicado: (2023)
por: Naveed, Humza, et al.
Publicado: (2023)
TRAM: Benchmarking Temporal Reasoning for Large Language Models
por: Wang, Yuqing, et al.
Publicado: (2023)
por: Wang, Yuqing, et al.
Publicado: (2023)
BlackDAN: A Black-Box Multi-Objective Approach for Effective and Contextual Jailbreaking of Large Language Models
por: Wang, Xinyuan, et al.
Publicado: (2024)
por: Wang, Xinyuan, et al.
Publicado: (2024)
Pitfalls and Outlooks in Using COMET
por: Zouhar, Vilém, et al.
Publicado: (2024)
por: Zouhar, Vilém, et al.
Publicado: (2024)
Confidence-Aware Sub-Structure Beam Search (CABS): Mitigating Hallucination in Structured Data Generation with Large Language Models
por: Wei, Chengwei, et al.
Publicado: (2024)
por: Wei, Chengwei, et al.
Publicado: (2024)
Chain of LoRA: Efficient Fine-tuning of Language Models via Residual Learning
por: Xia, Wenhan, et al.
Publicado: (2024)
por: Xia, Wenhan, et al.
Publicado: (2024)
Global-Recent Semantic Reasoning on Dynamic Text-Attributed Graphs with Large Language Models
por: Wang, Yunan, et al.
Publicado: (2025)
por: Wang, Yunan, et al.
Publicado: (2025)
RUPBench: Benchmarking Reasoning Under Perturbations for Robustness Evaluation in Large Language Models
por: Wang, Yuqing, et al.
Publicado: (2024)
por: Wang, Yuqing, et al.
Publicado: (2024)
Overview of the PromptCBLUE Shared Task in CHIP2023
por: Zhu, Wei, et al.
Publicado: (2023)
por: Zhu, Wei, et al.
Publicado: (2023)
KV Shifting Attention Enhances Language Modeling
por: Xu, Mingyu, et al.
Publicado: (2024)
por: Xu, Mingyu, et al.
Publicado: (2024)
Theory of Mind in Large Language Models: Assessment and Enhancement
por: Chen, Ruirui, et al.
Publicado: (2025)
por: Chen, Ruirui, et al.
Publicado: (2025)
FMBench: Adaptive Large Language Model Output Formatting
por: Wang, Yaoting, et al.
Publicado: (2026)
por: Wang, Yaoting, et al.
Publicado: (2026)
Overview of the CAIL 2023 Argument Mining Track
por: Liang, Jingcong, et al.
Publicado: (2024)
por: Liang, Jingcong, et al.
Publicado: (2024)
Astra: Activation-Space Tail-Eigenvector Low-Rank Adaptation of Large Language Models
por: Liu, Kainan, et al.
Publicado: (2026)
por: Liu, Kainan, et al.
Publicado: (2026)
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
por: Lee, Jooyoung, et al.
Publicado: (2024)
por: Lee, Jooyoung, et al.
Publicado: (2024)
Thinking with Nothinking Calibration: A New In-Context Learning Paradigm in Reasoning Large Language Models
por: Wu, Haotian, et al.
Publicado: (2025)
por: Wu, Haotian, et al.
Publicado: (2025)
A Study on Training and Developing Large Language Models for Behavior Tree Generation
por: Li, Fu, et al.
Publicado: (2024)
por: Li, Fu, et al.
Publicado: (2024)
Metacognitive Prompting Improves Understanding in Large Language Models
por: Wang, Yuqing, et al.
Publicado: (2023)
por: Wang, Yuqing, et al.
Publicado: (2023)
Multilingual Machine Translation with Open Large Language Models at Practical Scale: An Empirical Study
por: Cui, Menglong, et al.
Publicado: (2025)
por: Cui, Menglong, et al.
Publicado: (2025)
DoTA: Weight-Decomposed Tensor Adaptation for Large Language Models
por: Hu, Xiaolin, et al.
Publicado: (2024)
por: Hu, Xiaolin, et al.
Publicado: (2024)
An Overview of Large Language Models for Statisticians
por: Ji, Wenlong, et al.
Publicado: (2025)
por: Ji, Wenlong, et al.
Publicado: (2025)
Performance of Recent Large Language Models for a Low-Resourced Language
por: Jayakody, Ravindu, et al.
Publicado: (2024)
por: Jayakody, Ravindu, et al.
Publicado: (2024)
Schrodinger's Memory: Large Language Models
por: Wang, Wei, et al.
Publicado: (2024)
por: Wang, Wei, et al.
Publicado: (2024)
Are Large Language Models Effective Knowledge Graph Constructors?
por: Chen, Ruirui, et al.
Publicado: (2025)
por: Chen, Ruirui, et al.
Publicado: (2025)
AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models
por: Yeh, Cheng-Kai, et al.
Publicado: (2025)
por: Yeh, Cheng-Kai, et al.
Publicado: (2025)
Efficient Tuning and Inference for Large Language Models on Textual Graphs
por: Zhu, Yun, et al.
Publicado: (2024)
por: Zhu, Yun, et al.
Publicado: (2024)
Ejemplares similares
-
Word Embedding Dimension Reduction via Weakly-Supervised Feature Selection
por: Xue, Jintang, et al.
Publicado: (2024) -
GWPT: A Green Word-Embedding-based POS Tagger
por: Wei, Chengwei, et al.
Publicado: (2024) -
Self-Improvement of Large Language Models: A Technical Overview and Future Outlook
por: Yang, Haoyan, et al.
Publicado: (2026) -
Resilience of Large Language Models for Noisy Instructions
por: Wang, Bin, et al.
Publicado: (2024) -
IFEval-Audio: Benchmarking Instruction-Following Capability in Audio-based Large Language Models
por: Gao, Yiming, et al.
Publicado: (2025)