ZeroLM: Data-Free Transformer Architecture Search for Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Chen, Zhen-Song, Ding, Hong-Wei, Wang, Xian-Jia, Pedrycz, Witold |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
LLM4CMO: Large Language Model-aided Algorithm Design for Constrained Multiobjective Optimization
von: Chen, Zhen-Song, et al.
Veröffentlicht: (2025)
von: Chen, Zhen-Song, et al.
Veröffentlicht: (2025)
DecompressionLM: Deterministic, Diagnostic, and Zero-Shot Concept Graph Extraction from Language Models
von: Hong, Zhaochen, et al.
Veröffentlicht: (2026)
von: Hong, Zhaochen, et al.
Veröffentlicht: (2026)
Replicating ReLM Results: Validating Large Language Models with ReLM
von: Adamson, Reece, et al.
Veröffentlicht: (2025)
von: Adamson, Reece, et al.
Veröffentlicht: (2025)
LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models
von: Han, Chi, et al.
Veröffentlicht: (2023)
von: Han, Chi, et al.
Veröffentlicht: (2023)
LM-mixup: Text Data Augmentation via Language Model based Mixup
von: Deng, Zhijie, et al.
Veröffentlicht: (2025)
von: Deng, Zhijie, et al.
Veröffentlicht: (2025)
LM-Searcher: Cross-domain Neural Architecture Search with LLMs via Unified Numerical Encoding
von: Hu, Yuxuan, et al.
Veröffentlicht: (2025)
von: Hu, Yuxuan, et al.
Veröffentlicht: (2025)
DecorateLM: Data Engineering through Corpus Rating, Tagging, and Editing with Language Models
von: Zhao, Ranchi, et al.
Veröffentlicht: (2024)
von: Zhao, Ranchi, et al.
Veröffentlicht: (2024)
LM Transparency Tool: Interactive Tool for Analyzing Transformer Language Models
von: Tufanov, Igor, et al.
Veröffentlicht: (2024)
von: Tufanov, Igor, et al.
Veröffentlicht: (2024)
TacoLM: GaTed Attention Equipped Codec Language Model are Efficient Zero-Shot Text to Speech Synthesizers
von: Song, Yakun, et al.
Veröffentlicht: (2024)
von: Song, Yakun, et al.
Veröffentlicht: (2024)
LPZero: Language Model Zero-cost Proxy Search from Zero
von: Dong, Peijie, et al.
Veröffentlicht: (2024)
von: Dong, Peijie, et al.
Veröffentlicht: (2024)
EvoLM: In Search of Lost Language Model Training Dynamics
von: Qi, Zhenting, et al.
Veröffentlicht: (2025)
von: Qi, Zhenting, et al.
Veröffentlicht: (2025)
AdaPonderLM: Gated Pondering Language Models with Token-Wise Adaptive Depth
von: Song, Shixiang, et al.
Veröffentlicht: (2026)
von: Song, Shixiang, et al.
Veröffentlicht: (2026)
CodecLM: Aligning Language Models with Tailored Synthetic Data
von: Wang, Zifeng, et al.
Veröffentlicht: (2024)
von: Wang, Zifeng, et al.
Veröffentlicht: (2024)
DATE-LM: Benchmarking Data Attribution Evaluation for Large Language Models
von: Jiao, Cathy, et al.
Veröffentlicht: (2025)
von: Jiao, Cathy, et al.
Veröffentlicht: (2025)
LM-PUB-QUIZ: A Comprehensive Framework for Zero-Shot Evaluation of Relational Knowledge in Language Models
von: Ploner, Max, et al.
Veröffentlicht: (2024)
von: Ploner, Max, et al.
Veröffentlicht: (2024)
PonderLM: Pretraining Language Models to Ponder in Continuous Space
von: Zeng, Boyi, et al.
Veröffentlicht: (2025)
von: Zeng, Boyi, et al.
Veröffentlicht: (2025)
B-cos LM: Efficiently Transforming Pre-trained Language Models for Improved Explainability
von: Wang, Yifan, et al.
Veröffentlicht: (2025)
von: Wang, Yifan, et al.
Veröffentlicht: (2025)
MimicLM: Zero-Shot Voice Imitation through Autoregressive Modeling of Pseudo-Parallel Speech Corpora
von: Feng, Tao, et al.
Veröffentlicht: (2026)
von: Feng, Tao, et al.
Veröffentlicht: (2026)
LegiLM: A Fine-Tuned Legal Language Model for Data Compliance
von: Zhu, Linkai, et al.
Veröffentlicht: (2024)
von: Zhu, Linkai, et al.
Veröffentlicht: (2024)
AntLM: Bridging Causal and Masked Language Models
von: Yu, Xinru, et al.
Veröffentlicht: (2024)
von: Yu, Xinru, et al.
Veröffentlicht: (2024)
InternLM-XComposer2: Mastering Free-form Text-Image Composition and Comprehension in Vision-Language Large Model
von: Dong, Xiaoyi, et al.
Veröffentlicht: (2024)
von: Dong, Xiaoyi, et al.
Veröffentlicht: (2024)
Semformer: Transformer Language Models with Semantic Planning
von: Yin, Yongjing, et al.
Veröffentlicht: (2024)
von: Yin, Yongjing, et al.
Veröffentlicht: (2024)
Elastic Architecture Search for Efficient Language Models
von: Wang, Shang
Veröffentlicht: (2025)
von: Wang, Shang
Veröffentlicht: (2025)
KaLM-Embedding: Superior Training Data Brings A Stronger Embedding Model
von: Hu, Xinshuo, et al.
Veröffentlicht: (2025)
von: Hu, Xinshuo, et al.
Veröffentlicht: (2025)
DiffLM: Controllable Synthetic Data Generation via Diffusion Language Models
von: Zhou, Ying, et al.
Veröffentlicht: (2024)
von: Zhou, Ying, et al.
Veröffentlicht: (2024)
Socratic-Zero : Bootstrapping Reasoning via Data-Free Agent Co-evolution
von: Wang, Shaobo, et al.
Veröffentlicht: (2025)
von: Wang, Shaobo, et al.
Veröffentlicht: (2025)
InternLM-Math: Open Math Large Language Models Toward Verifiable Reasoning
von: Ying, Huaiyuan, et al.
Veröffentlicht: (2024)
von: Ying, Huaiyuan, et al.
Veröffentlicht: (2024)
Attention-guided Self-reflection for Zero-shot Hallucination Detection in Large Language Models
von: Liu, Qiang, et al.
Veröffentlicht: (2025)
von: Liu, Qiang, et al.
Veröffentlicht: (2025)
Jet-Nemotron: Efficient Language Model with Post Neural Architecture Search
von: Gu, Yuxian, et al.
Veröffentlicht: (2025)
von: Gu, Yuxian, et al.
Veröffentlicht: (2025)
ControlLM: Crafting Diverse Personalities for Language Models
von: Weng, Yixuan, et al.
Veröffentlicht: (2024)
von: Weng, Yixuan, et al.
Veröffentlicht: (2024)
LGBQPC: Local Granular-Ball Quality Peaks Clustering
von: Jia, Zihang, et al.
Veröffentlicht: (2025)
von: Jia, Zihang, et al.
Veröffentlicht: (2025)
Generation of Granular-Balls for Clustering Based on the Principle of Justifiable Granularity
von: Jia, Zihang, et al.
Veröffentlicht: (2024)
von: Jia, Zihang, et al.
Veröffentlicht: (2024)
REDAffectiveLM: Leveraging Affect Enriched Embedding and Transformer-based Neural Language Model for Readers' Emotion Detection
von: Kadan, Anoop, et al.
Veröffentlicht: (2023)
von: Kadan, Anoop, et al.
Veröffentlicht: (2023)
InternLM-Law: An Open Source Chinese Legal Large Language Model
von: Fei, Zhiwei, et al.
Veröffentlicht: (2024)
von: Fei, Zhiwei, et al.
Veröffentlicht: (2024)
ReaLM: Reflection-Enhanced Autonomous Reasoning with Small Language Models
von: Xu, Yuanfeng, et al.
Veröffentlicht: (2025)
von: Xu, Yuanfeng, et al.
Veröffentlicht: (2025)
Foundation CAN LM: A Pretrained Language Model For Automotive CAN Data
von: Esashi, Akiharu, et al.
Veröffentlicht: (2026)
von: Esashi, Akiharu, et al.
Veröffentlicht: (2026)
Kanbun-LM: Reading and Translating Classical Chinese in Japanese Methods by Language Models
von: Wang, Hao, et al.
Veröffentlicht: (2023)
von: Wang, Hao, et al.
Veröffentlicht: (2023)
Development of a Reliable and Accessible Caregiving Language Model (CaLM)
von: Parmanto, Bambang, et al.
Veröffentlicht: (2024)
von: Parmanto, Bambang, et al.
Veröffentlicht: (2024)
PrivLM-Bench: A Multi-level Privacy Evaluation Benchmark for Language Models
von: Li, Haoran, et al.
Veröffentlicht: (2023)
von: Li, Haoran, et al.
Veröffentlicht: (2023)
TokenSmith: Streamlining Data Editing, Search, and Inspection for Large-Scale Language Model Training and Interpretability
von: Khan, Mohammad Aflah, et al.
Veröffentlicht: (2025)
von: Khan, Mohammad Aflah, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
LLM4CMO: Large Language Model-aided Algorithm Design for Constrained Multiobjective Optimization
von: Chen, Zhen-Song, et al.
Veröffentlicht: (2025) -
DecompressionLM: Deterministic, Diagnostic, and Zero-Shot Concept Graph Extraction from Language Models
von: Hong, Zhaochen, et al.
Veröffentlicht: (2026) -
Replicating ReLM Results: Validating Large Language Models with ReLM
von: Adamson, Reece, et al.
Veröffentlicht: (2025) -
LM-Infinite: Zero-Shot Extreme Length Generalization for Large Language Models
von: Han, Chi, et al.
Veröffentlicht: (2023) -
LM-mixup: Text Data Augmentation via Language Model based Mixup
von: Deng, Zhijie, et al.
Veröffentlicht: (2025)