Wave Network: An Ultra-Small Language Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Xin, Sheng, Victor S. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
The Backpropagation of the Wave Network
di: Zhang, Xin, et al.
Pubblicazione: (2024)
di: Zhang, Xin, et al.
Pubblicazione: (2024)
Controlling Chat Style in Language Models via Single-Direction Editing
di: Xu, Zhenyu, et al.
Pubblicazione: (2026)
di: Xu, Zhenyu, et al.
Pubblicazione: (2026)
Collaborative Stance Detection via Small-Large Language Model Consistency Verification
di: Yan, Yu, et al.
Pubblicazione: (2025)
di: Yan, Yu, et al.
Pubblicazione: (2025)
InfiR : Crafting Effective Small Language Models and Multimodal Small Language Models in Reasoning
di: Xie, Congkai, et al.
Pubblicazione: (2025)
di: Xie, Congkai, et al.
Pubblicazione: (2025)
Capturing Nuanced Preferences: Preference-Aligned Distillation for Small Language Models
di: Gu, Yanggan, et al.
Pubblicazione: (2025)
di: Gu, Yanggan, et al.
Pubblicazione: (2025)
Small Language Models Offer Significant Potential for Science Community
di: Zhang, Jian
Pubblicazione: (2025)
di: Zhang, Jian
Pubblicazione: (2025)
TinyLlama: An Open-Source Small Language Model
di: Zhang, Peiyuan, et al.
Pubblicazione: (2024)
di: Zhang, Peiyuan, et al.
Pubblicazione: (2024)
SOD: Step-wise On-policy Distillation for Small Language Model Agents
di: Zhong, Qiyong, et al.
Pubblicazione: (2026)
di: Zhong, Qiyong, et al.
Pubblicazione: (2026)
Small Language Model as Data Prospector for Large Language Model
di: Ni, Shiwen, et al.
Pubblicazione: (2024)
di: Ni, Shiwen, et al.
Pubblicazione: (2024)
Small Language Model Makes an Effective Long Text Extractor
di: Chen, Yelin, et al.
Pubblicazione: (2025)
di: Chen, Yelin, et al.
Pubblicazione: (2025)
Hallucination Detection with Small Language Models
di: Cheung, Ming
Pubblicazione: (2025)
di: Cheung, Ming
Pubblicazione: (2025)
Small Language Model Helps Resolve Semantic Ambiguity of LLM Prompt
di: Huang, Zhenzhen, et al.
Pubblicazione: (2026)
di: Huang, Zhenzhen, et al.
Pubblicazione: (2026)
JiuZhang3.0: Efficiently Improving Mathematical Reasoning by Training Small Data Synthesis Models
di: Zhou, Kun, et al.
Pubblicazione: (2024)
di: Zhou, Kun, et al.
Pubblicazione: (2024)
Small Language Model Can Self-correct
di: Han, Haixia, et al.
Pubblicazione: (2024)
di: Han, Haixia, et al.
Pubblicazione: (2024)
Achieving Sparse Activation in Small Language Models
di: Song, Jifeng, et al.
Pubblicazione: (2024)
di: Song, Jifeng, et al.
Pubblicazione: (2024)
Small Language Models for Curriculum-based Guidance
di: Katharakis, Konstantinos, et al.
Pubblicazione: (2025)
di: Katharakis, Konstantinos, et al.
Pubblicazione: (2025)
Empathetic Cascading Networks: A Multi-Stage Prompting Technique for Reducing Social Biases in Large Language Models
di: Xin, Wangjiaxuan
Pubblicazione: (2025)
di: Xin, Wangjiaxuan
Pubblicazione: (2025)
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
di: Wang, Jingyuan, et al.
Pubblicazione: (2025)
di: Wang, Jingyuan, et al.
Pubblicazione: (2025)
Distilling Mathematical Reasoning Capabilities into Small Language Models
di: Zhu, Xunyu, et al.
Pubblicazione: (2024)
di: Zhu, Xunyu, et al.
Pubblicazione: (2024)
Efficient Long CoT Reasoning in Small Language Models
di: Wang, Zhaoyang, et al.
Pubblicazione: (2025)
di: Wang, Zhaoyang, et al.
Pubblicazione: (2025)
Latent Multi-Head Attention for Small Language Models
di: Mehta, Sushant, et al.
Pubblicazione: (2025)
di: Mehta, Sushant, et al.
Pubblicazione: (2025)
Confidence-Calibrated Small-Large Language Model Collaboration for Cost-Efficient Reasoning
di: Zhang, Chuang, et al.
Pubblicazione: (2026)
di: Zhang, Chuang, et al.
Pubblicazione: (2026)
Plug-in and Fine-tuning: Bridging the Gap between Small Language Models and Large Language Models
di: Kim, Kyeonghyun, et al.
Pubblicazione: (2025)
di: Kim, Kyeonghyun, et al.
Pubblicazione: (2025)
Small Language Models Fine-tuned to Coordinate Larger Language Models improve Complex Reasoning
di: Juneja, Gurusha, et al.
Pubblicazione: (2023)
di: Juneja, Gurusha, et al.
Pubblicazione: (2023)
Prompting Strategies for Language Model-Based Item Generation in K-12 Education: Bridging the Gap Between Small and Large Language Models
di: Amini, Mohammad, et al.
Pubblicazione: (2025)
di: Amini, Mohammad, et al.
Pubblicazione: (2025)
Federated Co-tuning Framework for Large and Small Language Models
di: Fan, Tao, et al.
Pubblicazione: (2024)
di: Fan, Tao, et al.
Pubblicazione: (2024)
SLM as Guardian: Pioneering AI Safety with Small Language Models
di: Kwon, Ohjoon, et al.
Pubblicazione: (2024)
di: Kwon, Ohjoon, et al.
Pubblicazione: (2024)
TrueBrief: Faithful Summarization through Small Language Models
di: Lakara, Kumud, et al.
Pubblicazione: (2025)
di: Lakara, Kumud, et al.
Pubblicazione: (2025)
Sensitivity of Small Language Models to Fine-tuning Data Contamination
di: Scaria, Nicy, et al.
Pubblicazione: (2025)
di: Scaria, Nicy, et al.
Pubblicazione: (2025)
Sadeed: Advancing Arabic Diacritization Through Small Language Model
di: Aldallal, Zeina, et al.
Pubblicazione: (2025)
di: Aldallal, Zeina, et al.
Pubblicazione: (2025)
Evidence of Phase Transitions in Small Transformer-Based Language Models
di: Hong, Noah, et al.
Pubblicazione: (2025)
di: Hong, Noah, et al.
Pubblicazione: (2025)
The Rise of Small Language Models in Healthcare: A Comprehensive Survey
di: Garg, Muskan, et al.
Pubblicazione: (2025)
di: Garg, Muskan, et al.
Pubblicazione: (2025)
Decoupling Understanding from Reasoning via Problem Space Mapping for Small-Scale Model Reasoning
di: Wang, Li, et al.
Pubblicazione: (2025)
di: Wang, Li, et al.
Pubblicazione: (2025)
Lifelong Evolution: Collaborative Learning between Large and Small Language Models for Continuous Emergent Fake News Detection
di: Zhou, Ziyi, et al.
Pubblicazione: (2025)
di: Zhou, Ziyi, et al.
Pubblicazione: (2025)
Pangu Ultra: Pushing the Limits of Dense Large Language Models on Ascend NPUs
di: Yin, Yichun, et al.
Pubblicazione: (2025)
di: Yin, Yichun, et al.
Pubblicazione: (2025)
Configurable Safety Tuning of Language Models with Synthetic Preference Data
di: Gallego, Victor
Pubblicazione: (2024)
di: Gallego, Victor
Pubblicazione: (2024)
Can Small Language Models Help Large Language Models Reason Better?: LM-Guided Chain-of-Thought
di: Lee, Jooyoung, et al.
Pubblicazione: (2024)
di: Lee, Jooyoung, et al.
Pubblicazione: (2024)
Cross-Domain Content Generation with Domain-Specific Small Language Models
di: Maloo, Ankit, et al.
Pubblicazione: (2024)
di: Maloo, Ankit, et al.
Pubblicazione: (2024)
No Reliable Evidence of Self-Reported Sentience in Small Large Language Models
di: Kaiser, Caspar, et al.
Pubblicazione: (2026)
di: Kaiser, Caspar, et al.
Pubblicazione: (2026)
An Empirical Study of SFT-DPO Interaction and Parameterization in Small Language Models
di: Feng, Yuming, et al.
Pubblicazione: (2026)
di: Feng, Yuming, et al.
Pubblicazione: (2026)
Documenti analoghi
-
The Backpropagation of the Wave Network
di: Zhang, Xin, et al.
Pubblicazione: (2024) -
Controlling Chat Style in Language Models via Single-Direction Editing
di: Xu, Zhenyu, et al.
Pubblicazione: (2026) -
Collaborative Stance Detection via Small-Large Language Model Consistency Verification
di: Yan, Yu, et al.
Pubblicazione: (2025) -
InfiR : Crafting Effective Small Language Models and Multimodal Small Language Models in Reasoning
di: Xie, Congkai, et al.
Pubblicazione: (2025) -
Capturing Nuanced Preferences: Preference-Aligned Distillation for Small Language Models
di: Gu, Yanggan, et al.
Pubblicazione: (2025)