Acquiring Bidirectionality via Large and Small Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Goto, Takumi, Nagao, Hiroyoshi, Koreeda, Yuta |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Building Domain-Specific Small Language Models via Guided Data Generation
by: Kumar, Aman, et al.
Published: (2025)
by: Kumar, Aman, et al.
Published: (2025)
Improving Explainability of Sentence-level Metrics via Edit-level Attribution for Grammatical Error Correction
by: Goto, Takumi, et al.
Published: (2024)
by: Goto, Takumi, et al.
Published: (2024)
Agent Fine-tuning through Distillation for Domain-specific LLMs in Microdomains
by: Xue, Yawen, et al.
Published: (2025)
by: Xue, Yawen, et al.
Published: (2025)
Is Micro Domain-Adaptive Pre-Training Effective for Real-World Operations? Multi-Step Evaluation Reveals Potential and Bottlenecks
by: Tsunokake, Masaya, et al.
Published: (2026)
by: Tsunokake, Masaya, et al.
Published: (2026)
Acquiring Common Chinese Emotional Events Using Large Language Model
by: Wang, Ya, et al.
Published: (2025)
by: Wang, Ya, et al.
Published: (2025)
Edit-level Majority Voting Mitigates Over-Correction in LLM-based Grammatical Error Correction
by: Goto, Takumi, et al.
Published: (2026)
by: Goto, Takumi, et al.
Published: (2026)
gec-metrics: A Unified Library for Grammatical Error Correction Evaluation
by: Goto, Takumi, et al.
Published: (2025)
by: Goto, Takumi, et al.
Published: (2025)
Reliability Crisis of Reference-free Metrics for Grammatical Error Correction
by: Goto, Takumi, et al.
Published: (2025)
by: Goto, Takumi, et al.
Published: (2025)
Rethinking Evaluation Metrics for Grammatical Error Correction: Why Use a Different Evaluation Process than Human?
by: Goto, Takumi, et al.
Published: (2025)
by: Goto, Takumi, et al.
Published: (2025)
Grammatical Error Correction Evaluation by Optimally Transporting Edit Representation
by: Goto, Takumi, et al.
Published: (2026)
by: Goto, Takumi, et al.
Published: (2026)
LCES: Zero-shot Automated Essay Scoring via Pairwise Comparisons Using Large Language Models
by: Shibata, Takumi, et al.
Published: (2025)
by: Shibata, Takumi, et al.
Published: (2025)
STEP: Staged Parameter-Efficient Pre-training for Large Language Models
by: Yano, Kazuki, et al.
Published: (2025)
by: Yano, Kazuki, et al.
Published: (2025)
Mutarjim: Advancing Bidirectional Arabic-English Translation with a Small Language Model
by: Hennara, Khalil, et al.
Published: (2025)
by: Hennara, Khalil, et al.
Published: (2025)
IMPARA-GED: Grammatical Error Detection is Boosting Reference-free Grammatical Error Quality Estimator
by: Sakai, Yusuke, et al.
Published: (2025)
by: Sakai, Yusuke, et al.
Published: (2025)
Personality, Role, and Expressive Style in Large Language Models: An Interactionist Analysis
by: Nagao, Moe, et al.
Published: (2026)
by: Nagao, Moe, et al.
Published: (2026)
How Do Language Models Acquire Character-Level Information?
by: Sato, Soma, et al.
Published: (2026)
by: Sato, Soma, et al.
Published: (2026)
How Do Large Language Models Acquire Factual Knowledge During Pretraining?
by: Chang, Hoyeon, et al.
Published: (2024)
by: Chang, Hoyeon, et al.
Published: (2024)
Can Visual Encoder Learn to See Arrows?
by: Terashita, Naoyuki, et al.
Published: (2025)
by: Terashita, Naoyuki, et al.
Published: (2025)
Bi-Chainer: Automated Large Language Models Reasoning with Bidirectional Chaining
by: Liu, Shuqi, et al.
Published: (2024)
by: Liu, Shuqi, et al.
Published: (2024)
Response Generation for Cognitive Behavioral Therapy with Large Language Models: Comparative Study with Socratic Questioning
by: Izumi, Kenta, et al.
Published: (2024)
by: Izumi, Kenta, et al.
Published: (2024)
Acquiring and Modelling Abstract Commonsense Knowledge via Conceptualization
by: He, Mutian, et al.
Published: (2022)
by: He, Mutian, et al.
Published: (2022)
Self-Improving Language Models with Bidirectional Evolutionary Search
by: Xu, Guowei, et al.
Published: (2026)
by: Xu, Guowei, et al.
Published: (2026)
Small Language Model as Data Prospector for Large Language Model
by: Ni, Shiwen, et al.
Published: (2024)
by: Ni, Shiwen, et al.
Published: (2024)
BiSup: Bidirectional Quantization Error Suppression for Large Language Models
by: Zou, Minghui, et al.
Published: (2024)
by: Zou, Minghui, et al.
Published: (2024)
Small Language Models as Effective Guides for Large Language Models in Chinese Relation Extraction
by: Tang, Xuemei, et al.
Published: (2024)
by: Tang, Xuemei, et al.
Published: (2024)
Exploring Concept Depth: How Large Language Models Acquire Knowledge and Concept at Different Layers?
by: Jin, Mingyu, et al.
Published: (2024)
by: Jin, Mingyu, et al.
Published: (2024)
LIT-RAGBench: Benchmarking Generator Capabilities of Large Language Models in Retrieval-Augmented Generation
by: Itai, Koki, et al.
Published: (2026)
by: Itai, Koki, et al.
Published: (2026)
KG-BiLM: Knowledge Graph Embedding via Bidirectional Language Models
by: Chen, Zirui, et al.
Published: (2025)
by: Chen, Zirui, et al.
Published: (2025)
Collaborative Stance Detection via Small-Large Language Model Consistency Verification
by: Yan, Yu, et al.
Published: (2025)
by: Yan, Yu, et al.
Published: (2025)
Evaluation of the Automated Labeling Method for Taxonomic Nomenclature Through Prompt-Optimized Large Language Model
by: Inoshita, Keito, et al.
Published: (2025)
by: Inoshita, Keito, et al.
Published: (2025)
TinyGPT-V: Efficient Multimodal Large Language Model via Small Backbones
by: Yuan, Zhengqing, et al.
Published: (2023)
by: Yuan, Zhengqing, et al.
Published: (2023)
Semantic Source Code Segmentation using Small and Large Language Models
by: Dahou, Abdelhalim, et al.
Published: (2025)
by: Dahou, Abdelhalim, et al.
Published: (2025)
All Language Models Large and Small
by: Chen, Zhixun, et al.
Published: (2024)
by: Chen, Zhixun, et al.
Published: (2024)
Bigger But Not Better: Small Neural Language Models Outperform Large Language Models in Detection of Thought Disorder
by: Li, Changye, et al.
Published: (2025)
by: Li, Changye, et al.
Published: (2025)
On Entity Identification in Language Models
by: Sakata, Masaki, et al.
Published: (2025)
by: Sakata, Masaki, et al.
Published: (2025)
The Bidirectional Process Reward Model
by: Zhang, Lingyin, et al.
Published: (2025)
by: Zhang, Lingyin, et al.
Published: (2025)
BLADE: Enhancing Black-box Large Language Models with Small Domain-Specific Models
by: Li, Haitao, et al.
Published: (2024)
by: Li, Haitao, et al.
Published: (2024)
DiReCT: Diagnostic Reasoning for Clinical Notes via Large Language Models
by: Wang, Bowen, et al.
Published: (2024)
by: Wang, Bowen, et al.
Published: (2024)
Blockwise SFT for Diffusion Language Models: Reconciling Bidirectional Attention and Autoregressive Decoding
by: Sun, Bowen, et al.
Published: (2025)
by: Sun, Bowen, et al.
Published: (2025)
FlowNIB: An Information Bottleneck Analysis of Bidirectional vs. Unidirectional Language Models
by: Kowsher, Md, et al.
Published: (2025)
by: Kowsher, Md, et al.
Published: (2025)
Similar Items
-
Building Domain-Specific Small Language Models via Guided Data Generation
by: Kumar, Aman, et al.
Published: (2025) -
Improving Explainability of Sentence-level Metrics via Edit-level Attribution for Grammatical Error Correction
by: Goto, Takumi, et al.
Published: (2024) -
Agent Fine-tuning through Distillation for Domain-specific LLMs in Microdomains
by: Xue, Yawen, et al.
Published: (2025) -
Is Micro Domain-Adaptive Pre-Training Effective for Real-World Operations? Multi-Step Evaluation Reveals Potential and Bottlenecks
by: Tsunokake, Masaya, et al.
Published: (2026) -
Acquiring Common Chinese Emotional Events Using Large Language Model
by: Wang, Ya, et al.
Published: (2025)