Exploring the Reasoning Depth of Small Language Models in Software Architecture: A Multidimensional Evaluation Framework Towards Software Engineering 2.0
Fuente:
arXiv
Saved in:
| Main Authors: | Vo, Ha, Tran, Nhut, Vo, Khang, Tran-Truong, Phat T., Ha, Son |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Measuring the Unmeasurable: Markov Chain Reliability for LLM Agents
by: Tran-Truong, Phat T., et al.
Published: (2026)
by: Tran-Truong, Phat T., et al.
Published: (2026)
Program Structure-aware Language Models: Targeted Software Testing beyond Textual Semantics
by: Tran, Khang, et al.
Published: (2026)
by: Tran, Khang, et al.
Published: (2026)
Evaluating Classical Software Process Models as Coordination Mechanisms for LLM-Based Software Generation
by: Ha, Duc Minh, et al.
Published: (2025)
by: Ha, Duc Minh, et al.
Published: (2025)
Automated Description Generation for Software Patches
by: Vu, Thanh Trong, et al.
Published: (2024)
by: Vu, Thanh Trong, et al.
Published: (2024)
Leveraging AI for Enhanced Software Effort Estimation: A Comprehensive Study and Framework Proposal
by: Tran, Nhi, et al.
Published: (2024)
by: Tran, Nhi, et al.
Published: (2024)
An Architecture for Software Engineering Gamification
by: Pedreira, Óscar, et al.
Published: (2024)
by: Pedreira, Óscar, et al.
Published: (2024)
Towards a Software Reference Architecture for Natural Language Processing Tools in Requirements Engineering
by: Frattini, Julian, et al.
Published: (2026)
by: Frattini, Julian, et al.
Published: (2026)
Impact of Code Transformation on Detection of Smart Contract Vulnerabilities
by: Manh, Cuong Tran, et al.
Published: (2024)
by: Manh, Cuong Tran, et al.
Published: (2024)
Towards an Understanding of Large Language Models in Software Engineering Tasks
by: Zheng, Zibin, et al.
Published: (2023)
by: Zheng, Zibin, et al.
Published: (2023)
Neurosymbolic Architectural Reasoning: Towards Formal Analysis through Neural Software Architecture Inference
by: Herbold, Steffen, et al.
Published: (2025)
by: Herbold, Steffen, et al.
Published: (2025)
An Empirically Grounded Reference Architecture for Software Supply Chain Metadata Management
by: Tran, Nguyen Khoi, et al.
Published: (2023)
by: Tran, Nguyen Khoi, et al.
Published: (2023)
Exploring the Power of Diffusion Large Language Models for Software Engineering: An Empirical Investigation
by: Zhang, Jingyao, et al.
Published: (2025)
by: Zhang, Jingyao, et al.
Published: (2025)
Towards Living Software Architecture Diagrams
by: Correia, Filipe F., et al.
Published: (2024)
by: Correia, Filipe F., et al.
Published: (2024)
Do Research Software Engineers and Software Engineering Researchers Speak the Same Language?
by: Kehrer, Timo, et al.
Published: (2025)
by: Kehrer, Timo, et al.
Published: (2025)
Architectural Support for Software Performance in Continuous Software Engineering: A Systematic Mapping Study
by: Eramo, Romina, et al.
Published: (2023)
by: Eramo, Romina, et al.
Published: (2023)
Agentic AI in the Software Development Lifecycle: Architecture, Empirical Evidence, and the Reshaping of Software Engineering
by: Bhati, Happy
Published: (2026)
by: Bhati, Happy
Published: (2026)
Exploring the Landscape of Fairness Interventions in Software Engineering
by: Mim, Sadia Afrin
Published: (2025)
by: Mim, Sadia Afrin
Published: (2025)
Assessing and Advancing Benchmarks for Evaluating Large Language Models in Software Engineering Tasks
by: Hu, Xing, et al.
Published: (2025)
by: Hu, Xing, et al.
Published: (2025)
The Architecture Tradeoff and Risk Analysis Framework (ATRAF): A Unified Approach for Evaluating Software Architectures, Reference Architectures, and Architectural Frameworks
by: Hassouna, Amine Ben
Published: (2025)
by: Hassouna, Amine Ben
Published: (2025)
A Survey on Large Language Models for Software Engineering
by: Zhang, Quanjun, et al.
Published: (2023)
by: Zhang, Quanjun, et al.
Published: (2023)
Large Language Models in Thematic Analysis: Prompt Engineering, Evaluation, and Guidelines for Qualitative Software Engineering Research
by: Montes, Cristina Martinez, et al.
Published: (2025)
by: Montes, Cristina Martinez, et al.
Published: (2025)
Toward an Architectural Blueprint to Observe Sustainability in and by Software Systems
by: Toczé, Klervie, et al.
Published: (2026)
by: Toczé, Klervie, et al.
Published: (2026)
Towards a Generic Software Architecture for IoT Systems
by: Abuseta, Yousef
Published: (2024)
by: Abuseta, Yousef
Published: (2024)
Analyzing Challenges in Deployment of the SLSA Framework for Software Supply Chain Security
by: Tamanna, Mahzabin, et al.
Published: (2024)
by: Tamanna, Mahzabin, et al.
Published: (2024)
Augmenting the Generality and Performance of Large Language Models for Software Engineering
by: Peña, Fabian C.
Published: (2025)
by: Peña, Fabian C.
Published: (2025)
The Current Challenges of Software Engineering in the Era of Large Language Models
by: Gao, Cuiyun, et al.
Published: (2024)
by: Gao, Cuiyun, et al.
Published: (2024)
Benchmarking and Evaluating VLMs for Software Architecture Diagram Understanding
by: Ouyang, Shuyin, et al.
Published: (2026)
by: Ouyang, Shuyin, et al.
Published: (2026)
Using Sustainability Impact Scores for Software Architecture Evaluation
by: Fatima, Iffat, et al.
Published: (2025)
by: Fatima, Iffat, et al.
Published: (2025)
Do Advanced Language Models Eliminate the Need for Prompt Engineering in Software Engineering?
by: Wang, Guoqing, et al.
Published: (2024)
by: Wang, Guoqing, et al.
Published: (2024)
The Second Round: Diverse Paths Towards Software Engineering
by: Hyrynsalmi, Sonja, et al.
Published: (2024)
by: Hyrynsalmi, Sonja, et al.
Published: (2024)
Towards an Ontology for the Foundations of Software Languages
by: Lämmel, Ralf
Published: (2026)
by: Lämmel, Ralf
Published: (2026)
iSNEAK: Partial Ordering as Heuristics for Model-Based Reasoning in Software Engineering
by: Lustosa, Andre, et al.
Published: (2023)
by: Lustosa, Andre, et al.
Published: (2023)
Teaching Software Metrology: The Science of Measurement for Software Engineering
by: Ralph, Paul, et al.
Published: (2024)
by: Ralph, Paul, et al.
Published: (2024)
Generative Software Engineering
by: Huang, Yuan, et al.
Published: (2024)
by: Huang, Yuan, et al.
Published: (2024)
A Comprehensive Empirical Evaluation of Agent Frameworks on Code-centric Software Engineering Tasks
by: Yin, Zhuowen, et al.
Published: (2025)
by: Yin, Zhuowen, et al.
Published: (2025)
Towards Understanding the Impact of Data Bugs on Deep Learning Models in Software Engineering
by: Shah, Mehil B, et al.
Published: (2024)
by: Shah, Mehil B, et al.
Published: (2024)
Revisiting Sentiment Analysis for Software Engineering in the Era of Large Language Models
by: Zhang, Ting, et al.
Published: (2023)
by: Zhang, Ting, et al.
Published: (2023)
Guidelines for Empirical Studies in Software Engineering involving Large Language Models
by: Baltes, Sebastian, et al.
Published: (2025)
by: Baltes, Sebastian, et al.
Published: (2025)
An Explanation of Software Architecture Explanations
by: Rukmono, Satrio Adi, et al.
Published: (2025)
by: Rukmono, Satrio Adi, et al.
Published: (2025)
Towards Assessing Spread in Sets of Software Architecture Designs
by: Cortellessa, Vittorio, et al.
Published: (2024)
by: Cortellessa, Vittorio, et al.
Published: (2024)
Similar Items
-
Measuring the Unmeasurable: Markov Chain Reliability for LLM Agents
by: Tran-Truong, Phat T., et al.
Published: (2026) -
Program Structure-aware Language Models: Targeted Software Testing beyond Textual Semantics
by: Tran, Khang, et al.
Published: (2026) -
Evaluating Classical Software Process Models as Coordination Mechanisms for LLM-Based Software Generation
by: Ha, Duc Minh, et al.
Published: (2025) -
Automated Description Generation for Software Patches
by: Vu, Thanh Trong, et al.
Published: (2024) -
Leveraging AI for Enhanced Software Effort Estimation: A Comprehensive Study and Framework Proposal
by: Tran, Nhi, et al.
Published: (2024)