Inference-Time Intervention in Large Language Models for Reliable Requirement Verification
Fuente:
arXiv
Guardado en:
| Autores principales: | Darm, Paul, Xie, James, Riccardi, Annalisa |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Head-Specific Intervention Can Induce Misaligned AI Coordination in Large Language Models
por: Darm, Paul, et al.
Publicado: (2025)
por: Darm, Paul, et al.
Publicado: (2025)
Comprehensive Evaluation and Insights into the Use of Large Language Models in the Automation of Behavior-Driven Development Acceptance Test Formulation
por: Karpurapu, Shanthi, et al.
Publicado: (2024)
por: Karpurapu, Shanthi, et al.
Publicado: (2024)
Large Language Models (LLMs) for Requirements Engineering (RE): A Systematic Literature Review
por: Zadenoori, Mohammad Amin, et al.
Publicado: (2025)
por: Zadenoori, Mohammad Amin, et al.
Publicado: (2025)
Towards Observation Lakehouses: Living, Interactive Archives of Software Behavior
por: Kessel, Marcus
Publicado: (2025)
por: Kessel, Marcus
Publicado: (2025)
Automated Bug Triaging using Instruction-Tuned Large Language Models
por: Kiashemshaki, Kiana, et al.
Publicado: (2025)
por: Kiashemshaki, Kiana, et al.
Publicado: (2025)
What Would GPT Click: Practical Effects of Human-AI Behavioral Misalignment and the Cost of Synthetic Participants in User Experience
por: Kuric, Eduard, et al.
Publicado: (2026)
por: Kuric, Eduard, et al.
Publicado: (2026)
Leveraging Natural Language Processing and Machine Learning for Evidence-Based Food Security Policy Decision-Making in Data-Scarce Making
por: Singh, Karan Kumar, et al.
Publicado: (2026)
por: Singh, Karan Kumar, et al.
Publicado: (2026)
FREYR: A Framework for Recognizing and Executing Your Requests
por: Gallotta, Roberto, et al.
Publicado: (2025)
por: Gallotta, Roberto, et al.
Publicado: (2025)
An Industrial-Scale Retrieval-Augmented Generation Framework for Requirements Engineering: Empirical Evaluation with Automotive Manufacturing Data
por: Khalid, Muhammad, et al.
Publicado: (2026)
por: Khalid, Muhammad, et al.
Publicado: (2026)
Synergy of Large Language Model and Model Driven Engineering for Automated Development of Centralized Vehicular Systems
por: Petrovic, Nenad, et al.
Publicado: (2024)
por: Petrovic, Nenad, et al.
Publicado: (2024)
Test-driven Software Experimentation with LASSO: an LLM Prompt Benchmarking Example
por: Kessel, Marcus
Publicado: (2024)
por: Kessel, Marcus
Publicado: (2024)
N-Version Assessment and Enhancement of Generative AI
por: Kessel, Marcus, et al.
Publicado: (2024)
por: Kessel, Marcus, et al.
Publicado: (2024)
Morescient GAI for Software Engineering (Extended Version)
por: Kessel, Marcus, et al.
Publicado: (2024)
por: Kessel, Marcus, et al.
Publicado: (2024)
Rango: Adaptive Retrieval-Augmented Proving for Automated Software Verification
por: Thompson, Kyle, et al.
Publicado: (2024)
por: Thompson, Kyle, et al.
Publicado: (2024)
Toward Architecture-Aware Evaluation Metrics for LLM Agents
por: Souza, Débora, et al.
Publicado: (2026)
por: Souza, Débora, et al.
Publicado: (2026)
Building Browser Agents: Architecture, Security, and Practical Solutions
por: Vardanyan, Aram
Publicado: (2025)
por: Vardanyan, Aram
Publicado: (2025)
Using a cognitive architecture to consider antiBlackness in design and development of AI systems
por: Dancy, Christopher L.
Publicado: (2022)
por: Dancy, Christopher L.
Publicado: (2022)
Contrastive Learning-Enhanced Large Language Models for Monolith-to-Microservice Decomposition
por: Sellami, Khaled, et al.
Publicado: (2025)
por: Sellami, Khaled, et al.
Publicado: (2025)
AdaDec: A Uncertainty-Guided Lookahead Decoding Framework for LLM-Based Code Generation
por: He, Kaifeng, et al.
Publicado: (2025)
por: He, Kaifeng, et al.
Publicado: (2025)
Leveraging Large Language Models for Use Case Model Generation from Software Requirements
por: Eisenreich, Tobias, et al.
Publicado: (2025)
por: Eisenreich, Tobias, et al.
Publicado: (2025)
LLMs taking shortcuts in test generation: A study with SAP HANA and LevelDB
por: Bekmyradov, Vekil, et al.
Publicado: (2026)
por: Bekmyradov, Vekil, et al.
Publicado: (2026)
LLMs as Idiomatic Decompilers: Recovering High-Level Code from x86-64 Assembly for Dart
por: Abualazm, Raafat, et al.
Publicado: (2026)
por: Abualazm, Raafat, et al.
Publicado: (2026)
SectEval: Evaluating the Latent Sectarian Preferences of Large Language Models
por: Maheshwari, Aditya, et al.
Publicado: (2026)
por: Maheshwari, Aditya, et al.
Publicado: (2026)
GALA: Multimodal Graph Alignment for Bug Localization in Automated Program Repair
por: Liu, Zhuoyao, et al.
Publicado: (2026)
por: Liu, Zhuoyao, et al.
Publicado: (2026)
AgentPulse: A Continuous Multi-Signal Framework for Evaluating AI Agents in Deployment
por: Gao, Yuxuan, et al.
Publicado: (2026)
por: Gao, Yuxuan, et al.
Publicado: (2026)
Engineering A Large Language Model From Scratch
por: Oketunji, Abiodun Finbarrs
Publicado: (2024)
por: Oketunji, Abiodun Finbarrs
Publicado: (2024)
Unified Modeling Language Code Generation from Diagram Images Using Multimodal Large Language Models
por: Bates, Averi, et al.
Publicado: (2025)
por: Bates, Averi, et al.
Publicado: (2025)
Developer Challenges on Large Language Models: A Study of Stack Overflow and OpenAI Developer Forum Posts
por: Alam, Khairul, et al.
Publicado: (2024)
por: Alam, Khairul, et al.
Publicado: (2024)
GraphWalk: Enabling Reasoning in Large Language Models through Tool-Based Graph Navigation
por: Ghandi, Taraneh, et al.
Publicado: (2026)
por: Ghandi, Taraneh, et al.
Publicado: (2026)
Towards Single-System Illusion in Software-Defined Vehicles -- Automated, AI-Powered Workflow
por: Lebioda, Krzysztof, et al.
Publicado: (2024)
por: Lebioda, Krzysztof, et al.
Publicado: (2024)
Representation Fidelity:Auditing Algorithmic Decisions About Humans Using Self-Descriptions
por: Elstner, Theresa, et al.
Publicado: (2026)
por: Elstner, Theresa, et al.
Publicado: (2026)
Can AI Assist in Olympiad Coding
por: Ren, Samuel
Publicado: (2025)
por: Ren, Samuel
Publicado: (2025)
Large Language Models for Combinatorial Optimization of Design Structure Matrix
por: Jiang, Shuo, et al.
Publicado: (2025)
por: Jiang, Shuo, et al.
Publicado: (2025)
Scaling Laws for State Dynamics in Large Language Models
por: Li, Jacob X, et al.
Publicado: (2025)
por: Li, Jacob X, et al.
Publicado: (2025)
FORGE: An LLM-driven Framework for Large-Scale Smart Contract Vulnerability Dataset Construction
por: Chen, Jiachi, et al.
Publicado: (2025)
por: Chen, Jiachi, et al.
Publicado: (2025)
Multi-Hierarchical Feature Detection for Large Language Model Generated Text
por: Zhang, Luyan, et al.
Publicado: (2025)
por: Zhang, Luyan, et al.
Publicado: (2025)
Developing the PsyCogMetrics AI Lab to Evaluate Large Language Models and Advance Cognitive Science -- A Three-Cycle Action Design Science Study
por: Jin, Zhiye, et al.
Publicado: (2026)
por: Jin, Zhiye, et al.
Publicado: (2026)
Evaluation of Hate Speech Detection Using Large Language Models and Geographical Contextualization
por: Zahid, Anwar Hossain, et al.
Publicado: (2025)
por: Zahid, Anwar Hossain, et al.
Publicado: (2025)
Neural Theorem Proving for Verification Conditions: A Real-World Benchmark
por: Xu, Qiyuan, et al.
Publicado: (2026)
por: Xu, Qiyuan, et al.
Publicado: (2026)
LLM4PLC: Harnessing Large Language Models for Verifiable Programming of PLCs in Industrial Control Systems
por: Fakih, Mohamad, et al.
Publicado: (2024)
por: Fakih, Mohamad, et al.
Publicado: (2024)
Ejemplares similares
-
Head-Specific Intervention Can Induce Misaligned AI Coordination in Large Language Models
por: Darm, Paul, et al.
Publicado: (2025) -
Comprehensive Evaluation and Insights into the Use of Large Language Models in the Automation of Behavior-Driven Development Acceptance Test Formulation
por: Karpurapu, Shanthi, et al.
Publicado: (2024) -
Large Language Models (LLMs) for Requirements Engineering (RE): A Systematic Literature Review
por: Zadenoori, Mohammad Amin, et al.
Publicado: (2025) -
Towards Observation Lakehouses: Living, Interactive Archives of Software Behavior
por: Kessel, Marcus
Publicado: (2025) -
Automated Bug Triaging using Instruction-Tuned Large Language Models
por: Kiashemshaki, Kiana, et al.
Publicado: (2025)