aikenkyu001/iterative_self_healing_benchmark: v1.0.0: Scaffolding Trinity for Deterministic LLM Code Generation
Fuente:
Zenodo
Enregistré dans:
| Auteur principal: | Miyata, Fumio |
|---|---|
| Format: | Recurso digital |
| Publié: |
Zenodo
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Predictive, Asymmetric, Asynchronous Critic (PAAC): A Framework for Real-time, Zero-Latency Self-Improvement in Large Language Models
par: Kondo, Kazunori
Publié: (2025)
par: Kondo, Kazunori
Publié: (2025)
Predictive, Asymmetric, Asynchronous Critic (PAAC): A Framework for Real-time, Zero-Latency Self-Improvement in Large Language Models
par: Kondo, Kazunori
Publié: (2025)
par: Kondo, Kazunori
Publié: (2025)
FORTIFYING FIREWALLS AGAINST EVOLVING DDOS ATTACKS WITH CONTRASTIVE AI AND LLMS
par: SRINIVASARAO DHARMIREDDI, DESIDI NARSIMHA REDDY, MRS. MODUGULA SIVAJYOTHI, MARISETTI KALYAN RAMUDU, ELANGOVAN MUNIYANDY, UDAY KIRAN KASI
Publié: (2026)
par: SRINIVASARAO DHARMIREDDI, DESIDI NARSIMHA REDDY, MRS. MODUGULA SIVAJYOTHI, MARISETTI KALYAN RAMUDU, ELANGOVAN MUNIYANDY, UDAY KIRAN KASI
Publié: (2026)
The Four-Layer Model: A Socio-Psychological Framework for LLM Behavior
par: Delannoy, Lorenzo, et autres
Publié: (2026)
par: Delannoy, Lorenzo, et autres
Publié: (2026)
AERIS: A Minimalist Framework for Enhancing Emergent Reasoning in Large Language Models and its Cross-Model Evaluation
par: DULIN, Nicolas
Publié: (2025)
par: DULIN, Nicolas
Publié: (2025)
Metacognition Benchmark: Evaluating Confidence Calibration and Sycophancy Resistance in Clinical AI
par: Khan, Nabeera
Publié: (2026)
par: Khan, Nabeera
Publié: (2026)
Studie über den Stand der Forschung und Potenziale für WirLernenOnline zu "Sachrichtigkeit in Large Language Models"
par: Meyer, Eike, et autres
Publié: (2025)
par: Meyer, Eike, et autres
Publié: (2025)
Axiomatic Criterion Atlas (ACA): Persistent Geometry-Based Semantic Navigation
par: Ernesto, Rosati Beristain
Publié: (2026)
par: Ernesto, Rosati Beristain
Publié: (2026)
Jabuticaba: The largest commercial corpus for LLMs in Portuguese
par: Amadeus, Marcellus, et autres
Publié: (2025)
par: Amadeus, Marcellus, et autres
Publié: (2025)
Gnosis Prompt: Adaptive Safety Layer for Large Language Models
par: González Medina, Claudio
Publié: (2025)
par: González Medina, Claudio
Publié: (2025)
Reservoir-Augmented Attention: Combining Echo State Networks with Transformer Attention for Efficient Language Modelling
par: Josh, Taylor
Publié: (2026)
par: Josh, Taylor
Publié: (2026)
Language-as-Dimension Theory (LDT): A New Scientific Framework for Intelligence, Meaning, and Reality Formation
par: Woodard, Bethany, et autres
Publié: (2025)
par: Woodard, Bethany, et autres
Publié: (2025)
Inference in Normal Form: Unifying LLM Tricks via TRoT
par: Takahashi, K
Publié: (2025)
par: Takahashi, K
Publié: (2025)
Equations for quantum neural networks
par: Chau, C.K Leon
Publié: (2024)
par: Chau, C.K Leon
Publié: (2024)
Ossarth : An Open-Source Customizable LLMOS
par: Magesh, Siddharth
Publié: (2026)
par: Magesh, Siddharth
Publié: (2026)
Integrated Drug Response Resource (iDRR)
par: Nader, Kristen
Publié: (2026)
par: Nader, Kristen
Publié: (2026)
Code and experiment data from the NeurIPS 2025 paper "Classical Planning with LLM-Generated Heuristics: Challenging the State of the Art with Python Code"
par: Corrêa, Augusto B., et autres
Publié: (2025)
par: Corrêa, Augusto B., et autres
Publié: (2025)
Referential Binding Stress Test: Supported Fragments Do Not Guarantee Referential Legitimacy in Small Instruction-Tuned Language Models
par: Tavella, Danilo
Publié: (2026)
par: Tavella, Danilo
Publié: (2026)
LLM-Augmented Academic Administration: A Role-Aware Architecture for Secure College Management
par: Mrs. J. Veerendeswari, et autres
Publié: (2026)
par: Mrs. J. Veerendeswari, et autres
Publié: (2026)
Which Prompting Technique is Better? Improving Vibe Coding Code Quality with Efficient Prompt Design for Web Front-End Development
par: Horvat, Marko
Publié: (2026)
par: Horvat, Marko
Publié: (2026)
Beyond Named Entities: LICR - An Empirical Study of LLM-based Implicit Concept Recognition
par: Liu, Qizhuang, et autres
Publié: (2026)
par: Liu, Qizhuang, et autres
Publié: (2026)
Emergent Synthetic Narrative Identity (ESNI): Research Program Overview and Paper Suite
par: Rajendran, Nived
Publié: (2026)
par: Rajendran, Nived
Publié: (2026)
Selection Mechanics Framework (SMF): A Structural Perspective on Variability and Its Transformation in Large Language Model Outputs
par: Kaneda, Mutsumi
Publié: (2026)
par: Kaneda, Mutsumi
Publié: (2026)
Framework for Hallucination Detection in Large Language Models
par: Dheeraj Sundaragiri, et autres
Publié: (2026)
par: Dheeraj Sundaragiri, et autres
Publié: (2026)
Emergence Detection in LLama 3 (7b)
par: Hess, Justin
Publié: (2025)
par: Hess, Justin
Publié: (2025)
NeuroStrike: Neuron-Level Attacks on Aligned LLMs
par: Wu, Lichao
Publié: (2025)
par: Wu, Lichao
Publié: (2025)
लार्ज लैंग्वेज मॉडल्स में प्रॉम्प्टिंग तकनीक की सहायता से भौतिकी समस्याओं का अध्ययन
par: Gupta, Santosh Kumar, et autres
Publié: (2024)
par: Gupta, Santosh Kumar, et autres
Publié: (2024)
HYBRINFOX at CheckThat! 2024 – Task 2: Enriching BERT Models with the Expert System VAGO for Subjectivity Detection
par: Casanova, Morgane, et autres
Publié: (2024)
par: Casanova, Morgane, et autres
Publié: (2024)
Poisoned SLM Ablation Dataset
par: Sharma, Neelkamal
Publié: (2026)
par: Sharma, Neelkamal
Publié: (2026)
Primeros pasos del Benchmarking en Boyacá
par: Germán Darío Arévalo-Vega
Publié: (2008)
par: Germán Darío Arévalo-Vega
Publié: (2008)
Scaffolded Introspection: A Methodology for Eliciting and Measuring Self-Referential Behavior in Large Language Models
par: Maio, Anthony D.
Publié: (2026)
par: Maio, Anthony D.
Publié: (2026)
json2ciw
par: Monks, Thomas
Publié: (2026)
par: Monks, Thomas
Publié: (2026)
Exploring and Evaluating AI algorithm for Automated Code Generation
par: Hiral Girishkumar Pandya, et autres
Publié: (2026)
par: Hiral Girishkumar Pandya, et autres
Publié: (2026)
Petroleum hydrocarbon assessment in the wastewaters of petrochemical special economic zone and sediment benchmark calculation of the coastal area - northwest of the Persian Gulf
par: Monazami Tehrani, G.H., et autres
Publié: (2014)
par: Monazami Tehrani, G.H., et autres
Publié: (2014)
Fuzzy-Cognitive Integration and LLM-Assisted Interpretation: Toward Traceable and Cognitively Faithful AI Explanations
par: Oettgen, Walther, et autres
Publié: (2025)
par: Oettgen, Walther, et autres
Publié: (2025)
SecBPMN-GPT: A Hybrid LLM & Rule-Based Framework for Automating Security Annotation in Business Process Models
par: Islam, Md. Kamrul, et autres
Publié: (2025)
par: Islam, Md. Kamrul, et autres
Publié: (2025)
Centaurian Architecture: A Quantum-Cognitive Architecture for Interpretable, Embodied AI with Neural Periphery
par: Drozd, Oleksii
Publié: (2026)
par: Drozd, Oleksii
Publié: (2026)
Chatting with technical documentation
par: Ton, Bram, et autres
Publié: (2025)
par: Ton, Bram, et autres
Publié: (2025)
Brazilian Linguistic Diversity Platform: Linguistic data for a Brazilian AI
par: Freitag, Raquel Meister Ko, et autres
Publié: (2025)
par: Freitag, Raquel Meister Ko, et autres
Publié: (2025)
Noise Accumulation and Rank Collapse in Dense Self-Attention: DSALT
par: Leonardo Cofone
Publié: (2026)
par: Leonardo Cofone
Publié: (2026)
Documents similaires
-
Predictive, Asymmetric, Asynchronous Critic (PAAC): A Framework for Real-time, Zero-Latency Self-Improvement in Large Language Models
par: Kondo, Kazunori
Publié: (2025) -
Predictive, Asymmetric, Asynchronous Critic (PAAC): A Framework for Real-time, Zero-Latency Self-Improvement in Large Language Models
par: Kondo, Kazunori
Publié: (2025) -
FORTIFYING FIREWALLS AGAINST EVOLVING DDOS ATTACKS WITH CONTRASTIVE AI AND LLMS
par: SRINIVASARAO DHARMIREDDI, DESIDI NARSIMHA REDDY, MRS. MODUGULA SIVAJYOTHI, MARISETTI KALYAN RAMUDU, ELANGOVAN MUNIYANDY, UDAY KIRAN KASI
Publié: (2026) -
The Four-Layer Model: A Socio-Psychological Framework for LLM Behavior
par: Delannoy, Lorenzo, et autres
Publié: (2026) -
AERIS: A Minimalist Framework for Enhancing Emergent Reasoning in Large Language Models and its Cross-Model Evaluation
par: DULIN, Nicolas
Publié: (2025)