Agentic Adversarial QA for Improving Domain-Specific LLMs
Fuente:
arXiv
Salvato in:
| Autori principali: | Grari, Vincent, Tomoiaga, Ciprian, Lamprier, Sylvain, Hashimoto, Tatsunori, Detyniecki, Marcin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ACT: Agentic Classification Tree
di: Grari, Vincent, et al.
Pubblicazione: (2025)
di: Grari, Vincent, et al.
Pubblicazione: (2025)
OptiGrad: A Fair and more Efficient Price Elasticity Optimization via a Gradient Based Learning
di: Grari, Vincent, et al.
Pubblicazione: (2024)
di: Grari, Vincent, et al.
Pubblicazione: (2024)
SAKE: Steering Activations for Knowledge Editing
di: Scialanga, Marco, et al.
Pubblicazione: (2025)
di: Scialanga, Marco, et al.
Pubblicazione: (2025)
Post-processing fairness with minimal changes
di: Di Gennaro, Federico, et al.
Pubblicazione: (2024)
di: Di Gennaro, Federico, et al.
Pubblicazione: (2024)
Language Models with Conformal Factuality Guarantees
di: Mohri, Christopher, et al.
Pubblicazione: (2024)
di: Mohri, Christopher, et al.
Pubblicazione: (2024)
From Demographics to Survey Anchors: Evaluating LLM Agents for Modeling Retirement Attitudes
di: Garzón, Rubén, et al.
Pubblicazione: (2026)
di: Garzón, Rubén, et al.
Pubblicazione: (2026)
Can LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers
di: Si, Chenglei, et al.
Pubblicazione: (2024)
di: Si, Chenglei, et al.
Pubblicazione: (2024)
Observational Scaling Laws and the Predictability of Language Model Performance
di: Ruan, Yangjun, et al.
Pubblicazione: (2024)
di: Ruan, Yangjun, et al.
Pubblicazione: (2024)
Linguistic Calibration of Long-Form Generations
di: Band, Neil, et al.
Pubblicazione: (2024)
di: Band, Neil, et al.
Pubblicazione: (2024)
Length-Controlled AlpacaEval: A Simple Way to Debias Automatic Evaluators
di: Dubois, Yann, et al.
Pubblicazione: (2024)
di: Dubois, Yann, et al.
Pubblicazione: (2024)
Reasoning to Learn from Latent Thoughts
di: Ruan, Yangjun, et al.
Pubblicazione: (2025)
di: Ruan, Yangjun, et al.
Pubblicazione: (2025)
Constructing Synthetic Instruction Datasets for Improving Reasoning in Domain-Specific LLMs: A Case Study in the Japanese Financial Domain
di: Okochi, Yuma, et al.
Pubblicazione: (2026)
di: Okochi, Yuma, et al.
Pubblicazione: (2026)
Aggregated Knowledge Model: Enhancing Domain-Specific QA with Fine-Tuned and Retrieval-Augmented Generation Models
di: Liu, Fengchen, et al.
Pubblicazione: (2024)
di: Liu, Fengchen, et al.
Pubblicazione: (2024)
Synthetic continued pretraining
di: Yang, Zitong, et al.
Pubblicazione: (2024)
di: Yang, Zitong, et al.
Pubblicazione: (2024)
Graph-based Uncertainty Metrics for Long-form Language Model Outputs
di: Jiang, Mingjian, et al.
Pubblicazione: (2024)
di: Jiang, Mingjian, et al.
Pubblicazione: (2024)
The Ideation-Execution Gap: Execution Outcomes of LLM-Generated versus Human Research Ideas
di: Si, Chenglei, et al.
Pubblicazione: (2025)
di: Si, Chenglei, et al.
Pubblicazione: (2025)
TrimLLM: Progressive Layer Dropping for Domain-Specific LLMs
di: Hu, Lanxiang, et al.
Pubblicazione: (2024)
di: Hu, Lanxiang, et al.
Pubblicazione: (2024)
Towards Execution-Grounded Automated AI Research
di: Si, Chenglei, et al.
Pubblicazione: (2026)
di: Si, Chenglei, et al.
Pubblicazione: (2026)
Benchmarking for Domain-Specific LLMs: A Case Study on Academia and Beyond
di: Chen, Rubing, et al.
Pubblicazione: (2025)
di: Chen, Rubing, et al.
Pubblicazione: (2025)
Learning to Correct for QA Reasoning with Black-box LLMs
di: Kim, Jaehyung, et al.
Pubblicazione: (2024)
di: Kim, Jaehyung, et al.
Pubblicazione: (2024)
Latent Adversarial Training Improves Robustness to Persistent Harmful Behaviors in LLMs
di: Sheshadri, Abhay, et al.
Pubblicazione: (2024)
di: Sheshadri, Abhay, et al.
Pubblicazione: (2024)
GEM: A Gym for Agentic LLMs
di: Liu, Zichen, et al.
Pubblicazione: (2025)
di: Liu, Zichen, et al.
Pubblicazione: (2025)
Eliciting Language Model Behaviors with Investigator Agents
di: Li, Xiang Lisa, et al.
Pubblicazione: (2025)
di: Li, Xiang Lisa, et al.
Pubblicazione: (2025)
TxGemma: Efficient and Agentic LLMs for Therapeutics
di: Wang, Eric, et al.
Pubblicazione: (2025)
di: Wang, Eric, et al.
Pubblicazione: (2025)
Synthetic Data for any Differentiable Target
di: Thrush, Tristan, et al.
Pubblicazione: (2026)
di: Thrush, Tristan, et al.
Pubblicazione: (2026)
SuRe: Summarizing Retrievals using Answer Candidates for Open-domain QA of LLMs
di: Kim, Jaehyung, et al.
Pubblicazione: (2024)
di: Kim, Jaehyung, et al.
Pubblicazione: (2024)
Structural Deep Encoding for Table Question Answering
di: Mouravieff, Raphaël, et al.
Pubblicazione: (2025)
di: Mouravieff, Raphaël, et al.
Pubblicazione: (2025)
Identifying the Risks of LM Agents with an LM-Emulated Sandbox
di: Ruan, Yangjun, et al.
Pubblicazione: (2023)
di: Ruan, Yangjun, et al.
Pubblicazione: (2023)
AlpacaFarm: A Simulation Framework for Methods that Learn from Human Feedback
di: Dubois, Yann, et al.
Pubblicazione: (2023)
di: Dubois, Yann, et al.
Pubblicazione: (2023)
Focus On This, Not That! Steering LLMs with Adaptive Feature Specification
di: Lamb, Tom A., et al.
Pubblicazione: (2024)
di: Lamb, Tom A., et al.
Pubblicazione: (2024)
HiQA: A Hierarchical Contextual Augmentation RAG for Multi-Documents QA
di: Chen, Xinyue, et al.
Pubblicazione: (2024)
di: Chen, Xinyue, et al.
Pubblicazione: (2024)
Controlled Model Debiasing through Minimal and Interpretable Updates
di: Di Gennaro, Federico, et al.
Pubblicazione: (2025)
di: Di Gennaro, Federico, et al.
Pubblicazione: (2025)
Exploring Design Choices for Building Language-Specific LLMs
di: Tejaswi, Atula, et al.
Pubblicazione: (2024)
di: Tejaswi, Atula, et al.
Pubblicazione: (2024)
Improving Pretraining Data Using Perplexity Correlations
di: Thrush, Tristan, et al.
Pubblicazione: (2024)
di: Thrush, Tristan, et al.
Pubblicazione: (2024)
SAGE: A Novelty Gate for Efficient Memory Evolution in Agentic LLMs
di: Wang, Sijia, et al.
Pubblicazione: (2026)
di: Wang, Sijia, et al.
Pubblicazione: (2026)
Understanding Prediction Discrepancies in Machine Learning Classifiers
di: Renard, Xavier, et al.
Pubblicazione: (2021)
di: Renard, Xavier, et al.
Pubblicazione: (2021)
Imagine Beyond! Distributionally Robust Auto-Encoding for State Space Coverage in Online Reinforcement Learning
di: Castanet, Nicolas, et al.
Pubblicazione: (2025)
di: Castanet, Nicolas, et al.
Pubblicazione: (2025)
Complex QA and language models hybrid architectures, Survey
di: Daull, Xavier, et al.
Pubblicazione: (2023)
di: Daull, Xavier, et al.
Pubblicazione: (2023)
Are LLMs Ready for Neural-integrated Mechanistic Modeling? A Benchmark and Agentic Framework
di: Guan, Zihan, et al.
Pubblicazione: (2026)
di: Guan, Zihan, et al.
Pubblicazione: (2026)
ReCellTy: Domain-Specific Knowledge Graph Retrieval-Augmented LLMs Reasoning Workflow for Single-Cell Annotation
di: Han, Dezheng, et al.
Pubblicazione: (2025)
di: Han, Dezheng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ACT: Agentic Classification Tree
di: Grari, Vincent, et al.
Pubblicazione: (2025) -
OptiGrad: A Fair and more Efficient Price Elasticity Optimization via a Gradient Based Learning
di: Grari, Vincent, et al.
Pubblicazione: (2024) -
SAKE: Steering Activations for Knowledge Editing
di: Scialanga, Marco, et al.
Pubblicazione: (2025) -
Post-processing fairness with minimal changes
di: Di Gennaro, Federico, et al.
Pubblicazione: (2024) -
Language Models with Conformal Factuality Guarantees
di: Mohri, Christopher, et al.
Pubblicazione: (2024)