Reducing Instability in Synthetic Data Evaluation with a Super-Metric in MalDataGen
Fuente:
arXiv
Salvato in:
| Autori principali: | da Silva, Anna Luiza Gomes, Kreutz, Diego, Diniz, Angelo, Mansilha, Rodrigo, da Fonseca, Celso Nobre |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MalDataGen: A Modular Framework for Synthetic Tabular Data Generation in Malware Detection
di: Paim, Kayua Oleques, et al.
Pubblicazione: (2025)
di: Paim, Kayua Oleques, et al.
Pubblicazione: (2025)
Exploiting Latent Space Discontinuities for Building Universal LLM Jailbreaks and Data Extraction Attacks
di: Paim, Kayua Oleques, et al.
Pubblicazione: (2025)
di: Paim, Kayua Oleques, et al.
Pubblicazione: (2025)
Synthetic Data: AI's New Weapon Against Android Malware
di: Nogueira, Angelo Gaspar Diniz, et al.
Pubblicazione: (2025)
di: Nogueira, Angelo Gaspar Diniz, et al.
Pubblicazione: (2025)
Structured Extraction of Vulnerabilities in OpenVAS and Tenable WAS Reports Using LLMs
di: Machado, Beatriz, et al.
Pubblicazione: (2025)
di: Machado, Beatriz, et al.
Pubblicazione: (2025)
AnonLFI 2.0: Extensible Architecture for PII Pseudonymization in CSIRTs with OCR and Technical Recognizers
di: Kapelinski, Cristhian, et al.
Pubblicazione: (2025)
di: Kapelinski, Cristhian, et al.
Pubblicazione: (2025)
On-Premise SLMs vs. Commercial LLMs: Prompt Engineering and Incident Classification in SOCs and CSIRTs
di: Almeida, Gefté, et al.
Pubblicazione: (2025)
di: Almeida, Gefté, et al.
Pubblicazione: (2025)
MH-FSF: A Unified Framework for Overcoming Benchmarking and Reproducibility Limitations in Feature Selection Evaluation
di: Rocha, Vanderson, et al.
Pubblicazione: (2025)
di: Rocha, Vanderson, et al.
Pubblicazione: (2025)
On Privacy Leakage in Tabular Diffusion Models: Influential Factors, Attacker Knowledge, and Metrics
di: Shafieinejad, Masoumeh, et al.
Pubblicazione: (2026)
di: Shafieinejad, Masoumeh, et al.
Pubblicazione: (2026)
A New Similarity Function for Spectral Clustering with Application to Plant Phenotypic Data
di: Ahuja, Kapil, et al.
Pubblicazione: (2023)
di: Ahuja, Kapil, et al.
Pubblicazione: (2023)
MH-1M: A 1.34 Million-Sample Comprehensive Multi-Feature Android Malware Dataset for Machine Learning, Deep Learning, Large Language Models, and Threat Intelligence Research
di: Braganca, Hendrio, et al.
Pubblicazione: (2025)
di: Braganca, Hendrio, et al.
Pubblicazione: (2025)
TSDS: Data Selection for Task-Specific Model Finetuning
di: Liu, Zifan, et al.
Pubblicazione: (2024)
di: Liu, Zifan, et al.
Pubblicazione: (2024)
Data and AI governance: Promoting equity, ethics, and fairness in large language models
di: Abhishek, Alok, et al.
Pubblicazione: (2025)
di: Abhishek, Alok, et al.
Pubblicazione: (2025)
RHealthTwin: Towards Responsible and Multimodal Digital Twins for Personalized Well-being
di: Ferdousi, Rahatara, et al.
Pubblicazione: (2025)
di: Ferdousi, Rahatara, et al.
Pubblicazione: (2025)
CHORUS: An Agentic Framework for Generating Realistic Deliberation Data
di: Koursaris, A., et al.
Pubblicazione: (2026)
di: Koursaris, A., et al.
Pubblicazione: (2026)
Learning from Similarity-Confidence and Confidence-Difference
di: Tate, Tomoya, et al.
Pubblicazione: (2025)
di: Tate, Tomoya, et al.
Pubblicazione: (2025)
Learning from Hard Labels with Additional Supervision on Non-Hard-Labeled Classes
di: Sugiyama, Kosuke, et al.
Pubblicazione: (2025)
di: Sugiyama, Kosuke, et al.
Pubblicazione: (2025)
Learning from Complementary Features
di: Sugiyama, Kosuke, et al.
Pubblicazione: (2024)
di: Sugiyama, Kosuke, et al.
Pubblicazione: (2024)
ConSensus: Multi-Agent Collaboration for Multimodal Sensing
di: Yoon, Hyungjun, et al.
Pubblicazione: (2026)
di: Yoon, Hyungjun, et al.
Pubblicazione: (2026)
Attack Selection Reduces Safety in Concentrated AI Control Settings against Trusted Monitoring
di: Schaeffer, Joachim, et al.
Pubblicazione: (2026)
di: Schaeffer, Joachim, et al.
Pubblicazione: (2026)
An Epidemiological Knowledge Graph extracted from the World Health Organization's Disease Outbreak News
di: Consoli, Sergio, et al.
Pubblicazione: (2025)
di: Consoli, Sergio, et al.
Pubblicazione: (2025)
Synthetic emotions and consciousness: exploring architectural boundaries
di: Borotschnig, Hermann
Pubblicazione: (2025)
di: Borotschnig, Hermann
Pubblicazione: (2025)
AIDOVECL: AI-generated Dataset of Outpainted Vehicles for Eye-level Classification and Localization
di: Kazemi, Amir, et al.
Pubblicazione: (2024)
di: Kazemi, Amir, et al.
Pubblicazione: (2024)
Mind the Metrics: Patterns for Telemetry-Aware In-IDE AI Application Development using the Model Context Protocol (MCP)
di: Koc, Vincent, et al.
Pubblicazione: (2025)
di: Koc, Vincent, et al.
Pubblicazione: (2025)
Temperature in SLMs: Impact on Incident Categorization in On-Premises Environments
di: Pohlmann, Marcio, et al.
Pubblicazione: (2025)
di: Pohlmann, Marcio, et al.
Pubblicazione: (2025)
KGroups: A Versatile Univariate Max-Relevance Min-Redundancy Feature Selection Algorithm for High-dimensional Biological Data
di: Ebiele, Malick, et al.
Pubblicazione: (2026)
di: Ebiele, Malick, et al.
Pubblicazione: (2026)
Subspace Clustering in Wavelet Packets Domain
di: Kopriva, Ivica, et al.
Pubblicazione: (2024)
di: Kopriva, Ivica, et al.
Pubblicazione: (2024)
Partitioned Neural Network Training via Synthetic Intermediate Labels
di: Karadağ, Cevat Volkan, et al.
Pubblicazione: (2024)
di: Karadağ, Cevat Volkan, et al.
Pubblicazione: (2024)
A Comparative Study of Feature Selection in Tsetlin Machines
di: Halenka, Vojtech, et al.
Pubblicazione: (2025)
di: Halenka, Vojtech, et al.
Pubblicazione: (2025)
Ideological Isolation in Online Social Networks: A Survey of Computational Definitions, Metrics, and Mitigation Strategies
di: Wang, Xiaodan, et al.
Pubblicazione: (2026)
di: Wang, Xiaodan, et al.
Pubblicazione: (2026)
ECG-FM: An Open Electrocardiogram Foundation Model
di: McKeen, Kaden, et al.
Pubblicazione: (2024)
di: McKeen, Kaden, et al.
Pubblicazione: (2024)
Feature Relevancy, Necessity and Usefulness: Complexity and Algorithms
di: Capdevielle, Tomás, et al.
Pubblicazione: (2025)
di: Capdevielle, Tomás, et al.
Pubblicazione: (2025)
A Theoretical Framework for Adaptive Utility-Weighted Benchmarking
di: Waggoner, Philip
Pubblicazione: (2026)
di: Waggoner, Philip
Pubblicazione: (2026)
From Language Models to Practical Self-Improving Computer Agents
di: Sheng, Alex
Pubblicazione: (2024)
di: Sheng, Alex
Pubblicazione: (2024)
A Taxonomy of Omnicidal Futures Involving Artificial Intelligence
di: Critch, Andrew, et al.
Pubblicazione: (2025)
di: Critch, Andrew, et al.
Pubblicazione: (2025)
Enhancing PyKEEN with Multiple Negative Sampling Solutions for Knowledge Graph Embedding Models
di: d'Amato, Claudia, et al.
Pubblicazione: (2025)
di: d'Amato, Claudia, et al.
Pubblicazione: (2025)
Understanding Input Selectivity in Mamba: Impact on Approximation Power, Memorization, and Associative Recall Capacity
di: Huang, Ningyuan, et al.
Pubblicazione: (2025)
di: Huang, Ningyuan, et al.
Pubblicazione: (2025)
Sample Efficient Generative Molecular Optimization with Joint Self-Improvement
di: Korkmaz, Serra, et al.
Pubblicazione: (2026)
di: Korkmaz, Serra, et al.
Pubblicazione: (2026)
Multi-objective Hyperparameter Optimization in the Age of Deep Learning
di: Basu, Soham, et al.
Pubblicazione: (2025)
di: Basu, Soham, et al.
Pubblicazione: (2025)
Unveiling Group-Specific Distributed Concept Drift: A Fairness Imperative in Federated Learning
di: Salazar, Teresa, et al.
Pubblicazione: (2024)
di: Salazar, Teresa, et al.
Pubblicazione: (2024)
Driving down Poisson error can offset classification error in clinical tasks
di: Delahunt, Charles B., et al.
Pubblicazione: (2024)
di: Delahunt, Charles B., et al.
Pubblicazione: (2024)
Documenti analoghi
-
MalDataGen: A Modular Framework for Synthetic Tabular Data Generation in Malware Detection
di: Paim, Kayua Oleques, et al.
Pubblicazione: (2025) -
Exploiting Latent Space Discontinuities for Building Universal LLM Jailbreaks and Data Extraction Attacks
di: Paim, Kayua Oleques, et al.
Pubblicazione: (2025) -
Synthetic Data: AI's New Weapon Against Android Malware
di: Nogueira, Angelo Gaspar Diniz, et al.
Pubblicazione: (2025) -
Structured Extraction of Vulnerabilities in OpenVAS and Tenable WAS Reports Using LLMs
di: Machado, Beatriz, et al.
Pubblicazione: (2025) -
AnonLFI 2.0: Extensible Architecture for PII Pseudonymization in CSIRTs with OCR and Technical Recognizers
di: Kapelinski, Cristhian, et al.
Pubblicazione: (2025)