On the Trustworthiness of Generative Foundation Models: Guideline, Assessment, and Perspective
Fuente:
arXiv
Salvato in:
Documenti analoghi
Safer-Instruct: Aligning Language Models with Automated Preference Data
di: Shi, Taiwei, et al.
Pubblicazione: (2023)
di: Shi, Taiwei, et al.
Pubblicazione: (2023)
Prioritization First, Principles Second: An Adaptive Interpretation of Helpful, Honest, and Harmless Principles
di: Huang, Yue, et al.
Pubblicazione: (2025)
di: Huang, Yue, et al.
Pubblicazione: (2025)
Analyzing And Editing Inner Mechanisms Of Backdoored Language Models
di: Lamparth, Max, et al.
Pubblicazione: (2023)
di: Lamparth, Max, et al.
Pubblicazione: (2023)
The Hallucination Tax of Reinforcement Finetuning
di: Song, Linxin, et al.
Pubblicazione: (2025)
di: Song, Linxin, et al.
Pubblicazione: (2025)
CoAct-1: Computer-using Multi-Agent System with Coding Actions
di: Song, Linxin, et al.
Pubblicazione: (2025)
di: Song, Linxin, et al.
Pubblicazione: (2025)
Linear π‐Extension of Acridone by the Fusion of Cyclobutadienoid
di: Jieyu Li, et al.
Pubblicazione: (2024)
di: Jieyu Li, et al.
Pubblicazione: (2024)
Detecting and Filtering Unsafe Training Data via Data Attribution with Denoised Representation
di: Pan, Yijun, et al.
Pubblicazione: (2025)
di: Pan, Yijun, et al.
Pubblicazione: (2025)
Experiential Reinforcement Learning
di: Shi, Taiwei, et al.
Pubblicazione: (2026)
di: Shi, Taiwei, et al.
Pubblicazione: (2026)
Skill Reuse as Compression in Agentic RL
di: Xu, Zhikun, et al.
Pubblicazione: (2026)
di: Xu, Zhikun, et al.
Pubblicazione: (2026)
Discovering Knowledge Deficiencies of Language Models on Massive Knowledge Base
di: Song, Linxin, et al.
Pubblicazione: (2025)
di: Song, Linxin, et al.
Pubblicazione: (2025)
Video-Based Reward Modeling for Computer-Use Agents
di: Song, Linxin, et al.
Pubblicazione: (2026)
di: Song, Linxin, et al.
Pubblicazione: (2026)
Realizing Equivalent Negative Capacitor and Negative Inductor Using Distributed Parameter Unit Cell of Microwave Transmission Line
di: Kun Wang, et al.
Pubblicazione: (2025)
di: Kun Wang, et al.
Pubblicazione: (2025)
Efficient Reinforcement Finetuning via Adaptive Curriculum Learning
di: Shi, Taiwei, et al.
Pubblicazione: (2025)
di: Shi, Taiwei, et al.
Pubblicazione: (2025)
Inside Back Cover: Degradable Polyketone Thermoplastic Elastomers with Biomass Sourced Composition (Angew. Chem. Int. Ed. 46/2025)
di: Shi‐Yu Chen, et al.
Pubblicazione: (2025)
di: Shi‐Yu Chen, et al.
Pubblicazione: (2025)
Degradable Polyketone Thermoplastic Elastomers with Biomass Sourced Composition
di: Shi‐Yu Chen, et al.
Pubblicazione: (2025)
di: Shi‐Yu Chen, et al.
Pubblicazione: (2025)
Degradable Polyketone Thermoplastic Elastomers with Biomass Sourced Composition
di: Shi‐Yu Chen, et al.
Pubblicazione: (2025)
di: Shi‐Yu Chen, et al.
Pubblicazione: (2025)
Inside Back Cover: Degradable Polyketone Thermoplastic Elastomers with Biomass Sourced Composition (Angew. Chem. 46/2025)
di: Shi‐Yu Chen, et al.
Pubblicazione: (2025)
di: Shi‐Yu Chen, et al.
Pubblicazione: (2025)
Numerical Simulation and Experimental Investigation of the High‐Speed Rolling Process for High‐Carbon Steel Wire Rods
di: Feng Jin, et al.
Pubblicazione: (2025)
di: Feng Jin, et al.
Pubblicazione: (2025)
Annotating FrameNet via Structure-Conditioned Language Generation
di: Cui, Xinyue, et al.
Pubblicazione: (2024)
di: Cui, Xinyue, et al.
Pubblicazione: (2024)
Cooling Performance Experiment and Simulation Investigation of Flow Boiling Heat Transfer for Wire Rods during Quenching in Molten Salt Mixtures
di: Jun Li, et al.
Pubblicazione: (2025)
di: Jun Li, et al.
Pubblicazione: (2025)
How Many Validation Labels Do You Need? Exploring the Design Space of Label-Efficient Model Ranking
di: Hu, Zhengyu, et al.
Pubblicazione: (2023)
di: Hu, Zhengyu, et al.
Pubblicazione: (2023)
Naphthalimide‐based Functional Glycopolymeric Nanoparticles as Fluorescent Probes for Selective Imaging of Tumor Cells
di: Yi Li, et al.
Pubblicazione: (2024)
di: Yi Li, et al.
Pubblicazione: (2024)
Revisiting Efficient Semantic Segmentation: Learning Offsets for Better Spatial and Class Feature Alignment
di: Zhang, Shi-Chen, et al.
Pubblicazione: (2025)
di: Zhang, Shi-Chen, et al.
Pubblicazione: (2025)
SynthFix: Adaptive Neuro-Symbolic Code Vulnerability Repair
di: Zhang, Yifan, et al.
Pubblicazione: (2026)
di: Zhang, Yifan, et al.
Pubblicazione: (2026)
AEGIS: Authenticity Evaluation Benchmark for AI-Generated Video Sequences
di: Li, Jieyu, et al.
Pubblicazione: (2025)
di: Li, Jieyu, et al.
Pubblicazione: (2025)
MarkCleaner: High-Fidelity Watermark Removal via Imperceptible Micro-Geometric Perturbation
di: Kong, Xiaoxi, et al.
Pubblicazione: (2026)
di: Kong, Xiaoxi, et al.
Pubblicazione: (2026)
Ovarian reserve and IVF/ICSI outcomes after various laparoscopic approaches in infertility patients with endometriomas and suspected compromised ovarian reserve: A retrospective study
di: Huaying Yu, et al.
Pubblicazione: (2025)
di: Huaying Yu, et al.
Pubblicazione: (2025)
Phylogeography of Pleurospermum foetens (Apiaceae) From the Sky Islands of Southwest China
di: Shuliang Yu, et al.
Pubblicazione: (2024)
di: Shuliang Yu, et al.
Pubblicazione: (2024)
Fairness in Reinforcement Learning: A Survey
di: Reuel, Anka, et al.
Pubblicazione: (2024)
di: Reuel, Anka, et al.
Pubblicazione: (2024)
Enhanced biocontrol traits of Pachycrepoideus vindemmiae reared on the alternative host Drosophila virilis
di: Ting Feng, et al.
Pubblicazione: (2026)
di: Ting Feng, et al.
Pubblicazione: (2026)
Escalation Risks from Language Models in Military and Diplomatic Decision-Making
di: Rivera, Juan-Pablo, et al.
Pubblicazione: (2024)
di: Rivera, Juan-Pablo, et al.
Pubblicazione: (2024)
BetterBench: Assessing AI Benchmarks, Uncovering Issues, and Establishing Best Practices
di: Reuel, Anka, et al.
Pubblicazione: (2024)
di: Reuel, Anka, et al.
Pubblicazione: (2024)
Intervals of torsion pairs and generalized Happel-Reiten-Smalø tilting
di: Chen, Jieyu, et al.
Pubblicazione: (2025)
di: Chen, Jieyu, et al.
Pubblicazione: (2025)
The Burden of Hepatitis B and C in Asia, 1990–2019: An Update Analysis From the Global Burden of Disease Study 2019
di: Qi Chen, et al.
Pubblicazione: (2025)
di: Qi Chen, et al.
Pubblicazione: (2025)
Cross-Lingual Pitfalls: Automatic Probing Cross-Lingual Weakness of Multilingual Large Language Models
di: Xu, Zixiang, et al.
Pubblicazione: (2025)
di: Xu, Zixiang, et al.
Pubblicazione: (2025)
Emergent Social Intelligence Risks in Generative Multi-Agent Systems
di: Huang, Yue, et al.
Pubblicazione: (2026)
di: Huang, Yue, et al.
Pubblicazione: (2026)
SPA: Achieving Consensus in LLM Alignment via Self-Priority Optimization
di: Huang, Yue, et al.
Pubblicazione: (2025)
di: Huang, Yue, et al.
Pubblicazione: (2025)
URDF-Anything+: End-to-End Generation for Simulation-Ready Articulated Assets
di: Wu, Zhuangzhe, et al.
Pubblicazione: (2026)
di: Wu, Zhuangzhe, et al.
Pubblicazione: (2026)
Neuroprotective Effects of SELFormer ‐Selected β‐Citronellol and β‐Caryophyllene in Vagotomized Ischemic Stroke Model Through Direct Brain Protection and Gut Microbiota Modulation
di: Yu Yue, et al.
Pubblicazione: (2025)
di: Yu Yue, et al.
Pubblicazione: (2025)
Adaptive Distraction: Probing LLM Contextual Robustness with Automated Tree Search
di: Wang, Yanbo, et al.
Pubblicazione: (2025)
di: Wang, Yanbo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Safer-Instruct: Aligning Language Models with Automated Preference Data
di: Shi, Taiwei, et al.
Pubblicazione: (2023) -
Prioritization First, Principles Second: An Adaptive Interpretation of Helpful, Honest, and Harmless Principles
di: Huang, Yue, et al.
Pubblicazione: (2025) -
Analyzing And Editing Inner Mechanisms Of Backdoored Language Models
di: Lamparth, Max, et al.
Pubblicazione: (2023) -
The Hallucination Tax of Reinforcement Finetuning
di: Song, Linxin, et al.
Pubblicazione: (2025) -
CoAct-1: Computer-using Multi-Agent System with Coding Actions
di: Song, Linxin, et al.
Pubblicazione: (2025)