Salvato in:
| Autori principali: | Dognin, Pierre, Melnyk, Igor, Mroueh, Youssef, Padhi, Inkit, Rigotti, Mattia, Ross, Jarret, Schiff, Yair, Young, Richard A., Belgodere, Brian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2020
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2012.11696 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Auditing and Generating Synthetic Data with Controllable Trust Trade-offs
di: Belgodere, Brian, et al.
Pubblicazione: (2023)
di: Belgodere, Brian, et al.
Pubblicazione: (2023)
Risk Aware Benchmarking of Large Language Models
di: Nitsure, Apoorva, et al.
Pubblicazione: (2023)
di: Nitsure, Apoorva, et al.
Pubblicazione: (2023)
Distributional Preference Alignment of LLMs via Optimal Transport
di: Melnyk, Igor, et al.
Pubblicazione: (2024)
di: Melnyk, Igor, et al.
Pubblicazione: (2024)
GP-MoLFormer-Sim: Test Time Molecular Optimization through Contextual Similarity Guidance
di: Navratil, Jiri, et al.
Pubblicazione: (2025)
di: Navratil, Jiri, et al.
Pubblicazione: (2025)
Revisiting Group Relative Policy Optimization: Insights into On-Policy and Off-Policy Training
di: Mroueh, Youssef, et al.
Pubblicazione: (2025)
di: Mroueh, Youssef, et al.
Pubblicazione: (2025)
CliffSearch: Structured Agentic Co-Evolution over Theory and Code for Scientific Algorithm Discovery
di: Mroueh, Youssef, et al.
Pubblicazione: (2026)
di: Mroueh, Youssef, et al.
Pubblicazione: (2026)
Multivariate Stochastic Dominance via Optimal Transport and Applications to Models Benchmarking
di: Rioux, Gabriel, et al.
Pubblicazione: (2024)
di: Rioux, Gabriel, et al.
Pubblicazione: (2024)
Value Alignment from Unstructured Text
di: Padhi, Inkit, et al.
Pubblicazione: (2024)
di: Padhi, Inkit, et al.
Pubblicazione: (2024)
Programming Refusal with Conditional Activation Steering
di: Lee, Bruce W., et al.
Pubblicazione: (2024)
di: Lee, Bruce W., et al.
Pubblicazione: (2024)
GP-MoLFormer: A Foundation Model For Molecular Generation
di: Ross, Jerret, et al.
Pubblicazione: (2024)
di: Ross, Jerret, et al.
Pubblicazione: (2024)
Reinforcement Learning with Verifiable Rewards: GRPO's Effective Loss, Dynamics, and Success Amplification
di: Mroueh, Youssef
Pubblicazione: (2025)
di: Mroueh, Youssef
Pubblicazione: (2025)
Information Theoretic Guarantees For Policy Alignment In Large Language Models
di: Mroueh, Youssef
Pubblicazione: (2024)
di: Mroueh, Youssef
Pubblicazione: (2024)
When in Doubt, Cascade: Towards Building Efficient and Capable Guardrails
di: Nagireddy, Manish, et al.
Pubblicazione: (2024)
di: Nagireddy, Manish, et al.
Pubblicazione: (2024)
Contextual Moral Value Alignment Through Context-Based Aggregation
di: Dognin, Pierre, et al.
Pubblicazione: (2024)
di: Dognin, Pierre, et al.
Pubblicazione: (2024)
Answering the Wrong Question: Reasoning Trace Inversion for Abstention in LLMs
di: Gourabathina, Abinitha, et al.
Pubblicazione: (2026)
di: Gourabathina, Abinitha, et al.
Pubblicazione: (2026)
Split, Unlearn, Merge: Leveraging Data Attributes for More Effective Unlearning in LLMs
di: Kadhe, Swanand Ravindra, et al.
Pubblicazione: (2024)
di: Kadhe, Swanand Ravindra, et al.
Pubblicazione: (2024)
Guided Speculative Inference for Efficient Test-Time Alignment of LLMs
di: Geuter, Jonathan, et al.
Pubblicazione: (2025)
di: Geuter, Jonathan, et al.
Pubblicazione: (2025)
Final-Model-Only Data Attribution with a Unifying View of Gradient-Based Methods
di: Wei, Dennis, et al.
Pubblicazione: (2024)
di: Wei, Dennis, et al.
Pubblicazione: (2024)
GIST: Gauge-Invariant Spectral Transformers for Scalable Graph Neural Operators
di: Rigotti, Mattia, et al.
Pubblicazione: (2026)
di: Rigotti, Mattia, et al.
Pubblicazione: (2026)
Eliciting Reasoning in Language Models with Cognitive Tools
di: Ebouky, Brown, et al.
Pubblicazione: (2025)
di: Ebouky, Brown, et al.
Pubblicazione: (2025)
Library Technology: Bibliography, 1950-68
di: Melnyk, Andrew
Pubblicazione: (1969)
di: Melnyk, Andrew
Pubblicazione: (1969)
Hétérocères nouveaux de l'Amérique du Sud
di: Dognin, Paul
Pubblicazione: (1901)
di: Dognin, Paul
Pubblicazione: (1901)
Heterocores nouveaux de l'Amerique du Sud
di: Dognin, Paul
Pubblicazione: (1913)
di: Dognin, Paul
Pubblicazione: (1913)
Verify when Uncertain: Beyond Self-Consistency in Black Box Hallucination Detection
di: Xue, Yihao, et al.
Pubblicazione: (2025)
di: Xue, Yihao, et al.
Pubblicazione: (2025)
FuzzWiz -- Fuzzing Framework for Efficient Hardware Coverage
di: Gadde, Deepak Narayan, et al.
Pubblicazione: (2024)
di: Gadde, Deepak Narayan, et al.
Pubblicazione: (2024)
Tiburones en la olla --
di: Wrisley, Jarret
Pubblicazione: (2008)
di: Wrisley, Jarret
Pubblicazione: (2008)
Evaluation of medication adherence among Lebanese diabetic patients
di: Lara Mroueh
Pubblicazione: (2018)
di: Lara Mroueh
Pubblicazione: (2018)
GraphWiz: An Instruction-Following Language Model for Graph Problems
di: Chen, Nuo, et al.
Pubblicazione: (2024)
di: Chen, Nuo, et al.
Pubblicazione: (2024)
KL-Regularized RLHF with Multiple Reference Models: Exact Solutions and Sample Complexity
di: Aminian, Gholamali, et al.
Pubblicazione: (2025)
di: Aminian, Gholamali, et al.
Pubblicazione: (2025)
Evaluating Assistive Technologies on a Trade Fair: Methodological Overview and Lessons Learned
di: Baumeister, Annalies, et al.
Pubblicazione: (2024)
di: Baumeister, Annalies, et al.
Pubblicazione: (2024)
Outline-Guided Object Inpainting with Diffusion Models
di: Pobitzer, Markus, et al.
Pubblicazione: (2024)
di: Pobitzer, Markus, et al.
Pubblicazione: (2024)
Assistive Technologies in the Library
di: Mates, Barbara T.
Pubblicazione: (2011)
di: Mates, Barbara T.
Pubblicazione: (2011)
WikiContradict: A Benchmark for Evaluating LLMs on Real-World Knowledge Conflicts from Wikipedia
di: Hou, Yufang, et al.
Pubblicazione: (2024)
di: Hou, Yufang, et al.
Pubblicazione: (2024)
Integrative Review of Recruitment Literature: Conceptual Evolution, Technological Developments, and Scope for Future Research
di: Preeti Sharma, et al.
Pubblicazione: (2026)
di: Preeti Sharma, et al.
Pubblicazione: (2026)
El Conflicto del Campo. Matrices culturales e identificaciones políticas
di: Sebastián Rigotti
Pubblicazione: (2014)
di: Sebastián Rigotti
Pubblicazione: (2014)
Rh Potenziale Moiré come Operatore di Scattering e il confinamento topologico sulla varietà di Klein
di: Rigotti, Alex
Pubblicazione: (2026)
di: Rigotti, Alex
Pubblicazione: (2026)
Gradient Flows and Riemannian Structure in the Gromov-Wasserstein Geometry
di: Zhang, Zhengxin, et al.
Pubblicazione: (2024)
di: Zhang, Zhengxin, et al.
Pubblicazione: (2024)
Best-of-N through the Smoothing Lens: KL Divergence and Regret Analysis
di: Aminian, Gholamali, et al.
Pubblicazione: (2025)
di: Aminian, Gholamali, et al.
Pubblicazione: (2025)
Escucha intermedial: auralidad desde una perspectiva retórica
di: Jarret Julián Woodside Woods
Pubblicazione: (2019)
di: Jarret Julián Woodside Woods
Pubblicazione: (2019)
Smooth Solutions of the Navier-Stokes Equation
di: Glimm, James, et al.
Pubblicazione: (2025)
di: Glimm, James, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Auditing and Generating Synthetic Data with Controllable Trust Trade-offs
di: Belgodere, Brian, et al.
Pubblicazione: (2023) -
Risk Aware Benchmarking of Large Language Models
di: Nitsure, Apoorva, et al.
Pubblicazione: (2023) -
Distributional Preference Alignment of LLMs via Optimal Transport
di: Melnyk, Igor, et al.
Pubblicazione: (2024) -
GP-MoLFormer-Sim: Test Time Molecular Optimization through Contextual Similarity Guidance
di: Navratil, Jiri, et al.
Pubblicazione: (2025) -
Revisiting Group Relative Policy Optimization: Insights into On-Policy and Off-Policy Training
di: Mroueh, Youssef, et al.
Pubblicazione: (2025)