Salvato in:
| Autori principali: | Gosal, Gurpreet, Xu, Yishi, Ramakrishnan, Gokul, Joshi, Rituraj, Sheinin, Avraham, Zhiming, Chen, Mishra, Biswajit, Vassilieva, Natalia, Hestness, Joel, Sengupta, Neha, Sahu, Sunil Kumar, Jia, Bokang, Pandit, Onkar, Katipomu, Satheesh, Kamboj, Samta, Ghosh, Samujjwal, Pal, Rahul, Mullah, Parvez, Doraiswamy, Soundar, Chami, Mohamed El Karim, Nakov, Preslav |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2407.12869 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PTPP-Aware Adaptation Scaling Laws: Predicting Domain-Adaptation Performance at Unseen Pre-Training Budgets
di: Goffinet, Etienne, et al.
Pubblicazione: (2025)
di: Goffinet, Etienne, et al.
Pubblicazione: (2025)
Llama-3-Nanda-10B-Chat: An Open Generative Large Language Model for Hindi
di: Choudhury, Monojit, et al.
Pubblicazione: (2025)
di: Choudhury, Monojit, et al.
Pubblicazione: (2025)
Nomad: Autonomous Exploration and Discovery
di: Jia, Bokang, et al.
Pubblicazione: (2026)
di: Jia, Bokang, et al.
Pubblicazione: (2026)
Sherkala-Chat: Building a State-of-the-Art LLM for Kazakh in a Moderately Resourced Setting
di: Koto, Fajri, et al.
Pubblicazione: (2025)
di: Koto, Fajri, et al.
Pubblicazione: (2025)
Straight to Zero: Why Linearly Decaying the Learning Rate to Zero Works Best for LLMs
di: Bergsma, Shane, et al.
Pubblicazione: (2025)
di: Bergsma, Shane, et al.
Pubblicazione: (2025)
Power Lines: Scaling Laws for Weight Decay and Batch Size in LLM Pre-training
di: Bergsma, Shane, et al.
Pubblicazione: (2025)
di: Bergsma, Shane, et al.
Pubblicazione: (2025)
Scaling with Collapse: Efficient and Predictable Training of LLM Families
di: Bergsma, Shane, et al.
Pubblicazione: (2025)
di: Bergsma, Shane, et al.
Pubblicazione: (2025)
Instruction Tuning on Public Government and Cultural Data for Low-Resource Language: a Case Study in Kazakh
di: Laiyk, Nurkhan, et al.
Pubblicazione: (2025)
di: Laiyk, Nurkhan, et al.
Pubblicazione: (2025)
DUAL-Bench: Measuring Over-Refusal and Robustness in Vision-Language Models
di: Ren, Kaixuan, et al.
Pubblicazione: (2025)
di: Ren, Kaixuan, et al.
Pubblicazione: (2025)
From Chaos to Clarity: Claim Normalization to Empower Fact-Checking
di: Sundriyal, Megha, et al.
Pubblicazione: (2023)
di: Sundriyal, Megha, et al.
Pubblicazione: (2023)
Large Language Models are Few-Shot Training Example Generators: A Case Study in Fallacy Recognition
di: Alhindi, Tariq, et al.
Pubblicazione: (2023)
di: Alhindi, Tariq, et al.
Pubblicazione: (2023)
Rethinking STS and NLI in Large Language Models
di: Wang, Yuxia, et al.
Pubblicazione: (2023)
di: Wang, Yuxia, et al.
Pubblicazione: (2023)
CoDet-M4: Detecting Machine-Generated Code in Multi-Lingual, Multi-Generator and Multi-Domain Settings
di: Orel, Daniil, et al.
Pubblicazione: (2025)
di: Orel, Daniil, et al.
Pubblicazione: (2025)
DenoiseRank: Learning to Rank by Diffusion Models
di: Wang, Ying, et al.
Pubblicazione: (2026)
di: Wang, Ying, et al.
Pubblicazione: (2026)
Adapting Fake News Detection to the Era of Large Language Models
di: Su, Jinyan, et al.
Pubblicazione: (2023)
di: Su, Jinyan, et al.
Pubblicazione: (2023)
Corpus Poisoning via Approximate Greedy Gradient Descent
di: Su, Jinyan, et al.
Pubblicazione: (2024)
di: Su, Jinyan, et al.
Pubblicazione: (2024)
The Information Search
di: Doraiswamy, Uma
Pubblicazione: (2011)
di: Doraiswamy, Uma
Pubblicazione: (2011)
UnsafeChain: Enhancing Reasoning Model Safety via Hard Cases
di: Tomar, Raj Vardhan, et al.
Pubblicazione: (2025)
di: Tomar, Raj Vardhan, et al.
Pubblicazione: (2025)
How Does Prefix Matter in Reasoning Model Tuning?
di: Tomar, Raj Vardhan, et al.
Pubblicazione: (2026)
di: Tomar, Raj Vardhan, et al.
Pubblicazione: (2026)
Work‐Related Migration and Couples in Long‐Distance Marriages: Mindfulness, Marital Quality, Satisfaction, and Happiness
di: Samta P. Pandya
Pubblicazione: (2025)
di: Samta P. Pandya
Pubblicazione: (2025)
ConspirED: A Dataset for Cognitive Traits of Conspiracy Theories and Large Language Model Safety
di: Bates, Luke, et al.
Pubblicazione: (2025)
di: Bates, Luke, et al.
Pubblicazione: (2025)
MuDRiC: Multi-Dialect Reasoning for Arabic Commonsense Validation
di: Elozeiri, Kareem, et al.
Pubblicazione: (2025)
di: Elozeiri, Kareem, et al.
Pubblicazione: (2025)
DP-Fusion: Token-Level Differentially Private Inference for Large Language Models
di: Thareja, Rushil, et al.
Pubblicazione: (2025)
di: Thareja, Rushil, et al.
Pubblicazione: (2025)
UNCERTAINTY-LINE: Length-Invariant Estimation of Uncertainty for Large Language Models
di: Vashurin, Roman, et al.
Pubblicazione: (2025)
di: Vashurin, Roman, et al.
Pubblicazione: (2025)
Missci: Reconstructing Fallacies in Misrepresented Science
di: Glockner, Max, et al.
Pubblicazione: (2024)
di: Glockner, Max, et al.
Pubblicazione: (2024)
Detecting Check-Worthy Claims in Political Debates, Speeches, and Interviews Using Audio Data
di: Ivanov, Petar, et al.
Pubblicazione: (2023)
di: Ivanov, Petar, et al.
Pubblicazione: (2023)
Multimodal Large Language Models to Support Real-World Fact-Checking
di: Geng, Jiahui, et al.
Pubblicazione: (2024)
di: Geng, Jiahui, et al.
Pubblicazione: (2024)
Adaptive Conformal Prediction for Improving Factuality of Generations by Large Language Models
di: Rubashevskii, Aleksandr, et al.
Pubblicazione: (2026)
di: Rubashevskii, Aleksandr, et al.
Pubblicazione: (2026)
$\texttt{Droid}$: A Resource Suite for AI-Generated Code Detection
di: Orel, Daniil, et al.
Pubblicazione: (2025)
di: Orel, Daniil, et al.
Pubblicazione: (2025)
Grounding Fallacies Misrepresenting Scientific Publications in Evidence
di: Glockner, Max, et al.
Pubblicazione: (2024)
di: Glockner, Max, et al.
Pubblicazione: (2024)
MemeMQA: Multimodal Question Answering for Memes via Rationale-Based Inferencing
di: Agarwal, Siddhant, et al.
Pubblicazione: (2024)
di: Agarwal, Siddhant, et al.
Pubblicazione: (2024)
Between Underthinking and Overthinking: An Empirical Study of Reasoning Length and correctness in LLMs
di: Su, Jinyan, et al.
Pubblicazione: (2025)
di: Su, Jinyan, et al.
Pubblicazione: (2025)
Fast or Better? Balancing Accuracy and Cost in Retrieval-Augmented Generation with Flexible User Control
di: Su, Jinyan, et al.
Pubblicazione: (2025)
di: Su, Jinyan, et al.
Pubblicazione: (2025)
On a Novel Application of Wasserstein-Procrustes for Unsupervised Cross-Lingual Learning
di: Ramírez, Guillem, et al.
Pubblicazione: (2020)
di: Ramírez, Guillem, et al.
Pubblicazione: (2020)
Оригинал и карикатура: как британская «профилактическая юстиция» (preventive justice) не приживается на континенте Оторванность от родной почвы выявляет полный абсурд
di: Vassilieva, Elena
Pubblicazione: (2025)
di: Vassilieva, Elena
Pubblicazione: (2025)
Создание «уязвимых групп» как механизм обхода правовых гарантий и Прав Человека - Кому выгодно «НЕравенство всех перед судом»?
di: Vassilieva, Elena
Pubblicazione: (2025)
di: Vassilieva, Elena
Pubblicazione: (2025)
Creating "Vulnerable Groups" as a Mechanism to Circumvent Legal Guarantees and Human Rights - Who Benefits from "INequality Before the Law"?
di: Vassilieva, Elena
Pubblicazione: (2025)
di: Vassilieva, Elena
Pubblicazione: (2025)
Британская модель профилактической юстиции (preventive justice) как новая форма правового подчинения (Claim of Originality)
di: Vassilieva, Elena
Pubblicazione: (2025)
di: Vassilieva, Elena
Pubblicazione: (2025)
Claim 5 - The Blind Spot of British Law: Judicial Criminalisation Without Realising It
di: Vassilieva, Elena
Pubblicazione: (2025)
di: Vassilieva, Elena
Pubblicazione: (2025)
От «защиты жертв» к системному вредительству: Превентивный надзор как закрепленный в законе обход процессуальных норм
di: Vassilieva, Elena
Pubblicazione: (2025)
di: Vassilieva, Elena
Pubblicazione: (2025)
Documenti analoghi
-
PTPP-Aware Adaptation Scaling Laws: Predicting Domain-Adaptation Performance at Unseen Pre-Training Budgets
di: Goffinet, Etienne, et al.
Pubblicazione: (2025) -
Llama-3-Nanda-10B-Chat: An Open Generative Large Language Model for Hindi
di: Choudhury, Monojit, et al.
Pubblicazione: (2025) -
Nomad: Autonomous Exploration and Discovery
di: Jia, Bokang, et al.
Pubblicazione: (2026) -
Sherkala-Chat: Building a State-of-the-Art LLM for Kazakh in a Moderately Resourced Setting
di: Koto, Fajri, et al.
Pubblicazione: (2025) -
Straight to Zero: Why Linearly Decaying the Learning Rate to Zero Works Best for LLMs
di: Bergsma, Shane, et al.
Pubblicazione: (2025)