Aligning Large Language Models for Faithful Integrity Against Opposing Argument
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhao, Yong, Deng, Yang, Ng, See-Kiong, Chua, Tat-Seng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Multi-Pass Large Language Model Framework for Precise and Efficient Radiology Report Error Detection
di: Kim, Songsoo, et al.
Pubblicazione: (2025)
di: Kim, Songsoo, et al.
Pubblicazione: (2025)
Argumentative Large Language Models for Explainable and Contestable Claim Verification
di: Freedman, Gabriel, et al.
Pubblicazione: (2024)
di: Freedman, Gabriel, et al.
Pubblicazione: (2024)
Can Large Language Models perform Relation-based Argument Mining?
di: Gorur, Deniz, et al.
Pubblicazione: (2024)
di: Gorur, Deniz, et al.
Pubblicazione: (2024)
Effective and Efficient Schema-aware Information Extraction Using On-Device Large Language Models
di: Wen, Zhihao, et al.
Pubblicazione: (2025)
di: Wen, Zhihao, et al.
Pubblicazione: (2025)
A Closer Look at Bias and Chain-of-Thought Faithfulness of Large (Vision) Language Models
di: Balasubramanian, Sriram, et al.
Pubblicazione: (2025)
di: Balasubramanian, Sriram, et al.
Pubblicazione: (2025)
LinkNER: Linking Local Named Entity Recognition Models to Large Language Models using Uncertainty
di: Zhang, Zhen, et al.
Pubblicazione: (2024)
di: Zhang, Zhen, et al.
Pubblicazione: (2024)
LoRS: Efficient Low-Rank Adaptation for Sparse Large Language Model
di: Hu, Yuxuan, et al.
Pubblicazione: (2025)
di: Hu, Yuxuan, et al.
Pubblicazione: (2025)
ConPET: Continual Parameter-Efficient Tuning for Large Language Models
di: Song, Chenyang, et al.
Pubblicazione: (2023)
di: Song, Chenyang, et al.
Pubblicazione: (2023)
Precise Length Control in Large Language Models
di: Butcher, Bradley, et al.
Pubblicazione: (2024)
di: Butcher, Bradley, et al.
Pubblicazione: (2024)
Large Language Models for Biomedical Article Classification
di: Proboszcz, Jakub, et al.
Pubblicazione: (2026)
di: Proboszcz, Jakub, et al.
Pubblicazione: (2026)
How Do Large Language Models Acquire Factual Knowledge During Pretraining?
di: Chang, Hoyeon, et al.
Pubblicazione: (2024)
di: Chang, Hoyeon, et al.
Pubblicazione: (2024)
PustakAI: Curriculum-Aligned and Interactive Textbooks Using Large Language Models
di: Sharma, Shivam, et al.
Pubblicazione: (2025)
di: Sharma, Shivam, et al.
Pubblicazione: (2025)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
di: Peters, Sydney, et al.
Pubblicazione: (2025)
di: Peters, Sydney, et al.
Pubblicazione: (2025)
Strategy Adaptation in Large Language Model Werewolf Agents
di: Nakamori, Fuya, et al.
Pubblicazione: (2025)
di: Nakamori, Fuya, et al.
Pubblicazione: (2025)
Socially Responsible Data for Large Multilingual Language Models
di: Smart, Andrew, et al.
Pubblicazione: (2024)
di: Smart, Andrew, et al.
Pubblicazione: (2024)
OPOR-Bench: Evaluating Large Language Models on Online Public Opinion Report Generation
di: Yu, Jinzheng, et al.
Pubblicazione: (2025)
di: Yu, Jinzheng, et al.
Pubblicazione: (2025)
IWLV-Ramayana: A Sarga-Aligned Parallel Corpus of Valmiki's Ramayana Across Indian Languages
di: VP, Sumesh
Pubblicazione: (2026)
di: VP, Sumesh
Pubblicazione: (2026)
Comparing Complex Concepts with Transformers: Matching Patent Claims Against Natural Language Text
di: Blume, Matthias, et al.
Pubblicazione: (2024)
di: Blume, Matthias, et al.
Pubblicazione: (2024)
Building and Aligning Comparable Corpora
di: Saad, Motaz, et al.
Pubblicazione: (2025)
di: Saad, Motaz, et al.
Pubblicazione: (2025)
Large Language Models for Persian $ \leftrightarrow $ English Idiom Translation
di: Rezaeimanesh, Sara, et al.
Pubblicazione: (2024)
di: Rezaeimanesh, Sara, et al.
Pubblicazione: (2024)
Qomhra: A Bilingual Irish and English Large Language Model
di: McInerney, Joseph, et al.
Pubblicazione: (2025)
di: McInerney, Joseph, et al.
Pubblicazione: (2025)
Dialect Normalization using Large Language Models and Morphological Rules
di: Dimakis, Antonios, et al.
Pubblicazione: (2025)
di: Dimakis, Antonios, et al.
Pubblicazione: (2025)
Towards Human Understanding of Paraphrase Types in Large Language Models
di: Meier, Dominik, et al.
Pubblicazione: (2024)
di: Meier, Dominik, et al.
Pubblicazione: (2024)
RUQuant: Towards Refining Uniform Quantization for Large Language Models
di: Liu, Han, et al.
Pubblicazione: (2026)
di: Liu, Han, et al.
Pubblicazione: (2026)
Towards Fundamental Language Models: Does Linguistic Competence Scale with Model Size?
di: Collado-Montañez, Jaime, et al.
Pubblicazione: (2025)
di: Collado-Montañez, Jaime, et al.
Pubblicazione: (2025)
Have Faith in Faithfulness: Going Beyond Circuit Overlap When Finding Model Mechanisms
di: Hanna, Michael, et al.
Pubblicazione: (2024)
di: Hanna, Michael, et al.
Pubblicazione: (2024)
A Domain-Based Taxonomy of Jailbreak Vulnerabilities in Large Language Models
di: Peláez-González, Carlos, et al.
Pubblicazione: (2025)
di: Peláez-González, Carlos, et al.
Pubblicazione: (2025)
Personality, Role, and Expressive Style in Large Language Models: An Interactionist Analysis
di: Nagao, Moe, et al.
Pubblicazione: (2026)
di: Nagao, Moe, et al.
Pubblicazione: (2026)
CRISP: Persistent Concept Unlearning via Sparse Autoencoders
di: Ashuach, Tomer, et al.
Pubblicazione: (2025)
di: Ashuach, Tomer, et al.
Pubblicazione: (2025)
Large Language Model (LLM) Bias Index -- LLMBI
di: Oketunji, Abiodun Finbarrs, et al.
Pubblicazione: (2023)
di: Oketunji, Abiodun Finbarrs, et al.
Pubblicazione: (2023)
Engineering A Large Language Model From Scratch
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2024)
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2024)
German Text Simplification: Finetuning Large Language Models with Semi-Synthetic Data
di: Klöser, Lars, et al.
Pubblicazione: (2024)
di: Klöser, Lars, et al.
Pubblicazione: (2024)
LLM-Ref: Enhancing Reference Handling in Technical Writing with Large Language Models
di: Fuad, Kazi Ahmed Asif, et al.
Pubblicazione: (2024)
di: Fuad, Kazi Ahmed Asif, et al.
Pubblicazione: (2024)
PLM: Efficient Peripheral Language Models Hardware-Co-Designed for Ubiquitous Computing
di: Deng, Cheng, et al.
Pubblicazione: (2025)
di: Deng, Cheng, et al.
Pubblicazione: (2025)
Towards Alignment-Centric Paradigm: A Survey of Instruction Tuning in Large Language Models
di: Han, Xudong, et al.
Pubblicazione: (2025)
di: Han, Xudong, et al.
Pubblicazione: (2025)
When Self-Reference Fails to Close: Matrix-Level Dynamics in Large Language Models
di: Bae, Ji Ho
Pubblicazione: (2026)
di: Bae, Ji Ho
Pubblicazione: (2026)
SEPTQ: A Simple and Effective Post-Training Quantization Paradigm for Large Language Models
di: Liu, Han, et al.
Pubblicazione: (2026)
di: Liu, Han, et al.
Pubblicazione: (2026)
EnDive: A Cross-Dialect Benchmark for Fairness and Performance in Large Language Models
di: Gupta, Abhay, et al.
Pubblicazione: (2025)
di: Gupta, Abhay, et al.
Pubblicazione: (2025)
Aligning the Norwegian UD Treebank with Entity and Coreference Information
di: Jørgensen, Tollef Emil, et al.
Pubblicazione: (2023)
di: Jørgensen, Tollef Emil, et al.
Pubblicazione: (2023)
After Retrieval, Before Generation: Enhancing the Trustworthiness of Large Language Models in Retrieval-Augmented Generation
di: Dai, Xinbang, et al.
Pubblicazione: (2025)
di: Dai, Xinbang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
A Multi-Pass Large Language Model Framework for Precise and Efficient Radiology Report Error Detection
di: Kim, Songsoo, et al.
Pubblicazione: (2025) -
Argumentative Large Language Models for Explainable and Contestable Claim Verification
di: Freedman, Gabriel, et al.
Pubblicazione: (2024) -
Can Large Language Models perform Relation-based Argument Mining?
di: Gorur, Deniz, et al.
Pubblicazione: (2024) -
Effective and Efficient Schema-aware Information Extraction Using On-Device Large Language Models
di: Wen, Zhihao, et al.
Pubblicazione: (2025) -
A Closer Look at Bias and Chain-of-Thought Faithfulness of Large (Vision) Language Models
di: Balasubramanian, Sriram, et al.
Pubblicazione: (2025)