An exploration of features to improve the generalisability of fake news detection models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Hoy, Nathaniel, Koulouri, Theodora |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
COVID-19 Infodemic. Understanding content features in detecting fake news using a machine learning approach
par: Balakrishnan, Vimala, et autres
Publié: (2026)
par: Balakrishnan, Vimala, et autres
Publié: (2026)
Alignment faking in large language models
par: Greenblatt, Ryan, et autres
Publié: (2024)
par: Greenblatt, Ryan, et autres
Publié: (2024)
Can large language models explore in-context?
par: Krishnamurthy, Akshay, et autres
Publié: (2024)
par: Krishnamurthy, Akshay, et autres
Publié: (2024)
GETAE: Graph information Enhanced deep neural NeTwork ensemble ArchitecturE for fake news detection
par: Truică, Ciprian-Octavian, et autres
Publié: (2024)
par: Truică, Ciprian-Octavian, et autres
Publié: (2024)
Multimodal large language model for wheat breeding: a new exploration of smart breeding
par: Yang, Guofeng, et autres
Publié: (2024)
par: Yang, Guofeng, et autres
Publié: (2024)
What is it for a Machine Learning Model to Have a Capability?
par: Harding, Jacqueline, et autres
Publié: (2024)
par: Harding, Jacqueline, et autres
Publié: (2024)
Diversity Measures: Domain-Independent Proxies for Failure in Language Model Queries
par: Ngu, Noel, et autres
Publié: (2023)
par: Ngu, Noel, et autres
Publié: (2023)
Multi-step retrieval and reasoning improves radiology question answering with large language models
par: Wind, Sebastian, et autres
Publié: (2025)
par: Wind, Sebastian, et autres
Publié: (2025)
Tiny-Toxic-Detector: A compact transformer-based model for toxic content detection
par: Kamphuis, Michiel
Publié: (2024)
par: Kamphuis, Michiel
Publié: (2024)
BooookScore: A systematic exploration of book-length summarization in the era of LLMs
par: Chang, Yapei, et autres
Publié: (2023)
par: Chang, Yapei, et autres
Publié: (2023)
Zero-knowledge LLM hallucination detection and mitigation through fine-grained cross-model consistency
par: Goel, Aman, et autres
Publié: (2025)
par: Goel, Aman, et autres
Publié: (2025)
Scaling sparse feature circuit finding for in-context learning
par: Kharlapenko, Dmitrii, et autres
Publié: (2025)
par: Kharlapenko, Dmitrii, et autres
Publié: (2025)
Post-edits Are Preferences Too
par: Berger, Nathaniel, et autres
Publié: (2024)
par: Berger, Nathaniel, et autres
Publié: (2024)
fg-expo: Frontier-guided exploration-prioritized policy optimization via adaptive kl and gaussian curriculum
par: Lin, Mingxiong, et autres
Publié: (2026)
par: Lin, Mingxiong, et autres
Publié: (2026)
Interpretable Cross-Examination Technique (ICE-T): Using highly informative features to boost LLM performance
par: Muric, Goran, et autres
Publié: (2024)
par: Muric, Goran, et autres
Publié: (2024)
Towards detecting unanticipated bias in Large Language Models
par: Kruspe, Anna
Publié: (2024)
par: Kruspe, Anna
Publié: (2024)
TIPS: Turn-Level Information-Potential Reward Shaping for Search-Augmented LLMs
par: Xie, Yutao, et autres
Publié: (2026)
par: Xie, Yutao, et autres
Publié: (2026)
SELF-[IN]CORRECT: LLMs Struggle with Discriminating Self-Generated Responses
par: Jiang, Dongwei, et autres
Publié: (2024)
par: Jiang, Dongwei, et autres
Publié: (2024)
Transformers for molecular property prediction: Domain adaptation efficiently improves performance
par: Sultan, Afnan, et autres
Publié: (2025)
par: Sultan, Afnan, et autres
Publié: (2025)
TQCompressor: improving tensor decomposition methods in neural networks via permutations
par: Abronin, V., et autres
Publié: (2024)
par: Abronin, V., et autres
Publié: (2024)
HIPO: Instruction Hierarchy via Constrained Reinforcement Learning
par: Chen, Keru, et autres
Publié: (2026)
par: Chen, Keru, et autres
Publié: (2026)
Prefill-Guided Thinking for zero-shot detection of AI-generated images
par: Kachwala, Zoher, et autres
Publié: (2025)
par: Kachwala, Zoher, et autres
Publié: (2025)
Classification is a RAG problem: A case study on hate speech detection
par: Willats, Richard, et autres
Publié: (2025)
par: Willats, Richard, et autres
Publié: (2025)
Explained anomaly detection in text reviews: Can subjective scenarios be correctly evaluated?
par: Novoa-Paradela, David, et autres
Publié: (2023)
par: Novoa-Paradela, David, et autres
Publié: (2023)
Genie: Achieving Human Parity in Content-Grounded Datasets Generation
par: Yehudai, Asaf, et autres
Publié: (2024)
par: Yehudai, Asaf, et autres
Publié: (2024)
Memory Injections: Correcting Multi-Hop Reasoning Failures during Inference in Transformer-Based Language Models
par: Sakarvadia, Mansi, et autres
Publié: (2023)
par: Sakarvadia, Mansi, et autres
Publié: (2023)
BoostStep: Boosting mathematical capability of Large Language Models via improved single-step reasoning
par: Zhang, Beichen, et autres
Publié: (2025)
par: Zhang, Beichen, et autres
Publié: (2025)
Catching rationalization in the act: detecting motivated reasoning before and after CoT via activation probing
par: Mirtaheri, Parsa, et autres
Publié: (2026)
par: Mirtaheri, Parsa, et autres
Publié: (2026)
Effective faking of verbal deception detection with target-aligned adversarial attacks
par: Kleinberg, Bennett, et autres
Publié: (2025)
par: Kleinberg, Bennett, et autres
Publié: (2025)
Illuminate: A novel approach for depression detection with explainable analysis and proactive therapy using prompt engineering
par: Agrawal, Aryan
Publié: (2024)
par: Agrawal, Aryan
Publié: (2024)
Mitigating Memorization In Language Models
par: Sakarvadia, Mansi, et autres
Publié: (2024)
par: Sakarvadia, Mansi, et autres
Publié: (2024)
Health Misinformation in Social Networks: A Survey of IT Approaches
par: Papanikou, Vasiliki, et autres
Publié: (2024)
par: Papanikou, Vasiliki, et autres
Publié: (2024)
The language of time: a language model perspective on time-series foundation models
par: Xie, Yi, et autres
Publié: (2025)
par: Xie, Yi, et autres
Publié: (2025)
Self-Improving Pretraining: using post-trained models to pretrain better models
par: Tan, Ellen Xiaoqing, et autres
Publié: (2026)
par: Tan, Ellen Xiaoqing, et autres
Publié: (2026)
Benchmarking zero-shot stance detection with FlanT5-XXL: Insights from training data, prompting, and decoding strategies into its near-SoTA performance
par: Aiyappa, Rachith, et autres
Publié: (2024)
par: Aiyappa, Rachith, et autres
Publié: (2024)
Representation in large language models
par: Yetman, Cameron
Publié: (2025)
par: Yetman, Cameron
Publié: (2025)
Auditing language models for hidden objectives
par: Marks, Samuel, et autres
Publié: (2025)
par: Marks, Samuel, et autres
Publié: (2025)
Adaptively profiling models with task elicitation
par: Brown, Davis, et autres
Publié: (2025)
par: Brown, Davis, et autres
Publié: (2025)
Lightweight reranking for language model generations
par: Jain, Siddhartha, et autres
Publié: (2023)
par: Jain, Siddhartha, et autres
Publié: (2023)
Toward universal steering and monitoring of AI models
par: Beaglehole, Daniel, et autres
Publié: (2025)
par: Beaglehole, Daniel, et autres
Publié: (2025)
Documents similaires
-
COVID-19 Infodemic. Understanding content features in detecting fake news using a machine learning approach
par: Balakrishnan, Vimala, et autres
Publié: (2026) -
Alignment faking in large language models
par: Greenblatt, Ryan, et autres
Publié: (2024) -
Can large language models explore in-context?
par: Krishnamurthy, Akshay, et autres
Publié: (2024) -
GETAE: Graph information Enhanced deep neural NeTwork ensemble ArchitecturE for fake news detection
par: Truică, Ciprian-Octavian, et autres
Publié: (2024) -
Multimodal large language model for wheat breeding: a new exploration of smart breeding
par: Yang, Guofeng, et autres
Publié: (2024)