Towards ethical multimodal systems
Fuente:
arXiv
Salvato in:
| Autori principali: | Roger, Alexis, Aïmeur, Esma, Rish, Irina |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Training Dynamics Underlying Language Model Scaling Laws: Loss Deceleration and Zero-Sum Learning
di: Mircea, Andrei, et al.
Pubblicazione: (2025)
di: Mircea, Andrei, et al.
Pubblicazione: (2025)
Attention-based sequential recommendation system using multimodal data
di: Oh, Hyungtaik, et al.
Pubblicazione: (2024)
di: Oh, Hyungtaik, et al.
Pubblicazione: (2024)
RomanLens: The Role Of Latent Romanization In Multilinguality In LLMs
di: Saji, Alan, et al.
Pubblicazione: (2025)
di: Saji, Alan, et al.
Pubblicazione: (2025)
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
di: Peters, Sydney, et al.
Pubblicazione: (2025)
di: Peters, Sydney, et al.
Pubblicazione: (2025)
Spectra: Surprising Effectiveness of Pretraining Ternary Language Models at Scale
di: Kaushal, Ayush, et al.
Pubblicazione: (2024)
di: Kaushal, Ayush, et al.
Pubblicazione: (2024)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
di: Oketunji, Abiodun Finbarrs
Pubblicazione: (2023)
SOCIA-Nabla: Textual Gradient Meets Multi-Agent Orchestration for Automated Simulator Generation
di: Hua, Yuncheng, et al.
Pubblicazione: (2025)
di: Hua, Yuncheng, et al.
Pubblicazione: (2025)
ALAS: A Stateful Multi-LLM Agent Framework for Disruption-Aware Planning
di: Chang, Edward Y., et al.
Pubblicazione: (2025)
di: Chang, Edward Y., et al.
Pubblicazione: (2025)
Evaluating Steering Techniques using Human Similarity Judgments
di: Studdiford, Zach, et al.
Pubblicazione: (2025)
di: Studdiford, Zach, et al.
Pubblicazione: (2025)
Unlocking the Wisdom of Large Language Models: An Introduction to The Path to Artificial General Intelligence
di: Chang, Edward Y.
Pubblicazione: (2024)
di: Chang, Edward Y.
Pubblicazione: (2024)
Reasoning-Based AI for Startup Evaluation (R.A.I.S.E.): A Memory-Augmented, Multi-Step Decision Framework
di: Preuveneers, Jack, et al.
Pubblicazione: (2025)
di: Preuveneers, Jack, et al.
Pubblicazione: (2025)
Understanding LLM Evaluator Behavior: A Structured Multi-Evaluator Framework for Merchant Risk Assessment
di: Wang, Liang, et al.
Pubblicazione: (2026)
di: Wang, Liang, et al.
Pubblicazione: (2026)
RADD: Retrieval-Augmented Discrete Diffusion for Multi-Modal Knowledge Graph Completion
di: Niu, Guanglin, et al.
Pubblicazione: (2026)
di: Niu, Guanglin, et al.
Pubblicazione: (2026)
Quantifying Self-Preservation Bias in Large Language Models
di: Migliarini, Matteo, et al.
Pubblicazione: (2026)
di: Migliarini, Matteo, et al.
Pubblicazione: (2026)
Evaluating Relational Reasoning in LLMs with REL
di: Fesser, Lukas, et al.
Pubblicazione: (2026)
di: Fesser, Lukas, et al.
Pubblicazione: (2026)
Latent Personality Alignment: Improving Harmlessness Without Mentioning Harms
di: Le, Linh, et al.
Pubblicazione: (2026)
di: Le, Linh, et al.
Pubblicazione: (2026)
KACE: Knowledge-Adaptive Context Engineering for Mathematical Reasoning
di: Parashar, Jayant, et al.
Pubblicazione: (2026)
di: Parashar, Jayant, et al.
Pubblicazione: (2026)
RAudit: A Blind Auditing Protocol for Large Language Model Reasoning
di: Chang, Edward Y., et al.
Pubblicazione: (2026)
di: Chang, Edward Y., et al.
Pubblicazione: (2026)
SciDMT: A Large-Scale Corpus for Detecting Scientific Mentions
di: Pan, Huitong, et al.
Pubblicazione: (2024)
di: Pan, Huitong, et al.
Pubblicazione: (2024)
AI-Powered Annotation Pipelines for Stabilizing Large Language Models: A Human-AI Synergy Approach
di: Pathak, Gangesh, et al.
Pubblicazione: (2025)
di: Pathak, Gangesh, et al.
Pubblicazione: (2025)
LLMs are Capable of Misaligned Behavior Under Explicit Prohibition and Surveillance
di: Ivanov, Igor
Pubblicazione: (2025)
di: Ivanov, Igor
Pubblicazione: (2025)
ToolWeaver: Weaving Collaborative Semantics for Scalable Tool Use in Large Language Models
di: Fang, Bowen, et al.
Pubblicazione: (2026)
di: Fang, Bowen, et al.
Pubblicazione: (2026)
PersistBench: When Should Long-Term Memories Be Forgotten by LLMs?
di: Pulipaka, Sidharth, et al.
Pubblicazione: (2026)
di: Pulipaka, Sidharth, et al.
Pubblicazione: (2026)
Heimdall: test-time scaling on the generative verification
di: Shi, Wenlei, et al.
Pubblicazione: (2025)
di: Shi, Wenlei, et al.
Pubblicazione: (2025)
Preventing Safety Drift in Large Language Models via Coupled Weight and Activation Constraints
di: Peng, Songping, et al.
Pubblicazione: (2026)
di: Peng, Songping, et al.
Pubblicazione: (2026)
SOCIA-EVO: Automated Simulator Construction via Dual-Anchored Bi-Level Optimization
di: Hua, Yuncheng, et al.
Pubblicazione: (2026)
di: Hua, Yuncheng, et al.
Pubblicazione: (2026)
Enhancing Mental Health Counseling Support in Bangladesh using Culturally-Grounded Knowledge
di: Hasan, Md Arid, et al.
Pubblicazione: (2026)
di: Hasan, Md Arid, et al.
Pubblicazione: (2026)
Executing Arithmetic: Fine-Tuning Large Language Models as Turing Machines
di: Lai, Junyu, et al.
Pubblicazione: (2024)
di: Lai, Junyu, et al.
Pubblicazione: (2024)
Process Supervision-Guided Policy Optimization for Code Generation
di: Dai, Ning, et al.
Pubblicazione: (2024)
di: Dai, Ning, et al.
Pubblicazione: (2024)
An Investigation of Neuron Activation as a Unified Lens to Explain Chain-of-Thought Eliciting Arithmetic Reasoning of LLMs
di: Rai, Daking, et al.
Pubblicazione: (2024)
di: Rai, Daking, et al.
Pubblicazione: (2024)
How LLMs Are Persuaded: A Few Attention Heads, Rerouted
di: Sun, Xiangkun, et al.
Pubblicazione: (2026)
di: Sun, Xiangkun, et al.
Pubblicazione: (2026)
Intrinsic Evaluation of RAG Systems for Deep-Logic Questions
di: Hu, Junyi, et al.
Pubblicazione: (2024)
di: Hu, Junyi, et al.
Pubblicazione: (2024)
From Extraction to Synthesis: Entangled Heuristics for Agent-Augmented Strategic Reasoning
di: Ghisellini, Renato, et al.
Pubblicazione: (2025)
di: Ghisellini, Renato, et al.
Pubblicazione: (2025)
Do Language Models Mirror Human Confidence? Exploring Psychological Insights to Address Overconfidence in LLMs
di: Xu, Chenjun, et al.
Pubblicazione: (2025)
di: Xu, Chenjun, et al.
Pubblicazione: (2025)
KemenkeuGPT: Leveraging a Large Language Model on Indonesia's Government Financial Data and Regulations to Enhance Decision Making
di: Febrian, Gilang Fajar, et al.
Pubblicazione: (2024)
di: Febrian, Gilang Fajar, et al.
Pubblicazione: (2024)
Multilingual De-Duplication Strategies: Applying scalable similarity search with monolingual & multilingual embedding models
di: Pasch, Stefan, et al.
Pubblicazione: (2024)
di: Pasch, Stefan, et al.
Pubblicazione: (2024)
LLM-based Automated Theorem Proving Hinges on Scalable Synthetic Data Generation
di: Lai, Junyu, et al.
Pubblicazione: (2025)
di: Lai, Junyu, et al.
Pubblicazione: (2025)
The Unified Cognitive Consciousness Theory for Language Models: Anchoring Semantics, Thresholds of Activation, and Emergent Reasoning
di: Chang, Edward Y., et al.
Pubblicazione: (2025)
di: Chang, Edward Y., et al.
Pubblicazione: (2025)
EVINCE: Optimizing Multi-LLM Dialogues Using Conditional Statistics and Information Theory
di: Chang, Edward Y.
Pubblicazione: (2024)
di: Chang, Edward Y.
Pubblicazione: (2024)
Learning Temporal Abstractions via Variational Homomorphisms in Option-Induced Abstract MDPs
di: Li, Chang, et al.
Pubblicazione: (2025)
di: Li, Chang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Training Dynamics Underlying Language Model Scaling Laws: Loss Deceleration and Zero-Sum Learning
di: Mircea, Andrei, et al.
Pubblicazione: (2025) -
Attention-based sequential recommendation system using multimodal data
di: Oh, Hyungtaik, et al.
Pubblicazione: (2024) -
RomanLens: The Role Of Latent Romanization In Multilinguality In LLMs
di: Saji, Alan, et al.
Pubblicazione: (2025) -
Text-Based Approaches to Item Difficulty Modeling in Large-Scale Assessments: A Systematic Review
di: Peters, Sydney, et al.
Pubblicazione: (2025) -
Spectra: Surprising Effectiveness of Pretraining Ternary Language Models at Scale
di: Kaushal, Ayush, et al.
Pubblicazione: (2024)