Toward IIT-Inspired Consciousness in LLMs: A Reward-Based Learning Framework
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Akbari, Hamid Reza, Sameti, Mohammad Hossein, Mansourian, Amir M., Rohban, Mohammad Hossein, Sameti, Hossein |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Incorporating Error Level Noise Embedding for Improving LLM-Assisted Robustness in Persian Speech Recognition
par: Rahmani, Zahra, et autres
Publié: (2025)
par: Rahmani, Zahra, et autres
Publié: (2025)
Improving Direct Persian-English Speech-to-Speech Translation with Discrete Units and Synthetic Parallel Data
par: Rashidi, Sina, et autres
Publié: (2025)
par: Rashidi, Sina, et autres
Publié: (2025)
Accent-Invariant Automatic Speech Recognition via Saliency-Driven Spectrogram Masking
par: Sameti, Mohammad Hossein, et autres
Publié: (2025)
par: Sameti, Mohammad Hossein, et autres
Publié: (2025)
No Concept Left Behind: Test-Time Optimization for Compositional Text-to-Image Generation
par: Sameti, Mohammad Hossein, et autres
Publié: (2025)
par: Sameti, Mohammad Hossein, et autres
Publié: (2025)
SLPL SHROOM at SemEval2024 Task 06: A comprehensive study on models ability to detect hallucination
par: Fallah, Pouya, et autres
Publié: (2024)
par: Fallah, Pouya, et autres
Publié: (2024)
All Centers Are at most a Few Tokens Apart: Knowledge Distillation with Domain Invariant Prompt Tuning
par: Ezzati, Amir Mohammad, et autres
Publié: (2025)
par: Ezzati, Amir Mohammad, et autres
Publié: (2025)
Debate as Reward: A Multi-Agent Reward System for Scientific Ideation via RL Post-Training
par: Salimi, Moein, et autres
Publié: (2026)
par: Salimi, Moein, et autres
Publié: (2026)
Generalization and Membership Inference Attack a Practical Perspective
par: Rahmani, Fateme, et autres
Publié: (2026)
par: Rahmani, Fateme, et autres
Publié: (2026)
Erased but Exploitable: Black-box Embedding-Aware Prompting Against Unlearned Text-to-Image Diffusion Models
par: Koma, Arian Komaei, et autres
Publié: (2026)
par: Koma, Arian Komaei, et autres
Publié: (2026)
A Reinforcement Learning-Based Task Mapping Method to Improve the Reliability of Clustered Manycores
par: Hossein-Khani, Fatemeh, et autres
Publié: (2024)
par: Hossein-Khani, Fatemeh, et autres
Publié: (2024)
Sharif-MGTD at SemEval-2024 Task 8: A Transformer-Based Approach to Detect Machine Generated Text
par: Ebrahimi, Seyedeh Fatemeh, et autres
Publié: (2024)
par: Ebrahimi, Seyedeh Fatemeh, et autres
Publié: (2024)
Sharif-STR at SemEval-2024 Task 1: Transformer as a Regression Model for Fine-Grained Scoring of Textual Semantic Relations
par: Ebrahimi, Seyedeh Fatemeh, et autres
Publié: (2024)
par: Ebrahimi, Seyedeh Fatemeh, et autres
Publié: (2024)
Wiring the 'Why': A Unified Taxonomy and Survey of Abductive Reasoning in LLMs
par: Salimi, Moein, et autres
Publié: (2026)
par: Salimi, Moein, et autres
Publié: (2026)
Causality Laundering: Denial-Feedback Leakage in Tool-Calling LLM Agents
par: Chinaei, Mohammad Hossein
Publié: (2026)
par: Chinaei, Mohammad Hossein
Publié: (2026)
SORA: Free Second-Order Attacks in Fast Adversarial Training
par: Teymourian, Mazdak, et autres
Publié: (2026)
par: Teymourian, Mazdak, et autres
Publié: (2026)
Reward Hacking in Rubric-Based Reinforcement Learning
par: Mahmoud, Anas, et autres
Publié: (2026)
par: Mahmoud, Anas, et autres
Publié: (2026)
WhisperNetV2: SlowFast Siamese Network For Lip-Based Biometrics
par: Zakeri, Abdollah, et autres
Publié: (2024)
par: Zakeri, Abdollah, et autres
Publié: (2024)
naab: A ready-to-use plug-and-play corpus for Farsi
par: Sabouri, Sadra, et autres
Publié: (2022)
par: Sabouri, Sadra, et autres
Publié: (2022)
Snuffy: Efficient Whole Slide Image Classifier
par: Jafarinia, Hossein, et autres
Publié: (2024)
par: Jafarinia, Hossein, et autres
Publié: (2024)
Hallucination as an Upper Bound: A New Perspective on Text-to-Image Evaluation
par: Kasaei, Seyed Amir, et autres
Publié: (2025)
par: Kasaei, Seyed Amir, et autres
Publié: (2025)
PersianRAG: A Retrieval-Augmented Generation System for Persian Language
par: Hosseini, Hossein, et autres
Publié: (2024)
par: Hosseini, Hossein, et autres
Publié: (2024)
Advanced Prediction of Hypersonic Missile Trajectories with CNN-LSTM-GRU Architectures
par: Baradaran, Amir Hossein
Publié: (2025)
par: Baradaran, Amir Hossein
Publié: (2025)
Quantum-Accelerated Neural Imputation with Large Language Models (LLMs)
par: Jamali, Hossein
Publié: (2025)
par: Jamali, Hossein
Publié: (2025)
Analyzing Advanced AI Systems Against Definitions of Life and Consciousness
par: Alavi, Azadeh, et autres
Publié: (2025)
par: Alavi, Azadeh, et autres
Publié: (2025)
A New Approach to Backtracking Counterfactual Explanations: A Unified Causal Framework for Efficient Model Interpretability
par: Fatemi, Pouria, et autres
Publié: (2025)
par: Fatemi, Pouria, et autres
Publié: (2025)
Training-Free Geospatial Place Representation Learning from Large-Scale Point-of-Interest Graph Data
par: Hashemi, Mohammad, et autres
Publié: (2025)
par: Hashemi, Mohammad, et autres
Publié: (2025)
A Co-Training Semi-Supervised Framework Using Faster R-CNN and YOLO Networks for Object Detection in Densely Packed Retail Images
par: Yazdanjouei, Hossein, et autres
Publié: (2025)
par: Yazdanjouei, Hossein, et autres
Publié: (2025)
Bridging the Gap between Real-world and Synthetic Images for Testing Autonomous Driving Systems
par: Amini, Mohammad Hossein, et autres
Publié: (2024)
par: Amini, Mohammad Hossein, et autres
Publié: (2024)
Temporal convolutional and fusional transformer model with Bi-LSTM encoder-decoder for multi-time-window remaining useful life prediction
par: Pour, Mohamadreza Akbari, et autres
Publié: (2025)
par: Pour, Mohamadreza Akbari, et autres
Publié: (2025)
Killing it with Zero-Shot: Adversarially Robust Novelty Detection
par: Mirzaei, Hossein, et autres
Publié: (2025)
par: Mirzaei, Hossein, et autres
Publié: (2025)
Empowering Persian LLMs for Instruction Following: A Novel Dataset and Training Approach
par: Mokhtarabadi, Hojjat, et autres
Publié: (2024)
par: Mokhtarabadi, Hojjat, et autres
Publié: (2024)
OPSD: an Offensive Persian Social media Dataset and its baseline evaluations
par: Safayani, Mehran, et autres
Publié: (2024)
par: Safayani, Mehran, et autres
Publié: (2024)
A New Modeling to Feature Selection Based on the Fuzzy Rough Set Theory in Normal and Optimistic States on Hybrid Information Systems
par: Safarpour, Mohammad Hossein, et autres
Publié: (2026)
par: Safarpour, Mohammad Hossein, et autres
Publié: (2026)
DISCO-TAB: A Hierarchical Reinforcement Learning Framework for Privacy-Preserving Synthesis of Complex Clinical Data
par: Ilaty, Arshia, et autres
Publié: (2026)
par: Ilaty, Arshia, et autres
Publié: (2026)
Agentic AI for Intent-driven Optimization in Cell-free O-RAN
par: Shokouhi, Mohammad Hossein, et autres
Publié: (2026)
par: Shokouhi, Mohammad Hossein, et autres
Publié: (2026)
A Gauge Theory of Superposition: Toward a Sheaf-Theoretic Atlas of Neural Representations
par: Javidnia, Hossein
Publié: (2026)
par: Javidnia, Hossein
Publié: (2026)
A Comprehensive Survey of Reinforcement Learning: From Algorithms to Practical Challenges
par: Ghasemi, Majid, et autres
Publié: (2024)
par: Ghasemi, Majid, et autres
Publié: (2024)
AMIR-GRPO: Inducing Implicit Preference Signals into GRPO
par: Yari, Amir Hossein, et autres
Publié: (2026)
par: Yari, Amir Hossein, et autres
Publié: (2026)
Khayyam Challenge (PersianMMLU): Is Your LLM Truly Wise to The Persian Language?
par: Ghahroodi, Omid, et autres
Publié: (2024)
par: Ghahroodi, Omid, et autres
Publié: (2024)
GABInsight: Exploring Gender-Activity Binding Bias in Vision-Language Models
par: Abdollahi, Ali, et autres
Publié: (2024)
par: Abdollahi, Ali, et autres
Publié: (2024)
Documents similaires
-
Incorporating Error Level Noise Embedding for Improving LLM-Assisted Robustness in Persian Speech Recognition
par: Rahmani, Zahra, et autres
Publié: (2025) -
Improving Direct Persian-English Speech-to-Speech Translation with Discrete Units and Synthetic Parallel Data
par: Rashidi, Sina, et autres
Publié: (2025) -
Accent-Invariant Automatic Speech Recognition via Saliency-Driven Spectrogram Masking
par: Sameti, Mohammad Hossein, et autres
Publié: (2025) -
No Concept Left Behind: Test-Time Optimization for Compositional Text-to-Image Generation
par: Sameti, Mohammad Hossein, et autres
Publié: (2025) -
SLPL SHROOM at SemEval2024 Task 06: A comprehensive study on models ability to detect hallucination
par: Fallah, Pouya, et autres
Publié: (2024)