Aller au contenu
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Connexion
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Recherche avancée
  • AI Deception: Risks, Dynamics, and Controls
Image de couverture de livre

AI Deception: Risks, Dynamics, and Controls

Fuente: arXiv
Enregistré dans:
Détails bibliographiques
Auteurs principaux: Chen, Boyuan, Fang, Sitong, Ji, Jiaming, Zhu, Yanxu, Wen, Pengcheng, Wu, Jinzhou, Tan, Yingshui, Zheng, Boren, Yuan, Mengying, Chen, Wenqi, Hong, Donghai, Qiu, Alex, Chen, Xin, Zhou, Jiayi, Wang, Kaile, Dai, Juntao, Zhang, Borong, Yang, Tianzhuo, Siddiqui, Saad, Duan, Isabella, Duan, Yawen, Tse, Brian, Jen-Tse, Huang, Wang, Kun, Zheng, Baihui, Liu, Jiaheng, Yang, Jian, Li, Yiming, Chen, Wenting, Liu, Dongrui, Vierling, Lukas, Xi, Zhiheng, Fu, Haobo, Wang, Wenxuan, Sang, Jitao, Shi, Zhengyan, Chan, Chi-Min, Shi, Eugenie, Li, Simin, Li, Juncheng, Ji, Wei, Li, Dong, Yang, Jinglin, Song, Jun, Dong, Yinpeng, Fu, Jie, Zheng, Bo, Yang, Min, Guo, Yike, Torr, Philip, Trager, Robert, Zeng, Yi, Wang, Zhongyuan, Yang, Yaodong, Huang, Tiejun, Zhang, Ya-Qin, Zhang, Hongjiang, Yao, Andrew
Format: Preprint
Publié: 2025
Sujets:
Artificial Intelligence
Accès en ligne:
Acceder al recurso
Tags: Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
  • Citer
  • Envoyer par SMS
  • Envoyer par courriel
  • Imprimer
  • Exporter les notices
    • Exporter vers RefWorks
    • Exporter vers EndNoteWeb
    • Exporter vers EndNote
  • Ajouter aux favoris
  • Permalien
  • Exemplaires
  • Description
  • Commentaires
  • Documents similaires
  • Affichage MARC
Soyez le premier à ajouter un commentaire!
Il faut se connecter d'abord

Documents similaires

  • Beyond Safe Answers: A Benchmark for Evaluating True Risk Awareness in Large Reasoning Models
    par: Zheng, Baihui, et autres
    Publié: (2025)
  • PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference
    par: Ji, Jiaming, et autres
    Publié: (2024)
  • PromptKD: Unsupervised Prompt Distillation for Vision-Language Models
    par: Li, Zheng, et autres
    Publié: (2024)
  • VISA: Value Injection via Shielded Adaptation for Personalized LLM Alignment
    par: Chen, Jiawei, et autres
    Publié: (2026)
  • A Game-Theoretic Negotiation Framework for Cross-Cultural Consensus in LLMs
    par: Zhang, Guoxi, et autres
    Publié: (2025)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 247,931© 2026 Universidad del Mar