Saltar al contenido
Universidad del Mar SIBUMAR Descubridor Institucional UMAR
  • Inicio
  • Búsqueda avanzada
  • Explorar
  • Entrar
    • English
    • Deutsch
    • Español
    • Français
    • Italiano
Búsqueda avanzada
  • AI Deception: Risks, Dynamics, and Controls
Imagen de Portada

AI Deception: Risks, Dynamics, and Controls

Fuente: arXiv
Guardado en:
Detalles Bibliográficos
Autores principales: Chen, Boyuan, Fang, Sitong, Ji, Jiaming, Zhu, Yanxu, Wen, Pengcheng, Wu, Jinzhou, Tan, Yingshui, Zheng, Boren, Yuan, Mengying, Chen, Wenqi, Hong, Donghai, Qiu, Alex, Chen, Xin, Zhou, Jiayi, Wang, Kaile, Dai, Juntao, Zhang, Borong, Yang, Tianzhuo, Siddiqui, Saad, Duan, Isabella, Duan, Yawen, Tse, Brian, Jen-Tse, Huang, Wang, Kun, Zheng, Baihui, Liu, Jiaheng, Yang, Jian, Li, Yiming, Chen, Wenting, Liu, Dongrui, Vierling, Lukas, Xi, Zhiheng, Fu, Haobo, Wang, Wenxuan, Sang, Jitao, Shi, Zhengyan, Chan, Chi-Min, Shi, Eugenie, Li, Simin, Li, Juncheng, Ji, Wei, Li, Dong, Yang, Jinglin, Song, Jun, Dong, Yinpeng, Fu, Jie, Zheng, Bo, Yang, Min, Guo, Yike, Torr, Philip, Trager, Robert, Zeng, Yi, Wang, Zhongyuan, Yang, Yaodong, Huang, Tiejun, Zhang, Ya-Qin, Zhang, Hongjiang, Yao, Andrew
Formato: Preprint
Publicado: 2025
Materias:
Artificial Intelligence
Acceso en línea:
Acceder al recurso
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
  • Citar
  • Describir
  • Enviar este por Correo electrónico
  • Imprimir
  • Exportar Registro
    • Exportar a RefWorks
    • Exportar a EndNoteWeb
    • Exportar a EndNote
  • Agregar a favoritos
  • Enlace Permanente
  • Existencias
  • Descripción
  • Comentarios
  • Ejemplares similares
  • Vista Equipo
Descripción
Descripción no disponible.

Ejemplares similares

  • Beyond Safe Answers: A Benchmark for Evaluating True Risk Awareness in Large Reasoning Models
    por: Zheng, Baihui, et al.
    Publicado: (2025)
  • PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference
    por: Ji, Jiaming, et al.
    Publicado: (2024)
  • PromptKD: Unsupervised Prompt Distillation for Vision-Language Models
    por: Li, Zheng, et al.
    Publicado: (2024)
  • VISA: Value Injection via Shielded Adaptation for Personalized LLM Alignment
    por: Chen, Jiawei, et al.
    Publicado: (2026)
  • A Game-Theoretic Negotiation Framework for Cross-Cultural Consensus in LLMs
    por: Zhang, Guoxi, et al.
    Publicado: (2025)
Universidad del Mar
Universidad del MarSistema Bibliotecario de la Universidad del MarDescubridor Institucional UMARImplementación y desarrollo: Mtro. Carlos Alonso Albores Pérez
InicioBúsqueda avanzadaExplorar
Visitas al Descubridor: 246,687© 2026 Universidad del Mar