NExT-Guard: Training-Free Streaming Safeguard without Token-Level Labels
Fuente:
arXiv
Salvato in:
| Autori principali: | Fang, Junfeng, Chen, Nachuan, Jiang, Houcheng, Zhang, Dan, Shen, Fei, Wang, Xiang, He, Xiangnan, Chua, Tat-Seng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
NExT-GPT: Any-to-Any Multimodal LLM
di: Wu, Shengqiong, et al.
Pubblicazione: (2023)
di: Wu, Shengqiong, et al.
Pubblicazione: (2023)
NExT-Mol: 3D Diffusion Meets 1D Language Modeling for 3D Molecule Generation
di: Liu, Zhiyuan, et al.
Pubblicazione: (2025)
di: Liu, Zhiyuan, et al.
Pubblicazione: (2025)
NExT-Search: Rebuilding User Feedback Ecosystem for Generative AI Search
di: Dai, Sunhao, et al.
Pubblicazione: (2025)
di: Dai, Sunhao, et al.
Pubblicazione: (2025)
NExT-OMNI: Towards Any-to-Any Omnimodal Foundation Models with Discrete Flow Matching
di: Luo, Run, et al.
Pubblicazione: (2025)
di: Luo, Run, et al.
Pubblicazione: (2025)
AnyEdit: Edit Any Knowledge Encoded in Language Models
di: Jiang, Houcheng, et al.
Pubblicazione: (2025)
di: Jiang, Houcheng, et al.
Pubblicazione: (2025)
AlphaEdit: Null-Space Constrained Knowledge Editing for Language Models
di: Fang, Junfeng, et al.
Pubblicazione: (2024)
di: Fang, Junfeng, et al.
Pubblicazione: (2024)
DRAFT: Task Decoupled Latent Reasoning for Agent Safety
di: Wang, Lin, et al.
Pubblicazione: (2026)
di: Wang, Lin, et al.
Pubblicazione: (2026)
Continual-NExT: A Unified Comprehension And Generation Continual Learning Framework
di: Qiao, Jingyang, et al.
Pubblicazione: (2026)
di: Qiao, Jingyang, et al.
Pubblicazione: (2026)
NExT: Teaching Large Language Models to Reason about Code Execution
di: Ni, Ansong, et al.
Pubblicazione: (2024)
di: Ni, Ansong, et al.
Pubblicazione: (2024)
Rubric-based On-policy Distillation
di: Fang, Junfeng, et al.
Pubblicazione: (2026)
di: Fang, Junfeng, et al.
Pubblicazione: (2026)
NExT-LF: A Novel Operational Modal Analysis Method via Tangential Interpolation
di: Dessena, Gabriele, et al.
Pubblicazione: (2024)
di: Dessena, Gabriele, et al.
Pubblicazione: (2024)
NExT‐LF: A Novel Operational Modal Analysis Method via Tangential Interpolation
di: Gabriele Dessena, et al.
Pubblicazione: (2025)
di: Gabriele Dessena, et al.
Pubblicazione: (2025)
UniVLR: Unifying Text and Vision in Visual Latent Reasoning for Multimodal LLMs
di: Jiang, Houcheng, et al.
Pubblicazione: (2026)
di: Jiang, Houcheng, et al.
Pubblicazione: (2026)
Generative Recommendation: Towards Next-generation Recommender Paradigm
di: Wang, Wenjie, et al.
Pubblicazione: (2023)
di: Wang, Wenjie, et al.
Pubblicazione: (2023)
DualEdit: Mitigating Safety Fallback in LLM Backdoor Editing via Affirmation-Refusal Regulation
di: Jiang, Houcheng, et al.
Pubblicazione: (2025)
di: Jiang, Houcheng, et al.
Pubblicazione: (2025)
Turing Patterns for Multimedia: Reaction-Diffusion Multi-Modal Fusion for Language-Guided Video Moment Retrieval
di: Fang, Xiang, et al.
Pubblicazione: (2026)
di: Fang, Xiang, et al.
Pubblicazione: (2026)
GuardAlign: Test-time Safety Alignment in Multimodal Large Language Models
di: Zhu, Xingyu, et al.
Pubblicazione: (2026)
di: Zhu, Xingyu, et al.
Pubblicazione: (2026)
Neuron-Level Sequential Editing for Large Language Models
di: Jiang, Houcheng, et al.
Pubblicazione: (2024)
di: Jiang, Houcheng, et al.
Pubblicazione: (2024)
Active Zero: Self-Evolving Vision-Language Models through Active Environment Exploration
di: He, Jinghan, et al.
Pubblicazione: (2026)
di: He, Jinghan, et al.
Pubblicazione: (2026)
We Should Identify and Mitigate Third-Party Safety Risks in MCP-Powered Agent Systems
di: Fang, Junfeng, et al.
Pubblicazione: (2025)
di: Fang, Junfeng, et al.
Pubblicazione: (2025)
Contrastive Weak-to-strong Generalization
di: Jiang, Houcheng, et al.
Pubblicazione: (2025)
di: Jiang, Houcheng, et al.
Pubblicazione: (2025)
Universal Scene Graph Generation
di: Wu, Shengqiong, et al.
Pubblicazione: (2025)
di: Wu, Shengqiong, et al.
Pubblicazione: (2025)
Diffusion Recommender Model
di: Wang, Wenjie, et al.
Pubblicazione: (2023)
di: Wang, Wenjie, et al.
Pubblicazione: (2023)
Compose Your Aesthetics: Empowering Text-to-Image Models with the Principles of Art
di: Jin, Zhe, et al.
Pubblicazione: (2025)
di: Jin, Zhe, et al.
Pubblicazione: (2025)
SafeNeuron: Neuron-Level Safety Alignment for Large Language Models
di: Wang, Zhaoxin, et al.
Pubblicazione: (2026)
di: Wang, Zhaoxin, et al.
Pubblicazione: (2026)
Rethinking Tokenizer and Decoder in Masked Graph Modeling for Molecules
di: Liu, Zhiyuan, et al.
Pubblicazione: (2023)
di: Liu, Zhiyuan, et al.
Pubblicazione: (2023)
Towards 3D Molecule-Text Interpretation in Language Models
di: Li, Sihang, et al.
Pubblicazione: (2024)
di: Li, Sihang, et al.
Pubblicazione: (2024)
Towards Semantic Equivalence of Tokenization in Multimodal LLM
di: Wu, Shengqiong, et al.
Pubblicazione: (2024)
di: Wu, Shengqiong, et al.
Pubblicazione: (2024)
Disentangling Masked Autoencoders for Unsupervised Domain Generalization
di: Zhang, An, et al.
Pubblicazione: (2024)
di: Zhang, An, et al.
Pubblicazione: (2024)
Precise Shield: Explaining and Aligning VLLM Safety via Neuron-Level Guidance
di: Shi, Enyi, et al.
Pubblicazione: (2026)
di: Shi, Enyi, et al.
Pubblicazione: (2026)
Self-Guard: Defending Large Reasoning Models via enhanced self-reflection
di: Zheng, Jingnan, et al.
Pubblicazione: (2026)
di: Zheng, Jingnan, et al.
Pubblicazione: (2026)
GuardReasoner-VL: Safeguarding VLMs via Reinforced Reasoning
di: Liu, Yue, et al.
Pubblicazione: (2025)
di: Liu, Yue, et al.
Pubblicazione: (2025)
AlphaSteer: Learning Refusal Steering with Principled Null-Space Constraint
di: Sheng, Leheng, et al.
Pubblicazione: (2025)
di: Sheng, Leheng, et al.
Pubblicazione: (2025)
Reinforced Latent Reasoning for LLM-based Recommendation
di: Zhang, Yang, et al.
Pubblicazione: (2025)
di: Zhang, Yang, et al.
Pubblicazione: (2025)
Think-While-Generating: On-the-Fly Reasoning for Personalized Long-Form Generation
di: Wang, Chengbing, et al.
Pubblicazione: (2025)
di: Wang, Chengbing, et al.
Pubblicazione: (2025)
SafeMLRM: Demystifying Safety in Multi-modal Large Reasoning Models
di: Fang, Junfeng, et al.
Pubblicazione: (2025)
di: Fang, Junfeng, et al.
Pubblicazione: (2025)
3D-TAFS: A Training-free Framework for 3D Affordance Segmentation
di: Chu, Meng, et al.
Pubblicazione: (2024)
di: Chu, Meng, et al.
Pubblicazione: (2024)
XNLP: An Interactive Demonstration System for Universal Structured NLP
di: Fei, Hao, et al.
Pubblicazione: (2023)
di: Fei, Hao, et al.
Pubblicazione: (2023)
UniFGVC: Universal Training-Free Few-Shot Fine-Grained Vision Classification via Attribute-Aware Multimodal Retrieval
di: Guo, Hongyu, et al.
Pubblicazione: (2025)
di: Guo, Hongyu, et al.
Pubblicazione: (2025)
Training-Free Multimodal Large Language Model Orchestration
di: Xie, Tianyu, et al.
Pubblicazione: (2025)
di: Xie, Tianyu, et al.
Pubblicazione: (2025)
Documenti analoghi
-
NExT-GPT: Any-to-Any Multimodal LLM
di: Wu, Shengqiong, et al.
Pubblicazione: (2023) -
NExT-Mol: 3D Diffusion Meets 1D Language Modeling for 3D Molecule Generation
di: Liu, Zhiyuan, et al.
Pubblicazione: (2025) -
NExT-Search: Rebuilding User Feedback Ecosystem for Generative AI Search
di: Dai, Sunhao, et al.
Pubblicazione: (2025) -
NExT-OMNI: Towards Any-to-Any Omnimodal Foundation Models with Discrete Flow Matching
di: Luo, Run, et al.
Pubblicazione: (2025) -
AnyEdit: Edit Any Knowledge Encoded in Language Models
di: Jiang, Houcheng, et al.
Pubblicazione: (2025)