跳到正文

从来源,看到研究的联系

让信息汇流,让研究相连。点选一条线索,看它从哪里来、通向哪些方向。

图中 6 条 · 本页 24 条 · 共 953 条动态论文会议论文
关系图可左右滑动,完整标题也在下方列表中
1 / 4
材料关系图:来源、新闻与研究、细分方向的桑基流图01来源302新闻与研究603细分与主体7来源:arXiv:越狱、提示注入、投毒与防御arXiv:越狱、提示注入、投毒与防御1 条材料来源:Unit 42Unit 421 条材料来源:NVIDIA 技术博客:可信 AI 与网络安全NVIDIA 技术博客:可信 AI 与网络安全4 条材料论文:Constitutional adapters:用推理期干预防御越狱与失准论文2026-09-29Constitutional adapters:用推理期干预防御越狱与失准动态:Unit 42 提出扰动探测方法,定位 LLM 安全拒答的少量神经元动态2026-08-28Unit 42 提出扰动探测方法,定位 LLM 安全拒答的少量神经元动态:NVIDIA 用 WebAssembly 沙箱隔离智能体 AI 工作流动态2024-12-16NVIDIA 用 WebAssembly 沙箱隔离智能体AI 工作流动态:NVIDIA 发布《NVIDIA AI Enterprise 安全》白皮书动态2024-12-20NVIDIA 发布《NVIDIA AI Enterprise 安全》白皮书动态:如何用 NVIDIA NeMo Guardrails 保护客服 AI 智能体动态2025-01-16如何用 NVIDIA NeMo Guardrails 保护客服 AI 智能体动态:在 NVIDIA NeMo Guardrails 中用 Cleanlab 可信语言模型防止 LLM 幻觉动态2025-04-09在 NVIDIA NeMo Guardrails 中用Cleanlab 可信语言模型防止 LLM 幻觉方向:对齐对齐1方向:可解释性可解释性1方向:其他方向其他方向3方向:防御与护栏防御与护栏6方向:Agent 安全Agent 安全2方向:NVIDIANVIDIA4方向:工具与开源工具与开源3
流带宽度表示材料数量,多标签均分;连线表示来源与分类归属。4 个较少出现的方向归入「其他方向」,点选可查看。

点选节点,展开一条线索

查看材料的摘要与原文,或探索同一来源、同一方向下的内容。

本页材料

完整标题与摘要 · 24 条