其他arXiv 2610.01539
研究者提出 AI 评估沙盒配置器,支持欧盟 AI 法案下的技术评估
提出 AI 评估沙盒配置器,支撑监管沙盒多方技术评估与报告
- arXiv
- 2610.01539
- 发表
- 场景
- 模型与 API
- 被测模型
- LLM-backed conversational assistant
摘要框架把每次技术测试配成沙盒。
AI Assessment Sandbox Configurator是面向欧盟 AIRS 中结构化技术测试的开源配置框架,用来按一次参与组装评估环境。
提出 AI 评估沙盒配置器,支撑监管沙盒多方技术评估与报告
AI Assessment Sandbox Configurator是面向欧盟 AIRS 中结构化技术测试的开源配置框架,用来按一次参与组装评估环境。
提出弹性沙箱基础设施 DSec,支撑大规模智能体训练
DSec 是 DeepSeek-AI 的生产沙箱平台,用来支撑从 DeepSeek V3.2 到 V4.1 的智能体 RL 与评测,而不是报告某个模型的任务准确率。
提出混合 CKKS/TFHE 的隐私保护 LLM 解码框架 ROSETTA
ROSETTA 是面向 LLM decode 的混合 CKKS/TFHE 隐私推理框架,目标是在 honest-but-curious 两方设定下,让服务器在密文上完成解码,同时保住权重和用户输入。
本文是一份推理时 AI 治理的可行性分类,用来接上作者自己的硬件层分类。