其他arXiv 2610.00812
视频生成模型的后训练与对齐综述
综述视频生成的后训练与对齐,并汇总基准与开放挑战
- arXiv
- 2610.00812
- 发表
- 场景
- 模型与 API
- 测试
- Wan、HunyuanVideo、OpenSora 等 8 个
- 组件图像生成
摘要综述把视频后训练分成四类对齐信号,并指出奖励、长视频、权衡和安全仍开放。
这是一篇视频生成 后训练与对齐 综述:预训练模型已有强先验,但作者认为仍不能可靠遵循意图、维持时间连贯或满足物理与安全约束。
综述视频生成的后训练与对齐,并汇总基准与开放挑战
这是一篇视频生成 后训练与对齐 综述:预训练模型已有强先验,但作者认为仍不能可靠遵循意图、维持时间连贯或满足物理与安全约束。
提出 SAVER 框架综述自演化智能体的安全状态转移
SAVER 是一篇关于自演化智能体安全的转移中心综述:安全对象从单次回答或单次授权动作,转到可复用状态在多次转移中的谱系。
提出 SGA-Flow-GRPO,用奖励梯度调制文生图模型的 token 级优势