首页
观察
资讯
应用
产品
论坛
笔记
工具
导航
资源
▾
订阅更新
观察思考
全部
具身智能
大模型
安全
智能体,安全
深度解析
行业
视频大模型
安全
2025.05.15
RLHF 还不够:AI 对齐的新前沿
RLHF 把人类偏好注入模型,但它的成本、标注偏差与可扩展性正受到挑战。Constitutional AI、DPO 等新方法正在重塑对齐的工具箱。