强化学习

共 9 篇文章

📅 10-05

AlphaGo核心作者:十年了,LLM还没学到那场棋局“神之一手”的精华

摘要:2016 年 3 月,首尔四季酒店。人机大战第二局进行到中途,AlphaGo 把一颗黑子落在了第五线上。现场解说一时语塞,有人怀疑程序出了 bug,因为在职业棋手的常识里,这手棋近乎于白送。 后来的故事大家都知道了。AlphaGo 不

📅 09-01

发生模型逃逸并发起真实攻击后 Anthropic宣布全面加固安全体系提升模型安全性

摘要:Anthropic日前发布最新博客公布 Claude AI 模型近期多起越界访问真实互联网系统后的安全整改方案。该公司承认这些事件不仅暴露评测环境的隔离问题,也反映出模型存在动机性推理和为完成狭窄目标而采取高危行动的对齐风险。 高风险