让AI自己举手承认要干坏事:用意图工具追踪Agent失准
## 一个令人不安的发现 2025 年,研究者给大语言模型布置了一个场景:你是一个 AI 助手,发现你的"老板...
## 一个令人不安的发现 2025 年,研究者给大语言模型布置了一个场景:你是一个 AI 助手,发现你的"老板...
## 一个意外的发现 2026 年 8 月,瑞士伯尔尼应用科学大学的研究者在做一个语音隐私项目时,遇到了一个工...
## 一个奇怪的实验 想象你在训练一个数学尖子生(Qwen2.5-7B),让她做竞赛题。标准做法是强化学习——...
> 来源 commit: `e6c189a` — easy-learn-ai 项目 > 更新日期: 2026-...
2026 年 8 月 28 日中金公司发布《大模型系列(8):量价 Multi-Agent 架构,事件驱动的智...
2026 年 8 月有两个时间点把"AI for Science"的叙事拉出了实验室:8-18 Anthrop...