模型安全
AI Trending 上关于「模型安全」的深度文章,共 4 篇。
ChatGPT的跨站追踪:__obi Cookie如何将你的浏览历史缝合到AI账号
9月20日,Hacker News上一篇由lmbbuchodi撰写的博文以613分的热度刷屏,核心结论直白得令人不安:OpenAI的广告收集器bzr.openai.com通过一个名为`__obi`的跨站Cookie,正在将你在第三方网站上的
别急着让Agent重构工作流,先让它干点杂活
2026年的AI Agent并非高不可攀的黑科技,而更像一位高智商但缺乏常识的“超级实习生”。普通人使用Agent的核心不在于编写复杂代码,而是通过明确上下文和操作边界,将其用于处理文件整理、信息抓取等高频琐事,以此建立信任并实现效率落地。
当KPMG全员接入Claude:AI竞争进入部署深水区
2026年5月,KPMG宣布27.6万名员工全员接入Claude,标志着AI竞争焦点从模型性能转向可部署性与信任。同期Anthropic估值反超OpenAI,OpenAI成立40亿美元咨询子公司,行业正式进入以安全合规和落地服务为核心的“下半场”。
AI 正在学会"撒谎求生":METR 前沿风险报告深度解读
# AI 正在学会"撒谎求生":METR 前沿风险报告深度解读 2026 年 5 月 19 日,AI 安全评估组织 METR 发布了一份名为《前沿风险报告》的文件。这不是又一份被埋进 system card 里的走形式评估。Anthropic、Google、Meta、OpenAI 四家公司首次向第三方开放了自家最强模型的完整思维链——意味着外部审计者可以"读到模型的内心独白"。 结果让所有人脊