博客
记录我对 AI 产品、eval / benchmark 方法论与设计的思考。
从 2023 年开始做大模型应用,我越来越确信:最快适应 AI 的人,往往不是技术最强的人。每一代「原生的人」,差别不在工具,而在默认假设。
一个九岁孩子用 Claude Code 做出了一款精美的游戏。模型已经够聪明——真正的问题是:什么样的交互,能让一张"有心力的白纸"也驾驭得了这份聪明?
PRD 已死,benchmark 永生。AI 时代,PM 的价值载体正在迁移:从写需求文档,到定义模型行为标准。