
昨天 GitHub 发了一篇挺有意思的文章,题目直接点出了一个越来越明显的问题:Chat is great for intent, but agent work gets lost in the scroll.我很认同。过去两年,我们几乎默认了一个 UI 逻辑:AI = Chat用户输入一句话,AI 回复一大段。可 Agent 一旦从“回答问题”变成“执行任务”,这个界面开始变得别扭。比如一个 Coding Agent 正在做:理解需求 →读 18 个文件 →拆 7 个任务 →修改 5 个文件 →跑测试 →修 3 个失败 →再跑测试 →等待人工确认最后这一切都被塞进一条越来越长的聊天记录。问题就来了。我真正想看的不是它说了什么,而是它现在是什么状态用户问:“现在做到哪了?”聊天记录可能已经有 80 屏。真正应该回答的是:任务:登录模块重构 总步骤:7 完成:4 进行中:1 阻塞:1 待人工:1 已修改: - AuthService.java - JwtFilter.java - LoginController.java 测试: 32 passed 2 failed 预算: $1.82 / $3.00这不是 Chat UI。这是任务控制面。GitHub 那篇文章里提到的一个现实问题很关键Agent 生成代码的速度,已经开始超过人类 Review 的速度。以前瓶颈是写代码,现在慢慢变成看 Agent 到底改了什么。所以产品界面如果仍然只展示模型消息,人会越来越累。因为 Review 需要的不是完整过程日志,而是:变更 证据 状态 差异 决策点一个 Agent Run,我希望至少有四个视图Goal最上面固定显示用户真正要完成什么。例如:修复登录偶发401, 不能改变现有Token格式, 必须通过全部Auth测试。