昨天 GitHub 发了一篇挺有意思的文章,题目直接点出了一个越来越明显的问题:
Chat is great for intent, but agent work gets lost in the scroll.
我很认同。
过去两年,我们几乎默认了一个 UI 逻辑:
AI = Chat用户输入一句话,AI 回复一大段。
可 Agent 一旦从“回答问题”变成“执行任务”,这个界面开始变得别扭。
比如一个 Coding Agent 正在做:
理解需求 →读 18 个文件 →拆 7 个任务 →修改 5 个文件 →跑测试 →修 3 个失败 →再跑测试 →等待人工确认最后这一切都被塞进一条越来越长的聊天记录。
问题就来了。
我真正想看的不是它说了什么,而是它现在是什么状态
用户问:“现在做到哪了?”
聊天记录可能已经有 80 屏。
真正应该回答的是:
任务:登录模块重构 总步骤:7 完成:4 进行中:1 阻塞:1 待人工:1 已修改: - AuthService.java - JwtFilter.java - LoginController.java 测试: 32 passed 2 failed 预算: $1.82 / $3.00这不是 Chat UI。
这是任务控制面。
GitHub 那篇文章里提到的一个现实问题很关键
Agent 生成代码的速度,已经开始超过人类 Review 的速度。
以前瓶颈是写代码,现在慢慢变成看 Agent 到底改了什么。
所以产品界面如果仍然只展示模型消息,人会越来越累。
因为 Review 需要的不是完整过程日志,而是:
变更 证据 状态 差异 决策点一个 Agent Run,我希望至少有四个视图
Goal
最上面固定显示用户真正要完成什么。
例如:
修复登录偶发401, 不能改变现有Token格式, 必须通过全部Auth测试。