跳到主要内容
刘俊

刘俊是你构建雄心勃勃的 AI 系统的合作者。

Eliot Leu · Vakkie

刘俊 · Vakkie · 工作室
mission-control.md·app-manager.ts
阅读范围检索风险起草计划评测门禁待验收

做一个类似 macOS Mission Control 的窗口管理界面,并接上并行 Agent 与 PMP 验收清单。

## 触发
菜单、快捷键 F3,或在指挥台双击项目。
## 任务
新建 MissionControlView.tsx
把 Agent 状态映射到风险登记册
验收:范围基线不被智能体改写

软件创造正在改变。

我在研究、工程、产品与财务的交界处工作:把模型变成可交付系统,把系统变成可管理的投入,把投入变成可解释的决策。

我们还有很多要学、要试、要建造。

公开工作线
  • 2026多智能体交付操作系统进行中
  • 2026提示词评测与回归框架公开
  • 2025AI 项目的成本对象模型公开
  • 2025产品级自主滑杆设计公开
  • 2024全栈 Agent 工作台公开
  • 2024研究复现流水线公开
  • 2023PMP 方法接入 AI 交付认证
  • 2023CMA 管理会计实践认证
  • 2022提示词作为产品接口公开

把想法变成可运行的系统

把研究原型、产品文档和财务约束收进同一条交付链。Agent 写代码,人做决策:接口、数据、评测和发布都在一个工作台里完成。

全栈工作室
mission-control.md·app-manager.ts
阅读范围检索风险起草计划评测门禁待验收

做一个类似 macOS Mission Control 的窗口管理界面,并接上并行 Agent 与 PMP 验收清单。

## 触发
菜单、快捷键 F3,或在指挥台双击项目。
## 任务
新建 MissionControlView.tsx
把 Agent 状态映射到风险登记册
验收:范围基线不被智能体改写

并行推进,按范围交付

用 PMP 管 AI 项目:范围、风险、干系人和里程碑写进可执行计划。多智能体并行探索,项目经理负责取舍、验收与复盘。

PMP 指挥台
范围基线不被智能体改写
范围
指挥台 v1:网格、状态、验收
风险
模型把探索写成需求
验收
基线变更必须人工签字

在每个工具、每一步

提示词不是一段神奇的话,是可版本、可评测、可回滚的接口。我把提示词工程嵌进 CLI、评审、文档和产品表面,让模型行为可预期。

提示词接口
system.md · v3.4
你是项目里的执行者,不是范围的作者。
- 先读验收清单,再动代码
- 任何范围变更必须回到人类
- 失败案例写入评测集,而不是再试一次
金样本 128回归门禁可回滚

用研究约束产品想象力

先测量,再放大。评测集、失败案例和复现实验先于演示。我关心的不是模型会说话,而是它在你的任务分布上稳不稳。

研究实验室
实验台 · 可复现
eval.yaml
id任务分布score门禁
MNIST-12数据切片漂移0.81失败
Prompt-88工具调用一致性0.94通过
Agent-04范围遵守率0.89观察

给自主智能体装上产品边界

自主不是放任。产品经理的工作是设计权限、反馈和中断:用户始终握着自主滑杆,从补全到全权代理,每档都有清晰后果。

产品边界
自主滑杆

用户始终知道这一档会改什么、谁负责、如何中断。

补全局部编辑计划全权代理
当前:补全。仅改光标处。提交仍由你完成。

用财务语言管理 AI 投入

Token、人力、返工和风险都可以入账。CMA 的方法让 AI 项目有成本对象、贡献边际和滚动预测,而不是一笔说不清的云账单。

管理会计
AI 投入分类账
FY26 · W37
41%
贡献边际
指挥台 Agent$12.4k38%边际改善
人工审阅$6.1k22%按计划
返工准备金$2.8k9%观察

用 AI 建造的新工作方式。

他能把一次含糊的模型演示,收成可以排期、可以验收、可以复盘的项目。研究的人听得懂,财务的人也听得懂。
林可·消费科技 · 产品负责人
提示词在他手里是有测试的。改一版就有回归,失败案例进集,而不是群里再试一句。
赵衡·量化研究主管
我们第一次把 Agent 的 Token、返工和人工审阅写进同一张贡献边际表。讨论立刻从感觉变成取舍。
苏晚·集团财务 BP
他写的不是功能列表,是用户在自主程度上的每一档后果。这是产品经理该做的事,很少有人真做。
江澄·B2B 产品顾问
全栈在他那里不是一个人会所有框架,而是研究、代码、发布和成本在同一条链上不断开。
韩牧·工程总监
PMP 在 AI 项目里常常是装饰。他把它用成真正的范围与风险语言,智能体再多也不会把目标带跑。
裴岚·PMO 负责人

现在就开始合作。