刘俊 · Vakkie · 工作室
进入工作室
mission-control.md·app-manager.ts
阅读范围检索风险起草计划评测门禁待验收
做一个类似 macOS Mission Control 的窗口管理界面,并接上并行 Agent 与 PMP 验收清单。
## 触发
菜单、快捷键 F3,或在指挥台双击项目。
## 任务
✓新建 MissionControlView.tsx
•把 Agent 状态映射到风险登记册
○验收:范围基线不被智能体改写
我们还有很多要学、要试、要建造。
公开工作线
- 2026多智能体交付操作系统进行中
- 2026提示词评测与回归框架公开
- 2025AI 项目的成本对象模型公开
- 2025产品级自主滑杆设计公开
- 2024全栈 Agent 工作台公开
- 2024研究复现流水线公开
- 2023PMP 方法接入 AI 交付认证
- 2023CMA 管理会计实践认证
- 2022提示词作为产品接口公开
把想法变成可运行的系统
把研究原型、产品文档和财务约束收进同一条交付链。Agent 写代码,人做决策:接口、数据、评测和发布都在一个工作台里完成。
全栈工作室
mission-control.md·app-manager.ts
阅读范围检索风险起草计划评测门禁待验收
做一个类似 macOS Mission Control 的窗口管理界面,并接上并行 Agent 与 PMP 验收清单。
## 触发
菜单、快捷键 F3,或在指挥台双击项目。
## 任务
✓新建 MissionControlView.tsx
•把 Agent 状态映射到风险登记册
○验收:范围基线不被智能体改写
并行推进,按范围交付
用 PMP 管 AI 项目:范围、风险、干系人和里程碑写进可执行计划。多智能体并行探索,项目经理负责取舍、验收与复盘。
PMP 指挥台
范围基线不被智能体改写
范围
指挥台 v1:网格、状态、验收
风险
模型把探索写成需求
验收
基线变更必须人工签字
在每个工具、每一步
提示词不是一段神奇的话,是可版本、可评测、可回滚的接口。我把提示词工程嵌进 CLI、评审、文档和产品表面,让模型行为可预期。
提示词接口
system.md · v3.4
你是项目里的执行者,不是范围的作者。 - 先读验收清单,再动代码 - 任何范围变更必须回到人类 - 失败案例写入评测集,而不是再试一次
金样本 128回归门禁可回滚
用研究约束产品想象力
先测量,再放大。评测集、失败案例和复现实验先于演示。我关心的不是模型会说话,而是它在你的任务分布上稳不稳。
研究实验室
实验台 · 可复现
eval.yamlid任务分布score门禁
MNIST-12数据切片漂移0.81失败
Prompt-88工具调用一致性0.94通过
Agent-04范围遵守率0.89观察
给自主智能体装上产品边界
自主不是放任。产品经理的工作是设计权限、反馈和中断:用户始终握着自主滑杆,从补全到全权代理,每档都有清晰后果。
产品边界
自主滑杆
用户始终知道这一档会改什么、谁负责、如何中断。
补全局部编辑计划全权代理
当前:补全。仅改光标处。提交仍由你完成。
用财务语言管理 AI 投入
Token、人力、返工和风险都可以入账。CMA 的方法让 AI 项目有成本对象、贡献边际和滚动预测,而不是一笔说不清的云账单。
管理会计
AI 投入分类账
FY26 · W37
41%
贡献边际
指挥台 Agent$12.4k38%边际改善
人工审阅$6.1k22%按计划
返工准备金$2.8k9%观察
用 AI 建造的新工作方式。
“他能把一次含糊的模型演示,收成可以排期、可以验收、可以复盘的项目。研究的人听得懂,财务的人也听得懂。”
“提示词在他手里是有测试的。改一版就有回归,失败案例进集,而不是群里再试一句。”
“我们第一次把 Agent 的 Token、返工和人工审阅写进同一张贡献边际表。讨论立刻从感觉变成取舍。”
“他写的不是功能列表,是用户在自主程度上的每一档后果。这是产品经理该做的事,很少有人真做。”
“全栈在他那里不是一个人会所有框架,而是研究、代码、发布和成本在同一条链上不断开。”
“PMP 在 AI 项目里常常是装饰。他把它用成真正的范围与风险语言,智能体再多也不会把目标带跑。”
