Vibe Coding 成熟度自测
19 题、约 3 分钟。每题都是"能不能指出证据"的行为问题,不是自我感觉量表——做完得到一张五维体检图与可复算的等级。
量表四档(无中性模糊档)
- 0 · 从未做过
- 1 · 想过或零星做过,不成习惯
- 2 · 稳定在做(但依赖个人自觉)
- 3 · 已成体系、有可出示的产物或证据
隐私与数据边界
- 本页数据仅存在于你的浏览器:答题进度只存 sessionStorage,关闭标签页即清空;无账号、无后端、无网络请求、无 cookie。
- 评分全部在本地浏览器完成并当场可复算(结果页附公式与阈值原文)。
- 答案、分数、等级不写入 URL;分享方式=口述或截图自决。
题库预览(19 题 × 五维)
D1 规格完整性(4 题)
- 你是否能为当前每个 AI 开发项目指出"它到底要做什么"的一句话书面描述,且 3 个月后仍认账?
- 你的需求条目里,是否写有"怎样才算做完"的可验证标准(而非"效果要好"式形容词)?
- 需求变化时,你是否先改文档、再让 AI 改代码?
- 最近一次改动,你能否追溯到它是为哪条需求服务?
D2 质量门禁(4 题)
- 最近一次发布前,你是否真实运行过自动化测试(能指出那次运行的证据)?
- 交付前是否有固定检查单(构建/测试/抽查项),而非凭感觉?
- 发现的问题是否分级处理(哪些必须修、哪些可延期、哪些绝不豁免)?
- AI 产出的关键改动,是否有"第二双眼睛"环节(独立复审/换日自查/他人抽查)?
D3 状态管理(4 题)
- 开一个新会话(或换台机器),你能否只靠文件就说清"项目到哪了、下一步做什么"?
- 每轮开工前,是否有明确的单一目标和完成判据(说得清"这轮不做什么")?
- 你的进行中事项是否收敛在一处(而非散在三个聊天窗口里)?
- "完成/阻塞/待验收"这类状态词,在你的项目里含义是否稳定(新条目不会漂移定义)?
D4 变更控制(3 题)
- 关键技术决定(为什么选 A 不选 B)是否有两月后还能找到的记录?
- 中途改范围时,是否有书面的"接受/拒绝/推迟"痕迹?
- AI 悄悄超范围改动(没要求却改了别处),你是否有办法发现并回退?
D5 交接能力(4 题)
- 新接手者(人或新会话)照文档能否自行走通"读状态→找产物→继续干"?
- 环境坑与已知问题是否有专门记录处(而非只在脑子里)?
- 每轮工作的产物(代码/文档/测试证据)是否放进固定目录结构?
- 你在一个项目养成的做法,是否能不靠口头解释直接用在下一个项目(模板/清单可搬走)?
本题库与评语模板由弦歌在 AI 辅助起草、人工复核定稿(ai_assisted / human_reviewed)
评分说明(公式·阈值·边界规则原文,手算可复核)
公式(全部确定性,无随机无权重黑箱) 1. 题目分:0/1/2/3(按所选档)。 2. 维度分:d_i = Σ(该维题分) ÷ (3 × 该维题数),取值 [0,1];五维分别报告。 3. 总分:T = mean(d1..d5)(维度等权——题数差异不产生隐性权重)。 4. 定级:取满足下表的【最大】等级 k(等级名对齐总纲 2.1 五阶段): 等级 1 AI 辅助个人:T≥0 且 min(d)≥0 等级 2 Skill / Workflow:T≥0.35 且 min(d)≥0.25 等级 3 Agent 编排:T≥0.55 且 min(d)≥0.45 等级 4 对外 Agent 服务:T≥0.75 且 min(d)≥0.60 等级 5 智能体微型企业:T≥0.90 且 min(d)≥0.70 5. 降级说明:若按 T 落入等级 k 但 min(d) < 最短木板线(k),判定降为 k−1 并在结果页明示触发降级的维度(木桶效应是本工具的核心教育点)。 6. 区间统一左闭右开;T 与 min(d) 恰好等于阈值按"≥"满足。 7. 缺答处理:v1 强制全答(交卷校验 19/19),不存在缺答计分分支;"未答当 0"等歧义从口径中根除。 8. 浮点规则:维度分/总分保留两位小数后比较(先舍入后比较,手算与程序算结果一致;容差=Number.EPSILON)。