
一、痛点还原你是不是也中招让 AI 写功能 → 30 秒出代码 → review 发现无单测、无边界、吞错误、命名随意补测试时它塞三个永不过的假测试。根因你只给了「提示词」没给「工程纪律」。二、2024设计模式元年Anthropic《Building Effective Agents》Workflow vs Agent下一步谁决定——代码还是模型。5 种 WorkflowPrompt chaining / Routing / Parallelization / Orchestrator-workers / Evaluator-optimizer。首提 MCP。核心反直觉简单可组合胜复杂框架。三、2025Skills 机制方法论 → 可复用资产一个 skill 含SKILL.md的目录三层渐进式披露控制上下文。社区把工程纪律编码成 skill# SKILL.md 正模式示例示意非真实仓库代码 name: tdd description: 写代码前先写测试先对齐再实现 步骤: 1. 读需求 → 写失败测试 2. 最小实现让测试通过 3. 重构 质量门禁不可协商: - 测试必须先真实失败过再变绿拒绝永不过的假测试 - 圈复杂度 10 视为未通过 - 无测试覆盖的代码不视为完成Osmani 三哲学Process not prose / Anti-rationalization / Verification non-negotiable。四、2026开放标准 质量危机面事实约对开发者的意义普及面Skills 超 10 万个、27 家平台互通SKILL.md格式统一真互操作危机面数量爆炸、质量参差、vibe coding 换皮选型官方 → 市场排行 → 社区审慎解法面Osmani《Agentic Code Quality》质量门禁靠 harness / 环境层兜底单测 / 属性测试 / 变异测试 / 复杂度指标五、落回痛点AI 写原型级代码是因为没装质量门禁。工程化成熟度 skill 库质量 质量门禁不是模型版本号。先对齐、再实现、以验证收尾。