人工智能AI Agent代码智能体Agent 编排CLIAI 应用【免费下载链接】gsd-2A powerful meta-prompting, context engineering and spec-driven development system that enables agents to work for long periods of time autonomously without losing track of the big picture项目地址https://gitcode.com/gh_mirrors/gs/gsd-2点击查看免费下载本指南源自 GSDgsd-2仓库中 docs/dev/building-coding-agents/25-designing-for-non-technical-users-vibe-coders.md它总结的是四家前沿模型Claude、Gemini、GPT、Grok两轮深度对话中收敛出的共识一个编程 Agent 的全部价值在于让有愿景但不懂代码的人用「意图、审美与判断」去建造软件而系统吸收掉一切技术层。读者读完本文将掌握非技术产品体验的完整设计框架意图化输入、能力化反馈、安全毯、渐进式披露等十根支柱并看到 GSD 的 auto-mode、worktree 隔离、/gsd undo、captures 捕获与 Web 仪表盘等实现如何逐条落地这些原则从而能把同样的模式套用到自己的 Agent 产品上。引言为什么「只有工程师能用」等于「毫无用处」一切 Agent 技术上下文工程、状态机、并行化、多模型路由只有在非技术用户也能独立使用时才有意义。这正是 25-designing-for-non-technical-users-vibe-coders.md 开篇提出的「最关键的问题」the human should never have to think in code。不是在输入时、输出时、报错时、验证时、调试时——任何时刻都不需要。人的语言是意图、愿景、偏好与判断技术翻译是系统的事。这一原则在 26-cross-cutting-themes-where-all-4-models-converge.md 中被提炼为四条高度一致的收敛主题之一The magic is the translation layer.For non-technical users, the entire value proposition is the invisible bridge between human intent and technical execution. Every moment the user has to think like a developer is a failure.也就是说「用户被迫像工程师一样思考」的每一个瞬间都是产品设计失败。下面先用一张哲学分界表锁定分工再逐条展开十根支柱最后用 GSD 的仓库实现auto-mode、worktree 隔离、undo、captures、Web 仪表盘等逐条验证这些原则的工程落地。核心哲学人机分工的边界原文给出了一个简洁有力的分工表这是所有后续设计决策的出发点Human Provides人提供System Provides系统提供Vision imagination愿景与想象Engineering intelligence工程智能Taste aesthetic judgment品味与审美判断Technical translation技术翻译Direction priorities方向与优先级Architecture implementation架构与实现This feels off — calmer, like Linear主观体验反馈Concrete CSS/animation/spacing changes具体技术落点注意最后一行人说的是一句主观感受This feels off — calmer, like Linear系统要把它翻译成具体的 CSS、动画曲线、间距调整。这正是 16-encoding-taste-aesthetics.md 里说的「把品味编码成可验证规格」的能力边界问题详见第 5 支柱。十根支柱魔法般的非技术体验支柱 1意图化输入而非规格化输入用户自然地说出I want an app where people can upload recipes and find them by ingredient. 系统启动的是一场发现式对话discovery conversation像和一位出色的产品合伙人交谈——而不是填一张需求表单。后台回答被编译成结构化 spec、验收标准acceptance criteria和接口契约用户永远看不到这些。关键准则提问必须关于体验而非实现。绝不问「用关系库还是文档库」而应该问「搜索应该只精确匹配还是也要支持可替代食材」在 GSD 中这一条的直接对应物是 deep planning mode 的发现流程auto-mode.md。planning_depth: deep开启后里程碑级规划之前先跑一轮一次性分阶段发现流程Workflow Preferences - Project Context - Requirements - Research Decision - Optional Project Research - Milestone Context/Roadmap这些阶段分别产出.gsd/PREFERENCES.md、.gsd/PROJECT.md、.gsd/REQUIREMENTS.md、.gsd/research/下的研究文档、.gsd/milestones/MID/M###-CONTEXT.md等——用户在界面里只回答关于产品的问题架构、目录、约束全部沉淀为文档与数据库记录。这些发现产出通过gsd_requirement_save/gsd_summary_save等工具持久化到 SQLite 数据库Markdown 只是投影auto-mode.md 的 State Authority 一节实现「结构化 spec 用户不可见」的设计意图。支柱 2展示成果而非展示过程每个里程碑之后用户看到的是一个可运行的预览working preview而不是任务清单。人在每个检查点与真实的东西交互——点击、感受、反馈。进度以「能力」而非「代码」来沟通✅ Your app can now save workouts and retrieve them later❌ implemented REST endpointGSD 的 auto-mode 正是以「纵向切片vertical slice」为单位交付的这也是 26-cross-cutting-themes 中的共识之二Vertical slices are non-negotiable. End-to-end working increments at every stage.。auto-mode.md 描述了每个 slice 的完整闭环Plan (with integrated research) → Execute (per task) → Complete → Reassess Roadmap → Next Slice ↓ (all slices done) Validate Milestone → Complete Milestone每个 slice 结束后产出S##-SUMMARY.md和 UAT 脚本里程碑结束由run-uat做用户验收测试S##-ASSESSMENT.md必须有verdict: PASS | FAIL | PARTIAL才算完成。也就是说「能力是否可用」由机械化验证把关而不是让用户去读代码。支柱 3协作式建造者而非命令执行器Agent 应该像一位资深联合创始人User: I want something like Notion but for recipes. Agent: Heres how Id approach that: - Recipe database with tagging - Search by ingredient - Meal planner Would you like to prioritize simplicity or advanced features?这种方式在对话中隐性教育用户同时避免基于模糊 spec 的错建。GSD 的对应实现是「能力化路由 边界明确的分步工作流」。在 gsd-orchestrator/SKILL.md 中编排者把 GSD 视为「一个你把 spec 交给他的初级开发者」在new-milestone前先由人类写好 product spec而 step-by-step.md 提供next循环让每一步之间都有决策点RESULT$(gsd headless --output-format json next 2/dev/null) EXIT$? case $EXIT in 0) ;; # success — continue 1) echo Step failed: $STATUS; break ;; 10) echo Blocked — needs intervention; break ;; 11) echo Cancelled; break ;; esac退出码本身就是「协作式」的产物10 blocked意味着系统知道自己需要人类介入把「该不该继续」的判断权交还给用户而不是闷头乱建。支柱 4问题而非错误用户永远不应该看到 stack trace。技术故障要么被静默修复要么被翻译成领域层的问题❌ Never Show绝不展示✅ Show Instead改为展示TypeError: Cannot read property map of undefinedThe recipe list isnt displaying correctly. Im fixing it now — should be ready in a few minutes.ECONNREFUSED localhost:5432Im having trouble connecting to the database. Working on it.Ambiguous technical decisionWhen someone searches chicken, should results include recipes where chicken is optional?GSD 在这方面提供了结构性保障错误先被系统分类再决定由谁处理。auto-mode.md 的 Provider Error Recovery 把 provider 错误分成三类——Rate limit429按retry-after或 60s 自动续跑、Server error500/502/50330s 后自动续跑、Permanentunauthorized / invalid key / billing暂停等待人工——瞬时错误用户根本不需要干预会话短暂暂停后自动继续。真正需要人工的只有不可恢复的类别此时/gsd forensicstroubleshooting 工具把复杂诊断过程封装成一次 LLM 引导的调查会话。用户看到的是「被翻译过的问题」而非ECONNREFUSED一类的原始技术噪音。支柱 5反应式反馈而非代码评审面向对运行中应用的反应来设计而不是代码评审。就像和室内设计师合作I love the color but the couch feels too big.——视觉的、空间的、体验的反馈。其中最强的模式是A/B 对比同时展示两个版本人在几秒内选出「哪个感觉更好」。GSD 系列文档在 16-encoding-taste-aesthetics.md 中给出了「品味编码」的可自动化边界与支柱 5 互为补充可以被自动化的品味参考提取Reference-based extractionFeels like Linear → 提取间距比例、动画时间曲线、配色关系、字体排印风格规格化Style specification把提取的属性转成可验证参数——transitions 150-200ms ease-out, 8px grid spacing, specific contrast ratios自动化验证Lighthouse 分数、视觉回归测试、无障碍审计、性能预算、设计系统 lint视觉对比渲染输出后用视觉模型对照参考截图A/B 对比展示两个版本让人选——比绝对判断更快不能被自动化的完形gestalt——那种由上千个小决策交织而成的整体感受Does this feel premium? Fast? Trustworthy? 这从根本上就是主观的。最优策略尽可能把品味转成「具体的、可验证的规格」不是 use nice spacing而是 16px between sections, 8px between related elements, 4px between tightly coupled elements然后把剩余的主观层留给结构化、具体的人类问题Does the density feel right? Does the transition timing feel snappy enough? Does the empty state feel intentional or broken?——这正是支柱 5「反应式反馈」的正确姿势。支柱 6工程权衡 简单选择题与其问 Which auth provider?不如问 Which matters more: A) Simplicity B) Maximum customization C) Enterprise security——系统把答案自动映射为技术决策。这类「领域语言 ↔ 技术决策」的双向映射正是 GSD 架构中的模型路由与 provider 抽象所体现的用户层面只需表达「简单 / 定制 / 企业安全」这类偏好系统层的 dynamic model routing 和 provider 配置把这些意图转译为具体的模型选择与执行策略。偏好与选择权agency始终留在用户手里实现细节哪个模型、哪种存储、哪套安全栈由系统翻译层承担。支柱 7安全毯Safety Blanket原文列出的四个保障机制每个 slice 自动备份 undo entire feature 按钮Vibe Checkpoints——每次重大变更前的保存点。Go back to how it was ten minutes ago.上线前必须有部署预览deployment previews没有可逆操作就一定要有纯英文确认plain-English confirmation不允许静默执行不可逆动作GSD 的工程实现对应如下① 撤销与回滚。commands.md 提供了两条与支柱直接对应的命令/gsd undo—— 回退上一个已完成单元/gsd undo-task—— 重置某个特定 task 的完成状态DB markdown 双写在 headless 编排层step-by-step.md 的干预模式里同样有gsd headless undo --force配合gsd headless next继续执行——「把整个功能撤销掉」不是一个抽象承诺而是一条可执行的命令。此外 auto-mode 的每个单位执行后都会做工件验证Artifact Verification缺失即重新派发并记录artifact-verification-retry事件最多 3 次——这种「写完即核对、坏了即重试」的机制是把安全毯做进状态机里而不是依赖模型自觉。② 检查点与 git 隔离。GSD 用 git 隔离让每个里程碑天然成为保存点。根据 auto-mode.md 的 Git Isolation 一节里程碑工作在三种模式下运行git.isolation配置none默认直接在当前分支工作适合热重载工作流worktree每个里程碑运行在自己的 git worktree.gsd/worktrees/MID/分支milestone/MID所有 slice 工作顺序提交里程碑最后以一个干净 commit squash-merge 回主干——「回到十分钟之前」等价于切回这个检查点branch在项目根目录的milestone/MID分支上工作适合 submodule 多的仓库③ 不可逆操作的分类与确认。17-irreversible-operations-safety-architecture.md 给出了风险分级策略与支柱 7 的「plain-English confirmation」严格对应ClassExamplesPolicyReversibleCode edits, UI changes, unit testsFull autonomy auto-revert on failureSemi-ReversibleNew files, dependenciesAuto-execute git checkpointIrreversibleDB migrations, external API changes, data transformationsHuman-in-the-loop requiredExternal Side-EffectPayment charges, third-party API calls with side effectsHuman approval dry-run rollback plan并且明确要求分类必须静态且确定性不由 Agent 临场判断、保守有疑问就归为不可逆、由编排器强制Agent 永远不会在无人拦截的情况下遇到不可逆操作。它还点出一个最容易被忽略的微妙陷阱某些数据转换技术上没有删除任何东西但通过重新格式化永久丢失了信息如把 nullable 列转成带默认值的 non-nullable这类操作必须按删除同等级别标记——这正是「非技术用户不需要理解数据库迁移」的保障前提。支柱 8渐进式披露Progressive Disclosure从极简开始。只有当用户主动提出时才提供 Advanced mode 开关。系统应该渐进式地揭示工程层——先是纯粹的愿景然后是架构微调最终是深度协作。许多用户永远不会离开简单模式这完全没问题。GSD 的落地证据遍布产品表面step mode步进模式Web 界面的 onboarding 引导中就有step-mode.tsxweb/components/gsd/onboarding/step-mode.tsx配合 use-user-mode.ts 在「用户模式」之间切换——新用户从最基本的模式进入高级能力按需开启。next循环 vsauto循环step-by-step.md 明确给出了使用边界——auto: You trust the build, just want the result vs nextloop: You need budget checks, progress updates, or intervention points。同一个引擎暴露程度由用户选择。预算与成本可见性auto-mode.md 的 Dashboard 显示 per-unit cost 与 token 分解、成本投影——这些对资深用户有用但默认不打扰。渐进披露还体现在交互频率上/gsd statusCtrlAltG按需打开/gsd visualize打开可视化器而不是把技术细节强塞给用户。支柱 9隐性教学Implicit Teaching当用户问 why is that taking longer? 时The recipe search needs to look through all recipes every time. Im adding an index — think of it like a table of contents — so it can find things faster.教学由好奇心触发、用类比表达、永远可选项。久而久之用户无需强制学习就能建立起有用的软件心智模型。GSD 与之呼应的机制是Incremental Memory增量记忆v2.26 起项目级KNOWLEDGE.md中的 Patterns 和 Lessons 被持久化到memories表并在每次会话开始时注入——系统在跨任务地积累「被解释过的为什么」。同时 Context Pressure Monitor70% 上下文水位时发 wrap-up 信号和自动生成的可读性 commit messageCommits are generated from task summaries — not generic complete task messages都让用户有机会通过 diff/log 逐步理解系统在做什么、为什么这么做——知识增长是顺带发生的不是被要求的。支柱 10隐形部署与运维Invisible Deployment OperationsI want to share this with people → 收到一个 URL。背后托管、域名、数据库、SSL、CI/CD。日常运维同样隐形。简单仪表盘Your recipe app had 340 visitors this week. Everything is running smoothly.GSD 的对应物Web 界面v2.41 起web-interface.md 描述了一个浏览器端仪表盘——gsd --web启动提供项目管理milestones/slices/tasks 可视化、实时进度SSE 推送、多项目支持?projectURL 参数。用户看到的是仪表盘上的进度与状态而非终端日志。自动 HTML 报告v2.26 起里程碑完成后 auto-mode 自动生成.gsd/reports/下的自包含 HTML 报告包含项目摘要、进度树、slice 依赖图SVG DAG、成本/ token 指标柱状图、执行时间线、changelog、知识库——CSS/JS 全部内联零外部依赖auto_report: true默认开启。远程控制auto-mode.md 记录了 Telegram 通道——/pause、/resume、/status、/progress、/budget、/log [n]。用户可以在不碰终端的情况下暂停、恢复、查询构建状态这是「运维隐形」的极端形态。翻译层魔法胶水The Translation Layer原文给出一个确定性架构「Human Translator」节点位于每个编排器周期的前端Raw user message references ↓ [Human Translator] ↓ Precise assumptions, invariants, success criteria ↓ [Rest of the god-tier orchestrator pipeline]图的其余部分永远看不到「vibe 语言」只看到干净的 spec。这样既保住了全部技术质量又屏蔽了用户。这条「确定性翻译节点」的设计与 GSD 的架构哲学高度一致。26-cross-cutting-themes-where-all-4-models-converge.md 明确指出The orchestrator is the product. The model is a commodity; the system around it is the differentiator与The LLM should only do what requires judgment. Everything deterministic belongs in code.翻译层就是「确定性的部分」它把人类的模糊意图assumptions、invariants、success criteria结构化再交给 LLM 与状态机处理。GSD 的发现式流程支柱 1、captures 分类见下都是这种「确定性节点」的具体实例。captures 是一个绝佳样例captures-triage.md 描述了/gsd capture add rate limiting to the API endpoints这类 fire-and-forget 的想法捕获。用户在 auto-mode 运行中扔进一句自然语言系统在任务间隙自动分诊TypeMeaningResolutionquick-taskSmall, self-contained fixInline quick task executed immediatelyinjectNew task needed in current sliceTask injected into the active slice plandeferImportant but not urgentDeferred to roadmap reassessmentreplanChanges the current approachTriggers slice replan with capture contextnoteInformational, no action neededAcknowledged, no plan changes流水线是capture → triage → confirm → resolve → resume其中「确认confirm」一步保留给用户——涉及改计划的 resolutioninject / replan必须经过用户确认。这就是「翻译层不夺权」的典型设计翻译在系统内完成但决策权始终在用户手里。范围保护层诚实而温和地讲清代价非技术用户常常意识不到自己的需求有多复杂。系统必须诚实——但要温和Thats a great idea. Adding social features is significant — it involves user profiles, a follow system, a feed algorithm, and notifications. Itll take as long as everything weve built so far. Want me to go ahead, or finish core recipe features first?这条「尊重自主权respects agency同时给出决策所需信息」的原则在 GSD 中体现为两个机制能力化的范围管理auto-mode 以 milestone 为边界工作每个里程碑有自己的上下文、路线图M###-ROADMAP.md带[sketch]徽标的 slice 表示「范围边界已批准、任务尚未展开」。reassess-roadmap在每个 slice 后重新评估路线图——范围是显式谈判的结果而不是悄悄膨胀的默认值。分诊与重规划回路captures 中的defer推迟到路线图重评估与replan触发 slice 重规划都是把「范围变更的代价」显式交给用户确认的通道——/gsd steer则可以硬性改写计划文档在下一个阶段边界生效auto-mode.md。此外 getting-started.md 提供的 Docker 沙箱docker sandbox create --template . --name gsd-sandbox让用户可以在隔离环境中先跑通流程再决定是否落地——探索没有代价决定永远属于用户。元原则它是创意工具不是开发工具The system is acreative tool, not a development tool. It should feel like Photoshop or Ableton — a powerful instrument that lets a person with vision manifest that vision without understanding the underlying mechanics. A music producer doesnt need to understand digital signal processing. A filmmaker doesnt need to understand codec compression.A person with a great app idea shouldnt need to understand React component lifecycle.这段话是对全部设计的元总结价值不来自「把工程师工作自动化」而来自「把创作的门槛抹平」。这与 GSD 的定位一致——其项目描述强调 meta-prompting, context engineering and spec-driven development system that enables agents to work for long periods of time autonomously——「长期自主运行」正是为了让人类可以退后一步、以创作者身份出现而不是守在终端旁当操作员。什么让它感觉「魔法般」原文用一张清单总结了最强系统的共同点可作为任何 Agent 产品的体验验收标准理解模糊的想法Understand vague ideas提出聪明的澄清问题Ask smart clarifying questions把意图翻译成架构Translate intent into architecture快速展示可见的进展Show visible progress quickly让实验安全Make experimentation safe清晰地解释决策Explain decisions clearly隐藏复杂性但不阻塞能力Hide complexity without blocking powerWhen these align, the user experiences:I can build anything I imagine.That feeling is the real product.在 GSD 中逐条对照发现式对话理解模糊想法、提澄清问题deep planning mode、意图→架构Human Translator 翻译层 结构化 spec 投影、可见进展/gsd status仪表盘、Web 实时进度、自动 HTML 报告、实验安全worktree 隔离、/gsd undo、/gsd undo-task、sandbox、决策解释Incremental Memory、可读性 commit、隐藏复杂性错误分类翻译、Telegram 远程控制。这些不是孤立的炫技而是同一个设计目标在不同层面的投影。结语把「人的体验」当成系统的第一公民从 25-designing-for-non-technical-users-vibe-coders.md 到 26-cross-cutting-themes-where-all-4-models-converge.md再到 auto-mode、undo、captures、Web 界面等落地实现GSD 系列文档给出的结论是一致的非技术用户体验不是「工程做完之后的润色」而是决定系统架构形态的第一约束。翻译层必须确定性、错误必须被分类路由、不可逆操作必须人在环内、进度必须用能力而非代码表达——当这些设计收敛到一起时用户得到的不是「一个更好用的开发工具」而是「我能建造我想到的任何东西」那种体验。对任何正在构建编码 Agent 的团队来说这份指南及其仓库实现都是一份可以直接照抄的交互规范与架构蓝图。赞分享人工智能AI Agent代码智能体Agent 编排CLIAI 应用【免费下载链接】gsd-2A powerful meta-prompting, context engineering and spec-driven development system that enables agents to work for long periods of time autonomously without losing track of the big picture项目地址https://gitcode.com/gh_mirrors/gs/gsd-2点击查看免费下载相关推荐Zotero PDF Translate学术翻译的技术架构与用户体验深度解析Zotero PDF Translate学术翻译的技术架构与用户体验深度解析 作为现代学术研究的核心工具Zotero PDF Translate插件通过创新桌面应用NLP大麦自动抢票实战Selenium Appium 双端方案从配置到出票三步走大麦自动抢票实战Selenium Appium 双端方案从配置到出票三步走 抢票自动化本质是把人的速度换成机器的速度提前打开页面、监听开售开GUI 自动化RPAM.I.B. Android Auto和CarPlay破解让老款车型支持无线连接的完整方案M.I.B. Android Auto和CarPlay破解让老款车型支持无线连接的完整方案 想要为老款大众、奥迪、斯柯达等车型的MIB2信息娱乐系统解锁And固件嵌入式逆向工程上一篇如何在Vue项目中快速集成wangEditor富文本编辑器完整指南下一篇Sealos多租户架构终极指南构建安全高效的云原生资源隔离方案创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
