斜杠中年斜杠中年AI × 沟通 × 商业 × 人生
AI 实战指南

从马来西亚读 Anthropic《创始人行动手册》:从想法到 MVP,别跳过纪律

想法与 MVP 阶段是 AI-Native 创始人最容易失败的地方——把能跑的原型当成验证。本文讲 Anthropic 手册如何框定想法到 MVP 的纪律,以及它如何对应到精益团队的 harness engineering。

2026-08-15更新: 2026-08-1511 分钟阅读Wesley Chong
#创始人行动手册#Anthropic#AI-Native 创业#MVP#问题-方案匹配#harness engineering#验证
从马来西亚读 Anthropic《创始人行动手册》:从想法到 MVP,别跳过纪律|AI 实战指南 封面图

摘要

Anthropic 的手册警告:建造变便宜,创始人容易跳过验证——原型不等于问题真实存在。本文把想法到 MVP 的纪律放到马来西亚创始人现实里,并说明把架构写下来、压力测试假设、保留会话日志,本质上就是 harness engineering。

一句话答案

Anthropic 的手册对想法与 MVP 阶段说得很直白:AI 让建造太便宜,创始人容易跳过验证;解药是纪律——把架构写下来、压力测试你自己的假设、保留会话日志——这正是对创业做的 harness engineering。

这是从马来西亚、精益团队视角读 Anthropic《创始人行动手册》(2026 年 5 月)的第二篇。第一篇讲了创始人作为编排者。这里我们要具体:想法阶段与 MVP 阶段——手册说,多数 AI-Native 创业公司其实就死在这里。

想法阶段:先验证,再造

手册的纪律让人不舒服:证据到手之前,不要写代码。 想法阶段是做研究、客户发现、竞品分析,并诚实地找反证——这些全发生在第一行生产代码之前。

退出条件是问题-方案匹配:主要来自真实人类对话的质性证据,证明你在为真实的人解决真实的问题。三个问题决定你能不能离开这个阶段:

  1. 问题真实且具体吗?你必须能说清谁经历它、多频繁、多严重、他们今天怎么处理。
  2. 你的方案对应的是真实问题吗——是验证中浮现的那个,不是你假设的那个?
  3. 你有没有足够信号开始造,让它是一个有理有据的决定,而不是信仰行动?

手册给了一个有用的测试:「大家讨厌报销」只是观察。「中型公司的财务经理每周花 4 小时以上核对报销提交,因为现有工具不和会计软件打通」才是可被测试的假设。先具体,再行动。

陷阱:原型不是验证

这是 AI 让它变危险的地方。在 agentic 编程之前,搭原型要几个月和真金白银,所以创始人被迫先验证。现在一个像样的原型一下午就好,手册警告这给 AI-Native 创业公司带来存在性风险。

失败模式:有想法 → 立刻造原型 → 把「原型存在」当成假设一开始就对。假设从没被检验。手册说得很直白:能跑的原型是和用户对话时的道具,不是问题真实存在的证据。对话才是证据。

对马来西亚 solo 创始人,诱惑是双倍的:你能快速造,又离用户近。但没和五个真正有这个问题的人谈就开造,恰好就是你造出没人想要的东西的方式——手册提到 AI 之前就已有约 42% 创业公司栽在这,而建造变免费后这个比例只会升。

把模型当反方代言人,不要当应声虫

确认偏误现在配上了一台研究引擎。让 AI 验证你的想法,它会找出佐证;让它估市场,它会给出能融资的 TAM。解药是同一个工具,方向反过来:

  • 和模型一起把问题陈述打磨到可测试。
  • 再让它反驳你——找失败的竞品、结构性障碍、客户不切换的理由。
  • 把反证当成 pivot 信号,不是人身攻击。

手册说,把模型当结构化的反方代言人,是 AI 创业生命周期每个阶段都成立的核心用法。那是反馈回路,而反馈回路是一层 harness。

MVP 阶段:关于方案的证据

MVP 仍是收集证据,但对象变成方案:可识别的人是否觉得它值得用、值得回头、值得付费、值得推荐?退出条件是真实的产品-市场匹配——来自具体群体的留存、收入或推荐。

手册点名的三个 MVP 陷阱:

  • Agentic 技术债。 如果你没把架构与决策写在 agent 能读到的地方,每次会话都重新推导基础、代码库漂移。它和普通技术债不同,会复利。解药:从第一天起就有一份 CLAUDE.md 上下文文件——项目的持久记忆。
  • 假 PMF。 来自朋友、投资人、或 Hacker News 流量尖峰的早期势头不是 PMF。在发布就设好留存与激活基准;让模型像怀疑者一样解读你的数字。
  • 零摩擦的范围蔓延。 加功能只要一个下午,每样都显得合理。写一份范围文档:MVP 做什么、明确不做什么、什么用户证据才足以证明该加东西。

为什么这是 harness engineering

把手册实际开的药方,映射到总览文章的 harness 层:

| 手册做法 | Harness 层 | | --- | --- | | 把架构与决策写进 CLAUDE.md | 记忆 / 状态 | | 用模型当反方代言人压力测试想法 | 反馈回路 | | 记录决策与假设的会话日志 | 状态持久化 | | 任何上线前都走人工审查 | 护栏 | | 真实用户碰数据前先做安全审查 | 护栏 |

第一篇说的编排者的手艺,原来和打造一个可靠 agent 是同一种手艺:你设计环境,让系统对你保持诚实。手册甚至点名了我们写过的失败模式——漂移、复利债、假信号——而解药就是一个 harness。

这也是 BNext 的楔子:我们交付你的业务跑在其上的软件,AI 在里面;而「AI 在里面」要安全,必须有人设计 harness——上下文、回路、护栏——而不只是功能。

重点整理

  • 想法阶段 = 先验证再造;以真实对话中的问题-方案匹配作为退出标准。
  • 原型是对话道具,不是验证。AI 让跳过这一步变成致命。
  • MVP 阶段 = 关于方案的证据;警惕 agentic 技术债、假 PMF、零摩擦范围蔓延。
  • 手册每一条药方都对应一层 harness:上下文、反馈、护栏。

下一篇:从发布到规模化——创始人如何变成瓶颈

基于 Anthropic《创始人行动手册》(2026 年 5 月)。评论与本地化视角,不是重制。

常见问题

想法阶段到底在做什么?

在写任何代码之前做研究型验证。证明一个真实问题存在、且你的方案能解决它,主要通过对真正有这个问题的人的诚实对话。

为什么能跑的原型不是验证?

原型只是和用户对话时的道具,不是问题真实存在的证据。手册说得很直白:和用户的对话才是证据;能跑的 app 只是有用的压力测试工具。

什么是「agentic 技术债」?

如果架构与决策没有写在 agent 能读到的地方,每次会话都重新推导基础、代码库漂移。它和普通技术债不同,会复利——所以手册坚持从第一天起就有一份 CLAUDE.md 上下文文件。

想法到 MVP 怎么对应 harness engineering?

把架构写下来(上下文)、用模型当反方代言人压力测试(反馈回路)、保留会话日志(状态),正是 harness 的三层:记忆、反馈、护栏。

分享这篇文章 / Share Article
Wesley Chong

作者

Wesley Chong

来自马来西亚居銮的软件开发者、数字顾问、Toastmasters 讲员。

专注帮助普通人用 AI 升级沟通、表达、商业与人生。

相关阅读