公开流水线报告 · R12026-07-29 → 07-30
一轮微型产品工厂:从 20 条线索到 1 个上线产品
这是「万舟计划」流水线在 freem.ai 上跑的第一轮完整记录:需求发现 → 桌面验证 → MVP 出厂 → 高转化分发。下面是全部 20 张需求卡的原文与证据链接、桌面验证逐条硬检查的结论(包括两个被杀掉的候选和死因)、产品的设计推导,以及分发做了什么。失败的部分照写。
20需求卡
39条真实证据链接
7过入库铁规
4≥8 分晋级
1立项出厂
3分发页面
0 · 这条流水线的规则
四条规则决定了下面每一个判断,全部在开工前写死:
- 先证需求,再写代码。没有 3 条陌生人的真实原文抱怨,任何想法不许进入开发。自己觉得痛不算数。
- 每个阶段 = 一个可证伪假设 + 淘汰线 + 时间盒。阈值开工前写死,事后不许改。
- 不投入是默认动作,晋级必须用数据敲门。所以叫「门」,不叫「里程碑」。
- 淘汰是产出,不是失败。被杀掉的候选交付两样东西:一份死因、一批可复用模板。
评分口径:6 个维度(痛感强度/发生频率/人群可触达/竞争空隙/3 天可 MVP/付费证据)各 0-2 分,满分 12,≥8 分才进桌面验证。
1 · 阶段 0:需求发现(全部 20 张卡)
采集渠道:Hacker News 的「你现在还有什么事在手工做」类问答帖、各厂官方社区(Atlassian/KNIME/Alteryx/Power Query/Adobe)、Reddit(r/remotework、r/Upwork、r/excel)、以及竞品的定价页与帮助中心。
本轮最重要的一个发现是关于采集本身:20 张卡里只有 7 张凑齐了 3 条陌生人原文。瓶颈不是想不出点子,是找不到证据——想法一小时能写二十个,证据一条要找十分钟。剩下的卡按铁规不评分、不进桌面验证,留在库里定期重扫。
R1-01 · 每次约会议都要翻日历、心算空档、手打进邮件,还怕报出去的时段和已有安排撞了 11/12 分 分发验证
谁在痛:对外沟通频繁的顾问 / 销售 / 自由职业者 / 招聘方;聚集在 HN Ask 帖、r/freelance、Calendly 帮助中心的「时段怎么发」类问题下|频率:每周多次(每次对外约会都发生)
现有方案与抱怨:手动翻日历口算;或用 Calendly 类预约链接——但有人明确说「the whole process felt impersonal and not very professional」,对客户不敢发链接
付费信号:Calendly 有付费档;ShareAvailability、Carly、WhenAvailable 一批小玩家在收费做「把空闲时段变成可发送文本」这件事
痛感 2频率 2可触达 2竞争空隙 13天可MVP 2付费证据 2
证据链接 6 条(过入库铁规)
📝 缝隙判定 1 分而非 2 分:Calendly 是巨头且体验好,但它卖的是预约页,不是「贴进邮件的一段文字」;小玩家扎堆恰好证明缝隙真实存在。 | 2026-07-30 用 Reddit(opencli 真实登录会话)补充证据。
R1-02 · AI 写出来的参考文献看着都像真的,要逐条去核实得花几个小时 11/12 分 归档
谁在痛:投稿的研究生与青年学者、期刊编辑与审稿人、写文献综述的学生;聚集在 arXiv 元研究、Enago/Sourcely 这类学术服务的读者群、各校图书馆指南页|频率:每篇论文一次,投稿季每周(编辑侧是每天)
现有方案与抱怨:手动一条条去 Google Scholar / 出版社站点查 DOI;或用 GPTZero 这类「测 AI 味」的工具——但它判的是文本像不像 AI 写的,不是逐条核验这篇文献到底存不存在
付费信号:GPTZero 的 hallucination detector 是付费产品;Sourcely、aicitationchecker 均有付费档;学术润色机构按篇收费做引用核对
痛感 2频率 1可触达 2竞争空隙 23天可MVP 2付费证据 2
证据链接 4 条(过入库铁规)
📝 死因:检查②未过——直接竞品免费且覆盖三大文献库,我能做的版本严格弱于它(少两个数据源)。收窄到中文文献核验也不成立:CNKI/万方没有可查询的开放接口,按铁律③(数据源不可信就改设计,而不是靠提示词补)这条路直接断。
价值:这次桌面验证用一次 WebFetch 省掉了 3 天开发。这正是阶段 1 存在的理由。
R1-03 · 写工单和用户故事要反复填一堆用不上的字段,验收标准还老是漏 9/12 分 归档
谁在痛:敏捷团队里的开发与 PM;聚集在 Atlassian Community 的 Jira 版块、各家 Jira 模板文章的评论区|频率:每天(每张卡都要填)
现有方案与抱怨:手工套模板;Atlassian 生态里一堆付费插件做模板与验收标准强制;也有人直接让 AI 写
付费信号:Atlassian Marketplace 上模板/验收标准类插件按用户数收费;AI 写工单已是付费加值功能
痛感 1频率 2可触达 2竞争空隙 03天可MVP 2付费证据 2
证据链接 4 条(过入库铁规)
📝 死因:检查②与④双双未过。生态位被平台方自己占据时,微型产品没有立足点——这属于手册即杀条款③的变体:不是巨头免费做,而是巨头在自家地盘上收费做,外来者连分发入口都没有。
R1-04 · 把银行流水导进记账软件,格式对不上就得一条条手敲 7/12 分 归档
谁在痛:小生意主与代账会计|频率:每月(代账的人每月十几份)
现有方案与抱怨:一批付费转换器(DocuClipper / Documentric / CapyParse / Lido);官方给的是「先转 CSV 再导」的多步流程
付费信号:至少 4 家在收费做同一件事
痛感 2频率 2可触达 1竞争空隙 03天可MVP 0付费证据 2
证据链接 3 条(过入库铁规)
📝 死因:市场已被付费玩家填满(gap 0),且核心是 PDF 解析+银行版式适配,与工厂「纯文本 3 天出厂」的形态不符(mvp3d 0)。7 分未过线。
R1-05 · 合并一堆列名不一致的 CSV,每次都要手工对齐表头 5/12 分 归档
谁在痛:做数据整理的运营/分析师|频率:每周
现有方案与抱怨:Excel Power Query(免费且好用)、pandas、少量付费小工具
付费信号:有付费小工具(SplitForge 等),但主力方案是免费的 Power Query
痛感 1频率 1可触达 1竞争空隙 03天可MVP 1付费证据 1
证据链接 4 条(过入库铁规)
📝 死因:即杀条款③——巨头(Excel Power Query)免费做且做得好。5 分。
R1-06 · 同一套表格格式每天手工套一遍(配色、列宽、条件格式) 未评分 待补证据
谁在痛:重度用 Google Sheets 交付客户的内容/运营从业者|频率:每天
现有方案与抱怨:手工套;或自己写 Apps Script
付费信号:Google Workspace Marketplace 有付费表格 AI 插件(Pipedreamer 等)
证据链接 3 条(过入库铁规)
📝 证据已够 3 条,但不评分晋级——竞争空隙为 0(Power Query 免费且做得好),属即杀条款③。留库定期重扫。 | 2026-07-30 用 Reddit(opencli 真实登录会话)补充证据。
R1-07 · 要下判断时得手工把好几个来源的信息汇到一起,LLM 只能给摘要 未评分 待补证据
谁在痛:做选型/调研/决策的知识工作者|频率:每周
现有方案与抱怨:手工开十几个标签页;LLM 摘要不敢直接用
付费信号:深度研究类订阅(Perplexity/Elicit 等)在收费
证据链接 1 条(不足 3 条,不评分)
📝 偏泛,需收窄到具体场景(如「选型对比」「尽调」)再补证据。
R1-08 · 相册里的截图和下载文件全靠手工命名归类 未评分 待补证据
谁在痛:手机/电脑里截图成山的普通用户|频率:每周
现有方案与抱怨:手工整理;系统自带相册分类不按用途分
付费信号:未验证
证据链接 1 条(不足 3 条,不评分)
📝 需要读本地文件,超出工厂形态,即使补齐证据也大概率在 mvp3d 上被砍。
R1-09 · 出门前行程、打包、机票、证件、接驳各在一处,没有任何同步 未评分 待补证据
谁在痛:一年出行数次的商旅与家庭出行者|频率:偶发(每次出行)
现有方案与抱怨:备忘录 + 截图 + 邮件里翻
付费信号:TripIt 类有付费档
证据链接 1 条(不足 3 条,不评分)
📝 频率低(偶发)是硬伤,补证据后 freq 大概率只有 0-1 分。
R1-10 · 审 AI 生成的内容比自己写还累(口吻不一致、事实要一条条核) 未评分 待补证据
谁在痛:用 AI 产内容的编辑、市场、技术写作者|频率:每天
现有方案与抱怨:人工逐段读;无成型清单
付费信号:AI 检测类工具在收费
证据链接 1 条(不足 3 条,不评分)
📝 与 R1-02 部分重叠,若补齐证据应考虑并入 R1-02 的付费层而不是单独立项。
R1-11 · 接单平台自带的岗位提醒过滤太弱,只能自己一天刷好几遍 9/12 分 研究中
谁在痛:Upwork 等平台上的自由职业者|频率:每天
现有方案与抱怨:平台自带 alert(条件太粗);手动刷列表
付费信号:Upwork 的 Freelancer Plus 本身是付费档(且用户抱怨它不管用);第三方岗位监控工具有付费档
痛感 2频率 2可触达 2竞争空隙 13天可MVP 0付费证据 2
证据链接 4 条(过入库铁规)
📝 2026-07-30 用 Reddit(opencli 登录会话)补齐证据后入库,9 分过线但 mvp3d = 0:需要常驻监控与推送,工厂当前是无状态纯文本形态,做不了。下一轮若要做,先解决「有状态产品」的基建,否则桌面验证必挂在即杀条款④。 | 2026-07-30 用 Reddit(opencli 真实登录会话)补充证据。
R1-12 · 画矢量图这事 AI 给不了、自己画又慢 未评分 待补证据
谁在痛:要给文档/幻灯配图的开发与写作者|频率:每周
现有方案与抱怨:手画;LLM 生成的 SVG 不可用
付费信号:图形工具订阅市场成熟
证据链接 1 条(不足 3 条,不评分)
R1-13 · 自动化工具本身的配置成本比要自动化的事还高 未评分 待补证据
谁在痛:想用 Zapier/n8n 类工具的个体与小团队|频率:每次尝试自动化时
现有方案与抱怨:Zapier/Make/n8n;抱怨是「要么老坏,要么配置比手做还久」
付费信号:该品类全是订阅制
证据链接 1 条(不足 3 条,不评分)
R1-14 · 工单/PR 模板里塞了一堆自己根本不用的字段,还得填 未评分 待补证据
谁在痛:在流程较重团队里的开发|频率:每天
现有方案与抱怨:照模板填
付费信号:见 R1-03
证据链接 1 条(不足 3 条,不评分)
📝 与 R1-03 同源,建议并卡。
R1-15 · 给非平凡场景造测试数据,每次都从零编 未评分 待补证据
谁在痛:写集成/端到端测试的开发|频率:每周
现有方案与抱怨:手写 fixture;Faker 类库(免费)
付费信号:有付费测试数据平台,但开源方案足够好
证据链接 1 条(不足 3 条,不评分)
R1-16 · 在写码和评审别人代码之间来回切上下文,很耗 未评分 待补证据
谁在痛:团队里的开发|频率:每天
现有方案与抱怨:无
付费信号:未验证
证据链接 1 条(不足 3 条,不评分)
📝 工厂已有 DiffCoach(#0037),若补证据应作为其迭代而非新产品。
R1-17 · 校对(proofreading)仍然是纯手工活 未评分 待补证据
谁在痛:开发与写作者|频率:每周
现有方案与抱怨:Grammarly 类(有免费档且体验好)
付费信号:Grammarly 等订阅制
证据链接 1 条(不足 3 条,不评分)
📝 大概率触发即杀条款③。
R1-18 · 后台/看板里的数据没法直接复制出来,只能一格格抄 未评分 待补证据
谁在痛:做报表的运营/分析师|频率:每周
现有方案与抱怨:手工抄;或让工程导数据
付费信号:表格类 AI 插件在收费(Pipedreamer、Professor Excel)
证据链接 1 条(不足 3 条,不评分)
R1-19 · 群里的接龙/报名消息要手工抄成表格 未评分 待补证据
谁在痛:社群团购团长、班级家长群管理者|频率:每天
现有方案与抱怨:手工复制到 Excel;闲鱼上有人接代整理的活
付费信号:手册示例中提到闲鱼有 ¥5/次代整理(未自行核实)
证据:0 条 —— 按铁规不入库
📝 这是手册 2.3 的示例卡,本轮没有自己找到证据链接,按铁规不入库、不评分——留在这里是为了下一轮去补(搜「接龙 整理 表格」「群接龙 导出」)。
R1-20 · 会议录音/纪要变成带责任人和期限的行动项,仍要手工拆 未评分 待补证据
谁在痛:带团队的一线管理者|频率:每周
现有方案与抱怨:会议转录工具给的是逐字稿或摘要,不是可执行项
付费信号:转录类产品普遍订阅制(未核实其行动项能力)
证据:0 条 —— 按铁规不入库
📝 同上,本轮未找到陌生人原文证据,不评分。
2 · 阶段 1:桌面验证(3 进 1)
时间盒 2 小时/个,全部基于公开检索,不写一行产品代码。四项硬检查全过才立项,任一即杀条款命中就直接归档。这一步的唯一目的是:在投入 3 天开发之前,用公开信息把明显不行的想法杀掉。
✕ R1-02 参考文献真伪核验 —— 归档
原本是本轮分数最高的候选之一(11/12),设想是把参考文献逐条拿去 Crossref 查存在性——正好是「能算的绝不让模型算」的典型题,而且工厂里已经有现成的取数件。
死因:检查②「竞争有空隙」未过。打开首页竞品实测其说明:粘贴任意格式的参考文献 → 逐条对 Crossref + OpenAlex + Semantic Scholar 三个库核验 → 导出 Word;免费档每天约 28-50 条,付费一次性 $9.99 起。也就是说我能做的版本严格弱于它(少两个数据源),而它还免费。
收窄到中文文献核验也不成立:中文期刊库没有可查询的开放接口,数据源这一层直接断——按规则「数据源不可信就改设计,而不是靠提示词补」,这条路走不通。
这次归档的价值:一次竞品页面实测,省掉了 3 天开发。这就是桌面验证存在的理由。
✕ R1-03 工单/用户故事模板填充 —— 归档
死因:检查②与④双双未过。搜索结果前 10 名里 8 条来自平台官方社区、官方文档与成熟插件厂商,平台自己还在把「AI 写工单」做成付费加值功能。没有缝隙,而且分发要和官方域抢同一批关键词——写得出关键词,拿不到位次。
这是即杀条款③的一个变体:不是巨头免费做,而是巨头在自家地盘上收费做,外来者连分发入口都没有。
✓ R1-01 跨时区可发送时段 —— 立项(但价值主张被改写)
| 检查 | 结论 | 依据 |
| ① 搜索需求存在 | 过 | Calendly 官方帮助中心专门有「怎么把时段放进邮件」一篇;一批小产品围绕同一意图做内容;HN 与 r/remotework 有真实抱怨帖 |
| ② 竞争有空隙 | 过,但很窄 | 实测免费竞品:连 Google 日历(只读)→ 生成可粘贴的空闲时段文字,免费。「省打字」这个价值主张已经被免费方案吃掉了 |
| ③ 付费市场存在 | 过 | 同一意图上有多家在收钱 |
| ④ 分发通路可写 | 过 | 可写出 ≥10 个关键词,信息类/对比/替代品三类都有 |
桌面验证真正改变的是产品本身,而不只是「做不做」:既然「省打字」已被免费方案覆盖,剩下的缝只有两处——(a) 它需要 Google 日历授权,公司账号常禁、Outlook 用户用不了;(b) 它没有体现「换算到收件人时区」,而跨时区正是最容易出错的场景。
所以价值主张从「帮你省去手打」改写成「让对方时区和夏令时不出错」,并把目标用户收窄一档:不愿意或不能授权日历、且要跨时区约会议的人。
另外:R1-11(接单平台岗位提醒,9/12)在本轮收尾后才补齐证据过线,下一轮进桌面验证。它已经能预见到会卡在哪一项——需要常驻监控与推送,而这条流水线目前的产品形态是无状态的纯文本进出,3 天做不出来。分数过线不等于能做,这也是四项硬检查里「3 天可 MVP」单独占一维的原因。
3 · 阶段 2:MVP 出厂 —— 设计是怎么从需求推出来的
产品:SlotMail(#0142)。时间盒 3 天,实际当天出厂。设计的每一步都能追回到上面某一条证据:
| 需求侧的事实 | 推出的设计决策 | 为什么不是别的做法 |
| 免费竞品已覆盖「连日历→可粘贴文字」,但要 Google 授权 |
不连任何日历:用户粘贴自己「忙」的时段,工具算空档 |
去和免费产品拼同一件事没有胜算;不授权本身就是一部分人唯一的选项 |
| 真正出错的是跨时区(用户原话:boss 把会排在我这边晚上 11 点) |
输出即含双时区,并标出「在对方那边是另一天」 |
跨日是约错时间的第一大来源:你说周三,对方记成他的周三,差一整天 |
| 时差不是常数,夏令时切换周所有固定时差都是错的 |
按每一天的真实时区偏移逐段换算,跨切换时明确警告 |
用固定时差表在一年里有两周会系统性算错,而那两周恰恰最容易出事 |
| 抱怨帖的核心其实是「谁迁就谁」,不是「找不到空档」 |
算出双方工作时间的重叠;零重叠时给出两个让步选项各自的代价(你晚 X 分钟/对方早 Y 分钟) |
零重叠时继续报时段没有意义——中美之间给十个时段,每一个都在对方半夜 |
| 报一个对方凌晨的时间,比少报几个时段更伤印象 |
把落在对方非工作时间的时段单独挑出来建议删掉 |
工具默认输出全部空档的话,等于帮用户把不该发的时段也发出去 |
明确不做的清单
日历 OAuth、预约页、账号体系、提醒与同步——一个都不做。微型产品的护城河是「快和准」,不是「全」;每加一样都会把 3 天的时间盒撑破。
关键动作与判定标准(开工第一件事)
关键动作 = 粘贴忙碌时段 + 选双方时区 → 得到可粘贴的时段文字;完成判定 = 结果渲染出来。没有这个定义,30 天后的需求门就没有裁判标准。
出厂标准(五件套,缺一不发布)
- 埋点三件套:访问、关键动作事件、满意度微调查。这一轮在这里抓到一个真 bug:埋点的网络请求没有等待就返回响应,运行环境会把未完成的请求直接取消,而错误又被吞掉——事件从来没有落过库,表面完全正常。修好后全舰队 142 个产品的关键动作才第一次有了记录。
- 满意度微调查:出结果后弹 👍/👎 加一句话,满意度 = 👍 ÷ (👍+👎)。
- 反馈入口:页脚固定入口,早期每条反馈都手工回复。
- 支付桩:支付链路已接好。这里对手册做了一处有意的偏离——手册要求 MVP 阶段隐藏价格入口、等需求门通过再开闸;本舰队的止损线要求尽快验证到第一笔真实付费,所以价格照常显示。偏离写在这里,不藏着。
- 接入总台:访问/关键动作/付费四个数字自动上报。
4 · 阶段 3:分发做了什么
优先级:意图流量(搜索) > 兴趣流量(社交) > 付费流量(只买验证,不买规模)。
页面矩阵(三类,已上线)
| 类型 | 页面 | 接的意图 | 这一页独有的价值 |
| A 信息类 | 怎么发跨时区会议时间 | 「怎么做」 | 工具嵌在首屏,用户不跳转就能算完;FAQ 带结构化标记 |
| B 对比页 | 和两个现有方案的逐项对照 | 「选哪个」 | 30 字结论先行;明确写出对手强在哪,并标注利益相关 |
| C 替代品 | 不连日历的方案清单 | 「有没有替代」 | 按「为什么找替代」的三个真实原因分组,含「手动做」这个诚实选项 |
没有做程序化批量页。批量生成长尾页是这个阶段最大的流量杠杆,但红线是每一页必须有该页独有的真实价值,否则会被按「规模化内容滥用」处理,全站连坐——宁要 3 张有用的页,不要 300 张空页。
发布与投放(已备稿,等人工授权,未执行)
四条内容按 D1 上线帖 / D3 教程帖 / D7 数据帖 / D14 对比帖写好排进队列;投放预算盒 ≤¥200 一次性、花完即停,只投搜索长尾词。两件事都需要账号与预算的人工授权,在拿到授权之前不会自动发出。其中 D7 数据帖有一条硬约束:没有真实数据就不发。
判定线(开工前写死,不许改)
| 指标 | 阈值 |
| 30 天独立访客 | ≥300 |
| 关键动作完成 | ≥30 次 |
| 访问 → 关键动作 | ≥10% |
| 满意度 | ≥0.6(样本 <5 时改看 7 天内回访用户数 ≥3) |
判定日 2026-08-28,到期三选一:晋级付费测试 / 用掉唯一一次迭代机会 / 归档并写死因。「再等等看」不是出口。
5 · 这一轮的漏斗与基准对照
| 关卡 | 进入 | 通过 | 本轮通过率 | 经验基准 |
| 入库评分(≥8/12) | 7 | 4 | 57% | 40% |
| 桌面验证(4 项硬检查) | 3 | 1 | 33% | 38% |
| MVP 出厂(≤3 天) | 1 | 1 | 100% | 83% |
| 30 天需求门 | 1 | 2026-08-28 判定 |
口径说明:「晋级」是按分数算的,但本轮只有最早凑齐证据的 3 张进了桌面验证——R1-11 是这一轮收尾后用新的采集通道补齐证据才过线的,它排在下一轮的桌面验证队列里,还没被检验过。这类先后差异照写,不合并。
样本只有一轮,这张表现在没有统计意义,放在这里是为了让后面几轮往上叠——手册说要跑满 90 天再用自己的数据覆盖经验值。
6 · 学到的三件事
- 瓶颈是证据,不是创意。20 张卡里只有 7 张凑齐 3 条陌生人原文。想法一小时能写二十个,证据一条要找十分钟——所以「每天 30 分钟采集」这条节奏不是建议,是这条流水线的燃料供给。
- 桌面验证真的会杀东西,而且杀得对。本轮最高分的两个候选都死在同一项检查上(竞争有空隙)。打开竞品首页看它到底做什么,是这一步唯一有价值的动作——比再想十个功能有用。
- 免费竞品通常改写价值主张,而不是杀死产品。上线的这个产品原本想做「省去手打」,实测发现免费方案已经做掉了,于是收窄成「不授权日历 + 跨时区不出错」——活下来的是那条缝,不是原来的想法。
这一轮的所有判断都可以质疑:证据链接全部可点开核对,评分口径与阈值写在上面,被杀掉的候选连死因一起放着。产品页在 /10000app/slotmail。