✳ freem.ai 10000app 计划The 10000app Program
公开流水线报告 · R12026-07-29 → 07-30

一轮微型产品工厂:从 20 条线索到 1 个上线产品

这是「万舟计划」流水线在 freem.ai 上跑的第一轮完整记录:需求发现 → 桌面验证 → MVP 出厂 → 高转化分发。下面是全部 20 张需求卡的原文与证据链接、桌面验证逐条硬检查的结论(包括两个被杀掉的候选和死因)、产品的设计推导,以及分发做了什么。失败的部分照写。

20需求卡
39条真实证据链接
7过入库铁规
4≥8 分晋级
1立项出厂
3分发页面

0 · 这条流水线的规则

四条规则决定了下面每一个判断,全部在开工前写死:

评分口径:6 个维度(痛感强度/发生频率/人群可触达/竞争空隙/3 天可 MVP/付费证据)各 0-2 分,满分 12,≥8 分才进桌面验证。

1 · 阶段 0:需求发现(全部 20 张卡)

采集渠道:Hacker News 的「你现在还有什么事在手工做」类问答帖、各厂官方社区(Atlassian/KNIME/Alteryx/Power Query/Adobe)、Reddit(r/remotework、r/Upwork、r/excel)、以及竞品的定价页与帮助中心。

本轮最重要的一个发现是关于采集本身:20 张卡里只有 7 张凑齐了 3 条陌生人原文。瓶颈不是想不出点子,是找不到证据——想法一小时能写二十个,证据一条要找十分钟。剩下的卡按铁规不评分、不进桌面验证,留在库里定期重扫。

R1-01 · 每次约会议都要翻日历、心算空档、手打进邮件,还怕报出去的时段和已有安排撞了 11/12 分 分发验证
谁在痛:对外沟通频繁的顾问 / 销售 / 自由职业者 / 招聘方;聚集在 HN Ask 帖、r/freelance、Calendly 帮助中心的「时段怎么发」类问题下|频率:每周多次(每次对外约会都发生)
现有方案与抱怨:手动翻日历口算;或用 Calendly 类预约链接——但有人明确说「the whole process felt impersonal and not very professional」,对客户不敢发链接
付费信号:Calendly 有付费档;ShareAvailability、Carly、WhenAvailable 一批小玩家在收费做「把空闲时段变成可发送文本」这件事
痛感 2频率 2可触达 2竞争空隙 13天可MVP 2付费证据 2
证据链接 6 条(过入库铁规)
📝 缝隙判定 1 分而非 2 分:Calendly 是巨头且体验好,但它卖的是预约页,不是「贴进邮件的一段文字」;小玩家扎堆恰好证明缝隙真实存在。 | 2026-07-30 用 Reddit(opencli 真实登录会话)补充证据。
R1-02 · AI 写出来的参考文献看着都像真的,要逐条去核实得花几个小时 11/12 分 归档
谁在痛:投稿的研究生与青年学者、期刊编辑与审稿人、写文献综述的学生;聚集在 arXiv 元研究、Enago/Sourcely 这类学术服务的读者群、各校图书馆指南页|频率:每篇论文一次,投稿季每周(编辑侧是每天)
现有方案与抱怨:手动一条条去 Google Scholar / 出版社站点查 DOI;或用 GPTZero 这类「测 AI 味」的工具——但它判的是文本像不像 AI 写的,不是逐条核验这篇文献到底存不存在
付费信号:GPTZero 的 hallucination detector 是付费产品;Sourcely、aicitationchecker 均有付费档;学术润色机构按篇收费做引用核对
痛感 2频率 1可触达 2竞争空隙 23天可MVP 2付费证据 2
证据链接 4 条(过入库铁规)
📝 死因:检查②未过——直接竞品免费且覆盖三大文献库,我能做的版本严格弱于它(少两个数据源)。收窄到中文文献核验也不成立:CNKI/万方没有可查询的开放接口,按铁律③(数据源不可信就改设计,而不是靠提示词补)这条路直接断。 价值:这次桌面验证用一次 WebFetch 省掉了 3 天开发。这正是阶段 1 存在的理由。
R1-03 · 写工单和用户故事要反复填一堆用不上的字段,验收标准还老是漏 9/12 分 归档
谁在痛:敏捷团队里的开发与 PM;聚集在 Atlassian Community 的 Jira 版块、各家 Jira 模板文章的评论区|频率:每天(每张卡都要填)
现有方案与抱怨:手工套模板;Atlassian 生态里一堆付费插件做模板与验收标准强制;也有人直接让 AI 写
付费信号:Atlassian Marketplace 上模板/验收标准类插件按用户数收费;AI 写工单已是付费加值功能
痛感 1频率 2可触达 2竞争空隙 03天可MVP 2付费证据 2
证据链接 4 条(过入库铁规)
📝 死因:检查②与④双双未过。生态位被平台方自己占据时,微型产品没有立足点——这属于手册即杀条款③的变体:不是巨头免费做,而是巨头在自家地盘上收费做,外来者连分发入口都没有。
R1-04 · 把银行流水导进记账软件,格式对不上就得一条条手敲 7/12 分 归档
谁在痛:小生意主与代账会计|频率:每月(代账的人每月十几份)
现有方案与抱怨:一批付费转换器(DocuClipper / Documentric / CapyParse / Lido);官方给的是「先转 CSV 再导」的多步流程
付费信号:至少 4 家在收费做同一件事
痛感 2频率 2可触达 1竞争空隙 03天可MVP 0付费证据 2
证据链接 3 条(过入库铁规)
📝 死因:市场已被付费玩家填满(gap 0),且核心是 PDF 解析+银行版式适配,与工厂「纯文本 3 天出厂」的形态不符(mvp3d 0)。7 分未过线。
R1-05 · 合并一堆列名不一致的 CSV,每次都要手工对齐表头 5/12 分 归档
谁在痛:做数据整理的运营/分析师|频率:每周
现有方案与抱怨:Excel Power Query(免费且好用)、pandas、少量付费小工具
付费信号:有付费小工具(SplitForge 等),但主力方案是免费的 Power Query
痛感 1频率 1可触达 1竞争空隙 03天可MVP 1付费证据 1
证据链接 4 条(过入库铁规)
📝 死因:即杀条款③——巨头(Excel Power Query)免费做且做得好。5 分。
R1-06 · 同一套表格格式每天手工套一遍(配色、列宽、条件格式) 未评分 待补证据
谁在痛:重度用 Google Sheets 交付客户的内容/运营从业者|频率:每天
现有方案与抱怨:手工套;或自己写 Apps Script
付费信号:Google Workspace Marketplace 有付费表格 AI 插件(Pipedreamer 等)
证据链接 3 条(过入库铁规)
📝 证据已够 3 条,但不评分晋级——竞争空隙为 0(Power Query 免费且做得好),属即杀条款③。留库定期重扫。 | 2026-07-30 用 Reddit(opencli 真实登录会话)补充证据。
R1-07 · 要下判断时得手工把好几个来源的信息汇到一起,LLM 只能给摘要 未评分 待补证据
谁在痛:做选型/调研/决策的知识工作者|频率:每周
现有方案与抱怨:手工开十几个标签页;LLM 摘要不敢直接用
付费信号:深度研究类订阅(Perplexity/Elicit 等)在收费
证据链接 1 条(不足 3 条,不评分)
📝 偏泛,需收窄到具体场景(如「选型对比」「尽调」)再补证据。
R1-08 · 相册里的截图和下载文件全靠手工命名归类 未评分 待补证据
谁在痛:手机/电脑里截图成山的普通用户|频率:每周
现有方案与抱怨:手工整理;系统自带相册分类不按用途分
付费信号:未验证
证据链接 1 条(不足 3 条,不评分)
📝 需要读本地文件,超出工厂形态,即使补齐证据也大概率在 mvp3d 上被砍。
R1-09 · 出门前行程、打包、机票、证件、接驳各在一处,没有任何同步 未评分 待补证据
谁在痛:一年出行数次的商旅与家庭出行者|频率:偶发(每次出行)
现有方案与抱怨:备忘录 + 截图 + 邮件里翻
付费信号:TripIt 类有付费档
证据链接 1 条(不足 3 条,不评分)
📝 频率低(偶发)是硬伤,补证据后 freq 大概率只有 0-1 分。
R1-10 · 审 AI 生成的内容比自己写还累(口吻不一致、事实要一条条核) 未评分 待补证据
谁在痛:用 AI 产内容的编辑、市场、技术写作者|频率:每天
现有方案与抱怨:人工逐段读;无成型清单
付费信号:AI 检测类工具在收费
证据链接 1 条(不足 3 条,不评分)
📝 与 R1-02 部分重叠,若补齐证据应考虑并入 R1-02 的付费层而不是单独立项。
R1-11 · 接单平台自带的岗位提醒过滤太弱,只能自己一天刷好几遍 9/12 分 研究中
谁在痛:Upwork 等平台上的自由职业者|频率:每天
现有方案与抱怨:平台自带 alert(条件太粗);手动刷列表
付费信号:Upwork 的 Freelancer Plus 本身是付费档(且用户抱怨它不管用);第三方岗位监控工具有付费档
痛感 2频率 2可触达 2竞争空隙 13天可MVP 0付费证据 2
证据链接 4 条(过入库铁规)
📝 2026-07-30 用 Reddit(opencli 登录会话)补齐证据后入库,9 分过线但 mvp3d = 0:需要常驻监控与推送,工厂当前是无状态纯文本形态,做不了。下一轮若要做,先解决「有状态产品」的基建,否则桌面验证必挂在即杀条款④。 | 2026-07-30 用 Reddit(opencli 真实登录会话)补充证据。
R1-12 · 画矢量图这事 AI 给不了、自己画又慢 未评分 待补证据
谁在痛:要给文档/幻灯配图的开发与写作者|频率:每周
现有方案与抱怨:手画;LLM 生成的 SVG 不可用
付费信号:图形工具订阅市场成熟
证据链接 1 条(不足 3 条,不评分)
R1-13 · 自动化工具本身的配置成本比要自动化的事还高 未评分 待补证据
谁在痛:想用 Zapier/n8n 类工具的个体与小团队|频率:每次尝试自动化时
现有方案与抱怨:Zapier/Make/n8n;抱怨是「要么老坏,要么配置比手做还久」
付费信号:该品类全是订阅制
证据链接 1 条(不足 3 条,不评分)
R1-14 · 工单/PR 模板里塞了一堆自己根本不用的字段,还得填 未评分 待补证据
谁在痛:在流程较重团队里的开发|频率:每天
现有方案与抱怨:照模板填
付费信号:见 R1-03
证据链接 1 条(不足 3 条,不评分)
📝 与 R1-03 同源,建议并卡。
R1-15 · 给非平凡场景造测试数据,每次都从零编 未评分 待补证据
谁在痛:写集成/端到端测试的开发|频率:每周
现有方案与抱怨:手写 fixture;Faker 类库(免费)
付费信号:有付费测试数据平台,但开源方案足够好
证据链接 1 条(不足 3 条,不评分)
R1-16 · 在写码和评审别人代码之间来回切上下文,很耗 未评分 待补证据
谁在痛:团队里的开发|频率:每天
现有方案与抱怨:无
付费信号:未验证
证据链接 1 条(不足 3 条,不评分)
📝 工厂已有 DiffCoach(#0037),若补证据应作为其迭代而非新产品。
R1-17 · 校对(proofreading)仍然是纯手工活 未评分 待补证据
谁在痛:开发与写作者|频率:每周
现有方案与抱怨:Grammarly 类(有免费档且体验好)
付费信号:Grammarly 等订阅制
证据链接 1 条(不足 3 条,不评分)
📝 大概率触发即杀条款③。
R1-18 · 后台/看板里的数据没法直接复制出来,只能一格格抄 未评分 待补证据
谁在痛:做报表的运营/分析师|频率:每周
现有方案与抱怨:手工抄;或让工程导数据
付费信号:表格类 AI 插件在收费(Pipedreamer、Professor Excel)
证据链接 1 条(不足 3 条,不评分)
R1-19 · 群里的接龙/报名消息要手工抄成表格 未评分 待补证据
谁在痛:社群团购团长、班级家长群管理者|频率:每天
现有方案与抱怨:手工复制到 Excel;闲鱼上有人接代整理的活
付费信号:手册示例中提到闲鱼有 ¥5/次代整理(未自行核实)
证据:0 条 —— 按铁规不入库
📝 这是手册 2.3 的示例卡,本轮没有自己找到证据链接,按铁规不入库、不评分——留在这里是为了下一轮去补(搜「接龙 整理 表格」「群接龙 导出」)。
R1-20 · 会议录音/纪要变成带责任人和期限的行动项,仍要手工拆 未评分 待补证据
谁在痛:带团队的一线管理者|频率:每周
现有方案与抱怨:会议转录工具给的是逐字稿或摘要,不是可执行项
付费信号:转录类产品普遍订阅制(未核实其行动项能力)
证据:0 条 —— 按铁规不入库
📝 同上,本轮未找到陌生人原文证据,不评分。

2 · 阶段 1:桌面验证(3 进 1)

时间盒 2 小时/个,全部基于公开检索,不写一行产品代码。四项硬检查全过才立项,任一即杀条款命中就直接归档。这一步的唯一目的是:在投入 3 天开发之前,用公开信息把明显不行的想法杀掉。

✕ R1-02 参考文献真伪核验 —— 归档

原本是本轮分数最高的候选之一(11/12),设想是把参考文献逐条拿去 Crossref 查存在性——正好是「能算的绝不让模型算」的典型题,而且工厂里已经有现成的取数件。

死因:检查②「竞争有空隙」未过。打开首页竞品实测其说明:粘贴任意格式的参考文献 → 逐条对 Crossref + OpenAlex + Semantic Scholar 三个库核验 → 导出 Word;免费档每天约 28-50 条,付费一次性 $9.99 起。也就是说我能做的版本严格弱于它(少两个数据源),而它还免费。

收窄到中文文献核验也不成立:中文期刊库没有可查询的开放接口,数据源这一层直接断——按规则「数据源不可信就改设计,而不是靠提示词补」,这条路走不通。

这次归档的价值:一次竞品页面实测,省掉了 3 天开发。这就是桌面验证存在的理由。

✕ R1-03 工单/用户故事模板填充 —— 归档

死因:检查②与④双双未过。搜索结果前 10 名里 8 条来自平台官方社区、官方文档与成熟插件厂商,平台自己还在把「AI 写工单」做成付费加值功能。没有缝隙,而且分发要和官方域抢同一批关键词——写得出关键词,拿不到位次。

这是即杀条款③的一个变体:不是巨头免费做,而是巨头在自家地盘上收费做,外来者连分发入口都没有。

✓ R1-01 跨时区可发送时段 —— 立项(但价值主张被改写)

检查结论依据
① 搜索需求存在Calendly 官方帮助中心专门有「怎么把时段放进邮件」一篇;一批小产品围绕同一意图做内容;HN 与 r/remotework 有真实抱怨帖
② 竞争有空隙过,但很窄实测免费竞品:连 Google 日历(只读)→ 生成可粘贴的空闲时段文字,免费。「省打字」这个价值主张已经被免费方案吃掉了
③ 付费市场存在同一意图上有多家在收钱
④ 分发通路可写可写出 ≥10 个关键词,信息类/对比/替代品三类都有

桌面验证真正改变的是产品本身,而不只是「做不做」:既然「省打字」已被免费方案覆盖,剩下的缝只有两处——(a) 它需要 Google 日历授权,公司账号常禁、Outlook 用户用不了;(b) 它没有体现「换算到收件人时区」,而跨时区正是最容易出错的场景

所以价值主张从「帮你省去手打」改写成「让对方时区和夏令时不出错」,并把目标用户收窄一档:不愿意或不能授权日历、且要跨时区约会议的人。

另外:R1-11(接单平台岗位提醒,9/12)在本轮收尾后才补齐证据过线,下一轮进桌面验证。它已经能预见到会卡在哪一项——需要常驻监控与推送,而这条流水线目前的产品形态是无状态的纯文本进出,3 天做不出来。分数过线不等于能做,这也是四项硬检查里「3 天可 MVP」单独占一维的原因。

3 · 阶段 2:MVP 出厂 —— 设计是怎么从需求推出来的

产品:SlotMail(#0142)。时间盒 3 天,实际当天出厂。设计的每一步都能追回到上面某一条证据:

需求侧的事实推出的设计决策为什么不是别的做法
免费竞品已覆盖「连日历→可粘贴文字」,但要 Google 授权 不连任何日历:用户粘贴自己「忙」的时段,工具算空档 去和免费产品拼同一件事没有胜算;不授权本身就是一部分人唯一的选项
真正出错的是跨时区(用户原话:boss 把会排在我这边晚上 11 点) 输出即含双时区,并标出「在对方那边是另一天」 跨日是约错时间的第一大来源:你说周三,对方记成他的周三,差一整天
时差不是常数,夏令时切换周所有固定时差都是错的 每一天的真实时区偏移逐段换算,跨切换时明确警告 用固定时差表在一年里有两周会系统性算错,而那两周恰恰最容易出事
抱怨帖的核心其实是「谁迁就谁」,不是「找不到空档」 算出双方工作时间的重叠;零重叠时给出两个让步选项各自的代价(你晚 X 分钟/对方早 Y 分钟) 零重叠时继续报时段没有意义——中美之间给十个时段,每一个都在对方半夜
报一个对方凌晨的时间,比少报几个时段更伤印象 把落在对方非工作时间的时段单独挑出来建议删掉 工具默认输出全部空档的话,等于帮用户把不该发的时段也发出去

明确不做的清单

日历 OAuth、预约页、账号体系、提醒与同步——一个都不做。微型产品的护城河是「快和准」,不是「全」;每加一样都会把 3 天的时间盒撑破。

关键动作与判定标准(开工第一件事)

关键动作 = 粘贴忙碌时段 + 选双方时区 → 得到可粘贴的时段文字;完成判定 = 结果渲染出来。没有这个定义,30 天后的需求门就没有裁判标准。

出厂标准(五件套,缺一不发布)

4 · 阶段 3:分发做了什么

优先级:意图流量(搜索) > 兴趣流量(社交) > 付费流量(只买验证,不买规模)。

页面矩阵(三类,已上线)

类型页面接的意图这一页独有的价值
A 信息类怎么发跨时区会议时间「怎么做」工具嵌在首屏,用户不跳转就能算完;FAQ 带结构化标记
B 对比页和两个现有方案的逐项对照「选哪个」30 字结论先行;明确写出对手强在哪,并标注利益相关
C 替代品不连日历的方案清单「有没有替代」按「为什么找替代」的三个真实原因分组,含「手动做」这个诚实选项

没有做程序化批量页。批量生成长尾页是这个阶段最大的流量杠杆,但红线是每一页必须有该页独有的真实价值,否则会被按「规模化内容滥用」处理,全站连坐——宁要 3 张有用的页,不要 300 张空页。

发布与投放(已备稿,等人工授权,未执行

四条内容按 D1 上线帖 / D3 教程帖 / D7 数据帖 / D14 对比帖写好排进队列;投放预算盒 ≤¥200 一次性、花完即停,只投搜索长尾词。两件事都需要账号与预算的人工授权,在拿到授权之前不会自动发出。其中 D7 数据帖有一条硬约束:没有真实数据就不发

判定线(开工前写死,不许改)

指标阈值
30 天独立访客≥300
关键动作完成≥30 次
访问 → 关键动作≥10%
满意度≥0.6(样本 <5 时改看 7 天内回访用户数 ≥3)

判定日 2026-08-28,到期三选一:晋级付费测试 / 用掉唯一一次迭代机会 / 归档并写死因。「再等等看」不是出口。

5 · 这一轮的漏斗与基准对照

关卡进入通过本轮通过率经验基准
入库评分(≥8/12)7457%40%
桌面验证(4 项硬检查)3133%38%
MVP 出厂(≤3 天)11100%83%
30 天需求门12026-08-28 判定

口径说明:「晋级」是按分数算的,但本轮只有最早凑齐证据的 3 张进了桌面验证——R1-11 是这一轮收尾后用新的采集通道补齐证据才过线的,它排在下一轮的桌面验证队列里,还没被检验过。这类先后差异照写,不合并。

样本只有一轮,这张表现在没有统计意义,放在这里是为了让后面几轮往上叠——手册说要跑满 90 天再用自己的数据覆盖经验值。

6 · 学到的三件事

  1. 瓶颈是证据,不是创意。20 张卡里只有 7 张凑齐 3 条陌生人原文。想法一小时能写二十个,证据一条要找十分钟——所以「每天 30 分钟采集」这条节奏不是建议,是这条流水线的燃料供给。
  2. 桌面验证真的会杀东西,而且杀得对。本轮最高分的两个候选都死在同一项检查上(竞争有空隙)。打开竞品首页看它到底做什么,是这一步唯一有价值的动作——比再想十个功能有用。
  3. 免费竞品通常改写价值主张,而不是杀死产品。上线的这个产品原本想做「省去手打」,实测发现免费方案已经做掉了,于是收窄成「不授权日历 + 跨时区不出错」——活下来的是那条缝,不是原来的想法。

这一轮的所有判断都可以质疑:证据链接全部可点开核对,评分口径与阈值写在上面,被杀掉的候选连死因一起放着。产品页在 /10000app/slotmail