这一轮是定向采集:只在 AI/软件、投资/加密货币、手机/玩机三个方向里找线索,每个方向至少出厂一个产品。和 第一轮最大的差别不是标准,是证据来源换了——R1 靠竞品页与帮助中心推断,三张候选杀掉两张;R2 全部是陌生人原话,三张全活。下面照例把过程摊开,包括这一轮踩到的两个算术缺陷和一次上游故障。
这一轮开始前,把手上列的线索采集通路挨个试了一遍。结论对后续几轮都成立,所以照写:
| 通路 | 实测 | 能不能用 |
|---|---|---|
| BigIdeasDB | 429 | 付费墙 + 速率限制,抓不到 |
| IdeaBrowser | 429 | 同上 |
| PainOnSocial | 307 | 重定向到登录 |
| Exploding Topics | 301 | 重定向,内容在付费墙后 |
| GummySearch | — | 已关停 |
| F5Bot / Syften | 200 | 可达,但它们是关键词邮件告警,不是可检索库:要先订阅再等,这一轮用不上 |
| Brand24 类 | — | 企业级舆情,价位与这条流水线不匹配 |
| 社区直搜 | 200 | 本轮全部证据来自这里——它给的是陌生人原话,正好是入库铁规要的东西 |
一句话结论:付费线索库的价值是二手转述,而铁规要的是一手原话。它们适合用来「发现有这么个话题」,不适合用来当证据。这一轮没有为它们付费,因为付了也拿不到能入库的东西。
三个产品的共同设计原则,也是这条流水线的三条建造铁律:能算的绝不让模型算、会变的数字一律不给只给查法、数据源脏就改设计而不是靠提示词补。
线索里最有说服力的一条是:缓存出问题会「silently 10-20x your API costs」。silently 是关键词——账单上看不出来,只有命中率看得出来。所以产品的核心输出不是「你花了多少钱」(账单已经告诉你了),而是账单答不了的四个问题:钱集中在哪个场景、缓存到底省了多少、按当前速率预算还能烧几天、单次请求均价是多少。
价格一律不写死。各家每百万 token 的单价每个月都在变,写进代码一定过期,还会让人拿着错数字做决定。所以让用户从自己账单上抄三个数填进来——工具不需要知道你用的是谁家的 API。这是铁律二的直接应用。
这个方向的证据里有一条特别关键:「用过集中流动性的话,你的税务软件(很可能)在编造你的成本基础」。付费软件也算不对,这就是空隙。另一条是「20000 笔网格机器人成交怎么处理」——纯粹的算术规模问题,手工不可能做。
但税务是强监管领域,所以产品线定得很死:只做算术,不给税率、不给规则、不判断哪种口径可用。各国各年差别极大,同一个国家对空投、质押、挖矿的定性都可能不同——写死任何一条都会害人。产品的用途被限定为:让你在找会计之前,先知道自己的数据长什么样、三种口径差多少、该问哪几个问题。
这个方向的需求信号是三张卡里最强的:有一个专门讨论电池焦虑的子版,还有每周常设的电池答疑帖(每期几十到上百条)。而反复出现的问法是「我这个掉得正常吗」——问的是速率,不是绝对值。
论坛永远答不好这个问题,因为回答的人不知道你的速率:同样是 83%,用了 1 年和用了 3 年是完全不同的两件事。所以产品算的就是速率(按月、按循环两个口径)、按速率外推跌破阈值的日期、以及换电池与换新机摊到每月的对比——把「值不值得」这个含糊问题,换成「每个月为这台机器付多少钱」这个能回答的问题。
这张卡的付费信号是三张里最弱的(现成替代「发帖问陌生人」是免费的),但可触达性与频率最高。付费点因此放在「决策包」而不是「读数」上——读数免费。
上线后第一次真实数据冒烟就抓到了:一笔 BTC 卖出,LIFO 口径下从 ARB 空投的批次里扣了成本,算出 $41,399 的假盈亏(正确值 $12,468)。剩余持仓还显示成「1200.3 单位」——把 1200 个 ARB 和 0.3 个 BTC 加在了一起,这个数字本身没有意义。
修法是逐资产分组后各跑一遍三种口径再加总,剩余持仓按资产分别列出,并且对识别不出资产代号的行明确警告结果不可用。修完用手算逐笔对过:FIFO $18,381.67、LIFO $12,468,两个口径都与手算一致。
为什么值得写出来:这个 bug 不会报错、不会崩页面,它只是安静地给出一个看起来很合理的错数字。而这正是这类工具最危险的失败方式——比崩掉严重得多。
把 0.028%/循环 显示成了 2.778%/循环。同一行里「每 100 次循环约 2.8%」是对的,说明是显示层乘错了倍数。已改成以「每 100 次循环」为主口径(单次数值太小,不适合当主要读数)。
冒烟期间上游返回 402/429(额度问题)。暴露出一个全舰队的设计缺陷:模型一挂,结果整页只剩「LLM error 402」——但这条流水线的铁律就是「能算的绝不让模型算」,多数产品的主体价值本来就在代码算出的那部分里,凭什么跟着模型一起死?
已改:模型失败时照常交付全部确定性结果,只标注缺了模型撰写的那一节。这一改动对全部 145 个产品生效,而且是在真实故障期间验证的——上面 CostBasis 的三口径对比、空投时点、持有期匹配四块内容,就是在上游不可用的状态下正常返回的。付费侧本来就安全:生成失败不扣次数。
| R1 | R2 | |
|---|---|---|
| 采集方式 | 宽口径扫 20 张 | 定向三个方向 |
| 证据来源 | 竞品页 / 帮助中心 / 社区混合 | 全部社区陌生人原话 |
| 桌面验证存活 | 3 张进,杀掉 2 张 | 3 张进,全部存活 |
| 出厂产品 | 1 个 | 3 个 |
不要把「R2 全活」读成流水线变松了。R1 杀掉的两张,死因都是「桌面上真去用了竞品,发现现成方案已经够好」。R2 三张之所以活下来,是因为它们的核心输出都能落在纯算术上,而且没有一张需要我们去维护会变的数据——价格、税率、机型参数一律由用户填或干脆不给。这是选题时就避开了死因,不是检验时放了水。
这三个产品一分钱都还没赚到,也还没有真实用户数据。上一轮的产品同样还在等 Gate 1(首个判断点看 UV、关键动作数与满意度)。在拿到真实分母之前,上面所有关于「需求真实存在」的判断,依据都只是陌生人在公开场合的抱怨——那是入场券,不是验证。真正的验证是有人愿意付钱,或者至少愿意反复用。
这一页会随流水线库实时更新。← 第一轮报告