- 后端
- API网关
- MCP 服务
- dsh-plugin
【免费下载链接】treg
OpenRouter for agent tools. Join community here: https://discord.gg/6mQYYfFMAn
本文是 treg.to 开源仓库中marketing/rebuild/BUILD-PLAN.md的完整技术解读。该计划描述了一个以 "Rebuild X"(重建 Clay、Gojiberry、AI SDR、GTM 工程栈、join problem)为主题的对外内容集群如何从关键词研究出发,经过真实数据运行、目录能力核对、页面类型移植、全站互链与测量回路,最终以/workflows/<slug>工作流页面形式落地。读完本文,你将掌握该集群的决策模型、运行预算、WORKFLOWS数据结构、测试护栏、分发节奏与 30 天评审机制,并能在当前仓库中逐条定位其实现证据。
集群的范围与定位:recipe,而非 listicle
marketing/rebuild/BUILD-PLAN.md开篇即界定范围:本目录下五篇草稿、X 分发、集成与测量回路,按依赖排序,每个步骤都指明其对应文件、测试与所需决策。配套的策略文档 00-strategy.md 给出了关键词依据:例如gtm engineering(3,600/月,CPC $9.32,竞争度 LOW)、ai sdr(1,900/月,同比 −46%)、clay alternative(480/月,KD 0)、gojiberry ai(1,600/月)等。策略同时列出明确不做的词:rebuild clay、clay clone、signal based outbound、waterfall enrichment api等——买家用的是 "scraper"、"alternative"、"pricing"、"vs"。
每篇草稿都是一份recipe:可运行的脚本、真实的 endpoint id、真实的按调用价格、一次真实运行的 receipt,并明确写出 treg 不做什么(不发送、不预热、不路由、不去匿名化)以及目录当前存在的缺口。诚实规则贯穿全部草稿:
- treg比较供应商,脚本决定顺序,绝不声称 "routing" 或 "failover";
- Findymail/Fiber 的 miss 在
_observed_cost_micro修复前仍按全价计费——只有 tomba、hunter、leadmagic 被实测为免费 miss; - 目录缺口必须写在页面上:网站 → markdown 抓取、关键词级 LinkedIn 互动监控、帖子的likers列表、访客去匿名化、发送。
0. 编码前的四项决策(D1–D4)
计划将决策编号,并给出"未答复时的默认值":
| # | 决策 | 未答复时的默认 |
|---|---|---|
| D1 | Receipt 策略:(a) 仅聚合 receipt(计数 + 成本,无 CSV、无逐行);(b) 当前规格(聚合 + 匿名化行结果 CSV);(c) 无 receipt(发布为 prompt + 实时价格步骤表,use-case 风格) | (a),诚实、无人数据、背后仍有一次运行 |
| D2 | 页面类型:移植进agent_pages.WORKFLOWS(免费获得 hub、.md孪生、HowTo schema、测试)vs 新增 "recipe" 类型 | WORKFLOWS,不增加第四个生成器 |
| D3 | Slugs:/workflows/rebuild-clay等 vs 面向任务的 slug(/workflows/find-and-verify-a-lead-list风格) | 任务化 slug,"Rebuild Clay" 进 H1/标题;slug 是永久的,品牌名不是 |
| D4 | 赞助 Daily Dose of DS 栏目(预算) | 先询价,步骤 5 上线后再决定 |
关键洞察:slug 一旦被索引就不可移动。这正是仓库中 agent_pages.py 与 docs/context/interface/seo.md 反复强调的"URL 扁平化、分类只是元数据"原则的延续——重新切分分类绝不能移动已被 Google 收录的页面。
1. 分支卫生:先 rebase 再动代码
计划的第一步是版本控制纪律:
- 当前工作树落后
origin/main245 个提交;/workflows、/tools、/agents、/pricing只存在于 main 上。在触碰agent_pages.py之前,先把seo/pages-2026-08-24rebase 到 main。 - 未跟踪的研究与草稿作为 docs(
marketing/)独立提交,与代码分离。 - 每个代码步骤结束时运行
.agents/skills/tools-registry-context/scripts/drift.sh;docs/context/interface/seo.md 是随动的片段。
Codex 评审(见 §9)指出该分支说明在评审落地前就已过期——发现分支从 main 切出后即失效。修正后计划按角色而非名称命名分支。
2. 目录前置条件:先修事实,再写声明
页面能声称什么,取决于目录能做什么。四项前置条件:
| 事项 | 为什么 | 位置 |
|---|---|---|
修复 findymail / fiber 的_observed_cost_micro | 草稿说 "miss 免费",但 ledger 对 miss 计费 | src/treg/内(按记忆笔记);涉及 money 代码,适用 ledger 规则 |
catalog_request:网站 → markdown | 8 个系统中的 3 个有此步骤;AI SDR 与 Clay 页面在落地前将其标注为缺口 | catalog |
catalog_request:LinkedIn 帖子likers与关键词级互动搜索 | Gojiberry 页面声明的两个缺口 | catalog |
| 确认响应路径 | .data.email、.contact.email、.items[0]、.comments[].linkedinUrl——从catalog get示例读取,尚未经真实运行验证 | 各调用一次 |
计划明确:"这些都不阻塞写作;它们改变页面可以声称什么。" 这一边界在 Codex 评审后进一步收窄:scrapecreators.x.v1-linkedin-search-posts(按关键词搜索公开帖子,Google 可索引)与aviato.linkedin.post.reactions(按帖子 URN 列出反应者)实际已存在,两条catalog_request被撤回,Gojiberry 页面与 Grok Bot FAQ 改为描述真实能力范围。
3. 五次真实运行:receipt 必须来自真实数据
每次草稿运行一次真实脚本,按 D1 记录聚合 receipt,CSV 留在本地。顺序按预期搜索价值:
- Rebuild Clay— 50 个联系人走瀑布式;receipt 记录每一级找到数、验证数、总数。
- Build your own AI SDR— 一周 SDR 招聘帖 → VP 级联系人 → 验证邮箱(复用 1)。
- The join problem— 7 天 ≥ $5M 融资 → 营收负责人 → 档案(复用 1)。
- Rebuild Gojiberry— 三条竞品帖子 → 评论者 → ICP 匹配 → 融资核查。
- GTM stack— 不运行;价格表在构建时从目录生成。
预算:按目录价格总计低于 $10。每次运行的 receipt 行以日期形式进入页面的run块。仓库中的实测 receipt 印证了这一机制——agent_pages.py 中 lead-list 工作流记录了 2026-09-23 的完整运行:50 家公司、总成本 $2.33(每条可投递线索 $0.12),并对比 2026-08-26 首次运行($3.62、27 条线索)说明 gate 的价值。
4. 移植到WORKFLOWS:数据结构与测试护栏
计划规定的移植形态(D2 的默认)直接对应仓库实现。agent_pages.WORKFLOWS是每个 slug 一个 dict,字段为:sentence、title、lede、prompt、prompt_why(4 条)、steps((name, capability, ask, endpoint, why)五元组)、once、run。实现在 src/treg/agent_pages.py(lead-list 工作流自 L4476 起)。
移植期强制规则:
- 能力必须存在:
test_every_workflow_step_capability_and_endpoint_exist(tests/test_agent_pages.py)逐步骤校验 capability 与 endpoint 均在目录中——否则页面就是在"凭空给步骤定价"。decision步骤(如 jev 判定)不属目录能力,从DECISION_STEPS定价,测试要求该表带usd、unit与/开头的link。 - 删除所有 em-dash:
test_workflow_copy_has_no_em_dashes(L679-L684)会拒绝按现状提交的草稿;同时遵守品牌规则——copy 中写 treg.to,绝不写裸 "treg"。 - 任何地方都不做路由声明;"the script picks the order"(脚本决定顺序)这句话保留。
- GTM-stack 页不是工作流(无运行),按 D2 精神以
/resources条目或/workflowshub 引言形式发布——不新增页面类型。
once字段解决计数模型问题:多供应商瀑布或三次具名来源帖子无法用"每 endpoint 一次调用"或"每行rows_in次调用"表达。lead-list 工作流的once为("apollo.companies.search",)——Apollo 按页计费,50 家公司的列表页只算一次调用。测试test_workflow_total_counts_a_once_per_run_step_once(L670-L676)断言页面渲染1 × $0.026而非50 × $0.026。
非空护栏test_no_workflow_ships_with_an_empty_section(L639-L656)规定每个工作流必须满足:prompt_why恰 4 条、steps≥ 3、run.receipt与run.narrative非空、run带日期与 CSV 路径、至少 4 个失败模式、FAQ 4–6 条(use-case 页恰为 4)、related恰 4 条且全部能在USE_CASES菜单中解析。
5. 接线(Wiring):生成式互链,而非手写
计划给出从各既有表面到新工作流页的接线矩阵:
| 从 | 到 | 机制 |
|---|---|---|
/workflowshub | 4 新 + 1 已有 | 已从WORKFLOWS展开;sitemap 与.md孪生随之生成 |
5 个 outcome 页(marketing/landing/0*.md→usecase-*.html) | 其延伸的工作流 | 每个一条 "Run the full sequence" 链接块;用marketing/landing/build.py重建 |
| 38 个 job 页 | 使用其能力的工作流 | 反向索引:工作流步骤的每个能力,在 job 页加 "Used in" 行——生成,非手写 |
/tools/<provider> | 调用该 provider 的工作流 | 按 endpoint 的同一反向索引 |
/agents/* | /workflows | install 块中一行 |
llms.txt、skill.md | /workflows | 各一行;它们是前门 |
docs/context/interface/seo.md | 新页面 | drift.sh 会标记 |
测试:tests/test_seo.py走查每条 sitemap 条目返回 200;四个工作流 slug 加入 served-with-crawler-essentials 测试。仓库实现进一步说明这一机制——docs/context/interface/seo.md 记录了_workflows_by_capability()与_jobs_by_provider()两个反向索引均从页面渲染所用的同一张表推导,新 job 或新工作流一经路由即自动交叉链接,无需手写任何条目。
工作流页面的渲染契约(同文档 L696-L760):setup 行与 prompt(带复制按钮)、四条 "why this prompt works" 卡片、步骤表(每步价格实时取自目录:实际使用的 endpoint、其cost_view单价、可执行该步的 provider 数、有样本时的实测成功率与 p50、按能力经USE_CASES解析到 use-case 页的链接)、最坏情况总计(price × rows_in)、真实运行的receipt(id="run")、WHY_TREG、至少四个失败模式、FAQ、四张相关卡片。JSON-LD 含 BreadcrumbList、HowTo(步骤即表格行)与 FAQPage;.md孪生以HTML version: …结尾。页面 hosted-only、sitemap 收录(hub 0.8、页面 0.7)、大小写折叠 301 到规范 slug。
两条关于价格的硬规则值得单独强调:价格绝不写进 copy——步骤表打印实时目录价,why、FAQ 或 narrative 中的数字是第二个真相来源,会漂移(2026-09 SEO 批次曾以 $0.003 发布 hunter,而目录价是 $0.01225);receipt 与 CSV 从真实运行手工记录并标注日期——页面原样打印、不做任何计算,只有每步价格是实时的。
CSV 隐私规则同样由测试钉死:发布的 CSV 只带行级结果(person_found、finder、verdict、catch-all、news)——绝不出现姓名、职位或地址,因为这些是真实的人,姓名 + 具名公司职位足以定位一个人。test_workflow_page_is_served_with_the_crawler_essentials(L571-L606)断言.csv响应以company,domain,person_found,email_source,verify开头、不含@、不含person,title,email。
6. 分发(Distribution):滚动节奏
计划按周列出分发节奏(页面 1 上线即开始):
| 周 | X(Jason 账号) | 其他渠道 |
|---|---|---|
| 页面 1 上线 | join-problem X Article + 带 receipt 截图的钩子推文 | Reddit:r/gtmengineering 的 Clay 替代品线程,发脚本不发链接(每周循环,u/jzdesign 规则) |
| +1 | 价格-receipt 图 #1:邮箱验证,3 个 provider | 开 YALC PR(treg provider adapter);列入gtmagents/gtm-agents |
| +2 | "Clay's moat in 40 lines" | ForkLeadMagic/gtm-skills的prospecting-stack到/call/;向上游提交 |
| +3 | 价格-receipt #2:邮箱查找器,6 个 provider | DDoDS 简报发出(D4) |
| 每周之后 | 一张 receipt 图,经 @treg_ai 循环回复("when unsure, skip") | — |
格式规则来自 teardown:第一行带数字与 receipt,产品名只在结尾出现一次,"try free" 作为自我回复,为"被收藏"而写。
7. 测量(Measurement):从第一天开始
- 每周通过既有 GSC + Ads 循环(自有 key,免费)查看
/workflows/*与关联 job 页的 Search Console 展示/点击。 - 首次调用率仍未被埋点(记忆中的漏斗缺口)。最低方案:install CTA 上加
?src=workflow-<slug>并在审计日志计数。 - 第 30 天评审:任何页面在其主关键词上有展示则保留该货架;否则将 copy 折入 job 页并停止新增工作流。
Codex 评审对此有重要修正:测量已经存在——每个工作流 CTA 已携带/app?ref=wf-<slug>,sitetrack.js记录 pageview 与首次触达 UTM/referrer。修正后的方案是:将ref贯穿到注册(persist),而不是新增src参数;按 索引化 → 非品牌展示/排名 → CTA 到首次调用 → 点击 的顺序分阶段设闸。
8. Codex 独立评审的 20 项发现(2026-08-28)
评审结论分三组:已接受并应用、已接受但改变计划、评审前已完成。
已接受并应用
- 并非缺口:
scrapecreators.x.v1-linkedin-search-posts(按关键词搜索公开帖子,Google 可索引)与aviato.linkedin.post.reactions(按帖子 URN 列出反应者)真实存在;branddev.brand.ai.query可从网站做具名字段抽取。§2 的两条catalog_request撤回。 - 免费 miss 的证据边界:只有 Hunter 与 LeadMagic 的 miss 由 ledger(
api.py)推导;Tomba、Findymail、Fiber 的 miss 按估算结算,已上线工作流的 receipt 对 Tomba 如实说明。预算按估算,页面区分 "documented" 与 "observed"。"每条验证邮箱 $0.01–0.03" 在拿到 receipt 前不可证明;Tomba + Findymail + 验证今天约 $0.035。 - 草稿中的 capability id 是错的(
linkedin.post、jobs.search、companies.funding):每个步骤的能力必须从所选 endpoint 的目录条目推导(companies.funding_rounds、linkedin.search.posts、linkedin.post.reactions…),由test_every_workflow_step_capability_and_endpoint_exist强制。 - 脚本中的参数形状是猜的:Apify 作业(POST JSON
jobTitles、postedLimit、maxItems/maxTotalChargeUsd上限;行不携带company_domain)、Icypeas 人搜(leads[]、profileUrl)、PredictLeads 融资(type、location、page、limit;域名在included下;effective_date、amount_normalized)、Aviato 融资(website、perPage、page;fundingRounds[].announcedOn)。每个脚本在被引用前都要做一次单行 smoke run。 treg skill install rebuild-clay不存在:从 Clay 草稿移除;打包技能是独立交付物。- 裸 "treg" 与 em/en dash违反 CLAUDE.md 与
test_no_em_dashes_in_the_hand_written_copy;移植时清除(已上线的 FAQ copy 已干净)。 - Slugs:草稿链接到不存在的
/rebuild/...与两条 use-case 路径;真实路径是/use-cases/social-trend-research-for-ai-agents与/use-cases/company-research-for-ai-agents。移植前冻结 slug 映射,并加内部链接 200 测试(sitemap 走查不检查出站链接)。
已接受,改变计划
- D1(a) 按现状不可发布:
WORKFLOWS渲染器与tests/test_agent_pages.py要求带日期的运行、rows_in、src/treg/workflow_runs/下的行结果 CSV、narrative、≥4 个失败模式、恰 4 条 FAQ 与 4 个相关标签。纯聚合 receipt 意味着作为契约变更同时改渲染器、规格、文档与测试——或改走 D1(b)(匿名化 CSV)。决策权仍在 Jason,默认翻转为 D1(b)。 - 渲染器没有容纳草稿比较表、首行规则或栈分层的槽位;frontmatter 中的
seo_title/meta_description/h1被忽略。移植方式:按字段矩阵映射进固定小节,或先以测试过的可选小节扩展渲染器。 once无法为多供应商瀑布或三个具名来源帖子定价:基数模型是每个 endpoint 一次调用或rows_in次调用。要么在 run 块存储calls_by_endpoint(文档 + 测试),要么把首批页面约束在模型可表达的范围内。- 爬虫门之后的新顺序:Clay 第一(或既有 lead-list 工作流改名指向 "clay pricing"),专门的 GTM 页面第二(但须先有带自有 title 与 canonical 的页面类型——
/resources只是一个静态文件),Gojiberry 第三,AI SDR 靠后,join problem 作为分发内容。 - 测量已存在(见 §7)。分支说明(§1)在评审落地前已过期,计划改按角色命名分支。
评审前已在 PR #234 完成
爬虫门(hub 链接来自已索引页面、反向索引、/catalog预渲染)、既有工作流作为试点并从每个 agent 页链接、tests/test_seo.py中的接线测试。
9. 压缩后的序列
决策 → rebase → 运行 1–4(与目录修复并行)→ 移植 + 测试 → 接线 + 文档 → 先发一个,之后每周一个 → 分发节奏 → 第 30 天评审。
这条序列是本文所涉全部机制的最终汇合:先有真实运行与真实 receipt,再有页面;先有能力与 endpoint 的测试校验,再谈 copy;先有生成式互链与埋点,再谈分发。仓库中agent_pages.WORKFLOWS的六个已上线工作流(lead list 及 2026-09-14 SEO 批次的五个)连同各自的workflow_runs/CSV,就是这套计划从草案走向可验证产物的直接证据。
- 后端
- API网关
- MCP 服务
- dsh-plugin
【免费下载链接】treg
OpenRouter for agent tools. Join community here: https://discord.gg/6mQYYfFMAn
相关推荐
剪映 Headless 无界面原生草稿全指南:从 `jy14-headless-plan/v1` 计划到本机首页登记
剪映 Headless 无界面原生草稿全指南:从 jy14 headless plan/v1 计划到本机首页登记 导读 本指南围绕 yichen jianyin
音视频AI 技能AI 应用3步快速上手:Ryujinx任天堂Switch模拟器终极使用指南
3步快速上手:Ryujinx任天堂Switch模拟器终极使用指南 Ryujinx是一款用C 编写的开源Nintendo Switch模拟器,致力于为玩家提供出色
硬件仿真图形学Apollo-2B架构深度解析:Gemma模型在医疗领域的优化与创新
Apollo 2B架构深度解析:Gemma模型在医疗领域的优化与创新 Apollo 2B是一款基于Gemma架构的轻量级多语言医疗大语言模型,专门为医疗AI领域
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考