← 返回产品

NO.003 · W03 · 2026.09.01

领域拆解

一句话说清你关注的技术领域,每周一早收到 5 个候选开源项目和与上周的差异;点其中一个,跑一份带逐字引文和永久回链的深度拆解

打开产品 ↗源代码 ↗在线#agent#开源#调研#每周

为什么做它

「先扫一遍同行,再决定自己做什么」不是设想中的需求,是我每次立项都在手工做的事:001 立项时扫了 12 个开源同类项目,002 立项时扫了 5 个,更早的 translate-agent 扫了 4 份。只要「每周一个产品」还在跑,这个动作就停不下来。

但手工那几次做的是「扫一遍」——立项那一刻,半小时内判断这周该不该做这个东西。我这次想要的是另一件事:没有具体决定要做什么的时候,持续地往一个领域里看。两者的产出物不一样:前者要查全,后者要深度。

动手前先查了赛道。一次性深度调研已经卷到 8 万星,而且头部在死——stanford-oval/storm 停更 11 个月,langchain-ai/open_deep_research 今年 8 月主动归档。反过来,「周期性」这一层在开源侧最高只有 19 星。空位是真的,但它不在无人区:Perplexity 的 Scheduled Tasks 字面上就是「按周自动出报告」,免费或低价发完了。

所以「自动」「周期」「出报告」这三个词都不能当差异化,一个都不能。能站住的只有它们结构上做不到的两件事:一是没有一家告诉你它淘汰了什么(gpt-researcher 用 0.42 的相似度阈值静默丢源,Perplexity 不公开淘汰名单);二是每次任务之间没有记忆——Perplexity 的定时任务建在会话模型上,第 5 次跑不知道前 4 次说过什么,所以它只能每次都从头写一份完整报告,「只讲增量」在它的产品结构里没有落脚点。

它做了什么

你给一句话(「我想跟踪 AI agent 的记忆与上下文工程」),它拆成一份看得见、改得动的关注档案:领域边界、在意什么、不在意什么、5–8 条检索词。你的原话永久保留,模型不许改写。

此后每周一早一封门铃邮件:5 个候选开源项目、与上周的差异(新增 / 转归档 / 换许可证)、一个回网页的按钮。邮件里不放报告全文——那些带 commit sha 的行号链接和可展开的引文在邮件客户端里全是死的。

发现层几乎零 LLM:每条检索词发两次 GitHub Search,一次按星排、一次按更新时间排。只按星排会系统性漏掉新项目,而周更场景下新项目恰恰是最该出现的那类东西。过滤(已归档 / 停更 / 许可证冲突 / 太小)是一个纯函数,直接读 GitHub 自己的字段,模型不接触。

候选清单旁边固定挂着排除清单和检索台账,它们不是附加项,是产品本身:发出几条查询(原文可见)、返回几个仓、进清单几个、排除几个、抓失败几个——数字全部由代码统计。旁边写死一句不可折叠的话:GitHub 搜索接口每条查询最多只肯返回 1000 条,所以这不是这个领域的全部。排除的每条带理由,并按「规则判的」还是「模型判的」分色;你觉得判错了可以申诉捞回。

点某一行,才跑那份贵的深度报告,1–3 分钟三节:第一节是它当年怎么走到今天(主体是 Hacker News 上的一手反应原文,不是今天的复盘文章);第二节是它源码里值得抄什么、以及和同一周清单上的其他候选比它的做法哪里不一样(读的是最多 15 份按档案里的领域维度词挑出来的源码,不是安装脚本;对照组只来自同周候选,不让模型「想」同类项目);第三节是它没 cover 这个领域的哪些方面——这一节没有模型,是代码在整棵文件树和读过的正文里做零命中检查,页面上明写「未见」只说明这些词没出现,不说明这个方面一定没做。每条结论必须挂一段逐字引文,由代码做字符串匹配核回它声称的那一份来源——跨源命中判为失败,因为一条挂错来源的引文比一条没有引文的结论更危险,它带着假凭证。永久回链里是 commit sha 不是分支名:blob/main/...#L12 会在对方下次提交后指向完全不同的代码。

判断层配不上证据的,直接丢弃,不灰显。002 里事实层配不上是灰显不删,这里有意反转:判断层是这个产品最想被人读的一层,在最想被读的地方放软门就是自欺——读者会把灰色当排版,照读不误。丢掉多少条会一起显示,不藏。

学到了什么

还没发布,这一节等第一周真实使用之后再写。

现在能先说的只有一条待验证的判断:**第一周注定看起来平庸。**四条差异化里有三条要到第二周才有东西可看——没有上一周,就没有增量。所以第一周唯一能验的是「候选清单捞回来的东西配不配得上我手工半小时找到的那五个」。