← 返回产品

NO.002 · W02 · 2026.08.25

长视频总结

一小时的视频、播客或长文,AI 先替你看完——值不值得看、讲了什么、每一段在原片的哪几分钟,随时跳回去

打开产品 ↗源代码 ↗在线#agent#视频#播客#摘要

为什么做它

001 每日简报回答「这条链接值不值得点」。但点进去发现是一小时的播客时,真正的成本才刚开始——001 覆盖不到这个黑箱。002 接着回答下一个问题:哪几分钟值得看

动手前扫了一圈同类开源项目(BibiGPT、AI-Video-Transcriber 等十几个),发现两个集体盲区:一是没有一家做「值不值得看」的分流判断,全部默认你已经决定要看;二是防幻觉上集体交白卷,全靠裸 prompt 直出——「AI 替你看完的」凭什么让人敢信,没人回答。这两个空位就是 002 的立足点。立场和 001 一脉相承:摘要是回原片的路由器,不是替代品——总结和分段地图是一体两面,只基于内容稿件(字幕/转写/正文),不猜画面。

它做了什么

丢给它一条链接(B站 / YouTube / 播客 / 文章,或直接粘贴正文),它给三样东西:一句话判决(值得看 / 部分值得 / 可以跳过,附判断依据);总体要点——每条必须附一段从原文逐字摘录的引文,系统用字符串匹配逐条验证,配不上的直接标「未能在原文中定位」,不假装可信;分段地图——整条内容按自然转折切段、首尾相接覆盖全程,每段一句话大意,广告寒暄车轱辘话灰显并统计「低价值段共几分钟」,B站/YouTube 的段落带秒数直达原片,文章的段落点一下滚到原文位置。

文章几秒到两分钟流式出结果;视频和播客走异步管线,页面显示五步进度。同一条内容全站只算一次——第二个人(或者同一视频的另一种链接形态)秒出结果。

学到了什么

还在建设期,验收标准先立好:10 条真实文章 ≥8 条出正文、引文锚定抽查全对、一条 B站长视频和一条播客端到端跑通。已经交学费学到的几课:①抽取器会「静默失败返回半空正文」是常态而非异常,Defuddle 的 markdown 选项在 Workers 环境下会静默失效,吐回没有换行的 HTML——不能信任任何抽取器的输出形态,得自己从块级元素重建干净段落;②引文锚定意外成了免费的质检器:正文一脏,锚定命中率立刻从 11/11 掉到 0——它拦的不只是模型幻觉,还有管线自己的 bug;③长文编辑调用实测最长 123 秒,而 Cloudflare 代理 100 秒无字节就掐线——流式不是体验优化,是生死线;④YouTube 封锁数据中心 IP 是 IP 信誉问题不是协议问题,先换干净出口再谈调参,顺序反了全是无用功。