Skip to content
本站运维local/daily-scout生产在跑

daily-scout:五源每日发现 + 四维分诊 + 人工闸门

我们的判断分诊阶段明令绝不下载媒体、绝不精读论文——省 token 是次要收益,主要收益是不让机器替人做「值不值得收」的判断。另一条被改写的定义更值钱:2026-09-04 起「发布 = 采集完 + 社交物料齐」,因为 og:image 404 时社媒抓取器会永久放弃且不重试。阶段 2.6 专挖存量,实测库里有 291 篇已发布精读论文而社交重写稿只有 1 行。

robotworld-daily-cron v3.2.0 是站点的内容发动机:Twitter、GitHub、HuggingFace、官方博客 RSS、arXiv 五源扫描,按 novelty、freshness、relevance、impact 四维加权打分并分 P0/P1/P2,写进 content_queue_items 待确认队列(pending → confirmed → done / rejected,同 URL 幂等去重)。

Codex
Agientry
daily-scout:五源每日发现 + 四维分诊 + 人工闸门
本站运维local/paper-search生产在跑

paper-search:论文三段接力的第一段,刻意做得很轻

我们的判断交付物是「三十秒能决策」的四行:arXiv ID 加标题、agent 自己写的一句话概要、带理由的相关性判断、链接——理由那一栏比标题更重要。真正该抄的是不对称节流:检索可以一次批量列 20 篇,入库逐条确认,精读一次只能做 1 篇,禁止检索后自动批量入库再批量生成详情页。

检索 → 入库 → 逐篇精读,这条 skill 只管第一段,而且刻意不做判断,只把候选摊到桌面上让人判断。三种检索方式:search_papers.py(日常主路径)、直接打 arXiv API、已知 ID 用 defuddle parse。11 个预设话题,两层相关性过滤:arXiv 类别白名单加强排除关键词,agent 再按站点内容定位过一遍。

Codex
Agientry
paper-search:论文三段接力的第一段,刻意做得很轻