ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

三步配置免费 arXiv 论文个性化订阅:让 Zotero-arXiv-Daily 按你的 Zotero 图书馆选文

三步配置免费 arXiv 论文个性化订阅:让 Zotero-arXiv-Daily 按你的 Zotero 图书馆选文 三步配置免费 arXiv 论文个性化订阅让 Zotero-arXiv-Daily 按你的 Zotero 图书馆选文【免费下载链接】zotero-arxiv-dailyRecommend new arxiv papers of your interest daily according to your Zotero libarary.项目地址: https://gitcode.com/GitHub_Trending/zo/zotero-arxiv-daily每天打开 arXiv新论文列表一眼望不到头刷完标题兴趣就没了真正想读的可能只有几篇和你最近阅读方向重叠的。Zotero-arXiv-Daily 就是为解决这件事而生的开源工具它根据你的 Zotero 图书馆内容每天自动从 arXiv、bioRxiv、medRxiv 里筛选新论文再推送一封整理好的邮件到你邮箱。整套流程跑在 GitHub Actions 上零成本不用维护任何服务器。原理Zotero 图书馆是怎么变成相关性评分的这个工具不要求你手写检索式而是直接读取你 Zotero 图书馆里的论文。它每天取回新发布的论文用 embedding 模型计算每篇新论文摘要的向量再按它与图书馆所有论文的加权相似度打分——最近入库的 Zotero 论文权重更高所以推荐结果会自动偏向你近期的阅读方向。打分完成后由 LLM 为每篇论文生成 TLDR摘要和作者机构信息最后通过 SMTP 把排序好的列表发到邮箱。整个流程由 executor.py 串起来你只需要配好自己的密钥。零成本部署三步走Fork 仓库。如果想在本地先跑起来熟悉一下也可以克隆到本地git clone https://gitcode.com/GitHub_Trending/zo/zotero-arxiv-daily配置 GitHub Secrets。在仓库的 Settings → Secrets and variables → Actions 里逐个填入下表中的密钥。两个容易踩的坑ZOTERO_ID不是用户名而是一串数字要到 Zotero 官网的账户安全页面查看SENDER_PASSWORD不是邮箱登录密码而是 SMTP 服务的授权码。设置 CUSTOM_CONFIG 变量。在 Secrets 旁边的 Variables 里新建一个公开的CUSTOM_CONFIG把仓库 README 里的默认 YAML 粘进去再把 arXiv 分类改成你关注的方向即可。比如只想调整分类订阅改动大致长这样source: arxiv: category: [cs.AI,cs.LG] executor: source: [arxiv]推送配置参数速查参数说明示例ZOTERO_IDZotero 用户 ID数字序列不是用户名12345678ZOTERO_KEY有读取权限的 Zotero API 密钥AB5tZ877P2j7…SENDER发件邮箱账号abcqq.comSENDER_PASSWORDSMTP 授权码不是邮箱登录密码abcdefghijklmnRECEIVER接收论文列表的邮箱abcoutlook.comOPENAI_API_KEYLLM API 密钥sk-xxxOPENAI_API_BASELLM API 地址https://api.openai.com/v1CUSTOM_CONFIG公开变量承载完整 YAML 配置见上一步示例CUSTOM_CONFIG内部还有一组可按需调整的子选项zotero.include_path用 glob 模式只纳入指定的 Zotero 集合source.arxiv.include_cross_list控制是否包含交叉列表论文llm.language指定 TLDR 的语言executor.max_paper_num限制每封邮件的论文数量。推送邮件里有什么邮件由 construct_email.py 生成每篇论文带 AI 生成的 TLDR、作者机构、PDF 与代码仓库的直接链接整个列表按和你 Zotero 图书馆的相关度从高到低排列方便快速跳过不相关的。手动触发测试的正确姿势配置完成后不必等到第二天先打开 Actions 页面手动触发 Test-Workflow 跑一次。两个工作流的差异值得注意Test-Workflow 是调试版无论日期如何都固定取 5 篇 arXiv 论文所以周末也能完整验证密钥和邮件链路主工作流则每天 22:00 UTC 自动运行只取前一天发布的新论文。arXiv 周末和节假日没有新论文那几天的日志里出现 No new papers found 属于正常状态。进阶能力多来源、过滤与重排器选择多来源订阅executor.source里可以组合开启 arxiv、biorxiv、medrxiv各自有独立的分类配置抓取逻辑按来源拆分在 retriever/。重排器选择executor.reranker设local时在 runner 里用 sentence-transformers 本地模型算 embedding免费且是默认选择设api则调用外部 embedding 服务精度和批量大小更可控。两种实现都在 reranker/。本地调试装了 uv 的话设置好同样的环境变量后本地执行uv run main.py就能脱离 Actions 跑一遍。局限与注意事项推荐算法本身比较简单本质是embedding 相似度 时间加权未必能完整刻画你的兴趣。结果跑偏时优先去调 arXiv 分类和include_path。max_paper_num设得过大单次运行会明显变慢可能撞上 runner 的时长上限公开仓库单次 6 小时、私有仓库每月 2000 分钟。个人日常使用一般够用有 heavier 需求可以换自托管 runner 或自己的服务器。项目迭代较快建议 Watch 仓库订阅 release 通知上游有更新后及时合并到你的 fork 里这样新特性和 bug 修复才能跟上来。项目采用 AGPLv3 许可证发布。开始动手Fork 仓库、填好密钥和变量、触发一次测试整个流程就走完了上游发布新版本时合并一次即可之后每天打开邮箱就能看到你读过什么和该读什么之间的交集。【免费下载链接】zotero-arxiv-dailyRecommend new arxiv papers of your interest daily according to your Zotero libarary.项目地址: https://gitcode.com/GitHub_Trending/zo/zotero-arxiv-daily创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表