ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

3步接入Zotero库的arXiv与bioRxiv每日论文推荐

3步接入Zotero库的arXiv与bioRxiv每日论文推荐 3步接入Zotero库的arXiv与bioRxiv每日论文推荐【免费下载链接】zotero-arxiv-dailyRecommend new arxiv papers of your interest daily according to your Zotero libarary.项目地址: https://gitcode.com/GitHub_Trending/zo/zotero-arxiv-dailyZotero-arXiv-Daily 基于你 Zotero 库里已有的论文每天自动从 arXiv、bioRxiv、medRxiv 三个源检索新论文并打分推荐最后用邮件推送到收件箱。本文以多源检索为主线用 3 步给出完整配置路径让跨领域的最新研究每天准时进邮箱。 谁适合用、什么场景下用跨学科阅读研究方向同时覆盖计算机和生命科学过去要分别打开 arXiv 和 bioRxiv 两个网站刷更新现在一封邮件收齐。早晨通勤邮件按相关性排好序标题加一段 TL;DR 摘要手机上看十分钟就能筛出值得精读的两三篇。组会前准备TL;DR 和作者单位都写在邮件里直接判断哪篇该分给组里同学不用再逐篇点开原文。最快上手路径第 1 步Fork 仓库。在你的 GitHub 账号下找到本项目点击 Fork。整个推荐流程运行在仓库自带的 Actions 工作流里Fork 之后不需要安装任何环境。第 2 步填好凭据变量。在 Fork 后仓库的 Actions 设置页填入 7 个环境变量ZOTERO_IDZotero 账号页的数字 ID、ZOTERO_KEYZotero 只读 API key、SENDER/SENDER_PASSWORD/RECEIVER发件邮箱、SMTP 授权码、收件邮箱以及OPENAI_API_KEY/OPENAI_API_BASE生成 TL;DR 用的 LLM 接口。再新建一个公开变量CUSTOM_CONFIG把仓库config/custom.yaml里的内容原样粘进去把里面的???换成对应值即可。第 3 步开启多源并触发测试。默认只抓 arXiv在CUSTOM_CONFIG里把 bioRxiv 加进来改动只有下面几行source: biorxiv: category: [biochemistry] executor: source: [arxiv, biorxiv]保存后手动触发一次测试工作流跑完检查日志和收件箱看到带排序的论文列表邮件就算配置成功。功能逐项拆解多源检索一份配置拉取三个网站能做什么从 arXiv、bioRxiv、medRxiv 三个源抓取前一天的新论文统一进入同一个推荐列表。怎么调在executor.source里列出要启用的源如[arxiv, biorxiv]并在source下给每个源填category限定学科。调完有什么变化邮件里会出现来自多个网站的新论文且三者按与你的 Zotero 库的相关性混排而不是各占一块。Zotero 库个性化排序读得越近排得越靠前能做什么把每篇新论文的摘要和你 Zotero 库里所有论文做相似度打分库内较新加入的论文权重更高所以最近在读的课题会主导排序。怎么调想只参考部分文件夹就给zotero.include_path填 glob 模式例如[2026/survey/**]想排除某些文件夹用zotero.ignore_path。调完有什么变化排序依据立刻收窄到你指定的研究线论文列表不再被库里旧方向的文献带偏。TL;DR 与作者单位一封邮件读清主旨能做什么每篇推荐论文附一段 LLM 生成的 TL;DR 摘要并解析出作者所属机构邮件里还带 PDF 链接和代码仓库链接如有。怎么调在llm.generation_kwargs里改model换模型改language控制 TL;DR 语言比如从English改成Chinese。调完有什么变化摘要直接以中文呈现非英文读者筛论文更快。进阶与自定义完整配置项及逐项注释见 config/base.yaml???标记的是必填项。三个源的抓取逻辑分别在 src/zotero_arxiv_daily/retriever/ 下各有一个以源名命名的文件想确认某源的字段含义可以对照阅读。排序模型支持两种local在 Actions 环境内跑本地 embedding 模型默认api走 OpenAI 兼容的 embedding 接口在reranker.api下填key、base_url、model后把executor.reranker改为api即可切换实现见 src/zotero_arxiv_daily/reranker/。不想走 Actions也可以本机运行装好 uv 并设置同样的环境变量后执行入口脚本即可流程见 CLAUDE.md。⚠️ 使用注意与常见坑bioRxiv、medRxiv 的category必须用网站上的英文栏目名如biochemistry写成中文或 arXiv 式缩写会匹配不到论文大小写不敏感名字必须对得上。周末和节假日 arXiv 不发新论文主工作流日志出现 No new papers found 属正常现象不是配置错误。SENDER_PASSWORD填的是邮件服务商的 SMTP 服务授权码不是登录邮箱的密码发信失败先检查这里。max_paper_num调得越大单次运行时间越长公开仓库单次执行上限 6 小时个人使用默认值 100 足够不建议盲目调大。结尾配置保存后主工作流每天 22:00 UTC 自动运行无需人工维护想改推送时间编辑.github/workflows/下的工作流文件里的触发时刻即可。后续如果想加自己的数据源或排序逻辑从 src/zotero_arxiv_daily/ 的插件注册机制入手即可。【免费下载链接】zotero-arxiv-dailyRecommend new arxiv papers of your interest daily according to your Zotero libarary.项目地址: https://gitcode.com/GitHub_Trending/zo/zotero-arxiv-daily创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表