写了个平时看论文可能会用上的工具

写了一款可以帮助经常阅读论文的同学提升效率的小工具,有两个部分:

  • HuggingFace Weekly Paper 制作工具
  • Arxiv Helper

前置条件

翻译基于 deepseek 的服务, 论文十问依赖于 kimi, 因此需要这两个的 api key。可以配置到环境变量中,代码中使用的环境变量 key 分别是

  • DEEPSEEK_KEY
  • KIMI_KEY

如果不想同时用两家,翻译可以考虑也换成 kimi,需要手动修改代码,将 deepseek 里面的设置换成 kimi的。

1. HuggingFace Weekly Paper 制作工具

我每周博客和公众号上都会发一篇 weekly paper,文章来源于 HuggingFace 的 Daily Paper。 为了减少每次都要一个个点进去通过N次复制粘贴来得到翻译后的结果的痛苦,写了个脚本,可以直接读取本周的点赞超过n次的论文,并生成Weekly Paper。

代码就是hf.py文件,运行 weekly_paper 方法即可,慢慢等待即可,如果出现了一些翻译上的问题或者接口异常,可以重新从目录下的output.md文件里面拿到英文原版继续人工处理。

此脚本依赖的模型是 deepseek.

2. Arxiv Helper

这个使用 streamlit 做了前端,输入框里面输入 arxiv 论文的首页地址,回车即可得到它的标题和摘要,左侧可以进行翻译,右侧是论文十问的模板,使用 kimi 的接口进行问答。

对pdf的读写是依赖于kimi的基于文件的问答,因此会上传文件到kimi,文件上传列表可以在设置页面看到(初版暂时没做文件上传去重处理),不需要的可以删除。文件本身也会下载到data目录,每篇论文对应一个文件夹,里面存放pdf以及数据json,避免每次都要重新调用接口。

使用方式:

shell 复制代码
streamlit run arxiv.py

后续计划

  1. arxiv helper 支持跳转到 kimi 聊天,并带上已经进行过的论文十问;
  2. 论文上传去重
  3. 本地论文管理(待定)

GitHub地址, 有用请点个 star,非常感谢!

相关推荐
知几蜗牛4 小时前
GPT-6 Astra来了:AI真的开始像“数字员工”一样工作了吗?
人工智能
夏文强4 小时前
DeepSeek Harness 可观测性:用 OpenTelemetry 把会话遥测出去
人工智能·开源·大模型·agent·deepseek
艾莉丝努力练剑4 小时前
【AI大模型接入SDK】Gemini模型接入知识体系
java·开发语言·网络·人工智能·网络协议·学习·http
AC赳赳老秦4 小时前
电力能源公开数据采集实操:用 OpenClaw 合规抓取电网电价与发电量数据,生成区域能源供需分析报告
大数据·数据库·人工智能·python·php·deepseek·openclaw
一切皆是因缘际会4 小时前
资源的适配
大数据·人工智能·算法
计算机编程-吉哥4 小时前
小麦叶病害识别系统:基于MobileNet的智能农业病害检测实战【计算机毕业设计选题推荐、深度学习】
人工智能·深度学习·毕业设计·课程设计·计算机毕业设计选题·机器学习毕业设计·大数据毕业设计选题推荐
新知图书4 小时前
第11章 智能体应用设计模式
人工智能·智能体
LlmCraft|大模型工程实践4 小时前
09 大语言模型(LLM)演进与 Prompt 入门
人工智能·语言模型·prompt
刘广睿4 小时前
AI 配音怎么做?语音合成 TTS 技术选型与本地部署实战(edge-tts / GPT-SoVITS / CosyVoice / Piper)
人工智能·音视频·效率工具·语音合成·tts
一见已难忘4 小时前
鸿蒙 AI 竞技场:用蓝耘 MaaS 一个 Key 让五个大模型同台 PK,Token 消耗实测差 5 倍
人工智能