Back to skills
SKILL.md
Arxiv Daily Report
ASecurity生成 arXiv 学术论文日报或针对具体问题进行学术调研。当用户提到\"arXiv日报\"、\"论文日报\"、\"学术日报\"、\"生成日报\"、\"论文速递\"、\"arxiv daily\"、\"论文摘要\"、\"帮我看看最近有什么论文\"、\"最近有什么论文\"、\"arxiv上有没有研究xxx的论文\"、\"xxx领域最近进展\"、\"我想知道xxx\"等涉及学术/论文检索的问题时自动触发。平台固定为 arXiv,支持用户自定义日期范围
- 2 stars
- 0 votes
- 0 copies
- 0 views
- Added October 6, 2026
Works with
Security analysis
100/100npx -y skills add Kairos-ai-agent/kairos-code --skill arxiv-daily-report --agent claude-codeAre you the author of Arxiv Daily Report?
Add the live security badge to your README. It updates with every re-scan.
[](https://www.skillsdirectory.com/skills/kairos-ai-agent-arxiv-daily-report)---
name: "arxiv-daily-report"
description: "生成 arXiv 学术论文日报或针对具体问题进行学术调研。当用户提到\"arXiv日报\"、\"论文日报\"、\"学术日报\"、\"生成日报\"、\"论文速递\"、\"arxiv daily\"、\"论文摘要\"、\"帮我看看最近有什么论文\"、\"最近有什么论文\"、\"arxiv上有没有研究xxx的论文\"、\"xxx领域最近进展\"、\"我想知道xxx\"等涉及学术/论文检索的问题时自动触发。平台固定为 arXiv,支持用户自定义日期范围"
priority: 0.5
imported-from: "hermes"
source-path: "hermes/skills/arxiv-daily-report/SKILL.md"
---
# arXiv 学术日报生成器
## 触发判断
触发后,首先判断用户请求属于以下哪种模式:
### 模式 A:笼统请求(日报模式)
用户没有提出具体问题,只是想看看最近有什么论文。
**触发示例:**
- "帮我生成 arXiv 日报"
- "最近有什么论文"
- "帮我看看最近有什么论文"
- "论文速递"
- "cs.AI 最近的论文"
- "今天有什么新论文"
**特征:** 用户的意图是「浏览最新论文」,没有明确要回答的问题。
### 模式 B:具体问题(调研模式)
用户提出了一个明确的问题或研究方向。进一步细分为:
**B1:检索类问题** — 用户想看某个方向的论文,不要求得到某个具体答案。
- "帮我找到AI+心理的研究"
- "最新AI心理学有哪些有意思的研究"
- "arXiv上有没有关于AGI安全的研究?"
- "强化学习最近有什么突破?"
**B2:答案类问题** — 用户提出了一个需要被回答的具体问题,论文作为证据支撑。
- "现在AI+心理的赛道火不火?"
- "大模型会不会产生自我意识?"
- "Transformer架构是不是到瓶颈了?"
- "AI做心理咨询靠谱吗?"
**判断规则:**
- 用户问「找论文」「看进展」「有哪些研究」→ B1(检索类)
- 用户问的是一个判断题、是非题或需要给出明确观点的问句 → B2(答案类)
- B1 和 B2 的搜索流程相同,区别在于报告的「第一部分:调研概览」的写法不同
---
## 工作流程
### 第一步:判断模式 & 呈现参数确认单(触发后立即呈现)
> ⛔ **STOP POINT — 展示确认单后必须停止,等待用户回复"确认"或"开始"后才能进入第二步。禁止在用户确认前执行任何 API 调用或搜索操作。**
**1. 判断模式:** 根据上述规则,判断当前请求是「模式 A(笼统请求)」还是「模式 B(具体问题)」,如果是 B 则进一步判断是 B1 还是 B2。
**2. 提取问题关键词(仅模式 B):**
从用户输入中提取核心问题/研究主题,用于后续 arXiv 搜索。
**3. 呈现参数确认表:**
```
📋 arXiv 日报参数确认
📢 请求模式:{模式 A:笼统请求 / 模式 B1:检索类 / 模式 B2:答案类}
❓ 调研问题:{仅模式 B 显示,提取的核心问题}
1. 📅 日期范围:<默认值>
2. 📂 学科分类:<默认值>
3. 🔢 精选论文数量:<默认值>
4. 📖 精读推荐数量:<默认值>
5. 🎯 关注重点:<默认值>
6. 📁 输出位置:<默认值>
如需修改,直接告诉我;没问题的话回复"确认"或"开始"。
```
> ⛔ **再次强调:必须等到用户确认后才能开始搜索。不要在同一条回复中既展示确认单又执行搜索。**
**参数说明:**
| 参数 | 默认值 | 说明 |
|------|--------|------|
| 日期范围 | 最近 2 天(模式 B 建议:最近 1-2 周) | 支持:具体日期如 2026-04-07 ~ 2026-04-08、最近3天、最近一周 |
| 学科分类 | cs.HC(模式 B 根据问题自动推断) | 支持英文 arXiv 分类(如 cs.AI、cs.LG)或中文主题(如"人工智能"、"机器学习"),使用下方的分类映射表自动匹配 |
| 精选论文数量 | 10 | 从检索到的论文中精选 N 篇 |
| 精读推荐数量 | 3 | 从精选中再推荐 N 篇精读 |
| 关注重点 | 全部(创新点、方法论、结论、应用价值) | 可指定某个维度,如"重点关注方法论" |
| 输出位置 | 桌面 arXiv_日报/ | 支持任意路径,自动创建目录 |
**模式 B 特殊处理:**
- 日期范围默认建议延长到 1-2 周,因为具体问题的相关论文可能需要更长时间窗口
- 学科分类根据问题自动推断,可能涉及多个分类
- 搜索时使用问题关键词而非仅按分类过滤
**论文数量规则:**
- 如果去重后相关论文 ≤ 精选数量,直接全部呈现,不做精选筛选,报告中标题改为「全部相关研究(N 篇)」
- 如果去重后相关论文 > 精选数量,精选 N 篇,在「第二部分」标题中标注「精选 Top N」
- 入选理由仅在精选时标注;全部呈现时不标注入选理由(因为本身就是全部)
### 第二步:搜索论文(确认后执行)
使用 arXiv API 搜索论文(免费、准确、结构化)。
#### API 调用方式
**模式 A(笼统请求)— 按分类搜索:**
```
http://export.arxiv.org/api/query?search_query=cat:{分类}+AND+submittedDate:[{起始YYYYMMDD}0000+TO+{结束YYYYMMDD}2359]&start=0&max_results=50&sortBy=submittedDate&sortOrder=descending
```
完整示例:
```
http://export.arxiv.org/api/query?search_query=cat:cs.HC+AND+submittedDate:[202604070000+TO+202604082359]&start=0&max_results=50&sortBy=submittedDate&sortOrder=descending
```
**模式 B(具体问题)— 按关键词搜索:**
```
http://export.arxiv.org/api/query?search_query=all:{关键词}+AND+submittedDate:[{起始YYYYMMDD}0000+TO+{结束YYYYMMDD}2359]&start=0&max_results=50&sortBy=submittedDate&sortOrder=descending
```
示例(问题:AI 是否有意识):
```
http://export.arxiv.org/api/query?search_query=all:"consciousness"+AND+all:"artificial+intelligence"+AND+submittedDate:[202603010000+TO+202604082359]&start=0&max_results=50&sortBy=submittedDate&sortOrder=descending
```
多分类搜索(模式 A):`cat:cs.HC+OR+cat:cs.AI`
多关键词搜索(模式 B):`all:"large language model"+AND+all:"consciousness"+OR+all:"self-awareness"`
API 返回的 Atom XML 格式关键字段:title、summary、published(ISO 8601)、author name、category term、id
#### 搜索策略
1. 先用 API 拉取指定分类/关键词 + 日期范围内的论文(max_results=50)
2. 解析返回的 XML/Atom 格式,提取论文信息
3. 如果结果不足,尝试扩大 max_results 或放宽日期范围
4. 如果 API 无响应或格式异常,回退使用 autoglm-websearch 搜索 site:arxiv.org {分类/关键词} {日期}
5. **模式 B 额外策略:** 如果第一次搜索结果不够相关,尝试用不同的关键词组合(英文同义词、更宽泛/更精确的关键词)再次搜索
6. **绝对不能编造或捏造任何论文信息。** 所有标题、作者、摘要、链接必须来自真实搜索结果。如果搜索结果不足,如实告知用户。
7. **记录检索总量:** 每次搜索必须记录并累计检索到的相关论文总数(跨所有关键词组合)。在报告第一部分中必须呈现:去重后的相关论文总数、精选数量、精选比例。
### 第三步:生成报告
按以下结构生成报告并保存为 .md 文件。
#### 🎨 语言风格要求(全局生效)
**核心原则:** 写给非科研人员也能看懂的内容,但保持专业准确性。
**中文摘要:**
- 紧贴原始英文摘要,忠实翻译和转述,不随意增删或发挥
- 用通顺流畅的中文表达,避免机翻感和生硬的学术八股(如"本文提出了一种基于XXX的框架")
- 2-3 句话说清楚:这篇论文要解决什么问题?用了什么方法?得出了什么结论?
- 让读者 10 秒看懂这篇论文大概做了什么,值不值得读原文
**深度点评:**
- 保持专业和严谨,用正常的中文表达,不要过分口语化或过度修饰
- 重在准确解释:研究背景、目标方法、核心发现、意义与局限
- 说明「这为什么重要」——对领域或读者的实际价值
- 可以适当使用类比帮助理解复杂概念,但类比要准确、克制
**共同要求:**
- 通俗易懂不等于简单粗暴,复杂概念用分层解释,不扭曲原意
- 禁止编造信息,所有内容必须基于搜索到的真实论文
---
#### 📄 模式 A 报告结构(笼统请求)
```
# arXiv 学术日报 — {分类中文名}
📅 日期范围:{起始日期} ~ {结束日期}
📂 学科分类:{arXiv 分类}
⏰ 生成时间:{当前时间}
---
## 📈 检索概况
| 指标 | 数值 |
|------|------|
| API 返回论文总数(去重前) | {X} 篇 |
| 去重后相关论文总数 | {Y} 篇 |
| 精选论文数量 | {Z} 篇 |
| 精选比例 | {Z/Y} = {P}% |
> 📊 **领域热度参考**:精选比例越低(如 <10%),说明该方向论文数量越多、竞争越激烈、领域越热门。
---
## 📊 第一部分:今日概览
### 🎯 核心趋势
根据论文内容总结 2-4 个研究趋势和热点方向。
### 🔤 高频关键词
列出 5-10 个最常出现的关键词,英文术语后附中文翻译。
---
## 📑 第二部分:精选 Top {N} 研究
### 1. {英文标题}
- **🏷️ 中文标题:**{翻译}
- **👤 作者:**{作者列表}
- **📅 发布日期:**{日期}
- **📂 分类:**{分类标签}
- **🔗 链接:**{arXiv 链接}
**📝 中文摘要:**{2-3句通俗易懂的概括}
**🔎 深度点评:**
- **📊 研究总结:**{准确解释:背景、问题、方法、发现、意义}
- **✅ 入选理由:**{一句话说明为什么选这篇}
- **亮点与不足:**
- 💡 亮点:{创新点}
- ⚠️ 不足:{局限性}
---
## ⭐ 第三部分:精读推荐
### 🌟 推荐一:{论文标题}
- **📌 推荐理由:**{为什么值得精读}
(重复直到推荐数量)
```
#### 📄 模式 B 报告结构(具体问题)
```
# arXiv 调研报告 — {用户的提问}
📅 日期范围:{起始日期} ~ {结束日期}
📂 学科分类:{arXiv 分类}
🔍 检索关键词:{实际使用的关键词}
⏰ 生成时间:{当前时间}
---
## 📊 第一部分:调研概览
### 🎯 概括
用一段话完成检索概括和总结,格式为:
「在 {日期范围} 内,共检索到 {去重后相关论文总数} 篇相关论文。{总结内容}」
- 如果是 B1(检索类问题):总结内容根据检索到的论文总结主要发现和趋势
- 如果是 B2(答案类问题):总结内容直接回答用户的问题,用论文作为证据支撑
- 2-4 句话即可,不要展开太多
### 🔤 高频关键词
列出 5-10 个在搜索结果中最常出现的关键词,英文术语后附中文翻译。
---
## 📑 第二部分:全部相关研究({N} 篇) ← 相关论文 ≤ 精选数量时
## 📑 第二部分:精选 Top {N} 研究 ← 相关论文 > 精选数量时
### 1. {英文标题}
- **🏷️ 中文标题:**{翻译}
- **👤 作者:**{作者列表}
- **📅 发布日期:**{日期}
- **📂 分类:**{分类标签}
- **🔗 链接:**{arXiv 链接}
- **✅ 入选理由:**{一句话,仅精选时标注}
**📝 中文摘要:**{2-3句通俗易懂的概括}
**🔎 深度点评:**
- **📊 研究总结:**{准确解释:背景、问题、方法、发现、意义}
- **亮点与不足:**
- 💡 亮点:{创新点}
- ⚠️ 不足:{局限性}
(重复直到所有相关论文展示完毕,序号递增)
---
## ⭐ 第三部分:精读推荐
### 🌟 推荐一:{论文标题}
- **📌 推荐理由:**{为什么这篇最值得精读}
(重复直到推荐数量)
```
### 第四步:保存文件
1. 确保输出目录存在(不存在则创建)
2. 文件名格式:
- 模式 A:`arXiv日报_{分类}_{日期}.md`
- 模式 B:`arXiv调研_{问题关键词}_{日期}.md`
3. 保存后告知用户文件路径
### 第五步:对话框内摘要推送
**模式 A 摘要格式:**
```
✅ 报告已生成!
📁 {文件路径}
📊 从 {Y} 篇中精选 {Z} 篇({P}%)
📊 今日趋势:
- 📌 {趋势一}
- 📌 {趋势二}
⭐ 精读推荐:
- 🌟 {论文} — {理由}
- 🌟 {论文} — {理由}
- 🌟 {论文} — {理由}
```
**模式 B 摘要格式:**
```
✅ 调研报告已生成!
📁 {文件路径}
💡 {1-2句话回答用户问题}
📊 共检索到 {Y} 篇相关论文
🎯 关键发现:
- 🧪 {发现一}
- 📏 {发现二}
- 🎭 {发现三}
⭐ 精读推荐:
- 🌟 {论文} — {理由}
- 🌟 {论文} — {理由}
- 🌟 {论文} — {理由}
```
**对话框回复可视化要求:**
- 使用 emoji 图标区分不同信息块
- 关键信息加粗
- 每个要点控制在 1-2 句话
- 整体控制在用户无需滚动即可看完的长度
- 避免 markdown 表格
- 语气简洁、信息密度高
---
## 学科分类映射表
### 计算机科学(cs.*)
| arXiv 分类 | 中文 | 英文关键词 | 中文关键词 |
|-----------|------|-----------|-----------|
| cs.HC | 人机交互 | HCI, Human-Computer Interaction, interaction, UX, usability | 人机交互, 交互设计, 用户体验, 可用性 |
| cs.AI | 人工智能 | Artificial Intelligence, AI, reasoning, planning | 人工智能, 推理, 规划, 智能体 |
| cs.LG | 机器学习 | Machine Learning, ML, deep learning, neural network | 机器学习, 深度学习, 神经网络, 模型训练 |
| cs.CL | 计算语言学 | NLP, natural language, language model, LLM, text | 自然语言处理, 语言模型, 大模型, NLP, 文本, 对话系统 |
| cs.CV | 计算机视觉 | Computer Vision, image, video, visual, detection, recognition | 计算机视觉, 图像, 视频, 目标检测, 图像识别 |
| cs.IR | 信息检索 | Information Retrieval, search, ranking, recommendation | 信息检索, 搜索, 推荐, 排序 |
| cs.SE | 软件工程 | Software Engineering, code, debugging, testing | 软件工程, 代码, 编程, 测试 |
| cs.NE | 神经与进化计算 | Neural networks, evolutionary, genetic, optimization | 神经网络, 进化计算, 遗传算法, 优化 |
| cs.RO | 机器人学 | Robotics, robot, manipulation, navigation, autonomous | 机器人, 无人车, 自动驾驶, 机械臂 |
| cs.GT | 博弈论 | Game Theory, mechanism design, auction, social choice | 博弈论, 机制设计, 拍卖, 社会选择 |
| cs.SD | 声音 | Audio, speech, sound, music, acoustic | 声音, 语音, 音频, 音乐, 语音合成 |
| cs.MM | 多媒体 | Multimedia, image processing, video processing | 多媒体, 图像处理, 视频处理 |
| cs.CY | 计算机与社会 | AI ethics, fairness, privacy, social computing | AI伦理, 公平性, 隐私, 社会计算 |
| cs.CC | 计算复杂性 | Complexity, computability, algorithms | 计算复杂性, 算法 |
| cs.DS | 数据结构 | Data structures, algorithms, graph theory | 数据结构, 图论, 算法 |
| cs.CR | 密码学 | Cryptography, security, blockchain | 密码学, 安全, 区块链 |
| cs.DB | 数据库 | Database, data management, query, SQL | 数据库, 数据管理, 查询 |
| cs.DC | 分布式计算 | Distributed, parallel, cloud, edge computing | 分布式计算, 并行计算, 云计算, 边缘计算 |
| cs.NI | 网络与互联网 | Network, internet, wireless, protocol | 网络, 无线网络, 互联网, 协议 |
| cs.OS | 操作系统 | Operating systems, systems, kernel | 操作系统, 系统, 内核 |
| cs.PL | 编程语言 | Programming languages, compilers, type systems | 编程语言, 编译器, 类型系统 |
| cs.LO | 计算逻辑 | Logic, verification, formal methods | 逻辑, 形式化验证 |
| cs.IT | 信息论 | Information theory, compression, coding | 信息论, 压缩, 编码 |
| cs.SY | 系统与控制 | Systems, control, embedded, IoT | 系统, 控制, 嵌入式, 物联网 |
| cs.MA | 多智能体 | Multi-agent, autonomous agents, cooperation | 多智能体, 自主代理, 协作 |
### 其他主要分类
| arXiv 分类 | 中文 | 英文关键词 | 中文关键词 |
|-----------|------|-----------|-----------|
| math.CO | 组合数学 | Combinatorics, graph, discrete math | 组合数学, 图论, 离散数学 |
| stat.ML | 统计机器学习 | Statistical learning, Bayesian, inference | 统计学习, 贝叶斯, 推断 |
| eess.AS | 音频与语音处理 | Audio, speech processing, signal | 音频, 语音处理, 信号处理 |
| eess.IV | 图像与视频处理 | Image, video, vision, processing | 图像处理, 视频处理 |
| q-bio.QM | 定量生物学方法 | Quantitative biology, bioinformatics | 定量生物学, 生物信息学 |
### 匹配规则
1. **精确匹配**:用户直接给 arXiv 分类号(如 cs.HC)→ 直接使用
2. **关键词匹配**:从用户输入中提取关键词,在映射表的英文/中文关键词列中搜索
3. **模糊匹配**:如果用户说的是宽泛主题(如"深度学习"),匹配最相关的分类(cs.LG 优先于 cs.NE、cs.CV)
4. **多分类建议**:如果主题可能跨多个分类,向用户建议并确认
5. **未知主题**:如果无法匹配,建议用户直接指定 arXiv 分类或换一种描述方式
Attribution
Comments
Loading comments…