Skip to content
Back to skills

Arxiv Daily Report

ASecurity

生成 arXiv 学术论文日报或针对具体问题进行学术调研。当用户提到\"arXiv日报\"、\"论文日报\"、\"学术日报\"、\"生成日报\"、\"论文速递\"、\"arxiv daily\"、\"论文摘要\"、\"帮我看看最近有什么论文\"、\"最近有什么论文\"、\"arxiv上有没有研究xxx的论文\"、\"xxx领域最近进展\"、\"我想知道xxx\"等涉及学术/论文检索的问题时自动触发。平台固定为 arXiv,支持用户自定义日期范围

  • 2 stars
  • 0 votes
  • 0 copies
  • 0 views
  • Added October 6, 2026
ai-agentsgosqltestingdebuggingapidatabasesecurity

Works with

  • api

Security analysis

A100/100

Scanned October 6, 2026

npx -y skills add Kairos-ai-agent/kairos-code --skill arxiv-daily-report --agent claude-code

Installs into .claude/skills of the current project.

Are you the author of Arxiv Daily Report?

Add the live security badge to your README. It updates with every re-scan.

Security grade badge for Arxiv Daily Report
[![Security: A — Skills Directory](https://www.skillsdirectory.com/api/skills/kairos-ai-agent-arxiv-daily-report/badge)](https://www.skillsdirectory.com/skills/kairos-ai-agent-arxiv-daily-report)

More formats (shields.io, HTML) on the badges page. Keep it an A: scan every change in CI with Pro.

Download with Pro
SKILL.md
---
name: "arxiv-daily-report"
description: "生成 arXiv 学术论文日报或针对具体问题进行学术调研。当用户提到\"arXiv日报\"、\"论文日报\"、\"学术日报\"、\"生成日报\"、\"论文速递\"、\"arxiv daily\"、\"论文摘要\"、\"帮我看看最近有什么论文\"、\"最近有什么论文\"、\"arxiv上有没有研究xxx的论文\"、\"xxx领域最近进展\"、\"我想知道xxx\"等涉及学术/论文检索的问题时自动触发。平台固定为 arXiv,支持用户自定义日期范围"
priority: 0.5
imported-from: "hermes"
source-path: "hermes/skills/arxiv-daily-report/SKILL.md"
---
# arXiv 学术日报生成器

## 触发判断

触发后,首先判断用户请求属于以下哪种模式:

### 模式 A:笼统请求(日报模式)
用户没有提出具体问题,只是想看看最近有什么论文。

**触发示例:**
- "帮我生成 arXiv 日报"
- "最近有什么论文"
- "帮我看看最近有什么论文"
- "论文速递"
- "cs.AI 最近的论文"
- "今天有什么新论文"

**特征:** 用户的意图是「浏览最新论文」,没有明确要回答的问题。

### 模式 B:具体问题(调研模式)
用户提出了一个明确的问题或研究方向。进一步细分为:

**B1:检索类问题** — 用户想看某个方向的论文,不要求得到某个具体答案。
- "帮我找到AI+心理的研究"
- "最新AI心理学有哪些有意思的研究"
- "arXiv上有没有关于AGI安全的研究?"
- "强化学习最近有什么突破?"

**B2:答案类问题** — 用户提出了一个需要被回答的具体问题,论文作为证据支撑。
- "现在AI+心理的赛道火不火?"
- "大模型会不会产生自我意识?"
- "Transformer架构是不是到瓶颈了?"
- "AI做心理咨询靠谱吗?"

**判断规则:**
- 用户问「找论文」「看进展」「有哪些研究」→ B1(检索类)
- 用户问的是一个判断题、是非题或需要给出明确观点的问句 → B2(答案类)
- B1 和 B2 的搜索流程相同,区别在于报告的「第一部分:调研概览」的写法不同

---

## 工作流程

### 第一步:判断模式 & 呈现参数确认单(触发后立即呈现)

> ⛔ **STOP POINT — 展示确认单后必须停止,等待用户回复"确认"或"开始"后才能进入第二步。禁止在用户确认前执行任何 API 调用或搜索操作。**

**1. 判断模式:** 根据上述规则,判断当前请求是「模式 A(笼统请求)」还是「模式 B(具体问题)」,如果是 B 则进一步判断是 B1 还是 B2。

**2. 提取问题关键词(仅模式 B):**
从用户输入中提取核心问题/研究主题,用于后续 arXiv 搜索。

**3. 呈现参数确认表:**

```
📋 arXiv 日报参数确认

📢 请求模式:{模式 A:笼统请求 / 模式 B1:检索类 / 模式 B2:答案类}
❓ 调研问题:{仅模式 B 显示,提取的核心问题}

1. 📅 日期范围:<默认值>
2. 📂 学科分类:<默认值>
3. 🔢 精选论文数量:<默认值>
4. 📖 精读推荐数量:<默认值>
5. 🎯 关注重点:<默认值>
6. 📁 输出位置:<默认值>

如需修改,直接告诉我;没问题的话回复"确认"或"开始"。
```

> ⛔ **再次强调:必须等到用户确认后才能开始搜索。不要在同一条回复中既展示确认单又执行搜索。**

**参数说明:**

| 参数 | 默认值 | 说明 |
|------|--------|------|
| 日期范围 | 最近 2 天(模式 B 建议:最近 1-2 周) | 支持:具体日期如 2026-04-07 ~ 2026-04-08、最近3天、最近一周 |
| 学科分类 | cs.HC(模式 B 根据问题自动推断) | 支持英文 arXiv 分类(如 cs.AI、cs.LG)或中文主题(如"人工智能"、"机器学习"),使用下方的分类映射表自动匹配 |
| 精选论文数量 | 10 | 从检索到的论文中精选 N 篇 |
| 精读推荐数量 | 3 | 从精选中再推荐 N 篇精读 |
| 关注重点 | 全部(创新点、方法论、结论、应用价值) | 可指定某个维度,如"重点关注方法论" |
| 输出位置 | 桌面 arXiv_日报/ | 支持任意路径,自动创建目录 |

**模式 B 特殊处理:**
- 日期范围默认建议延长到 1-2 周,因为具体问题的相关论文可能需要更长时间窗口
- 学科分类根据问题自动推断,可能涉及多个分类
- 搜索时使用问题关键词而非仅按分类过滤

**论文数量规则:**
- 如果去重后相关论文 ≤ 精选数量,直接全部呈现,不做精选筛选,报告中标题改为「全部相关研究(N 篇)」
- 如果去重后相关论文 > 精选数量,精选 N 篇,在「第二部分」标题中标注「精选 Top N」
- 入选理由仅在精选时标注;全部呈现时不标注入选理由(因为本身就是全部)

### 第二步:搜索论文(确认后执行)

使用 arXiv API 搜索论文(免费、准确、结构化)。

#### API 调用方式

**模式 A(笼统请求)— 按分类搜索:**

```
http://export.arxiv.org/api/query?search_query=cat:{分类}+AND+submittedDate:[{起始YYYYMMDD}0000+TO+{结束YYYYMMDD}2359]&start=0&max_results=50&sortBy=submittedDate&sortOrder=descending
```

完整示例:
```
http://export.arxiv.org/api/query?search_query=cat:cs.HC+AND+submittedDate:[202604070000+TO+202604082359]&start=0&max_results=50&sortBy=submittedDate&sortOrder=descending
```

**模式 B(具体问题)— 按关键词搜索:**

```
http://export.arxiv.org/api/query?search_query=all:{关键词}+AND+submittedDate:[{起始YYYYMMDD}0000+TO+{结束YYYYMMDD}2359]&start=0&max_results=50&sortBy=submittedDate&sortOrder=descending
```

示例(问题:AI 是否有意识):
```
http://export.arxiv.org/api/query?search_query=all:"consciousness"+AND+all:"artificial+intelligence"+AND+submittedDate:[202603010000+TO+202604082359]&start=0&max_results=50&sortBy=submittedDate&sortOrder=descending
```

多分类搜索(模式 A):`cat:cs.HC+OR+cat:cs.AI`
多关键词搜索(模式 B):`all:"large language model"+AND+all:"consciousness"+OR+all:"self-awareness"`

API 返回的 Atom XML 格式关键字段:title、summary、published(ISO 8601)、author name、category term、id

#### 搜索策略

1. 先用 API 拉取指定分类/关键词 + 日期范围内的论文(max_results=50)
2. 解析返回的 XML/Atom 格式,提取论文信息
3. 如果结果不足,尝试扩大 max_results 或放宽日期范围
4. 如果 API 无响应或格式异常,回退使用 autoglm-websearch 搜索 site:arxiv.org {分类/关键词} {日期}
5. **模式 B 额外策略:** 如果第一次搜索结果不够相关,尝试用不同的关键词组合(英文同义词、更宽泛/更精确的关键词)再次搜索
6. **绝对不能编造或捏造任何论文信息。** 所有标题、作者、摘要、链接必须来自真实搜索结果。如果搜索结果不足,如实告知用户。
7. **记录检索总量:** 每次搜索必须记录并累计检索到的相关论文总数(跨所有关键词组合)。在报告第一部分中必须呈现:去重后的相关论文总数、精选数量、精选比例。

### 第三步:生成报告

按以下结构生成报告并保存为 .md 文件。

#### 🎨 语言风格要求(全局生效)

**核心原则:** 写给非科研人员也能看懂的内容,但保持专业准确性。

**中文摘要:**
- 紧贴原始英文摘要,忠实翻译和转述,不随意增删或发挥
- 用通顺流畅的中文表达,避免机翻感和生硬的学术八股(如"本文提出了一种基于XXX的框架")
- 2-3 句话说清楚:这篇论文要解决什么问题?用了什么方法?得出了什么结论?
- 让读者 10 秒看懂这篇论文大概做了什么,值不值得读原文

**深度点评:**
- 保持专业和严谨,用正常的中文表达,不要过分口语化或过度修饰
- 重在准确解释:研究背景、目标方法、核心发现、意义与局限
- 说明「这为什么重要」——对领域或读者的实际价值
- 可以适当使用类比帮助理解复杂概念,但类比要准确、克制

**共同要求:**
- 通俗易懂不等于简单粗暴,复杂概念用分层解释,不扭曲原意
- 禁止编造信息,所有内容必须基于搜索到的真实论文

---

#### 📄 模式 A 报告结构(笼统请求)

```
# arXiv 学术日报 — {分类中文名}

📅 日期范围:{起始日期} ~ {结束日期}
📂 学科分类:{arXiv 分类}
⏰ 生成时间:{当前时间}

---

## 📈 检索概况

| 指标 | 数值 |
|------|------|
| API 返回论文总数(去重前) | {X} 篇 |
| 去重后相关论文总数 | {Y} 篇 |
| 精选论文数量 | {Z} 篇 |
| 精选比例 | {Z/Y} = {P}% |

> 📊 **领域热度参考**:精选比例越低(如 <10%),说明该方向论文数量越多、竞争越激烈、领域越热门。

---

## 📊 第一部分:今日概览

### 🎯 核心趋势
根据论文内容总结 2-4 个研究趋势和热点方向。

### 🔤 高频关键词
列出 5-10 个最常出现的关键词,英文术语后附中文翻译。

---

## 📑 第二部分:精选 Top {N} 研究

### 1. {英文标题}
- **🏷️ 中文标题:**{翻译}
- **👤 作者:**{作者列表}
- **📅 发布日期:**{日期}
- **📂 分类:**{分类标签}
- **🔗 链接:**{arXiv 链接}

**📝 中文摘要:**{2-3句通俗易懂的概括}

**🔎 深度点评:**
- **📊 研究总结:**{准确解释:背景、问题、方法、发现、意义}
- **✅ 入选理由:**{一句话说明为什么选这篇}

- **亮点与不足:**
  - 💡 亮点:{创新点}
  - ⚠️ 不足:{局限性}

---

## ⭐ 第三部分:精读推荐

### 🌟 推荐一:{论文标题}
- **📌 推荐理由:**{为什么值得精读}

(重复直到推荐数量)
```

#### 📄 模式 B 报告结构(具体问题)

```
# arXiv 调研报告 — {用户的提问}

📅 日期范围:{起始日期} ~ {结束日期}
📂 学科分类:{arXiv 分类}
🔍 检索关键词:{实际使用的关键词}
⏰ 生成时间:{当前时间}

---

## 📊 第一部分:调研概览

### 🎯 概括
用一段话完成检索概括和总结,格式为:
「在 {日期范围} 内,共检索到 {去重后相关论文总数} 篇相关论文。{总结内容}」
- 如果是 B1(检索类问题):总结内容根据检索到的论文总结主要发现和趋势
- 如果是 B2(答案类问题):总结内容直接回答用户的问题,用论文作为证据支撑
- 2-4 句话即可,不要展开太多

### 🔤 高频关键词
列出 5-10 个在搜索结果中最常出现的关键词,英文术语后附中文翻译。

---

## 📑 第二部分:全部相关研究({N} 篇)  ← 相关论文 ≤ 精选数量时
## 📑 第二部分:精选 Top {N} 研究      ← 相关论文 > 精选数量时

### 1. {英文标题}
- **🏷️ 中文标题:**{翻译}
- **👤 作者:**{作者列表}
- **📅 发布日期:**{日期}
- **📂 分类:**{分类标签}
- **🔗 链接:**{arXiv 链接}
- **✅ 入选理由:**{一句话,仅精选时标注}

**📝 中文摘要:**{2-3句通俗易懂的概括}

**🔎 深度点评:**
- **📊 研究总结:**{准确解释:背景、问题、方法、发现、意义}

- **亮点与不足:**
  - 💡 亮点:{创新点}
  - ⚠️ 不足:{局限性}

(重复直到所有相关论文展示完毕,序号递增)

---

## ⭐ 第三部分:精读推荐

### 🌟 推荐一:{论文标题}
- **📌 推荐理由:**{为什么这篇最值得精读}

(重复直到推荐数量)
```

### 第四步:保存文件

1. 确保输出目录存在(不存在则创建)
2. 文件名格式:
   - 模式 A:`arXiv日报_{分类}_{日期}.md`
   - 模式 B:`arXiv调研_{问题关键词}_{日期}.md`
3. 保存后告知用户文件路径

### 第五步:对话框内摘要推送

**模式 A 摘要格式:**
```
✅ 报告已生成!

📁 {文件路径}

📊 从 {Y} 篇中精选 {Z} 篇({P}%)

📊 今日趋势:
- 📌 {趋势一}
- 📌 {趋势二}

⭐ 精读推荐:
- 🌟 {论文} — {理由}
- 🌟 {论文} — {理由}
- 🌟 {论文} — {理由}
```

**模式 B 摘要格式:**
```
✅ 调研报告已生成!

📁 {文件路径}

💡 {1-2句话回答用户问题}

📊 共检索到 {Y} 篇相关论文

🎯 关键发现:
- 🧪 {发现一}
- 📏 {发现二}
- 🎭 {发现三}

⭐ 精读推荐:
- 🌟 {论文} — {理由}
- 🌟 {论文} — {理由}
- 🌟 {论文} — {理由}
```

**对话框回复可视化要求:**
- 使用 emoji 图标区分不同信息块
- 关键信息加粗
- 每个要点控制在 1-2 句话
- 整体控制在用户无需滚动即可看完的长度
- 避免 markdown 表格
- 语气简洁、信息密度高

---

## 学科分类映射表

### 计算机科学(cs.*)

| arXiv 分类 | 中文 | 英文关键词 | 中文关键词 |
|-----------|------|-----------|-----------|
| cs.HC | 人机交互 | HCI, Human-Computer Interaction, interaction, UX, usability | 人机交互, 交互设计, 用户体验, 可用性 |
| cs.AI | 人工智能 | Artificial Intelligence, AI, reasoning, planning | 人工智能, 推理, 规划, 智能体 |
| cs.LG | 机器学习 | Machine Learning, ML, deep learning, neural network | 机器学习, 深度学习, 神经网络, 模型训练 |
| cs.CL | 计算语言学 | NLP, natural language, language model, LLM, text | 自然语言处理, 语言模型, 大模型, NLP, 文本, 对话系统 |
| cs.CV | 计算机视觉 | Computer Vision, image, video, visual, detection, recognition | 计算机视觉, 图像, 视频, 目标检测, 图像识别 |
| cs.IR | 信息检索 | Information Retrieval, search, ranking, recommendation | 信息检索, 搜索, 推荐, 排序 |
| cs.SE | 软件工程 | Software Engineering, code, debugging, testing | 软件工程, 代码, 编程, 测试 |
| cs.NE | 神经与进化计算 | Neural networks, evolutionary, genetic, optimization | 神经网络, 进化计算, 遗传算法, 优化 |
| cs.RO | 机器人学 | Robotics, robot, manipulation, navigation, autonomous | 机器人, 无人车, 自动驾驶, 机械臂 |
| cs.GT | 博弈论 | Game Theory, mechanism design, auction, social choice | 博弈论, 机制设计, 拍卖, 社会选择 |
| cs.SD | 声音 | Audio, speech, sound, music, acoustic | 声音, 语音, 音频, 音乐, 语音合成 |
| cs.MM | 多媒体 | Multimedia, image processing, video processing | 多媒体, 图像处理, 视频处理 |
| cs.CY | 计算机与社会 | AI ethics, fairness, privacy, social computing | AI伦理, 公平性, 隐私, 社会计算 |
| cs.CC | 计算复杂性 | Complexity, computability, algorithms | 计算复杂性, 算法 |
| cs.DS | 数据结构 | Data structures, algorithms, graph theory | 数据结构, 图论, 算法 |
| cs.CR | 密码学 | Cryptography, security, blockchain | 密码学, 安全, 区块链 |
| cs.DB | 数据库 | Database, data management, query, SQL | 数据库, 数据管理, 查询 |
| cs.DC | 分布式计算 | Distributed, parallel, cloud, edge computing | 分布式计算, 并行计算, 云计算, 边缘计算 |
| cs.NI | 网络与互联网 | Network, internet, wireless, protocol | 网络, 无线网络, 互联网, 协议 |
| cs.OS | 操作系统 | Operating systems, systems, kernel | 操作系统, 系统, 内核 |
| cs.PL | 编程语言 | Programming languages, compilers, type systems | 编程语言, 编译器, 类型系统 |
| cs.LO | 计算逻辑 | Logic, verification, formal methods | 逻辑, 形式化验证 |
| cs.IT | 信息论 | Information theory, compression, coding | 信息论, 压缩, 编码 |
| cs.SY | 系统与控制 | Systems, control, embedded, IoT | 系统, 控制, 嵌入式, 物联网 |
| cs.MA | 多智能体 | Multi-agent, autonomous agents, cooperation | 多智能体, 自主代理, 协作 |

### 其他主要分类

| arXiv 分类 | 中文 | 英文关键词 | 中文关键词 |
|-----------|------|-----------|-----------|
| math.CO | 组合数学 | Combinatorics, graph, discrete math | 组合数学, 图论, 离散数学 |
| stat.ML | 统计机器学习 | Statistical learning, Bayesian, inference | 统计学习, 贝叶斯, 推断 |
| eess.AS | 音频与语音处理 | Audio, speech processing, signal | 音频, 语音处理, 信号处理 |
| eess.IV | 图像与视频处理 | Image, video, vision, processing | 图像处理, 视频处理 |
| q-bio.QM | 定量生物学方法 | Quantitative biology, bioinformatics | 定量生物学, 生物信息学 |

### 匹配规则

1. **精确匹配**:用户直接给 arXiv 分类号(如 cs.HC)→ 直接使用
2. **关键词匹配**:从用户输入中提取关键词,在映射表的英文/中文关键词列中搜索
3. **模糊匹配**:如果用户说的是宽泛主题(如"深度学习"),匹配最相关的分类(cs.LG 优先于 cs.NE、cs.CV)
4. **多分类建议**:如果主题可能跨多个分类,向用户建议并确认
5. **未知主题**:如果无法匹配,建议用户直接指定 arXiv 分类或换一种描述方式

Attribution

Is this your skill, or is something wrong with this listing? Request removal or report an issue. Author removals are honored within 72 hours.

Comments

Loading comments…