chore: import zh skill research-ideation

This commit is contained in:
wehub-skill-sync
2026-07-13 21:36:03 +08:00
commit be1f3cda3e
12 changed files with 2087 additions and 0 deletions
+9
View File
@@ -0,0 +1,9 @@
# WeHub 来源说明
- Skill 名称:`research-ideation`
- 中文类目:研究构思与头脑风暴
- 上游仓库:`galaxy-dawn__claude-scholar`
- 上游路径:`skills/research-ideation/SKILL.md`
- 上游链接:https://github.com/galaxy-dawn/claude-scholar/blob/HEAD/skills/research-ideation/SKILL.md
- 本仓库为 WeHub 中文 Skill 汉化包,基于 skill 市场筛选 Top200 清单整理
- 原作者、版权和许可证信息以上游仓库为准
+209
View File
@@ -0,0 +1,209 @@
---
name: research-ideation
description: 当用户要求"头脑风暴研究想法"、"使用 5W1H 框架"、"识别研究空白"、"进行差距分析"、"启动研究项目"、"进行文献综述"、"定义研究问题"、"选择研究方法"、"规划研究",或提及研究项目启动阶段时,应使用本技能。提供从想法生成到规划的研究启动工作流的全面指导。
version: 0.1.0
---
# 研究构思
支持研究项目启动阶段的完整工作流,从模糊想法到可追踪的研究合约:研究问题、假设、证据需求、证伪标准、方法选择与下一步行动。
## 核心功能
### 1. 想法头脑风暴(5W1H 框架)
使用 5W1H 框架系统地头脑风暴研究想法:
- **What**:研究什么问题或现象
- **Why**:为什么这个问题很重要
- **Who**:目标受众与利益相关者
- **When**:研究的时间范围与背景
- **Where**:应用场景与领域
- **How**:初步的研究方法论思路
**与 superpowers:brainstorming 集成**:可调用 superpowers:brainstorming 技能进行交互式头脑风暴,帮助快速生成和评估研究想法。
### 2. 文献综述
系统地检索、分析和综合相关文献:
- 构建有效的检索关键词
- 通过 WebSearch 在学术数据库(arXiv、Google Scholar 等)中检索
- 筛选和评估论文质量
- 识别研究趋势与空白
- 从带有证据标注的来源生成结构化文献综述
- **Zotero 集成**:论文通过 DOI 自动添加到 Zotero,按主题组织到集合中,开放获取的 PDF 自动附加以供全文阅读
### 3. 差距分析
系统地识别和评估研究空白:
- **文献空白**:识别尚未充分研究的主题或问题
- **方法空白**:发现现有方法的局限性和改进机会
- **应用空白**:识别理论到实践转化的机会
- **跨学科空白**:发现不同领域交叉处的研究机会
- **时间空白**:识别随时间变化而产生的新研究需求
**分析维度:**
- 研究主题的覆盖范围
- 现有方法的优缺点比较
- 实验设置的完整性
- 数据集和基准的可用性
- 理论与实践的差距
### 4. 研究问题定义
基于文献分析制定具体的研究问题:
- 识别研究空白与机会
- 应用 SMART 原则制定问题
- 评估重要性、新颖性和可行性
- 定义研究目标和预期贡献
- 撰写「研究问题卡片」,陈述假设、现有证据、缺失证据、支持标准、证伪标准以及最小下一步行动
- 在将卡片转化为正式提案之前,通过提案就绪关卡
### 5. 方法选择
选择合适的研究方法:
- 分析现有方法的优缺点
- 评估方法适用性
- 确定所需技术与资源
- 考虑方法的可行性
### 6. 研究规划
制定详细的研究计划:
- 规划研究时间线
- 定义里程碑和交付物
- 识别潜在风险
- 评估资源需求
## 使用时机
### 适合使用本技能的场景
请在以下情形中使用 research-ideation 技能:
1. **启动新研究项目**——已有研究兴趣但尚无明确研究问题
2. **文献综述**——需要系统性地了解某一研究领域
3. **研究问题制定**——需要将模糊想法转化为具体的研究问题
4. **方法选择**——需要选择合适的研究方法和技术路线
5. **研究规划**——需要规划研究时间线和资源
### 典型工作流
```
研究兴趣 → 想法头脑风暴(5W1H)→ 研究问题卡片 → 证据记录 → 差距分析 → 提案就绪关卡 → 选择方法或实验 → 决策
```
**有条件输出:**
- `research-question-card.md`——在研究启动或引入阶段始终生成此文件
- `literature-review.md`——仅当带有证据标注的来源足以进行综合时生成
- `research-proposal.md`——仅当所选的研究问题卡片通过证据关卡时生成
- `references.bib`——仅当存在可靠的引文元数据时生成
- 包含已整理论文和 PDF 的 Zotero 集合——仅当 Zotero 已配置、可写入,且用户未要求干跑/审计模式时创建
## 与其他系统的集成
### 完整研究工作流
```
research-ideation(研究启动)
实验执行(由用户完成)
results-analysis(结果分析)
ml-paper-writing(论文写作)
```
### 数据流
- **研究问题卡片**→ 指导文献范围、实验设计和方法选择
- **证据记录**→ 将来源类型、主张强度及允许/禁止措辞带入文献综合、项目知识以及后续的主张审计
- **提案就绪关卡**→ 防止仅有摘要或网页占位符的证据转化为正式提案
- **实验结果**→ 结果分析用于统计分析和主张候选
- **分析结果**→ 结果报告和论文写作,附带明确的证据限制
### Zotero 集成
通过 Zotero MCP 服务器,research-ideation 工作流实现了文献管理自动化:
- **论文发现**:WebSearch 在学术数据库中检索相关论文
- **自动导入**:从检索结果中提取 DOI / arXiv ID / 落地页 URL,然后使用 `zotero_add_items_by_identifier` 优先导入论文/预印本,而非回退到网页
- **集合整理**`zotero_create_collection` 创建按主题分类的集合,带有标准子集合(核心论文、方法、应用、基线、待读)
- **PDF 附件**`zotero_add_items_by_identifier(..., attach_pdf=true)` 运行 PDF 级联策略(落地页 PDF 提示 → 直接 PDF → Unpaywall),也可使用 `zotero_find_and_attach_pdfs` 作为后续补充扫描
- **全文阅读**`zotero_get_item_fulltext` 读取已索引的 PDF 内容用于分析和笔记
- **库检索**`zotero_search_items``zotero_get_collection_items` 浏览已有论文以避免重复
### 关键配置
- **文献检索范围**:默认检索过去 3 年的论文,可配置
- **输出格式**:Markdown 格式,便于编辑和版本控制
- **引文管理**:以 BibTeX 格式生成参考文献
- **Zotero 集合命名**:格式为 `Research-{topic}-{YYYY}`
- **PDF 自动附加**:默认对开放获取论文通过 Unpaywall 启用
## 其他资源
### 参考文件
详细的方法指南,按需加载:
- **`references/5w1h-framework.md`**——5W1H 框架指南
- What、Why、Who、When、Where、How——六个维度
- 头脑风暴研究想法的系统方法
- 与 superpowers:brainstorming 的集成
- 使用示例和最佳实践
- **`references/literature-search-strategies.md`**——文献检索策略
- 关键词构建技巧
- 学术数据库选择(arXiv、Google Scholar
- 检索技巧和筛选标准
- 论文质量评估方法
- DOI 提取与 Zotero 自动导入工作流
- **`references/zotero-integration-guide.md`**——Zotero MCP 集成指南
- 可用的 Zotero MCP 工具(浏览、添加、引用)
- 集合组织策略与命名规范
- 自动化工作流:WebSearch → DOI → Zotero 导入 → PDF 附件
- 全文阅读与结构化笔记
- 常见问题与故障排查
- **`references/gap-analysis-guide.md`**——差距分析指南
- 5 类差距分析(文献空白、方法空白、应用空白、跨学科空白、时间空白)
- 5 个分析维度
- 识别研究机会的系统方法
- 使用示例和最佳实践
- **`references/research-question-formulation.md`**——研究问题制定
- 应用 SMART 原则
- 问题类型分类(探索性、验证性、应用性)
- 评估标准(重要性、新颖性、可行性)
- 定义研究目标和贡献
- **`references/research-contract.md`**——研究合约
- 研究问题卡片模板
- 证据记录模板
- 主张候选模板
- 主张强度规则
- **`references/method-selection-guide.md`**——方法选择指南
- 常见研究方法分类
- 方法适用性分析
- 优缺点比较
- 资源需求评估
- **`references/research-planning.md`**——研究规划
- 时间线规划方法
- 里程碑定义技巧
- 风险识别与缓解
- 资源分配策略
### 示例文件
完整的工作示例:
- **`examples/example-literature-review.md`**——文献综述示例
- 展示结构化文献综述格式
- 包含研究趋势分析与空白识别
- **`examples/example-research-proposal.md`**——研究提案示例
- 展示完整的研究提案结构
- 包含问题、方法和计划的完整示例
+126
View File
@@ -0,0 +1,126 @@
---
name: literature-review-transformer-explainability
description: 文献综述示例:Transformer 模型可解释性研究
metadata:
type: reference
---
# 文献综述示例:Transformer 模型可解释性研究
## 研究主题
本文献综述聚焦于 Transformer 模型的可解释性研究,特别是注意力机制的解释和理解。
## 1. 引言
### 1.1 研究背景
Transformer 模型自 2017 年提出以来,已成为自然语言处理领域的主流架构。然而,其内部工作机制仍然不够透明,限制了模型的可信度和在关键应用中的部署。
### 1.2 研究重要性
**学术价值**
- 深入理解深度学习模型的工作原理
- 为模型改进提供理论指导
- 推动可解释 AI 领域发展
**实际价值**
- 提高模型可信度
- 辅助模型调试和优化
- 满足监管和伦理要求
### 1.3 综述范围
本综述涵盖 2020-2024 年间发表的相关工作,重点关注:
- 注意力机制的可视化和分析
- 模型内部表示的探测
- 可解释性评估方法
- 应用案例研究
## 2. 主要研究方向
### 2.1 注意力可视化方法
**代表性工作**
**Clark et al. (2019) - "What Does BERT Look At?"**
- 会议:ACL 2019
- 贡献:系统分析 BERT 的注意力模式
- 发现:不同层的注意力关注不同语言现象
- 引用次数:1200+
**Vig (2019) - "A Multiscale Visualization of Attention"**
- 会议:ACL 2019 Demo
- 贡献:开发交互式注意力可视化工具
- 工具:BertViz(开源)
- 影响:广泛使用的可视化工具
**主要发现**
- 早期层关注句法结构
- 中间层关注语义关系
- 后期层关注任务相关特征
### 2.2 模型探测方法
**代表性工作**
**Tenney et al. (2019) - "BERT Rediscovers the Classical NLP Pipeline"**
- 会议:ACL 2019
- 贡献:使用探测任务分析 BERT 的语言知识
- 方法:Edge probing tasks
- 发现:BERT 隐式学习了传统 NLP 流程
**Rogers et al. (2020) - "A Primer on BERTology"**
- 期刊:TACL 2020
- 贡献:系统综述 BERT 的可解释性研究
- 影响:成为该领域的重要参考文献
- 引用次数:800+
**主要发现**
- 模型学习了丰富的语言知识
- 不同层编码不同层次的信息
- 知识分布在多个层中
## 3. 研究趋势与空白
### 3.1 当前研究趋势
**从静态分析到动态分析**
- 早期工作主要分析训练好的模型
- 近期工作开始关注训练过程中的动态变化
**从单一方法到综合方法**
- 结合多种可解释性技术
- 跨层次、跨模态的分析
**从理解到应用**
- 将可解释性用于模型改进
- 辅助模型调试和优化
### 3.2 研究空白
**理论基础不足**
- 缺乏统一的可解释性理论框架
- 注意力权重与模型行为的因果关系不明确
**评估标准缺失**
- 缺乏标准化的评估方法
- 人类评估成本高且主观性强
**长文本处理**
- 现有方法主要针对短文本
- 长文本的注意力模式更复杂
## 4. 总结
本综述系统梳理了 Transformer 模型可解释性研究的主要方向和代表性工作。主要发现包括:
1. **注意力机制**:不同层关注不同语言现象,但注意力权重不能完全解释模型行为
2. **内部表示**:模型隐式学习了丰富的语言知识,分布在多个层中
3. **研究空白**:理论基础、评估标准、长文本处理等方面仍需深入研究
**未来研究方向**
- 建立统一的可解释性理论框架
- 开发标准化的评估方法
- 探索长文本的可解释性
- 将可解释性用于模型改进
+208
View File
@@ -0,0 +1,208 @@
# 研究提案示例:基于稀疏注意力的长文本 Transformer
## 研究主题
开发一种新的稀疏注意力机制,使 Transformer 模型能够高效处理长文本(10k+ tokens),同时保持或提升性能。
## 1. 研究问题
### 1.1 核心问题
**如何设计一种稀疏注意力机制,使 Transformer 能够在保持性能的同时,将计算复杂度从 O(n²) 降低到 O(n log n)**
### 1.2 子问题
1. 哪些注意力连接对模型性能最重要?
2. 如何自适应地选择重要的注意力连接?
3. 稀疏化对不同任务的影响如何?
4. 如何在训练和推理中高效实现稀疏注意力?
## 2. 研究目标
### 2.1 主要目标
1. **方法创新**:提出新的自适应稀疏注意力机制
2. **性能提升**:在长文本任务上达到或超越现有方法
3. **效率提升**:将计算和内存成本降低 50% 以上
4. **理论理解**:分析稀疏化对模型能力的影响
### 2.2 预期贡献
**学术贡献**
- 新的稀疏注意力机制设计
- 长文本处理的理论分析
- 开源实现和预训练模型
**实际价值**
- 降低长文本处理成本
- 使更长的上下文成为可能
- 提高推理速度
## 3. 研究方法
### 3.1 核心思路
**自适应稀疏注意力**
- 动态选择重要的注意力连接
- 保留局部注意力(相邻 tokens)
- 学习全局注意力模式
- 任务自适应的稀疏化策略
### 3.2 技术方案
**阶段 1:稀疏模式设计**
- 分析现有稀疏模式(Longformer, BigBird
- 设计新的自适应选择机制
- 理论分析复杂度和表达能力
**阶段 2:模型实现**
- 实现高效的稀疏注意力算子
- 集成到 Transformer 架构
- 优化训练和推理效率
**阶段 3:实验验证**
- 在多个长文本任务上评估
- 与现有方法对比
- 消融实验分析
## 4. 实验计划
### 4.1 数据集
| 任务 | 数据集 | 序列长度 | 评估指标 |
|------|--------|---------|---------|
| 文档分类 | Hyperpartisan | 4k-16k | F1 |
| 问答 | NarrativeQA | 8k-32k | F1, EM |
| 摘要 | arXiv | 4k-8k | ROUGE |
### 4.2 基线方法
- **Vanilla Transformer**:标准 Transformer(作为上界)
- **Longformer**:固定稀疏模式
- **BigBird**:随机+全局+局部
- **Reformer**LSH 注意力
### 4.3 评估维度
**性能**
- 任务准确率
- 与基线对比
**效率**
- 训练时间
- 推理速度
- 内存占用
**可扩展性**
- 不同序列长度的表现
- 参数量的影响
## 5. 时间线规划
### 5.1 研究阶段划分
**Phase 1: 准备阶段**(第1-2个月)
- 文献调研和综述
- 问题定义和方法设计
- 初步实验环境搭建
- **里程碑**:研究提案完成
**Phase 2: 探索阶段**(第3-4个月)
- 稀疏模式设计和理论分析
- 初步实现和概念验证
- 小规模实验验证可行性
- **里程碑**:概念验证完成
**Phase 3: 开发阶段**(第5-7个月)
- 完整模型实现
- 优化训练和推理效率
- 在多个数据集上进行实验
- **里程碑**:完整实验结果
**Phase 4: 完成阶段**(第8-9个月)
- 消融实验和深入分析
- 论文撰写和修改
- 代码整理和开源准备
- **里程碑**:论文投稿
### 5.2 关键检查点
**月度检查**
- 进度回顾和问题识别
- 实验结果分析
- 计划调整
**季度评审**
- 里程碑评估
- 风险评估和应对
- 资源需求调整
## 6. 资源需求
### 6.1 计算资源
**GPU 需求**
- 探索阶段:2-4 GPUV100 或 A100
- 开发阶段:4-8 GPU
- 完成阶段:8-16 GPU(大规模实验)
**存储需求**
- 数据集:200 GB
- 模型检查点:100 GB
- 实验日志:50 GB
- 总计:约 350 GB
**预计计算时间**
- 模型训练:约 500 GPU 小时
- 实验评估:约 200 GPU 小时
- 总计:约 700 GPU 小时
### 6.2 人力资源
**研究负责人**1人):
- 研究规划和指导
- 论文撰写
- 时间投入:50%
**研究助理**1-2人):
- 实验实现和运行
- 数据分析
- 时间投入:100%
### 6.3 其他资源
**数据集**
- Hyperpartisan(公开)
- NarrativeQA(公开)
- arXiv(公开)
**软件工具**
- PyTorch
- Transformers
- Weights & Biases(实验跟踪)
## 7. 总结
本研究提案旨在开发一种新的自适应稀疏注意力机制,解决 Transformer 在长文本处理中的效率问题。
**核心创新**
- 自适应选择重要的注意力连接
- 将计算复杂度从 O(n²) 降低到 O(n log n)
- 在保持性能的同时提高效率
**预期成果**
- 在长文本任务上达到或超越现有方法
- 将计算和内存成本降低 50% 以上
- 开源实现和预训练模型
**可行性**
- 基于成熟的 Transformer 架构
- 有充足的计算资源支持
- 9 个月的研究周期合理
- 团队具备相关技术背景
**影响力**
- 学术贡献:新的稀疏注意力机制和理论分析
- 实际价值:降低长文本处理成本,使更长的上下文成为可能
本研究具有明确的目标、可行的方法和充足的资源支持,预期能够产生有价值的学术成果和实际应用。
+164
View File
@@ -0,0 +1,164 @@
---
name: 5W1H-framework-for-research-ideation
description: 5W1H 框架帮助研究者从多个维度构思和评估研究想法
metadata:
type: reference
---
# 5W1H Framework for Research Ideation
## 概述
5W1H 框架是一个系统化的思维工具,帮助研究者从多个维度构思和评估研究想法。通过回答6个关键问题,可以快速建立对研究主题的全面理解。
## 框架组成
### What(什么)
**核心问题**:研究什么问题或现象?
**思考维度**
- 具体的研究对象是什么
- 要解决的核心问题是什么
- 研究的范围和边界在哪里
- 预期的研究成果是什么
**示例**
- "研究 Transformer 模型的可解释性"
- "探索少样本学习在医疗图像分析中的应用"
- "分析强化学习中的样本效率问题"
### Why(为什么)
**核心问题**:为什么这个问题重要?
**思考维度**
- 这个问题的学术价值是什么
- 解决这个问题有什么实际意义
- 当前研究的局限性是什么
- 为什么现在是研究这个问题的好时机
**评估标准**
- **学术重要性**:是否推动领域发展
- **实际影响**:是否解决真实问题
- **时效性**:是否符合当前研究趋势
- **可行性**:是否有足够的资源和技术支持
### Who(谁)
**核心问题**:目标受众和利益相关者是谁?
**思考维度**
- 谁会关心这个研究
- 谁会使用研究成果
- 谁会从中受益
- 需要与谁合作
**利益相关者分类**
- **学术界**:同领域研究者、审稿人、引用者
- **工业界**:产品团队、工程师、决策者
- **用户**:最终使用者、受影响群体
- **合作者**:导师、同事、跨学科专家
### When(何时)
**核心问题**:研究的时间范围和背景是什么?
**思考维度**
- 研究的时间跨度是多久
- 何时是最佳的研究时机
- 相关技术和数据何时可用
- 预期何时产出成果
**时间规划**
- **短期**(3-6个月):初步探索、文献综述、方法验证
- **中期**(6-12个月):完整实验、论文撰写、投稿
- **长期**(1-2年):系统研究、多篇论文、理论贡献
### Where(何处)
**核心问题**:研究的应用场景和领域是什么?
**思考维度**
- 研究应用在哪些具体场景
- 在哪些领域或行业有价值
- 地理或文化背景是否重要
- 实验在哪里进行
**应用场景分类**
- **学术场景**:理论验证、方法比较、基准测试
- **工业场景**:产品开发、系统优化、问题诊断
- **社会场景**:政策制定、公共服务、社会影响
- **跨领域**:多学科交叉、技术迁移
### How(如何)
**核心问题**:初步的研究方法思路是什么?
**思考维度**
- 采用什么研究方法或技术路线
- 需要什么数据和资源
- 如何验证研究假设
- 预期的技术挑战是什么
**方法类型**
- **理论研究**:数学证明、理论分析、模型推导
- **实验研究**:算法设计、实验验证、性能评估
- **应用研究**:系统开发、案例研究、用户测试
- **综合研究**:文献综述、元分析、系统评价
## 使用示例
### 示例 1Transformer 可解释性研究
**What**:研究 Transformer 模型的注意力机制可解释性
**Why**:提高模型透明度,增强用户信任,满足监管要求
**Who**:NLP 研究者、模型开发者、监管机构
**When**6-12个月,当前 Transformer 广泛应用但缺乏解释
**Where**:文本分类、机器翻译、问答系统等 NLP 任务
**How**:设计可视化工具,分析注意力权重,进行消融实验
### 示例 2:少样本学习在医疗影像中的应用
**What**:探索少样本学习方法在医疗图像诊断中的有效性
**Why**:医疗数据标注成本高,少样本学习可降低数据需求
**Who**:医疗 AI 研究者、放射科医生、医院
**When**:12-18个月,随着少样本学习技术成熟
**Where**:X光片、CT扫描、MRI 等医疗影像诊断
**How**:元学习、迁移学习、数据增强,在真实医疗数据集上验证
## 最佳实践
### 1. 迭代式思考
不要期望一次性回答所有问题。先快速过一遍6个问题,然后反复迭代细化。
### 2. 优先级排序
根据研究阶段调整关注重点:
- **早期**:重点关注 What、Why、Who
- **中期**:重点关注 How、When、Where
- **后期**:全面审视所有维度
### 3. 团队协作
与导师、同事讨论 5W1H 问题,获得多角度反馈。
### 4. 文档记录
将 5W1H 分析结果记录下来,作为研究提案的基础。
## 与 superpowers:brainstorming 集成
可以调用 `superpowers:brainstorming` skill 进行交互式头脑风暴:
**使用场景**
- 需要快速生成多个研究想法
- 需要评估想法的可行性
- 需要团队协作式讨论
**集成方式**
1. 使用 5W1H 框架初步构思想法
2. 调用 superpowers:brainstorming 进行深入探索
3. 将头脑风暴结果整理回 5W1H 框架
4. 形成结构化的研究提案
+261
View File
@@ -0,0 +1,261 @@
# Gap Analysis Guide for Research
## 概述
Gap Analysis(研究空白分析)是识别现有研究中未被充分探索的领域、方法或应用的系统化过程。通过识别这些空白,研究者可以找到有价值的研究机会和创新方向。
## 为什么需要 Gap Analysis
**学术价值**
- 确保研究的原创性和新颖性
- 避免重复已有的研究工作
- 识别高影响力的研究方向
**实践价值**
- 发现理论到实践的转化机会
- 识别技术改进的空间
- 找到跨学科合作的可能性
## Gap Analysis 的类型
### 1. 文献空白(Literature Gap
**定义**:尚未被充分研究或完全未被研究的主题或问题。
**识别方法**
- 系统化文献综述发现研究较少的子领域
- 分析综述论文中提到的「未来工作」
- 识别被引用较少但重要的研究方向
- 发现新兴技术或应用场景
**示例**
- 「Transformer 在时间序列预测中的应用研究较少」
- 「少样本学习在医疗影像中的研究刚刚起步」
- 「多模态学习在机器人控制中的应用尚未充分探索」
### 2. 方法空白(Methodological Gap
**定义**:现有方法的局限性和改进机会。
**识别方法**
- 分析现有方法的优缺点
- 识别方法在特定场景下的失效情况
- 发现计算效率或可扩展性问题
- 识别理论与实践的差距
**示例**
- 「现有注意力机制在长序列上效率低下」
- 「当前强化学习方法样本效率不足」
- 「现有可解释性方法难以应用于大规模模型」
### 3. 应用空白(Application Gap
**定义**:理论到实践的转化机会,或在新场景中的应用潜力。
**识别方法**
- 识别理论研究缺乏实际应用验证
- 发现成功方法在新领域的应用机会
- 识别工业界需求与学术研究的脱节
- 发现技术迁移的可能性
**示例**
- 「自监督学习在工业质检中的应用尚未充分探索」
- 「图神经网络在金融风控中的应用研究较少」
- 「联邦学习在医疗数据隐私保护中的实际部署案例不足」
### 4. 跨学科空白(Interdisciplinary Gap
**定义**:不同领域交叉产生的研究机会。
**识别方法**
- 识别不同领域的相似问题
- 发现方法在跨领域迁移的可能性
- 识别需要多学科协作的复杂问题
- 发现新兴交叉领域
**示例**
- 「认知科学与深度学习的交叉研究」
- 「量子计算与机器学习的结合」
- 「生物学启发的神经网络架构设计」
### 5. 时间空白(Temporal Gap
**定义**:随时间变化产生的新研究需求。
**识别方法**
- 识别新技术带来的新问题
- 发现数据分布随时间变化的影响
- 识别社会需求变化带来的新挑战
- 发现技术演进产生的新机会
**示例**
- 「大语言模型时代的提示工程研究」
- 「后疫情时代的远程协作技术」
- 「隐私法规变化对机器学习的影响」
## 分析维度
### 1. 研究主题的覆盖程度
**评估指标**
- 相关论文数量和质量
- 研究的深度和广度
- 主流会议和期刊的关注度
- 研究团队的活跃程度
**判断标准**
- **充分研究**:>100篇高质量论文,多个活跃团队
- **适度研究**:20–100篇论文,有一定关注
- **研究不足**:<20篇论文,关注度低
- **未被研究**:几乎没有相关文献
### 2. 现有方法的优缺点对比
**评估内容**
- 方法的理论基础
- 实验性能表现
- 计算复杂度
- 可扩展性和泛化能力
- 实际应用的可行性
**空白识别**
- 所有方法都存在的共同局限
- 特定场景下的失效情况
- 理论与实践的差距
### 3. 实验设置的完整性
**评估内容**
- 实验场景的多样性
- 基准数据集的覆盖范围
- 评估指标的全面性
- 消融实验的充分性
**空白识别**
- 缺少特定场景的实验验证
- 评估指标不够全面
- 缺少与强基线的对比
### 4. 数据集和基准的可用性
**评估内容**
- 公开数据集的数量和质量
- 标准基准的建立情况
- 数据集的多样性和代表性
- 数据标注的质量
**空白识别**
- 缺少特定领域的数据集
- 现有数据集存在偏差或局限
- 缺少标准化的评估基准
### 5. 理论与实践的差距
**评估内容**
- 理论假设与实际情况的匹配度
- 方法在实际应用中的可行性
- 理论保证与实验结果的一致性
- 工业界采用情况
**空白识别**
- 理论研究缺乏实际验证
- 实际问题缺乏理论支持
- 技术转化存在障碍
## 使用方法
### Step 1:系统化文献综述
- 收集相关领域的代表性论文(20–100篇)
- 按主题、方法、应用场景分类
- 识别研究趋势和热点
### Step 2:构建对比矩阵
创建表格对比现有研究:
| 研究 | 方法 | 数据集 | 性能 | 局限性 |
|------|------|--------|------|--------|
| Paper A | Method X | Dataset 1 | 85% | 计算复杂度高 |
| Paper B | Method Y | Dataset 2 | 82% | 泛化能力弱 |
### Step 3:识别空白模式
- 所有研究都未涉及的主题
- 所有方法都存在的共同局限
- 缺少的实验场景或数据集
- 理论与实践的脱节
### Step 4:评估空白的价值
对每个识别的空白评估:
- **重要性**:解决该空白的学术/实践价值
- **新颖性**:是否有人正在研究
- **可行性**:是否有足够的资源和技术支持
## 示例分析
### 示例 1Transformer 在时间序列预测中的应用
**文献综述发现**
- Transformer 在 NLP 领域应用广泛(>1000篇论文)
- 在计算机视觉中也有大量研究(>500篇论文)
- 在时间序列预测中的研究较少(<50篇论文)
**识别的空白**
- **文献空白**:时间序列领域的 Transformer 研究不足
- **方法空白**:现有方法未充分利用时间序列的特性
- **应用空白**:缺少在金融、能源等领域的应用验证
**研究机会**:设计专门针对时间序列的 Transformer 变体
### 示例 2:联邦学习的隐私保护
**文献综述发现**
- 联邦学习理论研究充分(>200篇论文)
- 隐私保护机制研究较多(>150篇论文)
- 实际部署案例较少(<20篇论文)
**识别的空白**
- **应用空白**:理论到实践的转化不足
- **方法空白**:现有方法在实际场景中效率低
- **时间空白**:新隐私法规带来的新挑战
**研究机会**:开发高效的隐私保护联邦学习系统
## 最佳实践
### 1. 保持客观性
避免为了找空白而找空白。真正的研究空白应该是:
- 有学术或实践价值的
- 可行的(有资源和技术支持)
- 符合研究兴趣的
### 2. 多维度分析
不要只关注一种类型的空白,综合考虑:
- 文献空白 + 方法空白 = 创新方法
- 应用空白 + 跨学科空白 = 新应用场景
- 时间空白 + 文献空白 = 新兴研究方向
### 3. 验证空白的真实性
在确定研究方向前,再次验证:
- 是否有最新的相关工作(搜索最近3个月的论文)
- 是否有人正在研究(检查 arXiv 预印本)
- 是否有技术或数据限制
### 4. 记录分析过程
将 Gap Analysis 的结果记录下来:
- 识别的空白列表
- 每个空白的评估(重要性、新颖性、可行性)
- 选择的研究方向和理由
### 5. 与导师和同行讨论
Gap Analysis 的结果应该与导师、同事讨论:
- 验证空白的真实性和价值
- 获得不同角度的反馈
- 避免主观偏见
+202
View File
@@ -0,0 +1,202 @@
# 文献搜索策略
系统化的文献搜索方法,帮助研究者高效地找到相关文献。
## 1. 关键词构建
### 1.1 核心概念识别
从研究兴趣中提取核心概念:
**示例**:研究兴趣 "Transformer 模型的可解释性"
- 核心概念 1Transformer
- 核心概念 2Interpretability / Explainability
### 1.2 同义词和变体
为每个核心概念列出同义词和变体:
| 核心概念 | 同义词/变体 |
|---------|------------|
| Transformer | Attention mechanism, Self-attention, BERT, GPT |
| Interpretability | Explainability, Transparency, Understanding |
### 1.3 布尔运算符
使用布尔运算符组合关键词:
```
(Transformer OR "attention mechanism" OR BERT OR GPT)
AND
(interpretability OR explainability OR transparency)
```
### 1.4 领域特定术语
添加领域特定的术语:
- **方法术语**probing, attention visualization, saliency maps
- **应用领域**NLP, computer vision, speech recognition
- **评估指标**faithfulness, plausibility, human evaluation
## 2. 学术数据库选择
### 2.1 主要数据库
| 数据库 | 特点 | 适用场景 |
|--------|------|---------|
| **arXiv** | 预印本,更新快 | 获取最新研究进展 |
| **Semantic Scholar** | AI 驱动,引用分析 | 发现相关论文,分析影响力 |
| **Google Scholar** | 覆盖面广 | 全面搜索,找遗漏论文 |
| **ACL Anthology** | NLP 专业 | NLP 领域深度搜索 |
| **IEEE Xplore** | 工程技术 | 计算机视觉、硬件相关 |
### 2.2 搜索策略
**arXiv 搜索**
```
cat:cs.LG AND (transformer OR attention) AND (interpretability OR explainability)
```
**Semantic Scholar 搜索**
- 使用自然语言查询
- 利用"Highly Influential Citations"筛选
- 查看"Related Papers"发现相关工作
**Google Scholar 搜索**
- 使用引号精确匹配:"transformer interpretability"
- 限制时间范围:2020-2024
- 排除专利:-patent
## 3. 搜索技巧
### 3.1 迭代搜索
1. **初始搜索** - 使用核心关键词
2. **分析结果** - 查看高引用论文的关键词
3. **优化查询** - 添加新发现的术语
4. **重复迭代** - 直到找到足够相关的论文
### 3.2 引用追踪
**前向引用**Forward Citation):
- 查看哪些新论文引用了这篇论文
- 了解研究的后续发展
**后向引用**Backward Citation):
- 查看这篇论文引用了哪些论文
- 了解研究的基础和背景
### 3.3 作者追踪
- 识别领域内的关键研究者
- 查看他们的其他相关工作
- 关注他们的最新研究
## 4. 论文筛选标准
### 4.1 初步筛选(基于标题和摘要)
**包含标准**
- 直接相关于研究主题
- 发表在顶级会议/期刊(NeurIPS, ICML, ICLR, ACL, AAAI
- 引用次数较高(相对于发表时间)
- 作者来自知名机构或研究组
**排除标准**
- 与研究主题无关
- 发表在低质量会议/期刊
- 明显过时的方法(除非是经典论文)
### 4.2 深度筛选(基于全文)
**质量评估**
1. **方法创新性** - 是否提出新方法或新视角
2. **实验充分性** - 实验设计是否合理,结果是否可信
3. **写作质量** - 论文是否清晰易懂
4. **可重现性** - 是否提供代码和数据
**相关性评估**
1. **直接相关** - 核心方法或问题直接相关
2. **间接相关** - 相关技术或应用场景
3. **背景知识** - 提供必要的背景和基础
### 4.3 文献管理
**集成工具**
- **Zotero**(主要工具,已通过 MCP 集成)
- 通过 `zotero_add_items_by_identifier` 智能导入论文,优先落成 paper/preprint
- 通过 `zotero_create_collection` 自动创建和组织集合
- 通过 PDF cascade(页面显式 PDF → direct PDF → Unpaywall)尽可能补齐 PDF
- 通过 `zotero_get_item_fulltext` 读取 PDF 全文进行分析
- 通过 `zotero_search_items` 搜索已有论文避免重复导入
- Mendeley - 社交功能,PDF 标注(备选)
- Papers - Mac 专用,界面优雅(备选)
**组织策略**
使用 Zotero 集合结构组织文献:
```
📁 Research-{topic}-{date}
├── 📁 Core Papers(核心论文)
├── 📁 Methods(方法论文)
├── 📁 Applications(应用论文)
├── 📁 Baselines(基线论文)
└── 📁 To-Read(待读论文)
```
- 核心论文:直接相关、高引用的关键论文
- 方法论文:技术方法参考,可借鉴的方法论
- 应用论文:应用场景参考,领域实践
- 基线论文:实验对比基准,需要复现的工作
- 待读论文:初步筛选,待深入阅读
## 5. DOI 提取与自动导入
### 5.1 DOI 提取方法
从 WebSearch 搜索结果中提取 DOI 的常见方式:
**URL 中的 DOI**
- `https://doi.org/10.xxxx/xxxxx` - 直接 DOI 链接
- `https://dl.acm.org/doi/10.xxxx/xxxxx` - ACM Digital Library
- `https://ieeexplore.ieee.org/document/xxxxx` - IEEE(需从页面提取)
- `https://arxiv.org/abs/xxxx.xxxxx` - arXivDOI 格式:`10.48550/arXiv.xxxx.xxxxx`
**常见 DOI 格式**
- `10.xxxx/xxxxx` - 标准 DOI 前缀
-`10.` 开头,包含 `/` 分隔符
- 例:`10.1038/s41586-023-06747-5`Nature
- 例:`10.48550/arXiv.2301.00234`arXiv
### 5.2 自动导入流程
```
WebSearch 搜索论文
从搜索结果中提取 DOI / arXiv ID / landing-page URL
add_items_by_identifier 批量导入到 Zotero
工具内部自动执行 PDF cascade
必要时用 `zotero_reconcile_collection_duplicates` 做导入后去重清理
get_item_fulltext 读取全文进行分析
```
**操作示例**
1. 使用 WebSearch 搜索 `"transformer interpretability" site:arxiv.org OR site:doi.org`
2. 从结果中收集 DOI 列表
3. 调用 `zotero_add_items_by_identifier(..., attach_pdf=true)` 批量导入(建议每批不超过 10 篇,避免 API 速率限制)
4. 仅对仍然缺 PDF 的条目,再调用 `zotero_find_and_attach_pdfs` 做补挂
5. 使用 `zotero_get_item_fulltext` 阅读关键论文全文
### 5.3 无 DOI 论文处理
部分论文可能没有标准 DOI
- **arXiv 预印本**:使用 `10.48550/arXiv.{id}` 格式
- **会议论文集**:尝试从出版商页面获取 DOI
- **无法获取 DOI**:优先识别 arXiv ID、页面中的 `citation_doi` / `citation_pdf_url`;只有都失败时才保存为 `webpage`。如果关键论文仍缺 PDF,请在 Zotero Desktop 中手动附加。
+217
View File
@@ -0,0 +1,217 @@
# 方法选择指南
帮助研究者选择适合的研究方法和技术路线。
## 1. 常见研究方法分类
### 1.1 理论分析方法
**特点**:通过数学推导和理论分析来理解问题
**适用场景**
- 需要理论保证的问题
- 算法复杂度分析
- 收敛性证明
- 泛化界分析
**示例**
- PAC 学习理论
- 优化算法收敛性分析
- 神经网络表达能力分析
**所需技能**
- 数学基础(概率论、优化理论)
- 理论计算机科学
- 证明技巧
### 1.2 实证研究方法
**特点**:通过实验验证假设和评估方法
**适用场景**
- 新方法性能评估
- 假设验证
- 方法对比
- 参数敏感性分析
**示例**
- 在多个数据集上评估新模型
- 消融实验分析组件贡献
- 超参数搜索和优化
**所需资源**
- 计算资源(GPU/TPU
- 标准数据集
- 评估指标和工具
### 1.3 系统构建方法
**特点**:构建完整的系统或工具
**适用场景**
- 端到端应用系统
- 工具和框架开发
- 集成多个技术
- 实际部署需求
**示例**
- 对话系统
- 推荐系统
- 代码生成工具
- 数据处理框架
**所需资源**
- 工程能力
- 系统设计经验
- 用户反馈渠道
- 维护和迭代能力
### 1.4 数据分析方法
**特点**:通过数据分析发现规律和洞察
**适用场景**
- 探索性研究
- 现象分析
- 模型行为理解
- 错误分析
**示例**
- 注意力模式可视化
- 模型预测错误分析
- 数据集偏差分析
- 训练动态分析
**所需技能**
- 数据可视化
- 统计分析
- 模型解释技术
## 2. 方法选择决策框架
### 2.1 问题类型匹配
| 问题类型 | 推荐方法 | 原因 |
|---------|---------|------|
| 理论问题 | 理论分析 | 需要严格证明 |
| 性能提升 | 实证研究 | 需要实验验证 |
| 实际应用 | 系统构建 | 需要端到端解决方案 |
| 现象理解 | 数据分析 | 需要探索和发现 |
### 2.2 资源约束考虑
**计算资源有限**
- 优先选择轻量级方法
- 使用预训练模型
- 考虑模型压缩技术
- 使用小规模数据集验证
**时间紧迫**
- 选择成熟的方法
- 使用现有工具和框架
- 避免从零开始
- 优先快速原型
**数据有限**
- 使用迁移学习
- 数据增强技术
- Few-shot 学习方法
- 合成数据生成
## 3. 方法优缺点对比
### 3.1 理论分析方法
**优点**
- 提供理论保证
- 深入理解问题本质
- 结果具有普适性
- 不依赖大量实验
**缺点**
- 需要强数学背景
- 可能与实际有差距
- 证明过程耗时
- 难以处理复杂系统
### 3.2 实证研究方法
**优点**
- 直接验证性能
- 结果直观可信
- 易于复现
- 适用范围广
**缺点**
- 需要大量计算资源
- 结果可能过拟合数据集
- 缺乏理论解释
- 超参数调优困难
### 3.3 系统构建方法
**优点**
- 解决实际问题
- 产生实用价值
- 综合多种技术
- 易于产业化
**缺点**
- 工程量大
- 维护成本高
- 学术贡献可能有限
- 难以发表顶会
### 3.4 数据分析方法
**优点**
- 发现新现象
- 提供洞察
- 成本相对较低
- 可视化效果好
**缺点**
- 可能缺乏深度
- 难以量化贡献
- 结果可能主观
- 需要领域知识
## 4. 资源需求评估
### 4.1 计算资源
| 方法类型 | GPU 需求 | 训练时间 | 存储需求 |
|---------|---------|---------|---------|
| 理论分析 | 无 | 无 | 低 |
| 小规模实验 | 1-2 GPU | 数小时-数天 | 中 |
| 大规模实验 | 4-8 GPU | 数天-数周 | 高 |
| 系统构建 | 可变 | 持续 | 高 |
### 4.2 人力资源
**单人项目**
- 理论分析(如有背景)
- 小规模实证研究
- 数据分析
**团队项目**
- 大规模实证研究
- 系统构建
- 跨领域研究
### 4.3 时间资源
**3个月内**
- 小规模实验
- 数据分析
- 理论分析(简单问题)
**6个月内**
- 中等规模实验
- 系统原型
- 理论分析(复杂问题)
**1年内**
- 大规模实验
- 完整系统
- 深入理论研究
+118
View File
@@ -0,0 +1,118 @@
---
name: research-contract
description: 研究合约——在 Claude Scholar 工作流中传递研究状态
metadata:
type: reference
---
# 研究合约
使用本合约在 Claude Scholar 工作流中传递研究状态。
目标是保留:
- 正在研究什么问题,
- 当前存在哪些证据,
- 根据这些证据可得出什么主张,
- 尚存哪些不确定性,
- 下一步应做什么决策或行动。
## 研究问题卡片
当一个模糊的想法演变为研究方向时,使用此卡片。
```md
## 研究问题卡片
问题:
类型:探索性 | 验证性 | 应用性
假设:
为何重要:
当前证据:
缺失证据:
什么能支持它:
什么能证伪它:
最小下一步行动:
决策:探索 | 深入阅读 | 运行实验 | 停止
```
## 证据记录
对论文证据、项目笔记、实验输出和分析产物使用此记录。
```md
## 证据记录
证据 ID
来源:
来源类型:完整论文 | 预印本 | 数据集 | 实验产物 | 项目笔记 | 仅摘要 | 网页占位符
支持:
反驳:
方法 / 数据集 / 评估指标:
局限性:
项目相关性:
主张强度:推测性 | 观察到 | 有支持 | 强有力
```
证据 ID 格式:
- 使用 `ER-YYYYMMDD-shortslug-NN`,例如 `ER-20260513-tta-eeg-01`
- 在项目或研究线索内保持 ID 唯一。
- 使用稳定、可读的短标识。不要使用模糊的 ID,如 `E1``paper1``source-a`
- 当同一证据记录在下游被引用时,重复使用同一证据 ID;仅为不同的来源、产物或分析结果创建新 ID。
## 主张候选
当分析或综合得出可能日后进入报告、论文、反驳或项目计划的表述时,使用此候选。
```md
## 主张候选
主张:
来源证据:
允许的措辞:
禁止的更强措辞:
不确定性:
下一步核查:
决策:保留 | 弱化 | 修订 | 丢弃
```
## 来源可信度等级
使用来源可信度来决定一条笔记能否支持下游综合。
- `完整论文` / `预印本`:当相关方法、数据集、评估指标和局限性均被指明时,可以支持「观察到」、「有支持」或「强有力」的主张。
- `数据集` / `实验产物`:当分析单元、评估指标、来源出处和分析局限性均被指明时,可以支持项目主张。
- `项目笔记`:可以支持假设和计划,但不能支持基于文献的主张,除非它链接到独立的证据记录。
- `仅摘要` / `网页占位符`:仅能支持发现和「待阅读」路由。除非后来被完整论文、预印本或经过验证的产物取代,否则不得用于支持「知识」、手稿或反驳主张。
## 主张提升门禁
在主张进入「知识」、「写作」、报告、手稿草稿或反驳之前,请检查:
1. 该主张至少有一个证据记录 ID。
2. 来源类型对于预期的主张来说足够强。
3. 主张强度没有被静默升级。
4. 允许的措辞和禁止的更强措辞均已记录。
5. 矛盾的证据或缺失的证据已保留。
如果任何一项未通过,则将该主张保留为假设、动机、警告或「待阅读」项目。不要将其打磨成持久的结论。
## 提案就绪门禁
仅在以下条件满足时才生成 `research-proposal.md`
- 已选定一个研究问题卡片,
- 当前证据足以证明问题和方法的合理性,
- 缺失证据已明确且可处理,
- 最小下一步行动比「深入阅读」更具体,
- 关键动机主张有引用或证据记录可用。
如果这些条件不满足,则生成 `research-question-card.md`、差距笔记或信息收集摘要,而非提案。
## 强度规则
- `推测性`:合理的想法,仅有薄弱或间接证据。
- `观察到`:在论文、笔记或实验中已见到,但尚不足以形成持久的结论。
- `有支持`:有明确的证据支持,如论文结果、实验或分析包。
- `强有力`:有多个证据锚点或统计严谨的项目证据支持。
在没有指明证明升级合理性的证据之前,不得将主张提升到更强的等级。
+174
View File
@@ -0,0 +1,174 @@
# 研究计划制定
系统化的研究计划制定方法,确保研究项目顺利推进。
## 1. 时间线规划
### 1.1 研究阶段划分
**典型研究周期**(以6个月为例):
| 阶段 | 时间 | 主要任务 | 交付物 |
|------|------|---------|--------|
| **Phase 1: 准备** | 第1个月 | 文献调研、问题定义 | 文献综述、研究提案 |
| **Phase 2: 探索** | 第2-3个月 | 初步实验、方法验证 | 概念验证、初步结果 |
| **Phase 3: 开发** | 第4-5个月 | 方法优化、全面实验 | 完整实验结果 |
| **Phase 4: 完成** | 第6个月 | 论文撰写、代码整理 | 论文草稿、开源代码 |
### 1.2 时间分配原则
**80/20 原则**
- 80% 时间用于核心工作(实验、分析、写作)
- 20% 时间用于辅助工作(文献、工具、沟通)
**缓冲时间**
- 每个阶段预留 20% 缓冲时间
- 应对意外情况和延期
**并行任务**
- 文献调研贯穿整个过程
- 论文写作可以提前开始(Introduction, Related Work
- 代码整理与实验同步进行
## 2. 里程碑定义
### 2.1 关键里程碑
**Milestone 1: 研究提案完成**
- 时间:第1个月末
- 标准:
- 文献综述完成(20-30篇核心论文)
- 研究问题明确定义
- 方法路线初步确定
- 实验计划制定
**Milestone 2: 概念验证**
- 时间:第3个月末
- 标准:
- 初步实验完成
- 方法可行性验证
- 至少一个正面结果
- 识别主要挑战
**Milestone 3: 完整实验**
- 时间:第5个月末
- 标准:
- 所有实验完成
- 结果达到预期
- 消融实验完成
- 可视化和分析完成
**Milestone 4: 论文提交**
- 时间:第6个月末
- 标准:
- 论文草稿完成
- 代码开源准备
- 内部审阅通过
- 准备投稿
### 2.2 检查点设置
**每周检查**
- 进度回顾
- 问题识别
- 计划调整
**每月评审**
- 里程碑评估
- 风险评估
- 资源调整
## 3. 风险识别与应对
### 3.1 常见风险
**技术风险**
- 方法不work
- 实验结果不理想
- 计算资源不足
- 技术难度超预期
**应对策略**
- 准备备选方案
- 早期概念验证
- 申请额外资源
- 寻求技术支持
**时间风险**
- 进度延期
- 依赖项延迟
- 意外事件
**应对策略**
- 预留缓冲时间
- 并行任务
- 优先级管理
- 及时调整计划
**资源风险**
- GPU 不可用
- 数据集问题
- 人员变动
**应对策略**
- 多个资源渠道
- 数据集备选
- 知识文档化
### 3.2 风险监控
**红色预警**(立即处理):
- 核心方法失败
- 关键资源缺失
- 严重进度延期
**黄色预警**(密切关注):
- 部分实验不理想
- 资源紧张
- 轻微延期
**绿色状态**(正常推进):
- 按计划进行
- 资源充足
- 结果符合预期
## 4. 资源分配
### 4.1 计算资源
**GPU 分配**
- 探索阶段:1-2 GPU
- 开发阶段:2-4 GPU
- 完成阶段:4-8 GPU(大规模实验)
**存储分配**
- 数据集:100-500 GB
- 模型检查点:50-200 GB
- 实验日志:10-50 GB
### 4.2 人力分配
**单人项目**
- 文献调研:20%
- 实验开发:50%
- 论文写作:20%
- 其他:10%
**团队项目**
- 研究负责人:规划、指导、写作
- 研究助理:实验、分析、编码
- 合作者:特定模块、审阅
### 4.3 时间分配
**每周时间**40小时):
- 核心研究:25-30小时
- 文献阅读:5-8小时
- 会议讨论:3-5小时
- 其他事务:2-5小时
**每日时间**
- 深度工作:4-6小时(上午)
- 实验监控:2-3小时
- 文献和写作:1-2小时
- 沟通协作:1小时
+210
View File
@@ -0,0 +1,210 @@
# 研究问题制定
将研究兴趣转化为具体、可执行的研究问题的系统化方法。
## 1. SMART 原则
好的研究问题应该满足 SMART 原则:
### 1.1 Specific(具体的)
**不好的问题**
- "如何提高模型性能?"(太宽泛)
**好的问题**
- "如何通过改进注意力机制来提高 Transformer 在长文本理解任务上的性能?"
**关键要素**
- 明确的研究对象(Transformer
- 具体的改进方向(注意力机制)
- 明确的任务场景(长文本理解)
- 清晰的目标(提高性能)
### 1.2 Measurable(可衡量的)
研究问题应该有明确的评估标准:
**示例**
- "提高性能" → "在 SQuAD 数据集上提高 F1 分数"
- "改善可解释性" → "提高人类评估的 faithfulness 分数"
**评估维度**
- 定量指标:准确率、F1、BLEU、困惑度
- 定性指标:人类评估、案例分析
- 效率指标:训练时间、推理速度、内存占用
### 1.3 Achievable(可实现的)
考虑资源和能力限制:
**资源评估**
- 计算资源:GPU 数量和类型
- 数据资源:数据集的可获得性和质量
- 时间资源:研究周期(3个月、6个月、1年)
- 人力资源:团队规模和专业技能
**可行性检查**
- 是否有类似工作作为基础?
- 所需技术是否已经成熟?
- 数据集是否公开可用?
- 计算成本是否在预算内?
### 1.4 Relevant(相关的)
研究问题应该对学术界或工业界有价值:
**学术价值**
- 填补研究空白
- 挑战现有假设
- 提供新的理论视角
- 推动方法论进步
**实际价值**
- 解决实际应用问题
- 提高系统性能
- 降低成本或资源消耗
- 改善用户体验
### 1.5 Time-bound(有时限的)
设定合理的研究时间框架:
**短期目标**1-3个月):
- 文献调研和问题定义
- 初步实验和概念验证
**中期目标**3-6个月):
- 方法开发和优化
- 全面实验和分析
**长期目标**6-12个月):
- 论文撰写和投稿
- 代码开源和社区推广
## 2. 研究问题类型
### 2.1 探索性问题(Exploratory
**特点**:探索未知领域,发现新现象
**示例**
- "Transformer 的注意力机制在处理长文本时表现出什么模式?"
- "大语言模型在推理任务中使用了哪些内部表示?"
**适用场景**
- 新兴研究领域
- 缺乏理论基础的现象
- 需要深入理解的复杂系统
### 2.2 验证性问题(Confirmatory
**特点**:验证假设或理论
**示例**
- "增加模型深度是否能提高长文本理解性能?"
- "预训练是否对低资源语言任务有帮助?"
**适用场景**
- 有明确假设需要验证
- 挑战现有理论或观点
- 复现和扩展已有工作
### 2.3 应用性问题(Applied
**特点**:解决实际应用问题
**示例**
- "如何在保持性能的同时将模型大小减少50%?"
- "如何使对话系统更好地理解用户意图?"
**适用场景**
- 有明确的应用需求
- 需要在约束条件下优化
- 工业界合作项目
## 3. 研究问题评估标准
### 3.1 重要性(Significance
**评估维度**
- **学术影响**:是否推动领域发展?
- **实际价值**:是否解决重要问题?
- **受众规模**:有多少人关心这个问题?
**评分标准**1-5分):
- 5分:突破性问题,影响整个领域
- 4分:重要问题,多个研究组关注
- 3分:有价值问题,部分研究者关注
- 2分:边缘问题,少数人关注
- 1分:琐碎问题,几乎无人关注
### 3.2 新颖性(Novelty
**评估维度**
- **问题新颖性**:是否是新问题?
- **方法新颖性**:是否用新方法?
- **视角新颖性**:是否有新视角?
**评分标准**1-5分):
- 5分:全新问题或突破性方法
- 4分:新问题或显著改进的方法
- 3分:新视角或方法组合
- 2分:增量改进
- 1分:重复已有工作
### 3.3 可行性(Feasibility
**评估维度**
- **技术可行性**:现有技术能否实现?
- **资源可行性**:资源是否充足?
- **时间可行性**:时间是否合理?
**评分标准**1-5分):
- 5分:完全可行,资源充足
- 4分:基本可行,资源足够
- 3分:有挑战,需要努力
- 2分:困难较大,需要突破
- 1分:几乎不可行
### 3.4 综合评估
**决策矩阵**
| 重要性 | 新颖性 | 可行性 | 建议 |
|--------|--------|--------|------|
| 高 | 高 | 高 | 优先执行 |
| 高 | 高 | 中 | 值得尝试 |
| 高 | 中 | 高 | 稳妥选择 |
| 中 | 高 | 高 | 可以考虑 |
| 低 | * | * | 重新考虑 |
## 4. 支持与证伪检查
每个研究问题都必须说明什么结果会支持它,什么结果会削弱或推翻它。
### 4.1 必填字段
```md
Question:
Hypothesis:
Current evidence:
Missing evidence:
What would support it:
What would falsify it:
Minimal next action:
Decision: explore | read more | run experiment | stop
```
### 4.2 决策含义
- `explore`:问题可能有价值,但还缺少基本文献或问题边界。
- `read more`:需要先补关键相关工作、baseline、dataset 或 metric。
- `run experiment`:问题、假设、支持证据和最小实验已经足够明确。
- `stop`:重要性、新颖性、可行性或证据边界不足,不建议继续投入。
### 4.3 写作要求
- 不要只写"值得研究";必须说明为什么值得研究。
- 不要只写"需要更多实验";必须说明最小下一步实验是什么。
- 不要只写"有文献支持";必须列出当前证据和缺失证据。
- 不要把探索性问题写成已经验证的结论。
+189
View File
@@ -0,0 +1,189 @@
# Zotero MCP 集成指南
通过 Zotero MCP 服务器实现文献管理的自动化集成。
## 1. 可用工具
### 1.1 浏览工具
| 工具 | 功能 | 使用场景 |
|------|------|---------|
| `zotero_get_collections` | 列出所有集合 | 查看已有研究项目 |
| `zotero_get_collection_items` | 获取集合中的条目 | 浏览特定集合的论文 |
| `zotero_search_items` | 搜索库中的条目 | 按关键词查找已有论文 |
| `zotero_get_item_metadata` | 批量获取条目元数据 | 获取论文详细信息 |
| `zotero_get_item_fulltext` | 获取 PDF 全文 | 阅读论文内容 |
### 1.2 添加工具
| 工具 | 功能 | 使用场景 |
|------|------|---------|
| `zotero_add_items_by_identifier` | 智能导入论文 | 先解析 DOI / arXiv / PDF,再尽量落成 paper 或 preprint |
| `zotero_add_items_by_doi` | 通过 DOI 添加论文 | 自动获取元数据,并默认尝试 PDF cascade |
| `zotero_add_items_by_arxiv` | 通过 arXiv ID 添加预印本 | 适合 arXiv-only 论文,并默认尝试 arXiv PDF |
| `zotero_add_item_by_url` | 保存网页为条目 | 仅在确实需要保留网页资源时使用 |
| `zotero_create_collection` | 创建集合 | 组织研究项目 |
| `zotero_find_and_attach_pdfs` | 批量补挂 PDF | 对已有条目再跑一遍 PDF cascade |
| `zotero_add_linked_url_attachment` | 附加 URL 链接 | 关联在线资源 |
### 1.3 引用工具
| 工具 | 功能 | 使用场景 |
|------|------|---------|
| `inject_citations` | 注入引用到 Word | 生成引用格式 |
## 2. 集合组织策略
### 2.1 命名规范
```
Research-{主题关键词}-{YYYY}
```
示例:
- `Research-TransformerInterpretability-2026`
- `Research-BrainDecoding-2026`
- `Research-RLHF-2026`
### 2.2 标准子集合结构
```
📁 Research-{topic}-{date}
├── 📁 Core Papers(核心论文)
├── 📁 Methods(方法论文)
├── 📁 Applications(应用论文)
├── 📁 Baselines(基线论文)
└── 📁 To-Read(待读论文)
```
各子集合用途:
| 子集合 | 收录标准 | 典型数量 |
|--------|---------|---------|
| Core Papers | 直接相关、高引用的关键论文 | 5-15 篇 |
| Methods | 技术方法参考,可借鉴的方法论 | 10-20 篇 |
| Applications | 应用场景参考,领域实践 | 5-10 篇 |
| Baselines | 实验对比基准,需要复现的工作 | 3-8 篇 |
| To-Read | 初步筛选,待深入阅读 | 不限 |
## 3. 自动化工作流
### 3.1 论文发现与导入
```
WebSearch 搜索论文
从搜索结果中提取 DOI / arXiv ID / landing-page URL
add_items_by_identifier 智能导入到 Zotero
工具内部先尝试页面显式 PDF,再回退到 Unpaywall
如果 Zotero Web API 无法直接挂上 PDF,而本地 Zotero Desktop 正在运行,则自动走本地修复路径
必要时运行 `zotero_reconcile_collection_duplicates` 做标准导入后去重
get_item_fulltext 读取全文进行分析
```
默认终端输出只需要告诉用户:
- Imported as paper + PDF attached
- Imported as paper
- Saved as webpage + PDF attached
- Saved as webpage
- Collection dedupe summary: duplicate groups N, duplicates trashed M
- Missing PDF postpass: repaired N items
只有在调试时,才展开 `route``pdf_source` 等实现细节。import ledger 属于内部状态,不应假设存在公开 MCP tool 用于读取它。
### 3.2 DOI 提取技巧
**从搜索结果 URL 中识别 DOI**
- `https://doi.org/10.xxxx/xxxxx` — 直接 DOI 链接
- `https://dl.acm.org/doi/10.xxxx/xxxxx` — ACM Digital Library
- `https://arxiv.org/abs/xxxx.xxxxx` — arXivDOI`10.48550/arXiv.xxxx.xxxxx`
**常见 DOI 格式**
-`10.` 开头,包含 `/` 分隔符
- 例:`10.1038/s41586-023-06747-5`Nature
- 例:`10.48550/arXiv.2301.00234`arXiv
- 例:`10.1145/3580305.3599256`ACM/KDD
**CrossRef 查询**
- 当 URL 中没有明显 DOI 时,可通过论文标题在 CrossRef 搜索获取 DOI
### 3.3 全文阅读与笔记
```
get_item_fulltext 获取全文
分析论文内容
提取关键信息
生成结构化笔记
```
### 3.4 笔记模板
每篇论文的结构化笔记应包含:
```markdown
## [论文标题]
**基本信息**
- 作者:
- 会议/期刊:
- 年份:
- DOI
**研究问题**
- 解决什么问题?
- 为什么重要?
**核心方法**
- 主要技术路线
- 关键创新点
**关键发现**
- 主要实验结果
- 重要结论
**局限性**
- 方法局限
- 实验局限
**与本研究的关联**
- 可借鉴之处
- 差异和改进空间
```
## 4. 常见问题
### 4.1 API 速率限制
Zotero API 有速率限制,批量添加时建议:
- 每批不超过 10 篇论文
- 批次之间适当间隔
- 如遇到 429 错误,等待后重试
### 4.2 PDF 全文索引延迟
新上传的 PDF 需要时间索引:
- `zotero_get_item_fulltext` 返回空时,稍后重试
- Zotero 客户端需要运行才能完成索引
- 大型 PDF 索引时间较长
### 4.3 DOI 无法识别
部分论文可能没有标准 DOI
- arXiv 预印本:使用 `10.48550/arXiv.{id}` 格式
- Workshop 论文:尝试从出版商页面获取
- 无法获取 DOI:优先尝试识别 arXiv ID 或页面中的 `citation_doi` / `citation_pdf_url`;只有仍无法确认 identifier 时,才回退为 `webpage`
### 4.4 OA PDF 不可用
非开放获取论文无法通过 Unpaywall 获取 PDF
- 检查作者主页是否有预印本版本
- 检查 arXiv 是否有对应版本
- 若仍拿不到 PDF,可在 Zotero Desktop 中手动附加 PDF,之后再运行全文或注释相关工作流