跳到主要内容

概念说明

💡TL;DR

Notemd 能从您的笔记中提取关键概念,并生成独立的概念笔记文件。LLM 会识别核心术语,在可配置的文件夹中为每个概念生成一个 .md 文件,同时可选择性地添加指向原始笔记的回链。它支持同义词过滤、按任务选择模型、文件名规范化处理以及四步去重引擎。该功能属于 Obsidian AI知识管理指南 的内容。

概览

概念笔记是构建互联知识库的基础要素。当您处理某条笔记时,Notemd:

  1. 将您的文本发送到 LLM,并附带结构化的提取提示
  2. 解析 LLM 响应中的 CONCEPT:
  3. 在指定文件夹中为每个概念创建一个 .md 文件。
  4. (如已启用)为源笔记添加反向链接

它是如何工作的?

提取流程

Source Note → Split into Chunks → LLM per Chunk → Parse CONCEPT: Lines
→ Deduplicate via Set → Create .md Files → Add Backlinks
→ (Optional: Generate Log)

提取提示词

LLM 收到一条指令,要求其执行以下操作:

  • 提取与文档主题相关的名词或名词短语
  • 优先考虑具体性——选择“介电松弛”而非“松弛”。
  • 转换为单数形式 — “models”将变为“model”
  • 抑制子概念 —— 如果出现“介电松弛”,则不要同时提取“松弛”这一概念。
  • 跳过参考文献/书目部分、普通名词以及公司/产品名称
  • 每行输出一个概念,格式为 CONCEPT: Term Name

同义词抑制(可选):在提示语前添加“尽可能避免提取同义词、语义相似的核心概念或关键词”。

专注学习领域(可选):在开头添加 Relevant Fields: [domain] 以将提取内容限制在特定学科范围内。

语言覆盖(可选):会在后面添加“输出内容必须使用[语言]。”

分块处理

较长的笔记会通过 settings.chunkWordCount 进行分割。每个片段会单独发送。所有片段中的概念会被汇总到 Set 中——不同片段中的重复内容会被自动删除。单个片段出现 LLM 错误也不会导致整个操作中止。

概念说明文档的创建

文件名规则

规则行为
连字符/下划线已替换为空格
特殊字符已移除的内容:反斜杠、正斜杠、冒号、星号、问号、引号、尖括号、竖线、井号、插入符、方括号
空白字符已折叠并修剪
最大长度100个字符(已截断并重新修剪)
空结果/全点结果已静默跳过

示例:A-B: Key*Term 变为 A B KeyTerm.md

模板

完整模板(启用外部链接,禁用简化模板):

# Concept Name

## Linked From
- [[SourceNoteBasename]]

最小模板(当 extractConceptsMinimalTemplate: true 时):

# Concept Name

正在更新现有笔记

当概念文件已存在时:

  1. 如果已启用反向链接且来源备注尚未列出,则添加一条反向链接。
  2. 如果存在 ## Linked From 部分,则在下一个 ## 标题之前插入。
  3. 如果不存在 ## Linked From,则在末尾追加该部分。
  4. 会检查重复的反向链接并跳过它们。

配置

设置默认值效果
useCustomConceptNoteFoldertrue主开关。关闭 = 不创建笔记
conceptNoteFolder''(已禁用)概念笔记的文件夹路径
extractConceptsMinimalTemplatetrue仅标题备注(无关联链接)
extractConceptsAddBacklinkfalse在独立提取过程中添加反向链接
extractConceptsProvider / extractConceptsModelDeepSeek用于概念提取的每任务 LLM
extractConceptsLanguage'en'概念名称的输出语言
replaceSynonymsDuringConceptExtractionfalse在提示词中启用同义词抑制功能
generateConceptLogFilefalse编写一个 .log 列表,列出已创建的概念

重要提示: extractConceptsAddBacklinkextractConceptsMinimalTemplate 这两个设置仅会影响专用提取命令。而“添加链接”命令始终会生成包含反向链接的完整模板笔记。

去重

dedup命令(Notemd: Check & remove duplicate concept notes)会执行5步分析:

步骤1:精确匹配文件名

在配置的范围内进行不区分大小写的基名比较。

第2步:复数形式检测

移除后缀:从 -ies-y-es 被移除,-s 也被移除。将单数形式与范围文件进行比较。不支持不规则复数形式(如 children/child)。

步骤3:符号规范化

适用范围:toLowerCase(),将连字符/下划线替换为空格,去除非字母数字字符,合并空白字符。所有经过相同规范化处理的匹配项都会被标记出来。

第4步:单词隔离

单字概念笔记会与多字范围文件名进行比对。当范围为 concept_folder_only 时不会执行。

第5步:确认与删除

所有候选项都会显示在确认弹窗中。已通过审核的项会被移至系统回收站。在每次删除操作之间都可以取消该操作。

作用域模式

模式与……相比
vault(默认)除概念文件夹外的所有 vault .md 文件
concept_folder_only文件夹中的其他概念说明文档
include特定列表文件夹中的文件
exclude除概念文件夹和已列出的文件夹之外的所有保险库文件

使用方法

提取概念(独立版)

  1. 打开一个笔记
  2. 从命令面板中运行**“Notemd: Extract concepts”**
  3. 概念文档会在配置好的文件夹中生成。

提取并生成内容

“Notemd:提取概念并生成标题”——首先提取概念,然后对该概念文件夹中的每条笔记执行“根据标题生成”操作。这样可以为文件夹中的所有概念笔记生成内容,而不仅仅是新创建的那些。

从所选内容创建维基链接

  1. 在编辑器中高亮文本
  2. 运行**“Notemd:从所选内容创建维基链接”**
  3. 文本被包裹在 [[...]] 中,随后生成了一份概念说明。

技巧

  • 先设置概念文件夹——没有它就无法创建任何笔记。如果未设置,会弹出警告对话框。
  • 使用任务专用模型——概念提取任务适合使用成本较低的模型(如 GPT-4o-mini、DeepSeek)。将昂贵的模型留作研究或翻译任务使用。
  • 为那些存在多个术语指代同一概念的技术领域启用同义词抑制功能
  • 定期去重——在批量处理完成后运行去重命令,以发现近乎重复的项。
  • 每次运行时,日志文件都会被覆盖,而不会追加内容。如果需要之前的记录,请将其复制下来。

后续步骤

  • Wiki-Links — 概念如何实现内联链接
  • 图表 — 可视化概念之间的关系
  • 工作流 — 与其他任务串联执行