概念说明
Notemd 能从您的笔记中提取关键概念,并生成独立的概念笔记文件。LLM 会识别核心术语,在可配置的文件夹中为每个概念生成一个 .md 文件,同时可选择性地添加指向原始笔记的回链。它支持同义词过滤、按任务选择模型、文件名规范化处理以及四步去重引擎。该功能属于 Obsidian AI知识管理指南 的内容。
概览
概念笔记是构建互联知识库的基础要素。当您处理某条笔记时,Notemd:
- 将您的文本发送到 LLM,并附带结构化的提取提示
- 解析 LLM 响应中的
CONCEPT:行 - 在指定文件夹中为每个概念创建一个
.md文件。 - (如已启用)为源笔记添加反向链接
它是如何工作的?
提取流程
Source Note → Split into Chunks → LLM per Chunk → Parse CONCEPT: Lines
→ Deduplicate via Set → Create .md Files → Add Backlinks
→ (Optional: Generate Log)
提取提示词
LLM 收到一条指令,要求其执行以下操作:
- 提取与文档主题相关的名词或名词短语
- 优先考虑具体性——选择“介电松弛”而非“松弛”。
- 转换为单数形式 — “models”将变为“model”
- 抑制子概念 —— 如果出现“介电松弛”,则不要同时提取“松弛”这一概念。
- 跳过参考文献/书目部分、普通名词以及公司/产品名称
- 每行输出一个概念,格式为
CONCEPT: Term Name
同义词抑制(可选):在提示语前添加“尽可能避免提取同义词、语义相似的核心概念或关键词”。
专注学习领域(可选):在开头添加 Relevant Fields: [domain] 以将提取内容限制在特定学科范围内。
语言覆盖(可选):会在后面添加“输出内容必须使用[语言]。”
分块处理
较长的笔记会通过 settings.chunkWordCount 进行分割。每个片段会单独发送。所有片段中的概念会被汇总到 Set 中——不同片段中的重复内容会被自动删除。单个片段出现 LLM 错误也不会导致整个操作中止。
概念说明文档的创建
文件名规则
| 规则 | 行为 |
|---|---|
| 连字符/下划线 | 已替换为空格 |
| 特殊字符 | 已移除的内容:反斜杠、正斜杠、冒号、星号、问号、引号、尖括号、竖线、井号、插入符、方括号 |
| 空白字符 | 已折叠并修剪 |
| 最大长度 | 100个字符(已截断并重新修剪) |
| 空结果/全点结果 | 已静默跳过 |
示例:A-B: Key*Term 变为 A B KeyTerm.md
模板
完整模板(启用外部链接,禁用简化模板):
# Concept Name
## Linked From
- [[SourceNoteBasename]]
最小模板(当 extractConceptsMinimalTemplate: true 时):
# Concept Name
正在更新现有笔记
当概念文件已存在时:
- 如果已启用反向链接且来源备注尚未列出,则添加一条反向链接。
- 如果存在
## Linked From部分,则在下一个##标题之前插入。 - 如果不存在
## Linked From,则在末尾追加该部分。 - 会检查重复的反向链接并跳过它们。
配置
| 设置 | 默认值 | 效果 |
|---|---|---|
useCustomConceptNoteFolder | true | 主开关。关闭 = 不创建笔记 |
conceptNoteFolder | ''(已禁用) | 概念笔记的文件夹路径 |
extractConceptsMinimalTemplate | true | 仅标题备注(无关联链接) |
extractConceptsAddBacklink | false | 在独立提取过程中添加反向链接 |
extractConceptsProvider / extractConceptsModel | DeepSeek | 用于概念提取的每任务 LLM |
extractConceptsLanguage | 'en' | 概念名称的输出语言 |
replaceSynonymsDuringConceptExtraction | false | 在提示词中启用同义词抑制功能 |
generateConceptLogFile | false | 编写一个 .log 列表,列出已创建的概念 |
重要提示: extractConceptsAddBacklink 和 extractConceptsMinimalTemplate 这两个设置仅会影响专用提取命令。而“添加链接”命令始终会生成包含反向链接的完整模板笔记。
去重
dedup命令(Notemd: Check & remove duplicate concept notes)会执行5步分析:
步骤1:精确匹配文件名
在配置的范围内进行不区分大小写的基名比较。
第2步:复数形式检测
移除后缀:从 -ies 到 -y,-es 被移除,-s 也被移除。将单数形式与范围文件进行比较。不支持不规则复数形式(如 children/child)。
步骤3:符号规范化
适用范围:toLowerCase(),将连字符/下划线替换为空格,去除非字母数字字符,合并空白字符。所有经过相同规范化处理的匹配项都会被标记出来。
第4步:单词隔离
单字概念笔记会与多字范围文件名进行比对。当范围为 concept_folder_only 时不会执行。
第5步:确认与删除
所有候选项都会显示在确认弹窗中。已通过审核的项会被移至系统回收站。在每次删除操作之间都可以取消该操作。
作用域模式
| 模式 | 与……相比 |
|---|---|
vault(默认) | 除概念文件夹外的所有 vault .md 文件 |
concept_folder_only | 文件夹中的其他概念说明文档 |
include | 特定列表文件夹中的文件 |
exclude | 除概念文件夹和已列出的文件夹之外的所有保险库文件 |
使用方法
提取概念(独立版)
- 打开一个笔记
- 从命令面板中运行**“Notemd: Extract concepts”**
- 概念文档会在配置好的文件夹中生成。
提取并生成内容
“Notemd:提取概念并生成标题”——首先提取概念,然后对该概念文件夹中的每条笔记执行“根据标题生成”操作。这样可以为文件夹中的所有概念笔记生成内容,而不仅仅是新创建的那些。
从所选内容创建维基链接
- 在编辑器中高亮文本
- 运行**“Notemd:从所选内容创建维基链接”**
- 文本被包裹在
[[...]]中,随后生成了一份概念说明。
技巧
- 先设置概念文件夹——没有它就无法创建任何笔记。如果未设置,会弹出警告对话框。
- 使用任务专用模型——概念提取任务适合使用成本较低的模型(如 GPT-4o-mini、DeepSeek)。将昂贵的模型留作研究或翻译任务使用。
- 为那些存在多个术语指代同一概念的技术领域启用同义词抑制功能。
- 定期去重——在批量处理完成后运行去重命令,以发现近乎重复的项。
- 每次运行时,日志文件都会被覆盖,而不会追加内容。如果需要之前的记录,请将其复制下来。
后续步骤
- Wiki-Links — 概念如何实现内联链接
- 图表 — 可视化概念之间的关系
- 工作流 — 与其他任务串联执行