Obsidian 接入 AI:任务交给 Agent,还是边写边问 AI?|以 Codex(ChatGPT) App 与 Claudian + Codex CLI 为例
先看完整演示,再结合下文判断外部 Agent 和内嵌 Agent 分别适合什么工作。
📺 YouTube 视频:Obsidian 接入 AI:任务交给 Agent,还是边写边问 AI?
把 AI 接进 Obsidian 之后,常见的分歧不是“要不要用 AI”,而是从哪里发起工作:把一个明确任务交给独立的 Agent,还是留在当前笔记里,一边阅读和写作,一边向 AI 提问?
这篇文章把前一种方式称为外部 Agent,把后一种称为内嵌 Agent。前者以 Codex App 为例,后者以 Claudian + Codex CLI 为例。它们能接触的内容可以是同一座 Obsidian Vault,差别主要在于任务从哪里开始,以及工作过程围绕什么展开。
理解这一区别之后,选择工具就不必围绕“谁更强”展开。更有用的问题是:现在面对的是一项独立任务,还是一篇正在处理的笔记?
要做这个判断,可以从界面、架构、接入与配置、实际工作流四个维度来看。它们不是两条能力边界,而是两种更顺手的工作方式。
外部 Agent 有独立的工作界面。以 Codex App 为例,把 Vault 作为项目打开后,可以在项目中查看文件、交代任务并查看执行结果;需要继续阅读或编辑笔记时,再回到 Obsidian。其他独立运行、能够访问 Vault 的 Agent,也可以放在这一类里理解。
内嵌 Agent 则出现在 Obsidian 的当前工作现场。比如在当前笔记右侧打开 Claudian,对着正在阅读的内容提问、选中文字修改,再继续整理笔记。界面上的差异很直接:外部模式会在 Agent 与 Obsidian 之间配合切换;内嵌模式的主要操作集中在当前笔记。
从架构看,两者最终处理的都可以是同一份 Obsidian Vault。外部模式中,Agent 在 Obsidian 之外启动,通过本地文件系统读取和修改文件;内嵌模式中,需求从 Obsidian 界面发出,Claudian 插件连接后面的 Codex CLI,再处理本地文件。入口不同,并不意味着资料被分成两套。
接入链路也不同。Codex App 的基本步骤是安装桌面端、建立本地项目、把 Vault 选进项目,并在项目下新建对话。Claudian + Codex CLI 还需要先准备 Codex CLI,再安装 Claudian,在插件设置中启用 Codex、选择模型,最后回到对话框开始使用。
这只是本文所用两套方案的接入差异,不应把它扩大成所有外部或内嵌 Agent 的统一结论。对日常使用影响更大的,是后面的工作流。
外部 Agent 的常见流程是:明确任务,提供需要的上下文,交给 Agent 执行,再检查结果。比如想快速理解一套 Obsidian 启动包,可以把启动包作为项目打开,让 Agent 分析目录、模板和说明,并在仓库中生成一篇使用说明。任务完成后,再回到 Obsidian 查看产物。
内嵌 Agent 的流程则从当前笔记开始。正在读一篇英文视频资料时,如果想到一个问题,可以先在笔记里记录问题,再选中它,让 Claudian 基于当前笔记回答,并把答案写到问题下方。完成后,阅读和整理并不会离开这篇笔记。
因此,外部 Agent 更像把一件事委派出去;内嵌 Agent 更像让 AI 加入眼前正在进行的工作。这是工作倾向的区别,不是谁能做、谁不能做的判断。
选择的起点不必是把两套模式一次性配齐。对还不知道自己需求从哪里产生的新手,可以先选一种,把一件真实任务跑通;两类需求稳定出现后,再把两个入口组合起来。
如果只选一个,本文会优先从 Codex App 这类桌面端 Agent 开始:它的接入链路相对更短,把 Vault 关联为项目后就能新建任务;插件的发现与调用入口也更直观,适合先把资料导入、整理和内容输出等任务跑起来。
但这不是硬性规则。工作始终围绕当前笔记、当前选区或阅读写作中的问题时,从内嵌 Agent 开始同样合理。真正的判断标准是工作中心和任务范围。
独立任务、跨文件、批量处理,或跨工具的输入与输出,更适合外部 Agent。围绕当前笔记、当前选区,以及阅读和写作时刚刚出现的问题,更适合内嵌 Agent。
我也会按“输入、处理、输出”来安排入口。把 YouTube、Bilibili 等平台内容导入 Obsidian,或根据大纲生成 PPT 等需要调用其他工具的输出任务,通常交给外部 Agent。知识处理要看范围:围绕当前笔记时更常用 Claudian;涉及跨文件或批量处理时,再切回外部 Agent。这是我的使用习惯,不是工具的能力边界。
两个入口不需要频繁切换。当前入口还顺手,就继续使用;独立任务完成、工作中心回到当前笔记时,从外部切到内嵌;当前笔记中的需求扩大成跨文件、批量处理或跨工具输出时,再从内嵌切回外部。
一个完整例子是:先在 Codex App 中调用视频导入 Skill,把视频资料保存到 Vault。
接着回到 Obsidian 阅读生成的笔记,在 Claudian 中基于当前笔记总结内容、整理结果,并生成 PPT 大纲。
当任务变为“根据大纲制作 PPT”后,带着大纲路径回到 Codex App,调用 PPT 插件生成演示文稿。
这个过程的重点不在固定使用哪一个入口,而在于让入口跟着任务阶段变化:外部 Agent 负责导入,内嵌 Agent 负责当前笔记的分析和整理,外部 Agent 再完成跨工具输出。
外部 Agent 从独立任务出发,更偏任务中心;内嵌 Agent 从当前笔记出发,更贴近工作现场。开始时,选一个入口完成一次真实任务即可;两个都用时,再按工作中心和任务范围分工,任务变了再切换入口。
协作时还要守住两个简单边界:同一份文件、同一时间只让一个 Agent 修改;需要继续使用的重要结论、处理范围和下一步都写回 Vault。这样即使换了入口,后续工作仍有可以接续的上下文。
如果还没有开始,可以挑一项真实任务,选一个入口完整跑一遍,再观察自己的工作更多是从“明确任务”开始,还是从“当前笔记”开始。这个观察比预先比较所有功能更能帮助你做出长期选择。