AI 代理
一个人写东西很孤单吧?来认识一位会陪你一起读笔记、写笔记、整理笔记的聪明 AI 朋友!
💻🆚📱 这份文档介绍的完整代理(安装 CLI + 登录,从资料搜集、语义搜索到生成思维导图)仅限从 ObsiKO 官网下载的桌面版(Mac、Windows)。不过现在多了只要填入 API 密钥就能用的纯对话模式,所以在 iPhone、iPad、Android、浏览器、Mac App Store 版上也能和 AI 对话、整理笔记!→ 16-8 纯对话模式(移动版、网页版)
🪟 Windows 只要是从 ObsiKO 官网下载的应用程序,就能照这一页使用 — Claude、Codex 代理、连接外部 AI 应用程序 (MCP)、git 都行。唯一的例外:Windows 上看不到 Gemini 代理引擎(请看下面的“引擎”— Gemini 可以填入 API 密钥、改用对话引擎)。Mac App Store 版的 AI 是纯对话(没有 CLI 代理、git、连接外部 AI 应用程序)→ 16-8 纯对话模式(移动版、网页版)
🚀 想直接上手? 下面的应用子页面 (16-1~16-12) 会一步一步教你工作流程、LLM 维基、推荐提示词,一直到纯对话模式!
💳 搞不清楚哪些要付费(额度)、哪些是订阅? 从 ⓒ 标记的意思到申请 API 密钥 → 16-9 AI 收费说明(订阅与额度)
← 回首页:ObsiKO 101
🎬 跟着做:连接 AI — 电脑与手机两条路(韩文页面)
它藏在哪里?🧐
- 打开右侧边栏,AI 代理面板已经精神抖擞地在等你了。
- 在输入框轻松说出你想要的就好。代理会仔细读过笔记库里的文件,利落地帮你编辑好!

▲ 在右侧面板和 AI 助手对话,一起整理笔记。(这一页的完整代理仅限桌面版;纯对话模式在网页版、移动版也能用)
随你挑选的 AI 引擎 🧠
- 点击输入框下方工具栏的引擎选择按钮 (✨),菜单会往上展开。
- 可以从 Claude、Gemini、Codex 里挑一个你喜欢的聪明帮手!(不过每个工具都要先安装它的 CLI 并登录,或是用 API 密钥设置环境变量。)ObsiKO 只会把你的密钥安全地转交给各个工具,绝不偷看,请放心!
- 🔑 Gemini 要用 Google 账号登录 Antigravity CLI (
agy):从 2026 年 6 月 18 日起,旧的 Gemini CLI 不再服务个人账号(免费、Google AI Pro、Ultra),改由后继的 Antigravity CLI 接手。免费的 Google 账号也能用(额度以周计算),订阅 Google AI Pro、Ultra 的话额度更宽裕(方案说明 ↗)。在终端用curl -fsSL https://antigravity.google/cli/install.sh | bash安装,运行一次agy并用 Google 账号登录后,ObsiKO 就会自动改用 agy 运行(不需要 API 密钥,使用 Gemini 3.x 模型)。没有 agy 时会退回旧 CLI + API 密钥的方式,所以原本的用户也能照常使用。用引擎说明 (?) 里的安装、登录按钮也能一次搞定。 - 🪟 Windows 的引擎清单里没有 Gemini 代理 — 因为 ObsiKO 还不支持在 Windows 上安装、运行 Antigravity CLI。请填入 API 密钥,改用
Gemini · 对话引擎。 - 不知道选哪个的话,推荐 Claude(说明“?”里也会标上“(推荐)”)。因为会自己检查的循环、看扫描 PDF 与图片这些功能,在 Claude 上跑得最好。
- 引擎清单会一起显示各引擎的安装版本(像
v0.3.x)和各个条目实际使用的模型 ID。像“默认模型”这类条目,只要把那个引擎运行过一次,就会改成显示实际用到的最新模型(并记住这个值,下次也照样显示);更新 CLI 后,版本显示也会跟着更新。(安装、连接说明在说明“?”里,用各模型旁的 [安装]、[登录] 按钮。) - 第一次安装觉得无从下手? CLI 还没装时跳出的说明窗口,会从怎么打开终端(Mac:⌘+Space 调出 Spotlight →“终端”/Windows:开始按钮或 ⊞Win →“终端”或“PowerShell”)一路教到安装、登录命令,还附上 [复制] 按钮。直接粘贴 (Mac ⌘V/Windows Ctrl+V) 就搞定!
- 下面介绍的资料搜集、语义搜索工具,不只 Claude,选 Gemini、Codex 也能用。Gemini 由 ObsiKO 自动接好、不必设置;Codex 则要在选项 (≡) 打开“把 obsiko 工具连给 Codex”(默认关闭 — 打开后 Codex 的文件保护(沙箱)会解除,可能改到笔记库外的文件,所以打开时会再确认一次)。另外,在“变更前先检阅”的工作副本上工作时,Codex 的工具连接会关闭。 Claude 专属的只有两项 — 扫描 PDF 的 OCR 和看图片。(顺带一提,直接打开网页来读、截取画面这两项,在所有引擎都是关闭的 — 因为常常卡在某些网站,为了稳定就关掉了,改用网络搜索结果来撰写。)
安全第一!ObsiKO 的严密保护 🛡️
- 代理的活动范围只限于当前的笔记库。想碰笔记库外面重要的电脑文件、或运行奇怪的命令,ObsiKO 都会毫不留情地挡下来!
- 代理修改文件后,文件树会立刻更新给你看;要是代理想覆盖你正在编辑(还没存盘)的文件,一定会先跳出警告。你写的东西很珍贵嘛!
- 也能指定不给 AI 看的笔记 🔒:日记、健康记录这类敏感笔记,在前置元数据加一行
ai: deny,或用.obsiko-ai-ignore文件把整个文件夹藏起来。反过来,也能确认回答是根据哪些笔记([S1]引用、依据清单)。→ 16-10 AI 依据与隐私
越用越顺手的功能 ✨
- 回答利落地保存为文件:像“帮我整理○○”“帮我写一篇△△”这样请它做出东西时,代理不会在对话里洋洋洒洒写一大串,而是保存为干净的
.md文件。(简短的问题、说明就直接在对话里回答。) - 图表放进笔记里,而且是真正的图表、不是图片!:像“用这些数字帮我画个图表”这样给它数值数据,就会在笔记里放进
```chart块 — ObsiKO 会当场画成真正的 SVG 图表,导出、演示文稿时也原样呈现(不会做成图片。“帮我画图表”的“画”是绘制数据 (plot) 的意思,不是画画嘛)。→ 和 12 Bases(数据表)的图表视图是两回事。 - 流程图、关系图就用 Canvas 或 Mermaid:“帮我画思维导图”“帮我画流程图”这类要求,会做成思维导图 (
.canvas) 或笔记里的 Mermaid 图表。Canvas 里需要图表时,会先创建一篇放图表的小笔记,再摆一张指向它的文件卡片(图表会直接在卡片里画出来)。→ 11 思维导图 - 复制、插入、保存为笔记:用代理回答泡泡下方的“复制”“插入编辑器”“保存为笔记”按钮,可以把满意的回答复制到剪贴板、插进正在写的笔记,或干脆做成一篇新的
.md笔记。 - 丢参考资料给它:笔记库里的其他笔记、图片与 PDF 这类附件文件,甚至从外面拿来的文件,都可以直接拖放到代理的输入框。等于是在说“这个也一起读、当参考!”
- 更清爽的输入框:选择模型、加入参照、助手、送出按钮全都靠右集中在输入框下方。附上好几个参照文件时只会显示一个,其余收成
+n,输入框不会跳来跳去,随时都很整齐。 - 用助手开始新对话:按输入框下方的人形按钮(助手),就会列出你存好的助手。选一个就会打开新对话,只要输入框上方的标记还显示着它的名字,整段对话都会维持那个角色(用
/调用的话只有那一次)。为助手设置参考笔记(人物、世界观、文风笔记)后,每次调用时都会一起附进对话 — 在“提示词助手 ▸ 框架设置 ▸ 创建斜线命令”的“参考笔记”栏选就可以。标记上的 × 会结束助手、回到新对话。在这台设备第一次使用笔记库里的助手时,会先让你看要传给 AI 的内容(因为它可能是通过同步、分享进来的)。 - 神奇的斜线命令:在输入框只要打
/,助手清单就会一口气列出来!在笔记库创建 Markdown 文件,还能加入自己的命令(最近用过的排在最上面)。放命令的文件夹有两个,别搞混了 —.claude/commands/给桌面版代理读(兼容 Claude Code),_ObsiKO/commands/则是桌面版加上手机、网页版对话都会读。想在哪里都能用,就把同一个文件放进_ObsiKO/commands/(同名时以_ObsiKO这边为准)。 - 回到过去:“刚刚跟它聊了什么来着?”按面板上方的时钟按钮,就能把先前的对话完整还原。在其他设备聊过的、或很久以前的对话,可以用清单最下方的“在已保存的对话原文中寻找”找出来接着聊(前提是打开了对话原文记录)。也可以直接问 AI:“帮我找上次聊○○的那段。”→ 16-11 记住的事
- 工作结束有“完成卡片”:创建或修改文件的工作完成后,对话里会出现 ✅ 工作完成 · N 秒 · 使用的 Token 卡片,并整理出变更的文件清单(🆕添加、✏️修改,点击马上打开)。把鼠标移到 Token 数字上,就会分开显示输入/输出。
- 报告怎么做、为什么这样做:工作结束后,回答最后会简短整理做法、各文件的变更、下一步建议(用选项 ≡ 里的“工作完成报告”开关)。
自己检查、自己修正的“循环”🔁(仅限 Claude)
写一次就结束?才不是!现在代理会跑一个聪明的循环,自己检查刚写好的笔记并再次修正。开关在面板的选项 (≡) 按钮 →“循环”类别。
- ① 自我验证循环(默认打开):保存笔记 (
.md) 后马上自己检查 Markdown 语法,发现会让显示跑掉的错误(没有关闭的代码块、表格列数对不上等),就立刻修正。 - ② 完成关卡(默认打开):在工作即将结束前,把这次写的笔记做最后检查,剩下的语法错误全部改好才收工。
- ③ 评论者循环(默认关闭):独立的检阅者会对照你的要求评估成果,指出不足的地方,让代理完善。质量很重要时再开(会多用 Token)。把“评论者引擎”从 Claude 改成 Gemini 或 Codex,就会由别家公司的模型交叉验证,审得更严格。
每次循环介入时,对话里会用 🔁 一行字告诉你“跑了什么检查、第几次”。评论者检阅期间,状态栏也会显示“检阅结果中”。
- “循环重复上限”滑杆:调整每个循环退回重做的最大次数,范围 1~20(防止无限退回)。
- 无限尝试:真的想让它咬住不放、做到最后就打开 — 会一直重复到通过验证为止。不过会同时跳出可能用掉很多 Token 的警告(就算这样,内部的轮次上限与闲置监看仍是最后的安全网,不会真的永远跑下去)。
💡 这个循环仅限 Claude 引擎(Gemini、Codex 会自己一路做到完成)。
大工作拆开同时做 — 平行分工 🔀(仅限 Claude)
像“调查 10 个主题并各做成笔记”这种大型工作,一个一个照顺序做会很久。打开选项 (≡) →“多引擎协作”类别里的“平行分工”,代理就会把工作拆成 2~8 个独立的子任务同时进行(一次 3 个),最后再汇总结果。
- 进度会在对话里用 🔀 一行字显示 — 像“(3/8)“○○”完成”。就算有些失败,其余的也会继续,失败的部分会在汇总时告诉你。
- 只会拆出彼此不重叠的工作,ObsiKO 也会盯着,不让两个工作同时动到同一个文件。
⚠️ 好几个运行同时跑,Token 可能用掉好几倍。建议只在大量搜集资料、批量整理这种真正的大工作时才开!默认关闭,仅限 Claude 引擎。
用 Canvas 画给它看 — 照着画的做 🗺️
既然能请 AI 画思维导图,反过来应该也行吧? 把文件夹结构或工作计划在 Canvas 上随手画出来,附给代理当参照,再说“照这张 Canvas 的结构帮我创建/整理/进行”。
- 它是这样读的:群组框 = 文件夹(框中框就是子文件夹)、笔记卡片 = 现有笔记、文字卡片 = 要新建的笔记(第一行是标题)。交办工作时,文字卡片会变成“待办”,箭头 = 进行顺序。
- 也能重新安排现有文件:不是做副本,而是用安全的移动工具把原文件直接搬过去(不覆盖,回收站这类隐藏文件夹不准动)。要搬 5 个以上时,会先列出清单问你。 移动也会留在变更记录里,可以还原。
- 把流程变成技能:说“把这个步骤做成技能”,就会以你专属的技能存进笔记库的
.claude/skills/,下次交办同样的工作时,就会照那套流程做。
💡 文件移动只有 Claude 引擎做得到(Gemini、Codex 只能新建)。Canvas 的画法请看 11 思维导图!
还原 AI 改过的东西 — 变更记录 ⏮️(虚拟工作树)
“咦?AI 改的我不喜欢,能不能变回原样?”现在可以了!代理每次创建或修改文件,都会以每次运行为单位保存“变更前/后”,随时都能比较并还原。这是不懂 git 也能用的轻量“虚拟工作树”。
- 在哪里? 打开右侧边栏指南栏的时钟图标(AI 变更记录)面板,AI 工作会以由新到旧的时间轴排列(用“刚刚 · 3 分钟前 · 昨天”这种好懂的时间标注)。
- 筛选:记录变多时,在最上方的搜索列用标题、文件、引擎筛选看看。
- 比较 (diff):展开工作后,每个变更的文件都会标上添加/修改/删除标记,按 [比较] 就会标注出哪几行被添加(+绿色)、删除(−红色),连变更的那一行里哪个词改了都会强调出来。没变的长段落会收成“n 行相同 — 展开”,只露出重点。点文件名就能直接打开那个文件。
- 还原:可以只还原一个文件,也可以用 [还原这个工作的全部] 把那次运行的变更整个恢复原状。(新建的文件会删除、修改过的文件回到原本内容、被删掉的文件会救回来。)
- 还原也能反悔(重新应用):还原过的文件会加上“已还原”标记,按 [重新应用] 就会回到 AI 改过的内容 — 还原的还原!如果这段期间你又动过那个文件(内容不一样了),覆盖前一定会再问你一次。
- 支持所有引擎:Claude、Gemini、Codex 三个都会记录。(Claude 是在写入前实时保存原文件;Gemini、Codex 则是在工作开始时先把原文件存下来,结束后再比较。)
- 所有平台都能用 📱:不只桌面版,iPhone、iPad、Android、网页版的纯对话模式也一样会记录、能还原。(桌面版存在应用程序内部的文件,移动版与网页版存在应用程序内部的存储空间 — 不管哪种都在笔记库外面,不会弄乱笔记库文件夹。)
- 不动你的笔记库:快照按每次运行保存在应用程序内部(最近 40 条)。也可以只删记录、文件保持原样(删除前会跳出确认窗口)。
💡 能还原的是文字文件(笔记、Canvas、代码等)。图片、PDF 这类大文件不在比较/还原范围内。
变更前先检阅 — 先在工作副本上做 🧪(桌面版)
“想在 AI 改我的笔记之前,先看看它要改什么”— 现在默认就是这样。AI 面板选项 (≡) 里的“变更前先检阅”(默认打开)打开时,Claude、Codex、Gemini 代理会在笔记的工作副本(应用程序内部的文件夹,只有文字文件)上工作,结束后回答下方会出现检阅卡片。
- 卡片上能做的事:新建与修改的笔记会列成清单,点开就能用比较看到哪几行会变。只有按下 [应用选中的] 才会写进你的笔记;按 [全部丢弃] 就像什么都没发生过。卡片状态会留在对话记录里,之后重新打开也一样。
- 不会覆盖:应用前会再确认一次原文件,只要 AI 工作期间有任何一篇你动过的笔记(包括还没存盘的编辑),就什么都不写入并告诉你。不会自动合并。
- 会应用的只有创建、修改笔记 (.md)。混有删除、移动的运行不会出现应用按钮(只应用一半的话,笔记会变成两份),Canvas、表格、附件只会告诉你数量。应用过的内容也会留在变更记录,可以还原。
- 挡下 AI 的笔记 (
ai: deny、.obsiko-ai-ignore) 根本不在副本里,所以就算是没有拦截机制 (hook) 的 Codex、Gemini 也读不到。 - 在工作副本上工作时,Codex 的工具连接会关闭(Codex 只用自己的文件工具工作)。
- 每个引擎的隔离程度不一样(老实说):Claude 是强制隔离,Codex 只能写进工作文件夹,Gemini 则只是不给它原文件路径、运行中原文件有变动时通知你。关掉的话,就会像以前一样直接在笔记库里工作(例行流程这类自动运行不会用检阅模式)。
代理设置都在面板里!⚙️
以前散落在设置窗口里的 AI 代理设置,现在都整齐地集中到面板标题栏的选项 (≡) 按钮这一个地方了。
- 最上面的开关:“自动累积个人化记忆”“把对话原文记录到笔记库”“放宽 Gemini 内容过滤”,还有“允许发送到外部 AI”清单(这四个在纯对话引擎也会出现 — 因为过滤设置会应用到对话、图片生成、朗读、转录发出的所有 Gemini 调用。打开时会跳出注意事项的确认窗口,再确认一次。→ 16-11 记住的事 · 发送许可请看 → 16-10 AI 依据与隐私)
- 接下来的开关(桌面版 CLI 引擎时):“把回答保存为 .md 文件”“变更前先检阅”“代理 Token 优化”“在受保护的笔记库阻挡绕道引擎”“工作完成报告”“把 obsiko 工具连给 Codex”
- “在受保护的笔记库阻挡绕道引擎”(默认关闭):在有 ai: deny 笔记的笔记库里,直接不让 Gemini、Codex 运行(关闭时照样运行,只提醒一次)。用“变更前先检阅”工作时,被挡的笔记根本不在副本里,所以不需要阻挡。→ 16-10 AI 依据与隐私
- “把 obsiko 工具连给 Codex”打开时也会跳出注意事项的确认窗口 — 因为它可能影响到笔记库外面。
- 两个直接运行的按钮:“创建语义索引”(一次建好语义搜索索引)、“保存对话摘要”(把当前的对话摘要成笔记)
- 可收起的类别:“循环”(参考上面)、“多引擎协作”、“git”(自动提交、远程、push)、“语义搜索的嵌入”(后端、模型)
- 多引擎协作 🤝:三个引擎(Claude、Gemini、Codex)互相帮忙 — 打开“问问其他引擎(咨询工具)”,工作中的引擎卡住时就能问其他引擎的意见(用 ask_gemini 这类工具);打开“平行草稿与集成”,其他引擎会先各写一份草稿,再由主引导擎交叉验证并集成。质量会提升,但 Token 也会多用那么多。(“平行分工”开关也在这个类别 — 请看上面的平行分工段落!)
- 再下面:“引擎 API 密钥”输入栏(留空就用登录/订阅)
- Token 用量 📊:每个密钥输入栏下方会累计在这个应用程序里用掉的输入、输出 Token 总数。不只对话,代理的运行(Claude、Gemini、Codex)也会算进去,随时可以用 [重置] 从 0 重新计算。(这不是供应商的账单仪表盘,只是 ObsiKO 里用量的参考。)
- 按各条目名称旁的“?”,说明就会在那个条目正下方展开(再按一次收起)。用鼠标的话移上去就看得到,手机、平板上轻点击就好。📱
各种数据都变成 .md — 网页、视频、文档、图片、数据 📥
代理不只会搜索,还能读各种格式的数据、做成笔记(桌面版)。Claude 全部都能用,Gemini、Codex 也能用大部分的工具(Codex 要打开“把 obsiko 工具连给 Codex”— YouTube、PDF、文档、转录、RSS、表格、文档内容搜索、语义搜索、图谱,还有图片生成、朗读 (TTS) — 请看下面的图片与朗读段落)。不过看图片、扫描 OCR 仅限 Claude。
🌐 网页、视频
- 用网络搜索搜集资料:给它一个主题,就会搜集网络搜索结果(标题、摘要、日期)整理成 .md,像“帮我整理○○的最新消息”(文件名、标题前会自动加上日期 YYYY-MM-DD)。为了稳定,一页一页直接打开来读的方式默认是关闭的,会根据搜索结果来撰写。
- 整理 YouTube:给它视频网址,就会抓字幕(逐字稿)做成 .md。(只限有字幕的视频。装了 yt-dlp 会更稳定 — 没装也能用)
- RSS/新闻订阅:给它订阅网址,就会把最新条目(标题、日期、链接、摘要)整齐地汇总成一份摘要报。
📄 文件、文档(笔记库里的文件,或拖进对话的附件)
- PDF(文字体):“帮我整理这份 PDF”→ 逐页截取文字来摘要、整理。
- PDF(扫描、图片型):就算是文字变成图片的扫描件,也会把页面转成图片,直接看着读 (OCR) 再抄写下来。(需要安装 poppler — 免费:macOS brew install poppler、Windows scoop install poppler。一次最多 8 页,很长的话就像“先做第 1-10 页”这样分段请它做。仅限 Claude 引擎。)
- 图片:扫描文档、手写字、图表、照片里的文字,它会直接看着抄下来或帮你说明(不必另外安装 OCR)。
- Office、电子书:把 Word、PowerPoint、ODT、EPUB、RTF、HTML 等转成 Markdown。(需要安装 pandoc — 免费)
- 语音、视频转录:没有字幕的课程、Podcast、录音、视频都能听写下来。现在是用云端 API(OpenAI、Gemini)转录,所以不装 whisper 也行(本机有装 whisper 的话会优先用它)。视频优先用 Gemini,语音优先用 OpenAI。(不通过代理的话,也能直接在文件总管右键点击 →“语音、视频 → 笔记(转录)”,或用命令面板 →“转录语音、视频(成笔记)” — 所有平台都行。在 iPhone、iPad 上,语音文件会在设备里免费转录,不需要密钥。视频或其他设备则用 OpenAI、Gemini 密钥。)
- 表格数据:把 CSV、TSV、JSON 文件变成整齐的 Markdown 表格。
- 文档内容搜索:不只一般笔记,连 PDF、Word、Excel、Hangul (.hwp/.hwpx)、CSV、JSON、文本文件等文档的正文都会翻找,回答“帮我找有提到○○的文档”。
🔧 查找应用程序用法、属性
- 搜索应用程序用法:像“ObsiKO 怎么导出 PDF?”这样问应用程序的用法时,代理不会用猜的,而是直接搜索这份帮助维基 (ObsiKO 101),根据内容回答。(和找你自己笔记的笔记库搜索是两回事。)
- 用属性找笔记:把前置元数据的属性当成数据库来条件搜索 — “status 是进行中的项目笔记清单”“type: book 而且 rating 4 以上”。可以用文件夹、标签、属性条件 (AND) 筛选,还能排序。问到 .base 表格时,会直接沿用那张表的条件来查找。→ 12 Bases(数据表)
💡
pandoc、yt-dlp、poppler都是免费工具(转录现在能用云端 API,所以whisper是选用的)。就算没装,应用程序也照常运作,只有在你要用那个功能时,才会跳出一行安装说明。
🛡️ 安全为上:文件只读笔记库里的 + 你附上的,网络数据会挡掉私人/内部网络地址,安全地抓取。没有字幕、没有文字时,也会老实告诉你“没有”。
也会画图、也会出声 — AI 图片生成与朗读 🎨🔊
不只会读、会写,现在还能画图、把文字念出来!这两个功能只要有 API 密钥,桌面版、iPhone、iPad、Android、网页版都能用(OpenAI 或 Gemini 密钥 — 设置里的对话 API 密钥)。
🎨 图片生成(文字 → 图片)
- 在对话里说“帮我画○○”,代理就会画好图、保存到笔记库的 assets/ 文件夹,并放进笔记。
- 或是在正文选中描述文字 → 右键点击 →“✨ AI 创建”,选“🎨 制作图片 · OpenAI”或“🎨 制作图片 · Gemini”,就会根据那段文字做出图片,插在选中文字的正下方。
- 用参考图来画(草图 → 完成图) 🖍️:把草图或照片附进对话,说“照这张草图帮我画”,就会保留原图的构图和线条来完成 (image-to-image)。拿 Canvas 上随手画的底稿来上色、完稿时最好用。
- 画人物、角色时,会自动留好空间,不让头顶被切掉。
- ✨ 制作标题标志:右键点击 → ✨ AI 创建 →“制作标题标志” — 以选中的文字(没选就用笔记标题)当文案,挑选 10 种风格(极简、手写、霓虹、复古、3D、水彩、网络小说、游戏、视频、书籍)与背景(单色/透明/插画),再选模型、写补充指示,就会做出漂亮的标题标志放进正文。透明背景仅限 GPT Image 模型(真正的 alpha PNG)。文案(尤其是中文)越短越准确!

▲ 选中描述文字后右键点击 →“✨ AI 创建”▸“🎨 制作图片”。做好的图会刚好放进选中文字的下方。
🔊 朗读 (TTS) — 免费聆听、制作语音文件,两条路
正文的右键菜单里有专属的“🔊 朗读 ▸”群组(没有选中文字时会显示成“🔊 朗读整篇笔记”,念出整篇笔记)。底下有三项 — 设备语音(免费)、OpenAI、Gemini。
① 用设备语音马上听 🆓(不用密钥)
- 右键 ▸“🔊 朗读”▸ 设备语音,或命令面板的“朗读笔记(设备语音)”。用 Mac、Windows、iPhone、Android 内置的声音马上念给你听 — 不用 API 密钥、不用安装、也不花钱。
- 因为这个模式不产生文件,播放栏也会跟着改变:没有跳转(拖动进度),改成显示句子进度(2/13 句),只留播放/暂停、速度、声音、句子醒目提示。暂停后再继续,会从那一句的开头接着念。就算是手机这种窄屏幕,播放栏也永远只有一行 — 空间不够时,会先收起时间、标签这模拟较不重要的东西(免得挡住两行正文)。
- 前后跳一句 ◀◀ ▶▶:播放按钮两侧的按钮会一句一句倒回、跳过(朗读的单位是句子,所以按一次 = 刚好一句,换段落的地方也就是下一句)。停住时按下去也不会突然出声 — 只会移动位置,正文的醒目提示和 2/13 数字会跟着走。没有地方可去时(最前面、最后面),按钮会变淡。
- 挑声音:播放栏的清单只会列出设备上已安装、该语言的声音(Eddy、Grandma 这类英文名字、机器人风格的趣味声音会排除)。播放中换声音,会从那一句开始用新声音接着念,选好的声音也会记住。
- Android 上会显示成 声音 1 · 声音 2 … — 因为 Android 不提供声音名称(只给内部代号),所以由应用程序编号。同一个声音的离线/在线版本会合成一行,只有需要网络的会标上 · 在线。还没下载的声音选了也不会出声,所以不列进清单。编号会记在设备上,之后再下载更多声音,原本用的编号也不会跑掉。
- ? 说明:按播放栏上的 ? — 会出现这个模式不会保存为文件的说明,以及在系统设置下载新声音后,也会直接加进这份清单的小提示。路径只显示你现在用的设备(Mac、iPhone:辅助使用 ▸ 语音内容 ▸ 声音/Android:设置 ▸ 无障碍 ▸ 文字转语音 ▸ 语音数据)。下载后把应用程序关掉再重新打开最保险。
- 刚打开应用程序时,设备有时会比较晚才回报声音清单(尤其是 iPhone)。这段期间只会看到“自动(设备默认)”,其余的准备好就会悄悄补上 — 这时朗读也照样正常。
- 夹在中文里的英文也念得对:很多设备的非英文声音遇到英文单词,会一个字母一个字母拼着念;所以句子里只有英文的片段会交给英文声音接手朗读(自动、不用设置)。接手的英文声音会跟着你选的声音性别 — 选男声,英文也由男声念;选女声就是女声(前提是设备上有该性别的英文声音)。
- 句子醒目提示 🖍️ 也照样有 — 因为是一句一句直接念,反而比 AI 朗读对得更准(用高亮图标开关)。
② 做成语音文件 💳(AI 朗读 — OpenAI、Gemini 密钥)
- 右键 ▸“🔊 朗读”▸ 选 OpenAI 或 Gemini,就会把那段文字做成语音、保存到 assets/,插入 [🔊 听朗读] 链接后马上播放。请代理“念这篇笔记给我听”也是走这条路。Gemini 密钥用免费方案也能用(在额度内 — Gemini 价目表 ↗)。
- 在播放栏可以调整选声音、试听、播放/暂停、跳转、速度 (0.75~2×)。默认声音在设置的“语音设置”块决定,也可以像“用○○的声音念”这样直接指定。
- 长文也能很快开始:会把文字切成好几段,第一段一准备好就开始播放,后面的部分在你听的时候接着做。进度条长度带着 + 一直变长,就表示“后面的段落还在制作中”!
- 朗读句子的醒目提示 🖍️:播放时,编辑器里正在念的句子会有淡淡的高亮跟着走,画面也会一起滚动。可以用播放栏上的高亮图标开关。需要更精准的同步,就打开设置里的“朗读精准highlight同步”(使用 whisper 重新转录 — 需要 OpenAI 密钥,会有额外费用)。
播放不会中断(两条路都一样)— 朗读中切到别的笔记、或去看仪表盘,声音也会继续。这时播放栏会显示 🎧 笔记名称,告诉你现在正在念什么,点击就回到那篇笔记。回到原本的笔记后,句子醒目提示会接着出现;修改原文的话,只有醒目提示会悄悄关掉(播放照常)。
没在听就会自己消失 — 在暂停、念完、或还没选声音的状态下离开那篇笔记,播放栏会自动关闭(免得孤零零地留在别的画面)。待在正在朗读的笔记里时就会保留。

▲ 编辑器下方的播放栏 — 选声音、试听、播放/暂停、跳转、速度、句子醒目提示开关,全在一行里。
💡 图片生成、朗读、转录是用多少、就由各供应商 (OpenAI/Gemini) 计费多少的 BYOK(自备密钥)功能。没有密钥时会跳出说明。(例外:用设备语音聆听和 iPhone、iPad 的语音转录都在设备里免费进行。)
更聪明的搜索 — 语义搜索与图谱 🔎🕸️
关键词要一字不差才找得到的时代结束了!代理会用意思找,再顺着链接结构扩大范围。
- 按意思搜索(语义):像“跟这篇类似的笔记”“把跟这个主题有关的全找出来”这样拜托,就算用字不同,也会找出意思相近的笔记(能理解语感与同义词)。会在本机为笔记库创建索引,每次修改笔记时,也只会自动重新索引有变动的部分。
- 轻量 GraphRAG:直接把你写的
[[链接]]和知识本体关系当成知识图谱来用。很擅长回答像“找出跟 X 有关的笔记,连周边结构一起整理”(找种子 → 扩展邻居)、“我的笔记分成哪些群组/主题?”(看整体分群)这类问题。
打开方法(语义搜索需要先准备一次免费的嵌入引擎)
- 桌面版:语义搜索需要本机嵌入引擎。安装免费的 Ollama,在终端运行一行
ollama pull nomic-embed-text就好。(直接从源代码运行 ObsiKO 的开发者,也能用npm i @huggingface/transformers使用内置引擎。) - iPhone、iPad、Android、网页版:不用安装任何东西 — 第一次创建索引时会下载一次小模型,在设备里创建索引。→ 07 搜索与浏览
在面板的选项 (≡) 按钮 →“语义搜索的嵌入”类别(桌面版)可以选择后端(自动侦测/Transformers.js/Ollama)与模型名称。(图谱搜索不用另外安装 — 马上就能用!)
在 Mac 上不用密钥 — 设备 AI (Apple Intelligence) 🍎
只要是 macOS 26 以上、打开了 Apple Intelligence 的 Mac,不用 API 密钥也不用登录,就能在 Mac 里使用简短的 AI 功能。文字不会离开 Mac。
- 能做的事:错别字 AI、AI 润色、文章检查提问、转录摘要,还有用代理面板的“设备 AI · 简单对话”引擎做简单对话。笔记编辑工具、网络搜索、调出记忆、长篇批改都不行 — 小模型很容易给出似是而非的错误答案,所以刻意挡掉了。
- 引擎顺序:有 API 密钥就用密钥 → 在这台 Mac 上已经用过 Claude、Codex 这类引擎的话,就用那个引擎 → 都没有才用设备 AI。随时都能在代理面板的引擎清单切换。
- 看不到的话:Apple Intelligence 关闭时,代理面板的说明 (?) 会告诉你去哪里打开 — 到系统设置 ▸ Apple Intelligence 与 Siri 打开后,再回到应用程序。Intel Mac 或 macOS 26 以前的版本不会出现在菜单里。
- 和 iPhone、iPad(iOS 26 以上)的“设备 AI”是同一个功能。Android 不支持设备 AI(因为 Google 设备 AI 的使用条款不允许用在未成年人可能使用的应用程序)。
- 更可靠:回答会逐字流出,点击“停止”就立刻停下。拼写检查、文章检查会用固定格式接收结果,把会改变意思、数字不同的建议过滤掉;长文会自动配合设备模型的上限来调整。设备不支持那个语言(例如韩文)时,会在运行前就告诉你。
- 看到“测试版”标记,就代表是设备 AI 做的。 它会小小地标在引擎清单与当前的引擎名称、拼写检查的结果列(连“没有错别字 ✓”时也有)、文章检查提问的开头、“AI 修改建议”卡片、录音整理的选项上。把鼠标移到标记上,会显示“还在测试阶段,结果可能不准确,请确认后再使用。文字不会离开设备。”设备 AI 的拼写检查可能漏抓或给出莫名其妙的建议,尤其是韩文,建议搭配 韩文拼写检查一起看。
不用安装就能用的助手命令 🎁
不用另外安装,一开始就内置好了。在输入框只要打 /,就会跳出各领域的助手!(在繁體中文界面,这些命令会以英文名称显示;像下面这样只打开头几个字也会自动完成。)
- 写作 — /draft /compose /craft /edit /revise /worldbuild /roleplay(化身角色设置笔记里的人物,来一场情境剧对话 — 试着打 /roleplay 角色名称,情境!)
- 读书 — /studynote /summarize /quiz /example /errorlog /lecturenote /studyplan /homework
- 资料搜集、论文 — /gather /excerpt /paper /litreview /factcheck /synthesize(这些助手禁止没有出处的断言,不知道就会说不知道!)
- 给 AI 的文档 — /aidoc /claudemd /skill /command /persona /harness
- 卡片盒笔记法、知识本体 — 用 /permanent /connect /classify /relate /atomize /attribute 等命令把知识结构化!→ 详情:17 知识结构化
- 项目 — /projectsetup(说出类型或主题,像“帮我建一个网络小说连载项目”,就一次建好文件夹、项目 Base 和基本笔记)
命令名称会跟着应用编程语言(韩文、英文、日文)改变,繁體中文界面则显示英文名称;用其他语言的名称打也听得懂。😊
一键创建 LLM 维基 📚
- 只要一句“帮我创建 LLM 维基”,代理就会问你要快速开始还是深入开始,一口气打好知识库的地基(之后就是放进数据说“帮我整理”、直接提问、偶尔说“帮我检查”,这样运转下去)。
- 维基由记录代理的身分、工作方式、用户、记忆的系统文件稳固地组成:
Soul.md— 代理是谁(身分、使命、语气、行为界线)AGENTS.md— 怎么工作(工作规则)user.md— 用户是谁memory.md— 一起定下的决定、惯例的记忆(旧版维基是隐藏的.memory.md)- 直接修改这些文件,就能随心所欲地改变代理的行为方式!
给开发者的 Git 自动集成(选用)🐙
- 只要在面板的选项 (≡) 按钮 →“git 自动提交、远程”类别打开,代理每次工作完都会自动提交 (commit),连推送 (push) 都帮你做!(直接使用电脑上设置好的 Git 认证。)连接远程仓库、创建 GitHub 仓库也在同一个地方。→ 23 设置与主题
从其他 AI 应用程序使用我的笔记库 — 连接外部 AI 应用程序 (MCP) 🔌
除了 ObsiKO 里的代理,也可以请 Claude Desktop、Cursor、VS Code、Claude Code、Codex CLI 这些其他 AI 应用程序“从我的笔记里找找看”。
- 打开设置 ▸ 连接外部 AI 应用程序,在你用的应用程序卡片上按一次 [连接] 就好。把那个应用程序重新打开,就会看到 ObsiKO 的工具。
- 要开放哪个笔记库由你自己选(最多 3 个)。切换窗口也不会偷偷改掉。
- 只读 — 只能搜索、读取,不能写入或删除。用 ai: deny 藏起来的笔记在这里也一样排除。
- 在从官网下载的桌面版(Mac、Windows)可以用(Mac App Store 版没有)。默认关闭。详情请看 → 23 设置与主题
高级 — 把其他 MCP 服务器接到 ObsiKO 的代理:反过来,也能让 ObsiKO 的 Claude 引擎使用其他 MCP 服务器的工具。在电脑的家目录创建 ~/.obsiko/mcp-clients.json,写成 {"servers": {"名称": {"command": "运行命令", "args": ["…"], "env": {}}}} 的格式,下次运行起就会一起接上那个服务器。放在家目录而不是笔记库,是为了不让别人通过同步的笔记库偷塞命令(名称 obsiko、qmd 不能用)。
🚀 进一步了解用法(子页面)
这些子文档会一步一步更深入地介绍实战工作流程。建议从上往下依次阅读。
- 16-1 基本用法 — 好好使唤它的基本功 + 小诀窍
- 16-2 情境应用示例 — 写作、读书、研究、结构化、转换、思维导图
- 16-3 写作与创作应用 — 6 种分阶段的写作助手
- 16-4 打造 LLM 维基 — 创建知识库 + 像 NotebookLM 一样使用 + 可读取的文件格式
- 16-5 卡片盒笔记法与知识本体 — 把笔记变成相互链接的知识
- 16-6 推荐提示词集 — 复制就能用的提示词
- 16-7 提示词助手 — 用块组提示词 + 创建框架(规则、命令)
- 16-8 纯对话模式(移动版、网页版) — 只靠 API 密钥在 iPhone、网页上用 AI(网络搜索、看图片、整理笔记)📱
- 16-9 AI 收费说明(订阅与额度) — 哪些是订阅、哪些是额度,一直到申请 API 密钥 💳
- 16-10 AI 依据与隐私 — 确认回答的出处([S1]、依据清单)与指定不让 AI 看的笔记 🔍🔒
- 16-11 记住的事 — 让 AI 长久记住你的价值观、判断标准、项目脉络(手动、自动)🧠
- 16-12 写作助手 — 结构检查 + 让思考更深入的提问 + 10 种类型镜头的编辑式批改 ✍️