ObsiKO ObsiKO 說明文件

AI 代理

一個人寫東西很孤單吧?來認識一位會陪你一起讀筆記、寫筆記、整理筆記的聰明 AI 朋友!

💻🆚📱 這份文件介紹的完整代理(安裝 CLI + 登入,從資料蒐集、語意搜尋到生成心智圖)僅限從 ObsiKO 官網下載的桌面版(Mac、Windows)。不過現在多了只要填入 API 金鑰就能用的純對話模式,所以在 iPhone、iPad、Android、瀏覽器、Mac App Store 版上也能和 AI 對話、整理筆記!→ 16-8 純對話模式(行動版、網頁版)

🪟 Windows 只要是從 ObsiKO 官網下載的應用程式,就能照這一頁使用 — Claude、Codex 代理、連接外部 AI 應用程式 (MCP)、git 都行。唯一的例外:Windows 上看不到 Gemini 代理引擎(請看下面的「引擎」— Gemini 可以填入 API 金鑰、改用對話引擎)。Mac App Store 版的 AI 是純對話(沒有 CLI 代理、git、連接外部 AI 應用程式)→ 16-8 純對話模式(行動版、網頁版)

🚀 想直接上手? 下面的應用子頁面 (16-1~16-12) 會一步一步教你工作流程、LLM 維基、推薦提示詞,一直到純對話模式!

💳 搞不清楚哪些要付費(額度)、哪些是訂閱? 從 ⓒ 標記的意思到申請 API 金鑰 → 16-9 AI 收費說明(訂閱與額度)

← 回首頁:ObsiKO 101

🎬 跟著做:連接 AI — 電腦與手機兩條路(韓文頁面)


它藏在哪裡?🧐

AI 代理對話面板
▲ 在右側面板和 AI 助手對話,一起整理筆記。(這一頁的完整代理僅限桌面版;純對話模式在網頁版、行動版也能用)

隨你挑選的 AI 引擎 🧠

安全第一!ObsiKO 的嚴密保護 🛡️

越用越順手的功能 ✨

自己檢查、自己修正的「迴圈」🔁(僅限 Claude)

寫一次就結束?才不是!現在代理會跑一個聰明的迴圈,自己檢查剛寫好的筆記並再次修正。開關在面板的選項 (≡) 按鈕 →「迴圈」類別。

每次迴圈介入時,對話裡會用 🔁 一行字告訴你「跑了什麼檢查、第幾次」。評論者檢閱期間,狀態列也會顯示「檢閱結果中」。

💡 這個迴圈僅限 Claude 引擎(Gemini、Codex 會自己一路做到完成)。

大作業拆開同時做 — 平行分工 🔀(僅限 Claude)

像「調查 10 個主題並各做成筆記」這種大型作業,一個一個照順序做會很久。打開選項 (≡) →「多引擎協作」類別裡的「平行分工」,代理就會把作業拆成 2~8 個獨立的子任務同時進行(一次 3 個),最後再彙整結果。

⚠️ 好幾個執行同時跑,Token 可能用掉好幾倍。建議只在大量蒐集資料、批次整理這種真正的大作業時才開!預設關閉,僅限 Claude 引擎。

用 Canvas 畫給它看 — 照著畫的做 🗺️

既然能請 AI 畫心智圖,反過來應該也行吧? 把資料夾結構或工作計畫在 Canvas 上隨手畫出來,附給代理當參照,再說「照這張 Canvas 的結構幫我建立/整理/進行」。

💡 檔案移動只有 Claude 引擎做得到(Gemini、Codex 只能新建)。Canvas 的畫法請看 11 心智圖!

還原 AI 改過的東西 — 變更紀錄 ⏮️(虛擬工作樹)

「咦?AI 改的我不喜歡,能不能變回原樣?」現在可以了!代理每次建立或修改檔案,都會以每次執行為單位保存「變更前/後」,隨時都能比較並還原。這是不懂 git 也能用的輕量「虛擬工作樹」。

💡 能還原的是文字檔案(筆記、Canvas、程式碼等)。圖片、PDF 這類大檔案不在比較/還原範圍內。

變更前先檢閱 — 先在工作副本上做 🧪(桌面版)

「想在 AI 改我的筆記之前,先看看它要改什麼」— 現在預設就是這樣。AI 面板選項 (≡) 裡的「變更前先檢閱」(預設開啟)打開時,Claude、Codex、Gemini 代理會在筆記的工作副本(應用程式內部的資料夾,只有文字檔案)上作業,結束後回答下方會出現檢閱卡片。

代理設定都在面板裡!⚙️

以前散落在設定視窗裡的 AI 代理設定,現在都整齊地集中到面板標題列的選項 (≡) 按鈕這一個地方了。
- 最上面的開關:「自動累積個人化記憶」「把對話原文記錄到筆記庫」「放寬 Gemini 內容過濾」,還有「允許傳送到外部 AI」清單(這四個在純對話引擎也會出現 — 因為過濾設定會套用到對話、圖片生成、朗讀、轉錄發出的所有 Gemini 呼叫。開啟時會跳出注意事項的確認視窗,再確認一次。→ 16-11 記住的事 · 傳送許可請看 → 16-10 AI 依據與隱私)
- 接下來的開關(桌面版 CLI 引擎時):「把回答存成 .md 檔案」「變更前先檢閱」「代理 Token 最佳化」「在受保護的筆記庫阻擋繞道引擎」「作業完成報告」「把 obsiko 工具連給 Codex」
- 「在受保護的筆記庫阻擋繞道引擎」(預設關閉):在有 ai: deny 筆記的筆記庫裡,直接不讓 Gemini、Codex 執行(關閉時照樣執行,只提醒一次)。用「變更前先檢閱」作業時,被擋的筆記根本不在副本裡,所以不需要阻擋。→ 16-10 AI 依據與隱私
- 「把 obsiko 工具連給 Codex」開啟時也會跳出注意事項的確認視窗 — 因為它可能影響到筆記庫外面。
- 兩個直接執行的按鈕:「建立語意索引」(一次建好語意搜尋索引)、「儲存對話摘要」(把目前的對話摘要成筆記)
- 可收合的類別:「迴圈」(參考上面)、「多引擎協作」、「git」(自動提交、遠端、push)、「語意搜尋的嵌入」(後端、模型)
- 多引擎協作 🤝:三個引擎(Claude、Gemini、Codex)互相幫忙 — 開啟「問問其他引擎(諮詢工具)」,作業中的引擎卡住時就能問其他引擎的意見(用 ask_gemini 這類工具);開啟「平行草稿與整合」,其他引擎會先各寫一份草稿,再由主導引擎交叉驗證並整合。品質會提升,但 Token 也會多用那麼多。(「平行分工」開關也在這個類別 — 請看上面的平行分工段落!)
- 再下面:「引擎 API 金鑰」輸入欄(留空就用登入/訂閱)
- Token 用量 📊:每個金鑰輸入欄下方會累計在這個應用程式裡用掉的輸入、輸出 Token 總數。不只對話,代理的執行(Claude、Gemini、Codex)也會算進去,隨時可以用 [重設] 從 0 重新計算。(這不是供應商的帳單儀表板,只是 ObsiKO 裡用量的參考。)
- 按各項目名稱旁的「?」,說明就會在那個項目正下方展開(再按一次收起)。用滑鼠的話移上去就看得到,手機、平板上輕點一下就好。📱

各種資料都變成 .md — 網頁、影片、文件、圖片、資料 📥

代理不只會搜尋,還能讀各種格式的資料、做成筆記(桌面版)。Claude 全部都能用,Gemini、Codex 也能用大部分的工具(Codex 要打開「把 obsiko 工具連給 Codex」— YouTube、PDF、文件、轉錄、RSS、表格、文件內容搜尋、語意搜尋、圖譜,還有圖片生成、朗讀 (TTS) — 請看下面的圖片與朗讀段落)。不過看圖片、掃描 OCR 僅限 Claude。

🌐 網頁、影片
- 用網路搜尋蒐集資料:給它一個主題,就會蒐集網路搜尋結果(標題、摘要、日期)整理成 .md,像「幫我整理○○的最新消息」(檔名、標題前會自動加上日期 YYYY-MM-DD)。為了穩定,一頁一頁直接打開來讀的方式預設是關閉的,會根據搜尋結果來撰寫。
- 整理 YouTube:給它影片網址,就會抓字幕(逐字稿)做成 .md。(只限有字幕的影片。裝了 yt-dlp 會更穩定 — 沒裝也能用)
- RSS/新聞訂閱:給它訂閱網址,就會把最新項目(標題、日期、連結、摘要)整齊地彙整成一份摘要報。

📄 檔案、文件(筆記庫裡的檔案,或拖進對話的附件)
- PDF(文字型):「幫我整理這份 PDF」→ 逐頁擷取文字來摘要、整理。
- PDF(掃描、圖片型):就算是文字變成圖片的掃描檔,也會把頁面轉成圖片,直接看著讀 (OCR) 再抄寫下來。(需要安裝 poppler — 免費:macOS brew install poppler、Windows scoop install poppler。一次最多 8 頁,很長的話就像「先做第 1-10 頁」這樣分段請它做。僅限 Claude 引擎。)
- 圖片:掃描文件、手寫字、圖表、照片裡的文字,它會直接看著抄下來或幫你說明(不必另外安裝 OCR)。
- Office、電子書:把 Word、PowerPoint、ODT、EPUB、RTF、HTML 等轉成 Markdown。(需要安裝 pandoc — 免費)
- 語音、影片轉錄:沒有字幕的課程、Podcast、錄音、影片都能聽寫下來。現在是用雲端 API(OpenAI、Gemini)轉錄,所以不裝 whisper 也行(本機有裝 whisper 的話會優先用它)。影片優先用 Gemini,語音優先用 OpenAI。(不透過代理的話,也能直接在檔案總管按右鍵 →「語音、影片 → 筆記(轉錄)」,或用命令面板 →「轉錄語音、影片(成筆記)」 — 所有平台都行。在 iPhone、iPad 上,語音檔會在裝置裡免費轉錄,不需要金鑰。影片或其他裝置則用 OpenAI、Gemini 金鑰。)
- 表格資料:把 CSV、TSV、JSON 檔案變成整齊的 Markdown 表格。
- 文件內容搜尋:不只一般筆記,連 PDF、Word、Excel、Hangul (.hwp/.hwpx)、CSV、JSON、文字檔等文件的內文都會翻找,回答「幫我找有提到○○的文件」。

🔧 查詢應用程式用法、屬性
- 搜尋應用程式用法:像「ObsiKO 怎麼匯出 PDF?」這樣問應用程式的用法時,代理不會用猜的,而是直接搜尋這份說明維基 (ObsiKO 101),根據內容回答。(和找你自己筆記的筆記庫搜尋是兩回事。)
- 用屬性找筆記:把前置資料的屬性當成資料庫來條件搜尋 — 「status 是進行中的專案筆記清單」「type: book 而且 rating 4 以上」。可以用資料夾、標籤、屬性條件 (AND) 篩選,還能排序。問到 .base 表格時,會直接沿用那張表的條件來查詢。→ 12 Bases(資料表)

💡 pandoc、yt-dlp、poppler 都是免費工具(轉錄現在能用雲端 API,所以 whisper 是選用的)。就算沒裝,應用程式也照常運作,只有在你要用那個功能時,才會跳出一行安裝說明。
🛡️ 安全為上:檔案只讀筆記庫裡的 + 你附上的,網路資料會擋掉私人/內部網路位址,安全地抓取。沒有字幕、沒有文字時,也會老實告訴你「沒有」。

也會畫圖、也會出聲 — AI 圖片生成與朗讀 🎨🔊

不只會讀、會寫,現在還能畫圖、把文字唸出來!這兩個功能只要有 API 金鑰,桌面版、iPhone、iPad、Android、網頁版都能用(OpenAI 或 Gemini 金鑰 — 設定裡的對話 API 金鑰)。

🎨 圖片生成(文字 → 圖片)
- 在對話裡說「幫我畫○○」,代理就會畫好圖、存到筆記庫的 assets/ 資料夾,並放進筆記。
- 或是在內文選取描述文字 → 按右鍵 →「✨ AI 建立」,選「🎨 製作圖片 · OpenAI」或「🎨 製作圖片 · Gemini」,就會根據那段文字做出圖片,插在選取文字的正下方。
- 用參考圖來畫(草圖 → 完成圖) 🖍️:把草圖或照片附進對話,說「照這張草圖幫我畫」,就會保留原圖的構圖和線條來完成 (image-to-image)。拿 Canvas 上隨手畫的底稿來上色、完稿時最好用。
- 畫人物、角色時,會自動留好空間,不讓頭頂被切掉。
- ✨ 製作標題標誌:按右鍵 → ✨ AI 建立 →「製作標題標誌」 — 以選取的文字(沒選就用筆記標題)當文案,挑選 10 種風格(極簡、手寫、霓虹、復古、3D、水彩、網路小說、遊戲、影片、書籍)與背景(單色/透明/插畫),再選模型、寫補充指示,就會做出漂亮的標題標誌放進內文。透明背景僅限 GPT Image 模型(真正的 alpha PNG)。文案(尤其是中文)越短越準確!

AI 圖片生成 — 內文右鍵選單與插入的圖片
▲ 選取描述文字後按右鍵 →「✨ AI 建立」▸「🎨 製作圖片」。做好的圖會剛好放進選取文字的下方。

🔊 朗讀 (TTS) — 免費聆聽、製作語音檔,兩條路

內文的右鍵選單裡有專屬的「🔊 朗讀 ▸」群組(沒有選取文字時會顯示成「🔊 朗讀整篇筆記」,唸出整篇筆記)。底下有三項 — 裝置語音(免費)、OpenAI、Gemini。

① 用裝置語音馬上聽 🆓(不用金鑰)
- 右鍵 ▸「🔊 朗讀」▸ 裝置語音,或命令面板的「朗讀筆記(裝置語音)」。用 Mac、Windows、iPhone、Android 內建的聲音馬上唸給你聽 — 不用 API 金鑰、不用安裝、也不花錢。
- 因為這個模式不產生檔案,播放列也會跟著改變:沒有跳轉(拖曳進度),改成顯示句子進度(2/13 句),只留播放/暫停、速度、聲音、句子醒目提示。暫停後再繼續,會從那一句的開頭接著唸。就算是手機這種窄螢幕,播放列也永遠只有一行 — 空間不夠時,會先收起時間、標籤這類比較不重要的東西(免得擋住兩行內文)。
- 前後跳一句 ◀◀ ▶▶:播放按鈕兩側的按鈕會一句一句倒回、跳過(朗讀的單位是句子,所以按一次 = 剛好一句,換段落的地方也就是下一句)。停住時按下去也不會突然出聲 — 只會移動位置,內文的醒目提示和 2/13 數字會跟著走。沒有地方可去時(最前面、最後面),按鈕會變淡。
- 挑聲音:播放列的清單只會列出裝置上已安裝、該語言的聲音(Eddy、Grandma 這類英文名字、機器人風格的趣味聲音會排除)。播放中換聲音,會從那一句開始用新聲音接著唸,選好的聲音也會記住。
- Android 上會顯示成 聲音 1 · 聲音 2 … — 因為 Android 不提供聲音名稱(只給內部代號),所以由應用程式編號。同一個聲音的離線/線上版本會合成一行,只有需要網路的會標上 · 線上。還沒下載的聲音選了也不會出聲,所以不列進清單。編號會記在裝置上,之後再下載更多聲音,原本用的編號也不會跑掉。
- ? 說明:按播放列上的 ? — 會出現這個模式不會存成檔案的說明,以及在系統設定下載新聲音後,也會直接加進這份清單的小提示。路徑只顯示你現在用的裝置(Mac、iPhone:輔助使用 ▸ 語音內容 ▸ 聲音/Android:設定 ▸ 無障礙 ▸ 文字轉語音 ▸ 語音資料)。下載後把應用程式關掉再重新開啟最保險。
- 剛開啟應用程式時,裝置有時會比較晚才回報聲音清單(尤其是 iPhone)。這段期間只會看到「自動(裝置預設)」,其餘的準備好就會悄悄補上 — 這時朗讀也照樣正常。
- 夾在中文裡的英文也唸得對:很多裝置的非英文聲音遇到英文單字,會一個字母一個字母拼著唸;所以句子裡只有英文的片段會交給英文聲音接手朗讀(自動、不用設定)。接手的英文聲音會跟著你選的聲音性別 — 選男聲,英文也由男聲唸;選女聲就是女聲(前提是裝置上有該性別的英文聲音)。
- 句子醒目提示 🖍️ 也照樣有 — 因為是一句一句直接唸,反而比 AI 朗讀對得更準(用螢光筆圖示開關)。

② 做成語音檔 💳(AI 朗讀 — OpenAI、Gemini 金鑰)
- 右鍵 ▸「🔊 朗讀」▸ 選 OpenAI 或 Gemini,就會把那段文字做成語音、存到 assets/,插入 [🔊 聽朗讀] 連結後馬上播放。請代理「唸這篇筆記給我聽」也是走這條路。Gemini 金鑰用免費方案也能用(在額度內 — Gemini 價目表 ↗)。
- 在播放列可以調整選聲音、試聽、播放/暫停、跳轉、速度 (0.75~2×)。預設聲音在設定的「語音設定」區塊決定,也可以像「用○○的聲音唸」這樣直接指定。
- 長文也能很快開始:會把文字切成好幾段,第一段一準備好就開始播放,後面的部分在你聽的時候接著做。進度條長度帶著 + 一直變長,就表示「後面的段落還在製作中」!
- 朗讀句子的醒目提示 🖍️:播放時,編輯器裡正在唸的句子會有淡淡的螢光筆跟著走,畫面也會一起捲動。可以用播放列上的螢光筆圖示開關。需要更精準的同步,就打開設定裡的「朗讀精準highlight同步」(使用 whisper 重新轉錄 — 需要 OpenAI 金鑰,會有額外費用)。

播放不會中斷(兩條路都一樣)— 朗讀中切到別的筆記、或去看儀表板,聲音也會繼續。這時播放列會顯示 🎧 筆記名稱,告訴你現在正在唸什麼,點一下就回到那篇筆記。回到原本的筆記後,句子醒目提示會接著出現;修改原文的話,只有醒目提示會悄悄關掉(播放照常)。

沒在聽就會自己消失 — 在暫停、唸完、或還沒選聲音的狀態下離開那篇筆記,播放列會自動關閉(免得孤零零地留在別的畫面)。待在正在朗讀的筆記裡時就會保留。

AI 朗讀播放列
▲ 編輯器下方的播放列 — 選聲音、試聽、播放/暫停、跳轉、速度、句子醒目提示開關,全在一行裡。

💡 圖片生成、朗讀、轉錄是用多少、就由各供應商 (OpenAI/Gemini) 計費多少的 BYOK(自備金鑰)功能。沒有金鑰時會跳出說明。(例外:用裝置語音聆聽和 iPhone、iPad 的語音轉錄都在裝置裡免費進行。)

更聰明的搜尋 — 語意搜尋與圖譜 🔎🕸️

關鍵字要一字不差才找得到的時代結束了!代理會用意思找,再順著連結結構擴大範圍。

開啟方法(語意搜尋需要先準備一次免費的嵌入引擎)

在面板的選項 (≡) 按鈕 →「語意搜尋的嵌入」類別(桌面版)可以選擇後端(自動偵測/Transformers.js/Ollama)與模型名稱。(圖譜搜尋不用另外安裝 — 馬上就能用!)

在 Mac 上不用金鑰 — 裝置 AI (Apple Intelligence) 🍎

只要是 macOS 26 以上、開啟了 Apple Intelligence 的 Mac,不用 API 金鑰也不用登入,就能在 Mac 裡使用簡短的 AI 功能。文字不會離開 Mac。

不用安裝就能用的助手命令 🎁

不用另外安裝,一開始就內建好了。在輸入框只要打 /,就會跳出各領域的助手!(在繁體中文介面,這些命令會以英文名稱顯示;像下面這樣只打開頭幾個字也會自動完成。)
- 寫作 — /draft /compose /craft /edit /revise /worldbuild /roleplay(化身角色設定筆記裡的人物,來一場情境劇對話 — 試著打 /roleplay 角色名稱,情境!)
- 讀書 — /studynote /summarize /quiz /example /errorlog /lecturenote /studyplan /homework
- 資料蒐集、論文 — /gather /excerpt /paper /litreview /factcheck /synthesize(這些助手禁止沒有出處的斷言,不知道就會說不知道!)
- 給 AI 的文件 — /aidoc /claudemd /skill /command /persona /harness
- 卡片盒筆記法、知識本體 — 用 /permanent /connect /classify /relate /atomize /attribute 等命令把知識結構化!→ 詳情:17 知識結構化
- 專案 — /projectsetup(說出類型或主題,像「幫我建一個網路小說連載專案」,就一次建好資料夾、專案 Base 和基本筆記)

命令名稱會跟著應用程式語言(韓文、英文、日文)改變,繁體中文介面則顯示英文名稱;用其他語言的名稱打也聽得懂。😊

一鍵建立 LLM 維基 📚

給開發者的 Git 自動整合(選用)🐙

從其他 AI 應用程式使用我的筆記庫 — 連接外部 AI 應用程式 (MCP) 🔌

除了 ObsiKO 裡的代理,也可以請 Claude Desktop、Cursor、VS Code、Claude Code、Codex CLI 這些其他 AI 應用程式「從我的筆記裡找找看」。
- 打開設定 ▸ 連接外部 AI 應用程式,在你用的應用程式卡片上按一次 [連接] 就好。把那個應用程式重新開啟,就會看到 ObsiKO 的工具。
- 要開放哪個筆記庫由你自己選(最多 3 個)。切換視窗也不會偷偷改掉。
- 唯讀 — 只能搜尋、讀取,不能寫入或刪除。用 ai: deny 藏起來的筆記在這裡也一樣排除。
- 在從官網下載的桌面版(Mac、Windows)可以用(Mac App Store 版沒有)。預設關閉。詳情請看 → 23 設定與主題

進階 — 把其他 MCP 伺服器接到 ObsiKO 的代理:反過來,也能讓 ObsiKO 的 Claude 引擎使用其他 MCP 伺服器的工具。在電腦的家目錄建立 ~/.obsiko/mcp-clients.json,寫成 {"servers": {"名稱": {"command": "執行指令", "args": ["…"], "env": {}}}} 的格式,下次執行起就會一起接上那個伺服器。放在家目錄而不是筆記庫,是為了不讓別人透過同步的筆記庫偷塞指令(名稱 obsiko、qmd 不能用)。


🚀 進一步了解用法(子頁面)

這些子文件會一步一步更深入地介紹實戰工作流程。建議從上往下依序閱讀。
- 16-1 基本用法 — 好好使喚它的基本功 + 小訣竅
- 16-2 情境應用範例 — 寫作、讀書、研究、結構化、轉換、心智圖
- 16-3 寫作與創作應用 — 6 種分階段的寫作助手
- 16-4 打造 LLM 維基 — 建立知識庫 + 像 NotebookLM 一樣使用 + 可讀取的檔案格式
- 16-5 卡片盒筆記法與知識本體 — 把筆記變成相互連結的知識
- 16-6 推薦提示詞集 — 複製就能用的提示詞
- 16-7 提示詞助手 — 用區塊組提示詞 + 建立框架(規則、命令)
- 16-8 純對話模式(行動版、網頁版) — 只靠 API 金鑰在 iPhone、網頁上用 AI(網路搜尋、看圖片、整理筆記)📱
- 16-9 AI 收費說明(訂閱與額度) — 哪些是訂閱、哪些是額度,一直到申請 API 金鑰 💳
- 16-10 AI 依據與隱私 — 確認回答的出處([S1]、依據清單)與指定不讓 AI 看的筆記 🔍🔒
- 16-11 記住的事 — 讓 AI 長久記住你的價值觀、判斷標準、專案脈絡(手動、自動)🧠
- 16-12 寫作助手 — 結構檢查 + 讓思考更深入的提問 + 10 種類型鏡頭的編輯式批改 ✍️


← 上一章:15-2 例行流程 · 回到首頁 · 下一章:16-1 基本用法 →