ObsiKO ObsiKO 도움말

16 AI 에이전트

혼자 글쓰기 외로우셨죠? 내 노트를 함께 읽고, 쓰고, 정리해 주는 똑똑한 AI 친구를 소개합니다!

💻🆚📱 이 문서가 설명하는 풀 에이전트(CLI 설치+로그인, 자료수집·의미검색·마인드맵 생성까지)는 데스크탑(PC) 전용이에요. 하지만 이제 API 키만 넣으면 쓸 수 있는 채팅 전용 모드가 생겨서 아이폰·아이패드·브라우저·맥앱스토어에서도 AI와 대화하고 노트를 정리할 수 있어요! → 16-8 채팅 전용 모드 (모바일·웹)

🚀 바로 실전으로? 아래 활용법 하위 항목(12-1~12-8)에서 워크플로·LLM위키·추천 프롬프트·채팅 전용 모드까지 단계별로 알려드려요!

💳 뭐가 유료(크레딧)이고 뭐가 구독인지 헷갈린다면 — ⓒ 배지의 뜻부터 API 키 만들기까지 → 16-9 AI 과금 안내(구독과 크레딧)

← 홈으로: 옵시코 101


어디 숨어 있나요? 🧐

AI 에이전트 채팅 패널 ▲ 오른쪽 패널에서 AI 조수와 대화하며 노트를 함께 정리해요. (이 페이지의 풀 에이전트는 데스크탑 전용 · 채팅 전용 모드는 웹·모바일에서도)

내 맘대로 고르는 AI 엔진 🧠

안전제일! 옵시코의 철저한 보호 🛡️

알면 알수록 편한 기능들 ✨

스스로 검토하고 고치는 '루프' 🔁 (Claude 전용)

글 한 번 쓰고 끝? 아니에요! 이제 에이전트가 자기가 쓴 노트를 스스로 검토하고 다시 고치는 똑똑한 루프를 돌려요. 켜고 끄는 건 패널의 옵션(≡) 버튼 → '루프' 카테고리에서 해요.

루프가 개입할 때마다 채팅에 🔁 한 줄로 "무슨 검사가 몇 번째 돌았는지" 알려줘요. 비평가가 리뷰하는 동안엔 상태 표시줄에 '결과 리뷰 중'도 떠요.

💡 이 루프는 Claude 엔진 전용이에요(Gemini·Codex는 자체적으로 끝까지 진행해요).

큰 작업은 나눠서 동시에 — 병렬 분담 🔀 (Claude 전용)

"주제 10개 조사해서 노트로 만들어줘" 같은 덩치 큰 작업, 하나씩 차례로 하면 오래 걸리죠. 옵션(≡) → '멀티 엔진 협력' 카테고리의 '병렬 분담'을 켜면, 에이전트가 작업을 독립된 하위 작업 2~8개로 나눠 동시에(한 번에 3개씩) 진행하고 마지막에 결과를 종합해요.

⚠️ 여러 실행이 동시에 돌아 토큰을 몇 배로 쓸 수 있어요. 대량 자료수집·일괄 정리처럼 정말 큰 작업에서만 켜는 걸 추천! 기본은 꺼짐이고 Claude 엔진 전용이에요.

캔버스로 그려서 시키기 — 그린 대로 착착 🗺️

AI에게 마인드맵을 그려달라고 할 수 있다면, 거꾸로도 되겠죠? 폴더 구조나 작업 계획을 캔버스에 슥슥 그려서 에이전트에게 참조로 붙이고 "이 캔버스 구조대로 만들어줘/정리해줘/진행해줘"라고 해보세요.

💡 파일 이동은 Claude 엔진에서만 돼요(Gemini·Codex는 새로 만들기까지만). 캔버스 그리는 법은 11 마인드맵 참고!

AI가 고친 걸 되돌리기 — 변경 이력 ⏮️ (가상 워크트리)

"어? AI가 고친 게 맘에 안 드는데 원래대로 돌릴 순 없나?" 이제 됩니다! 에이전트가 파일을 만들거나 고칠 때마다 실행 단위로 '변경 전/후'를 저장해 둬서, 언제든 비교하고 되돌릴 수 있어요. git을 몰라도 되는 가벼운 '가상 워크트리'예요.

💡 되돌리기가 되는 건 글자(텍스트) 파일이에요(노트·캔버스·코드 등). 이미지·PDF 같은 큰 파일은 비교/복원 대상이 아니에요.

에이전트 설정은 패널 안에! ⚙️

예전엔 설정 모달에 흩어져 있던 AI 에이전트 설정들이 이제 패널 헤더의 옵션(≡) 버튼 한 곳에 깔끔하게 모였어요. - 맨 위 토글: 개인화 기억 자동 축적 · 대화 원본 기록 (이 둘은 채팅 전용 엔진에서도 떠요 → 16-11 기억해 둔 것) - 그다음 토글(데스크탑 CLI 엔진일 때): 답변 .md로 받기 · 토큰 최적화 · 작업 완료 보고 · Gemini 콘텐츠 필터 완화 · Codex에 도구 연결 (뒤 두 개는 켤 때 주의 대화상자로 한 번 더 확인해요 — 볼트 밖까지 영향을 줄 수 있어서요.) - 바로 실행하는 버튼 둘: 시맨틱 색인 만들기(의미검색 색인을 한 번에) · 대화 요약 저장(지금 대화를 요약해 노트로) - 접이식 카테고리: 루프(바로 위 참고) · 멀티 엔진 협력 · git(자동 커밋·원격·push) · 시맨틱 검색 임베딩(백엔드·모델) - 멀티 엔진 협력 🤝: 엔진 셋(Claude·Gemini·Codex)이 서로 도와요 — 자문 도구를 켜면 작업 중인 엔진이 막힐 때 다른 엔진에게 의견을 물을 수 있고(ask_gemini 같은 도구로), 병렬 초안·종합을 켜면 다른 엔진들이 각자 초안을 먼저 쓰고 리드 엔진이 이를 교차 검증해 종합해요. 품질은 올라가지만 토큰도 그만큼 더 쓴답니다. (병렬 분담 토글도 이 카테고리에 있어요 — 위 병렬 분담 섹션 참고!) - 그 아래: 엔진 API 키 입력칸(비우면 로그인/구독 사용) - 토큰 사용량 📊: 각 키 입력칸 아래에 이 앱에서 쓴 입력·출력 토큰 합계가 쌓여요. 채팅뿐 아니라 에이전트 실행분(Claude·Gemini·Codex)도 집계되고, [초기화]로 언제든 0부터 다시 셀 수 있어요. (제공자 청구 대시보드가 아니라 옵시코에서 쓴 양의 참고용이에요.) - 각 항목 이름 옆의 '?'에 마우스를 올리면 자세한 설명이 툴팁으로 떠요.

다양한 자료를 .md로 — 웹·영상·문서·이미지·데이터 📥

에이전트가 단순 검색을 넘어 온갖 형식의 자료를 읽어 노트로 바꿔줘요(데스크탑). Claude는 전부, Gemini·Codex도 대부분의 도구를 씁니다(유튜브·PDF·문서·전사·RSS·표·문서 내용 검색·의미검색·그래프, 게다가 이미지 생성·낭독(TTS)까지 — 아래 이미지·낭독 섹션 참고). 단 이미지 보기·스캔 OCR는 Claude 전용이에요.

🌐 웹·영상 - 웹 검색으로 자료 모으기: 주제를 주면 웹 검색 결과(제목·요약·날짜)를 모아 정리해 .md로 만들어요. "○○ 최신 소식 정리해줘"처럼요(파일명·제목 앞에 날짜 YYYY-MM-DD 자동). 안정성을 위해 페이지를 하나하나 직접 열어 읽는 방식은 기본적으로 꺼져 있고, 검색 결과를 토대로 작성해요. - 유튜브 정리: 영상 URL을 주면 자막(전사)을 가져와 .md로. (자막 있는 영상만. yt-dlp 설치 시 더 안정적 — 없어도 동작) - RSS/뉴스 피드: 피드 주소를 주면 최신 항목(제목·날짜·링크·요약)을 깔끔히 모아 다이제스트로 만들어요.

📄 파일·문서(볼트 안 파일이나 채팅에 드래그한 첨부 파일) - PDF(텍스트형): "이 PDF 정리해줘" → 페이지별 텍스트를 뽑아 요약·정리. - PDF(스캔·이미지형): 글자가 그림으로 된 스캔본도, 페이지를 이미지로 렌더해 직접 보고 읽어(OCR) 옮겨 적어요. (poppler 설치 필요 — 무료: macOS brew install poppler, Windows scoop install poppler. 한 번에 최대 8쪽이라 길면 "1-10쪽 먼저"처럼 범위를 나눠 부르면 돼요. Claude 엔진 전용.) - 이미지: 스캔 문서·손글씨·차트·사진 속 글자를 직접 보고 옮겨 적거나 설명해 줘요(별도 OCR 설치 불필요). - 오피스·전자책: Word·PowerPoint·ODT·EPUB·RTF·HTML 등을 마크다운으로 변환. (pandoc 설치 필요 — 무료) - 음성·영상 전사: 자막 없는 강의·팟캐스트·녹음·영상을 받아써요. 이제 클라우드 API(OpenAI·Gemini)로 전사해서 whisper 설치 없이도 돼요(로컬 whisper가 깔려 있으면 그걸 우선 써요). 영상은 Gemini, 음성은 OpenAI를 우선 골라요. (에이전트에게 부탁하는 것 말고, 탐색기에서 우클릭 → '음성·영상 → 노트(전사)'명령 팔레트 → '음성·영상 전사'로도 바로 돼요 — 전 플랫폼.) - 표 데이터: CSV·TSV·JSON 파일을 깔끔한 마크다운 로. - 문서 내용 검색: 일반 노트뿐 아니라 PDF·Word·Excel·CSV·JSON·텍스트 문서들의 본문 속 내용까지 뒤져 "○○ 내용이 든 문서 찾아줘"에 답해요.

🔧 앱·속성 조회 - 앱 사용법 검색: "옵시코에서 PDF 내보내기 어떻게 해?"처럼 앱 사용법을 물으면, 에이전트가 추측하지 않고 이 도움말 위키(옵시코 101)를 직접 검색해 그 내용을 근거로 답해요. (내 노트를 찾는 볼트 검색과는 별개예요.) - 속성으로 노트 찾기: 프론트매터 속성을 데이터베이스처럼 조건 검색해요 — "상태가 진행중인 프로젝트 노트 목록", "type: book이고 rating 4 이상". 폴더·태그·속성 조건(AND)으로 걸러 정렬까지. .base 표에 대해 물으면 그 표의 조건을 그대로 옮겨 조회해요. → 12 Bases(데이터 표)

💡 pandoc·yt-dlp·poppler무료 도구예요(전사는 이제 클라우드 API로 되니 whisper는 선택 사항). 안 깔려 있어도 앱은 멀쩡하고, 그 기능을 부탁할 때만 한 줄 설치 안내를 알려줘요. 🛡️ 안전하게: 파일은 볼트 안 + 내가 첨부한 것만 읽고, 웹 자료는 사설/내부망 주소를 막고 안전하게 가져와요. 자막·텍스트가 없으면 "없다"고 솔직히 알려준답니다.

그림도 그리고 목소리로도 — AI 이미지 생성 & 낭독 🎨🔊

읽고 쓰는 것뿐 아니라, 이제 그림을 그리고 글을 목소리로 읽어주기도 해요! 이 두 기능은 API 키만 있으면 데스크탑·아이폰·아이패드·웹 어디서나 써요(OpenAI 또는 Gemini 키 — 설정의 채팅 API 키).

🎨 이미지 생성 (텍스트 → 그림) - 채팅에 "○○ 그려줘"라고 하면 에이전트가 그림을 만들어 볼트 assets/ 폴더에 저장하고 노트에 넣어줘요. - 또는 본문에서 설명 글을 선택 → 우클릭 → '🎨 AI로 이미지 만들기'(OpenAI/Gemini 중 선택)하면, 그 문장을 바탕으로 이미지를 만들어 선택한 글 바로 아래에 삽입해요. - 참조 이미지로 그리기(스케치 → 그림) 🖍️: 스케치나 사진을 채팅에 첨부하고 "이 스케치 바탕으로 그려줘"라고 하면, 그 그림의 구도와 선을 살려서 완성해 줘요(image-to-image). 캔버스에 슥슥 그린 밑그림을 채색·완성시킬 때 딱이에요. - 인물·캐릭터를 그릴 땐 머리 윗부분이 잘리지 않게 알아서 여백을 잡아줘요. - ✨ 제목 로고 만들기: 우클릭 → ✨ AI 만들기 → '제목 로고 만들기' — 선택한 글(없으면 노트 제목)을 문구로, 스타일 10종(미니멀·손글씨·네온·빈티지·3D·수채·웹소설·게임·영상·도서)과 배경(단색/투명/일러스트), 모델·추가 지시를 골라 예쁜 타이틀 로고를 만들어 본문에 넣어줘요. 투명 배경은 GPT Image 모델 전용(진짜 알파 PNG). 한글 문구는 짧을수록 정확해요!

▲ 설명 글을 선택해 우클릭 → 'AI로 이미지 만들기'. 만든 그림이 선택한 글 아래에 쏙 들어가요.

🔊 AI 낭독 (글 → 목소리, TTS) - 본문 글을 선택 → 우클릭 → '🔊 AI로 읽어주기'(OpenAI/Gemini)하면, 그 글을 음성으로 만들어 assets/에 저장하고 [🔊 낭독 듣기] 링크를 넣은 뒤 바로 재생해요. - 노트 전체는 명령 팔레트 → '노트 읽어주기'로 들어요(선택 영역이 있으면 그 부분만). 에이전트에게 "이 노트 읽어줘"라고 해도 돼요. - 재생 막대에서 목소리 고르기·미리듣기·재생/멈춤·구간 이동·배속(0.75~2×)을 조절해요. 기본 목소리는 설정의 'AI 음성' 섹션에서 정하고, "○○ 목소리로 읽어줘"처럼 콕 집을 수도 있어요. - 긴 글도 금방 시작: 글을 여러 조각으로 나눠 첫 조각이 준비되는 즉시 재생을 시작하고, 뒷부분은 들으시는 동안 이어서 만들어요. 시크바 길이가 +와 함께 점점 늘어나면 "아직 뒷조각을 만드는 중"이라는 뜻! - 읽는 문장 강조 🖍️: 재생 중 에디터에서 지금 읽는 문장에 은은한 형광펜이 따라다니고 화면도 함께 스크롤돼요. 재생 막대의 형광펜 아이콘으로 켜고 끌 수 있어요. 더 딱딱 맞는 싱크가 필요하면 설정의 '낭독 정밀 하이라이트 싱크'를 켜세요(whisper 재전사 사용 — OpenAI 키 필요, 추가 비용). - 재생은 끊기지 않아요: 낭독 중에 다른 노트로 이동하거나 글을 써도 재생 막대는 그대로 떠 있어요. 원문 노트로 돌아오면 문장 강조도 다시 이어지고, 원문을 고치면 강조만 살짝 꺼져요(재생은 계속).

▲ 에디터 아래 재생 막대 — 목소리 선택·미리듣기·재생/멈춤·구간 이동·배속·문장 강조 토글을 한 줄에서.

💡 이미지 생성·낭독·전사는 쓴 만큼 각 제공자(OpenAI/Gemini)에 과금되는 BYOK(내 키) 기능이에요. 키가 없으면 안내가 떠요.

더 똑똑한 검색 — 의미검색 & 그래프 🔎🕸️

키워드가 정확히 같아야만 찾는 시대는 끝! 에이전트가 뜻으로 찾고, 연결 구조로 넓혀줘요.

켜는 법 (의미검색은 무료 임베딩이 한 번 필요해요)

의미검색은 로컬 임베딩 엔진이 있어야 해요(둘 중 하나, 무료): 1. Ollamaollama pull nomic-embed-text (가장 쉬움), 또는 2. 자체 내장 — 앱 폴더에서 npm i @huggingface/transformers (완전 자립, 첫 검색 때 모델 1회 다운로드)

패널 옵션(≡) 버튼 → '시맨틱 검색 임베딩' 카테고리(데스크탑)에서 백엔드(자동/Transformers/Ollama)와 모델명을 고를 수 있어요. (그래프 검색은 추가 설치가 필요 없어요 — 바로 동작!)

설치 없이 바로 쓰는 도우미 커맨드 🎁

별도 설치 없이 기본 탑재돼 있어요. 채팅창에서 / 만 치면 분야별 도우미가 떠요! (커맨드의 정식 이름은 모두 끝에 도우미가 붙지만, 아래처럼 앞부분만 쳐도 자동완성으로 떠요.) - 글쓰기/초고 /작문 /작법 /편집 /퇴고 /설정 - 공부/공부노트 /요약 /문제제작 /예시제작 /오답노트 /강의노트 /학습계획 /숙제 - 정보수집·논문/정보수집 /발췌 /논문분석 /문헌조사 /사실확인 /지식정리 (이 도우미들은 출처 없는 단정 금지, 모르면 모른다고 해요!) - AI용 문서/AI문서 /CLAUDE /스킬문서 /슬래시커맨드 /에이전트지침 /하네스 - 제텔카스텐·온톨로지/영구노트 /연결 /분류 /관계 /원자화 /속성 등으로 지식을 구조화! → 자세히: 17 지식 구조화

영어/일본어로 앱을 쓰면 커맨드 이름도 그 언어로 바뀌고, 다른 언어로 쳐도 알아들어요. 😊

원터치 LLM위키 구축 📚

개발자분들을 위한 Git 자동 연동 (선택) 🐙


🚀 활용법 더 알아보기 (하위 항목)

실전 워크플로를 단계별로 더 깊이 다룬 하위 문서들이에요. 위에서 아래로 따라 읽으면 좋아요. - 16-1 기본 활용법 — 잘 부려먹는 기본기 + 꿀팁 - 16-2 상황별 활용 레시피 — 글쓰기·공부·연구·구조화·변환·마인드맵 - 16-3 글쓰기·작문 활용법 — 단계별 글쓰기 도우미 6종 - 16-4 LLM위키 만들기 — 지식 베이스 구축 + 노트북LM처럼 쓰기 + 읽는 파일 형식 - 16-5 제텔카스텐·온톨로지 활용 — 메모를 연결된 지식으로 - 16-6 추천 프롬프트 모음 — 복사해 바로 쓰는 프롬프트 - 16-7 프롬프트 도우미 — 블록으로 프롬프트 짜기 + 하네스(규칙·커맨드) 만들기 - 16-8 채팅 전용 모드 (모바일·웹)API 키만으로 아이폰·웹에서 AI 쓰기(웹 검색·이미지 보기·노트 정리) 📱 - 16-9 AI 과금 안내(구독과 크레딧) — 뭐가 구독이고 뭐가 크레딧인지, API 키 만들기까지 💳 - 16-10 AI 근거와 프라이버시 — 답변의 출처 확인([S1]·근거 목록)과 AI에게 감출 노트 지정하기 🔍🔒 - 16-11 기억해 둔 것 — AI가 내 가치관·판단 기준·프로젝트 맥락을 오래 기억하기(수동·자동) 🧠 - 16-12 글쓰기 도우미 — 구조 점검 + 생각을 깊게 하는 질문 + 장르 렌즈 10종의 편집자식 첨삭 ✍️


← 이전: 15-1 복습과 재발견 · 처음으로 · 다음: 16-1 기본 활용법