옵시디언 vault, RAG랑 뭐가 다른 거였을까 🗂️

얼마 전에 유튜브 영상을 공유 한 번으로 제 지식 저장소(vault)에 자동으로 쌓이게 만든 이야기를 적었습니다. 그 글을 본 지인이 이렇게 물었어요. “그럼 이제 챗봇한테 RAG로 연결해서 물어보면 되는 거 아니에요?”
순간 대답을 못 했습니다. 제가 몇 달째 매일 쌓고 있는 이 저장소가 RAG인 줄 알았거든요. 그런데 찾아보니 아니었습니다. 둘은 자료를 쌓는 시점부터 다르게 움직이고 있었습니다.
vault가 뭔지부터
제가 쓰는 옵시디언 vault는 거창한 게 아닙니다. 마크다운 파일(그냥 텍스트 파일이라고 보시면 됩니다)을 폴더에 모아두고, 파일과 파일을 링크로 연결해둔 것뿐입니다. 데이터베이스도 아니고 서버도 아니에요. 폴더 하나입니다.
다만 이 폴더 안에서 파일들이 서로 링크로 이어지면서, 옵시디언이 그걸 그래프(연결망)로 그려줍니다. 그래서 “지식이 쌓인다”는 느낌이 드는 거고요. 저는 여기에 회사 업무 자료, 가족 자산 정리, 개인 학습 노트를 영역별로 나눠 담아두고 있습니다.
실제로 자료가 들어가는 경로
말로만 하면 추상적이니, 실제로 자료 하나가 들어와서 정리되기까지 거치는 단계를 그대로 적어보겠습니다.

먼저, 자료가 들어옵니다. 경로는 여러 갈래입니다. 브라우저에서 클리핑 버튼을 누르거나, 떠오른 생각을 바로 적거나, 매일 아침 텔레그램으로 오는 브리핑이 자동으로 들어오거나, 유튜브 영상을 공유 한 번으로 보내거나요. 전부 일단 받아두는 폴더(inbox) 하나로 모입니다.
그다음, 자료가 그냥 저장되지 않습니다. 들어오는 순간 AI가 핵심을 3~5줄로 요약하고, 제 상황(하는 일·관심사)과 어떻게 연결되는지 한 줄 붙이고, 어느 폴더로 보내면 좋을지 제안하고, 같은 주제가 몇 번째 쌓이는 건지까지 표시합니다. 자료 하나 받을 때마다 이 네 가지가 같이 붙습니다.
이어서, 매일 아침 그 받아둔 폴더를 자동으로 비웁니다. 패턴이 뻔한 건 스크립트가, 판단이 필요한 건 에이전트가 나눠서 각자 있어야 할 폴더로 옮기고, 그 결과를 아침 브리핑으로 알려줍니다.
마지막으로, 한 달에 한 번 정해진 날에 60분을 들여 다시 봅니다. 그동안 쌓인 비슷한 주제의 메모들을 한 장으로 압축하고, 그 압축된 문서를 각 영역의 대표 색인 문서에 등록합니다. 나중에 뭔가 찾을 땐 이 색인 문서부터 열면 됩니다.
이 흐름을 한 번 실제로 돌려본 예가 있습니다. 유튜브 영상을 공유하면 다음 날 아침 요약 노트 하나가 받아둔 폴더에 도착합니다. 그러면 이게 그 자리에서 자동으로 분류되고, 비슷한 주제가 세 번쯤 쌓이면 다음 정리하는 날에 한 장으로 압축됩니다. 압축된 한 장이 나중에 제가 검색할 진짜 자료가 되는 거고요.
그래서 RAG랑 뭐가 다른가
여기까지 보면 “결국 검색해서 찾는 거 아니야?”라는 질문이 자연스럽게 나옵니다. 저도 그랬으니까요. 차이는 언제 정리를 하느냐에 있었습니다.
RAG는 자료를 잘게 쪼갠 다음, 그 조각을 숫자(임베딩)로 바꿔서 벡터 데이터베이스에 넣어둡니다. 그리고 질문이 들어오면, 그 순간에 질문과 가장 비슷한 조각을 계산으로 찾아옵니다. 새 문서가 하나 들어올 때마다 이 계산 작업(인덱싱)이 다시 필요하고, 벡터 데이터베이스 안의 내용은 숫자 뭉치라 사람이 열어봐도 못 읽습니다.
제가 쓰는 방식은 반대로 움직입니다. 자료가 들어오는 그 순간에 이미 개념을 뽑고 관계를 정리해서 사람이 읽을 수 있는 문서로 만들어둡니다. 나중에 새 자료 하나가 더 들어와도 그 자료만 처리하면 되지, 이미 정리해둔 문서 전체를 다시 계산할 필요가 없습니다. 그리고 결과물이 마크다운 문서라서, AI가 아니라 저도 그냥 열어서 읽을 수 있습니다.
검색할 때 계산할 것이냐, 저장할 때 미리 정리해둘 것이냐 — 그게 RAG와 vault의 진짜 차이였습니다.
기업이 다루는 문서 수백만 건이면 RAG 쪽이 현실적일 겁니다. 매번 사람이 손으로 정리할 수 없는 규모니까요. 하지만 저처럼 하루에 자료 몇 건을 쌓는 개인 규모에서는, 들어올 때 정리해두는 쪽이 계산 비용도 적고 결과물도 더 쓸모 있었습니다.
한계 — 목적 없이 쌓으면 무덤이 됩니다

이 방식에도 약점은 있습니다. 자료를 왜 저장하는지, 나중에 어떻게 써먹고 싶은지를 같이 적어두지 않으면, 그냥 “정리된 것처럼 보이는 창고”가 됩니다. 폴더는 예쁘게 나뉘어 있는데 아무도 다시 안 여는 상태요.
지난달, 다른 사람의 지식 저장소 운영 방식을 참고하다가 제 것에도 이 문제가 있는지 점검해본 적이 있습니다. 결과는 두 가지였습니다. 잘 되고 있는 부분도 있었고, 실제로 비어 있는 부분도 있었습니다.
비어 있던 것 중 하나는 “제가 누구고, 뭘 기준으로 판단하는지”를 정리해둔 문서가 없었다는 겁니다. 자료는 계속 쌓이는데, 그 자료를 어떤 기준으로 걸러 담을지 적어둔 기준 문서 자체가 없었어요. 그래서 제 세계관·판단 기준을 담은 문서 한 장을 새로 만들어서, 다른 자동화 작업이 참조할 기준점으로 등록했습니다.
또 하나는 캡처할 때 “왜 저장했는지”를 안 묻고 있었다는 겁니다. 자료가 들어오면 AI가 알아서 요약은 해주는데, 제 생각은 안 물었어요. 그래서 자료 정리 규칙에 한 줄을 추가했습니다. 제가 직접 넣은 자료는 “이걸 왜 저장했는지, 어떻게 써먹고 싶은지”를 되묻고, 그 답을 노트에 한 줄로 박아두게 했습니다.
나머지 두 개는 작업 세션 기록과, 쌓인 기록을 서사로 다시 읽어주는 회고 기능이었는데, 둘 다 별도 도구로 만들어 붙였습니다. 넷 다 공통점은 이겁니다. 저장하는 폴더 구조는 이미 있었지만, “왜”와 “그다음”이 빠져 있으면 아무리 정리해도 다시 안 열게 된다는 것.
지금은 이렇게 씁니다

요즘은 자료가 들어오면 자동으로 요약·분류되고, 한 달에 한 번 압축되고, 그 압축된 걸 다음 글이나 판단에 그대로 씁니다. 이 글도 몇 달 전에 본 영상 하나가 그 경로를 거쳐 압축된 메모로 남아 있었기 때문에 쓸 수 있었습니다.
따라 하기
거창한 시스템을 한 번에 만들 필요는 없습니다. 아래 순서로 하나씩 물어보시면, 지금 쓰는 메모 앱이 옵시디언이 아니어도 비슷하게 만들 수 있습니다.
1. 받아두는 곳과 정리된 곳을 폴더로 나누기
모든 걸 한 폴더에 넣으면 나중에 뭐가 정리됐고 뭐가 안 됐는지 구분이 안 됩니다. 먼저 두 폴더로만 나눕니다.
목표: 내 메모 폴더를 "일단 받아두는 곳"과 "정리 끝난 것"
두 개로 나누는 것.
- 받아두는 곳(inbox)에는 아무 형식 없이 던져도 되는 자료가 쌓이게 해줘.
- 정리된 곳에는 한 주제당 하나의 문서만 있어야 해(중복 금지).
- 지금 내 폴더 구조를 보고, 이 두 역할 중 어디에도 안 맞는 파일이 있으면 알려줘.
왜 필요한가 — 이 구분이 없으면 “정리”와 “저장”이 같은 동작이 돼버려서, 나중에 뭘 다시 봐야 할지 못 고릅니다.
2. 자료를 넣을 때 “왜”를 같이 묻게 하기
자료 요약만 자동으로 해주면, 시간이 지나면 왜 저장했는지 잊어버립니다.
목표: 자료를 받아두는 곳에 새 항목이 들어올 때마다,
요약과 함께 "왜 이걸 저장했는지, 나중에 어떻게 쓰고 싶은지"를
나한테 한 줄로 물어보고 그 답을 같이 저장하는 것.
- 내가 답을 안 하면 그냥 요약만 저장해도 돼. 강제로 막지는 마.
- 이미 저장된 오래된 자료들 중, 이 질문에 답이 없는 것들도
나중에 찾아서 다시 물어볼 수 있게 표시해줘.
왜 필요한가 — 이유 없이 쌓인 자료는 나중에 “이거 왜 저장했지”부터 다시 조사해야 합니다. 저장하는 순간의 맥락이 제일 저렴합니다.
3. 비슷한 주제가 몇 번 쌓이면 알려주게 하기
압축(정제)은 사람이 직접 시작하기 전에는 잘 안 일어납니다. 신호를 먼저 받아야 합니다.
목표: 같은 주제로 분류된 메모가 3개 이상 쌓이면,
"이 주제는 이제 한 장으로 압축할 때가 됐다"고 알려주는 것.
- 판단 기준은 폴더나 태그가 같은 자료 개수로 해줘.
- 알림은 정해진 시간(예: 매주 한 번)에 한꺼번에 모아서 줘.
왜 필요한가 — 압축할 타이밍을 사람이 기억해뒀다가 챙기는 건 오래 못 갑니다. 신호가 자동으로 와야 실제로 압축까지 이어집니다.
4. “나는 이런 기준으로 판단한다” 문서 한 장 만들기
폴더 구조보다 먼저 필요한 건 이 문서였습니다. 없으면 뭘 남기고 뭘 버릴지 기준이 없습니다.
목표: 내가 지금까지 쓴 메모·결정·산출물을 AI에게 읽히고,
"나는 무엇을 중요하게 생각하고, 어떤 기준으로 판단하는지"를
한 장짜리 문서로 뽑는 것.
- 결론부터 말고, 근거로 삼은 내 과거 기록을 같이 인용해줘.
- 이 문서는 나중에 다른 자동화 작업들이 참고할 기준 문서로 쓸 거야.
왜 필요한가 — 이 문서가 없으면 자료를 아무리 잘 쌓아도 “그래서 이게 나한테 왜 중요한데”라는 질문에 시스템이 답을 못 합니다.
결국 남는 건
RAG냐 vault냐는 사실 기술 선택의 문제였습니다. 진짜 중요한 건 그 뒤에 있는 질문이었어요. 내가 이 자료를 왜 쌓고 있고, 나중에 뭘 하려는가. 그 질문에 답이 있으면 폴더 몇 개로도 충분했고, 답이 없으면 아무리 좋은 도구를 붙여도 무덤이 됐습니다.
오늘도 차분히 한 걸음. 🐴
이 글은 산업 구조와 만드는 과정을 정리한 개인 기록입니다.
특정 종목의 매수·매도 추천이 아니며, 투자 판단과 그 결과는 독자 본인에게 있습니다.