지난 글에서 Claude Code에 붙일 만한 도구인지를 기준으로 두 개를 살펴봤다. 이번엔 세션 사이의 맥락을 자동으로 기억해준다는 claude-mem이라는 플러그인을 같은 기준으로 봤다. 검색 요약만 보고 넘어가는 대신 npm 배포본을 직접 받아서 소스를 까보고, GitHub API로 지표를 검증하고, 이슈 트래커까지 훑었다. 그러다가 지금 쓰고 있는 Honcho와 자연스럽게 비교하게 됐고, 결론이 그쪽으로 흘러갔다.
claude-mem — 스타 9만 개, 뭘 하는 도구인가
claude-mem은 Claude Code 세션에서 벌어지는 일(도구 호출, 대화)을 후킹해서 LLM으로 압축한 요약(“observation”)을 로컬 SQLite와 Chroma 벡터 DB에 저장하고, 다음 세션 시작 시 관련 있어 보이는 맥락을 자동으로 프롬프트에 주입해주는 플러그인이다. 검색 요약에는 별 대단하지 않은 스타 수(4만 6천~9만 몇천 대까지 소스마다 제각각)가 떠서, GitHub API로 직접 확인했다 — 실제로는 92,811스타·8,164포크, 2025년 8월 말 만들어져서 지금도 매일 push되는 활발한 프로젝트였다. npm 최신 버전은 13.21.2, 지난달 다운로드 7만 건이 넘었다.
검증된 진짜 취약점 하나 — CVE-2026-11330 (이미 패치됨)
GitHub Security Advisory를 직접 조회하니 등록된 건 하나뿐이었다 — GHSA-5gvr-v6qv-h5mm(CVE-2026-11330), 관찰 내용의 해시를 계산하는 함수가 약한 해시 알고리즘을 쓰고 있었다는 낮은 심각도 이슈로, 로컬 공격만 가능하고 난이도도 높다고 평가돼 있었다. v12.0.0에서 이미 고쳐졌고, 지금 배포판(13.21.2)은 안전하다.
기본값을 소스에서 직접 확인했다 — 텔레메트리와 cmem.ai 트라이얼
트러스트 관련 문구를 검색 요약으로만 보는 대신, npm 배포본 tarball을
직접 받아서 번들된 코드를 grep했다. 기본 provider는 "claude", 인증
방식은 "subscription"으로 설정돼 있어서, 원칙적으로는 이미 로그인된
Claude 구독을 통해 Anthropic에 직접 요청하는 구조였다.
다만 신규 설치엔 30일 무료 체험이 자동으로 붙는데, 이 기간엔 압축
작업이 claude-mem 제작사(glass brain)가 운영하는 cmem.ai라는 별도
서버를 거쳐서 “구독 사용량을 안 깎아먹게”(off-plan) 처리된다. 체험이
끝나면 결제 안 해도 강제되진 않고 원래 방식(자기 구독)으로 조용히
돌아가는데, 그 순간 “off-plan 유지하려면 여기서 결제하라”는 안내 문구가
코드에 그대로 박혀 있었다. cmem.ai 페이지를 직접 열어서 가격도
확인했다 — 그 압축 오프로드 기능(Pro)은 월 30달러, 로컬 DB를 여러
기기에 동기화해주는 기능(Cloud)은 월 20달러, 팀 공유는 좌석당 월
333달러였다. 핵심 엔진 자체는 무료 오픈소스지만, 그 위에 오픈코어
방식으로 유료 상품을 얹은 구조였다.
텔레메트리(PostHog)도 기본으로 켜져 있었다. 다만 실제로 전송되는 필드를
전부 뽑아보니 버전·OS·토큰 수·비용·에러 종류 같은 순수 사용량 지표뿐이고
대화 내용이나 코드는 화이트리스트에 없었다. DO_NOT_TRACK 표준도
지원해서 끌 수는 있다.
이슈 트래커가 검색 요약보다 정직했다
“BURNS YOUR TOKENS - STAY CLEAR FOLKS”라는 자극적인 제목의 이슈를
열어봤더니, 본문은 빈 버그리포트 템플릿이고 별다른 근거 없이 닫혀
있었다 — 실질적인 증거는 아니었다. 대신 진짜 신뢰도에 영향을 주는 건
따로 있었다. Windows에서 훅이 프롬프트를 전부 조용히 막아버린 사례,
macOS에서 훅에 빈 입력이 들어오면 메모리 캡처가 아무 에러 없이 그냥
멈춰버린 사례, 특정 프로젝트를 제외하도록 설정해도 실제로는 요약이
계속 만들어지던 버그, <private> 태그로 가린 내용이 요약 단계에서
실제로는 안 걸러지던 버그까지 — 전부 지금은 닫힌 이슈지만, 공통점은
“조용히 실패한다”는 것이었다. 메모리가 안 잡히고 있어도 화면엔 아무
신호가 없다.
실사용 후기 하나(joecotellese.com)도 찾아봤는데, 직접 만든 수동 요약 워크플로를 claude-mem으로 바꾸고 나서 토큰 사용량이 오히려 줄었다고 긍정적으로 평가하고 있었다. 근데 이 글에서 “전부 로컬에만 저장되고 외부로 전혀 안 나간다”고 썼다 — 소스로 직접 확인한 것과는 다른 얘기였다. 호의적인 실사용 후기조차 프라이버시 구조는 틀리게 알고 있었던 셈이다.
Honcho와 비교하다가, 이미 꺼둔 기능이라는 걸 알았다
이 블로그에서 다른 세션이 뭘 했는지 조회할 때 쓰는 Honcho도 원래
claude-mem과 비슷한 걸 할 수 있었다. 매 턴 끝에 대화를 저장하는 훅
말고, 질문을 던지면 Honcho가 과거 기록을 종합해서 답을 합성해주는
dialectic 훅도 있었는데, 지금은 꺼져 있다 — 그 합성 답변이 사실과 다른
내용을 지어낸 적이 있어서 2026년 7월에 일부러 껐다. 지금은
~/.claude/settings.json을 열어봐도 대화를 저장만 하는 Stop 훅만
남아 있고, 자동으로 불러오는 훅은 없다. 조회하려면 사람이 직접 “다른
세션에서 뭐 했는지 찾아봐”라고 물어봐야 한다.
claude-mem을 파다가 이 구조와 겹치는 지점을 알아챘다 — dialectic 훅을 다시 켜면 “관련 있어 보이는 과거 기록을 자동으로 판단해서 매 턴에 섞어 넣는다”는 핵심 동작 자체가 claude-mem과 같은 범주가 된다. 그리고 그게 정확히 그 훅을 끈 이유였다.
다시 켠다고 가정해도 세부 구조는 다르다. Honcho는 그 턴의 마지막
사용자 발화·AI 응답 텍스트만 저장하고, 질문이 들어올 때마다 그 자리에서
라이브로 원본을 종합한다. claude-mem은 도구 호출·파일 변경 내용까지 다
관찰해서 세션이 끝날 때 미리 압축해두고, 다음 세션 시작 시 그 압축본을
벡터 검색으로 꺼내 쓴다 — 재료의 폭도, 압축 시점도 다르다. 조회 범위도
다르다. Honcho는 세션 ID를 사람이 직접 골라서 조회하는데, claude-mem은
프로젝트 전체를 하나의 전역 DB로 묶어서 자동으로 관련 프로젝트를
판단하고(그 “제외” 기능이 실제로 새던 버그 전적도 있다), 외부로도 기본
텔레메트리와 트라이얼 기간의 cmem.ai 경유가 있다. 둘 다 여러 에이전트를
지원한다는 점은 같다 — claude-mem은 Claude Code 외에 Codex, Gemini,
Hermes 등도 지원하고, Honcho도 이미 claude-code와 agy(Antigravity)
세션을 같은 서버에 저장하고 있다.
결론 — 지금은 수동 조회로 남겨두기로 했다
claude-mem의 설계 자체가 조악한 건 아니었다. 텔레메트리를 화이트리스트
방식으로 제한한 것도, DO_NOT_TRACK을 지원하는 것도 프라이버시를
신경 쓴 흔적이었다. 다만 “관련 있어 보이면 자동으로 판단해서 다음
세션에 섞어 넣는다”는 그 핵심 기능은, 정확히 예전에 Honcho에서
신뢰하지 못해 꺼둔 패턴을 다른 도구로 다시 켜는 것과 같은 범주다.
편의성은 분명히 크다 — 안 물어봐도 알아서 챙겨주니까. 근데 그 편의성이
정확히 예전에 우려했던 그 지점이고, 이슈 트래커에 남은 “조용히
실패한다”는 패턴까지 겹치면, 자동으로 섞이는 쪽을 도입하기 전에 다시
한번 더 확인해볼 부분이 있다는 뜻이다.
그래서 지금은 claude-mem을 새로 들이는 것도, Honcho의 dialectic 훅을 다시 켜는 것도 보류하고, 필요할 때 Honcho에 저장된 원본 대화를 직접 조회하는 지금 방식을 그대로 유지하기로 했다. 저장은 계속 자동으로 하되, 불러와서 “사실”로 취급하는 건 사람이 판단하는 지점을 남겨두는 쪽이다.