CMDSPACE·구요한쓰는 방식이 축적되느냐, 매번 증발하느냐가 갈림길입니다.
연구자의 지식 시스템(볼트 · LLM Wiki · 하네스) 위에 AI Agent를 올리는 법을 다룹니다.
cmdspace.work
국가과학기술인력개발원(KIRD) · 2026.09.02(수) 15:30–17:30 · 청주
CMDSPACE오늘 보여드리는 것은 이론이 아니라, 3년 · 10,000개 노트로 직접 운영해 온 실물입니다.
KIRD 신진연구원 과정 · 구요한02
CMDSPACE현장은 — AI 구독료 영수증 증빙이 매월 반복, 대부분 기관에 생성형 AI 보안규정 부재로 책임은 연구자 개인에게 전가, 일부 기관은 아예 차단.
문제는 "쓸 것이냐"가 아니라 "쓰는 방식이 축적되느냐, 증발하느냐"03
CMDSPACE오늘 두 시간은 이 문장에 대한 개인 수준의 실행 답안입니다. 조직의 데이터 체계는 기다려야 하지만, 내 연구 지식의 구조는 오늘 밤부터 바꿀 수 있습니다.
출처: 헬로디디 · 2026 출연연 업무보고 보도04
CMDSPACENAIS는 출연연 전용 온프레미스 AI 환경과 연구용 샌드박스를 준비 중이고, 'AI 과학자 플랫폼' 베타는 연내 예정입니다. "보안 때문에 못 쓴다"를 국가가 풀겠다고 나선 겁니다 — 다만 그 사이 넉 달을 어떻게 쓰실 겁니까?
출처: co-scientist.kr · nst.re.kr · ai4scikorea.org05
CMDSPACE이 불편함은 비합리가 아니라 정확한 감각입니다. 오늘은 그 불편함이 어디서 오는지 짚고, 구조로 푸는 이야기를 합니다.
출처: Nature, "Scientists have a bad case of AI FOMO" (2026-06)06
CMDSPACE| 설계 | 관측 연구 (arXiv 2412.07727 · v3) | 무작위 대조시험 (METR) |
|---|---|---|
| 표본 | 자연과학 논문 4,130만 편 관측 | n=16 · 실제 이슈 246건 |
| 결과 | 논문 3.02배 · 인용 4.84배 · 팀리더 1.37년 단축 | 완료 시간 19% 증가 (느려짐) |
| 강점 / 약점 | 규모 / 선택 편향 | 인과 식별 / 소표본 · 코딩 한정 |
두 결과가 동시에 참일 수 있다는 것 — 여기서 오늘 이야기가 시작됩니다.
출처: arXiv 2412.07727 (v3) · arXiv 2507.09089 (METR)07
CMDSPACE후속 측정은 METR 스스로 선택 편향으로 해석 불가 판정. 측정조차 어려워졌다 — 그래서 감각이 아니라 구조로 접근해야 합니다.
출처: METR (arXiv 2507.09089 · 2026-02 설계변경 공지)08
CMDSPACE환각률 자체는 개선 추세입니다. 그러나 인용은 다릅니다 — 초안이 아무리 빨라져도 인용을 못 믿으면 검증 비용이 생성 이득을 잡아먹습니다.
출처: GhostCite (arXiv 2602.06718) 외 · 프리프린트 중심 — 수치는 범위로만09
CMDSPACE실무 원칙은 하나 — 인용을 생성하는 도구가 아니라 검색해서 가져오는 도구를 쓸 것. 이것이 오늘의 설계 목표, 검증 가능한 구조입니다.
AI는 소스를 찾는 데 쓰되, 소스 자체로 쓰지 말 것10
CMDSPACEv1 프롬프트 → v2 컨텍스트 → v3 하네스. 3년간 무엇이 바뀌었는가.
CMDSPACEv1→v3에서 사용자 입력은 다시 짧아집니다. 그런데 출력은 더 풍부하고, 재현 가능하고, 축적됩니다. 차이를 만드는 건 프롬프트가 아니라 하네스.
KIRD 신진연구원 과정 · 구요한12
CMDSPACE제가 '하네스'라 부르는 걸 Anthropic은 '컨트롤 플레인'이라 부릅니다. 이름만 다를 뿐 업계가 같은 곳을 가리킵니다. 그리고 Claude Code SDK가 Agent SDK로 개명됐습니다 — 코딩에서 검증된 하네스가 연구로 일반화되는 중.
출처: Anthropic — Effective context engineering for AI agents13
CMDSPACE코딩 에이전트의 하네스가 도구·권한·지식베이스·룰이라면, 연구자의 하네스는 볼트 + 레퍼런스 매니저 + 연구노트 + 개념 위키 + 시스템 파일입니다.
KIRD 신진연구원 과정 · 구요한14
CMDSPACE| 포맷 | 강제하는 사고 |
|---|---|
| PPT | 슬라이드 단위 사고 — 닫힌 포맷, AI에게도 닫힌 지식 |
| 표 | 비교 사고 |
| Markdown | 구조화 + 연결 사고 — 에이전트가 파싱 레이어 없이 그냥 읽는다 |
| YAML | 필드 수준 의미 선언 — 기계가 읽는 메타데이터 |
kepano의 "file over app" — 논문을 쓰기 전에, 어떤 포맷으로 지식을 쌓을지를 먼저 결정해야 합니다.
McLuhan "미디어가 메시지다"의 AI 시대 확장15
CMDSPACE
마무리: 10,000+ 노트 그래프뷰 — "정리한 게 아니라 연결된 겁니다"⚠ v3 선발사 · 실패 시 캡처 백업
CMDSPACE2부는 오늘의 본론 — LLM Wiki, 지식이 복리로 쌓이는 구조입니다.
CMDSPACE볼트가 일하는 공간이라면, 위키는 지식이 축적되는 코드베이스입니다.
CMDSPACE에이전트가 불변 원문(raw sources)을 지속·상호링크된 마크다운 위키로 컴파일합니다. 읽을 때마다 새로 요약하는 게 아니라 기존 페이지를 갱신 — 그래서 복리.
출처: Karpathy · LLM Wiki (GitHub gist)19
CMDSPACE어제의 답이 오늘의 출발점이 되는 구조 — 연구 지식에 필요한 건 이것입니다.
KIRD 신진연구원 과정 · 구요한20
CMDSPACE연구자에게 익숙한 감각입니다 — 사료와 논문을 분리하는 것. 원문은 건드리지 않고, 해석만 계속 갱신합니다.
KIRD 신진연구원 과정 · 구요한21
CMDSPACEAI가 인용을 만들어내지 못하게 하는 가장 확실한 방법 — 내가 넣은 것 안에서만 말하게 하는 것. 검증 병목과 LLM Wiki가 한 줄로 연결됩니다.
NotebookLM은 학술 DB에 독립 접근하지 않고 사용자가 준 소스에만 근거22
CMDSPACE문서를 쌓기 전에 해석의 질서를 설계하세요. 파일이 약 200개를 넘고 에이전트가 전체 그래프를 담지 못하면 패턴이 무너집니다 — 그때 필요한 게 경량 인덱스와 스키마.
Forte의 경고 — "노트가 엉망이면 AI가 구원하지 않는다." AI는 PKM을 대체하지 않고 leverage를 바꿉니다. 잘 쓰면 구조화된 memory로, 못 쓰면 문서를 high-speed drift로.
CMDSPACE모델 계층에서 싸우는 회사들이 인프라 계층에서는 협력합니다 — Linux · Kubernetes가 걸어간 길과 같은 패턴.
출처: modelcontextprotocol.io · 규모 수치는 방향성만 (18개월 만에 세 자릿수 배수 성장)24
CMDSPACE한계도 정직하게 — 대부분의 학술 MCP 서버는 검색·메타데이터에 집중하고 인용 내보내기는 Zotero 계열이 그 간극을 메웁니다.
GitHub 1차 확인 · 보안: 표준이 인프라가 되며 CVE·프로덕션 사고 보고 시작 (기관 심사 필요)25
CMDSPACEAI가 초안을 쓰는 건 이제 놀랍지 않습니다. 놀라워야 할 건 — AI가 자기가 쓴 인용을 스스로 검증하게 만드는 것.
검증 병목(§support vs existence)이 눈앞에서 닫히는 지점⚠ 백업 클립 준비
CMDSPACE성능이 아니라 재현성 · 감사 가능성 · 기존 도구 통합이 채택을 결정합니다 — 이 문장이 오늘 강의 전체의 요약이기도 합니다.
출처: TechCrunch (Claude Science) · Google DeepMind Blog27
CMDSPACE남는 질문 — 즐거운 노동을 자동화하는 방향이 맞는가. 실행은 넘기되, 무엇을 지킬지는 연구자의 선택입니다.
과학이 어려운 이유: 아이디어에 실험적 검증이 필요하기 때문28
CMDSPACE| 출판사 | 입장 |
|---|---|
| Science (AAAS) | 가장 엄격 — AI 생성 텍스트 사실상 전면 금지, 프롬프트·출력 요청 시 제공 |
| Nature / Springer | AI 저자 금지 · 실질 사용은 Methods 기재 · 순수 copy editing 면제 · 심사자의 원고 업로드 금지 |
| Elsevier | 별도 AI declaration statement · 편집자·심사자의 AI 사용 금지 |
현 정책은 '생성형 AI 도구' 일반 — 자율 에이전트 규정은 아직 공백. 이 공백이 지금 감사 로그 남기는 구조를 만들어야 하는 이유입니다. 국내도 AI연구윤리 가이드라인·국가연구데이터법 추진 중.
전 출판사 공통: 책임을 질 수 없으므로 저자 불가29
CMDSPACE| 넣어도 되는 것 | 판단 유보 — 기관 확인 | 절대 금지 |
|---|---|---|
| 공개된 논문·특허·표준 | 미공개 실험 데이터 (등급 확인) | 국가연구개발과제 미공개 정보 |
| 내가 쓴 초안 문장 (민감정보 제거) | 과제 제안서 일부 표현 | 보안과제 자료 일체 |
| 공개 데이터셋 | 공동연구 파트너 자료 | 심사 중인 타인 원고·심사보고서 |
| 개념 질문·방법론 상담 | 내부 회의록 | 개인정보 포함 데이터 |
"AI 쓰지 마세요"도 "마음껏 쓰세요"도 답이 아닙니다. 등급을 나누는 게 답이고 — 등급을 나누려면 지식이 이미 구조화돼 있어야 합니다.
출처: 한국연구재단 권고 (제40조) · N2SF 기밀(C)/민감(S)/공개(O) 차등 통제30
CMDSPACE제도는 "가능하다, 다만 명확히 관리되어야 한다"고 말하는데, 그 단서 조항이 현장에서는 "그냥 하지 말자"로 귀결되곤 합니다. PBS 전환기의 불확실성도 여러분이 직접 당사자입니다.
오늘 드리는 건 제도를 바꾸는 방법이 아니라, 그 사이 여러분 개인의 지식을 지키는 방법입니다.
CMDSPACE문서만 있으면 2점, 도구가 강제해야 3점, 시스템이 시스템을 고친 기록이 있어야 4점. 모든 점수는 아티팩트 증거 필수. L(Loop)만은 최근 30일 가동 흔적이 없으면 상한 2점 — akm.cmdspace.work 셀프 측정.
행동 앵커 기반 루브릭 · 실제 제출 데이터로 계속 개정 중 (심리측정 검증 진단 아님)32
CMDSPACE노트 50개면 그래프가 보이기 시작합니다. 단, 약 200개를 넘으면 스키마와 인덱스가 필요해집니다 — 그때가 LLM Wiki로 갈 시점.
KIRD 신진연구원 과정 · 구요한33
CMDSPACE·구요한여러분이 읽고 쓰고 정리해온 모든 것 — 그게 재료입니다.
AI가 여러분을 분류하기 전에, 먼저 측정하세요.
cmdspace.work · 더배러(The Better)KIRD 신진연구원 과정 · 2026.09.02(수)