CMDSPACE·구요한
POSTECH · Day 1 / 2
생성형 AI 활용 연구 데이터 분석 · Day 1
프롬프트는 휘발한다.
하네스는 남는다.
채팅창에 물어보는 것과, 내 데이터·방법·랩 룰을 아는 환경을 만드는 것은 다른 일입니다.
오늘 2시간, 본인 연구 데이터의 재현 가능한 분석 하네스를 직접 만듭니다.
CMDSPACE00 / OPENING
WHO · 구요한 · YOHAN KOO
연구하면서 가르치는 실천가.
오늘 말하는 모든 방식은 제가 매일 쓰는 방식 그대로입니다.
교육
LG 회장단·임원 AI 교육
기업 최고경영진 AI 교육 · 각사 CEO 1on1 지식 시스템 코칭.
실천
10,000+ 노트 시스템
Obsidian 지식 시스템 직접 운영 · AI 뉴스레터 '더배러' 발행.
제작
직접 만든 도구들
오늘 사례로 보여드릴 앱·파이프라인 — 전부 AI와 함께 제작.
CMDSPACE00 / OPENING
이틀의 지도
Day 1 분석 하네스, Day 2 지식 하네스.
DAY 1 · 오늘
내 데이터 분석 하네스
데이터 구조 파악 → 전처리 → 분석 → 표·그래프까지, AI가 내 데이터와 랩 룰 위에서 반복 수행하는 환경.
DAY 2 · 내일
연구 지식의 LLM Wiki
논문·실험노트·분석 결과를 Obsidian + AI Agent로 검색·연결되는 지식 베이스로 영속화.
둘이 합쳐지면 — 내 랩의 지식 위에서 내 데이터를 분석하는 연구 에이전트.
Obsidian은 양일 모두 사용합니다. 오늘은 분석의 기획·기록, 내일은 그 기록의 위키화.
CMDSPACE00 / OPENING
오늘의 구조 · 14:00–16:00
강의 40분, 실습 70분, 정리 10분.
14:00–14:40 · 강의
왜 프롬프트만으로는
안 되는가
v1→v2→v3 진화 · 같은 데이터 세 개의 답(라이브) · 실제로 만든 것 3가지
14:40–15:50 · 실습
분석 하네스
직접 만들기
실습 키트 데이터로 5개 체크포인트 통과 → CLAUDE.md로 고정
15:50–16:00 · 마무리
정리 + Day 2 예고
과제: 본인 논문·실험노트 2~3건 준비
실습 키트·가이드: labs.cmdspace.work/postech-0819 — Zoom 채팅창에도 같은 링크를 올립니다.
CMDSPACEPART 1 / 강의
PART 01
왜 프롬프트만으로는
연구 분석이 안 되는가.
CMDSPACEPART 1 / 강의
연구자의 세 장면
문제는 도구가 아니라 휘발이다.
장면 1 · 6개월 뒤의 나
"그 그래프
어떻게 만들었지?"
리비전이 왔는데 당시 분석 과정이 채팅 기록 어딘가에 흩어져 있다. 재현 불가.
장면 2 · 후배 인계
"노하우가
내 채팅창에만 있다"
잘 다듬은 프롬프트는 개인 메모장에. 후배는 처음부터 다시 시행착오.
장면 3 · 오늘의 나
"같은 질문,
다른 답"
어제와 오늘의 AI 답이 다르다. 옆 사람과도 다르다. 일관성 없음.
세 장면의 공통 원인 — 분석이 환경이 아니라 일회성 대화로 존재한다. 연구의 언어로: 재현성이 없다.
CMDSPACEPART 1 / 강의
관통 프레임 · 프롬프트에서 하네스로
AI에게 일 시키는 방식의 3단계 진화.
v1
프롬프트 — "이 데이터 분석해줘" · 매번 데이터 설명 재입력 · 답이 들쭉날쭉 · 재현 불가
v2
컨텍스트 — 역할·데이터 구조·연구설계·출력규칙 30줄 패키징 · 이번 한 번은 정확 · 매번 손으로 재입력
v3
하네스 — 내 데이터·방법·랩 룰을 아는 환경을 한 번 설계 · 이후엔 한 줄 · 일관 · 재현 · 랩의 자산
세 단계는 단절이 아니라 누적 — v3는 v1·v2를 포함합니다. 오늘의 목표: 여러분을 v3로.
CMDSPACEPART 1 / 강의 · LIVE
LIVE
실습 키트 데이터 · experiment_nanoparticle.csv
"어떤 조건에서 40nm 이하 입자를 수율 85% 이상으로 얻는가?"
v1 한 줄 → v2 30줄 컨텍스트 → v3 하네스 폴더에서 한 줄 · 관전 포인트: ① 데이터의 함정을 스스로 찾는가 ② 재현되는가 ③ 결과물이 어디에 남는가
CMDSPACEPART 1 / 강의
방금 본 것의 정리
결정적 차이는 재현·인계·축적.
입력
v3도 한 줄
규칙은 파일에 한 번 설계. 이후 입력은 연구질문 한 줄.
재현성
폴더를 열면 그대로
v1·v2는 채팅이 사라지면 끝. v3는 데이터·규칙·코드가 파일로.
인계
폴더 = 노하우
후배에게 폴더를 넘기면 분석 방식이 통째로 넘어간다.
축적
할수록 쌓인다
clean 데이터 · 코드 · 그래프 · 분석 로그가 랩의 인프라가 된다.
연구실에서 이 셋은 곧 — 연구 인프라.
CMDSPACEPART 1 / 강의 · 사례
"실제로 그렇게 일하는 사람이 있나요?"
있습니다. 제가 이 방식으로
만들어 굴리는 것 세 가지.
셋 다 구조는 하나 — 측정하고, 기록하고, 분석하고, 공유한다. 연구자의 일과 정확히 같은 구조입니다.
CMDSPACE사례 1 / 3
사례 1 · OMNICONTROL — 직접 만든 앱
작업 세션이 검색 가능한 데이터가 된다.
AI 에이전트 여러 세션을 동시에 굴리며 생기는 모든 이벤트(작업 완료·에러·대기)를 로그로 적재하고, 요약해 음성 브리핑·알림으로 전달하는 시스템.
- 모든 세션 로그 → 전문 검색 인덱스: "예전에 이 문제 다뤘던 세션"을 찾아 이어서 작업
- 이 앱 자체를 AI와 함께 제작 — 설계는 사람, 코드는 에이전트
연구로 치환하면
실험 세션 하나하나가 로그로 남고 검색되는 자동 실험노트 시스템.
"기록은 사람이 하는 일"이라는 전제가 무너진다 — 기록은 시스템이 하고, 사람은 검색한다.
CMDSPACE사례 2 / 3
사례 2 · SSH + TAILSCALE
분석 환경이 장소에서 풀려난다.
- Tailscale — 내 기기들끼리만 통하는 사설 네트워크. 설정 5분.
- SSH — 어디서든 랩 워크스테이션의 터미널로 진입.
- 무거운 계산은 랩 머신이, 나는 노트북·휴대폰에서 명령만.
- 실제 운영: 이동 중 휴대폰으로 에이전트 작업 승인·지시.
연구자에게 의미
분석 환경이 "그 자리의 그 컴퓨터"에 묶이지 않는다.
하네스는 폴더에 있고, 폴더가 있는 머신에는 어디서든 들어간다. 학회 출장 중에도 랩의 분석이 돈다.
CMDSPACE사례 3 / 3 · LIVE
사례 3 · STARLINK 대시보드 — starlink.cmdspace.work
측정에서 공개까지, 연구의 구조 그대로.
1
측정
5분 간격 속도·지연 자동 측정 스크립트 (이동 측정 포함)
→
2
적재
append-only 로그 · 원본 보존 · 공개용은 마스킹
→
3
분석
시간대·날씨·주행속도 상관 — 피크·강우 성능 저하 확인
→
4
공개
웹 대시보드 배포 — 살아있는 결과 발표
데이터 수집 → 데이터셋 구축 → 분석 → 발표. 코드는 AI가, 설계와 검증은 사람이. 오늘 실습 데이터 중 하나가 이 구조를 본뜬 속도 로그입니다.
CMDSPACEPART 1 / 강의
세 사례의 공통 구조
하네스 = 데이터 + 규칙 + 도구가 한 폴더에.
일회성 작업
묻고 → 받고 → 사라진다
결과는 채팅창에, 노하우는 머릿속에. 다음 작업은 다시 0에서.
하네스
폴더 위에서 일한다
데이터는 data/ · 규칙은 CLAUDE.md · 산출물은 clean/ figures/ notes/ — 쌓인 것 위에서 다음 작업이 시작.
지금부터 70분, 여러분이 만드는 것이 오른쪽 구조의 최소 버전입니다.
CMDSPACEPART 2 / 실습
PART 02 · 14:40–15:50
실습 — 내 분석 하네스
직접 만들기.
제 화면을 따라 5개 체크포인트. 통과하면 채팅창에 "완료".
CMDSPACEPART 2 / 실습
실습 키트 · postech-practice-kit.zip
데이터는 일부러 지저분합니다.
practice-kit/
├── README.md ← 실습 순서·통과 기준
├── CLAUDE.md ← ★ 분석 하네스 룰 견본
├── data/ ← 실험 CSV · 속도 로그 CSV · codebook
├── prompts/ ← v1 · v2 · v3 프롬프트
├── notes/ ← Obsidian 분석 로그 템플릿
└── scripts/ ← 데이터 생성 스크립트(재현성 예시)
- 경로 A — Claude Code/Codex: 키트 폴더에서 터미널 실행 (강사 시연과 동일)
- 경로 B — 웹 챗: CSV 업로드 + 가이드 페이지에서 프롬프트 복사
- 단계별 프롬프트 원클릭 복사 — labs.cmdspace.work/postech-0819
- 심어둔 함정 — 날짜 포맷 3종 · 촉매 표기 불일치 · 켈빈 혼입 · 10배 이상치 · 중복 행
- ⚠ 본인 미공개 데이터는 랩 데이터 정책 확인 후. 오늘은 더미데이터로 방법을 익히는 날.
CMDSPACEPART 2 / 실습
실습 지도 · 5 체크포인트 + 고정
분석 한 사이클을 통째로, 그리고 고정.
①
데이터 구조 파악 — AI에게 데이터 읽히기 · 함정 4종 찾게 하기
②
정리·전처리 — 원본 불변 · 코드로 · 단계별 로그
③
분석 방향 — 연구질문 → 기법 후보(가정·한계) → 선택은 내가
④
코드 작성·실행·디버깅 — 에이전트가 실행·수정 반복
⑤
해석 + 표·그래프 — 논문·발표·보고 3가지 형태로
★
하네스로 고정 — 오늘의 규칙을 CLAUDE.md로 박제 = 오늘의 진짜 산출물
CMDSPACE체크포인트 ① / ⑤
체크포인트 ① 데이터 구조 파악
AI는 시키는 만큼만 의심한다.
"
data/experiment_nanoparticle.csv 의 구조를 파악해줘. 컬럼별 타입, 결측, 이상해 보이는 값을 표로 정리해.
요청 프롬프트
못 찾으면 → "3명이 입력한 데이터야. 표기 불일치·단위 혼입을 의심하고 다시 봐" — 의심을 지시한다.
통과 기준 — AI가 스스로 찾아야 할 4가지:
- 날짜 포맷 3종 혼재
- 촉매 표기 불일치 (A / a / Cat-A / 촉매A)
- 온도에 켈빈 단위 혼입 ("353.4K")
- 소수점 누락 10배 이상치
CMDSPACE체크포인트 ② / ⑤
체크포인트 ② 정리·전처리
손 수정은 재현성의 끝, 코드는 기록의 시작.
원칙 1
원본 불변
data/ 원본은 절대 덮어쓰지 않는다. 정리본은 data/clean/ 에.
원칙 2
전처리는 코드로
엑셀 손 수정 금지. "무엇을 어떻게 고쳤는가"가 코드로 남는다.
원칙 3
단계별 로그
각 정리 단계마다 영향받은 행 수 기록 — 리비전 질문의 답이 된다.
"전처리 기준이 무엇이냐"는 심사평이 오면 — 이 로그가 그대로 답이 됩니다.
CMDSPACE체크포인트 ③ / ⑤
체크포인트 ③ 분석 방향 설정
AI는 후보를 내고, 선택은 연구자가.
"
연구질문: "어떤 조건에서 40nm 이하 입자를 수율 85% 이상으로 얻는가?" 적합한 분석 기법 후보 2~3개를 각각의 가정·한계와 함께 제안해. 아직 실행하지 마.
요청 프롬프트
통과 기준 — AI가 기법을 "하나 골라주는" 게 아니라 가정과 한계를 붙여 후보를 제시하고, 선택은 내가 한다.
심사위원 앞에서 방어할 수 있는 것은 "AI가 골라준 방법"이 아니라 "내가 가정을 검토하고 선택한 방법"뿐.
CMDSPACE체크포인트 ④ / ⑤
체크포인트 ④ 코드 작성·실행·디버깅
챗은 코드를 주고, 에이전트는 끝까지 간다.
경로 B · 웹 챗
코드 → 복사 → 실행 → 에러 붙여넣기
사람이 실행 루프를 돈다. 그래도 v1보다 훨씬 낫다.
경로 A · 에이전트
작성 → 실행 → 에러 → 스스로 수정
AI가 실행 루프를 돈다. 사람은 결과 검증에 집중.
확인할 것 — 촉매 효과·온도 효과가 잡히는가. 이 데이터에는 신호가 심어져 있으니, 안 나오면 전처리를 의심하세요.
CMDSPACE체크포인트 ⑤ / ⑤
체크포인트 ⑤ 해석 + 표·그래프
같은 결과, 세 개의 얼굴.
논문
Results 단락 초안
3~4문장 · 효과 크기·신뢰구간 병기 · 과장 없는 서술
발표
학회용 그래프 1장
figures/ 에 PNG 저장 · 축 라벨·단위 · 랩 공통 스타일
보고
지도교수용 3줄
결론 먼저 · 다음 실험 제안 포함
분석과 전달은 다른 일 — 그리고 전달 형식조차 하네스 규칙이 될 수 있습니다. 랩의 모든 그래프가 같은 스타일로.
CMDSPACE실습 마무리 · ★
오늘의 진짜 산출물 · CLAUDE.md
말로 한 지시를 파일로 박제한다.
# CLAUDE.md — 우리 랩 분석 하네스
## 데이터 취급 (절대 규칙)
1. 원본 불변 — 정리본은 data/clean/
2. 전처리는 항상 코드로 + 행수 로그
3. 이상치 자동 삭제 금지 — 보고 후 처리
## 분석 규칙
- 검정 전 가정 확인 명시
- p값 + 효과크기 + 신뢰구간 병기
- 난수 시드 고정 (재실행 = 같은 결과)
- 이 파일이 폴더에 있으면 — 내일부터 한 줄이면 이 규칙 위에서 분석
- 오늘 밤 할 일: 본인 연구 폴더에 랩 버전 CLAUDE.md 한 장 (30분)
- 웹 챗만 쓰는 경우 — Claude/ChatGPT Projects 지침에 저장 = 절반의 하네스
- Codex 사용자는 같은 내용을 AGENTS.md 로
CMDSPACE마무리
오늘의 세 문장
프롬프트는 휘발하고, 하네스는 남는다.
AI는 시키는 만큼 의심한다.
의심을 규칙으로 만들어라.
분석 환경은 연구 인프라다.
CMDSPACE내일 · DAY 2
DAY 2 예고 · 8/20(목) 14:00
오늘은 일하는 환경, 내일은 아는 환경.
- 논문·실험노트·분석 로그 → Obsidian Raw Sources 적재
- AI Agent가 위키로 컴파일 — 개념·방법·결과 페이지 + 크로스레퍼런스
- 내 연구 지식에 자연어로 질문, 근거와 함께 답
- Day 1 하네스와 연결 → 연구 에이전트 완성
내일 준비물
본인 논문·실험노트 2~3건 (PDF·메모 무엇이든)
+ 오늘 실습의 분석 로그 노트를 Obsidian에 넣어 오기 — 그게 위키의 첫 재료가 됩니다. 없으면 내일도 샘플 제공.
CMDSPACE
Q&A
감사합니다.
내일 뵙겠습니다.
질문 받겠습니다 · 실습 키트·자료: labs.cmdspace.work/postech-0819
더배러 뉴스레터 · cmdspace.work