CMDSCMDSPACE·구요한
POSTECH · Day 1 / 2
생성형 AI 활용 연구 데이터 분석 · Day 1

프롬프트는 휘발한다.
하네스는 남는다.

채팅창에 물어보는 것과, 내 데이터·방법·랩 룰을 아는 환경을 만드는 것은 다른 일입니다.
오늘 2시간, 본인 연구 데이터의 재현 가능한 분석 하네스를 직접 만듭니다.

cmdspace.work POSTECH 교육혁신센터 · 2026.08.19(수) 14:00–16:00 · Zoom
CMDSPACE
00 / OPENING
WHO · 구요한 · YOHAN KOO

연구하면서 가르치는 실천가.

오늘 말하는 모든 방식은 제가 매일 쓰는 방식 그대로입니다.

교육
LG 회장단·임원 AI 교육
기업 최고경영진 AI 교육 · 각사 CEO 1on1 지식 시스템 코칭.
실천
10,000+ 노트 시스템
Obsidian 지식 시스템 직접 운영 · AI 뉴스레터 '더배러' 발행.
제작
직접 만든 도구들
오늘 사례로 보여드릴 앱·파이프라인 — 전부 AI와 함께 제작.
POSTECH · 구요한02
CMDSPACE
00 / OPENING
이틀의 지도

Day 1 분석 하네스, Day 2 지식 하네스.

DAY 1 · 오늘
내 데이터 분석 하네스
데이터 구조 파악 → 전처리 → 분석 → 표·그래프까지, AI가 내 데이터와 랩 룰 위에서 반복 수행하는 환경.
DAY 2 · 내일
연구 지식의 LLM Wiki
논문·실험노트·분석 결과를 Obsidian + AI Agent로 검색·연결되는 지식 베이스로 영속화.

둘이 합쳐지면 — 내 랩의 지식 위에서 내 데이터를 분석하는 연구 에이전트.
Obsidian은 양일 모두 사용합니다. 오늘은 분석의 기획·기록, 내일은 그 기록의 위키화.

POSTECH · 구요한03
CMDSPACE
00 / OPENING
오늘의 구조 · 14:00–16:00

강의 40분, 실습 70분, 정리 10분.

14:00–14:40 · 강의
왜 프롬프트만으로는
안 되는가
v1→v2→v3 진화 · 같은 데이터 세 개의 답(라이브) · 실제로 만든 것 3가지
14:40–15:50 · 실습
분석 하네스
직접 만들기
실습 키트 데이터로 5개 체크포인트 통과 → CLAUDE.md로 고정
15:50–16:00 · 마무리
정리 + Day 2 예고
과제: 본인 논문·실험노트 2~3건 준비

실습 키트·가이드: labs.cmdspace.work/postech-0819 — Zoom 채팅창에도 같은 링크를 올립니다.

POSTECH · 구요한04
CMDSPACE
PART 1 / 강의
PART 01

왜 프롬프트만으로는
연구 분석이 안 되는가.

CMDSPACE
PART 1 / 강의
연구자의 세 장면

문제는 도구가 아니라 휘발이다.

장면 1 · 6개월 뒤의 나
"그 그래프
어떻게 만들었지?"
리비전이 왔는데 당시 분석 과정이 채팅 기록 어딘가에 흩어져 있다. 재현 불가.
장면 2 · 후배 인계
"노하우가
내 채팅창에만 있다"
잘 다듬은 프롬프트는 개인 메모장에. 후배는 처음부터 다시 시행착오.
장면 3 · 오늘의 나
"같은 질문,
다른 답"
어제와 오늘의 AI 답이 다르다. 옆 사람과도 다르다. 일관성 없음.

세 장면의 공통 원인 — 분석이 환경이 아니라 일회성 대화로 존재한다. 연구의 언어로: 재현성이 없다.

POSTECH · 구요한06
CMDSPACE
PART 1 / 강의
관통 프레임 · 프롬프트에서 하네스로

AI에게 일 시키는 방식의 3단계 진화.

v1
프롬프트 — "이 데이터 분석해줘" · 매번 데이터 설명 재입력 · 답이 들쭉날쭉 · 재현 불가
v2
컨텍스트 — 역할·데이터 구조·연구설계·출력규칙 30줄 패키징 · 이번 한 번은 정확 · 매번 손으로 재입력
v3
하네스 — 내 데이터·방법·랩 룰을 아는 환경을 한 번 설계 · 이후엔 한 줄 · 일관 · 재현 · 랩의 자산

세 단계는 단절이 아니라 누적 — v3는 v1·v2를 포함합니다. 오늘의 목표: 여러분을 v3로.

POSTECH · 구요한07
CMDSPACE
PART 1 / 강의 · LIVE
라이브 시연

같은 데이터, 세 개의 답.

LIVE
실습 키트 데이터 · experiment_nanoparticle.csv
"어떤 조건에서 40nm 이하 입자를 수율 85% 이상으로 얻는가?"
v1 한 줄 → v2 30줄 컨텍스트 → v3 하네스 폴더에서 한 줄 · 관전 포인트: ① 데이터의 함정을 스스로 찾는가 ② 재현되는가 ③ 결과물이 어디에 남는가
POSTECH · 구요한08
CMDSPACE
PART 1 / 강의
방금 본 것의 정리

결정적 차이는 재현·인계·축적.

입력
v3도 한 줄
규칙은 파일에 한 번 설계. 이후 입력은 연구질문 한 줄.
재현성
폴더를 열면 그대로
v1·v2는 채팅이 사라지면 끝. v3는 데이터·규칙·코드가 파일로.
인계
폴더 = 노하우
후배에게 폴더를 넘기면 분석 방식이 통째로 넘어간다.
축적
할수록 쌓인다
clean 데이터 · 코드 · 그래프 · 분석 로그가 랩의 인프라가 된다.

연구실에서 이 셋은 곧 — 연구 인프라.

POSTECH · 구요한09
CMDSPACE
PART 1 / 강의 · 사례
"실제로 그렇게 일하는 사람이 있나요?"

있습니다. 제가 이 방식으로
만들어 굴리는 것 세 가지.

셋 다 구조는 하나 — 측정하고, 기록하고, 분석하고, 공유한다. 연구자의 일과 정확히 같은 구조입니다.

CMDSPACE
사례 1 / 3
사례 1 · OMNICONTROL — 직접 만든 앱

작업 세션이 검색 가능한 데이터가 된다.

AI 에이전트 여러 세션을 동시에 굴리며 생기는 모든 이벤트(작업 완료·에러·대기)를 로그로 적재하고, 요약해 음성 브리핑·알림으로 전달하는 시스템.

  • 모든 세션 로그 → 전문 검색 인덱스: "예전에 이 문제 다뤘던 세션"을 찾아 이어서 작업
  • 이 앱 자체를 AI와 함께 제작 — 설계는 사람, 코드는 에이전트
연구로 치환하면

실험 세션 하나하나가 로그로 남고 검색되는 자동 실험노트 시스템.

"기록은 사람이 하는 일"이라는 전제가 무너진다 — 기록은 시스템이 하고, 사람은 검색한다.

POSTECH · 구요한11
CMDSPACE
사례 2 / 3
사례 2 · SSH + TAILSCALE

분석 환경이 장소에서 풀려난다.

  • Tailscale — 내 기기들끼리만 통하는 사설 네트워크. 설정 5분.
  • SSH — 어디서든 랩 워크스테이션의 터미널로 진입.
  • 무거운 계산은 랩 머신이, 나는 노트북·휴대폰에서 명령만.
  • 실제 운영: 이동 중 휴대폰으로 에이전트 작업 승인·지시.
연구자에게 의미

분석 환경이 "그 자리의 그 컴퓨터"에 묶이지 않는다.

하네스는 폴더에 있고, 폴더가 있는 머신에는 어디서든 들어간다. 학회 출장 중에도 랩의 분석이 돈다.

POSTECH · 구요한12
CMDSPACE
사례 3 / 3 · LIVE
사례 3 · STARLINK 대시보드 — starlink.cmdspace.work

측정에서 공개까지, 연구의 구조 그대로.

1
측정
5분 간격 속도·지연 자동 측정 스크립트 (이동 측정 포함)
2
적재
append-only 로그 · 원본 보존 · 공개용은 마스킹
3
분석
시간대·날씨·주행속도 상관 — 피크·강우 성능 저하 확인
4
공개
웹 대시보드 배포 — 살아있는 결과 발표

데이터 수집 → 데이터셋 구축 → 분석 → 발표. 코드는 AI가, 설계와 검증은 사람이. 오늘 실습 데이터 중 하나가 이 구조를 본뜬 속도 로그입니다.

라이브: starlink.cmdspace.work 열어 보여주기13
CMDSPACE
PART 1 / 강의
세 사례의 공통 구조

하네스 = 데이터 + 규칙 + 도구가 한 폴더에.

일회성 작업
묻고 → 받고 → 사라진다
결과는 채팅창에, 노하우는 머릿속에. 다음 작업은 다시 0에서.
하네스
폴더 위에서 일한다
데이터는 data/ · 규칙은 CLAUDE.md · 산출물은 clean/ figures/ notes/ — 쌓인 것 위에서 다음 작업이 시작.

지금부터 70분, 여러분이 만드는 것이 오른쪽 구조의 최소 버전입니다.

POSTECH · 구요한14
CMDSPACE
PART 2 / 실습
PART 02 · 14:40–15:50

실습 — 내 분석 하네스
직접 만들기.

제 화면을 따라 5개 체크포인트. 통과하면 채팅창에 "완료".

CMDSPACE
PART 2 / 실습
실습 키트 · postech-practice-kit.zip

데이터는 일부러 지저분합니다.

practice-kit/
├── README.md      ← 실습 순서·통과 기준
├── CLAUDE.md      ← ★ 분석 하네스 룰 견본
├── data/          ← 실험 CSV · 속도 로그 CSV · codebook
├── prompts/       ← v1 · v2 · v3 프롬프트
├── notes/         ← Obsidian 분석 로그 템플릿
└── scripts/       ← 데이터 생성 스크립트(재현성 예시)
  • 경로 A — Claude Code/Codex: 키트 폴더에서 터미널 실행 (강사 시연과 동일)
  • 경로 B — 웹 챗: CSV 업로드 + 가이드 페이지에서 프롬프트 복사
  • 단계별 프롬프트 원클릭 복사 — labs.cmdspace.work/postech-0819
  • 심어둔 함정 — 날짜 포맷 3종 · 촉매 표기 불일치 · 켈빈 혼입 · 10배 이상치 · 중복 행
  • ⚠ 본인 미공개 데이터는 랩 데이터 정책 확인 후. 오늘은 더미데이터로 방법을 익히는 날.
POSTECH · 구요한16
CMDSPACE
PART 2 / 실습
실습 지도 · 5 체크포인트 + 고정

분석 한 사이클을 통째로, 그리고 고정.

데이터 구조 파악 — AI에게 데이터 읽히기 · 함정 4종 찾게 하기
정리·전처리 — 원본 불변 · 코드로 · 단계별 로그
분석 방향 — 연구질문 → 기법 후보(가정·한계) → 선택은 내가
코드 작성·실행·디버깅 — 에이전트가 실행·수정 반복
해석 + 표·그래프 — 논문·발표·보고 3가지 형태로
하네스로 고정 — 오늘의 규칙을 CLAUDE.md로 박제 = 오늘의 진짜 산출물
POSTECH · 구요한17
CMDSPACE
체크포인트 ① / ⑤
체크포인트 ① 데이터 구조 파악

AI는 시키는 만큼만 의심한다.

"
data/experiment_nanoparticle.csv 의 구조를 파악해줘. 컬럼별 타입, 결측, 이상해 보이는 값을 표로 정리해.
요청 프롬프트

못 찾으면 → "3명이 입력한 데이터야. 표기 불일치·단위 혼입을 의심하고 다시 봐" — 의심을 지시한다.

통과 기준 — AI가 스스로 찾아야 할 4가지:

  • 날짜 포맷 3종 혼재
  • 촉매 표기 불일치 (A / a / Cat-A / 촉매A)
  • 온도에 켈빈 단위 혼입 ("353.4K")
  • 소수점 누락 10배 이상치
POSTECH · 구요한18
CMDSPACE
체크포인트 ② / ⑤
체크포인트 ② 정리·전처리

손 수정은 재현성의 끝, 코드는 기록의 시작.

원칙 1
원본 불변
data/ 원본은 절대 덮어쓰지 않는다. 정리본은 data/clean/ 에.
원칙 2
전처리는 코드로
엑셀 손 수정 금지. "무엇을 어떻게 고쳤는가"가 코드로 남는다.
원칙 3
단계별 로그
각 정리 단계마다 영향받은 행 수 기록 — 리비전 질문의 답이 된다.

"전처리 기준이 무엇이냐"는 심사평이 오면 — 이 로그가 그대로 답이 됩니다.

POSTECH · 구요한19
CMDSPACE
체크포인트 ③ / ⑤
체크포인트 ③ 분석 방향 설정

AI는 후보를 내고, 선택은 연구자가.

"
연구질문: "어떤 조건에서 40nm 이하 입자를 수율 85% 이상으로 얻는가?" 적합한 분석 기법 후보 2~3개를 각각의 가정·한계와 함께 제안해. 아직 실행하지 마.
요청 프롬프트

통과 기준 — AI가 기법을 "하나 골라주는" 게 아니라 가정과 한계를 붙여 후보를 제시하고, 선택은 내가 한다.
심사위원 앞에서 방어할 수 있는 것은 "AI가 골라준 방법"이 아니라 "내가 가정을 검토하고 선택한 방법"뿐.

POSTECH · 구요한20
CMDSPACE
체크포인트 ④ / ⑤
체크포인트 ④ 코드 작성·실행·디버깅

챗은 코드를 주고, 에이전트는 끝까지 간다.

경로 B · 웹 챗
코드 → 복사 → 실행 → 에러 붙여넣기
사람이 실행 루프를 돈다. 그래도 v1보다 훨씬 낫다.
경로 A · 에이전트
작성 → 실행 → 에러 → 스스로 수정
AI가 실행 루프를 돈다. 사람은 결과 검증에 집중.

확인할 것 — 촉매 효과·온도 효과가 잡히는가. 이 데이터에는 신호가 심어져 있으니, 안 나오면 전처리를 의심하세요.

POSTECH · 구요한21
CMDSPACE
체크포인트 ⑤ / ⑤
체크포인트 ⑤ 해석 + 표·그래프

같은 결과, 세 개의 얼굴.

논문
Results 단락 초안
3~4문장 · 효과 크기·신뢰구간 병기 · 과장 없는 서술
발표
학회용 그래프 1장
figures/ 에 PNG 저장 · 축 라벨·단위 · 랩 공통 스타일
보고
지도교수용 3줄
결론 먼저 · 다음 실험 제안 포함

분석과 전달은 다른 일 — 그리고 전달 형식조차 하네스 규칙이 될 수 있습니다. 랩의 모든 그래프가 같은 스타일로.

POSTECH · 구요한22
CMDSPACE
실습 마무리 · ★
오늘의 진짜 산출물 · CLAUDE.md

말로 한 지시를 파일로 박제한다.

# CLAUDE.md — 우리 랩 분석 하네스

## 데이터 취급 (절대 규칙)
1. 원본 불변 — 정리본은 data/clean/
2. 전처리는 항상 코드로 + 행수 로그
3. 이상치 자동 삭제 금지 — 보고 후 처리

## 분석 규칙
- 검정 전 가정 확인 명시
- p값 + 효과크기 + 신뢰구간 병기
- 난수 시드 고정 (재실행 = 같은 결과)
  • 이 파일이 폴더에 있으면 — 내일부터 한 줄이면 이 규칙 위에서 분석
  • 오늘 밤 할 일: 본인 연구 폴더에 랩 버전 CLAUDE.md 한 장 (30분)
  • 웹 챗만 쓰는 경우 — Claude/ChatGPT Projects 지침에 저장 = 절반의 하네스
  • Codex 사용자는 같은 내용을 AGENTS.md 로
POSTECH · 구요한23
CMDSPACE
마무리
오늘의 세 문장

프롬프트는 휘발하고, 하네스는 남는다.
AI는 시키는 만큼 의심한다.
의심을 규칙으로 만들어라.
분석 환경은 연구 인프라다.

CMDSPACE
내일 · DAY 2
DAY 2 예고 · 8/20(목) 14:00

오늘은 일하는 환경, 내일은 아는 환경.

  • 논문·실험노트·분석 로그 → Obsidian Raw Sources 적재
  • AI Agent가 위키로 컴파일 — 개념·방법·결과 페이지 + 크로스레퍼런스
  • 내 연구 지식에 자연어로 질문, 근거와 함께 답
  • Day 1 하네스와 연결 → 연구 에이전트 완성
내일 준비물

본인 논문·실험노트 2~3건 (PDF·메모 무엇이든)

+ 오늘 실습의 분석 로그 노트를 Obsidian에 넣어 오기 — 그게 위키의 첫 재료가 됩니다. 없으면 내일도 샘플 제공.

POSTECH · 구요한25
CMDSCMDSPACE
Q&A

감사합니다.
내일 뵙겠습니다.

질문 받겠습니다 · 실습 키트·자료: labs.cmdspace.work/postech-0819
더배러 뉴스레터 · cmdspace.work

cmdspace.work 구요한 · CMDSPACE