# 04-5 강사 노트 (내부 보관 — 납품 대상 아님)

## rev1 — 신규 배분 (2026-09-06)
`assets/contracts/04-5.md`(contract.py 생성본)를 원본으로 작성. 04-4(PASS)를 틀로 썼다. 숫자는 계약 「숫자 출처」 표를 그대로 옮기지 않고 전부 원자료로 재확인했다(§0.18) — license.csv를 `iconv -f CP949 -t UTF-8`로 변환 후 gawk(FPAT, quote-aware)로 재파싱, 영업상태명 6종·2019/2018 코호트 2년내 폐업률·04-3 밀도(shops_2026-06_clean_gu_category.csv ÷ population_2026-07.csv)를 전수 재현 — 계약 값과 전부 일치, 결함 0건. 「두 조건 동시 적용」의 결과(중구)는 계약이 지정하지 않아 집필자가 다섯 구 평균(밀도 549.9·폐업률 23.7)으로 직접 계산했다.

## rev2 — 건 1 FAIL 3 대응 (2026-09-06)
검증 `verify/results/04-5-rev1.md`. 분량·총량·minutes/clock·전환 칸·노트 시간 4/4·html diff 0·quiz 35.0%·데이터 재현 통과. 계약 `04-5.md`가 시연 ②·③을 정정(rev2, 03:40) — GE1은 계약 「숫자 출처」가 준 값의 모집단 문제라 오케스트레이터 결함, GE2·GE3는 집필자 결함. `assets/contracts/04-5-rev2.md` GE1~GE3 반영.
- **GE3(FAIL 3, 1위 단정 금지)** 앞 편 되짚기 축자와 두 조건 요점 문장의 "동구가 가장 높았고"·"폐업률은 다섯 구 중 가장 높아"를 04-4 헤지 재확인 문장과 같은 어법("동구가 앞서는 편")으로 통일했다. 동구-서구 5.99%는 4~6% 헤지 대역이다.
- **GE1(FAIL 1, 모집단 고지)** 24.9%(2018)·24.34%(2019)는 「대전광역시」 행 109건을 포함한 **전체 코호트**(13,665건)이고, 앞 화면 구별 표(동구28.4%…)는 그 행을 뺀 **5구 기준**(13,556건, 3,315건 폐업, 24.45%)이다 — 민감도 실물 둘째 장면 발화에 한 번 밝히고, 근거 절 「코호트 연도 민감도」에서 "같은 방법으로"를 지우고 두 모집단(전체 13,665 vs 5구 13,556)을 나눠 적었다. slides.md demo2 frame·notes도 함께.
- **GE2(FAIL 2, §0.18-a — 결론이 마진 0.84% 위)** 「두 조건을 동시에 만족하는 구는 중구 하나뿐」이 중구 폐업률 23.5%가 평균 23.7%보다 0.84% 낮다는 얇은 경계 하나로 선다는 것 — 폐업 6행(중구 코호트 2,284건의 0.26%)이면 (537+6)/2,284=23.77%로 평균을 넘어 뒤집힌다. 근거 절에 **평균 경계 판정표**(밀도·폐업률 10행, 표시값·큰 값 기준 마진 %)를 신설 — 문턱 4% 아래는 중구 폐업률(0.84%)·동구 밀도(2.19%) 둘뿐, 나머지 8행은 전부 안전. 두 조건 적용 축자를 "중구가 두 조건에 가장 가깝습니다. 그런데 폐업률 쪽은 평균과 1퍼센트도 차이가 안 납니다."로, 뒤이은 요점을 경계·6행 민감도 설명을 포함한 문장으로 재작성. quiz는 이 결론("중구 하나뿐")을 다루는 문항이 없어 해당 없음(민감도 문항은 밀도 쪽 사례라 이 결론과 무관). slides demo1 frame·note도 판정표·경계 언급으로 갱신.
- GE1·GE2 편집으로 시연 발화 2827→3093자(+266) — 시연 clock 15.44→16.51분→**17분**(slides `clock`), 이론(5분)·정리(2분)는 불변. 총량 25.80→**26.87분→27**(`minutes`), 25~30 안 유지. 태그 개수·초(10개·264초)는 불변(새 화면 지시 없음, 기존 화면 안 문장만 추가).
- script.md 줄 번호 변화 없음(전부 문장 내부 교체·확장, 삽입 줄 0) — 짚을 지점의 두 조건 인용문만 새 문장으로 교체, 나머지 줄참조 전부 유효.
- 머리말 rev2 갱신.

## rev3 — 건 2 FAIL 3 대응 (2026-09-06)
검증 `verify/results/04-5-rev2.md`. GE1·GE3 이행, 노트 시간 4/4, 총량·minutes/clock 통과. 계약 `04-5.md`를 두 곳 정정(rev3 — 평가 행·시연 ③ 고지 문장). `assets/contracts/04-5-rev3.md` GE4~GE6 반영.
- **GE4(FAIL 1, 계약 평가 행 — 다섯 슬롯 = 다섯 주제 고정)** quiz에 재현 문항이 없고 한계 문항이 첫째 한계만 물었다 — 이론 다른 예(200명·78%)를 묻던 문항을 재현 카드(버린 행 규칙·분모 출처·코호트 정의) 문항으로, 첫째 한계만 묻던 문항을 한계 셋 전체(폐업 미신고·구 단위·업종 체계, 넷째 보기는 코호트 연도를 바꾸면 결론이 뒤집힌다는 — 민감도 실물과 반대되는 — 오답)로 교체했다. 관문 재확인 결과 35.0%(어절 수 최다) — 경계 통과 유지.
- **GE5(FAIL 2, 계약 정정)** 민감도 실물 둘째 고지 문장의 "109건"이 2019 코호트 값만 가리켜, 2018 코호트의 대전광역시 행수(149건)가 빠져 있었다 — "(2018년 149건·2019년 109건)"으로 정정. 근거 절은 이미 두 모집단을 나눠 적어 두어 손대지 않았다.
- **GE6(FAIL 3, §0.18-a)** 두 조건 요점 문장의 "동구는 밀도도 평균 아래고"가 동구 밀도 경계(2.19%)를 단정으로 남겼다 — "동구는 밀도가 평균과 겨우 2.19퍼센트 떨어진 경계에 걸려 있고, 폐업률로는 확실히 걸러진다"는 경계 어법으로 정정. slides demo2 frame의 "109건"도 "149건(2018)·109건(2019)"으로 함께 갱신.
- GE4~GE6 편집으로 시연 발화 3093→3114자(+21) — 시연 clock 16.51→16.59분(반올림 17, 불변), 총량 26.87→26.96분(반올림 27, 불변). slides.md·minutes/clock 재기입 불필요.
- script.md 줄 번호 변화 없음(전부 문장 내부 교체) — quiz 두 문항 근거 인용은 새 문항에 맞춰 갱신, 나머지 짚을 지점 전부 유효.
- 머리말 rev3 갱신.

## 화면 지시 태그 표 (§0.4-a — 줄 · 유형 · 초 · 전환 · 소계)
전환 = 직전 화면 지시와 다른 화면으로 넘어감(예 → +8초). 이 표 하나가 총량·`minutes`·시연 clock의 유일한 근거다.

| 줄 | 유형 | 초 | 전환 | 소계 |
|---|---|---|---|---|
| L39(도입) | 없음 | 0 | 예 | 8 |
| L84 | 표작성 | 20 | 예 | 28 |
| L93 | 검사실행 | 30 | 아니오 | 30 |
| L102 | 검사실행 | 30 | 예 | 38 |
| L109 | 검사실행 | 30 | 아니오 | 30 |
| L116 | 표작성 | 20 | 예 | 28 |
| L127 | 표작성 | 20 | 예 | 28 |
| L131 | AI응답대기 | 30 | 예 | 38 |
| L145 | 표작성 | 20 | 예 | 28 |
| L156(정리) | 없음 | 0 | 예 | 8 |
| **합** | | | | **264초(4.4분)** |

전환 판단 근거: L39(도입, 완성본 목업만 띄움 — 직전 없음이라 「예」로 시작) · L84(도입 목업→04-3·04-4 표) 예 · L84→L93(같은 표 작업 계속) 아니오 · L102(같은 표에서 옛 화면과 새 화면 병치, 다른 자료) 예 · L102→L109(같은 민감도 화면 계속, 연도만 교체) 아니오 · L116(민감도 화면→한계 표) 예 · L127(한계 표→재현 카드) 예 · L131(재현 카드→AI 채팅창) 예 · L145(AI 채팅창→개방서비스명/소분류 표) 예 · L156(전공 표→도입 요약 화면 재등장) 예. 시연-only 소계(L84·93·102·109·116·127·131·145) = 248초(4.13분). 도입 L39 = 8초. 정리 L156 = 8초.

## 짚을 지점 (촬영 중 강조, rev1 시점 script.md 줄 번호 기준)
- L42 "오늘은 이 결론이 어디서 흔들리는지를 봅니다." — 도입 첫 축자.
- L49 "이번 차시에서 정하는 것은 이 결론을 얼마나 믿어도 되는가입니다." — 이번 편의 정하는 것.
- L58 "숫자 하나를 내고 끝나는 것이 아니라, 그 숫자가 흔들리는 지점까지 함께 적는 것을 결론의 세 의무라고 부릅니다." — 이론 핵심 정의. quiz mc1 근거.
- L61·L66·L71 민감도·한계·재현 세 정의 축자. 순서(민감도→한계→재현)를 시연도 그대로 따른다.
- L76 "응답자 200명 중 78퍼센트가 만족했다는 결과에서, 그 200명을 어떻게 모았는지가 빠지면 78퍼센트는 당연한 숫자가 됩니다." — 다른 예(이론 전용, GE4로 quiz 문항 주제에서 빠짐 — 계약이 이론 다른 예는 문항 주제가 아니라고 명시).
- L89 "동구와 서구는 표시값으로 6퍼센트에 못 미쳐, 동구가 앞서는 편이라고만 말합니다." — 04-4 헤지 재확인, 1위 단정 금지 유지.
- L93·L98 두 조건 동시 적용 → "중구가 두 조건에 가장 가깝습니다. 그런데 폐업률 쪽은 평균과 1퍼센트도 차이가 안 납니다." — 이 편에서 가장 중요한 결론이자 가장 얇은 경계(중구 폐업률 0.84%, GE2). 계약이 지정하지 않은 값이라는 것, 6행이면 뒤집힌다는 것을 함께 짚는다.
- L102·L107 민감도 실물 첫째(분모 근사값→원표) — "분모 하나를 근사값에서 원표로 바꾸는 것만으로 차이 값이 두 배 넘게 움직였습니다." quiz mc3 근거.
- L109·L114 민감도 실물 둘째(코호트 2018→2019) — 24.9%·24.34%는 대전광역시 행(2018년 149건·2019년 109건, GE5) 포함 전체 코호트(GE1), 구별 표는 5구 기준(13,556건, 24.45%)이라는 모집단 고지를 먼저 하고 "가정을 하나 바꿨을 때 결론이 크게 안 흔들리면, 그 결론은 튼튼한 쪽입니다." 2020 코호트는 비교 자체를 안 한다. quiz mc4 오답(코호트 연도를 바꾸면 결론이 뒤집힌다) 근거 — 이 문장과 정반대다.
- L118 요지 — 한계 첫째(폐업 미신고), 영업상태명 폐업132,830·취소/말소8,570·6종.
- L120 요지 — 한계 둘째(구 단위가 너무 크다).
- L122 요지 — 한계 셋째(인허가 업종≠소분류), 전공 장면에서 실물로 이어진다. L118·L120·L122는 함께 quiz mc4(한계 셋 전체를 묻는 문항, GE4) 근거.
- L125 "한계를 감추는 게 아니라, 먼저 꺼내 놓는 것입니다." — 한계 절 마무리 축자.
- L127·L129 요지 — 재현 카드(버린 행 747행·분모 출처·코호트 정의)를 한 장에. quiz mc2 근거(GE4로 재현 문항 신설).
- L131·L141 함정 — AI의 뻔한 답("이 데이터의 한계로 해석에 주의가 필요합니다") → "이 한계는 아무것도 말하지 않은 것과 같습니다." quiz mc5 근거.
- L145·L150 전공이 드러나는 곳 — "카페로 보이는 가게가 인허가로는 휴게음식점이고, 빵집이 제과점으로 잡히지 않는 경우도 있다고 봅니다." 04-2 전공 장면(카페=휴게음식점영업·빵/도넛=제과점영업)의 뒷면이라는 것을 짚는다.
- L159 "결론보다 먼저, 틀릴 수 있는 곳을 적습니다." — 지정 문자열(계약 04-5.md). 어미 변환 외 낱말·어순 그대로. 정리 한 줄, 천천히.
- L164 "이 리포트를 AI가 통째로 썼다면 어땠을까요." — 갈고리. 2-1 제목만 가리키고 내용은 지목하지 않는다(§0.18).

## 낭독 금지
- L135~138 AI 출력 코드블록(재구성)은 화면에 띄운 채로 두고 낭독하지 않는다.
- 정리 자막 `[자막: 이 결론이 틀릴 수 있는 이유 세 개를 대 보세요]`(L168)은 발화하지 않는다.

## 대본 근거 메모
수치 출처는 script.md 「근거」 절과 동일 — 아래는 재확인 방법만 보충.

**영업상태명 6종 전수(license.csv, CP949→UTF-8, gawk FPAT)**: 폐업 132,830 · 영업/정상 118,682 · 취소/말소/만료/정지/중지 8,570 · 휴업 449 · 제외/삭제/전출 324 · 기타 1(합 260,856) — 계약·04-4 근거 절과 일치.

**04-3 밀도 재현**: `shops_2026-06_clean_gu_category.csv`(정제 후 79,957행, awk로 재확인)를 `population_2026-07.csv`로 나눠 만 명당 값 재계산 — 중구 596.9·서구 592.3·동구 537.8·대덕구 512.7·유성구 509.6, 중구-서구 절대 차이 4.598→4.6·마진 0.7703%→0.77% — 계약과 일치.

**04-4 2019·2018 코호트 2년 내 폐업률 재현(gawk, mktime 기반 날짜 비교)**: 인허가일자 ≤ 폐업일자 ≤ 인허가일자+2년(같은 월일 기준), 폐업일자가 인허가일자보다 앞선 행 제외, 「대전광역시」 행은 분자·분모 모두 제외. 2019 구별(5구 기준): 동구 575/2,023(28.42%→28.4%)·서구 1,269/4,746(26.74%→26.7%)·중구 537/2,284(23.51%→23.5%)·유성구 709/3,266(21.71%→21.7%)·대덕구 225/1,237(18.19%→18.2%) — 표시값 마진 동구-서구 5.91%(정밀)→5.99%(표시값 기준, §0.18-a 규칙대로 표시값으로 계산). **GE1 — 두 모집단**: 5구 합계 3,315/13,556(24.454%→24.45%, 계약 `04-5.코호트2019.5구.폐업률` 일치) vs 전체(대전광역시 109건 포함) 3,326/13,665(24.34%) — 분모가 13,556 대 13,665로 서로 다르다. 2018년(전체, 대전광역시 149건 포함, GE5·계약 `04-5.코호트2018.대전광역시행수` 일치) 3,061/12,295(24.90%)·2019년(전체, 109건 포함) 3,326/13,665(24.34%) — 전부 계약·04-4 근거 절과 일치.

**두 조건 동시 적용(집필자 계산)**: 밀도 평균 (596.9+592.3+537.8+512.7+509.6)/5=549.86→549.9. 폐업률 평균 (28.4+26.7+23.5+21.7+18.2)/5=23.7. 평균 이상 밀도={중구,서구}, 평균 이하 폐업률={중구,유성구,대덕구} — 교집합 {중구}. 이 계산은 새 원자료 조회 없이 계약이 준 값(재확인 완료)만 사용했다.

**평균 경계 판정표(GE2, gawk 손계산, 표시값·큰 값 기준 — 마진% = |값−평균|÷max(값,평균)×100)**: 밀도(평균549.86) 중구7.883%→7.88%·서구7.166%→7.17%·동구2.194%→**2.19%(경계)**·대덕6.759%→6.76%·유성7.323%→7.32%. 폐업률(평균23.70) 중구0.844%→**0.84%(경계)**·동구16.549%→16.55%·서구11.236%→11.24%·유성8.439%→8.44%·대덕23.207%→23.21%. 문턱 4% 아래 둘(중구 폐업률·동구 밀도) 외 8행은 전부 안전. 중구 2019 코호트 2,284건 중 폐업 543건(현재537+6)이면 543/2,284=23.774%→23.77%로 평균(23.70%)을 넘는다 — 6/2,284=0.2627%→0.26%.

**재현 카드 세 항목**: 버린 행 747행·0.93%(`author-a/ep-04-2/script.md` 근거 절, 표준산업분류명 결측 22행+중복 725행) · 분모 출처(위 04-3 밀도 절) · 코호트 정의(위 04-4 코호트 절, 관측 종료 2021-12-30). 세 값 모두 새로 낸 숫자가 아니라 앞 세 차시 근거의 재인용이다.

## quiz 규격 확인
5문항 = 다섯 슬롯 다섯 주제(세 의무·민감도·한계 셋·재현·함정) 고정(GE4, rev3). mc2를 재현(버린 행 규칙·분모 출처·코호트 정의) 문항으로, mc4를 한계 셋 전체(폐업 미신고·구 단위·업종 체계, 넷째 보기는 코호트 연도를 바꾸면 결론이 뒤집힌다는 민감도 실물과 반대되는 오답)로 교체했다. 이론 다른 예(200명·78%)는 더 이상 문항 주제가 아니다(계약 명시). 정답 길이 조정 이력: rev1 최초안이 3연속 관문 위반 뒤 재배치로 35.0% 통과했고, rev3에서 mc2·mc4 교체 직후 「길이2위 40%」로 다시 걸려 mc4 보기 하나를 늘려 길이 순위 동률을 풀어 재통과시켰다. 최종 `axquiz` 결과: 관문(찍기 기대 정답률) **35.0%**(어절 수 최다) — 경계값 그대로 통과(COMMON §0.14 「35.0%는 통과」). 개별 문항 경고(정답 최장·편차 2배) 0건, 절대어·4계열 오답 편중 0건, 정답이 유일 최장/최단 각 1/5(한도 안), 정답 길이 순위 1·2·3·4·동률 각 1문항(재분산).

## 슬라이드 빌드
`slides.md`는 rev3에서 demo2 frame의 「109건」을 「149건(2018)·109건(2019)」으로 정정(GE5), 그 외 블록 구조는 rev2와 동일. 블록 15개(cover 포함) = 본문 **14장**(goal·result·chapter·big·two·steps·chapter·demo×4·chapter·wrap, §0.14는 cover 제외 셈) — 12~14 범위 안. 챕터 3장(clock 5·17·2) · big 1장(이론) · demo 4장(시연) · 이론 슬라이드(big·two·steps) 대전·자치구·인물 0회(집필자 육안 확인) · chapter title·label·lead 숫자 0건 · `two` 슬라이드 본문 숫자 0건 · 숫자 실린 슬라이드(result·demo×4) 전부 `src` 필드 보유. `axdeck` 실행 결과 경고 0건(검사 로그 참조).

## 분량 (자가측정)
`count_script.py` 실행 결과(검사 로그 참조): **합계 공백포함: 5514** ÷250 = 22.1분. 위 태그 표 소계 합 264초 ÷60 = 4.4분. chapter 전환 3장 합쳐 0.5분(편당 10초). 총량 = 22.1+4.4+0.5 = **26.96분→27**(25~30 판정 통과, 여유 약 3.0분, `minutes` 불변). 시연 clock = 시연 발화 3114÷250(12.46분) + 시연-only 소계 248초÷60(4.13분) = **16.59분→17분**(slides.md `clock: 17분`과 일치, 불변). 이론 clock = 이론 발화 1343÷250(5.37분) + chapter 전환 10초÷60(0.17분) = 5.54분→**5분**(불변). 정리 clock = 정리 발화 474÷250(1.90분) + chapter 전환 10초÷60(0.17분) = 2.06분→**2분**(불변). `minutes` 판정: 27−(5+17+2)=3, 0~6 안.

## 미확인
없음.

## 검사 로그 (집필자 실행 — rev3)

```
구간    라인                공백포함      공백제외    ÷250
도입    37-52              583       429     2.3
이론    53-81             1343       995     5.4
시연    82-153            3114      2329    12.5
정리    154-171            474       347     1.9

합계 공백포함: 5514  ÷250 = 22.1 분
합계 공백제외: 4100  ÷250 = 16.4 분
drop log: {'heading': 4, 'screen': 11, 'boldhead': 0, 'comment': 0, 'fence': 2, 'blank': 58, 'paren': 46}
이력 절 줄참조 있는 줄 0개 (0이어야 한다)
태그 표 대조: script 화면 지시 10개 ↔ notes 표 행 10개
script 내부 참조 검사 0개
검사 절 12개(검사 로그 절 제외) 중 검사 대상 줄 63 · 인용 14개 · 줄참조 56개 · stale 0
minutes·clock 절대값 대조: 총량 26.956분(조작 264초) · 시연 16.589분
ep-04-5/slides.html  슬라이드 16장 (인트로·아웃트로 포함) · 납품본 — 강사 노트 제외
ep-04-5/slides_notes.html  슬라이드 16장 (인트로·아웃트로 포함) · 강사용 — 노트 내장
ep-04-5/AX부트캠프_온라인38차시_평가문항.xlsx  1차시 · 6문항
  정답 분포  1번 1(20%) 2번 2(40%) 3번 1(20%) 4번 1(20%)
  정답이 유일 최장인 문항(길이 순위만)  1/5
  진단 특징(관문 제외) 최대  최장 어절 길이 최소 43.3%
  어휘 겹침(진단, 관문 제외)  어휘 겹침 최다 25% · 어휘 겹침 최소 25%
  번호 찍기(전 차시 합산 검사용)  최대 40%
  영상 없이 찍기 기대 정답률(최대 전략)  어절 수 최다 35.0%  [어절 수 최다 35% · 길이2위 30% · 길이3위 30% · 강조 부사 최소 30% · 단정형 지우기 27% · 숫자 지우기 27% · 단정 어미(이다·된다·있다) 최소 27% · 절대어 지우기 25% · 절대어 고르기 25% · 쉼표 최다 25% · 쉼표 최소 25% · 따옴표 최다 25% · 따옴표 최소 25% · 괄호 최다 25% · 괄호 최소 25% · 조건형(경우·수 있·때로·보였다·수도) 최다 25% · 조건형(경우·수 있·때로·보였다·수도) 최소 25% · 한자어 명사형 종결(~것·~함) 최다 25% · 한자어 명사형 종결(~것·~함) 최소 25% · 어절 수 최소 25% · 최장 20% · 최단 20% · 길이1위 20% · 길이4위 20% · 단정형 고르기 20% · 숫자 고르기 20% · 단정 어미(이다·된다·있다) 최다 20% · 글자 수 최다 20% · 글자 수 최소 20% · 강조 부사 없는 보기 20% · 단정 어미(이다·된다·있다) 없는 보기 17% · 강조 부사 최다 10% · 단정 어미(이다·된다·있다) 있는 보기 10% · 강조 부사 있는 보기 0%]
  정답이 유일 최단인 문항  1/5
  단정 서술 4계열(구조·배타·전면부정·빈도)  정답 0/5 · 오답 1/15
  절대어 보기  정답 0/5 · 오답 0/15
  정답 길이 순위 분포(1=최장)  1위 1 2위 1 3위 1 4위 1 동률 1
  정답이 눈에 띄게 긴 보기  0/5 (0%)
```
