← 목록 · 04-5 · 고르고, 틀릴 수 있는 곳을 적는다 · 원문 notes.md

04-5 강사 노트 (내부 보관 — 납품 대상 아님)

rev1 — 신규 배분 (2026-09-06)

assets/contracts/04-5.md(contract.py 생성본)를 원본으로 작성. 04-4(PASS)를 틀로 썼다. 숫자는 계약 「숫자 출처」 표를 그대로 옮기지 않고 전부 원자료로 재확인했다(§0.18) — license.csv를 iconv -f CP949 -t UTF-8로 변환 후 gawk(FPAT, quote-aware)로 재파싱, 영업상태명 6종·2019/2018 코호트 2년내 폐업률·04-3 밀도(shops_2026-06_clean_gu_category.csv ÷ population_2026-07.csv)를 전수 재현 — 계약 값과 전부 일치, 결함 0건. 「두 조건 동시 적용」의 결과(중구)는 계약이 지정하지 않아 집필자가 다섯 구 평균(밀도 549.9·폐업률 23.7)으로 직접 계산했다.

rev2 — 건 1 FAIL 3 대응 (2026-09-06)

검증 verify/results/04-5-rev1.md. 분량·총량·minutes/clock·전환 칸·노트 시간 4/4·html diff 0·quiz 35.0%·데이터 재현 통과. 계약 04-5.md가 시연 ②·③을 정정(rev2, 03:40) — GE1은 계약 「숫자 출처」가 준 값의 모집단 문제라 오케스트레이터 결함, GE2·GE3는 집필자 결함. assets/contracts/04-5-rev2.md GE1~GE3 반영. - GE3(FAIL 3, 1위 단정 금지) 앞 편 되짚기 축자와 두 조건 요점 문장의 "동구가 가장 높았고"·"폐업률은 다섯 구 중 가장 높아"를 04-4 헤지 재확인 문장과 같은 어법("동구가 앞서는 편")으로 통일했다. 동구-서구 5.99%는 4~6% 헤지 대역이다. - GE1(FAIL 1, 모집단 고지) 24.9%(2018)·24.34%(2019)는 「대전광역시」 행 109건을 포함한 전체 코호트(13,665건)이고, 앞 화면 구별 표(동구28.4%…)는 그 행을 뺀 5구 기준(13,556건, 3,315건 폐업, 24.45%)이다 — 민감도 실물 둘째 장면 발화에 한 번 밝히고, 근거 절 「코호트 연도 민감도」에서 "같은 방법으로"를 지우고 두 모집단(전체 13,665 vs 5구 13,556)을 나눠 적었다. slides.md demo2 frame·notes도 함께. - GE2(FAIL 2, §0.18-a — 결론이 마진 0.84% 위) 「두 조건을 동시에 만족하는 구는 중구 하나뿐」이 중구 폐업률 23.5%가 평균 23.7%보다 0.84% 낮다는 얇은 경계 하나로 선다는 것 — 폐업 6행(중구 코호트 2,284건의 0.26%)이면 (537+6)/2,284=23.77%로 평균을 넘어 뒤집힌다. 근거 절에 평균 경계 판정표(밀도·폐업률 10행, 표시값·큰 값 기준 마진 %)를 신설 — 문턱 4% 아래는 중구 폐업률(0.84%)·동구 밀도(2.19%) 둘뿐, 나머지 8행은 전부 안전. 두 조건 적용 축자를 "중구가 두 조건에 가장 가깝습니다. 그런데 폐업률 쪽은 평균과 1퍼센트도 차이가 안 납니다."로, 뒤이은 요점을 경계·6행 민감도 설명을 포함한 문장으로 재작성. quiz는 이 결론("중구 하나뿐")을 다루는 문항이 없어 해당 없음(민감도 문항은 밀도 쪽 사례라 이 결론과 무관). slides demo1 frame·note도 판정표·경계 언급으로 갱신. - GE1·GE2 편집으로 시연 발화 2827→3093자(+266) — 시연 clock 15.44→16.51분→17분(slides clock), 이론(5분)·정리(2분)는 불변. 총량 25.80→26.87분→27(minutes), 25~30 안 유지. 태그 개수·초(10개·264초)는 불변(새 화면 지시 없음, 기존 화면 안 문장만 추가). - script.md 줄 번호 변화 없음(전부 문장 내부 교체·확장, 삽입 줄 0) — 짚을 지점의 두 조건 인용문만 새 문장으로 교체, 나머지 줄참조 전부 유효. - 머리말 rev2 갱신.

rev3 — 건 2 FAIL 3 대응 (2026-09-06)

검증 verify/results/04-5-rev2.md. GE1·GE3 이행, 노트 시간 4/4, 총량·minutes/clock 통과. 계약 04-5.md를 두 곳 정정(rev3 — 평가 행·시연 ③ 고지 문장). assets/contracts/04-5-rev3.md GE4~GE6 반영. - GE4(FAIL 1, 계약 평가 행 — 다섯 슬롯 = 다섯 주제 고정) quiz에 재현 문항이 없고 한계 문항이 첫째 한계만 물었다 — 이론 다른 예(200명·78%)를 묻던 문항을 재현 카드(버린 행 규칙·분모 출처·코호트 정의) 문항으로, 첫째 한계만 묻던 문항을 한계 셋 전체(폐업 미신고·구 단위·업종 체계, 넷째 보기는 코호트 연도를 바꾸면 결론이 뒤집힌다는 — 민감도 실물과 반대되는 — 오답)로 교체했다. 관문 재확인 결과 35.0%(어절 수 최다) — 경계 통과 유지. - GE5(FAIL 2, 계약 정정) 민감도 실물 둘째 고지 문장의 "109건"이 2019 코호트 값만 가리켜, 2018 코호트의 대전광역시 행수(149건)가 빠져 있었다 — "(2018년 149건·2019년 109건)"으로 정정. 근거 절은 이미 두 모집단을 나눠 적어 두어 손대지 않았다. - GE6(FAIL 3, §0.18-a) 두 조건 요점 문장의 "동구는 밀도도 평균 아래고"가 동구 밀도 경계(2.19%)를 단정으로 남겼다 — "동구는 밀도가 평균과 겨우 2.19퍼센트 떨어진 경계에 걸려 있고, 폐업률로는 확실히 걸러진다"는 경계 어법으로 정정. slides demo2 frame의 "109건"도 "149건(2018)·109건(2019)"으로 함께 갱신. - GE4~GE6 편집으로 시연 발화 3093→3114자(+21) — 시연 clock 16.51→16.59분(반올림 17, 불변), 총량 26.87→26.96분(반올림 27, 불변). slides.md·minutes/clock 재기입 불필요. - script.md 줄 번호 변화 없음(전부 문장 내부 교체) — quiz 두 문항 근거 인용은 새 문항에 맞춰 갱신, 나머지 짚을 지점 전부 유효. - 머리말 rev3 갱신.

화면 지시 태그 표 (§0.4-a — 줄 · 유형 · 초 · 전환 · 소계)

전환 = 직전 화면 지시와 다른 화면으로 넘어감(예 → +8초). 이 표 하나가 총량·minutes·시연 clock의 유일한 근거다.

유형 전환 소계
L39(도입) 없음 0 8
L84 표작성 20 28
L93 검사실행 30 아니오 30
L102 검사실행 30 38
L109 검사실행 30 아니오 30
L116 표작성 20 28
L127 표작성 20 28
L131 AI응답대기 30 38
L145 표작성 20 28
L156(정리) 없음 0 8
264초(4.4분)

전환 판단 근거: L39(도입, 완성본 목업만 띄움 — 직전 없음이라 「예」로 시작) · L84(도입 목업→04-3·04-4 표) 예 · L84→L93(같은 표 작업 계속) 아니오 · L102(같은 표에서 옛 화면과 새 화면 병치, 다른 자료) 예 · L102→L109(같은 민감도 화면 계속, 연도만 교체) 아니오 · L116(민감도 화면→한계 표) 예 · L127(한계 표→재현 카드) 예 · L131(재현 카드→AI 채팅창) 예 · L145(AI 채팅창→개방서비스명/소분류 표) 예 · L156(전공 표→도입 요약 화면 재등장) 예. 시연-only 소계(L84·93·102·109·116·127·131·145) = 248초(4.13분). 도입 L39 = 8초. 정리 L156 = 8초.

짚을 지점 (촬영 중 강조, rev1 시점 script.md 줄 번호 기준)

낭독 금지

대본 근거 메모

수치 출처는 script.md 「근거」 절과 동일 — 아래는 재확인 방법만 보충.

영업상태명 6종 전수(license.csv, CP949→UTF-8, gawk FPAT): 폐업 132,830 · 영업/정상 118,682 · 취소/말소/만료/정지/중지 8,570 · 휴업 449 · 제외/삭제/전출 324 · 기타 1(합 260,856) — 계약·04-4 근거 절과 일치.

04-3 밀도 재현: shops_2026-06_clean_gu_category.csv(정제 후 79,957행, awk로 재확인)를 population_2026-07.csv로 나눠 만 명당 값 재계산 — 중구 596.9·서구 592.3·동구 537.8·대덕구 512.7·유성구 509.6, 중구-서구 절대 차이 4.598→4.6·마진 0.7703%→0.77% — 계약과 일치.

04-4 2019·2018 코호트 2년 내 폐업률 재현(gawk, mktime 기반 날짜 비교): 인허가일자 ≤ 폐업일자 ≤ 인허가일자+2년(같은 월일 기준), 폐업일자가 인허가일자보다 앞선 행 제외, 「대전광역시」 행은 분자·분모 모두 제외. 2019 구별(5구 기준): 동구 575/2,023(28.42%→28.4%)·서구 1,269/4,746(26.74%→26.7%)·중구 537/2,284(23.51%→23.5%)·유성구 709/3,266(21.71%→21.7%)·대덕구 225/1,237(18.19%→18.2%) — 표시값 마진 동구-서구 5.91%(정밀)→5.99%(표시값 기준, §0.18-a 규칙대로 표시값으로 계산). GE1 — 두 모집단: 5구 합계 3,315/13,556(24.454%→24.45%, 계약 04-5.코호트2019.5구.폐업률 일치) vs 전체(대전광역시 109건 포함) 3,326/13,665(24.34%) — 분모가 13,556 대 13,665로 서로 다르다. 2018년(전체, 대전광역시 149건 포함, GE5·계약 04-5.코호트2018.대전광역시행수 일치) 3,061/12,295(24.90%)·2019년(전체, 109건 포함) 3,326/13,665(24.34%) — 전부 계약·04-4 근거 절과 일치.

두 조건 동시 적용(집필자 계산): 밀도 평균 (596.9+592.3+537.8+512.7+509.6)/5=549.86→549.9. 폐업률 평균 (28.4+26.7+23.5+21.7+18.2)/5=23.7. 평균 이상 밀도={중구,서구}, 평균 이하 폐업률={중구,유성구,대덕구} — 교집합 {중구}. 이 계산은 새 원자료 조회 없이 계약이 준 값(재확인 완료)만 사용했다.

평균 경계 판정표(GE2, gawk 손계산, 표시값·큰 값 기준 — 마진% = |값−평균|÷max(값,평균)×100): 밀도(평균549.86) 중구7.883%→7.88%·서구7.166%→7.17%·동구2.194%→2.19%(경계)·대덕6.759%→6.76%·유성7.323%→7.32%. 폐업률(평균23.70) 중구0.844%→0.84%(경계)·동구16.549%→16.55%·서구11.236%→11.24%·유성8.439%→8.44%·대덕23.207%→23.21%. 문턱 4% 아래 둘(중구 폐업률·동구 밀도) 외 8행은 전부 안전. 중구 2019 코호트 2,284건 중 폐업 543건(현재537+6)이면 543/2,284=23.774%→23.77%로 평균(23.70%)을 넘는다 — 6/2,284=0.2627%→0.26%.

재현 카드 세 항목: 버린 행 747행·0.93%(author-a/ep-04-2/script.md 근거 절, 표준산업분류명 결측 22행+중복 725행) · 분모 출처(위 04-3 밀도 절) · 코호트 정의(위 04-4 코호트 절, 관측 종료 2021-12-30). 세 값 모두 새로 낸 숫자가 아니라 앞 세 차시 근거의 재인용이다.

quiz 규격 확인

5문항 = 다섯 슬롯 다섯 주제(세 의무·민감도·한계 셋·재현·함정) 고정(GE4, rev3). mc2를 재현(버린 행 규칙·분모 출처·코호트 정의) 문항으로, mc4를 한계 셋 전체(폐업 미신고·구 단위·업종 체계, 넷째 보기는 코호트 연도를 바꾸면 결론이 뒤집힌다는 민감도 실물과 반대되는 오답)로 교체했다. 이론 다른 예(200명·78%)는 더 이상 문항 주제가 아니다(계약 명시). 정답 길이 조정 이력: rev1 최초안이 3연속 관문 위반 뒤 재배치로 35.0% 통과했고, rev3에서 mc2·mc4 교체 직후 「길이2위 40%」로 다시 걸려 mc4 보기 하나를 늘려 길이 순위 동률을 풀어 재통과시켰다. 최종 axquiz 결과: 관문(찍기 기대 정답률) 35.0%(어절 수 최다) — 경계값 그대로 통과(COMMON §0.14 「35.0%는 통과」). 개별 문항 경고(정답 최장·편차 2배) 0건, 절대어·4계열 오답 편중 0건, 정답이 유일 최장/최단 각 1/5(한도 안), 정답 길이 순위 1·2·3·4·동률 각 1문항(재분산).

슬라이드 빌드

slides.md는 rev3에서 demo2 frame의 「109건」을 「149건(2018)·109건(2019)」으로 정정(GE5), 그 외 블록 구조는 rev2와 동일. 블록 15개(cover 포함) = 본문 14장(goal·result·chapter·big·two·steps·chapter·demo×4·chapter·wrap, §0.14는 cover 제외 셈) — 12~14 범위 안. 챕터 3장(clock 5·17·2) · big 1장(이론) · demo 4장(시연) · 이론 슬라이드(big·two·steps) 대전·자치구·인물 0회(집필자 육안 확인) · chapter title·label·lead 숫자 0건 · two 슬라이드 본문 숫자 0건 · 숫자 실린 슬라이드(result·demo×4) 전부 src 필드 보유. axdeck 실행 결과 경고 0건(검사 로그 참조).

분량 (자가측정)

count_script.py 실행 결과(검사 로그 참조): 합계 공백포함: 5514 ÷250 = 22.1분. 위 태그 표 소계 합 264초 ÷60 = 4.4분. chapter 전환 3장 합쳐 0.5분(편당 10초). 총량 = 22.1+4.4+0.5 = 26.96분→27(25~30 판정 통과, 여유 약 3.0분, minutes 불변). 시연 clock = 시연 발화 3114÷250(12.46분) + 시연-only 소계 248초÷60(4.13분) = 16.59분→17분(slides.md clock: 17분과 일치, 불변). 이론 clock = 이론 발화 1343÷250(5.37분) + chapter 전환 10초÷60(0.17분) = 5.54분→5분(불변). 정리 clock = 정리 발화 474÷250(1.90분) + chapter 전환 10초÷60(0.17분) = 2.06분→2분(불변). minutes 판정: 27−(5+17+2)=3, 0~6 안.

미확인

없음.

검사 로그 (집필자 실행 — rev3)

구간    라인                공백포함      공백제외    ÷250
도입    37-52              583       429     2.3
이론    53-81             1343       995     5.4
시연    82-153            3114      2329    12.5
정리    154-171            474       347     1.9

합계 공백포함: 5514  ÷250 = 22.1 분
합계 공백제외: 4100  ÷250 = 16.4 분
drop log: {'heading': 4, 'screen': 11, 'boldhead': 0, 'comment': 0, 'fence': 2, 'blank': 58, 'paren': 46}
이력 절 줄참조 있는 줄 0개 (0이어야 한다)
태그 표 대조: script 화면 지시 10개 ↔ notes 표 행 10개
script 내부 참조 검사 0개
검사 절 12개(검사 로그 절 제외) 중 검사 대상 줄 63 · 인용 14개 · 줄참조 56개 · stale 0
minutes·clock 절대값 대조: 총량 26.956분(조작 264초) · 시연 16.589분
ep-04-5/slides.html  슬라이드 16장 (인트로·아웃트로 포함) · 납품본 — 강사 노트 제외
ep-04-5/slides_notes.html  슬라이드 16장 (인트로·아웃트로 포함) · 강사용 — 노트 내장
ep-04-5/AX부트캠프_온라인38차시_평가문항.xlsx  1차시 · 6문항
  정답 분포  1번 1(20%) 2번 2(40%) 3번 1(20%) 4번 1(20%)
  정답이 유일 최장인 문항(길이 순위만)  1/5
  진단 특징(관문 제외) 최대  최장 어절 길이 최소 43.3%
  어휘 겹침(진단, 관문 제외)  어휘 겹침 최다 25% · 어휘 겹침 최소 25%
  번호 찍기(전 차시 합산 검사용)  최대 40%
  영상 없이 찍기 기대 정답률(최대 전략)  어절 수 최다 35.0%  [어절 수 최다 35% · 길이2위 30% · 길이3위 30% · 강조 부사 최소 30% · 단정형 지우기 27% · 숫자 지우기 27% · 단정 어미(이다·된다·있다) 최소 27% · 절대어 지우기 25% · 절대어 고르기 25% · 쉼표 최다 25% · 쉼표 최소 25% · 따옴표 최다 25% · 따옴표 최소 25% · 괄호 최다 25% · 괄호 최소 25% · 조건형(경우·수 있·때로·보였다·수도) 최다 25% · 조건형(경우·수 있·때로·보였다·수도) 최소 25% · 한자어 명사형 종결(~것·~함) 최다 25% · 한자어 명사형 종결(~것·~함) 최소 25% · 어절 수 최소 25% · 최장 20% · 최단 20% · 길이1위 20% · 길이4위 20% · 단정형 고르기 20% · 숫자 고르기 20% · 단정 어미(이다·된다·있다) 최다 20% · 글자 수 최다 20% · 글자 수 최소 20% · 강조 부사 없는 보기 20% · 단정 어미(이다·된다·있다) 없는 보기 17% · 강조 부사 최다 10% · 단정 어미(이다·된다·있다) 있는 보기 10% · 강조 부사 있는 보기 0%]
  정답이 유일 최단인 문항  1/5
  단정 서술 4계열(구조·배타·전면부정·빈도)  정답 0/5 · 오답 1/15
  절대어 보기  정답 0/5 · 오답 0/15
  정답 길이 순위 분포(1=최장)  1위 1 2위 1 3위 1 4위 1 동률 1
  정답이 눈에 띄게 긴 보기  0/5 (0%)