혼자 쓰던 AI 하네스를 회사 전체로 넓히려다 막혔다. 하네스(harness)란 AI에게 일을 맡기고 그 결과가 제대로 됐는지 자동으로 검증하는 장치 묶음이다. 막힌 곳은 조직이었다. 사용자 한 명을 대신해 품질을 판정하던 자동 검사원(user-proxy)은 여러 명 앞에서는 작동하지 않는다. '늦은 프로젝트에 사람을 더 투입하면 오히려 더 늦어진다'는 옛 소프트웨어 격언(브룩스의 법칙)이 AI 에이전트에서도 똑같이 반복된다. 전환 작업은 여덟 단계 가운데 세 번째, 규칙 적용 범위를 가르는 단계에서 3주째 멈춰 있다. 본문의 단계 표는 번호를 0부터 세므로, 이 세 번째 단계에는 이런 이름표가 붙어 있다: M2
convergence-loop-no-mid-question이라는 규칙이 있다. 중간에 멈춰 사람에게 되묻지 않고, 결론이 날 때까지 자동으로 반복한다는 원칙이다. 이 규칙은 한 가지를 전제한다. 시작을 승인한 사람, 결과를 받는 사람, 품질 기준을 정한 사람이 모두 같은 사람이라는 전제다. 조직에서는 이 전제가 성립하지 않는다.
M2 StagnationM2 단계가 3주째 멈춘 이유| Milestone | 상태 | 핵심 과제 |
|---|---|---|
M0 Baseline Freeze | ✓ completed | 지금 상태를 사진 찍듯 기록해 기준점 만들기 |
M1 Runtime Drift Sync | ✓ completed | 실제 설치돼 돌아가는 버전을 원본 코드와 일치시키기 |
M2 Hook Scope Classifier | ⚠ 3주째 정체 | 규칙 적용 범위(scope)를 '전체 공통(global)'에서 '프로젝트별(project)'로 나누기. 규칙을 어디까지 적용할지 경계를 긋는 일은 본질적 난제다 |
M3 Project Installer | — pending | 프로젝트별 규칙을 자동으로 설치하기 |
M4 Staged Migration | — pending | 한꺼번에 바꾸지 않고 조금씩 옮기기 |
M5 Self-Evolve Alignment | — pending | 스스로 개선하는 루프끼리 서로 어긋나지 않게 맞추기 |
M6 Scorecard Split | — pending | 성과 측정 지표를 범위별로 나누기 |
M7 Operationalization | — pending | 실제 운영에 올리고, 시간이 지나며 설정이 원본에서 어긋나는 것(드리프트) 막기 |
M2 단계에서 지금 멈춤
L0 / L1 / L2 / L3 / L4APM · manifest.ymlAPM · manifest.yml