Phase 1515-3

하네스 엔지니어링 — 어떤 작업대를 만들 것인가

모델과 작업 환경을 구분하고 도구·자료·검증·권한·기록을 함께 설계하는 방법을 배웁니다. 공개·합성 과제로 효과를 비교하고 법률 판단과 대외 제출은 노무사 승인에 맡깁니다.

Execution Kit

실습 중 막히지 않기 위한 진행표

Phase 15

준비

강의 전 현재 폴더, 계정, 설치 상태를 확인합니다.

실행

2026년의 핵심 공식은 'Agent = Model + Harness'이며, 하네스는 모델을 제외한 에이전트의 모든 것(도구·메모리·권한·검증·승인)입니다.

검증

명령 결과, 파일 변화, 브라우저 화면 중 하나로 성공 여부를 확인합니다.

기록

잘 된 명령과 막힌 지점을 다음 실습을 위한 로그로 남깁니다.

막혔을 때 Claude Code에 붙여넣을 양식

나는 코딩 경험이 많지 않은 실무자입니다. "하네스 엔지니어링 — 어떤 작업대를 만들 것인가" 강의를 따라 하고 있습니다.

현재 상태:
- 사용하는 컴퓨터:
- 방금 실행한 명령:
- 화면에 나온 결과 또는 오류:
- 내가 만들고 싶은 업무 결과물:

요청:
1. 지금 상황을 초보자 기준으로 진단해줘.
2. 다음에 실행할 명령을 한 줄씩 제시해줘.
3. 각 명령이 무엇을 하는지 쉬운 말로 설명해줘.
4. 성공 여부를 확인할 체크 포인트를 정리해줘.
5. 실패하면 다시 붙여넣을 오류 보고 양식을 만들어줘.

하네스란? — Agent = Model + Harness

2026년 AI 엔지니어링의 핵심 공식이 있습니다. 에이전트 = 모델 + 하네스 (Agent = Model + Harness) 하네스(Harness)는 원래 말(馬)에 씌우는 마구(馬具)를 뜻합니다. 아무리 힘센 말도 안장·고삐·재갈 없이는 일을 시킬 수 없습니다. AI도 같습니다. 모델(말)이 아무리 똑똑해도, 그것을 일하게 만드는 장치(마구)가 없으면 그냥 '똑똑한 대화 상대'에 그칩니다. 하네스는 '모델을 제외한 에이전트의 모든 것'입니다. 도구, 메모리, 권한, 검증 절차, 재시도 로직, 사람의 승인 게이트 — 모델이 추론에만 집중하도록 나머지 운영을 떠받치는 시스템 전체입니다. Claude Code로 예를 들면, Claude는 말이고 CLAUDE.md·MCP 연결·슬래시 커맨드·권한 설정·검증 절차가 전부 하네스입니다.
TIP: 1과~6과에서 배운 CLAUDE.md·스킬·MCP·권한 설정이 흩어진 기능이 아니라 '하네스'라는 하나의 그림이었다는 것을 이 강의에서 묶어 줍니다. 부품을 배웠으니, 이제 설계도를 봅니다.

모델 이름보다 작업 환경과 실제 결과를 비교합니다

같은 모델도 도구 구성, 자료 선별, 검증 루프와 권한 설계에 따라 결과가 달라질 수 있습니다. 좋은 하네스는 필요한 자료를 주고, 실패를 발견하며 범위 밖 작업을 막는 데 도움을 줍니다. 순위가 30위에서 5위가 되었다는 정보만으로 성능이 6배 향상됐다고 계산할 수는 없습니다. 순위와 실제 점수, 비교 과제, 비용, 실행 시간은 서로 다른 지표입니다. 비교 근거를 확인하지 못한 수치로 생산성이나 법률 정확도를 보장하지 않습니다. 노무 업무에서는 같은 공개·합성 과제로 누락된 쟁점, 근거 표시, 계산 검산, 문서 검수와 사람 수정 시간을 비교합니다. 모델 교체보다 하네스가 언제나 우월하다고 단정하지 말고 해당 작업의 결과로 판단합니다.

하네스의 5가지 레이어

잘 만든 하네스는 다섯 개 층으로 이루어집니다. 각 층을 노무사 환경으로 번역하면 이렇습니다. [1. 도구 오케스트레이션(Tool orchestration)] AI가 쓸 도구를 정리하고 연결하는 층. korean-law(법령), Gmail(메일), 캘린더, 블로그 발행 등. 어떤 일에 어떤 도구를 쓸지 정돈합니다. [2. 검증 루프(Verification loops)] 산출물을 자동으로 점검하는 층. "사건번호는 verify_citations로 검증", "계산은 코드로 검산". 오류를 찾아 보류할 기회를 주는 점검 장치입니다. 검증 도구 자체의 누락도 확인합니다. [3. 컨텍스트와 메모리(Context & memory)] 앞 강의의 컨텍스트 관리가 여기 들어갑니다. CLAUDE.md·볼트 메모리·압축으로 무엇을 기억하고 무엇을 줄지 관리합니다. [4. 가드레일(Guardrails)] 넘지 말아야 할 선을 긋는 층. "발행·제출·삭제 전에는 사람 승인", "개인정보는 마스킹", "단정적 표현 금지". 한동노무법인의 승인 게이트가 이 층입니다. [5. 관측(Observability)] 무엇을 했는지 기록하고 들여다보는 층. 작업 일지, 변경 전 백업, 로그. 나중에 "AI가 무슨 일을 했는지" 추적할 수 있게 합니다.
TIP: 다섯 층 중 노무사에게 가장 중요한 것은 [2] 검증 루프와 [4] 가드레일입니다. 법률 업무는 틀리면 의뢰인에게 직접 피해가 가므로, 검증과 승인 게이트를 하네스에 단단히 박아 두는 것이 출시 전 필수입니다.

노무사 하네스 설계 실전

한동노무법인의 실제 하네스가 어떻게 5층으로 짜였는지 봅시다. [도구] korean-law MCP(법령·판례), 이메일·캘린더 연동, 워드프레스 블로그 발행 도구 [검증] verify_citations로 인용 검증, legal-document-verifier로 문서 교차 검증, 임금 계산은 코드 검산 [컨텍스트·메모리] CLAUDE.md에 정체성·금지사항·약어 정리, 옵시디언 볼트 memory 폴더에 작업 일지 [가드레일] 노동청·노동위·법원·의뢰인 제출 전 반드시 노무사 승인, 개인정보 외부 공유 금지, 할루시네이션 금지 [관측] 변경 전 본문 백업, 세션 종료 시 일지 기록, GitHub 동기화 이런 구조는 오류를 발견하고 제출 전 검토할 기회를 늘려 줍니다. 다만 검증 도구도 누락이나 오류가 있을 수 있으므로 가짜 인용이나 실수를 완전히 차단한다고 보장하지 않습니다. 실제 처리량과 정확도는 사례별로 점검합니다.
# 하네스 설계 = CLAUDE.md로 5층을 명문화

  # CLAUDE.md 예시 (하네스의 골격)

  ## 정체성 (컨텍스트 층)
  - 사용자: 공인노무사. 사업주 자문 + 근로자 대리.
  - AI: 자료 정리와 초안·점검 보조. 최종 법률 판단·승인·대외 제출은 사용자에게 맡김.

  ## 도구 (도구 오케스트레이션 층)
  - 법령/판례: korean-law MCP (연결·인증 정책 확인, 실제 키는 공개하지 않음)
  - 발행: 워드프레스 / 메일: Gmail

  ## 검증 (검증 루프 층)
  - 판례 사건번호는 verify_citations 통과 후에만 인용
  - 임금/퇴직금은 코드로 검산하고 산식 첨부

  ## 가드레일 (가드레일 층)
  - 제출·발행·삭제는 노무사 승인 후
  - 존재하지 않는 판례·조문 생성 절대 금지
  - 개인정보 마스킹

  ## 기록 (관측 층)
  - 변경 전 백업, 세션 종료 시 작업 일지 기록
TIP: korean-law 연결은 8-1의 단계별 실습을 봅니다. 연결, 자료 조회, 인용 실존 확인, 판시 내용 검토, 사건 적용 판단은 서로 다른 점검입니다.

핵심 정리

  • ✓2026년의 핵심 공식은 'Agent = Model + Harness'이며, 하네스는 모델을 제외한 에이전트의 모든 것(도구·메모리·권한·검증·승인)입니다.
  • ✓하네스의 효과는 같은 과제의 결과·검수 부담·시간으로 비교하며 순위 변화만으로 성능 배수를 계산하지 않습니다.
  • ✓하네스 5레이어는 도구 오케스트레이션·검증 루프·컨텍스트와 메모리·가드레일·관측이며 노무사에게는 특히 검증 루프와 가드레일이 중요합니다.
  • ✓CLAUDE.md에 도구·자료·검증·승인·기록을 정하고 실제 작업 결과로 보완합니다.

이 강의가 어떠셨나요?