실전 메인라인 · 빌드 로그
당신의 Agent 빌드 로그
이 페이지는 실전 메인라인 전체의 기록장입니다. 한 장을 배울 때마다 돌아와 해당 마일스톤을 채우세요. 채우는 과정이 곧 검수 과정입니다: 쓸 수 있으면 진짜 한 것이고, 못 쓰면 그 칸은 아직 통과하지 않은 거예요. 여섯 칸을 채우면, 내보내는 것이 곧 완전한 Agent 구축 기록이 됩니다.
0 / 6개 마일스톤이 켜졌습니다. 내용은 이 기기 브라우저에만 저장되며 업로드되지 않습니다.
M0
무엇을 대신 하게 할지 정하기
M1
안정적으로 사람 말을 하기
M2
실제로 일을 해내기
M3
개선인지 악화인지 수치로
M4
오래 달려도 기억을 잃지 않기
M5
과정을 재현할 수 있기
여섯 마일스톤 · 해당 파트를 배운 뒤 돌아와 채우기
M0
무엇을 대신 하게 할지 정하기
대규모 모델 원리 · 검수 가능한 요구사항 하나 + 환각을 누르는 방안 하나
검수 기준: 네 줄을 비전문가에게 읽어 주면, AI가 무엇을 내놓아야 하는지를 다시 말할 수 있어야 합니다.
M1
안정적으로 사람 말을 하기
Harness 핵심 · 같은 입력으로 다섯 번 연속 실행, 결과가 모두 쓸 수 있음
다섯 번 중 두 번이 빗나가면 아직 M1이 아닙니다. 먼저 분류(형식 흔들림 / 내용 지어내기 / 길이 폭주)하고, 원인에 맞게 고치세요.
M2
실제로 일을 해내기
실전 · 첫 번째 진짜 도구를 붙이고 전체 루프를 통과시키기
멈춘 기록은 통과 기록보다 값집니다. 그게 M3 평가 세트의 첫 번째 까다로운 케이스예요.
M3
개선인지 악화인지 수치로
심화 · 케이스 10개의 평가 세트 + 베이스라인 점수 하나
「점수가 몇에서 몇으로, 대가는 어느 케이스가 퇴화했는지」를 말할 수 있으면 M3는 통과입니다.
M4
오래 달려도 기억을 잃지 않기
자기 개선 · 장거리 규칙 세 가지 + 「디스크에 남기고 다시 읽기」 통과
검수는 하나뿐입니다: 새 세션이 지난번 일을 끊김 없이 이어갈 수 있는가.
M5
과정을 재현할 수 있기
협업 방법론 · 첫 번째 Rule + 남이 따라 할 수 있는 규범 한 부
여섯 칸을 채운 뒤 아래 내보내기를 누르면, 그 Markdown이 이 강의가 당신 손에 남긴 실물입니다.
이 기기에 저장됨