엔지니어링
만들어 돌려 보고, 숫자로 확인한 것.
AI 에이전트와 업무자동화를 실제로 운영하면서 측정한 것을 적습니다. 잘된 것만 고르지 않고, 숫자가 저희 가정을 뒤집은 지점도 그대로 남깁니다.
- 2026-09-01ax 트랙 88편·검색량 155키워드 대조가설 재판정 1회·죽은 계측 2건 복구
노출 2.6→0.9, 범인은 따로 있었다
SEO 콘텐츠 축에서 발행량을 늘리는 동안 오퍼 트랙(ax)의 편당 노출은 2.6에서 0.9로 더 떨어졌습니다. 처음 지목한 범인은 같은 키워드에 열여섯 편이 쌓인 콘텐츠 중복이었지만, 반대가설로 검색량을 다시 대조하고서야 2차 요인이라는 사실이 드러났습니다. 진짜 원인과, 그 과정에서 함께 발견된 두 번의 죽은 계측을 그대로 적습니다.
SEO 콘텐츠데이터 검증계측 - 2026-09-01테스트 5,638건오진 2회·반증 2회
1,300개의 에러는 버그가 아니었다
테스트를 돌리면 1,289건이 깨졌습니다. 코드를 한 줄도 안 고치고 다시 돌리니 1,516건, 한 번 더 돌리니 2,173건이었습니다. 처음 지목한 범인은 알리바이가 있었고, 진짜 원인은 코드가 아니라 코드를 재는 도구 안에 있었습니다.
디버깅테스트 자동화품질 검증 - 2026-09-01계측 기간 21일사람 발화 3,161턴
에이전트는 왜 한 턴 만에 멈추나
같은 도구, 같은 모델인데 어떤 세션은 도구를 190번 쓰고 끝까지 가고 어떤 세션은 1번 쓰고 멈춥니다. 원인이 프롬프트 길이라고 생각했습니다. 21일치 3,161턴을 세어 보니 절반만 맞았고, 틀린 절반이 처방을 통째로 바꿨습니다.
AI 에이전트업무자동화계측