AI가 매일 새벽 법원경매 물건을 분석한다 — 옥션렌즈 새벽 배치 운영기

AI옥션렌즈는 법원경매 물건 하나를 볼 때 흩어져 있는 매각물건명세서·감정평가 요항·기일 이력·인근 실거래가를 한 화면에 모으고, AI가 “여기를 직접 확인하라"고 짚어 주는 문서 도우미다. 7월 4일 배포하고 이튿날부터 새벽 배치를 붙였다. 내가 자는 동안 AI가 전국 물건을 훑어 신건을 분석해 두는 구조인데, 두 달 운영일지에 찍힌 숫자를 보면 낭만보다 배관 이야기가 더 많다. 법률·투자 판단을 제공하는 서비스가 아니라는 점을 먼저 적어 두고 시작한다.

법원경매 문서 — 개념 사진 (사진: https://kaboompics.com/ / Pexels)
법원경매 문서 — 개념 사진 (사진: https://kaboompics.com/ / Pexels)

가장 먼저 정한 것 — 판정하지 않는다

경매 물건에 “안전하다 / 위험하다 / 추천한다"는 결론을 AI가 내리지 않는다. 이건 기능이 아니라 제약이고, 처음부터 코드에 박았다. 모든 정리 항목에는 원문 인용과 출처가 붙고, AI의 역할은 “매각물건명세서 비고란에 이런 문구가 있으니 직접 확인하세요"까지다.

말로만 두면 LLM은 어느 날 “입찰을 권합니다"를 쓴다. 그래서 생성문을 저장하기 전에 권유·지시·안전 판정·수익 보장 같은 9가지 패턴을 검사하고, 걸리면 공개 캐시에 올리지 않고 격리 큐로 보내 관리자에게 알린다. 기존 분석 595건에 돌려 봤을 때 오탐은 0이었다. 원문 인용에 섞여 나오는 임차인·채무자 실명은 성만 남기고 가리고, 대법원 응답의 구조가 바뀌면(필수 블록·타입이 어긋나면) 기존 캐시를 지키고 하루 한 번 경보만 보낸다. “원문을 보여준다"는 원칙은 개인정보와 원천 데이터 안정성까지 같이 따라온다는 걸 만들면서 배웠다.

데이터는 대법원 법원경매정보 공개 API와 국토교통부 실거래가만 쓴다. 유료 경매 사이트를 복제하지 않는 건 원칙이자 법적 선이다.

새벽 3시에 벌어지는 일

배치는 매일 03:00에 돌고 06:30에 한 번 더 깨어나 “오늘 수집이 끝났으면 그냥 잔다.” 순서는 이렇다.

  1. 먼저 대법원 API가 살아 있는지 한 번 찔러 본다. 점검 중이면 17개 지역을 100분 동안 헛돌지 않고 바로 멈추고 알림만 남긴다.
  2. 전국 17개 시도의 진행 물건을 수집한다. 호출 간격은 1.3초, 지역 사이 3초 휴식. 새벽이라 더 예의 있게 간다. 결과는 날짜별 스냅샷으로 저장하고 7일치만 남긴다.
  3. 전날 스냅샷과 비교해 새로 나타난 물건을 “신건 후보”, 사라진 물건을 “종결 추정"으로 분류한다. 수집이 0건이면 빈 스냅샷으로 기준선을 덮지 않고 중단한다.
  4. 신건을 서울→경기→인천 순, 매각기일 빠른 순으로 정렬해 AI 분석을 붙인다. 마감은 05:00, 최대 150건. 한 건 실패는 건너뛰고 계속 간다.
  5. 방금 만든 스냅샷으로 지도 데이터를 다시 만들고, 결과를 텔레그램으로 보내고 상태 파일을 남긴다.

운영일지 숫자로 본 두 달

7월 6일 첫날은 기준선이 없어 전국 4,036건을 전부 후보로 잡고 99건을 분석했다. 다음 날 전국 17,402건, 후보 13,733건. 이후로는 하루 전국 진행 물건이 대체로 1만 3천1만 9천 건 사이를 오갔고(7월 13일 18,942건이 최고), 신건 후보는 적은 날 149건, 많은 날 2,493건이었다. 분석 완료는 거의 매일 7999건. 후보가 2천 건이어도 분석은 90건 남짓에서 멈추는데, 마감 05:00까지 두 시간 동안 건당 1분 남짓 걸리기 때문이다. 배치 소요는 120분 전후로 거의 일정했고 실패는 0~2건이었다. 주말처럼 신건이 없는 날은 15분 만에 끝난다.

사고도 있었다. 7월 11일은 “전국 진행 물건 0건, 수집 불완전 17개 지역"이 찍혔다. 대법원 쪽 응답이 빈 채로 돌아온 날이고, 덕분에 “0건이면 기준선을 덮지 말 것"이 코드에 들어갔다. 그 전에는 0건 스냅샷이 기준선이 되면 다음 날 전국 물건이 전부 신건으로 잡혔을 것이다.

8월에 서버를 집 PC에서 맥북으로 옮긴 뒤가 더 문제였다. 분석 한 건에 5분 가까이 걸리고 300초 타임아웃에 걸려 하루 17~27건밖에 처리하지 못했다. 집 PC에서 91건 하던 일이다. 8월 22일에 배치 전용으로 타임아웃 600초, 더 가벼운 모델을 쓰도록 바꿨고, 다음 날 새벽 로그로 처리량을 확인하기로 했다. 그리고 운영일지를 쭉 넘기다 보니 8월 10일부터 22일까지 배치 줄이 “13,022건 / 신건 258건 / 분석 91건"으로 글자 하나 안 바뀐 채 반복된다. 배치가 맥북으로 옮겨 갔는데 일지는 집 PC에 남은 옛 로그를 읽고 있었던 것이다. 자동 기록은 성실했지만 값은 멈춰 있었다.

사람이 보는 부분

배치는 자동이지만 사람 손이 빠지지 않는 지점이 몇 개 있다. 회원의 분석 요청은 이메일 인증 뒤 내가 승인해야 AI가 돈다. 무분별한 호출을 막기 위한 게이트인데, 분석 원가가 건당 2~3원이라 비용보다는 품질 통제 쪽 의미가 크다. 등기부 열람은 건당 800원 안팎 실비가 들어 운영자만 할 수 있고, 원문은 공개하지 않고 요약과 마스킹된 이름만 올린다. 판정 금지 검사에 걸려 격리된 분석은 사람이 읽고 결정한다. 그리고 새벽 알림을 아침에 읽는 것 — 이게 제일 중요한 사람의 일이다. 위의 “멈춘 숫자"를 알아챈 것도 결국 사람이었다.

다음으로 붙이려는 건 대법원의 문건접수·송달 목록을 읽어 “취하서 접수"를 실제로 감지하는 일이다. 지금 핵심 체크포인트의 취하 신호는 추정인데, 이걸 사실 기반으로 바꾸는 게 할 일 목록의 최우선이다. 그다음이 건축물대장(위반건축물 표시)과 결제다.

매일 새벽 두 시간, 1만 건을 훑고 90건을 읽는 일을 사람이 했다면 이 서비스는 존재하지 않았을 것이다. 다만 그 90건이 “입찰하라"가 아니라 “여기를 확인하라"로 끝나는 이상, 마지막 판단과 책임은 여전히 읽는 사람의 것이다. 이 글도 마찬가지로 법률·투자 판단을 제공하지 않는다.

이 글은 제 여행 기록과 작업 로그를 바탕으로 초안을 AI와 함께 정리하고, 직접 편집했습니다.