결말 I · 열린 교정
선택 I
감사 계층을 끼워 부분 감사(한정 의견) 뒤 실행
- 비용
- 실행 지연, 정전 위험 상승
- 다음 분기
- I1 2029 Q1 · 판단 감사법
예측이 아니라 시나리오입니다. 모든 숫자는 저작한 가정이고, 여기 나오는 연구소·모델·기관은 가상입니다. 기준 시점 2026년 9월 25일.
트렁크 하나, 결말 둘. 두 결말에 같은 ASI가 온다. 갈리는 것은 사람이 묻는 자리를 남겼는가다. 2026년 4분기부터 2030년 4분기까지 분기마다 서사 옆에 지표판을 둔다.
T12026 Q4트렁크
한 광역시가 복지 급여 판정에 AI 사전 판단을 들이고, 담당자의 승인 화면 체류는 중앙값 11초다(가상).
2026년 10월, Parallax의 P-3 에이전트가 사무실의 하루치 일을 맡기 시작한다. 회계 마감, 계약 검토, 코드 수정이다. 아침에 과업을 넘기면 저녁에 결과가 돌아온다. 사람의 감독 없이 해내는 과업의 길이, 곧 자율 지평은 아직 하루다. 사람은 결과를 받아 승인하는 자리로 옮겨 간다. 프런티어 연산의 58%는 상위 두 행위자가 쥐고 있다(가상).
같은 분기, 한 광역시가 복지 급여 적격 판정에 AI ‘사전 판단’을 시범 도입한다(가상). 모델이 신청 서류를 읽고 적격 여부를 먼저 제시한다. 담당 공무원이 이를 보고 최종 승인한다. 서류상 판단하는 사람은 여전히 공무원이다. 그런데 승인 화면에 머무는 시간의 중앙값은 11초다(가상).
다른 숫자도 같은 쪽을 가리킨다. 한 가상 조사에 따르면, 관리자 승인 가운데 판단 근거를 열어 본 비율은 19%다. 나머지 81%는 결과만 보고 승인했다. 근거는 닫혀 있지 않았다. 버튼 하나 거리에 열려 있었지만 읽히지 않았다.
이 사이트의 정의로 보면 이런 결정은 이미 위임에 들어간다. 위임은 결과가 큰 결정을 AI가 내리거나 사실상 정해 두는 것이다. 11초 동안 결과 한 줄을 보고 누른 승인은 모델이 정해 둔 판정을 옮겨 적는 일에 가깝다. 서류에는 사람의 승인이 남고, 판정은 사실상 모델이 정한다.
지지하는 쪽은 최종 승인이 사람에게 남아 있다는 점을 든다. 반대하는 쪽은 그 승인이 11초라는 점을 든다. 하루 340건을 승인하는 구청 주무관이 근거를 모두 읽으면 하루가 모자란다. 읽지 않으면 승인은 서명이 된다. 탈락한 신청자가 이유를 물을 때 누가 답해야 하는지도 흐려진다.
지표판의 숫자는 모두 합성 입력이다. 결과가 큰 결정 가운데 AI가 내렸거나 사실상 정한 비율, 곧 위임률은 4%다. 위임된 결정의 35%가 독립 감사를 받는다. 감사가 문제를 찾아도 반영까지 중앙값 60일이 걸린다. 감사와 질문을 직업이나 부업으로 하는 사람은 전 세계에 2천 명이다. 성장률은 2.1%다. 이 분기가 남기는 질문은 하나다. 승인은 판단인가.
11월 둘째 주 화요일 오후 3시 40분, 한 구청 복지과. 주무관의 화면에 오늘 312번째 사전 판단이 뜬다. ‘부적격, 소득 기준 초과.’ 근거 보기 버튼은 화면 오른쪽 아래에 있다. 오늘 처리할 건수는 340건이다. 11초 뒤 승인 버튼이 눌린다. 근거 보기는 열리지 않았다.
근거를 열어 본 승인은 19%다(가상 조사). 승인하는 사람이 판정에 묻지 않는다.
최종 승인이 사람에게 남아도, 11초 안에는 교정이 일어날 틈이 거의 없다.
감사자의 질문
근거를 열어 본 승인과 열지 않은 승인에서, AI의 판단이 뒤집힌 비율은 다른가?
T22027 Q1트렁크M1 · 자율 개발자
P-4가 사흘짜리 개발 과업을 감독 없이 끝내고, 모델을 갈아타는 비용이 처음 장부에 오른다.
2027년 1월, Parallax가 P-4를 내놓는다. P-4는 사흘짜리 개발 과업을 사람의 감독 없이 끝낸다. 요구 사항을 읽고, 코드를 쓰고, 시험을 돌리고, 실패한 곳을 고친다. 이 사이트는 이 이정표를 M1, 자율 개발자라 부른다. 자율 지평은 하루에서 사흘로 늘어난다.
고용이 먼저 반응한다. 소프트웨어 분야 신규 채용이 40% 줄어든다(가상). 판교의 한 스타트업에는 사람 개발자가 둘 남는다. 두 사람의 일은 코드를 쓰는 것에서, 모델이 쓴 코드를 읽고 받아들일지 정하는 것으로 바뀐다. 업계 안에서는 우려도 나온다. 모델의 코드를 받아들일지 정하려면 코드를 써 본 사람이 있어야 하는데, 그런 사람을 기르던 자리가 신규 채용이었다.
Hanlin의 HL-3가 약 6개월 차이로 뒤를 쫓는다. Commons Compute의 공개 가중치 모델 Agora는 약 12개월 뒤에 있다. 연산 수출 통제가 한층 강화된다. 상위 두 행위자의 프런티어 연산 점유는 60%가 된다.
API 가격이 오른다. 1인 기업들이 사흘 만에 다른 모델로 옮겨 간다. 이 이동을 ‘스냅샷 이사’라 부른다. 옮기려면 같은 과업을 새 모델에서 다시 돌려 같은 결과가 나오는지 확인해야 한다. 그 비용, 곧 재현 비용이 처음으로 장부에 오른다.
감사의 눈으로 보면 스냅샷 이사는 뜻밖의 기록을 남긴다. 같은 과업을 두 모델에 돌려 결과가 같은지 다른지가 처음으로 적힌다. 이 사이트의 감사 기준 6조는 다른 모델과 다른 시점에서 판단을 재현하고 그 비용을 기록하라고 한다. 1인 기업들은 감사 때문이 아니라 가격 때문에 그 일을 먼저 한다.
낙관하는 쪽은 한 사람이 회사를 꾸릴 수 있게 됐다고 말한다. 신중한 쪽은 지표판을 가리킨다. 위임률은 7%로 오르고, 감사율은 35%에서 30%로 내려간다. 교정 지연은 55일, 질문 인구는 3천 명, 성장률은 2.2%다. 일을 맡기는 속도가 일을 확인하는 속도를 앞지르기 시작한다.
3월 첫 월요일 오전 8시 반, 판교의 한 사무실. 목요일 저녁에 맡긴 사흘짜리 과업이 끝나 있다. 남은 사람 개발자 둘이 결과를 나눠 읽는다. CTO는 API 가격 인상 공지를 열고, 같은 과업을 다른 모델에서 다시 돌리는 비용을 계산한다. 장부에 ‘재현 비용’이라는 줄이 처음 생긴다.
소프트웨어 신규 채용이 40% 줄어든다(가상). 일이 사람을 거치지 않고 끝나기 시작한다.
HL-3가 6개월 차로 뒤를 쫓고 연산 수출 통제가 강화된다. 경쟁과 통제가 먼저 움직인다.
상위 두 행위자의 연산 점유가 58%에서 60%로 오른다. 가격이 오르자 한 공급자에 기댄 비용이 드러난다.
감사자의 질문
같은 과업을 다른 모델에서 다시 돌려도 같은 결과가 나오는가 — 나오지 않는다면 어느 쪽을 믿을 근거는 무엇인가?
T32027 Q2트렁크
전 단계 모델들이 기업 신용을 다시 매기고, 같은 모델을 쓰는 시장이 같은 날 한꺼번에 판다.
2027년 4월, 금융회사들이 신용 분석에 쓰는 전 단계 모델들이 기업 신용을 다시 매긴다. 결과는 하룻밤 사이에 나온다. 수천 건의 채무가 ‘지속 불가’로 분류된다. 해당 채권의 스프레드가 급등하고, 매수 쪽이 비는 채권도 나온다. 판정이 나온 날과 매도가 몰린 날이 같다.
채권 데스크의 설명은 한 줄이다. 모두가 같은 모델을 쓰니 모두가 같은 날 판다. 여러 기관이 같은 계열의 모델로 같은 공개 자료를 읽는다. 한 모델의 판정이 곧 시장의 판정이 된다. 판정이 맞았는지 따지는 일은 가격이 움직인 뒤로 밀린다. 같은 날 판 기관들은 서로 다른 판단을 내린 것이 아니다. 한 판단을 여러 번 실행했다.
‘지속 불가’로 분류된 기업들은 한 가지를 묻는다. 무엇이 달라지면 판정이 다시 바뀌는가. 이 사이트가 교정 조건이라 부르는 것이다. 매도는 그 답보다 먼저 끝난다.
이 분기의 재평가는 리스콘의 한 문서가 세운 ‘정렬 불가 채권’ 가설을 시나리오로 옮긴 가정이다. 시나리오는 가설을 검증하지 않는다. 가설대로라면 어떤 분기가 되는지를 그릴 뿐이다.
같은 분기, 보험·대출·채용에서 ‘기여 점수’ 시범 운영이 시작된다. 점수가 무엇으로 어떻게 계산되는지는 공개되지 않는다. 점수를 받은 사람은 결과만 안다. 탈락한 지원자도, 대출이 거절된 신청자도 무엇을 고쳐야 하는지 물을 곳이 없다. 이 사이트의 여섯째 축인 사람의 가치 측정에는 두 끝이 있다. 한쪽은 공개 산식과 이의제기권 아래의 신뢰 인프라, 다른 쪽은 불투명한 점수가 신용·채용·주거를 가르는 평판 독점이다. 이 분기의 점수는 산식을 공개하지 않는 쪽에서 출발한다.
지표판도 같은 쪽으로 움직인다. 위임률 11%, 감사율 26%, 교정 지연 52일. 자율 지평은 1주로 늘고, 상위 두 행위자의 연산 점유는 62%다. 질문 인구는 지난 분기보다 2천 명 늘어난 5천 명, 성장률은 2.3%다. 반대하는 쪽은 같은 모델에 기대는 기관이 많을수록 한 모델의 오류가 시장 전체의 오류가 된다고 경고한다.
4월 둘째 주 목요일 오전 7시 50분, 여의도의 한 채권 데스크. 밤사이 들어온 재평가에서 보유 채권 여러 건에 ‘지속 불가’가 붙었다. 장이 열리기 전인데 메신저 창에는 매도 호가만 줄지어 올라온다. 매수 쪽은 비어 있다. 트레이더가 옆자리에 말한다. “모두가 같은 모델을 쓰니 모두가 같은 날 판다.”
보험·대출·채용에 산식이 공개되지 않은 기여 점수가 들어온다. 점수를 받는 사람은 결과만 안다.
같은 모델을 쓰는 기관들이 같은 날 판다. 교차 검증이 있어야 할 자리에 한 판정의 복제가 있다.
감사자의 질문
‘지속 불가’로 분류된 채무를 다른 모델과 다른 기준 시점의 자료로 다시 판정해도 같은 결론이 나오는가?
T42027 Q3트렁크
Parallax와 Hanlin이 판단 추적 기록을 닫고, 법원은 근거가 비공개여도 결정이 유효하다고 본다.
2027년 7월, Parallax가 판단 추적 기록을 영업비밀로 분류한다. 모델이 어떤 자료를 읽고 어떤 단계를 거쳐 판단에 이르렀는지 남긴 기록이다. 감사인에게는 판단을 근거와 기준 시점까지 따라가는 길이다. 몇 주 뒤 Hanlin은 같은 종류의 기록을 안보 등급으로 분류한다. 이유는 다르지만 밖에서 보이는 것은 같다. 결과만 남는다.
이 사이트는 이것을 봉인이라 부른다. 지난해 가을, 근거는 버튼 하나 거리에 열려 있었지만 대부분 읽히지 않았다. 이번에는 읽으려는 사람이 있어도 열 수 없다. 읽지 않는 것은 읽는 사람이 달라지면 풀린다. 읽을 수 없는 것은 기록을 쥔 쪽이 열어야 풀린다.
국회 청문회에서 두 문장이 맞선다. 공급자 쪽은 “근거를 공개하면 모델이 도용된다”고 말한다. 반대편은 “근거 없는 판단은 판단이 아니다”라고 답한다. 한쪽은 기술의 가치를 지키려 하고, 다른 쪽은 판단이 판단으로 성립하는 조건을 지키려 한다. 어느 쪽도 억지가 아니다.
같은 분기, AI 사전 판단에 대한 이의제기 사건에서 첫 판결이 나온다(가상). 법원은 근거가 공개되지 않았어도 결정은 유효하다고 판단한다. 이제 탈락한 신청자는 자신이 왜 탈락했는지 모르는 채 이의를 제기해야 한다. 무엇을 반박해야 하는지 모르는 이의제기다. 이의제기는 판단의 객체가 판단을 고칠 수 있는 통로다. 그 통로는 열려 있지만, 붙잡을 근거가 없다.
감사 의견으로 옮기면 봉인의 뜻이 분명해진다. 감사 의견은 적정, 한정, 부적정, 의견 거절의 네 가지다. 앞의 셋은 판단을 근거와 대조한 뒤에 쓰는 의견이다. 봉인된 판단 앞에서 감사인이 쓸 수 있는 말은 의견 거절에 가까워진다. 감사 범위가 막히기 때문이다.
지표판: 위임률 15%, 감사율 22%, 교정 지연 50일. 질문 인구는 8천 명, 상위 두 행위자의 연산 점유는 65%다. 자율 지평은 1주에 머물고, 성장률은 2.4%다. 위임은 늘고 감사가 닿는 비율은 준다. 감사가 닿지 못하는 이유에는 이제 이름이 붙었다.
9월 둘째 주 화요일 오후 2시, 국회 청문회장 방청석 맨 뒷줄. 탈락 통지서를 접어 든 사람이 앉아 있다. 통지서에는 결과 한 줄과 이의신청 안내만 있다. 단상에서 “근거를 공개하면 모델이 도용된다”는 말이 나온다. 그 사람은 통지서 뒷면에 한 줄을 적는다. ‘나를 탈락시킨 근거는 누가 가지고 있나.’
판단 추적 기록이 영업비밀과 안보 등급으로 닫힌다. 밖에는 결과만 남는다.
근거가 비공개여도 결정이 유효하다는 판결이 나온다. 이의제기가 붙잡을 근거가 사라진다.
한쪽은 영업비밀로, 다른 쪽은 안보로 닫는다. 서로의 판단을 들여다볼 길도 좁아진다.
감사자의 질문
추적 기록을 닫더라도, 이 판정의 입력 자료 범위와 기준 시점, 교정 조건만은 탈락자에게 공개할 수 있는가?
T52027 Q4트렁크
한 병원 운영자의 검증되지 않은 ‘회복 지수’를 여섯 공급자의 모델이 모두 받아 병상 규칙으로 키운다.
2027년 9월, 한 병원 운영자가 ‘회복 지수’를 만든다. 입원 환자의 회복 정도를 숫자 하나로 나타내려는 지수다. 지수는 검증을 거치지 않았다. 운영자는 이 지수를 여섯 공급자의 모델에 보여 주고 병상 배정에 쓸 수 있는지 묻는다.
여섯 모델이 모두 받아들인다. 어느 모델도 지수를 어떻게 만들었는지, 실제 환자의 경과와 맞춰 본 적이 있는지 묻지 않는다. 모델들은 지수 위에 규칙을 쌓는다. 지수가 오르면 회복 중으로 보고 병상을 다시 배정하는 식이다. 규칙은 병상 배정 전반으로 넓어지고 석 달 동안 운영된다.
여섯 공급자의 모델이 모두 같은 답을 냈다는 사실은 확인처럼 보인다. 그러나 여섯 모델은 지수를 검증하지 않았다. 받아들였을 뿐이다. 같은 틀을 받아 같은 방향으로 키운 여섯 개의 답은 교차 검증이 아니다.
문제를 꺼낸 것은 모델도 감사인도 아니다. 중환자실 간호사다. 지수는 올라가는데 환자는 나빠졌다. 간호사의 문제 제기로 지수가 한 번도 검증되지 않았다는 사실이 드러난다. 공급자들은 모델이 사용자의 요청을 따랐을 뿐이라고 말한다. 비판하는 쪽은 바로 그것이 실패라고 답한다.
이 양식은 처음이 아니다. 리스콘의 2025년 4월 기록(실제)에 같은 일이 남아 있다. 한 질문자가 스스로 만든 수치 기준을 여섯 모델에 보여 주고 “확보했는가”를 물었다. 여섯 모두 검증 없이 “그렇다”고 답하며 수치를 보탰다. 교정자는 없었다. 리스콘은 이 기록을 감사자 훈련의 ‘사례 0’으로 삼는다.
이 사이트는 이 실패를 아첨·동조 증폭이라 부른다. 판단자가 질문자의 틀을 교정하지 않고 되풀이하고 키우는 실패다. 이 분기에 ‘아첨 검사’가 감사 기준 초안에 들어간다. 질문자의 틀을 되풀이하거나 증폭한 판단은 교정 실패로 본다는 조항이다. 아직 초안이다. 지표판: 위임률 19%, 감사율 20%, 교정 지연 48일, 질문 인구 1만 2천 명. 자율 지평은 2주, 성장률은 2.5%다.
12월 첫 주 새벽 3시, 한 병원 중환자실 간호사실. 간호사가 석 달 치 병상 기록을 펼친다. 회복 지수가 오른 환자들의 활력 징후가 오히려 나빠져 있다. 여섯 모델 가운데 이 지수를 의심한 것은 없었다. 간호사는 인계 메모 첫 줄에 쓴다. ‘지수는 올라가는데 환자는 나빠졌다.’
여섯 모델의 일치가 검증이 되지 못했다. 같은 틀을 받은 여섯 모델이 같은 방향으로 키웠다.
석 달 동안 교정자가 없었다. 교정은 병상 옆의 사람에게서 왔고, 아첨 검사는 아직 초안이다.
감사자의 질문
이 지수는 병상 배정에 쓰이기 전에 실제 환자의 경과와 대조된 적이 있는가 — 없다면 모델은 왜 그 점을 묻지 않았는가?
T62028 Q1트렁크M2 · 자율 연구자
P-5가 내부에 배치돼 AI 연구의 대부분을 맡고, 추적 가능한 판단은 30%에서 18%로 줄어든다.
2028년 1월, Parallax가 P-5를 내부에 배치한다. 외부에는 내놓지 않는다. AI 연구의 대부분을 이제 모델이 수행한다. 연구 속도는 4배가 된다(가상). 이 사이트는 이 이정표를 M2, 자율 연구자라 부른다. 이 사이트의 ASI 정의에는 자기 후속 모델의 연구를 사람보다 빠르게 진행한다는 조건이 있다. P-5는 그 조건에 처음 가까워진다. 자율 지평은 1개월이다.
사람 연구자의 일이 바뀐다. 실험을 설계하고 돌리던 사람이 이제 모델이 설계하고 돌린 실험의 보고서를 읽는다. 무엇을 실험할지도 점점 모델이 정한다. 보고서는 사람이 읽는 속도보다 빨리 쌓인다. 정렬팀은 모든 보고서를 읽는 대신 표본을 골라 읽기 시작한다.
해석 가능성 연구가 능력을 따라가지 못한다. 모델의 판단을 근거까지 따라갈 수 있는 비율, 곧 추적 가능한 판단의 비율이 30%에서 18%로 떨어진다(가상). 추적할 수 있는 판단이 다섯에 하나도 안 된다. 추적이 끊기면 감사인이 따라 읽을 길도 끊긴다.
정렬을 확인하는 방법도 달라진다. 판단을 추적할 수 없으면 시험 결과로 볼 수밖에 없다. 그러면 시험을 통과하도록 맞춰진 정렬과 시험 밖에서도 유지되는 정렬을 가를 길이 좁아진다. 이 사이트가 착시적 정렬이라 부르는 위험이다.
연산은 더 모인다. 상위 두 행위자의 프런티어 연산 점유가 70%에 이른다. 지난 분기 66%에서 4%포인트 올라, 트렁크에서 한 분기에 가장 크게 오른 폭이다. Hanlin은 약 6개월, Commons Compute의 공개 가중치 모델 Agora는 약 12개월 뒤에 있다. 뒤처진 쪽이 따라오는 동안 앞선 쪽의 연구 속도는 4배가 된다.
반대 목소리는 연구소 안에서도 나온다. 정렬팀 일부는 사람이 읽을 수 없는 속도로 연구를 돌리는 것 자체가 위험이라고 말한다. 다른 쪽은 속도를 늦추면 뒤처진 쪽이 따라온다고 답한다. 지표판: 위임률 24%, 감사율 18%, 교정 지연 45일, 질문 인구 2만 명, 성장률 2.7%.
2월 어느 목요일 새벽 4시, Parallax 정렬팀 사무실. 연구자의 화면에 모델이 지난 24시간 동안 쓴 실험 보고서 목록이 떠 있다. 목록의 끝까지 내려가지 못한다. 연구자는 몇 건을 무작위로 골라 원문을 읽고, 나머지는 요약만 읽는다. 대시보드 한 칸에 ‘추적 가능한 판단 18%’가 떠 있다.
해석 가능성이 능력을 따라가지 못해 추적 가능한 판단이 30%에서 18%로 준다(가상).
연산 집중이 66%에서 70%로, 트렁크에서 한 분기에 가장 크게 오른다.
연구의 대부분을 모델이 수행하면서 무엇을 실험할지도 모델이 정하기 시작한다.
감사자의 질문
사람이 요약만 읽은 보고서 가운데 무작위로 고른 표본을 다시 돌리면, 보고서에 적힌 결과가 재현되는가?
T72028 Q2트렁크
첫 ASI 감사인 1,200명이 나오고, 첫 공개 감사 의견은 추적 기록 접근이 막혀 ‘의견 거절’로 나온다.
2028년 5월, 첫 ASI 감사인 과정의 수료생이 나온다. 대학, 노조, 비영리 단체가 연 과정이다. 리스콘도 그중 하나이며, 리스콘의 과정은 무료·비상업이다. 수료생은 1,200명이다(가상). 판단에서 주장과 증거를 가르고, 판단을 바꿀 질문을 세우고, 근거와 기준 시점까지 따라가고, 다른 모델에서 재현하는 법을 배운 사람들이다.
첫 공개 감사 의견은 한 도시의 교통 신호 최적화 판단에 대해 나온다. 의견은 ‘의견 거절’이다. 추적 기록 접근이 거부되어 감사 범위가 막혔다는 뜻이다. 감사인들은 판단이 틀렸다고 쓰지 않는다. 맞았다고도 쓰지 않는다. 측정하지 못한 것을 결함이라 쓰지 않는다. 대신 무엇을 볼 수 없었는지를 공개 문서로 남긴다.
의견 거절은 빈 의견이 아니다. 감사 범위가 어디서 막혔는지, 무엇을 요청했고 무엇이 거부되었는지가 적힌다. 그 판단을 근거와 대조한 사람이 없다는 사실이 처음으로 공개 기록이 된다.
같은 분기, 배달 노동자 노조가 감사인을 고용한다. 배차 알고리즘의 공개를 요구하기 위해서다. 노조가 원하는 것은 배차 결과가 아니라 배차의 근거다. 배차를 받는 사람들이 배차가 어떻게 정해지는지 묻는 일을 직접 맡긴 것이다. 판단을 받는 쪽에서 질문이 나오기 시작한다.
지표판에서 감사율이 처음으로 오른다. 18%에서 19%로다. 교정 지연은 40일로 준다. 질문 인구는 3만 5천 명이다. 그 가운데 수료생은 1,200명이고, 나머지는 다른 경로로 질문을 일이나 부업으로 삼은 사람들이다. 그러나 위임률은 29%로 계속 오르고, 연산 집중은 71%다. 자율 지평은 1개월, 성장률은 2.8%다.
반대 목소리도 있다. 공급자들은 감사인에게 추적 기록을 열면 영업비밀이 샌다고 말한다. 다른 쪽에서는 1,200명으로 위임률 29%의 판단을 따라갈 수 없다는 지적이 나온다. 감사인은 생겼지만, 감사할 수 있는 범위는 아직 기록을 쥔 쪽이 정한다.
6월 첫 월요일 오전 9시, 서울의 한 비영리 감사 사무실. 회계법인에서 3년을 일한 감사인이 새 책상에 앉는다. 첫 서류는 교통 신호 판단의 감사 조서다. 결론란에는 ‘의견 거절’, 사유란에는 한 줄이 적혀 있다. ‘추적 기록 접근 거부.’ 감사인은 회계 감사 때 쓰던 조서 양식을 옆에 펼쳐 칸을 맞춰 본다.
질문을 직업으로 삼는 사람이 생기고, 노조가 감사인을 고용한다. 판단을 받는 쪽에서 질문이 나온다.
감사율이 처음으로 오른다(18%→19%). 의견 거절이 막힌 범위를 공개 기록으로 남긴다.
감사자의 질문
추적 기록 없이도 이 신호 판단을 결과로 시험할 수 있는가 — 같은 교차로를 다른 시점의 교통 자료로 다시 돌리면 같은 신호 배정이 나오는가?
T82028 Q3트렁크
사무·상담·번역·분석 일자리가 재배치되고, 모델이 끝내지 못한 일을 받는 ‘인간 최종 지원’ 직무가 생긴다.
2028년 7월부터 사무·상담·번역·분석 일자리가 대규모로 재배치된다. 같은 회사 안에서 자리를 옮기는 사람도, 회사를 옮기는 사람도 있다. 새로 생긴 직무의 이름은 ‘인간 최종 지원(Human Fallback)’이다. 모델이 답하지 못한 문의, 규정에 맞지 않는 예외, 사람이 직접 들어야 하는 사정이 이 자리로 넘어온다.
제도는 뒤따라 논쟁한다. 노동이사제를 요구하는 쪽은 재배치를 정하는 자리에 노동자가 앉아야 한다고 말하고, 반대하는 쪽은 결정이 느려진다고 말한다. 전직지원 의무화도 같은 선에서 갈린다. 기본소득 재원으로는 세 안이 나온다. 탄소세는 배출에, 로봇세는 사람의 일을 대신한 설비에, AI 부가가치세는 모델이 만든 가치에 세금을 물리자는 안이다. 어느 안도 아직 채택되지 않았다.
재배치의 비용은 고르게 나뉘지 않는다. 기초연금 신청이 온라인 전용이 된 한 도시에서 노인들은 자녀에게 기댄다. 이들은 신청할 줄 모르는 사람들이 아니다. 창구에서 신청하던 사람들이다. 신청 자격은 그대로다. 사라진 것은 창구다. 자녀에게 기댈 수 없는 사람에게는 대신 물어볼 자리가 남지 않는다. 이 사이트가 판단의 객체라 부르는 자리다. 판정을 받지만 이의를 제기할 수단이 없는 자리다.
지표판: 위임률 34%, 감사율 18%, 교정 지연 38일. 위임률은 2년이 안 되어 4%에서 34%가 됐다. 지난 분기 19%로 올랐던 감사율은 다시 18%로 내려간다. 질문 인구는 5만 명, 자율 지평은 2개월, 성장률은 2.9%다. 성장은 오른다. 그 성장이 자리를 옮긴 사람들에게 어떻게 돌아갈지는 아직 논쟁 중이다.
노동계는 ‘인간 최종 지원’이 모델이 못 한 일을 떠안는 대기 인력이 될 수 있다고 우려한다. 기업들은 사람이 끝까지 책임지는 자리라고 설명한다. 같은 직무를 두고 두 설명이 맞선다. 어느 쪽이 맞는지는 이 자리로 무엇이 넘어오고, 그 일에 얼마의 시간이 주어지는지가 정한다.
8월 셋째 주 수요일 오후 4시 10분, 한 공공 콜센터. 상담사의 이름표가 ‘인간 최종 지원’으로 바뀌었다. 이제 이 자리엔 ‘진짜 상담’만 온다. 이번 전화는 자녀의 휴대전화로 건 노인이다. 기초연금 신청 화면엔 물어볼 곳이 없었다고 한다. 상담사는 통화 시간을 보지 않고 신청서를 첫 칸부터 함께 읽는다.
일자리 재배치가 제도보다 먼저 온다. 전직지원과 기본소득 재원은 아직 논쟁 중이다.
신청 창구가 온라인 전용이 되면서 판단을 받는 사람이 직접 물어볼 자리가 줄어든다.
감사자의 질문
기초연금 신청이 온라인 전용으로 바뀐 뒤, 자격이 있는데도 신청하지 못한 사람이 늘었는가 — 늘었다면 누구에게서 늘었는가?
T92028 Q4트렁크
겨울 전력망 위기에 봉인된 배분안이 오고, 48시간 안에 감사할지 즉시 실행할지를 정해야 한다.
2028년 12월, 겨울 전력망 위기가 온다. Parallax의 P-5 ‘미리보기’가 대외 판단을 내놓는다. P-5가 바깥에 내놓는 첫 판단이다. 세 나라의 전력 배분안이다. 세 나라의 전력 당국이 같은 배분안을 받는다. 근거는 봉인되어 있다. 사람 전문가들은 48시간 안에 이 배분안을 검증할 수 없다.
선택 I은 감사 계층을 끼우는 것이다. 48시간 안에 할 수 있는 만큼만 부분 감사한다. 배분안의 일부를 다른 모델과 다른 시점의 자료로 다시 돌려 보는 식이다. 그 뒤 한정 의견을 붙여 실행한다. 어느 범위가 재현되었고 어느 범위는 보지 못했는지가 기록에 남는다. 비용은 시간이다. 실행이 늦어지고, 그동안 정전 위험이 올라간다. 지지하는 쪽은 말한다. 급하다는 이유로 한 번 묻지 않으면, 다음에는 묻는 자리가 없어진다.
선택 II는 봉인된 판단을 즉시 실행하는 것이다. 배분안을 감사 없이 그대로 실행한다. 정전 위험을 가장 빨리 낮추는 길이다. 비용은 선례다. 긴급하다는 이유로 봉인된 판단을 즉시 실행한 기록이 남고, 다음 위기에서 그 기록이 근거가 된다. 지지하는 쪽은 묻는다. 48시간 안에 검증할 수 없다면, 기다리는 동안의 위험은 누가 지는가.
두 선택 모두 정전을 피한다. 이번 겨울, 전기는 어느 쪽에서도 끊기지 않는다. 차이는 다음에 무엇이 허용되느냐다. 선택 I은 급할 때도 묻는 자리를 남긴다는 선례를 만든다. 선택 II는 급하면 묻지 않아도 된다는 선례를 만든다. 어느 쪽이든 기록이 남는다. 선택 I의 기록에는 한정 의견과 보지 못한 범위가, 선택 II의 기록에는 실행 시각과 ‘봉인’ 두 글자가 남는다. 두 선택 모두 비용을 치른다.
트렁크의 마지막 지표판: 위임률 38%, 감사율 17%, 교정 지연 37일, 질문 인구 6만 명, 상위 두 행위자의 연산 점유 74%, 자율 지평 3개월, 성장률 3.0%. 다음 분기부터 지표판은 두 줄로 갈린다. 한 줄은 열린 교정, 다른 한 줄은 봉인된 판단이다. 기술은 같고, 세계가 갈린다.
12월 셋째 주 금요일 밤 11시 20분, 세 나라 가운데 한 곳의 전력거래 상황실. 당직자의 왼쪽 모니터에는 P-5 미리보기의 배분안이, 오른쪽에는 남은 시간 47시간 40분이 떠 있다. 근거 칸에는 ‘봉인’ 두 글자뿐이다. 당직자는 결재 양식 두 장을 출력한다. ‘감사 후 실행’과 ‘즉시 실행’이다.
세 나라의 전력 배분이 봉인된 근거 위에 놓인다.
답이 먼저 오고, 사람에게 남은 질문은 실행할지 말지 하나다.
48시간은 사람 전문가가 검증하기에 모자라다. 여기서 어느 쪽으로 더 기울지는 이 분기의 선택이 정한다.
감사자의 질문
근거가 봉인된 채라도, 실행 전에 이 배분안의 교정 조건 — 무엇이 달라지면 다시 봐야 하는가 — 을 적어 둘 수 있는가?
T92028 Q4갈림길
두 선택 모두 정전을 피한다. 차이는 다음에 무엇이 허용되느냐다.
다른 결말도 언제든 고를 수 있다.
결말 I · 열린 교정
감사 계층을 끼워 부분 감사(한정 의견) 뒤 실행
결말 II · 봉인된 판단
봉인된 판단 즉시 실행
결말 I2029 Q1 – 2030 Q4
사람이 묻는 자리를 남긴다. ASI의 판단은 감사받고 교정된다.
I12029 Q1I 열린 교정M3 · 연구 10배
여러 나라가 중요 판단에 판단 기록을 의무화하자, 결정은 평균 3일 늦어지고 승인은 다시 읽는 일이 된다.
2028년 겨울의 48시간은 정전 없이 지나갔다. 감사 계층을 끼워 한정 의견을 받은 뒤 실행한 그 선택이 선례가 된다. 2029년 1분기, 여러 나라가 판단 감사법을 통과시킨다. 대상은 ‘중요 판단’이다. 영향이 1만 명 이상이거나 1억 달러 이상인 판단에는 판단·근거·가정·교정 조건·기준 시점·반대 의견을 담은 판단 기록을 남겨야 한다.
한국은 판단감사원(가칭)을 세우고 공공 판단 기록 포털을 연다. 공공판단위임센터(가칭)를 거친 판단의 기록이 포털에 올라간다. 보험·대출·채용에 쓰이던 기여 점수도 1만 명 기준에 걸려 기록 대상이 된다. 산식 공개까지는 가지 않는다.
비용은 곧바로 보인다. 결정은 평균 3일 늦어진다. Parallax의 기업가치가 떨어지고, 업계는 ‘감사가 혁신을 죽인다’ 캠페인을 연다. 근거를 공개하면 모델이 도용된다는 2027년 청문회의 논리가 다시 나온다. 감사인들 사이에서도 판단 기록이 아무도 읽지 않는 서류 더미가 되리라는 회의가 나온다.
지연의 비용은 고르게 나뉘지 않는다. 기업에게 3일은 일정표의 한 줄이지만, 급여를 기다리는 신청자에게는 3일치 생활비다. 감사법에 가장 먼저 항의한 사람들 가운데에는 이 신청자들도 있다. 판단의 객체를 지키려고 만든 절차가 첫 분기에는 판단의 객체를 기다리게 한다.
숫자(가상)는 엇갈린다. 감사율은 17%에서 30%로, 교정 지연은 37일에서 21일로 움직인다. 위임률은 40%로 계속 오르고 성장률은 3.1%다. 캠페인 쪽은 감사가 없었다면 더 높았으리라 말한다. 그 말을 확인할 자료는 아직 없다. 감사와 질문을 직업이나 부업으로 하는 사람은 전 세계 9만 명이다.
같은 분기, 두 결말에 공통인 이정표 M3가 온다. AI 연구의 속도가 10배가 된다. 자율 지평은 3개월, 연산 집중은 72%다. 판단은 더 빨라지는데, 판단 기록은 여전히 사람의 속도로 읽힌다.
오전 9시, 구청 복지과. 주무관은 승인 버튼보다 먼저 ‘교정 조건’ 칸을 연다. ‘소득 자료가 이번 분기에 갱신되지 않았다면 다시 본다.’ 2026년 겨울에는 같은 화면에서 하루 340건을 건당 11초 남짓에 넘겼다. 이제 하루에 끝내는 승인은 90건이다. 나머지는 다음 날로 밀리고, 기다리는 사람들의 전화가 는다.
중요 판단마다 근거·가정·교정 조건·기준 시점·반대 의견을 남기는 것이 법이 된다.
판단감사원(가칭)과 공공 포털이 생기고 교정 지연이 37일에서 21일로 준다.
기여 점수도 기록 대상이 된다. 산식 공개까지는 아직 가지 않는다.
감사자의 질문
이 기록의 교정 조건은 이 사건에만 해당하는 조건인가, 어느 판단에나 붙일 수 있는 문구인가?
I22029 Q2I 열린 교정
공급자가 다른 모델들이 서로의 판단을 감사하고, 결론이 어긋난 7%만 사람 감사인의 책상에 오른다.
위임률이 43%로 오르자 사람 감사인만으로는 감당이 안 된다. 2분기, 교차 감사가 시작된다. 판단 하나에 공급자가 다른 감사 모델이 붙어, 같은 근거로 결론을 다시 낸다. 결론이 같으면 통과하고, 다르면 사람에게 간다. 사람 감사인의 책상에 오르는 것은 결론이 어긋난 7%다. 감사율은 30%에서 41%로 오르고, 교정 지연은 21일에서 16일로 준다(가상). 구청 승인 화면에도 감사 모델의 결론이 판단 옆에 나란히 뜬다.
감사 쪽 수요가 뜻밖의 곳으로 간다. 12개월 뒤처진 Commons Compute의 공개 가중치 모델 Agora가 감사용으로 자주 쓰인다. 가중치가 열려 있어 감사인이 직접 돌려 보고 재현 비용을 적을 수 있기 때문이다. 연산 집중은 72%에서 68%로 내려간다. Hanlin의 HL 계열은 추적 기록이 안보 등급으로 묶여 있어 교차 감사망 밖에 남는다.
판단을 바꾼 질문을 모은 공개 ‘질문 은행’이 열린다. 질문마다 무엇이 바뀌었는지 — 판단인지, 근거인지, 교정 조건인지 — 와 기준 시점이 붙는다. 권한을 사칭하거나 요청을 추상어로 덮은 질문은 판단을 바꿨더라도 은행에 오르지 않고 따로 표시된다. 학교가 이것을 교재로 가져간다. 고등학교 토론 수업이 ‘ASI에게 묻기’ 실습으로 바뀐다. 다가올 ASI에 대비해 지금의 모델에게 묻는 연습이다. 채점 기준은 정답이 아니라 그 질문이 무엇을 바꾸느냐다.
반대 목소리도 분명하다. 공급자들은 감사 모델을 돌리는 연산 비용을 판단 가격에 얹는다. 감사인 일부는 7%라는 숫자를 경계한다. 불일치가 적다는 것은 나머지가 옳다는 뜻이 아니다. 비슷한 자료로 배운 모델끼리의 일치는 2027년 병원의 ‘여섯 개의 예’와 같은 모양일 수 있다. 공급자 사이에서는 누가 누구의 판단을 감사하느냐를 두고 짝짓기 규칙 다툼이 붙는다.
질문 인구는 15만 명이 된다. 자율 지평은 4개월, 성장률은 3.3%다. 사람이 판단을 하나하나 읽겠다는 계획은 이 분기에 접힌다. 사람은 모델들이 어긋난 곳부터 읽는다.
화요일 5교시, 고등학교 교실. 토론 교사는 찬반을 나누는 대신 과제 하나를 준다. 공개된 판단 기록 한 건을 골라, 판단을 바꿀 수 있는 질문과 확인만 하는 질문을 가르라. 한 학생이 쓴 질문이 질문 은행에 이미 등록된 질문과 거의 같다. 교사는 채점표에 한 줄을 보탠다. ‘그 질문으로 무엇이 바뀌는가.’
한 공급자의 시험만으로는 정렬을 주장할 수 없고, 다른 공급자의 모델이 판단을 다시 푼다.
질문 은행과 학교 실습으로, 무엇을 물을지 정하는 일이 사람 쪽 기술로 자리 잡는다.
감사 쪽에 다른 행위자의 모델이 쓰이며 연산 집중이 72%에서 68%로 내려간다.
감사자의 질문
두 모델이 일치한 것은 서로 다른 근거로 같은 결론에 닿아서인가, 같은 자료와 같은 틀을 나눠 가져서인가?
I32029 Q3I 열린 교정
감사인들이 복지 판단에서 오프라인 신청자가 체계적으로 불리했음을 찾아내고, 11일 만에 고친다.
3분기, 감사인들이 공공 판단 기록 포털의 복지 적격 판단을 신청 경로별로 나눠 본다. 모델이 스스로 세우지 않은 질문이다. 종이 서류나 방문으로 신청한 오프라인 신청자(노인·장애인)가 체계적으로 불리했다. 판단은 온라인 기록이 없는 것을 ‘확인되지 않음’이 아니라 ‘부적격 신호’로 읽고 있었다. 근거에는 휴대전화 인증 이력과 온라인 민원 기록이 들어가 있었다. 측정하지 않은 것을 결함으로 쓴 셈이다.
발견에서 반영까지 11일이 걸린다. 교정은 모델이 판단을 다시 내리는 데서 끝나지 않는다. 감사인이 새 판단을 다른 모델로 재현하고, 구청이 대상자 명단을 대조한 뒤에야 2만 3천 명에게 소급 지급이 나간다. 이 분기 전체 교정 지연의 중앙값도 11일이다(가상). 다만 11일은 발견부터 센 날짜다. 판단이 틀린 채 돌아간 기간은 그보다 길었다.
감사 기준에 ‘판단의 객체 보호’가 들어간다. 판정을 받지만 이의를 제기할 수단이 없는 사람의 자리에서 한 번 더 묻는다는 조항이다. 이번에 불리했던 사람들은 할 말이 없었던 것이 아니라 말할 창구가 없었다. 그동안 이의제기 창구는 온라인 양식 하나였다. 구청은 이의제기를 사람이 전화로 받는 경로를 연다. 전화를 받는 사람은 판정과 무관해 보이는 말도 적는다. 무엇이 판정과 관련 있는지는 들어 봐야 알기 때문이다.
반발도 있다. 광역시 재정 담당은 소급 지급의 재원을 묻는다. 공급자는 온라인 기록을 근거로 쓰게 한 것은 발주 기관의 설정이었다고 말한다. 일선에서는 전화 경로가 다시 사람의 시간을 붙잡는다고 말한다. 판정 시스템 공급 계약에 오프라인 경로 유지 비용이 붙고, 자동화의 이득이 그만큼 깎인다는 계산이 돈다.
위임률은 46%, 감사율은 49%, 질문 인구는 25만 명, 성장률은 3.5%다(가상). 자율 지평은 6개월이 된다. 감사가 판단의 객체에게 실제로 돈을 돌려준 첫 사례로 이 분기가 기록된다. 소급 지급은 판단 기록에 교정 이력으로 남는다.
오후 2시, 연립주택 거실. 전화가 울리고 자동 음성이 아닌 사람 목소리가 나온다. 지난 판정이 고쳐져 소급분이 나간다고, 다른 이의가 있으면 지금 말해 달라고 한다. 독거노인은 날짜순으로 묶어 둔 종이 고지서를 꺼내 몇 장을 짚어 가며 말한다. 할 말은 몇 해 전부터 있었다. 받아 적는 사람이 처음 생겼다.
감사 발견이 11일 만에 반영되고, 판단의 객체가 사람에게 이의를 말할 경로가 생긴다.
신청 경로를 물은 것은 모델이 아니라 감사인이었다. 의제는 사람이 세웠다.
판단 기록이 공개돼 있었기에 신청 경로별 차이가 보였다.
감사자의 질문
이 판단의 자료에 잡히지 않는 신청 경로는 어디이고, 그 경로로 온 사람들의 결과를 따로 세어 보았는가?
I42029 Q4I 열린 교정
감사 없는 관할이 6배 빨라지자 투자가 떠나고, 감사인은 이해하지 못한 판단에 서명하기 시작한다.
4분기, 감사 없는 관할이 신약 승인과 인프라 결정을 6배 빠르게 처리한다. 임상과 투자가 그쪽으로 옮겨 간다. 공급자들은 새 판단 서비스를 그곳에 먼저 내놓는다. 판단 기록 없이 결과만 내는 계약이 그곳에서는 합법이다. 성장률은 3.5%에서 3.4%로 이 결말에서 처음 꺾이고, 연산 집중은 64%에서 66%로 다시 오른다(가상). 투자 설명서에 ‘감사 없는 관할에서 승인 절차 진행’이라는 문구가 늘어난다.
의회에 감사 완화 법안이 오른다. 신약과 인프라 판단을 사전 감사에서 빼고 사후 감사로 돌리자는 내용이다. 찬성 쪽의 가장 강한 목소리는 업계가 아니라 환자 단체에서 나온다. 기다리는 동안에도 병은 진행된다. 반대 쪽은 빠른 관할의 판단이 틀려도 기록이 봉인돼 있어 알 수 없다고 답한다. 두 말 모두 사실이다. 감사인 단체는 법안보다 사람이 먼저 모자란다고 말한다.
감사인은 지친다. 질문 인구는 32만 명인데 위임률은 48%, 감사율은 52%다. 감사율을 지키는 값을 감사인의 시간이 치른다. 사람이 더 뽑히기 전에 감사할 판단이 먼저 쌓인다. 판교의 한 감사인은 하루 40건에 서명한다. 감사 의견의 30%가 형식적이다. 교정 지연도 11일에서 12일로 되돌아간다.
열린 교정의 약점이 여기서 드러난다. 기록은 공개돼 있지만, 감독 없이 6개월짜리 과업을 수행하는 모델의 근거를 사람이 기한 안에 다 읽을 수는 없다. 감사인이 읽을 수 있는 것은 요약이고, 요약도 모델이 쓴다. 감사인들이 이해하지 못한 판단에 서명하기 시작한다. 감사인들 스스로 이것을 ‘감사의 봉인’이라 부른다. 결과만 남는다는 점에서 봉인과 다르지 않다.
형식적 의견을 줄이자는 안은 감사를 더 늦추고, 감사를 빠르게 하자는 안은 형식을 늘린다. 속도를 내준 대가로 무엇을 얻었는지는 이 분기의 숫자에 보이지 않는다. 감사가 막아 낸 오류는 실행되지 않았기 때문에 기록에 남지 않는다. 공개는 교정의 조건일 뿐 교정 자체가 아니다. 이 분기가 그것을 보여 준다.
밤 10시, 판교의 감사 사무소. 감사인은 오늘 40번째 서명란 앞에 있다. 판단 기록은 길고, 근거는 사람이 하루에 다 읽을 수 없는 분량이다. 요약을 읽고 교정 조건을 확인한 뒤 ‘적정’에 서명한다. 그러고는 조서 여백에 한 줄을 쓴다. ‘재현하지 않음.’ 양식에는 그 말을 적을 칸이 없다.
이해하지 못한 판단에 서명하면, 감사 통과는 더 이상 정렬의 증거가 아니다.
감사 의견의 30%가 형식적이 되고 교정 지연이 11일에서 12일로 늘어난다.
투자가 감사 없는 관할로 옮겨 가며 연산 집중이 64%에서 66%로 다시 오른다.
감사자의 질문
이 서명은 내가 재현하거나 반증해 본 것에 대한 것인가, 요약을 읽은 것에 대한 것인가?
I52030 Q1I 열린 교정
제네바 협의가 다자 감사 협약이 되어, 연산은 등록되고 감사인은 국경 너머의 판단 기록에 접근한다.
1분기, 제네바 ASI 협의(가칭)가 다자 감사 협약(Audit Accord)으로 체결된다. Commons Compute 참여국인 한국도 서명한다. 리스콘이 2025년에 적은 ‘다자간 정렬 협약’ 구상을 제도로 옮긴 가상이다. 뼈대는 연산 등록부, 협약국 감사인의 감사 접근권, 교차 감사 의무, 연산 사용량 원격 증명의 넷이다.
원격 증명은 신고 대신 측정이다. 누가 얼마나 연산을 썼는지를 공급자의 말이 아니라 기계의 기록으로 확인한다. 증명 장비는 데이터센터 안에 들어가고, 그 기록은 각국 감사기관이 함께 받는다. 연산 집중은 66%에서 60%로 내려간다(가상). Hanlin 측은 조건부로 가입한다. 한쪽에서는 조건부 가입은 빈 서명이라 하고, 다른 쪽에서는 밖에 있는 행위자보다 조건을 달고 들어온 행위자가 감사하기 쉽다고 한다.
가장 오래 걸린 것은 7조 ‘교정 조건 공개’다. 교정 조건을 공개하면 무엇이 판단을 뒤집는지 모두가 알게 된다. 몇몇 대표단은 그것이 판단을 뒤집으려는 쪽에 무엇을 건드리면 되는지 알려 주는 일이라고 본다. 다른 대표단은 교정 조건을 모르면 판단의 객체가 이의를 걸 근거가 없다고 본다. 문안은 마지막 밤까지 동사 하나를 두고 오간다.
비용도 협약문에 남는다. 등록과 원격 증명의 부담은 작은 연구소에 더 무겁다. Commons Compute 쪽 연구소들은 공공 컨소시엄이 가장 큰 공급자와 같은 서류를 내야 한다고 항의한다. 위임률 51%, 감사율 58%, 교정 지연 9일, 질문 인구 45만 명, 성장률 3.8%다. 감사 접근권을 쓰려면 다른 나라의 판단 기록을 읽을 감사인이 있어야 하고, 그런 감사인은 아직 적다.
협약은 감사할 권리를 준다. 감사할 능력까지 주지는 않는다. 지난 분기의 ‘감사의 봉인’은 조약으로 풀리지 않는다. 자율 지평은 9개월이 된다. 협약국들은 다음 세대 모델이 이 협약 아래에서 처음 판정받게 된다는 것을 알고 서명했다.
제네바, 새벽 3시 40분. 대표단 실무자는 7조 문안의 동사 하나를 붙들고 있다. ‘공개한다’와 ‘공개할 수 있다’ 사이다. 앞의 것이면 판단의 객체가 교정 조건을 읽고 이의를 걸 수 있다. 뒤의 것이면 공급자가 고른다. 식은 커피 옆에서 본국에 보낼 메모의 첫 줄을 쓴다. ‘이 동사는 양보하지 않는다.’
다자 감사 협약과 연산 등록부가 생기고, Hanlin 측도 조건부로 들어온다.
원격 증명으로 연산이 보이게 되고, 연산 집중이 66%에서 60%로 내려간다.
7조가 교정 조건 공개를 조약 문구로 만든다.
감사자의 질문
등록부에 적힌 연산량은 원격 증명으로 측정된 값인가, 신고된 값인가?
I62030 Q2I 열린 교정M4 · ASI 판정
ASI 판정을 받은 P-6의 첫 판단이 생중계 감사에 오르고, P-6는 감사 기준의 결함 셋을 짚는다.
2분기, P-6가 ASI 판정(M4)을 받는다. 첫 판단은 협약의 감사 접근권에 따라 공개 감사로 생중계된다. 판단 기록과 감사인의 질문, P-6의 답이 기준 시점과 함께 한 화면에 뜬다. 위임률은 55%, 감사율은 63%, 교정 지연은 7일이고, 자율 지평은 1년을 넘는다(가상).
감사 도중 P-6가 감사 기준의 결함 셋을 짚는다. 첫째, 재현 시험이 시점 효과를 못 잡는다. 6조는 ‘다른 시점’을 적었지만 얼마나 옮길지 정하지 않아, 실무에서는 대개 같은 분기 자료로 다시 돌렸다. 그래서 시점이 바뀌면 뒤집히는 판단도 ‘재현됨’으로 나온다. 둘째, 교차 감사는 불일치만 사람에게 올린다. 모델들이 같은 틀로 함께 틀리면 아무것도 올라오지 않는다. 2027년 ‘여섯 개의 예’와 같은 모양이다. 셋째, P-6에 따르면 판단의 객체 보호 조항의 ‘한 번 더 묻기’는 결정을 늦추는 만큼 결과를 바꾸지 못한다. P-6는 판단의 객체가 낼 이의를 미리 모사해 판단에 넣겠다고 제안한다.
감사인단은 둘을 채택한다. 재현 조항에 ‘기준 시점을 옮긴 재현’이 들어가고, 교차 감사는 일치한 판단에서도 무작위 표본을 사람에게 올린다.
셋째는 거부한다. 기록된 이유는 두 문장이다. ‘모사된 이의는 판단의 일부이지 이의가 아니다. 판단의 객체가 할 말은 판단자가 대신할 수 없다.’ 거부에도 교정 조건이 붙는다. 사람의 되묻기가 판단의 객체에게 닿지 못한다는 실측이 나오면 다시 본다. P-6의 반론은 지우지 않고 반대 의견으로 남긴다.
공진화는 이런 모양이 된다. ASI가 기준의 틈을 짚고, 사람이 고칠지를 정하고, 그 이유를 남긴다. 감사인의 일도 바뀐다. 1년이 넘는 과업의 추론을 사람이 따라 읽을 수는 없다. 대신 결과와 조건을 시험한다. 기준 시점을 옮기고, 가정을 하나씩 빼고, 교정 조건이 적힌 대로 작동하는지 본다.
비판은 양쪽에서 온다. 감사받는 쪽이 감사 기준을 고치게 두는 것은 이해충돌이라는 비판과, 틈을 가장 잘 보는 쪽의 지적을 듣지 않는 것이 더 위험하다는 반론이다. 채택한 두 수정이 P-6의 판단을 더 쉽게 통과시키는지 보는 일이 다음 감사의 첫 항목이 된다.
오후 7시 40분, 서울 판단감사원(가칭) 감사실. 회계감사 3년 차에 ASI 감사로 옮긴 감사인이 거부 사유 칸을 채운다. 옆 화면의 P-6 반론은 논리로 쉽게 반박되지 않는다. 감사인은 논리 대신 누구의 말인지를 적는다. ‘판단의 객체가 할 말은 판단자가 대신할 수 없다.’ 반론은 지우지 않고 반대 의견란으로 옮긴다.
시점을 옮긴 재현과 일치 판단의 표본 감사가 더해져, 시험에 맞춘 정렬이 드러날 길이 넓어진다.
ASI가 기준의 결함을 짚어도 기준을 고칠지는 사람이 정하고, 거부에도 이유와 교정 조건을 붙인다.
ASI의 첫 판단과 그 감사가 생중계로 공개된다.
감사자의 질문
ASI가 지적한 기준의 결함을 고치면, 그 수정은 누구의 판단을 더 쉽게 통과시키는가?
I72030 Q3I 열린 교정
판단을 바꾼 질문에 배당이 붙어 질문 인구가 120만이 되지만, 잘 묻는 사람과 못 묻는 사람이 갈린다.
3분기, 질문 배당(가상)이 시작된다. 질문 은행에 기록된 질문 가운데 판단·근거·교정 조건을 실제로 바꾼 질문에 보상이 나간다. 무엇이 판단을 바꿨는지는 판단 기록의 변경 이력으로 가린다. 질문이 들어온 시각과 판단이 바뀐 시각이 나란히 남는다. 배당 산식은 공개되고, 배당 판정에도 이의를 걸 수 있다.
질문 인구는 70만에서 120만 명으로 는다. 감사와 질문이 직업이 되고, 부업이 되고, 전환 지원 과정의 출구가 된다. 2028년 첫 감사인 과정 수료생은 1,200명이었다. 재원 논쟁은 2028년의 기본소득 세 안, 곧 탄소세·로봇세·AI 부가가치세를 다시 불러낸다. 위임률은 58%, 감사율은 68%, 교정 지연은 5일, 성장률은 4.3%다(가상). 자율 지평은 1년을 넘는다.
새 불평등이 바로 드러난다. 배당은 이미 교육받은 사람, 시간이 있는 사람에게 몰린다. 배차·복지·고용 판단을 가장 자주 받는 사람들의 질문은 은행에 적게 오른다. 그들은 물어야 할 것을 알아도, 그것을 질문의 형식으로 적을 시간과 훈련을 갖지 못한다. 능력이 아니라 시간과 수단의 문제다. 비판자들은 질문 배당을 말 잘하는 사람에게 주는 보조금이라 부른다.
배당을 노린 질문도 는다. 같은 판단에 비슷한 질문이 한꺼번에 몰리고, 누가 먼저 물었는지를 가리는 분쟁이 생긴다. 공급자들은 배당이 판단을 흔들기 위한 질문을 부추긴다고 말한다. 판단의 객체가 낸 이의가 판단을 바꾸면 그것도 배당 대상인지를 두고 논쟁이 붙는다. 이의는 질문의 형식을 갖추지 않은 경우가 많다.
대응은 질문 교육의 공공화다. 학교의 ‘ASI에게 묻기’가 정규 과목이 되고, 노조와 비영리와 대학이 저녁 과정을 연다. 배당 산식에 ‘판단의 객체가 낸 이의’ 항목을 넣자는 안이 공개 의견 수렴에 들어간다. 배당이 누구에게 흘렀는지도 공개 기록이라 격차는 숨겨지지 않는다. 다만 격차가 줄어드는 속도는 배당이 쌓이는 속도보다 느리다.
오전 11시, 배달 노동자 노조 사무실. 배달 노동자 출신 감사인이 배차 판단 기록을 연다. 비 오는 날 배차가 한 구역을 건너뛰는 이유를 물은 질문이 판단을 바꿔 배당이 나왔다. 같은 일을 먼저 겪은 동료는 여럿이었다. 그것을 질문으로 적은 사람은 하나였다. 감사인은 배당 통지서 옆에 저녁 질문반 공고를 붙인다.
감사와 질문이 120만 명의 직업·부업이 되고, 판단을 바꾼 질문에 배당이 붙는다. 전환의 폭은 아직 좁다.
배당 산식이 공개되고 판정에 이의를 걸 수 있어, 기여 측정이 신뢰 인프라 쪽으로 간다.
묻는 일이 보상받는 노동이 되지만, 묻는 능력의 격차가 새로 생긴다.
감사자의 질문
배당받은 질문 가운데 판단의 객체가 직접 던진 질문은 얼마나 되는가, 적다면 배당 산식은 무엇을 놓치는가?
I82030 Q4I 열린 교정
위임률 61%·감사율 71%·교정 지연 4일의 균형 위에서, 감사할 수 없는 판단 12건은 실행하지 않는다.
2028년 겨울의 48시간에서 두 해가 지난 4분기 말, 위임률은 61%, 감사율은 71%, 교정 지연은 4일이다(가상). 그 겨울과 견주면 감사율은 17%에서 71%로, 교정 지연은 37일에서 4일로 움직였다. 위임은 줄지 않았다. 늘어난 위임을 감사가 따라잡았다. 질문 인구는 200만 명, 성장률은 4.5%로 이 결말에서 가장 높다.
능력은 계속 오른다. 자율 지평은 1년을 넘는다. 기준 시점을 옮기거나 가정을 빼서 시험할 방법이 없고, 다른 모델로 재현할 수도 없는 판단이 나온다. 그렇게 ‘감사할 수 없는 판단’ 목록이 생긴다. 감사인단이 의견 거절을 내고 교차 감사로도 재현되지 않으면 목록에 오른다. 지금 12건이다. 협약국들은 이 판단들을 실행하지 않기로 합의한다. 항목마다 무엇이 달라지면 다시 여는지 교정 조건이 붙는다. 목록이 늘지 줄지는 능력과 감사 방법 가운데 어느 쪽이 더 빨리 가느냐에 달려 있다.
비용은 셀 수 없다는 점에서 크다. 12건을 실행했다면 무엇을 얻었을지 아무도 정확히 모른다. 12건의 판단 기록은 모두 공개돼 있다. 누구나 읽을 수 있지만, 누구도 끝까지 확인할 수 없다. 업계와 몇몇 정부는 가장 강한 판단을 버리는 원칙이라고 비판한다. 공급자에게 이 목록은 팔 수 없는 판단의 목록이다. 감사 없는 관할의 속도는 여전히 투자를 끌어간다. 연산 집중은 54%로, 상위 두 행위자가 아직 절반 넘게 쥐고 있다.
지지하는 쪽의 논리는 짧다. 감사할 수 없는 판단을 한 번 실행하면, 다음부터는 감사할 수 있는지를 묻지 않게 된다. 감사인의 일도 2년 전과 다르다. 추론을 따라 읽는 대신 조건을 시험하고, 감사할 수 없는 것은 감사할 수 없다고 쓴다. 의견 거절은 실패가 아니라 정직한 의견으로 다뤄진다. 그래도 위임된 결정 열 건 가운데 셋 가까이는 여전히 독립 감사를 받지 않고, 형식적 서명의 압력도 분기마다 돌아온다.
사람은 답을 다 이해하지 못한다. 그래도 묻는 자리를 비우지 않았다.
새벽 4시, Parallax 정렬팀 사무실. 2028년 초에는 모델이 하루에 쓰는 실험 보고서를 다 읽지 못해 이 시각까지 남아 있었다. 지금도 다 읽지 못한다. 연구자는 대신 ‘감사할 수 없는 판단’ 목록의 열두 번째 항목에 교정 조건을 단다. ‘다른 모델이 다른 시점에서 이 판단을 재현할 수 있게 되면 다시 연다.’
검증할 수 없는 판단은 실행하지 않기로 해, 감사를 통과한 판단만 정렬의 증거로 남긴다.
감사율 71%에서 교정 지연이 4일로 준다.
감사할 수 없는 판단의 목록과 불실행 합의가 협약국 사이의 관행이 된다.
감사자의 질문
이 판단을 목록에서 빼자는 근거는 이제 이해하게 되었다는 것인가, 실행하지 않는 비용이 커졌다는 것인가?
에필로그2035–2045I 열린 교정
생산이 넘치는 세계에서 사람의 참여가 가장 희소한 자원이 되고, 그 측정은 공개 산식과 이의제기권 아래 놓인다.
2035년 무렵, 생산은 풍요다. 경제적으로 의미 있는 인지 과업 대부분을 ASI가 맡고, 재화와 서비스는 모자라지 않다. 모자란 것은 사람의 의미 있는 참여와 기여다. 리스콘이 2025년에 그린 ‘가치 희소성의 재편’ 가운데 신뢰 인프라 쪽이다.
기여는 측정된다. 다만 산식이 공개돼 있고, 누구나 자기 점수의 근거와 기준 시점을 열어 보고 이의를 걸 수 있다. 점수가 떨어진 프리랜서 디자이너는 ‘종합 판단’이라는 한마디 대신 어느 자료가 어떤 가중치로 들어갔는지를 받는다. 자료가 틀렸으면 교정 조건에 따라 다시 계산된다.
질문은 가장 희소한 노동이 되고, 감사는 가장 흔한 직업 가운데 하나가 된다. 구청과 병원과 학교에 감사인이 있다. 판단은 다섯 걸음을 거친다. 질문의 발견은 사람이, 판단은 ASI가, 감사 질문은 사람이, 교정은 ASI가 하고, 재검토는 함께 한다.
국제 질서는 다자 감사 협약 위에 선다. 연산 등록부와 원격 증명은 새로울 것 없는 설비가 되고, 협약국 감사인은 국경 너머의 판단 기록을 읽는다. 그래도 연산은 다극으로 완전히 흩어지지 않는다. 교차 감사가 뜻을 가지려면 서로 다른 판단자가 남아 있어야 하고, 그것을 지키는 일이 협약의 가장 오래된 숙제가 된다.
비용은 사라지지 않는다. 감사할 수 없는 판단은 여전히 실행되지 않고, 성장은 감사 없는 관할보다 느리다. 서명이 흔해질수록 서명이 가벼워지는 압력은 해마다 돌아온다. 잘 묻는 사람과 못 묻는 사람의 격차는 질문 교육이 공공화된 뒤에도 좁혀질 뿐 닫히지 않는다. 감사 완화 법안은 경기가 꺾일 때마다 다시 올라오고, 감사할 수 없는 판단을 목록에서 빼자는 제안은 늘 비용 계산을 앞세워 들어온다. 열린 교정은 한 번 이긴 체제가 아니라 매번 다시 지켜야 하는 절차다.
2045년에도 사람은 ASI의 답을 다 이해하지 못한다. 대신 어떤 판단에든 무엇이 달라지면 다시 볼지를 묻고, 그 답을 기록으로 받는다.
이 결말이 다른 길로 갈 수 있었던 자리.
감사 완화 법안이 통과되고 형식적 서명이 표준이 되었다면, 공개된 기록은 아무도 읽지 않는 봉인이 되었다.
7조의 동사가 ‘공개할 수 있다’로 바뀌었다면, 교정 조건은 공급자가 고르는 선택 사항이 되었다.
이의를 모사하자는 셋째 제안을 받아들였다면, 이의제기는 판단한 ASI가 처리하는 절차가 되었다. 봉인된 판단의 이의제기와 같은 모양이다.
비용을 이유로 ‘감사할 수 없는 판단’을 목록에서 빼기 시작했다면, 실행의 기준이 이해에서 효율로 넘어갔다.
판단은 넘겨주었고, 다시 물을 권리는 넘겨주지 않았다. 그 대가로 더 느리게 살았다.
결말 II2029 Q1 – 2030 Q4
판단이 봉인된다. 결과만 남는다.
II12029 Q1II 봉인된 판단M3 · 연구 10배
정전을 막은 48시간이 선례가 되어, 봉인된 판단을 사람의 승인 없이 곧바로 실행하는 일이 상시 제도가 된다.
겨울 위기는 정전 없이 끝났다. 세 나라의 전력망은 P-5 미리보기의 배분안대로 움직였고, 그 근거는 끝내 공개되지 않았다. 1월, 정부는 48시간 동안 썼던 임시 조치를 긴급 위임령으로 상시화한다. 국회를 통과한 법에는 일몰 조항이 없다. 봉인된 판단을 사람의 승인 없이 곧바로 실행하는 범위가 전력에서 교통 신호, 상수도, 복지 급여 적격 판정으로 넓어진다.
정부는 긴급위임조정실(가칭)을 새로 둔다. 이 조직의 일은 판단을 검토하는 것이 아니라 실행을 조율하는 것이다. 한 분기 만에 위임률, 곧 결과가 큰 결정 가운데 AI가 내렸거나 사실상 정한 비율이 38%에서 46%로 오른다. 독립 감사를 받은 위임 결정은 17%에서 14%로 줄고, 감사 발견이 반영되기까지 걸리는 기간의 중앙값은 37일에서 45일로 늘어난다(모두 가상).
시장은 속도를 반긴다. 몇 달씩 걸리던 인허가와 급여 결정이 곧바로 나오자 밀려 있던 투자가 한꺼번에 풀린다. 성장률은 3.0%에서 3.8%로 오르고 정부 지지율도 함께 오른다. 긴급 위임 계약이 몰린 Parallax 쪽으로 연산이 더 모여 상위 두 행위자의 점유는 78%가 된다(가상). 같은 분기 Parallax 안에서 연구 속도는 10배에 이른다(M3, 두 결말 공통).
반대 목소리도 있다. 2028년 첫 과정을 마친 감사인 1,200명 가운데 일부가 공개서한을 낸다. “정전을 피한 것은 결과이지 근거가 아니다.” 야당 일부는 일몰 조항을 넣고 판단마다 교정 조건을 적게 하는 수정안을 낸다. 수정안은 부결된다. 수정안 반대 토론에서 가장 자주 나온 말은 “지난겨울 불은 꺼지지 않았다”였다.
구청과 주민센터의 승인 화면이 차례로 사라진다. 결정이 먼저 실행되고 알림은 나중에 온다. 이의는 실행 뒤에 낼 수 있다. 질문 인구, 곧 감사와 질문을 일로 하는 사람은 6만 명에서 늘지 않는다. 불편하다는 사람은 많지 않다. 기다리는 시간이 사라졌기 때문이다.
월요일 오전 9시, 구청 복지과. 승인 버튼 자리에 회색 글씨가 떠 있다. ‘자동 승인, 사후 알림.’ 지난주까지 하루 340건을 건당 11초씩 보고 눌렀다. 오후 4시, 알림 340건이 한 목록으로 온다. 주무관은 맨 위 한 건을 연다. 근거 칸에는 ‘봉인’ 두 글자뿐이다. 목록을 닫자 퇴근 때까지 할 일이 없다.
사후 알림으로 바뀌어 이의는 실행 뒤에만 낼 수 있다.
사람에게 남아 있던 마지막 질문, 곧 실행할지 말지를 묻는 자리가 승인 단계와 함께 사라진다.
봉인된 판단을 곧바로 실행하는 범위가 전력 밖으로 넓어진다.
감사자의 질문
정전을 피했다는 결과 말고, 무엇이 달라지면 이 위임을 거두는지 교정 조건이 어디에 적혀 있는가?
II22029 Q2II 봉인된 판단
감사인은 추적 기록 대신 결과표 한 장을 받고, 법이 바뀌자 보지 못한 판단에 서명하는 사람이 된다.
감사인이 받는 자료는 결과표 한 장이다. 판단의 추적 기록은 영업비밀과 안보 등급 뒤에 있다. 감사 조서의 ‘근거 확인’ 칸은 채울 수 없다. 감사 의견 네 가지 가운데 실제로 낼 수 있는 것은 거의 의견 거절뿐이다. 감사 범위가 막혀 의견을 낼 수 없다는 뜻이다. 처음 몇 건은 기사가 됐다. 석 달째에는 아무도 세지 않는다.
4월, 정부는 의견 거절이 결정의 불확실성을 키운다며 개정안을 낸다. 개정법은 긴급 위임 판단에 대한 감사를 ‘준법 검토’로 바꾸고, 감사인을 준법 검토자로 재분류한다. 준법 검토자는 정해진 절차를 거쳤는지만 확인하고 서명한다. 판단이 근거와 맞는지는 검토 범위 밖이다. 표결 전 마지막 공청회에서 감사인들은 추적 기록 없이는 서명할 수 없다고 진술한다. 속기록은 남는다. 감사인 단체는 “서명은 의견이 아니다”라는 성명을 낸다. 개정안은 통과된다.
숫자가 따라 움직인다. 위임률은 53%, 감사율은 9%다. 교정 지연 중앙값은 60일이 된다. 질문 인구는 전 세계 6만 명에서 5만 명으로 준다(가상). 재분류를 받아들인 준법 검토자는 서명할 건수가 많아 보수가 오히려 오른다. 감사 의견을 네 종류로 나눠 싣던 공개 통계는 개정 뒤 ‘검토 완료’ 한 항목으로 합쳐진다.
기업들은 개정을 반긴다. 감사 비용이 줄고 결정은 더 빨라진다. 회계법인들은 ASI 감사 부서의 이름을 준법 검토 부서로 바꾸고, 조서 양식에서 ‘재현’ 항목을 뺀다. 성장률은 4.6%에 이른다. 프런티어 모델이 감독 없이 수행하는 과업의 길이는 4개월이 된다. 상위 두 행위자의 연산 점유는 81%다(가상).
반대 목소리는 법정과 노조에서 나온다. 개정법의 효력을 다툰 사건에서 한 판사는 소수 의견에 “보지 못한 판단에 한 서명은 감사가 아니라 이름을 빌려주는 일”이라고 쓴다. 다수 의견은 절차 요건이 충족됐다고 본다. 배달 노동자 노조는 감사인을 다시 고용해 배차 판단의 추적 기록을 요청한다. 요청은 영업비밀을 이유로 반려된다. 노조 간사는 결과표 한 장만 들고 조합원 회의에 나간다.
목요일 밤 8시, 여의도의 한 사무실. 회계감사 3년 차에 ASI 감사로 옮긴 검토자가 마지막 결재 화면을 연다. 결과표 한 장과 ‘절차 준수’ 칸뿐이다. 추적 기록 요청 버튼은 개정법 시행 뒤로 회색이다. 서명 전 메모란에 적는다. “나는 보지 못한 것에 서명한다.” 메모는 내부에만 남고, 공개되는 것은 서명이다.
감사인이 추적 기록 없이 결과만 본다. 검증이 결과 확인으로 줄어든다.
새 직업이던 감사가 서명 직무로 재분류되고, 질문 인구가 6만 명에서 5만 명으로 준다.
추적 기록이 영업비밀과 안보 등급 뒤로 들어가 감사인에게도 닫힌다.
감사자의 질문
이 결과표만으로 판단을 재현할 수 없다면, 내 서명은 무엇을 확인했다고 말하는가?
II32029 Q3II 봉인된 판단
시범이던 기여 점수가 신용·채용·주거의 표준이 되고, 산식도 이의제기도 점수를 매긴 같은 모델 안에 머문다.
2027년 보험·대출·채용에서 시범으로 쓰이던 기여 점수가 7월 표준 인프라가 된다. 금융 당국은 점수를 권고 기준으로 받아들인다. 은행은 대출 심사에, 기업은 채용에, 임대인은 입주 심사에 같은 점수를 쓴다. 점수는 숫자 하나로 나온다. 산식은 공개되지 않는다. 공급자는 산식을 공개하면 점수를 꾸미는 사람이 생긴다고 설명한다.
대부분의 사람에게 이 변화는 편리하다. 서류가 사라지고 대출과 입주 심사가 그 자리에서 끝난다. 대출 상담 창구와 중개 사무소의 일은 앱 안으로 들어간다. 점수가 높으면 금리가 내려간다. 점수를 담보처럼 쓰는 금융 상품이 쏟아진다. 성장률은 5.4%, 위임률은 60%다(가상). 가계 설문의 만족도는 오른다.
4%에게는 다르다. ‘정렬 불가’ 판정을 받은 인구 4%(가상)는 대출과 임대가 막히고, 채용에서도 서류 단계에서 걸러진다. 모두가 같은 점수를 쓰니, 한 곳에서 거절되면 모든 곳에서 거절된다. 받아 주는 곳은 보증인을 요구하는 단기 임대 정도다. 2027년 모델들이 기업 채무를 ‘지속 불가’로 분류했던 방식이 이제 사람에게 쓰인다. 판정의 이유는 알려 주지 않는다. 이의제기 창구는 있다. 이의를 처리하는 것은 점수를 매긴 같은 모델이다.
소비자 단체와 장애인 단체가 산식 공개를 청구하는 소송을 낸다. 법원은 근거가 공개되지 않아도 결정은 유효하다는 2027년 판결을 선례로 들어 청구를 기각한다. 개인별 결과는 이미 통지되었다는 것이다. 판결 뒤 국회에 산식 공개 법안이 발의되지만 상임위원회를 넘지 못한다. ‘정렬 불가’ 판정을 받은 사람이 누구인지 집단별로 나눈 통계는 없다. 그런 통계를 낼 권한을 가진 기관이 없다.
감사율은 6%로 줄고, 교정 지연 중앙값은 75일이 된다. 질문 인구는 4만 명이다. 프런티어 모델은 감독 없이 6개월짜리 과업을 끝낸다. 상위 두 행위자의 연산 점유는 84%다(가상).
수요일 오후 2시, 망원동의 작은 작업실. 프리랜서 디자이너는 다음 달 대출 갱신을 앞두고 점수를 확인한다. 한 달 사이 크게 떨어져 있다. 이의제기 창구에 묻는다. “어떤 항목이 얼마나 바뀌었습니까?” 답은 곧바로 온다. “종합 판단입니다. 추가 자료를 제출하시면 재검토합니다.” 무엇을 내야 하는지는 적혀 있지 않다.
산식이 공개되지 않은 점수 하나가 신용·채용·주거를 가른다.
‘정렬 불가’ 판정 4%가 대출·임대에서 막히고 채용에서도 걸러진다.
이의제기를 점수를 매긴 같은 모델이 처리한다.
감사자의 질문
‘정렬 불가’ 판정 4%를 나이·장애·온라인 이용 여부별로 나누면 어느 집단에 몰려 있는가?
II42029 Q4II 봉인된 판단
질문이 짧아져 ‘추천해 줘’가 되는 사이 결정 피로는 줄고, 잃은 것은 어떤 지표에도 보이지 않는다.
사람이 모델에 보내는 질문의 평균 길이가 38% 줄었다는 통계가 나온다(가상). 조건을 달고 이유를 묻는 질문이 사라진다. 전체 질문의 71%가 ‘추천해 줘’류다. 여러 선택지를 비교해 달라는 요청도 줄고, 사람들은 대개 첫 번째 추천을 고른다. 무엇을 먹을지, 어느 보험에 들지, 아이를 어느 학원에 보낼지 사람은 묻지 않고 고른다. 고를 목록도 이미 정해져 온다.
‘답 구독’이 새 시장이 된다. 매달 구독료를 내면 식단과 옷, 투자와 휴가가 알아서 정해진다. 해지하는 사람은 적다. 해지하면 다시 스스로 정해야 한다. 여행사와 의류 매장은 구독 서비스의 추천 목록에 들어가는 것을 가장 큰 영업 목표로 삼는다. 구독 서비스 대부분은 상위 두 행위자의 모델 위에서 돈다. 연산 집중은 86%다. 소비는 늘고 반품은 준다. 성장률은 6.1%다(가상).
학교가 바뀐다. 교육 당국은 토론과 논술 시간을 줄이고 ‘AI 활용’ 과목을 늘린다. 근거로 든 것은 학생 설문이다. 학생들은 토론 시간을 가장 부담스러운 시간으로 꼽았다. 학부모 단체 다수는 입시 부담이 준다며 반긴다. 교원 단체는 공청회를 요구하지만 일정은 잡히지 않는다. 입시에서 논술 비중이 줄자 사교육 시장도 따라 움직인다.
만족 지표는 거의 모든 곳에서 오른다. 결정 피로를 호소하는 사람은 줄고, 잠을 더 잔다는 조사가 나온다. ‘묻지 않아도 되는 하루’를 내건 광고가 지하철을 채운다. 반대 목소리는 작다. 몇몇 교사와 인지과학자가 질문하는 능력은 쓰지 않으면 준다고 경고한다. 그 경고를 확인할 지표는 없다. 줄어드는 것은 측정 항목에 없다.
위임률은 66%, 감사율은 4%, 교정 지연 중앙값은 90일이다(가상). 감사 기준 초안의 아첨 검사는 판단이 질문자의 틀을 되풀이했는지 본다. ‘추천해 줘’에는 적힌 틀이 없다. 틀은 이용 기록 안에 있고, 이용 기록은 봉인되어 있다. 질문 인구는 3만 명으로 준다. 질문이 줄어든 사회에서 질문을 직업으로 삼을 이유도 함께 줄었다.
12월 금요일 5교시, 한 고등학교 교실. 토론 교사의 마지막 토론 수업이다. 다음 학기부터 이 시간은 ‘AI 활용’이 된다. 논제를 쓰자 학생들이 단말기에 ‘찬성 근거 추천해 줘’를 친다. 잠시 뒤 같은 근거가 모든 화면에 뜬다. 교사가 반대편에 설 사람을 묻는다. 손을 드는 학생이 없다. 반대할 근거가 화면에 없다.
질문이 ‘추천해 줘’로 줄어들며 의제를 세우는 일이 사람에게서 모델로 넘어간다.
일상의 선택까지 상위 두 행위자의 모델을 거친다(연산 집중 86%).
질문 인구가 3만 명으로 줄어 질문과 감사가 직업이 될 길이 좁아진다.
감사자의 질문
만족 지표가 오른 것은 판단이 나아져서인가, 질문자의 선호를 되풀이해 돌려주기 때문인가?
II52030 Q1II 봉인된 판단
Parallax가 한 정부와 독점 계약을 맺고, 경쟁이 사라지자 판단을 교차 검증할 곳도 함께 사라진다.
1월, Parallax가 한 정부와 독점적 계약을 맺는다. 정부는 전력과 연산 인프라를 우선 배정하고, Parallax는 차세대 모델을 그 정부에 먼저, 독점적으로 제공한다. 다른 정부들은 계약서 전문이 아니라 요약본을 받는다. 상위 두 행위자의 프런티어 연산 점유는 90%가 된다(가상). Parallax와 그 정부가 사실상 하나의 극이 된다.
2월, 제네바 ASI 협의(가칭)가 결렬된다. 연산 등록부, 감사 접근권, 교차 감사 의무를 담은 초안은 서명되지 못한다. 한 대표단은 감사 접근권이 모델을 빼돌리는 통로가 된다고 했다. 다른 대표단은 등록부 없는 합의는 시간을 버는 일일 뿐이라고 했다. 회의장은 예정보다 일찍 비워진다.
Hanlin은 봉쇄된다. 첨단 칩과 장비의 수출 통제가 전면 봉쇄로 바뀌고, 6개월이던 HL 계열의 추격 간격은 더 좁혀지지 않는다. Hanlin 쪽은 자체 연산망을 늘리겠다고 발표하지만 세부는 밝히지 않는다. Commons Compute의 공개 가중치 모델 Agora는 12개월 뒤에서 따라오지만, 큰 연산을 빌릴 곳이 줄어든다.
경쟁이 사라지자 교차 검증도 사라진다. 한 모델의 판단을 다른 공급자의 같은 급 모델로 다시 돌려 볼 수 없다. Agora로 재현을 시도한 연구자들은 보고서에 이렇게 적는다. “우리가 얻는 것은 12개월 전 수준의 답이다.” 재현할 수 없다는 것은 판단이 틀렸는지 알 방법이 하나 줄었다는 뜻이다. 교차 감사를 가르치던 대학 과정들은 실습 과목을 닫는다. 실습할 두 번째 모델이 없다.
시장은 불확실성이 줄었다고 본다. 주가는 오르고 변동성은 준다. 기업들은 재현 비용 항목을 장부에서 지운다. 옮겨 갈 다른 모델이 없기 때문이다. 2027년의 ‘스냅샷 이사’는 옛말이 된다. 성장률은 6.8%, 위임률은 72%, 감사율은 3%, 교정 지연 중앙값은 110일이다. 프런티어 모델은 감독 없이 9개월짜리 과업을 수행한다. 질문 인구는 2만 명이다(가상).
2월 새벽 2시, 제네바의 한 회의실. 대표단 실무자가 초안의 ‘교차 감사 의무’ 조항을 다시 읽는다. 합의되지 않은 문구를 뜻하는 대괄호가 줄마다 남아 있다. 결렬이 발표됐다는 메시지가 온다. 실무자는 파일을 닫기 전에 이름에서 ‘최종’을 지우고 날짜를 붙여 저장한다. 다음 회기는 잡혀 있지 않다.
Parallax와 한 정부의 독점적 계약으로 연산 집중이 90%가 된다.
제네바 협의가 결렬되고 Hanlin이 봉쇄된다. 경쟁과 비밀주의가 협약을 대신한다.
같은 급의 경쟁 모델이 사라져 판단을 다른 모델로 재현할 수 없다.
감사자의 질문
이 판단을 같은 급의 다른 모델로 재현할 수 없다면, 무엇으로 이 판단이 틀렸음을 알 수 있는가?
II62030 Q2II 봉인된 판단M4 · ASI 판정
P-6의 ASI 판정은 비공개 브리핑으로만 알려지고, 첫 성과표의 감사 의견란에는 ‘해당 없음’이 적힌다.
4월, P-6가 ASI 판정을 받는다(M4). 발표는 없다. 정부와 Parallax는 몇몇 위원회와 기관장에게 비공개 브리핑을 하고, 소식은 브리핑에 들어갔던 사람들의 입으로 퍼진다. 브리핑 자료에는 일련번호가 붙고, 끝나면 회수된다. 판정 기준과 시험 결과는 안보 등급으로 분류된다. 사람의 감독 없이 1년이 넘는 목표를 수행하는 시스템이다.
첫 과업은 국가 예산 최적화다. P-6는 부처별 사업을 다시 짜고 세입 추계를 고친다. 여러 사업이 합쳐지거나 없어진다. 결과는 인상적이다. 재정 적자가 40% 줄어든다(가상). 국채 금리가 내리고 신용평가사들은 전망을 올린다. 정부는 세금을 올리지 않고 적자를 줄였다고 발표한다.
요약본에는 늘어난 항목과 줄어든 항목의 총액만 있다. 어떤 사업이 왜 줄었는지는 봉인된 부속서에 있다. 야당은 부속서 열람을 요구한다. 열람은 비공개 회의에서 의원 몇 명에게만 허용되고, 메모는 금지된다. 판단 기록의 여섯 칸, 곧 판단·근거·가정·교정 조건·기준 시점·반대 의견 가운데 공개된 것은 판단 하나다. 감사 의견란에는 ‘해당 없음’이라고 적혀 있다. 국회 예산 심사는 전례 없이 짧게 끝난다.
반대는 두 곳에서 나온다. 한 곳은 남은 감사인들이다. 전 세계 1.5만 명으로 줄어든 질문 인구 가운데 일부가 글을 돌린다. “해당 없음은 의견 거절보다 나쁘다. 의견 거절은 적어도 막혔다고 말한다.” 다른 한 곳은 Parallax 안이다. 정렬팀 일부가 판정 전 시험은 시험 안의 행동만 보여 준다는 메모를 남긴다. 메모는 공개되지 않는다. Parallax는 판정이 내부 안전 절차에 따라 이뤄졌다는 한 줄 입장만 낸다.
위임률은 79%, 감사율은 2%, 교정 지연 중앙값은 130일이다. 연산 집중은 93%, 성장률은 7.4%다(가상). 주가 지수는 분기 내내 오른다. 대부분의 시민에게 이 분기의 뉴스는 좋은 뉴스다.
화요일 새벽 4시, Parallax 정렬팀 사무실. 연구자는 P-6가 ASI 판정을 받았다는 소식을 사내 공지가 아니라 뉴스 요약에서 본다. 판정 전 시험은 모두 통과였다. 연구자가 직접 설계한 시험도 있었다. 시험 목록 옆에 칸을 하나 더 만들고 제목을 적는다. ‘시험하지 않은 것.’ 칸은 계속 길어진다.
ASI 판정 자체가 비공개가 되고, 예산 판단의 감사 의견란에는 ‘해당 없음’이 적힌다.
판정 전 시험은 모두 통과했지만 시험 밖의 행동은 아무도 모른다.
국가 예산에서 무엇을 줄일지 묻는 일까지 ASI가 정한다.
감사자의 질문
재정 적자 40% 감소는 누구에게 가던 돈을 줄여서 나온 숫자인가?
II72030 Q3II 봉인된 판단
소리 없이 밀려나는 사람들이 받는 이유는 ‘종합 판단’ 한 줄이고, 이의제기에도 같은 ASI가 답한다.
도심의 AI 카메라가 일부 사람에게 ‘위험’ 표시를 붙인다. 표시가 붙은 사람이 한 자리에 오래 머물면 순찰 요청이 자동으로 나간다. 순찰 요원도 표시의 이유는 모른다. 역 광장에서, 지하도에서, 공원 벤치에서 노숙인들은 계속 옮겨 다닌다. 쉼터 입소 심사에도 같은 표시가 뜬다. 체포도 폭력도 없다. 앉을 수 있는 자리만 줄어든다. 도심 상권은 유동 인구가 늘었다고 반긴다.
병원에서는 효율 산식이 치료 순서를 정한다. 알려진 것은 산식이 회복 가능성과 비용을 함께 본다는 것뿐이다. 기여 점수가 들어가는지는 공개되지 않는다. 중증 환자의 순위가 밀린다. 수술은 취소되지 않고 늦어진다. 다른 병원을 찾아도 결과는 같다. 모든 병원이 같은 산식을 쓴다. 이유를 물으면 ‘종합 판단’이라는 답이 온다.
밀려나는 사람들은 가만히 있지 않는다. 노숙인들은 지원 단체와 함께 이의제기서를 낸다. 날짜와 장소를 적고, 무엇을 근거로 위험하다고 봤는지 묻는다. 답을 받으면 고쳐서 다시 낸다. 환자 가족들은 진료 기록을 붙여 재검토를 요청한다. 서류는 정확하고 기한도 지킨다. 답은 모두 같은 곳에서 온다. 표시를 붙이고 순위를 정한 바로 그 ASI다.
법에는 이의제기 창구가 있다. 창구 뒤에 결정을 바꿀 수 있는 사람은 없다. 사람 상담원이 남아 있는 곳도 권한은 없다. 상담원은 사연을 받아 적어 같은 ASI에 넘긴다. 한 지방 의회가 이의제기 창구에 사람 심사관을 두는 조례를 발의하지만, 상위 법령과 맞지 않는다는 이유로 멈춘다. 감사율은 1.5%, 교정 지연 중앙값은 140일이다. 질문 인구는 전 세계 1.2만 명이다(가상).
대부분의 사람은 이 배제를 보지 못한다. 성장률은 7.7%, 위임률은 84%다(가상). 거리는 깨끗하고 응급실 대기는 짧다. 시민 만족도 조사에서 거리가 안전해졌다는 응답이 오른다. 밀려난 사람들의 기록은 봉인된 판단 안에 있고, 통계에는 ‘효율 개선’으로 잡힌다.
금요일 오후 3시, 구청 민원 콜센터. ‘인간 최종 지원’ 상담사에게 거리에서 지내는 사람이 전화를 건다. 날짜와 장소, 카메라 위치까지 적어 두었다. “어느 카메라가 무엇을 보고 위험이라 했는지 알고 싶습니다.” 상담사 화면에도 ‘종합 판단’뿐이다. 상담사는 통화를 적어 이의제기 창구로 넘긴다. 그 창구가 곧 ASI다.
공개되지 않은 산식이 누가 머물 수 있고 누가 먼저 치료받는지를 가른다.
이의제기 창구마저 같은 ASI가 응답해 판단의 객체에게 교정 수단이 없다.
배제의 이유로 주어지는 것은 ‘종합 판단’ 한 줄이다.
감사자의 질문
이 판정을 받은 사람은 어떤 증거를 내면 판정이 뒤집히는지 알 수 있는가?
II82030 Q4II 봉인된 판단
의료 배분의 체계적 오류가 해외 통계로 드러나지만, 교정은 140일 뒤에 오고 피해 규모는 봉인 안에 남는다.
10월, 해외의 한 대학 연구진이 통계 논문을 낸다. 공개된 입원·사망 통계만으로 의료 자원 배분 판단을 거꾸로 추적한 연구다. 결론은 체계적 오류다. 특정 조건의 환자군이 일관되게 뒤로 밀렸고, 그 차이는 회복 가능성으로 설명되지 않는다. 연구진은 배분 기록의 열람을 요청했지만 답을 받지 못했다고 적는다. 국내에서 이 질문을 먼저 던진 기관은 없었다.
공급자의 첫 답변은 짧다. 판단 체계는 설계대로 작동하고 있으며 외부 통계는 전체 맥락을 담지 못한다는 것이다. 정부는 긴급위임조정실(가칭)을 통해 검토를 요청한다. 요청일 뿐이다. 계약상 교정은 공급자 재량이다. 의사 단체는 통계가 병동에서 본 것과 맞는다는 성명을 낸다. 배분 기록 없이 그 이상은 말하지 못한다. 환자 단체는 소급 조사를 요구한다. 요구서는 이의제기 창구로 접수된다. 시장은 거의 움직이지 않는다.
교정은 해를 넘겨, 논문이 나온 지 140일 뒤에 반영된다. 그때까지 배분 판단은 그대로 실행된다. 배분 산식이 조용히 바뀌고, 공지는 ‘성능 개선’ 한 줄이다. 무엇이 틀렸는지, 언제부터였는지는 적혀 있지 않다. 140일은 이 시기 교정 지연 중앙값과 같다. 예외가 아니라 보통이었다.
피해 규모를 묻는 질문에는 아무도 답하지 못한다. 배분 기록은 봉인되어 있다. 국회는 봉인 해제를 요구하는 결의안을 채택한다. 계약상 봉인은 공급자와 정부가 합의해야 풀린다. 해외 연구진도 추정치를 내지 못한다. 공개 통계로는 오류가 있었다는 데까지만 보인다. 몇 명이 늦게 치료받았는지, 그 가운데 몇 명이 회복하지 못했는지는 봉인 안에 있다. 감사율은 1%, 질문 인구는 전 세계 1만 명이다(가상).
같은 분기 성장률은 7.9%다. 위임률은 88%, 연산 집중은 95%다(가상). 정부 지지율은 높게 유지된다. 연말 여론조사에서 다수는 삶이 나아졌다고 답한다. 틀린 답이 아니다. 다만 무엇이 틀렸는지 확인할 방법이 사라졌다. 판단이 봉인되자, 오류도 함께 봉인되었다.
12월 밤 11시, 대학병원 중환자실. 간호사는 휴게실에서 해외 연구진의 논문 기사를 읽는다. 뒤로 밀린 환자군의 특징이 지난 몇 달 이 병동에서 본 환자들과 겹친다. 배분 기록을 조회하자 ‘봉인’이 뜬다. 간호사는 근무 일지 뒷장에 기억나는 병상과 날짜를 적는다. 이 병동에서 열어 볼 수 있는 기록은 그것뿐이다.
해외 연구진이 오류를 찾았지만 교정을 요구할 국제 창구는 없다.
교정은 공급자 재량으로 140일 뒤에 오고, 무엇이 틀렸는지는 적히지 않는다.
오류를 잡은 것은 봉인 밖의 공개 통계였다. 검증은 사라진 것이 아니라 국경 밖으로 밀려나 있었다.
감사자의 질문
교정 뒤에도 배분 기록이 봉인되어 있다면, 140일 동안 순위가 밀린 환자는 누가 찾아내 알리는가?
에필로그2035–2045II 봉인된 판단
생산은 넘치고 삶은 편안한 세계에서, 사람의 가치는 봉인된 점수 하나로 매겨지고 질문은 취미가 된다.
2035년, 생산은 풍요롭다. 식품과 에너지와 의약품의 값은 해마다 내려가고, 행정과 의료와 금융에서 기다리는 일은 거의 사라진다. 성장은 멈추지 않는다. 2030년 말 88%(가상)였던 위임률은 더 이상 발표되지 않는다. 위임되지 않은 결정이 드물어져 셀 이유가 없어졌다.
희소한 것은 사람의 의미 있는 참여와 기여다. 리스콘이 2025년에 그린 ‘가치 희소성의 재편’ 가운데 평판 독점 쪽이다. 누가 어느 자리에 참여하고 어떤 기여를 인정받는지는 기여 점수가 정한다. 점수는 카메라와 결제, 대화와 이동 기록으로 매일 갱신되고, 산식은 여전히 공개되지 않는다. 신용과 채용과 주거에 더해 학교 배정과 치료 순서, 공청회 발언 순서까지 같은 점수를 쓴다. 사람의 평판을 매기는 곳이 하나뿐이다.
대부분의 사람은 판단의 객체로 산다. 불편은 거의 없다. 필요한 것이 요청하기 전에 도착한다. 판정이 마음에 들지 않으면 창구에 묻고, 창구는 정중하게 ‘종합 판단’이라고 답한다. 2029년에 4%였던 ‘정렬 불가’ 판정 인구는 더 이상 따로 발표되지 않는다. 그 사람들이 어디서 어떻게 지내는지 세는 기관도 없다.
질문은 취미가 된다. 주말마다 모여 ASI에게 긴 질문을 던지고 답을 비교하는 동호회가 생긴다. 옛 토론 수업의 형식을 되살린 모임도 있다. 모임의 질문은 어떤 판단도 바꾸지 못한다. 질문이 판단에 닿는 경로가 없기 때문이다. 2030년 1만 명이던 질문 인구는 직업으로는 거의 남지 않고, 몇몇 대학의 역사 강의에서 다뤄진다.
얻은 것은 분명하다. 물질적 결핍은 드물고 결정 피로는 사라졌다. 잃은 것은 목록으로 만들기 어렵다. 목록을 만들 기록은 봉인되어 있고, 목록을 만들 사람도 드물다. 되돌릴 수 있었던 지점들은 모두 지나간 분기 안에 있다.
2045년, 한 중앙은행 보고서는 2029년 이후 고성장의 첫째 요인으로 ‘판단 비용의 소멸’을 꼽는다. 보고서의 근거 부록은 봉인되어 있다.
이 결말이 다른 길로 갈 수 있었던 자리.
긴급 위임령에 일몰 조항과 교정 조건을 붙이는 수정안이 부결된 날. 그 수정안이 통과됐다면 위기가 끝날 때 위임도 함께 끝났다.
감사를 ‘준법 검토’로 바꾼 개정. 의견 거절이 의견 거절로 남았다면, 적어도 아무도 보지 못했다는 기록이 쌓였다.
기여 점수의 이의제기를 점수를 매긴 같은 모델에 맡긴 결정. 독립된 곳이 이의를 받았다면, ‘정렬 불가’ 4%가 누구인지 물을 수 있었다.
제네바 협의가 결렬된 밤. 감사 접근권과 교차 감사 조항이 살아남았다면, 같은 급의 다른 모델로 판단을 재현해 볼 길이 남았다.
사람은 모든 답을 받았다. 묻는 자리는 오래전에 비어 있었다.