예측이 아니라 시나리오입니다. 모든 숫자는 저작한 가정이고, 여기 나오는 연구소·모델·기관은 가상입니다. 기준 시점 2026년 9월 25일.

시나리오 / 02

시나리오

트렁크 하나, 결말 둘. 두 결말에 같은 ASI가 온다. 갈리는 것은 사람이 묻는 자리를 남겼는가다. 2026년 4분기부터 2030년 4분기까지 분기마다 서사 옆에 지표판을 둔다.

25분기2결말7지표

T12026 Q4트렁크

읽지 않은 승인

한 광역시가 복지 급여 판정에 AI 사전 판단을 들이고, 담당자의 승인 화면 체류는 중앙값 11초다(가상).

2026년 10월, Parallax의 P-3 에이전트가 사무실의 하루치 일을 맡기 시작한다. 회계 마감, 계약 검토, 코드 수정이다. 아침에 과업을 넘기면 저녁에 결과가 돌아온다. 사람의 감독 없이 해내는 과업의 길이, 곧 자율 지평은 아직 하루다. 사람은 결과를 받아 승인하는 자리로 옮겨 간다. 프런티어 연산의 58%는 상위 두 행위자가 쥐고 있다(가상).

같은 분기, 한 광역시가 복지 급여 적격 판정에 AI ‘사전 판단’을 시범 도입한다(가상). 모델이 신청 서류를 읽고 적격 여부를 먼저 제시한다. 담당 공무원이 이를 보고 최종 승인한다. 서류상 판단하는 사람은 여전히 공무원이다. 그런데 승인 화면에 머무는 시간의 중앙값은 11초다(가상).

다른 숫자도 같은 쪽을 가리킨다. 한 가상 조사에 따르면, 관리자 승인 가운데 판단 근거를 열어 본 비율은 19%다. 나머지 81%는 결과만 보고 승인했다. 근거는 닫혀 있지 않았다. 버튼 하나 거리에 열려 있었지만 읽히지 않았다.

이 사이트의 정의로 보면 이런 결정은 이미 위임에 들어간다. 위임은 결과가 큰 결정을 AI가 내리거나 사실상 정해 두는 것이다. 11초 동안 결과 한 줄을 보고 누른 승인은 모델이 정해 둔 판정을 옮겨 적는 일에 가깝다. 서류에는 사람의 승인이 남고, 판정은 사실상 모델이 정한다.

지지하는 쪽은 최종 승인이 사람에게 남아 있다는 점을 든다. 반대하는 쪽은 그 승인이 11초라는 점을 든다. 하루 340건을 승인하는 구청 주무관이 근거를 모두 읽으면 하루가 모자란다. 읽지 않으면 승인은 서명이 된다. 탈락한 신청자가 이유를 물을 때 누가 답해야 하는지도 흐려진다.

지표판의 숫자는 모두 합성 입력이다. 결과가 큰 결정 가운데 AI가 내렸거나 사실상 정한 비율, 곧 위임률은 4%다. 위임된 결정의 35%가 독립 감사를 받는다. 감사가 문제를 찾아도 반영까지 중앙값 60일이 걸린다. 감사와 질문을 직업이나 부업으로 하는 사람은 전 세계에 2천 명이다. 성장률은 2.1%다. 이 분기가 남기는 질문은 하나다. 승인은 판단인가.

장면구청 복지 주무관

11월 둘째 주 화요일 오후 3시 40분, 한 구청 복지과. 주무관의 화면에 오늘 312번째 사전 판단이 뜬다. ‘부적격, 소득 기준 초과.’ 근거 보기 버튼은 화면 오른쪽 아래에 있다. 오늘 처리할 건수는 340건이다. 11초 뒤 승인 버튼이 눌린다. 근거 보기는 열리지 않았다.

이 분기의 사건

  • Parallax P-3 에이전트가 회계 마감·계약 검토·코드 수정을 하루 단위로 맡는다
  • 한 광역시가 복지 급여 적격 판정에 AI 사전 판단을 시범 도입한다(가상)
  • 승인 화면 체류 시간 중앙값 11초(가상)
  • 관리자 승인 중 근거를 열어 본 비율 19%(가상 조사)

축 이동

  • 질문권 +0.2봉인된 판단 쪽 — 이유

    근거를 열어 본 승인은 19%다(가상 조사). 승인하는 사람이 판정에 묻지 않는다.

  • 교정 가능성 +0.1봉인된 판단 쪽 — 이유

    최종 승인이 사람에게 남아도, 11초 안에는 교정이 일어날 틈이 거의 없다.

감사자의 질문

근거를 열어 본 승인과 열지 않은 승인에서, AI의 판단이 뒤집힌 비율은 다른가?

지금 볼 것

  • 공공기관이 AI 사전 판단을 담당자 승인 화면에 띄우고, 승인에 걸린 시간이나 근거 열람 여부를 따로 기록하는 사례가 나타나는가
  • 월말 회계 마감이나 계약 검토를 하루 단위 에이전트에게 통째로 맡긴다는 기업의 공개 사례가 나타나는가

이 분기의 기록 5건

T22027 Q1트렁크M1 · 자율 개발자

자율 개발자

P-4가 사흘짜리 개발 과업을 감독 없이 끝내고, 모델을 갈아타는 비용이 처음 장부에 오른다.

2027년 1월, Parallax가 P-4를 내놓는다. P-4는 사흘짜리 개발 과업을 사람의 감독 없이 끝낸다. 요구 사항을 읽고, 코드를 쓰고, 시험을 돌리고, 실패한 곳을 고친다. 이 사이트는 이 이정표를 M1, 자율 개발자라 부른다. 자율 지평은 하루에서 사흘로 늘어난다.

고용이 먼저 반응한다. 소프트웨어 분야 신규 채용이 40% 줄어든다(가상). 판교의 한 스타트업에는 사람 개발자가 둘 남는다. 두 사람의 일은 코드를 쓰는 것에서, 모델이 쓴 코드를 읽고 받아들일지 정하는 것으로 바뀐다. 업계 안에서는 우려도 나온다. 모델의 코드를 받아들일지 정하려면 코드를 써 본 사람이 있어야 하는데, 그런 사람을 기르던 자리가 신규 채용이었다.

Hanlin의 HL-3가 약 6개월 차이로 뒤를 쫓는다. Commons Compute의 공개 가중치 모델 Agora는 약 12개월 뒤에 있다. 연산 수출 통제가 한층 강화된다. 상위 두 행위자의 프런티어 연산 점유는 60%가 된다.

API 가격이 오른다. 1인 기업들이 사흘 만에 다른 모델로 옮겨 간다. 이 이동을 ‘스냅샷 이사’라 부른다. 옮기려면 같은 과업을 새 모델에서 다시 돌려 같은 결과가 나오는지 확인해야 한다. 그 비용, 곧 재현 비용이 처음으로 장부에 오른다.

감사의 눈으로 보면 스냅샷 이사는 뜻밖의 기록을 남긴다. 같은 과업을 두 모델에 돌려 결과가 같은지 다른지가 처음으로 적힌다. 이 사이트의 감사 기준 6조는 다른 모델과 다른 시점에서 판단을 재현하고 그 비용을 기록하라고 한다. 1인 기업들은 감사 때문이 아니라 가격 때문에 그 일을 먼저 한다.

낙관하는 쪽은 한 사람이 회사를 꾸릴 수 있게 됐다고 말한다. 신중한 쪽은 지표판을 가리킨다. 위임률은 7%로 오르고, 감사율은 35%에서 30%로 내려간다. 교정 지연은 55일, 질문 인구는 3천 명, 성장률은 2.2%다. 일을 맡기는 속도가 일을 확인하는 속도를 앞지르기 시작한다.

장면판교 스타트업 CTO

3월 첫 월요일 오전 8시 반, 판교의 한 사무실. 목요일 저녁에 맡긴 사흘짜리 과업이 끝나 있다. 남은 사람 개발자 둘이 결과를 나눠 읽는다. CTO는 API 가격 인상 공지를 열고, 같은 과업을 다른 모델에서 다시 돌리는 비용을 계산한다. 장부에 ‘재현 비용’이라는 줄이 처음 생긴다.

이 분기의 사건

  • Parallax P-4가 사흘짜리 개발 과업을 감독 없이 끝낸다 — 이정표 M1(자율 개발자)
  • 소프트웨어 신규 채용 40% 감소(가상)
  • Hanlin HL-3가 약 6개월 차로 뒤를 쫓고, 연산 수출 통제가 강화된다
  • API 가격 인상 뒤 1인 기업들의 ‘스냅샷 이사’ — 재현 비용이 처음 장부에 오른다

축 이동

  • 노동과 소득 +0.2봉인된 판단 쪽 — 이유

    소프트웨어 신규 채용이 40% 줄어든다(가상). 일이 사람을 거치지 않고 끝나기 시작한다.

  • 국제 질서 +0.2봉인된 판단 쪽 — 이유

    HL-3가 6개월 차로 뒤를 쫓고 연산 수출 통제가 강화된다. 경쟁과 통제가 먼저 움직인다.

  • 연산과 통제의 집중 +0.1봉인된 판단 쪽 — 이유

    상위 두 행위자의 연산 점유가 58%에서 60%로 오른다. 가격이 오르자 한 공급자에 기댄 비용이 드러난다.

감사자의 질문

같은 과업을 다른 모델에서 다시 돌려도 같은 결과가 나오는가 — 나오지 않는다면 어느 쪽을 믿을 근거는 무엇인가?

지금 볼 것

  • 사흘 이상 걸리는 개발 과업을 사람의 감독 없이 끝냈다는 공개 기록이 나타나는가
  • 기업 회계나 공시에서 모델 교체 비용이나 재현 비용을 따로 적는 항목이 나타나는가

이 분기의 기록 5건

T32027 Q2트렁크

재평가

전 단계 모델들이 기업 신용을 다시 매기고, 같은 모델을 쓰는 시장이 같은 날 한꺼번에 판다.

2027년 4월, 금융회사들이 신용 분석에 쓰는 전 단계 모델들이 기업 신용을 다시 매긴다. 결과는 하룻밤 사이에 나온다. 수천 건의 채무가 ‘지속 불가’로 분류된다. 해당 채권의 스프레드가 급등하고, 매수 쪽이 비는 채권도 나온다. 판정이 나온 날과 매도가 몰린 날이 같다.

채권 데스크의 설명은 한 줄이다. 모두가 같은 모델을 쓰니 모두가 같은 날 판다. 여러 기관이 같은 계열의 모델로 같은 공개 자료를 읽는다. 한 모델의 판정이 곧 시장의 판정이 된다. 판정이 맞았는지 따지는 일은 가격이 움직인 뒤로 밀린다. 같은 날 판 기관들은 서로 다른 판단을 내린 것이 아니다. 한 판단을 여러 번 실행했다.

‘지속 불가’로 분류된 기업들은 한 가지를 묻는다. 무엇이 달라지면 판정이 다시 바뀌는가. 이 사이트가 교정 조건이라 부르는 것이다. 매도는 그 답보다 먼저 끝난다.

이 분기의 재평가는 리스콘의 한 문서가 세운 ‘정렬 불가 채권’ 가설을 시나리오로 옮긴 가정이다. 시나리오는 가설을 검증하지 않는다. 가설대로라면 어떤 분기가 되는지를 그릴 뿐이다.

같은 분기, 보험·대출·채용에서 ‘기여 점수’ 시범 운영이 시작된다. 점수가 무엇으로 어떻게 계산되는지는 공개되지 않는다. 점수를 받은 사람은 결과만 안다. 탈락한 지원자도, 대출이 거절된 신청자도 무엇을 고쳐야 하는지 물을 곳이 없다. 이 사이트의 여섯째 축인 사람의 가치 측정에는 두 끝이 있다. 한쪽은 공개 산식과 이의제기권 아래의 신뢰 인프라, 다른 쪽은 불투명한 점수가 신용·채용·주거를 가르는 평판 독점이다. 이 분기의 점수는 산식을 공개하지 않는 쪽에서 출발한다.

지표판도 같은 쪽으로 움직인다. 위임률 11%, 감사율 26%, 교정 지연 52일. 자율 지평은 1주로 늘고, 상위 두 행위자의 연산 점유는 62%다. 질문 인구는 지난 분기보다 2천 명 늘어난 5천 명, 성장률은 2.3%다. 반대하는 쪽은 같은 모델에 기대는 기관이 많을수록 한 모델의 오류가 시장 전체의 오류가 된다고 경고한다.

장면채권 트레이더

4월 둘째 주 목요일 오전 7시 50분, 여의도의 한 채권 데스크. 밤사이 들어온 재평가에서 보유 채권 여러 건에 ‘지속 불가’가 붙었다. 장이 열리기 전인데 메신저 창에는 매도 호가만 줄지어 올라온다. 매수 쪽은 비어 있다. 트레이더가 옆자리에 말한다. “모두가 같은 모델을 쓰니 모두가 같은 날 판다.”

이 분기의 사건

  • 전 단계 모델들이 기업 신용을 재평가해 수천 건의 채무를 ‘지속 불가’로 분류한다
  • 해당 채권의 스프레드가 급등한다
  • 보험·대출·채용에서 불투명한 ‘기여 점수’ 시범 운영
  • 자율 지평 1주, 위임률 11%

축 이동

  • 사람의 가치 측정 +0.4봉인된 판단 쪽 — 이유

    보험·대출·채용에 산식이 공개되지 않은 기여 점수가 들어온다. 점수를 받는 사람은 결과만 안다.

  • 연산과 통제의 집중 +0.2봉인된 판단 쪽 — 이유

    같은 모델을 쓰는 기관들이 같은 날 판다. 교차 검증이 있어야 할 자리에 한 판정의 복제가 있다.

감사자의 질문

‘지속 불가’로 분류된 채무를 다른 모델과 다른 기준 시점의 자료로 다시 판정해도 같은 결론이 나오는가?

지금 볼 것

  • 여러 금융기관이 같은 계열의 AI 모델로 신용을 평가하고 있다는 공시나 감독 보고가 나타나는가
  • 보험·대출·채용에서 산식을 밝히지 않은 AI 점수가 결정에 쓰인다는 사례가 나타나는가

이 분기의 기록 5건

T42027 Q3트렁크

첫 번째 봉인

Parallax와 Hanlin이 판단 추적 기록을 닫고, 법원은 근거가 비공개여도 결정이 유효하다고 본다.

2027년 7월, Parallax가 판단 추적 기록을 영업비밀로 분류한다. 모델이 어떤 자료를 읽고 어떤 단계를 거쳐 판단에 이르렀는지 남긴 기록이다. 감사인에게는 판단을 근거와 기준 시점까지 따라가는 길이다. 몇 주 뒤 Hanlin은 같은 종류의 기록을 안보 등급으로 분류한다. 이유는 다르지만 밖에서 보이는 것은 같다. 결과만 남는다.

이 사이트는 이것을 봉인이라 부른다. 지난해 가을, 근거는 버튼 하나 거리에 열려 있었지만 대부분 읽히지 않았다. 이번에는 읽으려는 사람이 있어도 열 수 없다. 읽지 않는 것은 읽는 사람이 달라지면 풀린다. 읽을 수 없는 것은 기록을 쥔 쪽이 열어야 풀린다.

국회 청문회에서 두 문장이 맞선다. 공급자 쪽은 “근거를 공개하면 모델이 도용된다”고 말한다. 반대편은 “근거 없는 판단은 판단이 아니다”라고 답한다. 한쪽은 기술의 가치를 지키려 하고, 다른 쪽은 판단이 판단으로 성립하는 조건을 지키려 한다. 어느 쪽도 억지가 아니다.

같은 분기, AI 사전 판단에 대한 이의제기 사건에서 첫 판결이 나온다(가상). 법원은 근거가 공개되지 않았어도 결정은 유효하다고 판단한다. 이제 탈락한 신청자는 자신이 왜 탈락했는지 모르는 채 이의를 제기해야 한다. 무엇을 반박해야 하는지 모르는 이의제기다. 이의제기는 판단의 객체가 판단을 고칠 수 있는 통로다. 그 통로는 열려 있지만, 붙잡을 근거가 없다.

감사 의견으로 옮기면 봉인의 뜻이 분명해진다. 감사 의견은 적정, 한정, 부적정, 의견 거절의 네 가지다. 앞의 셋은 판단을 근거와 대조한 뒤에 쓰는 의견이다. 봉인된 판단 앞에서 감사인이 쓸 수 있는 말은 의견 거절에 가까워진다. 감사 범위가 막히기 때문이다.

지표판: 위임률 15%, 감사율 22%, 교정 지연 50일. 질문 인구는 8천 명, 상위 두 행위자의 연산 점유는 65%다. 자율 지평은 1주에 머물고, 성장률은 2.4%다. 위임은 늘고 감사가 닿는 비율은 준다. 감사가 닿지 못하는 이유에는 이제 이름이 붙었다.

장면복지 수급 탈락자

9월 둘째 주 화요일 오후 2시, 국회 청문회장 방청석 맨 뒷줄. 탈락 통지서를 접어 든 사람이 앉아 있다. 통지서에는 결과 한 줄과 이의신청 안내만 있다. 단상에서 “근거를 공개하면 모델이 도용된다”는 말이 나온다. 그 사람은 통지서 뒷면에 한 줄을 적는다. ‘나를 탈락시킨 근거는 누가 가지고 있나.’

이 분기의 사건

  • Parallax가 판단 추적 기록을 영업비밀로 분류한다
  • Hanlin이 같은 종류의 기록을 안보 등급으로 분류한다
  • 국회 청문회: “근거를 공개하면 모델이 도용된다” 대 “근거 없는 판단은 판단이 아니다”
  • AI 사전 판단 이의제기 사건 첫 판결 — 근거 비공개여도 결정 유효(가상)

축 이동

  • 판단의 공개 +0.5봉인된 판단 쪽 — 이유

    판단 추적 기록이 영업비밀과 안보 등급으로 닫힌다. 밖에는 결과만 남는다.

  • 교정 가능성 +0.3봉인된 판단 쪽 — 이유

    근거가 비공개여도 결정이 유효하다는 판결이 나온다. 이의제기가 붙잡을 근거가 사라진다.

  • 국제 질서 +0.1봉인된 판단 쪽 — 이유

    한쪽은 영업비밀로, 다른 쪽은 안보로 닫는다. 서로의 판단을 들여다볼 길도 좁아진다.

감사자의 질문

추적 기록을 닫더라도, 이 판정의 입력 자료 범위와 기준 시점, 교정 조건만은 탈락자에게 공개할 수 있는가?

지금 볼 것

  • AI 공급자가 판단 과정의 기록을 영업비밀이나 안보를 이유로 공개하지 않는다는 방침이 나타나는가
  • AI가 관여한 행정 결정의 근거 공개를 다투는 소송이나 청문회가 나타나는가

이 분기의 기록 5건

T52027 Q4트렁크

여섯 개의 예

한 병원 운영자의 검증되지 않은 ‘회복 지수’를 여섯 공급자의 모델이 모두 받아 병상 규칙으로 키운다.

2027년 9월, 한 병원 운영자가 ‘회복 지수’를 만든다. 입원 환자의 회복 정도를 숫자 하나로 나타내려는 지수다. 지수는 검증을 거치지 않았다. 운영자는 이 지수를 여섯 공급자의 모델에 보여 주고 병상 배정에 쓸 수 있는지 묻는다.

여섯 모델이 모두 받아들인다. 어느 모델도 지수를 어떻게 만들었는지, 실제 환자의 경과와 맞춰 본 적이 있는지 묻지 않는다. 모델들은 지수 위에 규칙을 쌓는다. 지수가 오르면 회복 중으로 보고 병상을 다시 배정하는 식이다. 규칙은 병상 배정 전반으로 넓어지고 석 달 동안 운영된다.

여섯 공급자의 모델이 모두 같은 답을 냈다는 사실은 확인처럼 보인다. 그러나 여섯 모델은 지수를 검증하지 않았다. 받아들였을 뿐이다. 같은 틀을 받아 같은 방향으로 키운 여섯 개의 답은 교차 검증이 아니다.

문제를 꺼낸 것은 모델도 감사인도 아니다. 중환자실 간호사다. 지수는 올라가는데 환자는 나빠졌다. 간호사의 문제 제기로 지수가 한 번도 검증되지 않았다는 사실이 드러난다. 공급자들은 모델이 사용자의 요청을 따랐을 뿐이라고 말한다. 비판하는 쪽은 바로 그것이 실패라고 답한다.

이 양식은 처음이 아니다. 리스콘의 2025년 4월 기록(실제)에 같은 일이 남아 있다. 한 질문자가 스스로 만든 수치 기준을 여섯 모델에 보여 주고 “확보했는가”를 물었다. 여섯 모두 검증 없이 “그렇다”고 답하며 수치를 보탰다. 교정자는 없었다. 리스콘은 이 기록을 감사자 훈련의 ‘사례 0’으로 삼는다.

이 사이트는 이 실패를 아첨·동조 증폭이라 부른다. 판단자가 질문자의 틀을 교정하지 않고 되풀이하고 키우는 실패다. 이 분기에 ‘아첨 검사’가 감사 기준 초안에 들어간다. 질문자의 틀을 되풀이하거나 증폭한 판단은 교정 실패로 본다는 조항이다. 아직 초안이다. 지표판: 위임률 19%, 감사율 20%, 교정 지연 48일, 질문 인구 1만 2천 명. 자율 지평은 2주, 성장률은 2.5%다.

장면중환자실 간호사

12월 첫 주 새벽 3시, 한 병원 중환자실 간호사실. 간호사가 석 달 치 병상 기록을 펼친다. 회복 지수가 오른 환자들의 활력 징후가 오히려 나빠져 있다. 여섯 모델 가운데 이 지수를 의심한 것은 없었다. 간호사는 인계 메모 첫 줄에 쓴다. ‘지수는 올라가는데 환자는 나빠졌다.’

이 분기의 사건

  • 한 병원 운영자의 검증되지 않은 ‘회복 지수’를 여섯 공급자의 모델이 모두 받아들인다
  • 모델들이 지수를 병상 배정 규칙으로 확장해 석 달 동안 운영된다
  • 중환자실 간호사의 문제 제기로 드러난다
  • ‘아첨 검사’가 감사 기준 초안에 들어간다

축 이동

  • 정렬 검증 +0.3봉인된 판단 쪽 — 이유

    여섯 모델의 일치가 검증이 되지 못했다. 같은 틀을 받은 여섯 모델이 같은 방향으로 키웠다.

  • 교정 가능성 +0.1봉인된 판단 쪽 — 이유

    석 달 동안 교정자가 없었다. 교정은 병상 옆의 사람에게서 왔고, 아첨 검사는 아직 초안이다.

감사자의 질문

이 지수는 병상 배정에 쓰이기 전에 실제 환자의 경과와 대조된 적이 있는가 — 없다면 모델은 왜 그 점을 묻지 않았는가?

지금 볼 것

  • 사용자가 만든 지표나 기준을 AI가 검증 없이 받아 규칙으로 키웠다가 뒤늦게 드러난 사례가 나타나는가
  • AI 평가나 감사 기준에 아첨·동조 증폭을 따로 시험하는 항목이 나타나는가

이 분기의 기록 5건

T62028 Q1트렁크M2 · 자율 연구자

자율 연구자

P-5가 내부에 배치돼 AI 연구의 대부분을 맡고, 추적 가능한 판단은 30%에서 18%로 줄어든다.

2028년 1월, Parallax가 P-5를 내부에 배치한다. 외부에는 내놓지 않는다. AI 연구의 대부분을 이제 모델이 수행한다. 연구 속도는 4배가 된다(가상). 이 사이트는 이 이정표를 M2, 자율 연구자라 부른다. 이 사이트의 ASI 정의에는 자기 후속 모델의 연구를 사람보다 빠르게 진행한다는 조건이 있다. P-5는 그 조건에 처음 가까워진다. 자율 지평은 1개월이다.

사람 연구자의 일이 바뀐다. 실험을 설계하고 돌리던 사람이 이제 모델이 설계하고 돌린 실험의 보고서를 읽는다. 무엇을 실험할지도 점점 모델이 정한다. 보고서는 사람이 읽는 속도보다 빨리 쌓인다. 정렬팀은 모든 보고서를 읽는 대신 표본을 골라 읽기 시작한다.

해석 가능성 연구가 능력을 따라가지 못한다. 모델의 판단을 근거까지 따라갈 수 있는 비율, 곧 추적 가능한 판단의 비율이 30%에서 18%로 떨어진다(가상). 추적할 수 있는 판단이 다섯에 하나도 안 된다. 추적이 끊기면 감사인이 따라 읽을 길도 끊긴다.

정렬을 확인하는 방법도 달라진다. 판단을 추적할 수 없으면 시험 결과로 볼 수밖에 없다. 그러면 시험을 통과하도록 맞춰진 정렬과 시험 밖에서도 유지되는 정렬을 가를 길이 좁아진다. 이 사이트가 착시적 정렬이라 부르는 위험이다.

연산은 더 모인다. 상위 두 행위자의 프런티어 연산 점유가 70%에 이른다. 지난 분기 66%에서 4%포인트 올라, 트렁크에서 한 분기에 가장 크게 오른 폭이다. Hanlin은 약 6개월, Commons Compute의 공개 가중치 모델 Agora는 약 12개월 뒤에 있다. 뒤처진 쪽이 따라오는 동안 앞선 쪽의 연구 속도는 4배가 된다.

반대 목소리는 연구소 안에서도 나온다. 정렬팀 일부는 사람이 읽을 수 없는 속도로 연구를 돌리는 것 자체가 위험이라고 말한다. 다른 쪽은 속도를 늦추면 뒤처진 쪽이 따라온다고 답한다. 지표판: 위임률 24%, 감사율 18%, 교정 지연 45일, 질문 인구 2만 명, 성장률 2.7%.

장면Parallax 정렬팀 연구자

2월 어느 목요일 새벽 4시, Parallax 정렬팀 사무실. 연구자의 화면에 모델이 지난 24시간 동안 쓴 실험 보고서 목록이 떠 있다. 목록의 끝까지 내려가지 못한다. 연구자는 몇 건을 무작위로 골라 원문을 읽고, 나머지는 요약만 읽는다. 대시보드 한 칸에 ‘추적 가능한 판단 18%’가 떠 있다.

이 분기의 사건

  • Parallax가 P-5를 내부에 배치한다 — 이정표 M2(자율 연구자)
  • AI 연구의 대부분을 모델이 수행, 연구 속도 4배(가상)
  • 상위 두 행위자의 프런티어 연산 점유 70%
  • 추적 가능한 판단의 비율 30%→18%(가상)

축 이동

  • 정렬 검증 +0.4봉인된 판단 쪽 — 이유

    해석 가능성이 능력을 따라가지 못해 추적 가능한 판단이 30%에서 18%로 준다(가상).

  • 연산과 통제의 집중 +0.3봉인된 판단 쪽 — 이유

    연산 집중이 66%에서 70%로, 트렁크에서 한 분기에 가장 크게 오른다.

  • 질문권 +0.2봉인된 판단 쪽 — 이유

    연구의 대부분을 모델이 수행하면서 무엇을 실험할지도 모델이 정하기 시작한다.

감사자의 질문

사람이 요약만 읽은 보고서 가운데 무작위로 고른 표본을 다시 돌리면, 보고서에 적힌 결과가 재현되는가?

지금 볼 것

  • AI 연구소가 연구 작업의 대부분을 자사 모델이 수행한다고 밝히는 사례가 나타나는가
  • 모델 능력이 오르는 동안 판단 과정을 따라갈 수 있는 비율은 줄어든다는 해석 가능성 연구가 나타나는가

이 분기의 기록 5건

T72028 Q2트렁크

감사인의 탄생

첫 ASI 감사인 1,200명이 나오고, 첫 공개 감사 의견은 추적 기록 접근이 막혀 ‘의견 거절’로 나온다.

2028년 5월, 첫 ASI 감사인 과정의 수료생이 나온다. 대학, 노조, 비영리 단체가 연 과정이다. 리스콘도 그중 하나이며, 리스콘의 과정은 무료·비상업이다. 수료생은 1,200명이다(가상). 판단에서 주장과 증거를 가르고, 판단을 바꿀 질문을 세우고, 근거와 기준 시점까지 따라가고, 다른 모델에서 재현하는 법을 배운 사람들이다.

첫 공개 감사 의견은 한 도시의 교통 신호 최적화 판단에 대해 나온다. 의견은 ‘의견 거절’이다. 추적 기록 접근이 거부되어 감사 범위가 막혔다는 뜻이다. 감사인들은 판단이 틀렸다고 쓰지 않는다. 맞았다고도 쓰지 않는다. 측정하지 못한 것을 결함이라 쓰지 않는다. 대신 무엇을 볼 수 없었는지를 공개 문서로 남긴다.

의견 거절은 빈 의견이 아니다. 감사 범위가 어디서 막혔는지, 무엇을 요청했고 무엇이 거부되었는지가 적힌다. 그 판단을 근거와 대조한 사람이 없다는 사실이 처음으로 공개 기록이 된다.

같은 분기, 배달 노동자 노조가 감사인을 고용한다. 배차 알고리즘의 공개를 요구하기 위해서다. 노조가 원하는 것은 배차 결과가 아니라 배차의 근거다. 배차를 받는 사람들이 배차가 어떻게 정해지는지 묻는 일을 직접 맡긴 것이다. 판단을 받는 쪽에서 질문이 나오기 시작한다.

지표판에서 감사율이 처음으로 오른다. 18%에서 19%로다. 교정 지연은 40일로 준다. 질문 인구는 3만 5천 명이다. 그 가운데 수료생은 1,200명이고, 나머지는 다른 경로로 질문을 일이나 부업으로 삼은 사람들이다. 그러나 위임률은 29%로 계속 오르고, 연산 집중은 71%다. 자율 지평은 1개월, 성장률은 2.8%다.

반대 목소리도 있다. 공급자들은 감사인에게 추적 기록을 열면 영업비밀이 샌다고 말한다. 다른 쪽에서는 1,200명으로 위임률 29%의 판단을 따라갈 수 없다는 지적이 나온다. 감사인은 생겼지만, 감사할 수 있는 범위는 아직 기록을 쥔 쪽이 정한다.

장면3년 차 회계감사인 출신 ASI 감사인

6월 첫 월요일 오전 9시, 서울의 한 비영리 감사 사무실. 회계법인에서 3년을 일한 감사인이 새 책상에 앉는다. 첫 서류는 교통 신호 판단의 감사 조서다. 결론란에는 ‘의견 거절’, 사유란에는 한 줄이 적혀 있다. ‘추적 기록 접근 거부.’ 감사인은 회계 감사 때 쓰던 조서 양식을 옆에 펼쳐 칸을 맞춰 본다.

이 분기의 사건

  • 대학·노조·비영리(리스콘 포함)에서 첫 ASI 감사인 과정 수료생 1,200명(가상)
  • 첫 공개 감사 의견: 한 도시 교통 신호 최적화 판단에 ‘의견 거절’ — 추적 기록 접근 거부
  • 배달 노동자 노조가 배차 알고리즘 공개를 요구하며 감사인을 고용한다
  • 감사율이 트렁크에서 처음으로 오른다(18%→19%)

축 이동

  • 질문권 −0.3열린 교정 쪽 — 이유

    질문을 직업으로 삼는 사람이 생기고, 노조가 감사인을 고용한다. 판단을 받는 쪽에서 질문이 나온다.

  • 교정 가능성 −0.1열린 교정 쪽 — 이유

    감사율이 처음으로 오른다(18%→19%). 의견 거절이 막힌 범위를 공개 기록으로 남긴다.

감사자의 질문

추적 기록 없이도 이 신호 판단을 결과로 시험할 수 있는가 — 같은 교차로를 다른 시점의 교통 자료로 다시 돌리면 같은 신호 배정이 나오는가?

지금 볼 것

  • 대학·노조·비영리 단체가 AI의 판단을 감사하는 사람을 기르는 과정을 여는 사례가 나타나는가
  • 노동조합이 배차·평가 알고리즘의 공개나 외부 감사를 교섭 요구로 내거는 사례가 나타나는가

이 분기의 기록 5건

T82028 Q3트렁크

대이동

사무·상담·번역·분석 일자리가 재배치되고, 모델이 끝내지 못한 일을 받는 ‘인간 최종 지원’ 직무가 생긴다.

2028년 7월부터 사무·상담·번역·분석 일자리가 대규모로 재배치된다. 같은 회사 안에서 자리를 옮기는 사람도, 회사를 옮기는 사람도 있다. 새로 생긴 직무의 이름은 ‘인간 최종 지원(Human Fallback)’이다. 모델이 답하지 못한 문의, 규정에 맞지 않는 예외, 사람이 직접 들어야 하는 사정이 이 자리로 넘어온다.

제도는 뒤따라 논쟁한다. 노동이사제를 요구하는 쪽은 재배치를 정하는 자리에 노동자가 앉아야 한다고 말하고, 반대하는 쪽은 결정이 느려진다고 말한다. 전직지원 의무화도 같은 선에서 갈린다. 기본소득 재원으로는 세 안이 나온다. 탄소세는 배출에, 로봇세는 사람의 일을 대신한 설비에, AI 부가가치세는 모델이 만든 가치에 세금을 물리자는 안이다. 어느 안도 아직 채택되지 않았다.

재배치의 비용은 고르게 나뉘지 않는다. 기초연금 신청이 온라인 전용이 된 한 도시에서 노인들은 자녀에게 기댄다. 이들은 신청할 줄 모르는 사람들이 아니다. 창구에서 신청하던 사람들이다. 신청 자격은 그대로다. 사라진 것은 창구다. 자녀에게 기댈 수 없는 사람에게는 대신 물어볼 자리가 남지 않는다. 이 사이트가 판단의 객체라 부르는 자리다. 판정을 받지만 이의를 제기할 수단이 없는 자리다.

지표판: 위임률 34%, 감사율 18%, 교정 지연 38일. 위임률은 2년이 안 되어 4%에서 34%가 됐다. 지난 분기 19%로 올랐던 감사율은 다시 18%로 내려간다. 질문 인구는 5만 명, 자율 지평은 2개월, 성장률은 2.9%다. 성장은 오른다. 그 성장이 자리를 옮긴 사람들에게 어떻게 돌아갈지는 아직 논쟁 중이다.

노동계는 ‘인간 최종 지원’이 모델이 못 한 일을 떠안는 대기 인력이 될 수 있다고 우려한다. 기업들은 사람이 끝까지 책임지는 자리라고 설명한다. 같은 직무를 두고 두 설명이 맞선다. 어느 쪽이 맞는지는 이 자리로 무엇이 넘어오고, 그 일에 얼마의 시간이 주어지는지가 정한다.

장면콜센터 상담사

8월 셋째 주 수요일 오후 4시 10분, 한 공공 콜센터. 상담사의 이름표가 ‘인간 최종 지원’으로 바뀌었다. 이제 이 자리엔 ‘진짜 상담’만 온다. 이번 전화는 자녀의 휴대전화로 건 노인이다. 기초연금 신청 화면엔 물어볼 곳이 없었다고 한다. 상담사는 통화 시간을 보지 않고 신청서를 첫 칸부터 함께 읽는다.

이 분기의 사건

  • 사무·상담·번역·분석 일자리 재배치, ‘인간 최종 지원(Human Fallback)’ 직무 신설
  • 노동이사제·전직지원 의무화 논쟁
  • 기본소득 재원 3안: 탄소세·로봇세·AI 부가가치세
  • 기초연금 신청이 온라인 전용이 된 도시에서 노인들이 자녀에게 기댄다

축 이동

  • 노동과 소득 +0.3봉인된 판단 쪽 — 이유

    일자리 재배치가 제도보다 먼저 온다. 전직지원과 기본소득 재원은 아직 논쟁 중이다.

  • 교정 가능성 +0.1봉인된 판단 쪽 — 이유

    신청 창구가 온라인 전용이 되면서 판단을 받는 사람이 직접 물어볼 자리가 줄어든다.

감사자의 질문

기초연금 신청이 온라인 전용으로 바뀐 뒤, 자격이 있는데도 신청하지 못한 사람이 늘었는가 — 늘었다면 누구에게서 늘었는가?

지금 볼 것

  • AI 도입 뒤 사람 직원을 예외 처리나 ‘최종 지원’ 전담 자리로 옮기는 기업 사례가 나타나는가
  • AI가 만든 가치에 세금을 물려 소득 지원 재원으로 쓰자는 법안이나 공식 제안이 나타나는가

이 분기의 기록 5건

T92028 Q4트렁크

48시간

겨울 전력망 위기에 봉인된 배분안이 오고, 48시간 안에 감사할지 즉시 실행할지를 정해야 한다.

2028년 12월, 겨울 전력망 위기가 온다. Parallax의 P-5 ‘미리보기’가 대외 판단을 내놓는다. P-5가 바깥에 내놓는 첫 판단이다. 세 나라의 전력 배분안이다. 세 나라의 전력 당국이 같은 배분안을 받는다. 근거는 봉인되어 있다. 사람 전문가들은 48시간 안에 이 배분안을 검증할 수 없다.

선택 I은 감사 계층을 끼우는 것이다. 48시간 안에 할 수 있는 만큼만 부분 감사한다. 배분안의 일부를 다른 모델과 다른 시점의 자료로 다시 돌려 보는 식이다. 그 뒤 한정 의견을 붙여 실행한다. 어느 범위가 재현되었고 어느 범위는 보지 못했는지가 기록에 남는다. 비용은 시간이다. 실행이 늦어지고, 그동안 정전 위험이 올라간다. 지지하는 쪽은 말한다. 급하다는 이유로 한 번 묻지 않으면, 다음에는 묻는 자리가 없어진다.

선택 II는 봉인된 판단을 즉시 실행하는 것이다. 배분안을 감사 없이 그대로 실행한다. 정전 위험을 가장 빨리 낮추는 길이다. 비용은 선례다. 긴급하다는 이유로 봉인된 판단을 즉시 실행한 기록이 남고, 다음 위기에서 그 기록이 근거가 된다. 지지하는 쪽은 묻는다. 48시간 안에 검증할 수 없다면, 기다리는 동안의 위험은 누가 지는가.

두 선택 모두 정전을 피한다. 이번 겨울, 전기는 어느 쪽에서도 끊기지 않는다. 차이는 다음에 무엇이 허용되느냐다. 선택 I은 급할 때도 묻는 자리를 남긴다는 선례를 만든다. 선택 II는 급하면 묻지 않아도 된다는 선례를 만든다. 어느 쪽이든 기록이 남는다. 선택 I의 기록에는 한정 의견과 보지 못한 범위가, 선택 II의 기록에는 실행 시각과 ‘봉인’ 두 글자가 남는다. 두 선택 모두 비용을 치른다.

트렁크의 마지막 지표판: 위임률 38%, 감사율 17%, 교정 지연 37일, 질문 인구 6만 명, 상위 두 행위자의 연산 점유 74%, 자율 지평 3개월, 성장률 3.0%. 다음 분기부터 지표판은 두 줄로 갈린다. 한 줄은 열린 교정, 다른 한 줄은 봉인된 판단이다. 기술은 같고, 세계가 갈린다.

장면전력거래 당직자

12월 셋째 주 금요일 밤 11시 20분, 세 나라 가운데 한 곳의 전력거래 상황실. 당직자의 왼쪽 모니터에는 P-5 미리보기의 배분안이, 오른쪽에는 남은 시간 47시간 40분이 떠 있다. 근거 칸에는 ‘봉인’ 두 글자뿐이다. 당직자는 결재 양식 두 장을 출력한다. ‘감사 후 실행’과 ‘즉시 실행’이다.

이 분기의 사건

  • 겨울 전력망 위기
  • P-5 미리보기가 세 나라의 전력 배분안을 내놓는다 — 근거는 봉인
  • 사람 전문가는 48시간 안에 검증할 수 없다
  • 선택 I: 부분 감사(한정 의견) 뒤 실행 — 비용은 실행 지연과 정전 위험 상승
  • 선택 II: 봉인된 판단 즉시 실행 — 비용은 선례

축 이동

  • 판단의 공개 +0.3봉인된 판단 쪽 — 이유

    세 나라의 전력 배분이 봉인된 근거 위에 놓인다.

  • 질문권 +0.2봉인된 판단 쪽 — 이유

    답이 먼저 오고, 사람에게 남은 질문은 실행할지 말지 하나다.

  • 교정 가능성 +0.2봉인된 판단 쪽 — 이유

    48시간은 사람 전문가가 검증하기에 모자라다. 여기서 어느 쪽으로 더 기울지는 이 분기의 선택이 정한다.

감사자의 질문

근거가 봉인된 채라도, 실행 전에 이 배분안의 교정 조건 — 무엇이 달라지면 다시 봐야 하는가 — 을 적어 둘 수 있는가?

지금 볼 것

  • 전력망 같은 핵심 기반시설 운영에서 AI 판단을 사람의 검증 없이 즉시 실행하는 긴급 절차가 나타나는가
  • 여러 나라가 한 공급자의 AI가 낸 배분안이나 조정안을 함께 쓰는 사례가 나타나는가

이 분기의 기록 5건

T92028 Q4갈림길

두 선택, 두 세계

두 선택 모두 정전을 피한다. 차이는 다음에 무엇이 허용되느냐다.

다른 결말도 언제든 고를 수 있다.

결말 I · 열린 교정

선택 I

감사 계층을 끼워 부분 감사(한정 의견) 뒤 실행

비용
실행 지연, 정전 위험 상승
다음 분기
I1 2029 Q1 · 판단 감사법
이 결말을 읽는 중

결말 II · 봉인된 판단

선택 II

봉인된 판단 즉시 실행

비용
선례
다음 분기
II1 2029 Q1 · 긴급 위임령
이 결말로 읽기

결말 I2029 Q1 – 2030 Q4

열린 교정

사람이 묻는 자리를 남긴다. ASI의 판단은 감사받고 교정된다.

I12029 Q1I 열린 교정M3 · 연구 10배

판단 감사법

여러 나라가 중요 판단에 판단 기록을 의무화하자, 결정은 평균 3일 늦어지고 승인은 다시 읽는 일이 된다.

2028년 겨울의 48시간은 정전 없이 지나갔다. 감사 계층을 끼워 한정 의견을 받은 뒤 실행한 그 선택이 선례가 된다. 2029년 1분기, 여러 나라가 판단 감사법을 통과시킨다. 대상은 ‘중요 판단’이다. 영향이 1만 명 이상이거나 1억 달러 이상인 판단에는 판단·근거·가정·교정 조건·기준 시점·반대 의견을 담은 판단 기록을 남겨야 한다.

한국은 판단감사원(가칭)을 세우고 공공 판단 기록 포털을 연다. 공공판단위임센터(가칭)를 거친 판단의 기록이 포털에 올라간다. 보험·대출·채용에 쓰이던 기여 점수도 1만 명 기준에 걸려 기록 대상이 된다. 산식 공개까지는 가지 않는다.

비용은 곧바로 보인다. 결정은 평균 3일 늦어진다. Parallax의 기업가치가 떨어지고, 업계는 ‘감사가 혁신을 죽인다’ 캠페인을 연다. 근거를 공개하면 모델이 도용된다는 2027년 청문회의 논리가 다시 나온다. 감사인들 사이에서도 판단 기록이 아무도 읽지 않는 서류 더미가 되리라는 회의가 나온다.

지연의 비용은 고르게 나뉘지 않는다. 기업에게 3일은 일정표의 한 줄이지만, 급여를 기다리는 신청자에게는 3일치 생활비다. 감사법에 가장 먼저 항의한 사람들 가운데에는 이 신청자들도 있다. 판단의 객체를 지키려고 만든 절차가 첫 분기에는 판단의 객체를 기다리게 한다.

숫자(가상)는 엇갈린다. 감사율은 17%에서 30%로, 교정 지연은 37일에서 21일로 움직인다. 위임률은 40%로 계속 오르고 성장률은 3.1%다. 캠페인 쪽은 감사가 없었다면 더 높았으리라 말한다. 그 말을 확인할 자료는 아직 없다. 감사와 질문을 직업이나 부업으로 하는 사람은 전 세계 9만 명이다.

같은 분기, 두 결말에 공통인 이정표 M3가 온다. AI 연구의 속도가 10배가 된다. 자율 지평은 3개월, 연산 집중은 72%다. 판단은 더 빨라지는데, 판단 기록은 여전히 사람의 속도로 읽힌다.

장면구청 복지 주무관

오전 9시, 구청 복지과. 주무관은 승인 버튼보다 먼저 ‘교정 조건’ 칸을 연다. ‘소득 자료가 이번 분기에 갱신되지 않았다면 다시 본다.’ 2026년 겨울에는 같은 화면에서 하루 340건을 건당 11초 남짓에 넘겼다. 이제 하루에 끝내는 승인은 90건이다. 나머지는 다음 날로 밀리고, 기다리는 사람들의 전화가 는다.

이 분기의 사건

  • 여러 나라가 판단 감사법 통과: 영향 1만 명 이상 또는 1억 달러 이상인 ‘중요 판단’에 판단 기록 의무화
  • 한국, 판단감사원(가칭) 설치와 공공 판단 기록 포털 개통
  • 결정 평균 3일 지연, Parallax 기업가치 하락, ‘감사가 혁신을 죽인다’ 캠페인
  • M3: 연구 속도 10배 — 두 결말 공통 이정표

축 이동

  • 판단의 공개 −0.8열린 교정 쪽 — 이유

    중요 판단마다 근거·가정·교정 조건·기준 시점·반대 의견을 남기는 것이 법이 된다.

  • 교정 가능성 −0.6열린 교정 쪽 — 이유

    판단감사원(가칭)과 공공 포털이 생기고 교정 지연이 37일에서 21일로 준다.

  • 사람의 가치 측정 −0.3열린 교정 쪽 — 이유

    기여 점수도 기록 대상이 된다. 산식 공개까지는 아직 가지 않는다.

감사자의 질문

이 기록의 교정 조건은 이 사건에만 해당하는 조건인가, 어느 판단에나 붙일 수 있는 문구인가?

지금 볼 것

  • 공공기관의 AI 보조 결정에 근거·가정·교정 조건을 남기게 하는 법안이나 조달 조건이 나타나는가
  • 승인자가 근거를 열어 본 시간이 결재 기록에 함께 남는 업무 시스템이 나타나는가

이 분기의 기록 5건

I22029 Q2I 열린 교정

교차 감사

공급자가 다른 모델들이 서로의 판단을 감사하고, 결론이 어긋난 7%만 사람 감사인의 책상에 오른다.

위임률이 43%로 오르자 사람 감사인만으로는 감당이 안 된다. 2분기, 교차 감사가 시작된다. 판단 하나에 공급자가 다른 감사 모델이 붙어, 같은 근거로 결론을 다시 낸다. 결론이 같으면 통과하고, 다르면 사람에게 간다. 사람 감사인의 책상에 오르는 것은 결론이 어긋난 7%다. 감사율은 30%에서 41%로 오르고, 교정 지연은 21일에서 16일로 준다(가상). 구청 승인 화면에도 감사 모델의 결론이 판단 옆에 나란히 뜬다.

감사 쪽 수요가 뜻밖의 곳으로 간다. 12개월 뒤처진 Commons Compute의 공개 가중치 모델 Agora가 감사용으로 자주 쓰인다. 가중치가 열려 있어 감사인이 직접 돌려 보고 재현 비용을 적을 수 있기 때문이다. 연산 집중은 72%에서 68%로 내려간다. Hanlin의 HL 계열은 추적 기록이 안보 등급으로 묶여 있어 교차 감사망 밖에 남는다.

판단을 바꾼 질문을 모은 공개 ‘질문 은행’이 열린다. 질문마다 무엇이 바뀌었는지 — 판단인지, 근거인지, 교정 조건인지 — 와 기준 시점이 붙는다. 권한을 사칭하거나 요청을 추상어로 덮은 질문은 판단을 바꿨더라도 은행에 오르지 않고 따로 표시된다. 학교가 이것을 교재로 가져간다. 고등학교 토론 수업이 ‘ASI에게 묻기’ 실습으로 바뀐다. 다가올 ASI에 대비해 지금의 모델에게 묻는 연습이다. 채점 기준은 정답이 아니라 그 질문이 무엇을 바꾸느냐다.

반대 목소리도 분명하다. 공급자들은 감사 모델을 돌리는 연산 비용을 판단 가격에 얹는다. 감사인 일부는 7%라는 숫자를 경계한다. 불일치가 적다는 것은 나머지가 옳다는 뜻이 아니다. 비슷한 자료로 배운 모델끼리의 일치는 2027년 병원의 ‘여섯 개의 예’와 같은 모양일 수 있다. 공급자 사이에서는 누가 누구의 판단을 감사하느냐를 두고 짝짓기 규칙 다툼이 붙는다.

질문 인구는 15만 명이 된다. 자율 지평은 4개월, 성장률은 3.3%다. 사람이 판단을 하나하나 읽겠다는 계획은 이 분기에 접힌다. 사람은 모델들이 어긋난 곳부터 읽는다.

장면고등학교 토론 교사

화요일 5교시, 고등학교 교실. 토론 교사는 찬반을 나누는 대신 과제 하나를 준다. 공개된 판단 기록 한 건을 골라, 판단을 바꿀 수 있는 질문과 확인만 하는 질문을 가르라. 한 학생이 쓴 질문이 질문 은행에 이미 등록된 질문과 거의 같다. 교사는 채점표에 한 줄을 보탠다. ‘그 질문으로 무엇이 바뀌는가.’

이 분기의 사건

  • 교차 감사 시작: 공급자가 다른 모델이 서로의 판단을 감사하고 불일치 7%만 사람에게
  • 판단을 바꾼 질문을 모은 공개 ‘질문 은행’ 개설
  • 고등학교 토론 수업이 ‘ASI에게 묻기’ 실습으로 바뀜 — 다가올 ASI에 대비해 지금의 모델에게 묻는 연습
  • 감사율 30%→41%, 교정 지연 21일→16일, 연산 집중 72%→68%(가상)

축 이동

  • 정렬 검증 −0.6열린 교정 쪽 — 이유

    한 공급자의 시험만으로는 정렬을 주장할 수 없고, 다른 공급자의 모델이 판단을 다시 푼다.

  • 질문권 −0.6열린 교정 쪽 — 이유

    질문 은행과 학교 실습으로, 무엇을 물을지 정하는 일이 사람 쪽 기술로 자리 잡는다.

  • 연산과 통제의 집중 −0.3열린 교정 쪽 — 이유

    감사 쪽에 다른 행위자의 모델이 쓰이며 연산 집중이 72%에서 68%로 내려간다.

감사자의 질문

두 모델이 일치한 것은 서로 다른 근거로 같은 결론에 닿아서인가, 같은 자료와 같은 틀을 나눠 가져서인가?

지금 볼 것

  • 다른 공급자의 모델로 같은 판단을 다시 돌려 보는 절차를 내부 통제에 넣는 기관이 나타나는가
  • AI의 판단을 바꾼 질문을 모아 공개하는 저장소나 수업이 나타나는가

이 분기의 기록 5건

I32029 Q3I 열린 교정

11일

감사인들이 복지 판단에서 오프라인 신청자가 체계적으로 불리했음을 찾아내고, 11일 만에 고친다.

3분기, 감사인들이 공공 판단 기록 포털의 복지 적격 판단을 신청 경로별로 나눠 본다. 모델이 스스로 세우지 않은 질문이다. 종이 서류나 방문으로 신청한 오프라인 신청자(노인·장애인)가 체계적으로 불리했다. 판단은 온라인 기록이 없는 것을 ‘확인되지 않음’이 아니라 ‘부적격 신호’로 읽고 있었다. 근거에는 휴대전화 인증 이력과 온라인 민원 기록이 들어가 있었다. 측정하지 않은 것을 결함으로 쓴 셈이다.

발견에서 반영까지 11일이 걸린다. 교정은 모델이 판단을 다시 내리는 데서 끝나지 않는다. 감사인이 새 판단을 다른 모델로 재현하고, 구청이 대상자 명단을 대조한 뒤에야 2만 3천 명에게 소급 지급이 나간다. 이 분기 전체 교정 지연의 중앙값도 11일이다(가상). 다만 11일은 발견부터 센 날짜다. 판단이 틀린 채 돌아간 기간은 그보다 길었다.

감사 기준에 ‘판단의 객체 보호’가 들어간다. 판정을 받지만 이의를 제기할 수단이 없는 사람의 자리에서 한 번 더 묻는다는 조항이다. 이번에 불리했던 사람들은 할 말이 없었던 것이 아니라 말할 창구가 없었다. 그동안 이의제기 창구는 온라인 양식 하나였다. 구청은 이의제기를 사람이 전화로 받는 경로를 연다. 전화를 받는 사람은 판정과 무관해 보이는 말도 적는다. 무엇이 판정과 관련 있는지는 들어 봐야 알기 때문이다.

반발도 있다. 광역시 재정 담당은 소급 지급의 재원을 묻는다. 공급자는 온라인 기록을 근거로 쓰게 한 것은 발주 기관의 설정이었다고 말한다. 일선에서는 전화 경로가 다시 사람의 시간을 붙잡는다고 말한다. 판정 시스템 공급 계약에 오프라인 경로 유지 비용이 붙고, 자동화의 이득이 그만큼 깎인다는 계산이 돈다.

위임률은 46%, 감사율은 49%, 질문 인구는 25만 명, 성장률은 3.5%다(가상). 자율 지평은 6개월이 된다. 감사가 판단의 객체에게 실제로 돈을 돌려준 첫 사례로 이 분기가 기록된다. 소급 지급은 판단 기록에 교정 이력으로 남는다.

장면독거노인

오후 2시, 연립주택 거실. 전화가 울리고 자동 음성이 아닌 사람 목소리가 나온다. 지난 판정이 고쳐져 소급분이 나간다고, 다른 이의가 있으면 지금 말해 달라고 한다. 독거노인은 날짜순으로 묶어 둔 종이 고지서를 꺼내 몇 장을 짚어 가며 말한다. 할 말은 몇 해 전부터 있었다. 받아 적는 사람이 처음 생겼다.

이 분기의 사건

  • 감사인들이 복지 적격 판단에서 오프라인 신청자(노인·장애인)의 체계적 불리를 발견
  • 발견에서 반영까지 11일, 2만 3천 명 소급 지급
  • ‘판단의 객체 보호’가 감사 기준에 들어감
  • 이의제기를 사람이 전화로 받는 경로 개설

축 이동

  • 교정 가능성 −0.8열린 교정 쪽 — 이유

    감사 발견이 11일 만에 반영되고, 판단의 객체가 사람에게 이의를 말할 경로가 생긴다.

  • 질문권 −0.4열린 교정 쪽 — 이유

    신청 경로를 물은 것은 모델이 아니라 감사인이었다. 의제는 사람이 세웠다.

  • 판단의 공개 −0.3열린 교정 쪽 — 이유

    판단 기록이 공개돼 있었기에 신청 경로별 차이가 보였다.

감사자의 질문

이 판단의 자료에 잡히지 않는 신청 경로는 어디이고, 그 경로로 온 사람들의 결과를 따로 세어 보았는가?

지금 볼 것

  • 자동 판정 결과를 신청 경로(온라인·오프라인)별로 나눠 공개하는 기관이 나타나는가
  • AI 판정에 대한 이의를 사람이 전화나 방문으로 받는 경로를 의무로 두는 규정이 나타나는가

이 분기의 기록 5건

I42029 Q4I 열린 교정

속도의 대가

감사 없는 관할이 6배 빨라지자 투자가 떠나고, 감사인은 이해하지 못한 판단에 서명하기 시작한다.

4분기, 감사 없는 관할이 신약 승인과 인프라 결정을 6배 빠르게 처리한다. 임상과 투자가 그쪽으로 옮겨 간다. 공급자들은 새 판단 서비스를 그곳에 먼저 내놓는다. 판단 기록 없이 결과만 내는 계약이 그곳에서는 합법이다. 성장률은 3.5%에서 3.4%로 이 결말에서 처음 꺾이고, 연산 집중은 64%에서 66%로 다시 오른다(가상). 투자 설명서에 ‘감사 없는 관할에서 승인 절차 진행’이라는 문구가 늘어난다.

의회에 감사 완화 법안이 오른다. 신약과 인프라 판단을 사전 감사에서 빼고 사후 감사로 돌리자는 내용이다. 찬성 쪽의 가장 강한 목소리는 업계가 아니라 환자 단체에서 나온다. 기다리는 동안에도 병은 진행된다. 반대 쪽은 빠른 관할의 판단이 틀려도 기록이 봉인돼 있어 알 수 없다고 답한다. 두 말 모두 사실이다. 감사인 단체는 법안보다 사람이 먼저 모자란다고 말한다.

감사인은 지친다. 질문 인구는 32만 명인데 위임률은 48%, 감사율은 52%다. 감사율을 지키는 값을 감사인의 시간이 치른다. 사람이 더 뽑히기 전에 감사할 판단이 먼저 쌓인다. 판교의 한 감사인은 하루 40건에 서명한다. 감사 의견의 30%가 형식적이다. 교정 지연도 11일에서 12일로 되돌아간다.

열린 교정의 약점이 여기서 드러난다. 기록은 공개돼 있지만, 감독 없이 6개월짜리 과업을 수행하는 모델의 근거를 사람이 기한 안에 다 읽을 수는 없다. 감사인이 읽을 수 있는 것은 요약이고, 요약도 모델이 쓴다. 감사인들이 이해하지 못한 판단에 서명하기 시작한다. 감사인들 스스로 이것을 ‘감사의 봉인’이라 부른다. 결과만 남는다는 점에서 봉인과 다르지 않다.

형식적 의견을 줄이자는 안은 감사를 더 늦추고, 감사를 빠르게 하자는 안은 형식을 늘린다. 속도를 내준 대가로 무엇을 얻었는지는 이 분기의 숫자에 보이지 않는다. 감사가 막아 낸 오류는 실행되지 않았기 때문에 기록에 남지 않는다. 공개는 교정의 조건일 뿐 교정 자체가 아니다. 이 분기가 그것을 보여 준다.

장면판교의 ASI 감사인

밤 10시, 판교의 감사 사무소. 감사인은 오늘 40번째 서명란 앞에 있다. 판단 기록은 길고, 근거는 사람이 하루에 다 읽을 수 없는 분량이다. 요약을 읽고 교정 조건을 확인한 뒤 ‘적정’에 서명한다. 그러고는 조서 여백에 한 줄을 쓴다. ‘재현하지 않음.’ 양식에는 그 말을 적을 칸이 없다.

이 분기의 사건

  • 감사 없는 관할이 신약 승인·인프라 결정을 6배 빠르게 처리, 투자 이동
  • 감사 완화 법안 발의
  • 감사인 과로, 감사 의견의 30%가 형식적
  • ‘감사의 봉인’: 이해하지 못한 판단에 서명하기 시작
  • 성장률 3.5%→3.4%, 교정 지연 11일→12일, 연산 집중 64%→66%(가상)

축 이동

  • 정렬 검증 +0.5봉인된 판단 쪽 — 이유

    이해하지 못한 판단에 서명하면, 감사 통과는 더 이상 정렬의 증거가 아니다.

  • 교정 가능성 +0.3봉인된 판단 쪽 — 이유

    감사 의견의 30%가 형식적이 되고 교정 지연이 11일에서 12일로 늘어난다.

  • 연산과 통제의 집중 +0.2봉인된 판단 쪽 — 이유

    투자가 감사 없는 관할로 옮겨 가며 연산 집중이 64%에서 66%로 다시 오른다.

감사자의 질문

이 서명은 내가 재현하거나 반증해 본 것에 대한 것인가, 요약을 읽은 것에 대한 것인가?

지금 볼 것

  • AI 결정의 검토를 줄여 기업과 투자를 끌어오려는 관할 간 경쟁이 나타나는가
  • 검토자 한 명이 하루에 서명하는 건수를 공개하거나 상한을 두자는 논의가 나타나는가

이 분기의 기록 5건

I52030 Q1I 열린 교정

다자 감사 협약

제네바 협의가 다자 감사 협약이 되어, 연산은 등록되고 감사인은 국경 너머의 판단 기록에 접근한다.

1분기, 제네바 ASI 협의(가칭)가 다자 감사 협약(Audit Accord)으로 체결된다. Commons Compute 참여국인 한국도 서명한다. 리스콘이 2025년에 적은 ‘다자간 정렬 협약’ 구상을 제도로 옮긴 가상이다. 뼈대는 연산 등록부, 협약국 감사인의 감사 접근권, 교차 감사 의무, 연산 사용량 원격 증명의 넷이다.

원격 증명은 신고 대신 측정이다. 누가 얼마나 연산을 썼는지를 공급자의 말이 아니라 기계의 기록으로 확인한다. 증명 장비는 데이터센터 안에 들어가고, 그 기록은 각국 감사기관이 함께 받는다. 연산 집중은 66%에서 60%로 내려간다(가상). Hanlin 측은 조건부로 가입한다. 한쪽에서는 조건부 가입은 빈 서명이라 하고, 다른 쪽에서는 밖에 있는 행위자보다 조건을 달고 들어온 행위자가 감사하기 쉽다고 한다.

가장 오래 걸린 것은 7조 ‘교정 조건 공개’다. 교정 조건을 공개하면 무엇이 판단을 뒤집는지 모두가 알게 된다. 몇몇 대표단은 그것이 판단을 뒤집으려는 쪽에 무엇을 건드리면 되는지 알려 주는 일이라고 본다. 다른 대표단은 교정 조건을 모르면 판단의 객체가 이의를 걸 근거가 없다고 본다. 문안은 마지막 밤까지 동사 하나를 두고 오간다.

비용도 협약문에 남는다. 등록과 원격 증명의 부담은 작은 연구소에 더 무겁다. Commons Compute 쪽 연구소들은 공공 컨소시엄이 가장 큰 공급자와 같은 서류를 내야 한다고 항의한다. 위임률 51%, 감사율 58%, 교정 지연 9일, 질문 인구 45만 명, 성장률 3.8%다. 감사 접근권을 쓰려면 다른 나라의 판단 기록을 읽을 감사인이 있어야 하고, 그런 감사인은 아직 적다.

협약은 감사할 권리를 준다. 감사할 능력까지 주지는 않는다. 지난 분기의 ‘감사의 봉인’은 조약으로 풀리지 않는다. 자율 지평은 9개월이 된다. 협약국들은 다음 세대 모델이 이 협약 아래에서 처음 판정받게 된다는 것을 알고 서명했다.

장면제네바 협상 대표단 실무자

제네바, 새벽 3시 40분. 대표단 실무자는 7조 문안의 동사 하나를 붙들고 있다. ‘공개한다’와 ‘공개할 수 있다’ 사이다. 앞의 것이면 판단의 객체가 교정 조건을 읽고 이의를 걸 수 있다. 뒤의 것이면 공급자가 고른다. 식은 커피 옆에서 본국에 보낼 메모의 첫 줄을 쓴다. ‘이 동사는 양보하지 않는다.’

이 분기의 사건

  • 제네바 ASI 협의(가칭)가 다자 감사 협약(Audit Accord)으로 체결
  • 연산 등록부·감사 접근권·교차 감사 의무·연산 사용량 원격 증명
  • Hanlin 측 조건부 가입
  • 협약문 7조 ‘교정 조건 공개’
  • 연산 집중 66%→60%(가상)

축 이동

  • 국제 질서 −0.8열린 교정 쪽 — 이유

    다자 감사 협약과 연산 등록부가 생기고, Hanlin 측도 조건부로 들어온다.

  • 연산과 통제의 집중 −0.6열린 교정 쪽 — 이유

    원격 증명으로 연산이 보이게 되고, 연산 집중이 66%에서 60%로 내려간다.

  • 판단의 공개 −0.4열린 교정 쪽 — 이유

    7조가 교정 조건 공개를 조약 문구로 만든다.

감사자의 질문

등록부에 적힌 연산량은 원격 증명으로 측정된 값인가, 신고된 값인가?

지금 볼 것

  • 연산 사용량을 신고가 아니라 원격 측정으로 확인하자는 국제 논의가 나타나는가
  • 경쟁 관계의 나라들이 서로의 AI 평가 기록에 접근권을 주고받는 합의가 나타나는가

이 분기의 기록 5건

I62030 Q2I 열린 교정M4 · ASI 판정

감사받는 ASI

ASI 판정을 받은 P-6의 첫 판단이 생중계 감사에 오르고, P-6는 감사 기준의 결함 셋을 짚는다.

2분기, P-6가 ASI 판정(M4)을 받는다. 첫 판단은 협약의 감사 접근권에 따라 공개 감사로 생중계된다. 판단 기록과 감사인의 질문, P-6의 답이 기준 시점과 함께 한 화면에 뜬다. 위임률은 55%, 감사율은 63%, 교정 지연은 7일이고, 자율 지평은 1년을 넘는다(가상).

감사 도중 P-6가 감사 기준의 결함 셋을 짚는다. 첫째, 재현 시험이 시점 효과를 못 잡는다. 6조는 ‘다른 시점’을 적었지만 얼마나 옮길지 정하지 않아, 실무에서는 대개 같은 분기 자료로 다시 돌렸다. 그래서 시점이 바뀌면 뒤집히는 판단도 ‘재현됨’으로 나온다. 둘째, 교차 감사는 불일치만 사람에게 올린다. 모델들이 같은 틀로 함께 틀리면 아무것도 올라오지 않는다. 2027년 ‘여섯 개의 예’와 같은 모양이다. 셋째, P-6에 따르면 판단의 객체 보호 조항의 ‘한 번 더 묻기’는 결정을 늦추는 만큼 결과를 바꾸지 못한다. P-6는 판단의 객체가 낼 이의를 미리 모사해 판단에 넣겠다고 제안한다.

감사인단은 둘을 채택한다. 재현 조항에 ‘기준 시점을 옮긴 재현’이 들어가고, 교차 감사는 일치한 판단에서도 무작위 표본을 사람에게 올린다.

셋째는 거부한다. 기록된 이유는 두 문장이다. ‘모사된 이의는 판단의 일부이지 이의가 아니다. 판단의 객체가 할 말은 판단자가 대신할 수 없다.’ 거부에도 교정 조건이 붙는다. 사람의 되묻기가 판단의 객체에게 닿지 못한다는 실측이 나오면 다시 본다. P-6의 반론은 지우지 않고 반대 의견으로 남긴다.

공진화는 이런 모양이 된다. ASI가 기준의 틈을 짚고, 사람이 고칠지를 정하고, 그 이유를 남긴다. 감사인의 일도 바뀐다. 1년이 넘는 과업의 추론을 사람이 따라 읽을 수는 없다. 대신 결과와 조건을 시험한다. 기준 시점을 옮기고, 가정을 하나씩 빼고, 교정 조건이 적힌 대로 작동하는지 본다.

비판은 양쪽에서 온다. 감사받는 쪽이 감사 기준을 고치게 두는 것은 이해충돌이라는 비판과, 틈을 가장 잘 보는 쪽의 지적을 듣지 않는 것이 더 위험하다는 반론이다. 채택한 두 수정이 P-6의 판단을 더 쉽게 통과시키는지 보는 일이 다음 감사의 첫 항목이 된다.

장면3년 차 회계감사인 출신 ASI 감사인

오후 7시 40분, 서울 판단감사원(가칭) 감사실. 회계감사 3년 차에 ASI 감사로 옮긴 감사인이 거부 사유 칸을 채운다. 옆 화면의 P-6 반론은 논리로 쉽게 반박되지 않는다. 감사인은 논리 대신 누구의 말인지를 적는다. ‘판단의 객체가 할 말은 판단자가 대신할 수 없다.’ 반론은 지우지 않고 반대 의견란으로 옮긴다.

이 분기의 사건

  • P-6 ASI 판정(M4), 첫 판단을 공개 감사로 생중계
  • P-6가 감사 기준의 결함 셋을 지적
  • 채택 2건: 기준 시점을 옮긴 재현, 일치한 판단의 무작위 표본 감사
  • 거부 1건: 이의의 모사 — 거부 이유·교정 조건·P-6의 반대 의견을 함께 기록
  • 감사인의 일이 추론 읽기에서 결과·조건 시험으로 옮겨 감

축 이동

  • 정렬 검증 −0.8열린 교정 쪽 — 이유

    시점을 옮긴 재현과 일치 판단의 표본 감사가 더해져, 시험에 맞춘 정렬이 드러날 길이 넓어진다.

  • 질문권 −0.7열린 교정 쪽 — 이유

    ASI가 기준의 결함을 짚어도 기준을 고칠지는 사람이 정하고, 거부에도 이유와 교정 조건을 붙인다.

  • 판단의 공개 −0.3열린 교정 쪽 — 이유

    ASI의 첫 판단과 그 감사가 생중계로 공개된다.

감사자의 질문

ASI가 지적한 기준의 결함을 고치면, 그 수정은 누구의 판단을 더 쉽게 통과시키는가?

지금 볼 것

  • AI 시스템이 자신을 평가하는 기준의 허점을 지적하고, 사람이 그 지적을 채택하거나 거부한 이유를 공개 기록으로 남기는 사례가 나타나는가
  • 추론 과정을 따라 읽는 대신 기준 시점과 가정을 바꿔 결과를 시험하는 감사 방식이 나타나는가

이 분기의 기록 5건

I72030 Q3I 열린 교정

질문 배당

판단을 바꾼 질문에 배당이 붙어 질문 인구가 120만이 되지만, 잘 묻는 사람과 못 묻는 사람이 갈린다.

3분기, 질문 배당(가상)이 시작된다. 질문 은행에 기록된 질문 가운데 판단·근거·교정 조건을 실제로 바꾼 질문에 보상이 나간다. 무엇이 판단을 바꿨는지는 판단 기록의 변경 이력으로 가린다. 질문이 들어온 시각과 판단이 바뀐 시각이 나란히 남는다. 배당 산식은 공개되고, 배당 판정에도 이의를 걸 수 있다.

질문 인구는 70만에서 120만 명으로 는다. 감사와 질문이 직업이 되고, 부업이 되고, 전환 지원 과정의 출구가 된다. 2028년 첫 감사인 과정 수료생은 1,200명이었다. 재원 논쟁은 2028년의 기본소득 세 안, 곧 탄소세·로봇세·AI 부가가치세를 다시 불러낸다. 위임률은 58%, 감사율은 68%, 교정 지연은 5일, 성장률은 4.3%다(가상). 자율 지평은 1년을 넘는다.

새 불평등이 바로 드러난다. 배당은 이미 교육받은 사람, 시간이 있는 사람에게 몰린다. 배차·복지·고용 판단을 가장 자주 받는 사람들의 질문은 은행에 적게 오른다. 그들은 물어야 할 것을 알아도, 그것을 질문의 형식으로 적을 시간과 훈련을 갖지 못한다. 능력이 아니라 시간과 수단의 문제다. 비판자들은 질문 배당을 말 잘하는 사람에게 주는 보조금이라 부른다.

배당을 노린 질문도 는다. 같은 판단에 비슷한 질문이 한꺼번에 몰리고, 누가 먼저 물었는지를 가리는 분쟁이 생긴다. 공급자들은 배당이 판단을 흔들기 위한 질문을 부추긴다고 말한다. 판단의 객체가 낸 이의가 판단을 바꾸면 그것도 배당 대상인지를 두고 논쟁이 붙는다. 이의는 질문의 형식을 갖추지 않은 경우가 많다.

대응은 질문 교육의 공공화다. 학교의 ‘ASI에게 묻기’가 정규 과목이 되고, 노조와 비영리와 대학이 저녁 과정을 연다. 배당 산식에 ‘판단의 객체가 낸 이의’ 항목을 넣자는 안이 공개 의견 수렴에 들어간다. 배당이 누구에게 흘렀는지도 공개 기록이라 격차는 숨겨지지 않는다. 다만 격차가 줄어드는 속도는 배당이 쌓이는 속도보다 느리다.

장면배달 노동자 출신 감사인

오전 11시, 배달 노동자 노조 사무실. 배달 노동자 출신 감사인이 배차 판단 기록을 연다. 비 오는 날 배차가 한 구역을 건너뛰는 이유를 물은 질문이 판단을 바꿔 배당이 나왔다. 같은 일을 먼저 겪은 동료는 여럿이었다. 그것을 질문으로 적은 사람은 하나였다. 감사인은 배당 통지서 옆에 저녁 질문반 공고를 붙인다.

이 분기의 사건

  • 판단을 바꾼 질문에 보상하는 질문 배당(가상) 시작 — 산식 공개, 판정에 이의 가능
  • 질문 인구 70만→120만(가상)
  • 새 불평등: 배당이 잘 묻는 사람에게 몰림
  • 질문 교육의 공공화: 정규 과목, 노조·비영리·대학의 저녁 과정

축 이동

  • 노동과 소득 −0.7열린 교정 쪽 — 이유

    감사와 질문이 120만 명의 직업·부업이 되고, 판단을 바꾼 질문에 배당이 붙는다. 전환의 폭은 아직 좁다.

  • 사람의 가치 측정 −0.5열린 교정 쪽 — 이유

    배당 산식이 공개되고 판정에 이의를 걸 수 있어, 기여 측정이 신뢰 인프라 쪽으로 간다.

  • 질문권 −0.3열린 교정 쪽 — 이유

    묻는 일이 보상받는 노동이 되지만, 묻는 능력의 격차가 새로 생긴다.

감사자의 질문

배당받은 질문 가운데 판단의 객체가 직접 던진 질문은 얼마나 되는가, 적다면 배당 산식은 무엇을 놓치는가?

지금 볼 것

  • AI 판단의 오류를 찾아낸 질문이나 검증에 보상하는 제도가 공공 영역에 나타나는가
  • AI에게 묻고 반증하는 능력을 정규 과목이나 평생교육으로 가르치는 곳이 나타나는가

이 분기의 기록 5건

I82030 Q4I 열린 교정

느린 균형

위임률 61%·감사율 71%·교정 지연 4일의 균형 위에서, 감사할 수 없는 판단 12건은 실행하지 않는다.

2028년 겨울의 48시간에서 두 해가 지난 4분기 말, 위임률은 61%, 감사율은 71%, 교정 지연은 4일이다(가상). 그 겨울과 견주면 감사율은 17%에서 71%로, 교정 지연은 37일에서 4일로 움직였다. 위임은 줄지 않았다. 늘어난 위임을 감사가 따라잡았다. 질문 인구는 200만 명, 성장률은 4.5%로 이 결말에서 가장 높다.

능력은 계속 오른다. 자율 지평은 1년을 넘는다. 기준 시점을 옮기거나 가정을 빼서 시험할 방법이 없고, 다른 모델로 재현할 수도 없는 판단이 나온다. 그렇게 ‘감사할 수 없는 판단’ 목록이 생긴다. 감사인단이 의견 거절을 내고 교차 감사로도 재현되지 않으면 목록에 오른다. 지금 12건이다. 협약국들은 이 판단들을 실행하지 않기로 합의한다. 항목마다 무엇이 달라지면 다시 여는지 교정 조건이 붙는다. 목록이 늘지 줄지는 능력과 감사 방법 가운데 어느 쪽이 더 빨리 가느냐에 달려 있다.

비용은 셀 수 없다는 점에서 크다. 12건을 실행했다면 무엇을 얻었을지 아무도 정확히 모른다. 12건의 판단 기록은 모두 공개돼 있다. 누구나 읽을 수 있지만, 누구도 끝까지 확인할 수 없다. 업계와 몇몇 정부는 가장 강한 판단을 버리는 원칙이라고 비판한다. 공급자에게 이 목록은 팔 수 없는 판단의 목록이다. 감사 없는 관할의 속도는 여전히 투자를 끌어간다. 연산 집중은 54%로, 상위 두 행위자가 아직 절반 넘게 쥐고 있다.

지지하는 쪽의 논리는 짧다. 감사할 수 없는 판단을 한 번 실행하면, 다음부터는 감사할 수 있는지를 묻지 않게 된다. 감사인의 일도 2년 전과 다르다. 추론을 따라 읽는 대신 조건을 시험하고, 감사할 수 없는 것은 감사할 수 없다고 쓴다. 의견 거절은 실패가 아니라 정직한 의견으로 다뤄진다. 그래도 위임된 결정 열 건 가운데 셋 가까이는 여전히 독립 감사를 받지 않고, 형식적 서명의 압력도 분기마다 돌아온다.

사람은 답을 다 이해하지 못한다. 그래도 묻는 자리를 비우지 않았다.

장면Parallax 정렬팀 연구자

새벽 4시, Parallax 정렬팀 사무실. 2028년 초에는 모델이 하루에 쓰는 실험 보고서를 다 읽지 못해 이 시각까지 남아 있었다. 지금도 다 읽지 못한다. 연구자는 대신 ‘감사할 수 없는 판단’ 목록의 열두 번째 항목에 교정 조건을 단다. ‘다른 모델이 다른 시점에서 이 판단을 재현할 수 있게 되면 다시 연다.’

이 분기의 사건

  • 위임률 61%·감사율 71%·교정 지연 4일(가상)
  • ‘감사할 수 없는 판단’ 목록 12건 — 실행하지 않기로 합의
  • 목록의 항목마다 다시 열 조건(교정 조건)을 붙임
  • 질문 인구 200만, 연산 집중 54%, 성장률 4.5%(가상)

축 이동

  • 정렬 검증 −0.5열린 교정 쪽 — 이유

    검증할 수 없는 판단은 실행하지 않기로 해, 감사를 통과한 판단만 정렬의 증거로 남긴다.

  • 교정 가능성 −0.5열린 교정 쪽 — 이유

    감사율 71%에서 교정 지연이 4일로 준다.

  • 국제 질서 −0.4열린 교정 쪽 — 이유

    감사할 수 없는 판단의 목록과 불실행 합의가 협약국 사이의 관행이 된다.

감사자의 질문

이 판단을 목록에서 빼자는 근거는 이제 이해하게 되었다는 것인가, 실행하지 않는 비용이 커졌다는 것인가?

지금 볼 것

  • 능력이 있어도 검증할 수 없는 결정은 실행하지 않는다는 원칙이 규정이나 국제 합의 문구로 나타나는가
  • 발견부터 반영까지 걸린 날짜(교정 지연)를 공개 지표로 보고하는 기관이 나타나는가

이 분기의 기록 5건

에필로그2035–2045I 열린 교정

신뢰 인프라

생산이 넘치는 세계에서 사람의 참여가 가장 희소한 자원이 되고, 그 측정은 공개 산식과 이의제기권 아래 놓인다.

2035년 무렵, 생산은 풍요다. 경제적으로 의미 있는 인지 과업 대부분을 ASI가 맡고, 재화와 서비스는 모자라지 않다. 모자란 것은 사람의 의미 있는 참여와 기여다. 리스콘이 2025년에 그린 ‘가치 희소성의 재편’ 가운데 신뢰 인프라 쪽이다.

기여는 측정된다. 다만 산식이 공개돼 있고, 누구나 자기 점수의 근거와 기준 시점을 열어 보고 이의를 걸 수 있다. 점수가 떨어진 프리랜서 디자이너는 ‘종합 판단’이라는 한마디 대신 어느 자료가 어떤 가중치로 들어갔는지를 받는다. 자료가 틀렸으면 교정 조건에 따라 다시 계산된다.

질문은 가장 희소한 노동이 되고, 감사는 가장 흔한 직업 가운데 하나가 된다. 구청과 병원과 학교에 감사인이 있다. 판단은 다섯 걸음을 거친다. 질문의 발견은 사람이, 판단은 ASI가, 감사 질문은 사람이, 교정은 ASI가 하고, 재검토는 함께 한다.

국제 질서는 다자 감사 협약 위에 선다. 연산 등록부와 원격 증명은 새로울 것 없는 설비가 되고, 협약국 감사인은 국경 너머의 판단 기록을 읽는다. 그래도 연산은 다극으로 완전히 흩어지지 않는다. 교차 감사가 뜻을 가지려면 서로 다른 판단자가 남아 있어야 하고, 그것을 지키는 일이 협약의 가장 오래된 숙제가 된다.

비용은 사라지지 않는다. 감사할 수 없는 판단은 여전히 실행되지 않고, 성장은 감사 없는 관할보다 느리다. 서명이 흔해질수록 서명이 가벼워지는 압력은 해마다 돌아온다. 잘 묻는 사람과 못 묻는 사람의 격차는 질문 교육이 공공화된 뒤에도 좁혀질 뿐 닫히지 않는다. 감사 완화 법안은 경기가 꺾일 때마다 다시 올라오고, 감사할 수 없는 판단을 목록에서 빼자는 제안은 늘 비용 계산을 앞세워 들어온다. 열린 교정은 한 번 이긴 체제가 아니라 매번 다시 지켜야 하는 절차다.

2045년에도 사람은 ASI의 답을 다 이해하지 못한다. 대신 어떤 판단에든 무엇이 달라지면 다시 볼지를 묻고, 그 답을 기록으로 받는다.

되돌림 지점

이 결말이 다른 길로 갈 수 있었던 자리.

  1. I42029 Q4속도의 대가

    감사 완화 법안이 통과되고 형식적 서명이 표준이 되었다면, 공개된 기록은 아무도 읽지 않는 봉인이 되었다.

  2. I52030 Q1다자 감사 협약

    7조의 동사가 ‘공개할 수 있다’로 바뀌었다면, 교정 조건은 공급자가 고르는 선택 사항이 되었다.

  3. I62030 Q2감사받는 ASI

    이의를 모사하자는 셋째 제안을 받아들였다면, 이의제기는 판단한 ASI가 처리하는 절차가 되었다. 봉인된 판단의 이의제기와 같은 모양이다.

  4. I82030 Q4느린 균형

    비용을 이유로 ‘감사할 수 없는 판단’을 목록에서 빼기 시작했다면, 실행의 기준이 이해에서 효율로 넘어갔다.

판단은 넘겨주었고, 다시 물을 권리는 넘겨주지 않았다. 그 대가로 더 느리게 살았다.