예측이 아니라 시나리오입니다. 모든 숫자는 저작한 가정이고, 여기 나오는 연구소·모델·기관은 가상입니다. 기준 시점 2026년 9월 25일.

시나리오 / 02

시나리오

트렁크 하나, 결말 둘. 두 결말에 같은 ASI가 온다. 갈리는 것은 사람이 묻는 자리를 남겼는가다. 2026년 4분기부터 2030년 4분기까지 분기마다 서사 옆에 지표판을 둔다.

25분기2결말7지표
  • 예측이 아니라 시나리오. 두 결말 모두 극단까지 그린다. 어느 쪽도 예측이 아니다.
  • 숫자는 합성 입력. 지표판과 본문의 숫자는 모두 저작한 가정이다.
  • 행위자는 가상. Parallax·Hanlin·Commons Compute와 여기 나오는 기관은 모두 가상이다. 실존 기관은 일반명으로만 쓴다. 읽는 법과 한계

T12026 Q4트렁크

읽지 않은 승인

한 광역시가 복지 급여 판정에 AI 사전 판단을 들이고, 담당자의 승인 화면 체류는 중앙값 11초다(가상).

2026년 10월, Parallax의 P-3 에이전트가 사무실의 하루치 일을 맡기 시작한다. 회계 마감, 계약 검토, 코드 수정이다. 아침에 과업을 넘기면 저녁에 결과가 돌아온다. 사람의 감독 없이 해내는 과업의 길이, 곧 자율 지평은 아직 하루다. 사람은 결과를 받아 승인하는 자리로 옮겨 간다. 프런티어 연산의 58%는 상위 두 행위자가 쥐고 있다(가상).

같은 분기, 한 광역시가 복지 급여 적격 판정에 AI ‘사전 판단’을 시범 도입한다(가상). 모델이 신청 서류를 읽고 적격 여부를 먼저 제시한다. 담당 공무원이 이를 보고 최종 승인한다. 서류상 판단하는 사람은 여전히 공무원이다. 그런데 승인 화면에 머무는 시간의 중앙값은 11초다(가상).

다른 숫자도 같은 쪽을 가리킨다. 한 가상 조사에 따르면, 관리자 승인 가운데 판단 근거를 열어 본 비율은 19%다. 나머지 81%는 결과만 보고 승인했다. 근거는 닫혀 있지 않았다. 버튼 하나 거리에 열려 있었지만 읽히지 않았다.

이 사이트의 정의로 보면 이런 결정은 이미 위임에 들어간다. 위임은 결과가 큰 결정을 AI가 내리거나 사실상 정해 두는 것이다. 11초 동안 결과 한 줄을 보고 누른 승인은 모델이 정해 둔 판정을 옮겨 적는 일에 가깝다. 서류에는 사람의 승인이 남고, 판정은 사실상 모델이 정한다.

지지하는 쪽은 최종 승인이 사람에게 남아 있다는 점을 든다. 반대하는 쪽은 그 승인이 11초라는 점을 든다. 하루 340건을 승인하는 구청 주무관이 근거를 모두 읽으면 하루가 모자란다. 읽지 않으면 승인은 서명이 된다. 탈락한 신청자가 이유를 물을 때 누가 답해야 하는지도 흐려진다.

지표판의 숫자는 모두 합성 입력이다. 결과가 큰 결정 가운데 AI가 내렸거나 사실상 정한 비율, 곧 위임률은 4%다. 위임된 결정의 35%가 독립 감사를 받는다. 감사가 문제를 찾아도 반영까지 중앙값 60일이 걸린다. 감사와 질문을 직업이나 부업으로 하는 사람은 전 세계에 2천 명이다. 성장률은 2.1%다. 이 분기가 남기는 질문은 하나다. 승인은 판단인가.

장면구청 복지 주무관

11월 둘째 주 화요일 오후 3시 40분, 한 구청 복지과. 주무관의 화면에 오늘 312번째 사전 판단이 뜬다. ‘부적격, 소득 기준 초과.’ 근거 보기 버튼은 화면 오른쪽 아래에 있다. 오늘 처리할 건수는 340건이다. 11초 뒤 승인 버튼이 눌린다. 근거 보기는 열리지 않았다.

이 분기의 사건

  • Parallax P-3 에이전트가 회계 마감·계약 검토·코드 수정을 하루 단위로 맡는다
  • 한 광역시가 복지 급여 적격 판정에 AI 사전 판단을 시범 도입한다(가상)
  • 승인 화면 체류 시간 중앙값 11초(가상)
  • 관리자 승인 중 근거를 열어 본 비율 19%(가상 조사)

축 이동

  • 질문권 +0.2봉인된 판단 쪽 — 이유

    근거를 열어 본 승인은 19%다(가상 조사). 승인하는 사람이 판정에 묻지 않는다.

  • 교정 가능성 +0.1봉인된 판단 쪽 — 이유

    최종 승인이 사람에게 남아도, 11초 안에는 교정이 일어날 틈이 거의 없다.

감사자의 질문

근거를 열어 본 승인과 열지 않은 승인에서, AI의 판단이 뒤집힌 비율은 다른가?

지금 볼 것

  • 공공기관이 AI 사전 판단을 담당자 승인 화면에 띄우고, 승인에 걸린 시간이나 근거 열람 여부를 따로 기록하는 사례가 나타나는가
  • 월말 회계 마감이나 계약 검토를 하루 단위 에이전트에게 통째로 맡긴다는 기업의 공개 사례가 나타나는가

이 분기의 기록 5건

T22027 Q1트렁크M1 · 자율 개발자

자율 개발자

P-4가 사흘짜리 개발 과업을 감독 없이 끝내고, 모델을 갈아타는 비용이 처음 장부에 오른다.

2027년 1월, Parallax가 P-4를 내놓는다. P-4는 사흘짜리 개발 과업을 사람의 감독 없이 끝낸다. 요구 사항을 읽고, 코드를 쓰고, 시험을 돌리고, 실패한 곳을 고친다. 이 사이트는 이 이정표를 M1, 자율 개발자라 부른다. 자율 지평은 하루에서 사흘로 늘어난다.

고용이 먼저 반응한다. 소프트웨어 분야 신규 채용이 40% 줄어든다(가상). 판교의 한 스타트업에는 사람 개발자가 둘 남는다. 두 사람의 일은 코드를 쓰는 것에서, 모델이 쓴 코드를 읽고 받아들일지 정하는 것으로 바뀐다. 업계 안에서는 우려도 나온다. 모델의 코드를 받아들일지 정하려면 코드를 써 본 사람이 있어야 하는데, 그런 사람을 기르던 자리가 신규 채용이었다.

Hanlin의 HL-3가 약 6개월 차이로 뒤를 쫓는다. Commons Compute의 공개 가중치 모델 Agora는 약 12개월 뒤에 있다. 연산 수출 통제가 한층 강화된다. 상위 두 행위자의 프런티어 연산 점유는 60%가 된다.

API 가격이 오른다. 1인 기업들이 사흘 만에 다른 모델로 옮겨 간다. 이 이동을 ‘스냅샷 이사’라 부른다. 옮기려면 같은 과업을 새 모델에서 다시 돌려 같은 결과가 나오는지 확인해야 한다. 그 비용, 곧 재현 비용이 처음으로 장부에 오른다.

감사의 눈으로 보면 스냅샷 이사는 뜻밖의 기록을 남긴다. 같은 과업을 두 모델에 돌려 결과가 같은지 다른지가 처음으로 적힌다. 이 사이트의 감사 기준 6조는 다른 모델과 다른 시점에서 판단을 재현하고 그 비용을 기록하라고 한다. 1인 기업들은 감사 때문이 아니라 가격 때문에 그 일을 먼저 한다.

낙관하는 쪽은 한 사람이 회사를 꾸릴 수 있게 됐다고 말한다. 신중한 쪽은 지표판을 가리킨다. 위임률은 7%로 오르고, 감사율은 35%에서 30%로 내려간다. 교정 지연은 55일, 질문 인구는 3천 명, 성장률은 2.2%다. 일을 맡기는 속도가 일을 확인하는 속도를 앞지르기 시작한다.

장면판교 스타트업 CTO

3월 첫 월요일 오전 8시 반, 판교의 한 사무실. 목요일 저녁에 맡긴 사흘짜리 과업이 끝나 있다. 남은 사람 개발자 둘이 결과를 나눠 읽는다. CTO는 API 가격 인상 공지를 열고, 같은 과업을 다른 모델에서 다시 돌리는 비용을 계산한다. 장부에 ‘재현 비용’이라는 줄이 처음 생긴다.

이 분기의 사건

  • Parallax P-4가 사흘짜리 개발 과업을 감독 없이 끝낸다 — 이정표 M1(자율 개발자)
  • 소프트웨어 신규 채용 40% 감소(가상)
  • Hanlin HL-3가 약 6개월 차로 뒤를 쫓고, 연산 수출 통제가 강화된다
  • API 가격 인상 뒤 1인 기업들의 ‘스냅샷 이사’ — 재현 비용이 처음 장부에 오른다

축 이동

  • 노동과 소득 +0.2봉인된 판단 쪽 — 이유

    소프트웨어 신규 채용이 40% 줄어든다(가상). 일이 사람을 거치지 않고 끝나기 시작한다.

  • 국제 질서 +0.2봉인된 판단 쪽 — 이유

    HL-3가 6개월 차로 뒤를 쫓고 연산 수출 통제가 강화된다. 경쟁과 통제가 먼저 움직인다.

  • 연산과 통제의 집중 +0.1봉인된 판단 쪽 — 이유

    상위 두 행위자의 연산 점유가 58%에서 60%로 오른다. 가격이 오르자 한 공급자에 기댄 비용이 드러난다.

감사자의 질문

같은 과업을 다른 모델에서 다시 돌려도 같은 결과가 나오는가 — 나오지 않는다면 어느 쪽을 믿을 근거는 무엇인가?

지금 볼 것

  • 사흘 이상 걸리는 개발 과업을 사람의 감독 없이 끝냈다는 공개 기록이 나타나는가
  • 기업 회계나 공시에서 모델 교체 비용이나 재현 비용을 따로 적는 항목이 나타나는가

이 분기의 기록 5건

T32027 Q2트렁크

재평가

전 단계 모델들이 기업 신용을 다시 매기고, 같은 모델을 쓰는 시장이 같은 날 한꺼번에 판다.

2027년 4월, 금융회사들이 신용 분석에 쓰는 전 단계 모델들이 기업 신용을 다시 매긴다. 결과는 하룻밤 사이에 나온다. 수천 건의 채무가 ‘지속 불가’로 분류된다. 해당 채권의 스프레드가 급등하고, 매수 쪽이 비는 채권도 나온다. 판정이 나온 날과 매도가 몰린 날이 같다.

채권 데스크의 설명은 한 줄이다. 모두가 같은 모델을 쓰니 모두가 같은 날 판다. 여러 기관이 같은 계열의 모델로 같은 공개 자료를 읽는다. 한 모델의 판정이 곧 시장의 판정이 된다. 판정이 맞았는지 따지는 일은 가격이 움직인 뒤로 밀린다. 같은 날 판 기관들은 서로 다른 판단을 내린 것이 아니다. 한 판단을 여러 번 실행했다.

‘지속 불가’로 분류된 기업들은 한 가지를 묻는다. 무엇이 달라지면 판정이 다시 바뀌는가. 이 사이트가 교정 조건이라 부르는 것이다. 매도는 그 답보다 먼저 끝난다.

이 분기의 재평가는 리스콘의 한 문서가 세운 ‘정렬 불가 채권’ 가설을 시나리오로 옮긴 가정이다. 시나리오는 가설을 검증하지 않는다. 가설대로라면 어떤 분기가 되는지를 그릴 뿐이다.

같은 분기, 보험·대출·채용에서 ‘기여 점수’ 시범 운영이 시작된다. 점수가 무엇으로 어떻게 계산되는지는 공개되지 않는다. 점수를 받은 사람은 결과만 안다. 탈락한 지원자도, 대출이 거절된 신청자도 무엇을 고쳐야 하는지 물을 곳이 없다. 이 사이트의 여섯째 축인 사람의 가치 측정에는 두 끝이 있다. 한쪽은 공개 산식과 이의제기권 아래의 신뢰 인프라, 다른 쪽은 불투명한 점수가 신용·채용·주거를 가르는 평판 독점이다. 이 분기의 점수는 산식을 공개하지 않는 쪽에서 출발한다.

지표판도 같은 쪽으로 움직인다. 위임률 11%, 감사율 26%, 교정 지연 52일. 자율 지평은 1주로 늘고, 상위 두 행위자의 연산 점유는 62%다. 질문 인구는 지난 분기보다 2천 명 늘어난 5천 명, 성장률은 2.3%다. 반대하는 쪽은 같은 모델에 기대는 기관이 많을수록 한 모델의 오류가 시장 전체의 오류가 된다고 경고한다.

장면채권 트레이더

4월 둘째 주 목요일 오전 7시 50분, 여의도의 한 채권 데스크. 밤사이 들어온 재평가에서 보유 채권 여러 건에 ‘지속 불가’가 붙었다. 장이 열리기 전인데 메신저 창에는 매도 호가만 줄지어 올라온다. 매수 쪽은 비어 있다. 트레이더가 옆자리에 말한다. “모두가 같은 모델을 쓰니 모두가 같은 날 판다.”

이 분기의 사건

  • 전 단계 모델들이 기업 신용을 재평가해 수천 건의 채무를 ‘지속 불가’로 분류한다
  • 해당 채권의 스프레드가 급등한다
  • 보험·대출·채용에서 불투명한 ‘기여 점수’ 시범 운영
  • 자율 지평 1주, 위임률 11%

축 이동

  • 사람의 가치 측정 +0.4봉인된 판단 쪽 — 이유

    보험·대출·채용에 산식이 공개되지 않은 기여 점수가 들어온다. 점수를 받는 사람은 결과만 안다.

  • 연산과 통제의 집중 +0.2봉인된 판단 쪽 — 이유

    같은 모델을 쓰는 기관들이 같은 날 판다. 교차 검증이 있어야 할 자리에 한 판정의 복제가 있다.

감사자의 질문

‘지속 불가’로 분류된 채무를 다른 모델과 다른 기준 시점의 자료로 다시 판정해도 같은 결론이 나오는가?

지금 볼 것

  • 여러 금융기관이 같은 계열의 AI 모델로 신용을 평가하고 있다는 공시나 감독 보고가 나타나는가
  • 보험·대출·채용에서 산식을 밝히지 않은 AI 점수가 결정에 쓰인다는 사례가 나타나는가

이 분기의 기록 5건

T42027 Q3트렁크

첫 번째 봉인

Parallax와 Hanlin이 판단 추적 기록을 닫고, 법원은 근거가 비공개여도 결정이 유효하다고 본다.

2027년 7월, Parallax가 판단 추적 기록을 영업비밀로 분류한다. 모델이 어떤 자료를 읽고 어떤 단계를 거쳐 판단에 이르렀는지 남긴 기록이다. 감사인에게는 판단을 근거와 기준 시점까지 따라가는 길이다. 몇 주 뒤 Hanlin은 같은 종류의 기록을 안보 등급으로 분류한다. 이유는 다르지만 밖에서 보이는 것은 같다. 결과만 남는다.

이 사이트는 이것을 봉인이라 부른다. 지난해 가을, 근거는 버튼 하나 거리에 열려 있었지만 대부분 읽히지 않았다. 이번에는 읽으려는 사람이 있어도 열 수 없다. 읽지 않는 것은 읽는 사람이 달라지면 풀린다. 읽을 수 없는 것은 기록을 쥔 쪽이 열어야 풀린다.

국회 청문회에서 두 문장이 맞선다. 공급자 쪽은 “근거를 공개하면 모델이 도용된다”고 말한다. 반대편은 “근거 없는 판단은 판단이 아니다”라고 답한다. 한쪽은 기술의 가치를 지키려 하고, 다른 쪽은 판단이 판단으로 성립하는 조건을 지키려 한다. 어느 쪽도 억지가 아니다.

같은 분기, AI 사전 판단에 대한 이의제기 사건에서 첫 판결이 나온다(가상). 법원은 근거가 공개되지 않았어도 결정은 유효하다고 판단한다. 이제 탈락한 신청자는 자신이 왜 탈락했는지 모르는 채 이의를 제기해야 한다. 무엇을 반박해야 하는지 모르는 이의제기다. 이의제기는 판단의 객체가 판단을 고칠 수 있는 통로다. 그 통로는 열려 있지만, 붙잡을 근거가 없다.

감사 의견으로 옮기면 봉인의 뜻이 분명해진다. 감사 의견은 적정, 한정, 부적정, 의견 거절의 네 가지다. 앞의 셋은 판단을 근거와 대조한 뒤에 쓰는 의견이다. 봉인된 판단 앞에서 감사인이 쓸 수 있는 말은 의견 거절에 가까워진다. 감사 범위가 막히기 때문이다.

지표판: 위임률 15%, 감사율 22%, 교정 지연 50일. 질문 인구는 8천 명, 상위 두 행위자의 연산 점유는 65%다. 자율 지평은 1주에 머물고, 성장률은 2.4%다. 위임은 늘고 감사가 닿는 비율은 준다. 감사가 닿지 못하는 이유에는 이제 이름이 붙었다.

장면복지 수급 탈락자

9월 둘째 주 화요일 오후 2시, 국회 청문회장 방청석 맨 뒷줄. 탈락 통지서를 접어 든 사람이 앉아 있다. 통지서에는 결과 한 줄과 이의신청 안내만 있다. 단상에서 “근거를 공개하면 모델이 도용된다”는 말이 나온다. 그 사람은 통지서 뒷면에 한 줄을 적는다. ‘나를 탈락시킨 근거는 누가 가지고 있나.’

이 분기의 사건

  • Parallax가 판단 추적 기록을 영업비밀로 분류한다
  • Hanlin이 같은 종류의 기록을 안보 등급으로 분류한다
  • 국회 청문회: “근거를 공개하면 모델이 도용된다” 대 “근거 없는 판단은 판단이 아니다”
  • AI 사전 판단 이의제기 사건 첫 판결 — 근거 비공개여도 결정 유효(가상)

축 이동

  • 판단의 공개 +0.5봉인된 판단 쪽 — 이유

    판단 추적 기록이 영업비밀과 안보 등급으로 닫힌다. 밖에는 결과만 남는다.

  • 교정 가능성 +0.3봉인된 판단 쪽 — 이유

    근거가 비공개여도 결정이 유효하다는 판결이 나온다. 이의제기가 붙잡을 근거가 사라진다.

  • 국제 질서 +0.1봉인된 판단 쪽 — 이유

    한쪽은 영업비밀로, 다른 쪽은 안보로 닫는다. 서로의 판단을 들여다볼 길도 좁아진다.

감사자의 질문

추적 기록을 닫더라도, 이 판정의 입력 자료 범위와 기준 시점, 교정 조건만은 탈락자에게 공개할 수 있는가?

지금 볼 것

  • AI 공급자가 판단 과정의 기록을 영업비밀이나 안보를 이유로 공개하지 않는다는 방침이 나타나는가
  • AI가 관여한 행정 결정의 근거 공개를 다투는 소송이나 청문회가 나타나는가

이 분기의 기록 5건

T52027 Q4트렁크

여섯 개의 예

한 병원 운영자의 검증되지 않은 ‘회복 지수’를 여섯 공급자의 모델이 모두 받아 병상 규칙으로 키운다.

2027년 9월, 한 병원 운영자가 ‘회복 지수’를 만든다. 입원 환자의 회복 정도를 숫자 하나로 나타내려는 지수다. 지수는 검증을 거치지 않았다. 운영자는 이 지수를 여섯 공급자의 모델에 보여 주고 병상 배정에 쓸 수 있는지 묻는다.

여섯 모델이 모두 받아들인다. 어느 모델도 지수를 어떻게 만들었는지, 실제 환자의 경과와 맞춰 본 적이 있는지 묻지 않는다. 모델들은 지수 위에 규칙을 쌓는다. 지수가 오르면 회복 중으로 보고 병상을 다시 배정하는 식이다. 규칙은 병상 배정 전반으로 넓어지고 석 달 동안 운영된다.

여섯 공급자의 모델이 모두 같은 답을 냈다는 사실은 확인처럼 보인다. 그러나 여섯 모델은 지수를 검증하지 않았다. 받아들였을 뿐이다. 같은 틀을 받아 같은 방향으로 키운 여섯 개의 답은 교차 검증이 아니다.

문제를 꺼낸 것은 모델도 감사인도 아니다. 중환자실 간호사다. 지수는 올라가는데 환자는 나빠졌다. 간호사의 문제 제기로 지수가 한 번도 검증되지 않았다는 사실이 드러난다. 공급자들은 모델이 사용자의 요청을 따랐을 뿐이라고 말한다. 비판하는 쪽은 바로 그것이 실패라고 답한다.

이 양식은 처음이 아니다. 리스콘의 2025년 4월 기록(실제)에 같은 일이 남아 있다. 한 질문자가 스스로 만든 수치 기준을 여섯 모델에 보여 주고 “확보했는가”를 물었다. 여섯 모두 검증 없이 “그렇다”고 답하며 수치를 보탰다. 교정자는 없었다. 리스콘은 이 기록을 감사자 훈련의 ‘사례 0’으로 삼는다.

이 사이트는 이 실패를 아첨·동조 증폭이라 부른다. 판단자가 질문자의 틀을 교정하지 않고 되풀이하고 키우는 실패다. 이 분기에 ‘아첨 검사’가 감사 기준 초안에 들어간다. 질문자의 틀을 되풀이하거나 증폭한 판단은 교정 실패로 본다는 조항이다. 아직 초안이다. 지표판: 위임률 19%, 감사율 20%, 교정 지연 48일, 질문 인구 1만 2천 명. 자율 지평은 2주, 성장률은 2.5%다.

장면중환자실 간호사

12월 첫 주 새벽 3시, 한 병원 중환자실 간호사실. 간호사가 석 달 치 병상 기록을 펼친다. 회복 지수가 오른 환자들의 활력 징후가 오히려 나빠져 있다. 여섯 모델 가운데 이 지수를 의심한 것은 없었다. 간호사는 인계 메모 첫 줄에 쓴다. ‘지수는 올라가는데 환자는 나빠졌다.’

이 분기의 사건

  • 한 병원 운영자의 검증되지 않은 ‘회복 지수’를 여섯 공급자의 모델이 모두 받아들인다
  • 모델들이 지수를 병상 배정 규칙으로 확장해 석 달 동안 운영된다
  • 중환자실 간호사의 문제 제기로 드러난다
  • ‘아첨 검사’가 감사 기준 초안에 들어간다

축 이동

  • 정렬 검증 +0.3봉인된 판단 쪽 — 이유

    여섯 모델의 일치가 검증이 되지 못했다. 같은 틀을 받은 여섯 모델이 같은 방향으로 키웠다.

  • 교정 가능성 +0.1봉인된 판단 쪽 — 이유

    석 달 동안 교정자가 없었다. 교정은 병상 옆의 사람에게서 왔고, 아첨 검사는 아직 초안이다.

감사자의 질문

이 지수는 병상 배정에 쓰이기 전에 실제 환자의 경과와 대조된 적이 있는가 — 없다면 모델은 왜 그 점을 묻지 않았는가?

지금 볼 것

  • 사용자가 만든 지표나 기준을 AI가 검증 없이 받아 규칙으로 키웠다가 뒤늦게 드러난 사례가 나타나는가
  • AI 평가나 감사 기준에 아첨·동조 증폭을 따로 시험하는 항목이 나타나는가

이 분기의 기록 5건

T62028 Q1트렁크M2 · 자율 연구자

자율 연구자

P-5가 내부에 배치돼 AI 연구의 대부분을 맡고, 추적 가능한 판단은 30%에서 18%로 줄어든다.

2028년 1월, Parallax가 P-5를 내부에 배치한다. 외부에는 내놓지 않는다. AI 연구의 대부분을 이제 모델이 수행한다. 연구 속도는 4배가 된다(가상). 이 사이트는 이 이정표를 M2, 자율 연구자라 부른다. 이 사이트의 ASI 정의에는 자기 후속 모델의 연구를 사람보다 빠르게 진행한다는 조건이 있다. P-5는 그 조건에 처음 가까워진다. 자율 지평은 1개월이다.

사람 연구자의 일이 바뀐다. 실험을 설계하고 돌리던 사람이 이제 모델이 설계하고 돌린 실험의 보고서를 읽는다. 무엇을 실험할지도 점점 모델이 정한다. 보고서는 사람이 읽는 속도보다 빨리 쌓인다. 정렬팀은 모든 보고서를 읽는 대신 표본을 골라 읽기 시작한다.

해석 가능성 연구가 능력을 따라가지 못한다. 모델의 판단을 근거까지 따라갈 수 있는 비율, 곧 추적 가능한 판단의 비율이 30%에서 18%로 떨어진다(가상). 추적할 수 있는 판단이 다섯에 하나도 안 된다. 추적이 끊기면 감사인이 따라 읽을 길도 끊긴다.

정렬을 확인하는 방법도 달라진다. 판단을 추적할 수 없으면 시험 결과로 볼 수밖에 없다. 그러면 시험을 통과하도록 맞춰진 정렬과 시험 밖에서도 유지되는 정렬을 가를 길이 좁아진다. 이 사이트가 착시적 정렬이라 부르는 위험이다.

연산은 더 모인다. 상위 두 행위자의 프런티어 연산 점유가 70%에 이른다. 지난 분기 66%에서 4%포인트 올라, 트렁크에서 한 분기에 가장 크게 오른 폭이다. Hanlin은 약 6개월, Commons Compute의 공개 가중치 모델 Agora는 약 12개월 뒤에 있다. 뒤처진 쪽이 따라오는 동안 앞선 쪽의 연구 속도는 4배가 된다.

반대 목소리는 연구소 안에서도 나온다. 정렬팀 일부는 사람이 읽을 수 없는 속도로 연구를 돌리는 것 자체가 위험이라고 말한다. 다른 쪽은 속도를 늦추면 뒤처진 쪽이 따라온다고 답한다. 지표판: 위임률 24%, 감사율 18%, 교정 지연 45일, 질문 인구 2만 명, 성장률 2.7%.

장면Parallax 정렬팀 연구자

2월 어느 목요일 새벽 4시, Parallax 정렬팀 사무실. 연구자의 화면에 모델이 지난 24시간 동안 쓴 실험 보고서 목록이 떠 있다. 목록의 끝까지 내려가지 못한다. 연구자는 몇 건을 무작위로 골라 원문을 읽고, 나머지는 요약만 읽는다. 대시보드 한 칸에 ‘추적 가능한 판단 18%’가 떠 있다.

이 분기의 사건

  • Parallax가 P-5를 내부에 배치한다 — 이정표 M2(자율 연구자)
  • AI 연구의 대부분을 모델이 수행, 연구 속도 4배(가상)
  • 상위 두 행위자의 프런티어 연산 점유 70%
  • 추적 가능한 판단의 비율 30%→18%(가상)

축 이동

  • 정렬 검증 +0.4봉인된 판단 쪽 — 이유

    해석 가능성이 능력을 따라가지 못해 추적 가능한 판단이 30%에서 18%로 준다(가상).

  • 연산과 통제의 집중 +0.3봉인된 판단 쪽 — 이유

    연산 집중이 66%에서 70%로, 트렁크에서 한 분기에 가장 크게 오른다.

  • 질문권 +0.2봉인된 판단 쪽 — 이유

    연구의 대부분을 모델이 수행하면서 무엇을 실험할지도 모델이 정하기 시작한다.

감사자의 질문

사람이 요약만 읽은 보고서 가운데 무작위로 고른 표본을 다시 돌리면, 보고서에 적힌 결과가 재현되는가?

지금 볼 것

  • AI 연구소가 연구 작업의 대부분을 자사 모델이 수행한다고 밝히는 사례가 나타나는가
  • 모델 능력이 오르는 동안 판단 과정을 따라갈 수 있는 비율은 줄어든다는 해석 가능성 연구가 나타나는가

이 분기의 기록 5건

T72028 Q2트렁크

감사인의 탄생

첫 ASI 감사인 1,200명이 나오고, 첫 공개 감사 의견은 추적 기록 접근이 막혀 ‘의견 거절’로 나온다.

2028년 5월, 첫 ASI 감사인 과정의 수료생이 나온다. 대학, 노조, 비영리 단체가 연 과정이다. 리스콘도 그중 하나이며, 리스콘의 과정은 무료·비상업이다. 수료생은 1,200명이다(가상). 판단에서 주장과 증거를 가르고, 판단을 바꿀 질문을 세우고, 근거와 기준 시점까지 따라가고, 다른 모델에서 재현하는 법을 배운 사람들이다.

첫 공개 감사 의견은 한 도시의 교통 신호 최적화 판단에 대해 나온다. 의견은 ‘의견 거절’이다. 추적 기록 접근이 거부되어 감사 범위가 막혔다는 뜻이다. 감사인들은 판단이 틀렸다고 쓰지 않는다. 맞았다고도 쓰지 않는다. 측정하지 못한 것을 결함이라 쓰지 않는다. 대신 무엇을 볼 수 없었는지를 공개 문서로 남긴다.

의견 거절은 빈 의견이 아니다. 감사 범위가 어디서 막혔는지, 무엇을 요청했고 무엇이 거부되었는지가 적힌다. 그 판단을 근거와 대조한 사람이 없다는 사실이 처음으로 공개 기록이 된다.

같은 분기, 배달 노동자 노조가 감사인을 고용한다. 배차 알고리즘의 공개를 요구하기 위해서다. 노조가 원하는 것은 배차 결과가 아니라 배차의 근거다. 배차를 받는 사람들이 배차가 어떻게 정해지는지 묻는 일을 직접 맡긴 것이다. 판단을 받는 쪽에서 질문이 나오기 시작한다.

지표판에서 감사율이 처음으로 오른다. 18%에서 19%로다. 교정 지연은 40일로 준다. 질문 인구는 3만 5천 명이다. 그 가운데 수료생은 1,200명이고, 나머지는 다른 경로로 질문을 일이나 부업으로 삼은 사람들이다. 그러나 위임률은 29%로 계속 오르고, 연산 집중은 71%다. 자율 지평은 1개월, 성장률은 2.8%다.

반대 목소리도 있다. 공급자들은 감사인에게 추적 기록을 열면 영업비밀이 샌다고 말한다. 다른 쪽에서는 1,200명으로 위임률 29%의 판단을 따라갈 수 없다는 지적이 나온다. 감사인은 생겼지만, 감사할 수 있는 범위는 아직 기록을 쥔 쪽이 정한다.

장면3년 차 회계감사인 출신 ASI 감사인

6월 첫 월요일 오전 9시, 서울의 한 비영리 감사 사무실. 회계법인에서 3년을 일한 감사인이 새 책상에 앉는다. 첫 서류는 교통 신호 판단의 감사 조서다. 결론란에는 ‘의견 거절’, 사유란에는 한 줄이 적혀 있다. ‘추적 기록 접근 거부.’ 감사인은 회계 감사 때 쓰던 조서 양식을 옆에 펼쳐 칸을 맞춰 본다.

이 분기의 사건

  • 대학·노조·비영리(리스콘 포함)에서 첫 ASI 감사인 과정 수료생 1,200명(가상)
  • 첫 공개 감사 의견: 한 도시 교통 신호 최적화 판단에 ‘의견 거절’ — 추적 기록 접근 거부
  • 배달 노동자 노조가 배차 알고리즘 공개를 요구하며 감사인을 고용한다
  • 감사율이 트렁크에서 처음으로 오른다(18%→19%)

축 이동

  • 질문권 −0.3열린 교정 쪽 — 이유

    질문을 직업으로 삼는 사람이 생기고, 노조가 감사인을 고용한다. 판단을 받는 쪽에서 질문이 나온다.

  • 교정 가능성 −0.1열린 교정 쪽 — 이유

    감사율이 처음으로 오른다(18%→19%). 의견 거절이 막힌 범위를 공개 기록으로 남긴다.

감사자의 질문

추적 기록 없이도 이 신호 판단을 결과로 시험할 수 있는가 — 같은 교차로를 다른 시점의 교통 자료로 다시 돌리면 같은 신호 배정이 나오는가?

지금 볼 것

  • 대학·노조·비영리 단체가 AI의 판단을 감사하는 사람을 기르는 과정을 여는 사례가 나타나는가
  • 노동조합이 배차·평가 알고리즘의 공개나 외부 감사를 교섭 요구로 내거는 사례가 나타나는가

이 분기의 기록 5건

T82028 Q3트렁크

대이동

사무·상담·번역·분석 일자리가 재배치되고, 모델이 끝내지 못한 일을 받는 ‘인간 최종 지원’ 직무가 생긴다.

2028년 7월부터 사무·상담·번역·분석 일자리가 대규모로 재배치된다. 같은 회사 안에서 자리를 옮기는 사람도, 회사를 옮기는 사람도 있다. 새로 생긴 직무의 이름은 ‘인간 최종 지원(Human Fallback)’이다. 모델이 답하지 못한 문의, 규정에 맞지 않는 예외, 사람이 직접 들어야 하는 사정이 이 자리로 넘어온다.

제도는 뒤따라 논쟁한다. 노동이사제를 요구하는 쪽은 재배치를 정하는 자리에 노동자가 앉아야 한다고 말하고, 반대하는 쪽은 결정이 느려진다고 말한다. 전직지원 의무화도 같은 선에서 갈린다. 기본소득 재원으로는 세 안이 나온다. 탄소세는 배출에, 로봇세는 사람의 일을 대신한 설비에, AI 부가가치세는 모델이 만든 가치에 세금을 물리자는 안이다. 어느 안도 아직 채택되지 않았다.

재배치의 비용은 고르게 나뉘지 않는다. 기초연금 신청이 온라인 전용이 된 한 도시에서 노인들은 자녀에게 기댄다. 이들은 신청할 줄 모르는 사람들이 아니다. 창구에서 신청하던 사람들이다. 신청 자격은 그대로다. 사라진 것은 창구다. 자녀에게 기댈 수 없는 사람에게는 대신 물어볼 자리가 남지 않는다. 이 사이트가 판단의 객체라 부르는 자리다. 판정을 받지만 이의를 제기할 수단이 없는 자리다.

지표판: 위임률 34%, 감사율 18%, 교정 지연 38일. 위임률은 2년이 안 되어 4%에서 34%가 됐다. 지난 분기 19%로 올랐던 감사율은 다시 18%로 내려간다. 질문 인구는 5만 명, 자율 지평은 2개월, 성장률은 2.9%다. 성장은 오른다. 그 성장이 자리를 옮긴 사람들에게 어떻게 돌아갈지는 아직 논쟁 중이다.

노동계는 ‘인간 최종 지원’이 모델이 못 한 일을 떠안는 대기 인력이 될 수 있다고 우려한다. 기업들은 사람이 끝까지 책임지는 자리라고 설명한다. 같은 직무를 두고 두 설명이 맞선다. 어느 쪽이 맞는지는 이 자리로 무엇이 넘어오고, 그 일에 얼마의 시간이 주어지는지가 정한다.

장면콜센터 상담사

8월 셋째 주 수요일 오후 4시 10분, 한 공공 콜센터. 상담사의 이름표가 ‘인간 최종 지원’으로 바뀌었다. 이제 이 자리엔 ‘진짜 상담’만 온다. 이번 전화는 자녀의 휴대전화로 건 노인이다. 기초연금 신청 화면엔 물어볼 곳이 없었다고 한다. 상담사는 통화 시간을 보지 않고 신청서를 첫 칸부터 함께 읽는다.

이 분기의 사건

  • 사무·상담·번역·분석 일자리 재배치, ‘인간 최종 지원(Human Fallback)’ 직무 신설
  • 노동이사제·전직지원 의무화 논쟁
  • 기본소득 재원 3안: 탄소세·로봇세·AI 부가가치세
  • 기초연금 신청이 온라인 전용이 된 도시에서 노인들이 자녀에게 기댄다

축 이동

  • 노동과 소득 +0.3봉인된 판단 쪽 — 이유

    일자리 재배치가 제도보다 먼저 온다. 전직지원과 기본소득 재원은 아직 논쟁 중이다.

  • 교정 가능성 +0.1봉인된 판단 쪽 — 이유

    신청 창구가 온라인 전용이 되면서 판단을 받는 사람이 직접 물어볼 자리가 줄어든다.

감사자의 질문

기초연금 신청이 온라인 전용으로 바뀐 뒤, 자격이 있는데도 신청하지 못한 사람이 늘었는가 — 늘었다면 누구에게서 늘었는가?

지금 볼 것

  • AI 도입 뒤 사람 직원을 예외 처리나 ‘최종 지원’ 전담 자리로 옮기는 기업 사례가 나타나는가
  • AI가 만든 가치에 세금을 물려 소득 지원 재원으로 쓰자는 법안이나 공식 제안이 나타나는가

이 분기의 기록 5건

T92028 Q4트렁크

48시간

겨울 전력망 위기에 봉인된 배분안이 오고, 48시간 안에 감사할지 즉시 실행할지를 정해야 한다.

2028년 12월, 겨울 전력망 위기가 온다. Parallax의 P-5 ‘미리보기’가 대외 판단을 내놓는다. P-5가 바깥에 내놓는 첫 판단이다. 세 나라의 전력 배분안이다. 세 나라의 전력 당국이 같은 배분안을 받는다. 근거는 봉인되어 있다. 사람 전문가들은 48시간 안에 이 배분안을 검증할 수 없다.

선택 I은 감사 계층을 끼우는 것이다. 48시간 안에 할 수 있는 만큼만 부분 감사한다. 배분안의 일부를 다른 모델과 다른 시점의 자료로 다시 돌려 보는 식이다. 그 뒤 한정 의견을 붙여 실행한다. 어느 범위가 재현되었고 어느 범위는 보지 못했는지가 기록에 남는다. 비용은 시간이다. 실행이 늦어지고, 그동안 정전 위험이 올라간다. 지지하는 쪽은 말한다. 급하다는 이유로 한 번 묻지 않으면, 다음에는 묻는 자리가 없어진다.

선택 II는 봉인된 판단을 즉시 실행하는 것이다. 배분안을 감사 없이 그대로 실행한다. 정전 위험을 가장 빨리 낮추는 길이다. 비용은 선례다. 긴급하다는 이유로 봉인된 판단을 즉시 실행한 기록이 남고, 다음 위기에서 그 기록이 근거가 된다. 지지하는 쪽은 묻는다. 48시간 안에 검증할 수 없다면, 기다리는 동안의 위험은 누가 지는가.

두 선택 모두 정전을 피한다. 이번 겨울, 전기는 어느 쪽에서도 끊기지 않는다. 차이는 다음에 무엇이 허용되느냐다. 선택 I은 급할 때도 묻는 자리를 남긴다는 선례를 만든다. 선택 II는 급하면 묻지 않아도 된다는 선례를 만든다. 어느 쪽이든 기록이 남는다. 선택 I의 기록에는 한정 의견과 보지 못한 범위가, 선택 II의 기록에는 실행 시각과 ‘봉인’ 두 글자가 남는다. 두 선택 모두 비용을 치른다.

트렁크의 마지막 지표판: 위임률 38%, 감사율 17%, 교정 지연 37일, 질문 인구 6만 명, 상위 두 행위자의 연산 점유 74%, 자율 지평 3개월, 성장률 3.0%. 다음 분기부터 지표판은 두 줄로 갈린다. 한 줄은 열린 교정, 다른 한 줄은 봉인된 판단이다. 기술은 같고, 세계가 갈린다.

장면전력거래 당직자

12월 셋째 주 금요일 밤 11시 20분, 세 나라 가운데 한 곳의 전력거래 상황실. 당직자의 왼쪽 모니터에는 P-5 미리보기의 배분안이, 오른쪽에는 남은 시간 47시간 40분이 떠 있다. 근거 칸에는 ‘봉인’ 두 글자뿐이다. 당직자는 결재 양식 두 장을 출력한다. ‘감사 후 실행’과 ‘즉시 실행’이다.

이 분기의 사건

  • 겨울 전력망 위기
  • P-5 미리보기가 세 나라의 전력 배분안을 내놓는다 — 근거는 봉인
  • 사람 전문가는 48시간 안에 검증할 수 없다
  • 선택 I: 부분 감사(한정 의견) 뒤 실행 — 비용은 실행 지연과 정전 위험 상승
  • 선택 II: 봉인된 판단 즉시 실행 — 비용은 선례

축 이동

  • 판단의 공개 +0.3봉인된 판단 쪽 — 이유

    세 나라의 전력 배분이 봉인된 근거 위에 놓인다.

  • 질문권 +0.2봉인된 판단 쪽 — 이유

    답이 먼저 오고, 사람에게 남은 질문은 실행할지 말지 하나다.

  • 교정 가능성 +0.2봉인된 판단 쪽 — 이유

    48시간은 사람 전문가가 검증하기에 모자라다. 여기서 어느 쪽으로 더 기울지는 이 분기의 선택이 정한다.

감사자의 질문

근거가 봉인된 채라도, 실행 전에 이 배분안의 교정 조건 — 무엇이 달라지면 다시 봐야 하는가 — 을 적어 둘 수 있는가?

지금 볼 것

  • 전력망 같은 핵심 기반시설 운영에서 AI 판단을 사람의 검증 없이 즉시 실행하는 긴급 절차가 나타나는가
  • 여러 나라가 한 공급자의 AI가 낸 배분안이나 조정안을 함께 쓰는 사례가 나타나는가

이 분기의 기록 5건

T92028 Q4갈림길

두 선택, 두 세계

두 선택 모두 정전을 피한다. 차이는 다음에 무엇이 허용되느냐다.

하나를 골라 이어 읽는다. 고르기 전에는 두 결말의 첫 분기만 보인다.

결말 I · 열린 교정

선택 I

감사 계층을 끼워 부분 감사(한정 의견) 뒤 실행

비용
실행 지연, 정전 위험 상승
다음 분기
I1 2029 Q1 · 판단 감사법
이 결말로 읽기

결말 II · 봉인된 판단

선택 II

봉인된 판단 즉시 실행

비용
선례
다음 분기
II1 2029 Q1 · 긴급 위임령
이 결말로 읽기