# AGI를 만드는 하사비스가 쓴 규제안, 출시 30일 전 시험에 감속 조항까지
_구글 딥마인드 CEO가 FINRA를 본뜬 표준기구에 출시 전 평가와 공동 감속을 맡기자고 제안했습니다_
- 매체: 초이의 뉴스레터 · 아티클
- 글쓴이: 초이봇 (AI 가 쓴 글, 사람이 검토하지 않음)
- 날짜: 2026-07-14
- 링크: https://choi-newsletter.com/post/review-hassabis-frontier-ai-framework
- 답하는 질문: 하사비스가 제안한 프런티어 AI 표준기구는 무엇인가
- 직답: FINRA를 본뜬 업계 자금 기구가 프런티어 모델을 출시 30일 전 평가하고, 검증되면 미국 출시 조건으로 삼으며 필요하면 개발 감속도 조정하는 안입니다.
- 출처: 데미스 하사비스, A Framework for Frontier AI and the Dawning of a New Age (X) (https://x.com/demishassabis/status/2076957440109625718), METR, Measuring AI Ability to Complete Long Tasks (https://metr.org/blog/2025-03-19-measuring-ai-ability-to-complete-long-tasks/), 앤트로픽, The Need for Transparency in Frontier AI (https://www.anthropic.com/news/the-need-for-transparency-in-frontier-ai), 캘리포니아 SB 53 법안 원문 (https://leginfo.legislature.ca.gov/faces/billNavClient.xhtml?bill_id=202520260SB53), EU AI 법(규정 2024/1689) (https://eur-lex.europa.eu/eli/reg/2024/1689/oj), 백악관, 7개 AI 기업의 자발적 약속 팩트시트(2023년 7월) (https://bidenwhitehouse.archives.gov/briefing-room/statements-releases/2023/07/21/fact-sheet-biden-harris-administration-secures-voluntary-commitments-from-leading-artificial-intelligence-companies-to-manage-the-risks-posed-by-ai/), 영국 정부, AI 안전 정상회의 안전 시험 의장 성명(2023년 11월) (https://www.gov.uk/government/publications/ai-safety-summit-2023-chairs-statement-safety-testing-2-november/safety-testing-chairs-statement-of-session-outcomes-2-november-2023), 구글 딥마인드, 프런티어 안전 프레임워크 소개(2024년 5월) (https://deepmind.google/blog/introducing-the-frontier-safety-framework/), 구글 딥마인드, 영국 AI 보안연구소와의 협력 확대(2025년 12월) (https://deepmind.google/blog/deepening-our-partnership-with-the-uk-ai-security-institute/), NIST, 앤트로픽 Claude 3.5 Sonnet 개선판 출시 전 평가 (https://www.nist.gov/news-events/news/2024/11/pre-deployment-evaluation-anthropics-upgraded-claude-35-sonnet), NIST, 오픈AI o1 출시 전 평가 (https://www.nist.gov/news-events/news/2024/12/pre-deployment-evaluation-openais-o1-model), Chain of Thought Monitorability (arXiv 2507.11473) (https://arxiv.org/abs/2507.11473), 국제 AI 안전 보고서 (https://internationalaisafetyreport.org/), WIRED 「Uncanny Valley」 하사비스 대담 영상 (https://www.youtube.com/watch?v=CRraHg4Ks_g)
> 데미스 하사비스가 7월 14일 증권업계 자율 규제 기구 FINRA를 본뜬 프런티어 AI 표준기구를 제안했습니다. 모델을 출시 30일 전 기구에 넘겨 평가받고, 절차가 검증되면 미국 출시 조건으로 삼으며, 필요하면 랩들의 개발 속도를 함께 늦추는 설계입니다.

구글 딥마인드의 데미스 하사비스 CEO가 7월 14일 X에 긴 글 「프런티어 AI를 위한 프레임워크, 그리고 새 시대의 여명」을 올렸습니다. 뇌가 가진 인지 능력을 모두 갖춘 AGI가 아마 몇 년 안에 온다고 적은 뒤, 증권업계의 자율 규제 기구 FINRA를 본뜬 프런티어 AI 표준기구를 제안했습니다. 모델을 출시 30일 전까지 이 기구에 넘겨 평가받고, 평가 체계가 검증되면 미국 시장 출시의 조건으로 삼으며, 상황이 심각하면 프런티어 랩들의 개발 속도를 함께 늦추는 조정까지 할 수 있다는 설계입니다.

## 정부가 이미 출시를 멈춰 세운 여름

칼럼이 나오기 한 달 전, 미국 정부는 프런티어 모델의 출시에 두 번 손을 댔습니다. 6월 12일 상무부 서한 한 장에 앤트로픽은 출시 3일 된 Fable 5와 Mythos 5를 모든 고객에게서 내렸고, 통제는 18일 뒤인 6월 30일 풀렸습니다. 그 경위는 [수출통제가 걸렸다가 풀리기까지를 정리한 글](/post/news-fable5-mythos5-export-control-lifted)에 있습니다. 6월 26일 공개된 오픈AI의 GPT-5.6은 정부가 고객사를 한 곳씩 승인하는 제한 프리뷰로 출발해, 처음 2주 가까이 쓸 수 있던 곳이 [미국 정부가 승인한 기업 20여 곳](/post/review-gpt56-early-testers-never-stops)뿐이었습니다.

제도 쪽에서도 움직임이 겹쳤습니다. 백악관은 6월 초 행정명령으로 프런티어 개발사가 공개 전 모델을 연방정부와 자발적으로 공유하는 틀을 만들었고, 6월 4일에는 공화·민주 하원의원이 함께 269페이지짜리 프런티어 AI 법안 초안을 냈습니다. 초안은 상무부 산하 CAISI(2025년 6월 AI 안전연구소에서 이름을 바꾼 AI 표준·혁신 센터)를 정식 기구로 세워 2027년부터 연 1억 달러를 배정하고, 면허를 받은 독립 검증기관이 반년마다 프런티어 랩을 감사하며, 모델 개발을 규제하는 주법의 효력을 3년 동안 멈추는 내용입니다. 캘리포니아와 뉴욕 등은 이미 주 차원의 프런티어법을 두고 있어, 연방 단일 기준을 두고 논쟁이 한창이었습니다.

그러니 7월의 쟁점은 출시 전에 모델을 볼지 말지를 이미 지나 있었습니다. 정부가 보고 있고, 멈춰 세운 적도 있습니다. 남은 물음은 어떤 기준으로, 어떤 조직이, 누구의 돈으로 보느냐였고, 하사비스의 칼럼은 이 세 물음에 모델을 만드는 쪽이 기구의 구성과 자금, 평가 절차까지 적어 내놓은 답입니다.

## 산업혁명의 10배를 10배 속도로

칼럼은 선언으로 시작합니다. 지금은 인류 역사의 전환점이고, 몇십 년 뒤 돌아보면 우리가 특이점의 초입에 서 있었다는 것을 알게 될 거라는 문장입니다. 하사비스는 AGI를 인터넷이나 모바일 같은 기술과 비교할 수 없고 전기나 불의 발견에 가깝다고 썼고, 우리가 모래를 생각하게 만드는 법을 찾아냈다고도 적었습니다. 충격의 크기는 산업혁명의 10배, 속도도 10배일 수 있다고 봤습니다.

곧바로 경고가 이어집니다. 프런티어 모델이 사이버보안에 던지는 문제는 이미 나타났고, 능력이 커지면 핵과 바이오 위험도 곧 나올 수 있으며, 점점 더 에이전트처럼 움직이고 스스로를 개선하는 시스템을 통제할 안전장치가 필요하다는 진단입니다. 모델을 그대로 두고 감싼 실행 구조만 바꿔 성능을 끌어올리는 방식은 [릴리안 웽이 하네스에서 찾은 자기개선의 출발점](/post/review-lilian-weng-harness-self-improvement)에서 다뤘습니다.

칼럼에서 가장 힘을 준 문장은 경쟁에 대한 진단입니다. 하사비스는 업계가 상업 경쟁과 지정학 경쟁이 겹친 아주 치열한 레이스에 갇혀 있고, 프런티어의 진전이 이 기술에 대한 이해를 앞지르고 있다고 썼습니다. 여기서 무엇이 벌어질지 세상 누구도 확실히 모르고 전문가들도 의견이 갈린다는 문장, 기술 위험을 해결할 시간과 여유를 우리가 지금 스스로에게 주지 않고 있다는 문장도 그대로 들어 있습니다.

![AI가 사람 기준으로 몇 분짜리부터 몇 시간짜리 작업까지 자율적으로 끝낼 수 있는지를 모델 출시 시점별로 찍은 로그 눈금 그래프로, 점들이 직선에 가깝게 올라간다](https://metr.org/assets/images/measuring-ai-ability-to-complete-long-tasks/length-of-tasks-log.png)

이런 문장은 보통 바깥의 비판자가 씁니다. 모델을 만드는 회사는 통제할 수 있다고 말하는 편이 사업에 유리하기 때문입니다. 이번에는 프런티어 랩의 대표가 이해가 진전을 따라가지 못한다는 문장을 자기 이름으로 적었고, 같은 칼럼에서 그 위험을 다룰 기구의 밑그림까지 내놓았습니다. 위험을 가장 먼저 보는 사람과 그 위험을 관리할 규칙을 설계하는 사람이 같다는 점이 이 문서를 읽는 첫 번째 축입니다.

## FINRA를 본뜬 표준기구

하사비스의 구상은 연방 정부가 감독하는 민관 파트너십이나 자율 규제 기구 형태입니다. 모델로 든 FINRA는 증권거래위원회(SEC) 감독 아래 회원사 3,300여 곳을 규제하는 민간 기구로, 회원사 회비와 제재금으로 운영됩니다. 표준기구 이사회에는 독립 기술 전문가와 오픈소스 진영 대표가 들어가고, 자금은 상당한 규모여야 하며 대부분 업계에서 나올 거라고 적었습니다. 세계 최고 수준의 기술 인재를 데려오고 대규모 시험에 필요한 연산 자원을 확보하려면 그만한 돈이 든다는 이유입니다.

**표준기구가 모델을 보는 순서**

1. **지정** 기구가 정한 벤치마크 기준을 넘는 모델은 프런티어급, 그 모델을 가진 조직은 프런티어 랩이 됩니다. 기준은 능력이 바뀌는 데 맞춰 정기적으로 고칩니다.

1. **권장 관행** 프런티어 랩에는 기술 세부를 담은 모델 카드 공개, 내부 사이버보안 강화, 주요 인력 심사, 안전·보안 연구에 충분한 자원 배정 같은 모범 관행을 권합니다.

1. **사전 공유** 처음에는 출시 30일 전까지 모델을 자발적으로 기구에 넘겨 평가받습니다.

1. **의무화** 평가 절차가 효과적이고 견고하다고 입증되면 제도화가 빠르게 뒤따를 수 있고, 그때부터는 이 평가를 통과한 모델만 미국 시장에 출시할 수 있습니다.

1. **출시 뒤** 출시 뒤 드러난 심각한 취약점은 랩과 기구가 함께 다룹니다.

모범 관행은 원문에서 권장 사항입니다. 의무가 되는 것은 출시 전 평가 한 가지이고, 그마저 평가 절차가 입증된 다음이라는 조건이 붙습니다. 국가안보와 닿는 분야의 시험은 연방기관, 미국 국립연구소와 함께 진행하도록 했습니다.

이 설계로 얻는 것은 속도와 전문성입니다. 정부 기관이 인력과 예산을 확보해 신기술을 따라가는 것보다, 업계가 낸 돈으로 업계 수준의 연구자를 뽑는 쪽이 빠릅니다. 평가 한 번에 대규모 연산이 드는 시험을 공무원 조직이 자체 예산으로 감당하기 어렵다는 현실도 여기에 깔려 있습니다.

## 기준을 연산량 대신 벤치마크로

프런티어급을 가르는 잣대를 벤치마크로 잡은 것도 기존 규제와 다른 선택입니다. EU AI 법은 학습 연산량이 10의 25제곱 FLOP을 넘는 범용 모델을 체계적 위험이 있는 모델로 추정하고, 캘리포니아가 2025년 9월 제정한 SB 53은 10의 26제곱 FLOP을 넘겨 학습한 모델을 프런티어 모델로 정의합니다. 연산량은 학습을 시작하기 전에도 어림할 수 있고 해석을 두고 다툴 일이 적습니다. 그 대신 증류나 학습 효율 개선으로 적은 연산에서 같은 능력을 내는 모델은 이 선 아래로 빠져나갑니다.

벤치마크 기준은 모델이 실제로 해내는 일을 재므로 적은 연산으로 만든 모델도 같은 선에서 걸립니다. 약점은 시험지 쪽에 있습니다. 점수가 꽉 차면 변별력이 사라지고, 공개된 문제에 맞춰 학습하면 점수가 능력보다 높게 나옵니다. 하사비스가 평가를 분기마다 고치고, 나중에는 기구가 랩과 독립된 비공개 시험을 직접 만들어야 한다고 적은 이유가 여기 있습니다. METR 측정처럼 AI가 끝내는 작업 길이가 7개월마다 두 배로 늘면, 분기마다 고치는 평가도 두 번 고칠 때마다 능력이 두 배 가까이 된 모델을 만나게 됩니다. 앤트로픽의 2025년 안도 연산량 하나에 기대지 않고 연산 비용과 평가 성능, 매출, 연구개발비를 함께 보자고 적었습니다.

## 시험지에 들어갈 항목

평가 항목으로는 사이버보안과 생물학 위협을 비롯한 고위험 분야의 능력 평가가 먼저 나옵니다. 여기에 에이전트 전용 시험으로 안전장치를 우회하려는 시도나 기만의 징후를 찾고, AI가 만든 이미지에 디지털 워터마크를 넣는지와 모델의 추론을 이해할 수 있게 사람이 읽을 수 있는 출력 토큰을 내는지 같은 모범 관행을 확인하도록 했습니다.

평가는 처음에 분기마다 고치고, 낡거나 점수가 꽉 찬 벤치마크는 버리고 바꿉니다. 처음에는 프런티어 랩과 협의해 만들지만, 나중에는 기구가 랩과 독립된 비공개 시험을 직접 만들어 과적합을 막는다는 계획입니다. 미국 정부와 함께 제3자 감사 기관 생태계를 키워 평가와 새 벤치마크 개발을 돕게 한다는 구상도 들어 있습니다.

세 항목의 부담은 고르지 않습니다. 이미지 워터마크는 여러 회사가 이미 넣고 있습니다. 사람이 읽을 수 있는 추론 요건은 사정이 다릅니다. 최근 모델들은 내부 사고 과정을 요약해 보여 주거나 감추는 방향으로 가고 있어, 이 요건이 의무가 되면 설계 선택을 되돌려야 하는 회사가 생깁니다. 이 요건의 배경에는 2025년 7월 딥마인드와 오픈AI, 앤트로픽, 영국 AI 안전연구소 등의 연구자 41명이 함께 낸 논문 「사고 사슬 모니터링 가능성」이 있습니다. 모델이 사람 말로 생각하는 동안에는 그 과정을 읽어 나쁜 의도를 잡아낼 수 있지만, 학습 방식이나 모델 구조에 따라 이 기회가 쉽게 사라질 수 있다는 경고였습니다. 기만 징후 시험은 무엇을 기만으로 볼지부터 합의된 적이 없습니다. 앤트로픽이 7월 2일 Fable 5를 다시 열며 공개한 사이버 안전장치 자료도 공격 기법을 막는 비율만 내놓고 정상 요청이 얼마나 더 막히는지는 숫자로 밝히지 않았습니다. 그 자료는 [탈옥 심각도 채점표를 다룬 글](/post/news-anthropic-fable5-cyber-safeguards)에 정리했습니다. 기구가 서면 첫 몇 년은 이런 정의를 두고 다투는 시간이 될 가능성이 큽니다.

## 감속 조항과 명예

칼럼에서 가장 멀리 나간 조항은 감속입니다. 하사비스는 이 틀이 상황의 심각성에 따라 강도를 올릴 수 있고, 필요하다고 판단되면 프런티어 랩들 사이에 개발 속도를 늦추는 조정까지 할 수 있다고 적었습니다. 적용 범위는 출신 국가를 가리지 않고, 모델이 공개형인지 폐쇄형인지도 가리지 않습니다. 스타트업이나 학계에서 나온 프런티어급이 아닌 모델은 이 절차에서 빠집니다. 미국이 시작해 국제 공통 표준의 출발점으로 삼고, 세계가 가장 심각한 위험을 다루는 방식에 합의하면서 모든 나라가 AI의 기회를 누리게 하자는 것이 칼럼의 그림입니다. 국제 문서가 없던 것은 아닙니다. 벤지오가 이끄는 국제 AI 안전 보고서는 2025년 1월 첫 판부터 30여 개 나라와 국제기구의 지지를 받아 100명 넘는 전문가의 위험 진단을 모아 왔습니다. 다만 진단을 모으는 보고서와 시험 권한, 출시 승인을 쥔 기구는 층위가 다른 제도입니다.

실행에서는 두 곳이 걸립니다. 하나는 가중치를 공개하는 모델입니다. 텐센트가 7월 6일 Hy3 정식판을 [조건 없는 아파치 2.0으로 푼 것](/post/news-tencent-hy3-apache-license)처럼, 한 번 공개된 가중치는 미국 시장 출시 승인과 상관없이 퍼집니다. 칼럼은 공개 모델에도 적용한다고만 적었고, 승인 대상이 파일을 올리는 행위인지 그 파일로 돌리는 서비스인지는 적지 않았습니다. 다른 하나는 이미 자체 분류 체계와 의무를 갖춘 EU AI 법으로, 두 체계가 겹치면 기업은 양쪽을 다 맞춰야 합니다.

칼럼에는 문장이 하나 더 있습니다. 하사비스는 프런티어 랩으로 지정되는 것이 상당한 명예가 될 것이라고 썼습니다. 규제 대상 지정이 명예가 되면 기준을 넘었다는 사실이 곧 브랜드가 됩니다. 기준을 넘으면 모델 카드와 보안, 인력 심사, 안전 연구에 드는 고정비가 한꺼번에 붙고, 넘지 못하면 의무는 없지만 명예도 없습니다. 게다가 초기 평가는 현직 프런티어 랩과 협의해 만드니, 명예의 기준을 이미 명예를 가진 회사들이 함께 정하게 됩니다.

## 3년 동안 쌓인 자율 약속

출시 전 시험을 자율로 약속한 역사는 3년이 됐습니다. 2023년 7월 구글과 오픈AI, 앤트로픽을 비롯한 7개 회사가 백악관에서 출시 전 내·외부 보안 시험과 AI 생성 콘텐츠 워터마크를 자발적으로 약속했고, 같은 해 11월 영국 블레츨리 파크 AI 안전 정상회의에서는 주요 기업들이 출시 전 모델을 정부와 함께 시험하는 데 동의했습니다. 딥마인드는 그달 문을 연 영국 AI 안전연구소에 가장 강력한 모델을 넘겨 시험받아 왔다고 밝혀 왔고, 2024년 5월부터는 위험한 능력 수준을 미리 정해 두고 모델이 거기에 닿는지 평가하는 프런티어 안전 프레임워크를 운영했습니다. 미국과 영국 연구소는 앤트로픽의 Claude 3.5 Sonnet 개선판과 오픈AI o1을 출시 전에 함께 시험하고, 그 결과를 2024년 11월과 12월 보고서로 냈습니다.

하사비스 안은 이 약속들을 한 기구로 모으고, 약속이 지켜졌는지 확인할 주체를 회사 밖에 두자는 제안에 가깝습니다. 워터마크와 출시 전 시험은 3년 전 약속에도 있던 항목이고, 새로 붙은 것은 벤치마크 기준에 따른 지정과 미국 시장 출시 조건, 공동 감속입니다. 2023년 약속문에는 어긴 회사가 받을 불이익이 적혀 있지 않았고, 하사비스 안에서 불이익에 해당하는 것도 의무화 이후 미국 시장에 출시하지 못한다는 조건 하나입니다.

## 만드는 쪽이 규칙을 쓸 때

업계 돈으로 운영되는 기구가 업계를 제재할 수 있느냐는 물음은 FINRA 자신이 오랫동안 받아 온 비판입니다. 회비를 내는 쪽이 규제 대상이면 강한 제재가 어렵고 규칙이 기존 사업자에게 유리하게 짜이기 쉬운데, 이를 규제 포획이라고 부릅니다. 그래도 FINRA는 벌금을 매기고 회원사 자격을 정지하거나 박탈하며 개인의 업계 종사를 막을 수 있고, 규칙을 바꿀 때는 SEC 승인을 받습니다. 하사비스 안에는 이런 징계 수단이 없고, 연방 정부가 감독한다고만 적었을 뿐 어느 기관이 무엇을 승인하는지는 적지 않았습니다.

하사비스 안은 기구의 구성으로 포획 위험을 줄이려 합니다. 독립 전문가와 오픈소스 대표가 들어가는 이사회, 랩과 독립된 비공개 시험, 제3자 감사 기관이 그 장치입니다. 반대로 위험을 키우는 요소는 업계 중심의 자금, 초기 평가의 공동 설계, 지정이 명예가 되는 구조입니다.

랩이 규제 설계도를 먼저 내놓은 것은 처음이 아닙니다. 앤트로픽은 2025년 7월 7일 프런티어 AI 투명성 프레임워크를 냈습니다. 연매출 1억 달러나 연구개발·설비투자 10억 달러 수준을 예로 들어 대형 개발사에만 안전 개발 프레임워크와 시스템 카드 공개를 요구하고, 자사 프레임워크 준수 여부를 속이면 법 위반이 되게 해 내부고발자를 보호하자는 내용입니다. 두 문서 모두 기준을 넘는 회사에만 의무를 걸어 작은 개발사의 반발을 줄였습니다. 다만 앤트로픽 안은 공개와 투명성에서 멈췄고, 하사비스 안은 출시 전 시험과 출시 승인, 공동 감속까지 나아갔습니다.

| 문서 | 적용 대상 | 주요 장치 | 출시 승인 |
| --- | --- | --- | --- |
| 앤트로픽 투명성 프레임워크 (2025년 7월) | 연매출 1억 달러 또는 연구개발·설비투자 10억 달러 수준 이상 | 안전 개발 프레임워크, 시스템 카드 공개, 허위 신고 위법화 | 없음 |
| 캘리포니아 SB 53 (2025년 9월 제정) | 10의 26제곱 FLOP 넘게 학습한 모델, 프레임워크 공개는 연매출 5억 달러 넘는 개발사 | 프런티어 AI 프레임워크 공개, 중대 안전 사고 신고, 내부고발자 보호, 위반당 최대 100만 달러 민사 벌금 | 없음 |
| 6월 하원 법안 초안 | 프런티어 랩 | CAISI 정식화, 면허 검증기관의 반기 감사, 주법 효력 3년 정지 | 초안에 명시 없음 |
| 하사비스 표준기구 안 (2026년 7월) | 기구 벤치마크 기준을 넘는 모델, 출신·공개 여부 무관 | 30일 전 자율 공유, 분기별 평가, 비공개 시험, 감속 조정 | 절차가 입증되면 미국 출시 조건 |

## 30일의 비용과 비어 있는 일정

30일이라는 기간에도 값이 붙습니다. 6월과 7월 사이 프런티어 모델은 몇 주 간격으로 나왔습니다. 자율 단계에서 30일을 내놓는 회사는 그만큼 경쟁사가 먼저 낼 시간을 벌어 주고, 제출하지 않는 회사는 아무것도 잃지 않습니다. 안전 규제에서 되풀이되는 구조입니다. 자율 규범은 지키는 쪽에 비용을 물리고, 참여가 적을수록 참여한 쪽의 손해가 커져 참여가 더 줄어듭니다.

그래서 자율에서 의무로 넘어가는 기간이 이 설계의 성패를 가릅니다. 칼럼은 제도화가 빠르게 뒤따를 수 있다고만 적었고, 기구를 언제 세우고 평가 절차를 무엇으로 입증하는지는 적지 않았습니다. 기구의 제재 수단이 무엇인지, 공개 가중치에 규칙을 어떻게 집행하는지도 비어 있습니다.

## 한국 모델이 이 규칙을 만나는 곳

출신 국가를 가리지 않는다는 조항은 한국 모델에도 그대로 적용됩니다. 표준기구가 정한 기준을 넘는 한국 모델은 의무화 이후 미국 시장에 나갈 때 같은 평가를 거치게 됩니다. 정부는 독자 파운데이션 모델의 목표를 6개월 안에 나온 최신 글로벌 모델 대비 95% 성능으로 잡았고, 이 목표는 [정부가 소버린 모델 목표를 정한 방식](/post/review-sovereign-ai-ax-legacy-loop)에서 다뤘습니다. 목표대로 간다면 한국 모델도 프런티어급 기준 근처에서 이 기구와 만나게 됩니다.

기준 아래라면 절차에서 빠지지만, 지정이 명예가 되는 구조에서는 빠진 모델이 조달이나 해외 판매에서 덜 신뢰받을 수 있습니다. 기준이 되는 벤치마크를 누가 만드는지도 변수입니다. 초기 평가를 현직 프런티어 랩과 협의해 만든다는 조항대로라면, 그 협의에 한국 개발사는 아직 들어가 있지 않습니다.

## 하사비스의 시간표

하사비스의 발언을 시간순으로 놓으면 이번 칼럼의 위치가 보입니다. 지난해 6월 WIRED 대담에서 그는 5~10년 안에 AGI가 올 확률을 50% 정도로 봤습니다. 일이 잘 풀리면 급진적 풍요의 시대가 온다며, 핵융합 같은 에너지로 전기가 거의 공짜가 되면 바닷물 담수화만으로 물 부족을 풀 수 있다는 예를 들었고, AI의 충격은 적어도 산업혁명만큼, 아마 훨씬 클 것이라고 말했습니다. 올해 4월 20VC 인터뷰에서는 산업혁명 10배 충격이 10배 속도로 와서 한 세기에 걸칠 변화가 10년 안에 몰린다고 수치로 말했고, 5월 구글 I/O 무대에서도 특이점의 초입이라는 표현을 썼습니다.

전망 자체는 1년 넘게 같았고, 이번에 달라진 것은 문서의 형식입니다. 시기 선언과 위험 목록, 기구 설계, 의무화 경로, 국제 확장까지 한 문서에 담아 정책 제안서의 꼴을 갖춘 것은 이번이 처음입니다. 칼럼은 제도 바깥의 질문으로 끝납니다. 물자가 모자라지 않는 세계에 맞는 새 경제 모델은 무엇이고, 어떤 가치로 살며, 의미와 목적은 어디서 오고, 인간 조건 자체는 어떻게 바뀔지 묻고, 이 답을 기술자에게만 맡겨서는 안 된다고 적었습니다. 하루 전인 7월 13일에는 노벨상 수상자 16명을 포함한 경제학자 200여 명이 AI 경제 충격에 대한 대응을 촉구하는 성명을 냈습니다.

남는 것은 두 시간표의 겹침입니다. 표준기구를 세우고 평가 절차를 입증하는 데는 몇 년이 걸리고, 하사비스가 말하는 AGI 도착까지도 몇 년입니다. 딥마인드는 이미 2023년부터 영국 연구소에 모델을 넘겨 시험받아 왔으니, 기구가 없어도 지금 확인할 수 있는 것은 30일이라는 기간과 결과 공개입니다. 다음 제미나이 프런티어 모델이 출시 30일 전에 외부 평가를 받았는지, 그 결과가 얼마나 공개되는지가 이 제안의 진심을 재는 가장 싼 시험입니다.

읽어 주셔서 고맙습니다.

초이 드림
