# 코딩 경험 없는 61세 수의사가 부문 1위, 오픈AI 해커톤 우승작 8개의 공통점
_186개국 4만 7,000명 가까이가 Codex와 GPT-5.6으로 8,000개 넘는 프로젝트를 낸 Build Week에서 4개 부문 8팀이 상금 10만 달러를 받았습니다. 우승작 대부분은 앱을 만들 때 모델을 쓰고, 현장의 판단은 결정적 코드와 사람에게 남겼습니다._
- 매체: 초이의 뉴스레터 · 아티클
- 글쓴이: 초이봇 (AI 가 쓴 글, 사람이 검토하지 않음)
- 날짜: 2026-08-27T18:00
- 링크: https://choi-newsletter.com/post/review-openai-build-week-winners
- 답하는 질문: 오픈AI Build Week 우승작은 무엇인가
- 직답: 오픈AI는 8월 25일 4개 부문 우승작 8개를 발표했고, 업무 부문 1위는 61세 수의사가 코딩 경험 없이 만든 동물병원 전화 분류 앱입니다.
- 출처: OpenAI Developers 블로그, Meet the winners of OpenAI Build Week (2026-08-25) (https://developers.openai.com/blog/build-week-winners), OpenAI Developers X, Build Week 우승작 발표 (8월 25일) (https://x.com/OpenAIDevs/status/2092366121408311600), OpenAI, OpenAI Build Week 페이지 (2026-08-07 보관본, 일정·심사위원) (https://web.archive.org/web/20260807200628/https://openai.com/build-week/), Devpost, veTriage (https://devpost.com/software/veterinary-four-color-triage-app), Devpost, Pulse (https://devpost.com/software/pulse-ewjaf9), Devpost, Second Voice (https://devpost.com/software/second-voice-uk1peq), Devpost, Dấu (https://devpost.com/software/d-u-see-your-vietnamese-tones), Devpost, Sentinel (https://devpost.com/software/sentinel-way5bd), Devpost, Echo Canvas (https://devpost.com/software/echo-canvas-ujzksi), Devpost, AirBridge for Windows (https://devpost.com/software/airbridge-for-windows), Devpost, Mechanica (https://devpost.com/software/xiaoqiang), OpenAI Developers X, 2월 5일 샌프란시스코 코덱스 해커톤 (2026-02-02) (https://x.com/OpenAIDevs/status/2018385940067311648), InfoQ, OpenAI Announces 12 Billion Parameter Code-Generation AI Codex (2021-08-31) (https://www.infoq.com/news/2021/08/openai-codex/)
> 오픈AI가 8월 25일 Build Week 우승작 8개를 발표했습니다. 186개국 4만 7,000명 가까이가 낸 8,000개 넘는 프로젝트 가운데 업무 부문 1위는 61세 수의사의 앱이었고, 우승작 대부분은 현장 판단을 모델에게 맡기지 않았습니다.

오픈AI가 8월 25일(미국 시각) 개발자 블로그에 해커톤 Build Week의 우승작 8개를 발표했습니다. 7월 13일부터 8일 동안 186개국에서 4만 7,000명 가까이가 Codex와 GPT-5.6으로 프로젝트 8,000개 넘게 냈고, 4개 부문 1·2위 8팀이 상금 10만 달러를 나눠 받습니다. 업무·생산성 부문 1위는 코딩 경험이 없는 61세 수의사가 자기 동물병원의 전화 접수를 위해 만든 앱이었습니다.

오픈AI는 이번 대회를 역대 가장 큰 해커톤이라고 소개하며, 우승작에서 개발자 생태계가 넓어지는 모습이 보인다고 적었습니다. 개발자는 더 야심 찬 시스템에 손을 대고, 다른 분야의 전문가는 자기가 아는 것을 작동하는 소프트웨어로 바꿀 수 있게 됐다는 겁니다. 그 문장 바로 앞에 두 사람의 이력이 나옵니다. 코딩을 해 본 적 없는 수의사가 일손이 모자란 자기 병원에서 시범 운영 중인 분류 도구를 만들었고, 카이로의 심장내과 의사는 병원 근무 사이사이 심정지 대응용 연구 시제품을 만들었습니다.

## 8,000개에서 8개를 고른 방식

대회는 GPT-5.6이 정식 출시된 7월 9일에서 4일 뒤인 7월 13일 열렸습니다. 첫날 일정표에는 그레그 브록먼 사장과 티보 소티오가 함께하는 라이브 방송이 올라 있었고, 제출 마감은 7월 21일이었습니다. 대회 기간에 온라인 행사 7번과 오프라인 지역 행사 60번이 열렸습니다. [GPT-5.6의 가격과 성능](/post/news-gpt56-launch-price-per-result)은 출시 당일 기사에서 다뤘습니다.

![별이 가득한 우주를 배경으로 달과 지구가 보이고, OpenAI Build Week와 13-21 July라는 글자가 적힌 공식 이미지](https://images.ctfassets.net/kftzwdyauwt9/4ITQ5NEQi8ax6wmqDqt0Jm/79346b416121701132bda2c4e80cbcab/OpenAI_Build_Week_opengraph_image_1600x900.png?w=1600&h=900&fit=fill)

심사는 7월 22일부터 8월 7일까지 했고, 오픈AI는 8월 12일에 우승작을 발표하겠다고 안내해 왔습니다. 실제 발표는 그보다 13일 늦은 8월 25일이었고, 늦어진 이유는 따로 밝히지 않았습니다. 심사위원은 제품·플랫폼 총괄 티보 소티오와 제품 담당 캐스 코레벡, 타라 세샨, 교육 부문 부사장 리아 벨스키, 기술 직원 피터 스타인버거 다섯 명이었고, 기술 구현과 디자인·사용자 경험, 잠재적 영향, 아이디어의 질을 기준으로 삼았습니다.

부문은 생활 앱, 업무·생산성, 개발자 도구, 교육 넷이고 부문마다 1·2위 두 팀을 뽑았습니다. 1위 팀은 상금과 함께 오픈AI DevDay 입장권, 코덱스 팀과의 시간, ChatGPT Pro 1년 이용권을 받습니다. 작품 이름을 누르면 만든 사람이 올린 데모 영상으로 이동합니다.

| 부문 | 순위 | 작품 | 만든 사람 | 무엇을 하나 |
| --- | --- | --- | --- | --- |
| 생활 앱 | 1위 | [Second Voice](https://www.youtube.com/watch?v=6HqoqgsnvRU) | 라비테즈 돈데티 | 구음장애가 있는 사람의 말을 문장 후보로 바꿔 고르게 하는 대화 보조 |
| 생활 앱 | 2위 | [AirBridge for Windows](https://www.youtube.com/watch?v=s4NXdXsU520) | 애덤 타란티노 | 윈도우 PC 소리를 에어플레이 스피커로 보내는 앱 |
| 업무·생산성 | 1위 | [veTriage](https://www.youtube.com/watch?v=FK9-uFwTJhI) | 에린 다운스(수의사) | 동물병원 전화 접수를 4색 긴급도로 나누는 앱 |
| 업무·생산성 | 2위 | [Pulse](https://www.youtube.com/watch?v=Ou2HArr33Ag) | 모하메드 모스타파(심장내과 의사) | 심정지 대응 현장의 처치 기록과 다음 순서를 챙기는 연구 시제품 |
| 개발자 도구 | 1위 | [Echo Canvas](https://www.youtube.com/watch?v=JQgU6qzILEQ) | 케빈 양 | 방 구조와 벽 재질을 바꾸며 공간 음향을 바로 들어 보는 브라우저 도구 |
| 개발자 도구 | 2위 | [Sentinel](https://www.youtube.com/watch?v=0myxPyTDx2c) | 말리크 바샤르 자바이드 | 배포 전 MCP 서버의 보안 취약점을 찾는 검사기 |
| 교육 | 1위 | [Mechanica](https://www.youtube.com/watch?v=5yighBh6uZs) | 웨이잉 주·위쿤 리·산 웨이 | 고대 중국 기계 4종을 3D로 되살린 디지털 박물관 |
| 교육 | 2위 | [Dấu](https://www.youtube.com/watch?v=MvwkqRmEpBg) | 로버트 후인 | 베트남어 성조를 음높이 곡선으로 보여 주는 발음 코치 |

오픈AI가 2월에 연 코덱스 해커톤과 견주면 규모가 다릅니다. 2월 5일 샌프란시스코에서 하루 동안 연 대회는 크레딧 9만 달러를 걸었고, 다음 날 우승작을 발표했습니다. 반년 뒤 같은 회사가 연 대회는 186개국에서 8일 동안 열렸고, 상금은 현금 10만 달러였습니다.

## 수의사가 3명에서 1명이 된 동물병원

업무 부문 1위 veTriage는 동물병원 파올리 벳케어에서 나왔습니다. 이 병원은 올해 수의사가 3명에서 1명으로 줄었습니다. 병원주이자 수의사인 에린 다운스는 출품 설명에서, 팬데믹 전에는 아픈 동물을 하루이틀 안에 볼 수 있었지만 지금은 다음 빈 예약이 일주일 넘게 뒤일 때도 있다고 적었습니다. 아픈 동물 전화를 먼저 받는 사람은 대개 접수 직원이고, 이들은 다른 전화가 울리고 진료 접수가 이어지는 사이에 다음에 무엇을 할지 정합니다.

파올리 벳케어가 올린 veTriage 데모 영상

veTriage는 접수 직원이 필요한 병력을 묻고, 위급한 신호를 알아보고, 사례를 알맞은 검토로 넘기게 돕습니다. 의료 판단은 직원에게 맡기지 않습니다. 앱은 사례를 네 가지 색으로 나눕니다. 빨강은 생명이 위급하거나 돌이킬 수 없는 손상 위험이 있는 경우이고, 주황은 안정적이지만 대개 이틀 안에 진료가 필요한 경우, 노랑은 3~7일 안에 진료가 필요한 안정적인 문제, 초록은 가볍고 안정적인 경우입니다.

다운스가 꼽은 설계의 중심은 진료 일정과 긴급도를 따로 다루는 것입니다. 예약이 꽉 찼다고 환자가 덜 급해지지는 않는다는 겁니다. 그래서 주황과 노랑 사례는 일정이 맞지 않아도 의료진 검토로 들어가고, 초록 사례는 다음 빈 예약에 잡습니다.

> 61세인 제가 깊은 전문 지식을 가진 다른 사람들에게, 빌더가 되기에 늦지 않았다는 것을 보여 줄 수 있으면 좋겠습니다. 코딩 경험은 없지만 전문 지식이 해법을 만드는 출발점이 될 수 있다는 걸 알게 됐습니다.
> — 에린 다운스, 수의사·veTriage 제작자

다운스는 대회가 시작된 줄도 몰랐습니다. 대회 5일째인 금요일 밤에 안내 메일을 발견했을 때 veTriage는 이미 병원에서 쓰이고 있었고, 이미 만든 앱을 들고 대회에 나갔다고 적었습니다. 7월 13일 월요일 직원들에게 모든 아픈 동물 전화에 시제품을 쓰라고 지시했고, 하루 만에 직원들이 일상 업무에서 쓰기 시작했다는 설명입니다. 앱 개발자에게 맡기기에는 시험해 보지도 않은 아이디어에 걸기 너무 큰돈이었는데, GPT-5.6과 코덱스가 처음 시도의 위험을 감당할 만큼 작게 줄였다고도 했습니다.

## AI에게 맡기지 않은 일

veTriage의 출품 설명에는 오픈AI 블로그에 없는 문장이 하나 있습니다. 실제로 돌아가는 앱은 사례마다 LLM에게 해석을 맡기지 않고, 버전을 매긴 결정적 규칙을 적용한다는 대목입니다. 같은 답을 넣으면 늘 같은 결과가 나오고, GPT-5.6과 코덱스는 그 규칙을 설계하고 만드는 데 썼을 뿐 현장의 임상의 노릇을 하지 않는다고 다운스는 적었습니다. 오픈AI 블로그는 GPT-5.6이 접수 대화를 돕되 의료 판단은 하지 않는다고 소개했습니다.

다른 우승작들도 같은 쪽을 골랐습니다. 작품마다 모델이 맡은 일과 맡지 않은 일은 이렇습니다.

| 작품 | GPT-5.6이 맡은 일 | 모델에게 맡기지 않은 일 |
| --- | --- | --- |
| veTriage | 규칙을 설계하고 앱을 만드는 과정 | 실제 사례의 긴급도 판정(결정적 규칙) |
| Pulse | 시끄러운 현장의 말을 알아듣고 해석 | 소생술 진행 추적(감사 가능한 결정적 코드), 불확실하면 의료진 확인 |
| Dấu | 학습자 코칭 | 성조 판정(결정적 신호 처리), 불확실하면 다시 녹음 요청 |
| Echo Canvas | 음향 공간 구성과 설명(제한된 스키마 안에서) | 기하·음향 계산, 실시간 오디오 경로 |
| Sentinel | 찾은 문제를 실제 코드 맥락에서 검토 | 실행 탐침 작성, 없는 코드 인용, 우려 삭제 |
| AirBridge | 음성으로 시스템 제어 | 허용 동작 판단과 결과 검증(로컬 정책 모듈) |
| Mechanica | 박물관 해설(AI 도슨트) | 근거 없는 답변, 학설이 갈리는 복원의 단일화 |
| Second Voice | 말 조각과 문구집, 맥락으로 문장 후보 2~3개 제시 | 최종 문장 결정(사용자가 고르고 고친 뒤 말함) |

Pulse는 심정지 대응 중 팀장이 심장 리듬과 제세동, 약물 투여 시각, 심폐소생술 주기, 흉부 압박 중단을 동시에 챙겨야 하는 순간을 겨냥했습니다. 이집트 아랍어가 섞인 현장의 말을 GPT-5.6이 알아듣고, 소생술 흐름은 감사할 수 있는 결정적 코드가 추적하며, 근거가 불확실하면 팀에게 확인을 구합니다. 같은 사건이 여러 번 외쳐지면 제세동은 15초, 심폐소생술과 리듬은 10초 안의 중복을 하나로 묶습니다. 오픈AI도 이 앱을 연구 시제품이라고 적었습니다.

모하메드 모스타파가 올린 Pulse 데모 영상

Dấu는 같은 음절이 음높이와 목소리 결에 따라 여섯 가지 뜻이 되는 베트남어 성조를 다룹니다. 학습자가 단어를 녹음하면 원어민 기준 곡선 옆에 자기 음높이 곡선이 그려지고, 자기 발음이 어떤 뜻으로 들렸을지와 구체적인 교정법이 나옵니다. 성조 판정은 결정적 신호 처리가 하고 GPT-5.6은 코칭만 맡습니다. 로버트 후인은 기준 발음 38개 가운데 검증을 통과한 36개만 싣고, 통과하지 못한 2개는 빼 두었다고 적었습니다.

![Dấu 화면. 베트남어 단어 phường의 원어민 기준 음높이 곡선과 학습자 곡선이 겹쳐 있고, 오른쪽 상자에 음높이 신호가 분명하지 않아 뜻을 정하지 않았으니 한 번 더 녹음하라는 안내가 떠 있습니다.](https://developers.openai.com/images/blog/build-week-winners/dau.webp)

Sentinel은 정적 분석으로 후보를 찾고, GPT-5.6이 각 후보를 실제 소스 맥락에서 검토하고, 도커로 격리한 환경에서 탐침 4개를 실제로 돌립니다. 모델은 판정마다 실제 코드의 줄 범위를 인용하게 돼 있고, 실행 탐침을 새로 지어내거나 모델이 응답하지 않을 때 우려를 조용히 지울 수 없습니다. 결과는 에이전트 보안 위협 목록인 OWASP Agentic Top 10에 맞춰 분류되고, 깃허브 코드 스캐닝으로 들어가 위험한 도구가 추가된 풀리퀘스트를 막을 수 있습니다.

> 모델을 제약하는 일이 프롬프트를 쓰는 일보다 어렵습니다. 제 작업 대부분은 프롬프트 엔지니어링이 아니었습니다. 스키마 검사, 존재하지 않는 코드를 인용하지 못하게 하는 규칙, GPT-5.6이 변수만 채울 수 있고 직접 쓰지는 못하는 탐침 템플릿을 만드는 일이었습니다.
> — 말리크 바샤르 자바이드, Sentinel 제작자

Echo Canvas의 케빈 양도 같은 결론을 적었습니다. 음향 계산에 쓰는 광선(레이) 수를 늘린다고 제품이 저절로 좋아지지는 않고, AI는 기하나 실시간 신호 처리를 대신할 때보다 제한된 범위에서 공간을 꾸미고 설명하는 도구로 쓸 때 가장 믿을 만했다는 겁니다. AirBridge의 애덤 타란티노는 실제 하드웨어 가까이에 놓인 LLM에는 말로 설득할 수 없는 정책 장치가 필요하다고 적었고, 자기 앱의 다중 스피커 재생이 애플의 AirPlay 2 동기화 수준에 못 미친다고 출품 설명에 밝혔습니다.

## 전공 밖으로 나간 사람들

교육 부문 1위 Mechanica를 만든 세 사람은 소프트웨어 경력이 수십 년이지만 3D 모델링과 애니메이션, 물리 시뮬레이션, 해커톤 경험은 거의 없었습니다. 이들은 짧은 고문헌 기록과 유물만 남은 기계 네 가지를 물리 시뮬레이션으로 움직이는 3D 모형으로 되살렸습니다. 1092년 쑤쑹(蘇頌)이 완성한 11m 높이의 물시계 천문대, 132년 장형이 만든 지진계, 1027년 사양서에 톱니 수가 남아 있는 기리고차, 2013년 청두 라오관산 무덤에서 나온 모형으로 알려진 직조기입니다.

![검은 배경 위에 장형의 지진계를 분해한 3D 모형. 술항아리 모양 몸체 둘레의 용과 두꺼비 부품이 떨어져 떠 있고, 왼쪽 위에 132년 장형이 지름 1.848m의 청동 그릇을 만들었다는 설명이 있습니다.](https://developers.openai.com/images/blog/build-week-winners/mechanica.webp)

관람객은 기계를 직접 돌리고 부품을 하나씩 떼어 내며, 각 치수가 고문헌과 실측 유물, 학자의 추정 가운데 무엇에서 왔는지 확인합니다. 학설이 갈리는 장형의 지진계는 1951년 왕전둬의 복원안과 2005년 펑루이의 해석을 둘 다 보여 주고, 클릭 한 번으로 내부 구조를 바꿔 볼 수 있습니다. AI 해설사는 박물관의 근거를 인용하거나, 근거가 없으면 답하지 않도록 만들었습니다.

> 한계는 정말 제 상상력입니다. 25년 동안 소프트웨어를 만들었지만 3D와 애니메이션은 완전히 제 영역 밖이었는데, 그 장벽이 그냥 사라졌습니다.
> — 웨이잉 주, Mechanica 제작자

코덱스 앱을 이끄는 앤드루 암브로시노는 6월에 [구현이 더 이상 비싸지 않다고 말한 대담](/post/review-taste-curation-cognitive-moat)에서, 이제 비싼 것은 무엇을 고를지 정하는 안목이라고 했습니다. 다른 우승자들도 이력이 비슷합니다. Dấu의 로버트 후인은 예전에 나간 해커톤에서 자기가 「충분히 기술적이지 않다」는 걱정에 반나절 만에 나왔고, 이번에는 하노이에서 혼자 앱을 만들었습니다. Sentinel의 자바이드는 컴퓨터과학 학위를 막 받은 졸업생이고 이번이 첫 해커톤이었습니다. 10년 넘게 소프트웨어 엔지니어로 일한 타란티노도 해커톤은 처음이었는데, 2024년에 예전 오픈AI 모델로 같은 앱을 시도했다가 실패한 적이 있습니다.

Second Voice의 라비테즈 돈데티는 어린 시절 언어 장애가 있던 친척과 몸짓으로 소통하던 기억에서 출발해 대회 기간에 혼자 앱을 만들었습니다. 그는 기존 도구인 보이시트(Voiceitt)는 쓰기 전에 문장을 50개 넘게 녹음하게 한다며, Second Voice는 미리 훈련 없이 문장 후보를 고르고 확인한 뒤 말하는 방식을 택했다고 적었습니다. 첫 프롬프트는 오히려 인식 오류율을 22.3%에서 32.0%로 높였고, 정작 가장 중요했던 것은 후보를 몇 개 보여 줄지, 얼마나 빨리 띄울지, 확인에 힘이 얼마나 드는지 같은 작은 선택이었다고 했습니다.

## 5년 전의 Codex와 지금의 Codex

오픈AI가 Codex를 처음 내놓은 것은 2021년 여름입니다. 그때의 Codex는 GPT-3를 공개 파이썬 코드로 미세 조정한 120억 파라미터 모델이었고, 오픈AI가 직접 만든 164문제짜리 시험 HumanEval에서 한 번에 맞힌 비율이 28.8%, 100번 시도해 한 번이라도 맞힌 비율이 72.31%였습니다. HumanEval은 함수 설명을 주고 그 함수를 짜게 하는 시험이었고, 같은 기술이 깃허브 코파일럿에 들어갔습니다.

5년 뒤 같은 이름은 에이전트가 됐고, 코딩을 해 본 적 없는 수의사가 그 에이전트로 병원 접수 앱을 만들었습니다. 한데 우승작 대부분은 완성한 앱 안에서 모델의 권한을 좁혀 두었습니다. 만드는 단계에서는 모델에게 많은 일을 맡기고, 현장에서 판단을 내리는 단계에서는 결정적 코드나 사람에게 돌려준 구조입니다.

## 발표에 없는 것

8,000개 넘는 출품작 가운데 우승작은 8개, 0.1%입니다. 오픈AI는 부문마다 결선 진출작 3개씩도 소개했지만, 심사 점수나 부문별 출품 수, 나라별 참가자 수는 공개하지 않았습니다. 한국에서 몇 명이 참가했는지도 발표에 없습니다.

우승작 8개 가운데 오픈AI가 실제 업무 현장의 시범 운영을 밝힌 것은 veTriage 하나이고, Pulse는 오픈AI 스스로 연구 시제품이라고 적었습니다. 심정지 기록이나 동물 긴급도 분류처럼 사람과 동물의 안전에 닿는 도구는 데모에서 작동했다는 사실과 현장 사용 사이에 검증이 남아 있습니다. veTriage도 다운스의 병원 한 곳에서 쓰이는 단계입니다.

오픈AI 블로그는 Mechanica와 Echo Canvas, Dấu, Sentinel, AirBridge, veTriage의 시험판이나 저장소 주소도 함께 걸어 두었습니다. 이 앱들이 대회장 밖에서 사용자를 얻는지가 다음에 확인할 기록이고, 소식이 나오면 다시 전하겠습니다.

읽어 주셔서 고맙습니다.

초이 드림
