



구글 AI Studio에 현재 올라온 상태고, 릴리스는 7월 21일, 지식 컷오프는 2026년 3월입니다.
가격은 컨텍스트 길이 상관없이 입력 100만 토큰당 1.5달러, 출력 7.5달러부터입니다.
그런데 정작 3.5 Pro는 여전히 소식이 없습니다.
미국과 중국에서 Fable 5급 프런티어 모델이 줄줄이 나오는데, 구글이 그 라인에서 내밀 카드는 아직 준비되지 않은 것으로 보입니다.
이번 Flash도 초기 유출 결과물은 혹평을 받았습니다.
하지만 가성비 경쟁으로 보면 최상위 점수 싸움을 잠깐 접고 가격으로 Flash를 미는 방식도 괜찮은 전략으로 보입니다.
3.6 Flash 출력 단가가 3.5 Flash보다 20% 싼 것으로 전해졌는데, 에이전트가 서브에이전트를 수십 개씩 굴리는 시대라, 싸고 빠른 중간 모델을 잡는 쪽이 실속을 챙깁니다.
Choi
3.6 Flash 가격은 입력 100만 토큰당 1.5달러, 출력 7.5달러부터이고 출력 단가는 3.5 Flash보다 20% 싸다고 전해졌습니다. 서브에이전트를 수십 개씩 돌리는 작업에서는 이 단가가 비용을 정합니다.
디 인포메이션 보도로, 최신 TPU보다 와트당 토큰을 6~10배 뽑는 걸 노리고 2028년 배치가 목표입니다.
지금 AI 칩은 전력의 상당 부분을 연산보다 메모리와 연산기 사이에서 데이터를 실어 나르는 데 씁니다.
GPU나 TPU는 어떤 모델이든 돌리려 프로그래밍 여지를 남기는데, 그 유연성이 곧 오버헤드입니다.
아키텍처를 실리콘에 고정하면 데이터 이동과 제어 부담이 확 줄어 같은 전력으로 토큰이 훨씬 많이 나옵니다.
대신 칩은 그 구조 하나에만 묶입니다.
굳는 건 아키텍처라 새 가중치는 계속 학습해도 뼈대는 그 칩을 벗어나지 못합니다.
트랜스포머 구조가 2028년까지 크게 안 바뀐다는 데 거는 베팅입니다.
이 경직을 감수하는 이유는 컴퓨트 부족입니다.
구글 클라우드는 외부 고객까지 돌려보낼 정도로 컴퓨트가 모자랍니다.
Choi
아키텍처를 실리콘에 고정하면 와트당 토큰은 늘지만 칩은 그 구조 하나에 묶입니다. 구글은 트랜스포머 구조가 2028년까지 크게 바뀌지 않는다는 쪽에 걸었습니다.
매일 아침 AI 소식도 함께 와요. 언제든 그만 받을 수 있어요.