Google I/O가 끝나고 예측 다섯 개를 채점했다
- 공유 링크 만들기
- X
- 이메일
- 기타 앱

1편 끝에 닷새 뒤에 다시 보자고 적어뒀습니다. 그 닷새가 지났고 Google I/O도 끝났고 오늘은 키노트 일주일 뒤입니다. AI 전선을 클라우드, 디바이스, 폼팩터 세 갈래로 나눠 그려두고 닫았던 글을 다시 열어놓고 다섯 예측을 한 줄씩 채점해봤습니다.
채점은 단순하게 했습니다. 맞으면 ○, 반쯤 맞으면 △, 틀리면 ×. 제가 그은 줄을 제가 다시 보는 거라 좀 민망하기는 했습니다. 예측 글은 쓰기는 쉬운데 다시 열어보기가 어렵습니다. 맞은 건 기억나고 틀린 건 잘 안 떠오릅니다. 그래서 일부러 1편을 옆에 펴놓고 문장 그대로 대조했습니다. 기억으로 채점하면 아마 다 ○를 줬을 것 같습니다.
예측 글을 왜 쓰는지도 채점하면서 좀 생각해 봤습니다. 맞히려고 쓰는 건 아닌 것 같습니다. 맞힐 자신이 있었으면 그렇게 거칠게 묶지 않았을 겁니다. 그보다는 지금 제가 세상을 어떻게 보고 있는지를 한번 적어두고 싶었던 것에 가깝습니다. 적어두지 않으면 나중에 제가 처음부터 이렇게 봤던 것처럼 기억이 바뀌니까요. 그러니 채점이라는 것도 결국 그때의 제 눈과 지금의 제 눈을 나란히 놓아보는 일인 것 같습니다.
다 채점하고 나니 △가 많았습니다. 맞은 것도 있고 어긋난 것도 있었는데 그건 예상했던 정도였습니다. 한 줄에 두세 가지를 묶어놨으니 그럴 만했습니다. 거칠게 그린 그림이 키노트랑 어느 정도 맞물렸다는 데서 조금 안도했습니다.
그런데 채점보다 옆에 적어둔 메모 두 줄이 더 무거웠습니다. 채점은 제가 쓴 문장이 맞았느냐를 보는 거라 끝이 있는데, 메모는 제가 아예 안 쓴 걸 보는 거라 어디까지 봐야 끝인지가 없습니다. 1편이 아예 못 본 게 두 개 있었습니다. 하나는 1편을 쓸 때 이미 나와 있던 모델이었고, 하나는 제가 한 회사만의 베팅이라고 그린 폼팩터 쪽에 다른 회사가 다른 방식으로 같은 걸 들고 들어온 일이었습니다.
다섯 줄 채점
1편 다섯 예측은 이랬습니다. Gemini 3.2 Flash 공식 발표, 3.2 Pro 티저, Android OS 통합 가속, Astra 후속 데모, 그리고 OpenAI는 I/O 직후 응수하고 Anthropic은 6~7월에 Sonnet 5를 조용히 내고 Sweetpea 는 가을, Opus 5는 그 뒤.
첫 줄은 △입니다. 나온 건 3.2가 아니라 Gemini 3.5 Flash였고 바로 풀렸습니다. 저는 3.1 Pro 다음이니 마이너 업데이트로 3.2 Flash 정도가 나올 거라고 봤는데 Google은 한 단계 크게 뛰었습니다. 번호는 틀렸는데 위치는 맞았습니다. 키노트 메인이 새 Flash 라인일 거라는 건 맞았고, 1편에서 디바이스 쪽은 OEM이 메인이 될 거라고 했는데 OEM 쪽에 들어가는 건 결국 Flash 계열입니다. 제일 작고 빠르고 싸게 만들어서 폰과 노트북에 넣는 모델이요. 3.5 Flash가 딱 거기 들어갔습니다. 벤치 숫자는 제 생각보다 훨씬 셌습니다. Google 스스로 3.1 Pro를 거의 모든 벤치에서 넘고 다른 frontier 모델보다 4배 빠르다고 적었습니다. Flash가 한 단계 위 모델을 넘는 건 제가 그린 것보다 큰 점프였습니다. 작고 싼 모델이 크고 비싼 모델을 넘으면 사람들이 어느 쪽을 쓰게 될지는 뻔해 보입니다. 1편에서 OEM 쪽이 메인이 될 거라고 한 게 이 점프 덕분에 더 그럴듯해진 것 같기도 합니다. 방향은 맞았는데 크기를 작게 잡았습니다. 번호를 보수적으로 잡은 건 그냥 지난번이 3.1이었으니까 다음은 3.2겠지 하는 정도의 생각이었습니다. 따져보면 근거라고 할 게 없었습니다. 회사가 번호를 어떻게 붙일지는 제가 알 수 있는 게 아닌데 숫자를 하나 적어두니 예측처럼 보였던 것 같습니다.
둘째 줄도 △입니다. 3.5 Pro는 6월로 미뤄졌습니다. Sundar Pichai 가 다음 달에 나온다고 하자 현장 청중에서 아쉬워하는 소리가 났다는 보도가 있었고, 내부에서는 이미 쓰고 있다는 말도 같이 나왔습니다. 1편엔 티저라고만 적었으니 티저였다는 건 맞습니다. 다만 저는 I/O에서 같이 깔리는 보조 트랙 정도로 생각했는데, 실제로는 메인 키노트에서 한 박자 미루는 발표였습니다. 청중이 아쉬워했다는 게 그 차이를 보여주는 것 같습니다. 작아 보이는데 저는 이게 꽤 의미가 있다고 봤습니다. Google이 frontier 모델을 키노트 일정에 못 맞췄다는 거니까요. Flash가 먼저 준비됐고 Pro는 아직 다듬는 중이라 Flash로 키노트를 채우고 Pro는 한 달 늦췄습니다. 내부 일정이 어디서 밀리는지까지는 1편에서 못 봤습니다. 키노트는 회사가 제일 잘 보이고 싶은 날이라 거기서 한 박자 미뤘다는 건 그만큼 사정이 있었다는 얘기 같습니다. 밖에서 보는 사람은 그 사정을 모르니 이런 작은 어긋남을 보면서 짐작하는 수밖에 없습니다.
셋째 줄은 ○입니다. 1편에 Gemini는 이제 챗봇이 아니라 안드로이드의 운영 계층이고 폰, 차, 노트북, 브라우저에서 같은 Gemini가 돈다고 적었는데 키노트에서 그 그림이 거의 그대로 나왔습니다. 핵심은 Antigravity 2.0 데스크톱 앱이었습니다. Gemini API에 Managed Agents 가 들어갔고, Google AI Studio 안에서 안드로이드 앱을 바로 vibe coding 할 수 있게 됐고, Android Studio 에는 마이그레이션 에이전트가 들어가서 주 단위 일을 시간 단위로 줄인다고 했습니다. 단순히 OS에 붙인 게 아니라 운영체제 위에 에이전트 하네스 자체를 올리겠다는 그림이라 1편에서 말한 운영 계층보다 한 층 더 깊었습니다. 1편은 운영 계층이라고 불렀는데 키노트는 agent layer 라고 불렀습니다. 그 단어가 더 맞는 것 같습니다. 운영 계층이라고 하면 OS 안에 Gemini 가 들어간다는 느낌인데, agent layer 라고 하면 OS 위에서 Gemini 가 일을 한다는 느낌입니다. 한 단어 차이인데 사람이 하는 일이 얼마나 넘어가느냐가 꽤 다르게 들립니다.
넷째 줄도 ○로 줬습니다. 이름만 달랐습니다. 저는 Astra 후속 데모라고 적었는데 실제 이름은 Gemini Omni 와 Gemini Spark 였고 Astra 라는 이름은 키노트에 안 보였습니다. 멀티모달, 라이브, 주변 인식이라는 모양은 맞았습니다. Astra 는 2024~2025년 데모 라인이었으니 데모를 졸업하고 정식 제품 이름을 받은 거라고 봅니다. 데모에서 제품으로 넘어가는 걸 제가 못 본 셈인데 채점까지 바꿀 정도는 아니었습니다. 그래도 이름을 바꿨다는 건 좀 생각해볼 만한 것 같습니다. 데모일 때는 이름이 연구 프로젝트 같았는데 제품이 되면서 Omni, Spark 처럼 팔기 좋은 이름이 됐습니다. 이름이 바뀌는 날이 실험이 끝나는 날인 것 같기도 합니다. 그렇다면 1편에서 Astra 라는 이름으로 적어둔 건 실험 단계의 이름을 붙들고 있었던 셈입니다. 밖에서 보는 사람은 회사가 이름을 바꿀 때까지 그게 아직 실험인지 이미 제품인지 잘 모릅니다. 저도 이름이 그대로니까 아직 데모겠거니 했던 것 같습니다. 이름을 보고 단계를 짐작하는 건 편하긴 한데, 회사 입장에서는 이름을 언제 바꿀지도 발표의 일부라서 밖에서 그걸로 속도를 재는 건 좀 순진한 방법이었던 것 같습니다.
다섯째 줄이 제일 거칠었습니다. 한 줄에 네 가지를 넣었습니다. OpenAI가 I/O 직후 1~2주 안에 GPT-5.5 Pro 나 Sora 후속으로 응수할 거라고 했는데 일주일이 지난 지금까지는 작은 업데이트 몇 개뿐입니다. 아직 일주일 남았으니 보류입니다. Sweetpea 가을 출시는 맞았습니다. OpenAI 가 9월 출시 일정을 직접 밝혔고 첫해 출하 목표도 그대로입니다. Anthropic 이 6~7월에 Sonnet 5를 낸다는 건 완전히 틀렸습니다. Sonnet 5는 이미 2월에 나와 있었습니다. 그러니 Opus 5도 제 표보다 한 칸 앞당겨서 봐야 할 것 같습니다. 이것도 보류입니다. Sonnet 5 를 맞혔으면 Opus 5 는 그냥 다음 카드였을 텐데, 앞 카드를 놓치니 뒤 카드 시점도 같이 흔들렸습니다. 예측을 줄줄이 엮어놓으면 하나가 틀릴 때 뒤가 같이 틀립니다. 네 개 중 하나 맞고, 하나 크게 틀리고, 둘은 아직 모릅니다. 묶어서 △를 줬습니다. 쓰고 보니 이 줄은 채점이라고 하기가 좀 민망합니다. 네 개를 한 줄에 넣은 건 그때 그게 다 같이 일어날 것 같아서였는데, 실제로는 각자 따로 일어났고 하나는 이미 일어나 있었습니다. 한 줄에 묶으면 맞은 것과 틀린 게 서로를 가려줍니다.
이미 2월에 나와 있던 Sonnet 5
채점하고 나서 제일 오래 붙잡고 있었던 게 이겁니다.
Claude Sonnet 5, 코드명 Fennec 은 2월 3일에 나왔습니다. 슈퍼볼 주간이었습니다. 1편을 쓴 게 5월 14일이니 100일쯤 지나 있었는데, 저는 1편에 Anthropic 패턴상 6월에서 7월 사이 코딩과 에이전트 벤치 점수와 함께 조용히 나올 가능성이 높다고 적었습니다. 이미 나온 모델을 앞으로 나올 모델로 그린 겁니다.
어떻게 거기까지 갔는지 되짚어보면, Anthropic 은 큰 발표를 자주 안 한다는 생각에서 시작했습니다. 그 생각이 조용히, 벤치만, 한 우물이라는 패턴을 만들었고 거기에 6~7월이 그럴듯해 보였습니다. 그리고 제 생각에 어울리는 시점을 미래에 놓고 글을 닫았습니다.
그런데 그 생각부터 틀렸습니다. Anthropic 은 미국에서 제일 노출이 큰 주에 Sonnet 5를 냈습니다. 조용히의 반대입니다. 한국에서는 슈퍼볼이 큰일이 아니라서 노출이 작아 보였을 뿐이고, 미국에서는 큰 발표 시기였습니다.
신호가 하나 더 있었습니다. 1편 다섯째 줄에 제가 직접, 2월 초에 claude-sonnet-5 식별자가 Vertex AI 에 떴다가 사라졌다고 적어놨습니다. 그게 발표 신호였는데 저는 준비 중이라는 약한 신호로만 읽었습니다. 떴다가 사라진 그날이 사실 발표일이었습니다.
돌아보면 한국 미디어에서 크게 안 다뤄지면 조용히 준비 중이라고 읽고, 미국 현지의 발표 일정은 제 생각 밖에 있으니 안 봤던 것 같습니다. 혼자 글을 쓰다 보면 제 눈에 들어오는 것만 신호로 치게 되는 것 같습니다. 더 곤란한 건 그걸 쓰는 동안에는 그런 줄을 모른다는 겁니다. 1편을 쓸 때 저는 꽤 넓게 봤다고 생각했습니다. 세 갈래로 나누고 회사마다 동기를 적고 시나리오 표까지 만들었으니까요. 그런데 그 표를 만든 재료가 전부 제가 평소에 보는 데서 왔습니다. 표가 정교해 보일수록 그 바깥이 안 보였던 것 같습니다. 식별자가 떴다 사라졌다는 걸 직접 적어놓고도 지나간 게 제일 아픕니다.
이걸 놓친 게 1편의 다른 그림도 좀 흔듭니다. 1편은 Anthropic 이 코딩과 에이전트라는 한 우물을 파면서 호출당 가치를 높인다고 했는데, 그 베팅은 5월에 이미 석 달째 시장에서 검증받고 있었습니다. 그걸 미래형으로 써놓은 게 지금 보니 어색합니다. Opus 5도 마찬가지로 Sonnet 5가 2월이었으면 6~7월일 가능성이 제 생각보다 높습니다. 한 우물 베팅의 다음 카드가 제 그림보다 빨리 나올 수 있다는 얘기입니다.
만약 1편을 쓸 때 Sonnet 5 가 이미 나와 있다는 걸 알았다면 글이 꽤 달라졌을 것 같습니다. Anthropic 을 조용히 준비하는 회사로 그리지 않았을 거고, 클라우드 쪽에서 세 회사 중 누가 먼저 카드를 냈는지부터 따졌을 겁니다. 그러면 Google 의 Flash 점프도 앞서 나간 쪽을 따라잡는 쪽으로 읽혔을지도 모릅니다. 사실 하나를 놓친 게 그 사실 하나로 끝나지 않고 그림 전체의 순서를 바꿔버린다는 게 좀 무섭습니다. 예측을 쓸 때는 미래를 몰라서 틀린다고 생각했는데, 이번엔 과거를 몰라서 틀렸습니다.
Sweetpea 보다 먼저 나온 안경
두 번째로 놓친 건 Google 이 키노트에서 발표한 Android XR 오디오 안경입니다. 가을에 나오고 Samsung, Warby Parker, Gentle Monster 가 첫 하드웨어 파트너입니다. 화면 없이 귀로 정보를 들려주고 손이 자유로운 형태입니다.
이걸 다시 읽어보면 어디서 많이 본 그림입니다. 화면이 없고, 늘 듣고 있는 오디오 기기이고, AI 회사가 앞에 서고, 가을에 나옵니다. 1편에서 OpenAI 와 Jony Ive 의 Sweetpea 를 설명한 것과 거의 같습니다. 1편은 폼팩터 쪽을 스마트폰을 우회하려는 OpenAI 혼자만의 베팅으로 그렸는데, 실제로는 두 회사가 다른 방식으로 같은 걸 들고 같이 들어왔습니다.
방식은 꽤 다릅니다. OpenAI 는 직접 갑니다. 기기를 자기가 만들고, Jony Ive 회사를 큰돈 주고 인수했고, Foxconn 라인을 직접 잡고, 자기 브랜드로 팝니다. Apple Watch 같은 그림입니다. 하드웨어를 처음 해보는 회사가 처음부터 다 직접 하겠다는 거라 저는 이쪽이 더 대담해 보였습니다. Google 은 나눠서 갑니다. 모델과 소프트웨어는 Google 이, 칩과 광학과 양산은 Samsung 이, 디자인과 안경 브랜드는 Warby Parker 와 Gentle Monster 가 맡습니다. 안경으로 이미 믿음이 쌓인 브랜드를 데려와서, 사람들이 안경이라고 알던 물건을 통해 AI 기기로 자연스럽게 들어오게 하는 것 같습니다. 새 물건을 처음 사는 것과 원래 쓰던 물건의 새 버전을 사는 건 마음이 꽤 다릅니다. 안경은 이미 얼굴에 쓰고 다니는 물건이라 이상해 보일까 하는 걱정이 덜할 것 같고, 그게 Google 쪽 계산인 것 같습니다. 어느 쪽이 나을지는 저도 모르겠습니다. 직접 만들면 경험을 끝까지 쥘 수 있고, 나눠서 하면 빨리 넓게 깔 수 있습니다.
나눠서 하는 쪽을 보면서 같이 일하는 회사가 많을 때 생기는 일도 좀 떠올랐습니다. 한 회사가 다 하면 느려도 자기 속도로 가는데, 여러 회사가 나눠 맡으면 제일 늦는 한 곳에 전체 일정이 묶입니다. 문제가 생겼을 때 누가 고쳐야 하는지도 흐려지기 쉽습니다. 안경에서 소리가 이상하면 그게 모델 탓인지, 칩 탓인지, 테 디자인 탓인지를 사용자는 모릅니다. 빨리 넓게 깔 수 있다는 장점이 그런 비용이랑 같이 오는 것 같습니다.
한 회사가 혼자 수천만 대를 만드는 쪽과 여러 회사가 나눠서 내는 쪽이 같은 데서 부딪힙니다. 누가 먼저 5천만 대를 깔지가 이번 분기의 관전 포인트일 것 같습니다.
1편이 이걸 못 본 이유를 생각해보면, 저는 폼팩터 쪽을 OpenAI 의 적자 얘기로만 봤습니다. 클라우드 API 는 적자고 기기는 한 번 팔면 수익이 정해지니 폼팩터가 적자에서 도망치는 제일 큰 출구라고 썼습니다. 그 그림에는 OpenAI 하나만 있었습니다. Google 은 광고라는 큰 본업이 있어서 클라우드 적자 압박이 작다고 봤고, 그러니 폼팩터에 크게 걸 이유가 약해 보였습니다. 실제로는 Google 은 적자에서 도망치려는 게 아니라 안드로이드 운영 계층을 기기 전체로 넓히려고 들어왔습니다. 이유는 달라도 같은 데로 모일 수 있다는 걸 제가 못 봤습니다. 1편을 쓸 때는 회사마다 왜 그걸 하는지를 먼저 적고, 그 이유에서 뭘 할지를 끌어냈습니다. 그 방식이 깔끔해 보였는데 이유가 다른 두 회사가 같은 걸 들고 나오니 그 방식으로는 안 보였습니다. 회사가 뭘 할지는 이유 하나로 다 안 나오는 것 같습니다. 한 회사의 동기에 묶여서 그림을 그렸던 것 같습니다.
9월 분기면 이 얘기가 어느 정도 결론이 날 것 같습니다. Sweetpea 가 9월, 안경이 가을입니다. 같은 종류의 기기가 같은 분기에 다른 방식으로 나옵니다. 1편에서 저는 이 분기를 OpenAI 가 처음 기기를 내는 때로만 생각했는데, 지금은 두 방식 중 어느 쪽이 사람들한테 먹히는지를 처음으로 보는 때가 될 것 같습니다. 같은 걸 보는데 질문이 바뀌었습니다.
진짜 신호는 Antigravity 였던 것 같습니다
채점을 끝내고 하나가 더 보였습니다. 1편은 클라우드 쪽이 회사마다 다르게 나뉜다고 그렸는데 I/O가 거기 한 줄을 더 그었습니다.
1편에서는 두 회사였습니다. OpenAI 는 호출 단가를 맞추려고 라인업을 잘게 쪼개고, Anthropic 은 한 호출에 7시간 일하게 해서 호출당 가치를 높이고. 같은 문제, 클라우드 추론 비용을 다르게 푸는 거였습니다. I/O에서 Google 이 같은 데로 다른 베팅을 들고 들어왔는데 그 이름이 Antigravity 2.0 입니다.
Antigravity 는 데스크톱 앱이고 Gemini 3.5 Flash 랑 같이 짜여서, 데스크톱 안에서 서브에이전트들이 같이 일하는 하네스를 줍니다. Google 블로그에 collaborative subagents 라는 말이 있습니다. 제가 1편에서 Anthropic 의 한 우물이라고 부른 것과 거의 같습니다. OpenAI 도 Agents SDK 를 깔고 있고, Anthropic 도 7시간 자율 작업을 깔고 있고, 이제 Google 도 Antigravity 로 들어왔습니다. 세 회사가 같은 데로 모이고 있습니다.
그런데 서브에이전트들이 같이 일하는 하네스라는 말을 처음 들었을 때 반사적으로 든 생각은 이거 원래 있던 거 아닌가였습니다. 에이전트 여러 개를 띄워서 일을 나눠 맡기는 건 이미 여기저기서 하고 있었으니까요. 새로 나온 건 그걸 모델 회사가 데스크톱 앱 하나로 묶어서 내놨다는 정도인 것 같습니다. 기능만 보면 새롭다기보다 정리된 쪽에 가깝습니다. 다만 정리된 걸 큰 회사가 기본값으로 깔아주면, 손으로 엮던 사람들 대부분은 그걸 그만두고 기본값으로 갈 겁니다. 새로운 게 없어도 판이 바뀌는 건 보통 그런 식인 것 같습니다.
모델 회사가 데스크톱 앱을 직접 들고 나왔다는 게 따로 걸렸습니다. 한 달 전에 디자인 툴 한 곳 주가가 하루에 8% 넘게 빠진 날, 해자가 도구가 아니라 모델 쪽에 있다는 신호로 읽어둔 적이 있는데, Antigravity 는 그 모델 쪽에서 아예 자기 앱을 내놓은 그림입니다. 그때는 디자인 하나였고 이번엔 개발 도구가 같은 순서를 밟았습니다. 도구를 만들던 회사들 입장에서는 꽤 불편한 그림일 것 같습니다. 모델을 빌려 쓰면서 그 위에 도구를 얹어 팔았는데, 모델을 만드는 쪽이 같은 도구를 직접 들고 나오면 남는 게 별로 없습니다. 다음은 어느 카테고리일지 조금 궁금해졌습니다.
그렇다고 도구 회사들이 다 밀려날 거라고까지는 잘 모르겠습니다. 모델 회사가 내놓는 앱은 아무래도 자기 모델에 맞춰져 있을 거고, 여러 모델을 섞어 쓰고 싶은 사람한테는 그게 오히려 불편할 수 있습니다. 다만 그런 사람이 얼마나 많을지는 감이 안 옵니다. 대부분은 처음 깐 걸 그냥 계속 쓰니까요.
그러면 1편의 세 갈래라는 말도 좀 의심해봐야 할 것 같습니다. 세 회사가 같은 데로 모이는 그림이 더 맞을 수도 있습니다. 모이는 방식은 다릅니다. OpenAI 는 음성, 통역, 전사로 쪼갠 라인업 위에 Agents SDK 를 얹고, Anthropic 은 쪼개지 않고 한 우물에 Claude Code 형태로 들어가고, Google 은 Antigravity 라는 데스크톱 하네스 위에 Flash 를 얹습니다. 5월 14일에는 Google 이 이렇게 들어올 거라는 신호가 약했으니 그때는 세 갈래가 맞았던 것 같고, 5월 26일 지금은 세 회사가 다른 베팅으로 같은 데 모인다는 쪽이 더 맞아 보입니다. 채점표에 한 줄을 더 쓴다면 이렇게 쓸 것 같습니다. 1편이 나뉜다고 한 쪽 일부가 다시 모이고 있다.
디바이스 쪽은 그대로였습니다
1편에 노트북 로컬 LLM의 한계를 다섯 개 적어놨습니다. 추론 속도, 에이전트 통합, NPU 를 못 쓰는 것, 배터리와 발열, OS 통합이 없는 것. I/O가 이 중 하나라도 풀었나 보면 거의 없습니다.
Google 이 보여준 Gemini Nano, Antigravity, Android Studio 에이전트는 다 Google 모델이 Google OS 안에서 도는 그림이었습니다. 사용자가 자기가 고른 가중치를 NPU 에 올리거나 오픈 모델이 시스템 통합층에 들어가는 얘기는 키노트에 없었습니다. 1편에서 외롭다고 했던 그 상태가 그대로입니다. M4 에 모델을 올려놓아도 OS 는 그 모델이 거기 있는 줄을 모른다는 얘기였는데, 큰 회사 키노트를 보고 나니 그 거리가 더 커 보입니다. Google 의 그림이 정교해질수록 그 바깥에서 혼자 도는 모델은 더 따로 노는 것처럼 보입니다.
그래서 로컬 LLM 을 계속 붙들고 있는 게 의미가 있나 하는 생각도 들었습니다. 큰 회사들이 OS 안쪽을 자기 모델로 채워가는 동안, 노트북에 따로 깔아둔 모델은 점점 취미에 가까워질지도 모릅니다. 그런데 저는 그게 꼭 나쁘다고만은 생각하지 않습니다. OS 가 모르는 모델이라는 건 OS 가 간섭하지 않는 모델이라는 뜻이기도 하니까요. 토큰 사용량을 줄이려고 시작한 일이었는데, 어쩌면 남는 이유는 그쪽일 수도 있겠다 싶습니다.
이쪽 답은 6월 초 Apple WWDC 에서 나올 것 같습니다. 1편에서 Apple Intelligence 가 Gemini 기반으로 다시 짜였을 거라고 했는데 그걸 Apple 이 어떻게 말할지가 궁금합니다. 그리고 그 안에서 사용자가 자기 모델을 NPU 에 올릴 수 있게 되는지, 아니면 Apple 이 정한 모델만 NPU 를 쓰게 막아두는지가 제일 궁금합니다. 1편에 이게 풀리는 순간이 진짜 폭발이라고 썼는데 5월 키노트에는 그게 없었습니다. Google 이 그걸 안 한 건 이해가 갑니다. 자기 모델을 깔 수 있는 곳에 남의 모델을 올리게 해줄 이유가 별로 없으니까요. 1편 가설대로 Apple 이 Gemini 를 빌려 쓰는 쪽이라면 사정이 좀 다를 수 있는데, 그래서 더 궁금합니다.
6월부터 9월까지
1편의 거친 표를 조금 다듬어보면 이렇습니다. 방금 한 줄에 하나씩 써야겠다고 해놓고 또 표를 만드는 게 좀 우습긴 한데, 이번엔 최대한 나눠서 적어봤습니다. 이것도 9월에 다시 열어보면 또 어딘가가 비어 있을 겁니다.
6월 초 WWDC 에서는 Gemini 기반이라는 걸 Apple 이 어떻게 포장할지, 사용자가 외부 모델을 어디까지 직접 고를 수 있을지를 보게 될 것 같습니다. 1편에 iOS 27에서 사용자가 Gemini 나 Claude 같은 외부 모델을 직접 고를 수도 있다고 적었는데, 그게 NPU 까지 가는지가 핵심입니다.
6월 중에 Gemini 3.5 Pro 가 정식으로 나올 겁니다. 이건 Google 이 직접 다음 달이라고 했으니 예측이라고 하기도 어렵습니다. 한 박자 늦춘 만큼 나올 때 더 큰 데모를 같이 보여줄 가능성이 있다고 봅니다.
Opus 5는 6~7월일 가능성이 1편 때보다 높아졌습니다. 1편에 Opus 4.7에 1M 컨텍스트를 풀어둔 게 다음 단계 예고편이라고 적었는데, Sonnet 5가 2월에 이미 나와 있었으니 그 다음 카드도 빨리 올 수 있습니다. 나온다면 SWE-Bench 나 OSWorld 같은 데서 한 단계 뛰는 모습일 것 같습니다.
8~9월은 Sweetpea 와 Android XR 안경이 같이 나오는 분기입니다. 1편이 안 본 제일 큰 변수가 여기 있습니다. 둘 다 화면이 없는 기기라서, 사람들이 화면 없이 AI 랑 얘기하는 걸 정말 편하게 느끼는지도 이때 처음 보게 될 것 같습니다. 저는 아직 그게 잘 상상이 안 됩니다.
OpenAI 응수는 1편에서 1~2주라고 했는데 일주일 동안 큰 건 안 나왔습니다. 제 예상보다 한 박자 늦을 수 있고 WWDC 전이나 직후가 더 자연스러워 보입니다.
채점하고 나서
다 채우고 1편 첫 줄을 다시 봤습니다. 토큰 사용량을 어떻게 줄일까 고민하다 Qwen3.5 122B 를 M4 에 깔아봤다는 문장이었습니다. 그 한 줄에서 시작한 글이 다섯 예측이 되고, 닷새 뒤 키노트를 거쳐 일주일 뒤 이 채점까지 왔습니다.
결과만 보면 ○ 둘, △ 셋이고, 다섯째 줄 안에 완전히 틀린 게 하나 있고, 1편이 아예 못 본 게 둘입니다. 이 숫자가 잘한 건지 못한 건지는 잘 모르겠습니다. 비교할 게 없으니까요. 다만 ○ 둘이 다 Google 이 원래 하던 일의 연장이었고, 틀리거나 못 본 건 Google 바깥이거나 Google 이 제 그림 밖에서 한 일이었다는 게 좀 걸립니다. 제가 그린 그림 안쪽만 잘 맞혔다는 뜻 같습니다.
한 줄에 두세 가지를 묶어놓으니까 채점이 자꾸 △로 갔습니다. 다음엔 한 줄에 하나씩만 쓰는 게 맞을 것 같습니다. 그래야 맞았는지 틀렸는지가 분명해집니다.
큰 그림도 두 군데 금이 갔습니다. 한 번에 무너지진 않았는데, Sonnet 5를 놓친 건 클라우드 쪽에서 제가 뭘 더 무겁게 봤는지를 다시 생각해야 하는 일이고, Android XR 안경은 폼팩터 쪽에 회사를 하나에서 둘로 늘려야 하는 일입니다. 1편 본문으로 돌아가서 어디서 흔들렸는지 메모를 달아두려고 합니다.
둘 다 결국 제 시야 밖 얘기였던 것 같습니다. Sonnet 5는 제가 안 보던 미국 쪽 일정에 있었고, 안경은 제가 안 그리던 회사의 동기 안에 있었습니다. Sonnet 5 는 날짜 하나만 찾아봤어도 안 틀렸을 거라 더 아깝습니다. 한 줄에 하나씩 쓰는 건 마음먹으면 할 수 있는데, 제 눈에 안 들어오는 걸 일부러 찾아오는 건 어떻게 해야 할지 아직 잘 모르겠습니다. 안 보이는 걸 찾으려면 어디가 안 보이는지를 알아야 하는데, 그걸 알면 이미 보이는 거니까요. 이번에 알게 된 건 미국 쪽 발표 일정이랑 제가 덜 쳐준 회사의 동기, 이 두 군데가 제 시야 밖이었다는 정도입니다. 다음엔 그 둘은 챙기겠지만 또 다른 데가 비어 있을 것 같습니다.
이 글이 시리즈 3편입니다. 1편이 I/O 닷새 전, 2편이 M4 5일과 회사 도입 ROI, 3편이 I/O 결산입니다. 1편에 3편은 I/O 끝나고 쓰겠다고 했는데 그건 지켰습니다.
다음은 시리즈 외전이 될지 새 시리즈 1편이 될지 모르겠습니다. 6월 초 WWDC 직후면 Apple 이 Gemini 기반으로 다시 짰다는 얘기를 Apple 입으로 듣고 NPU 쪽이 풀리는지 볼 수 있을 것 같고, 9월이면 Sweetpea 와 안경이 처음 출하될 때 두 베팅을 나란히 놓고 볼 수 있을 것 같습니다. 지금은 WWDC 가 더 가깝습니다. 이번엔 쓰기 전에 Apple 쪽이 이미 뭘 냈는지부터 찾아볼 생각입니다. 같은 걸 두 번 놓치면 그건 시야가 아니라 게으름일 것 같아서요. Apple 이 뭘 들고 나올지 좀 궁금합니다.
- 공유 링크 만들기
- X
- 이메일
- 기타 앱
댓글
댓글 쓰기