DHH는 날짜를 짚었고 저는 AI에 손코딩을 넘긴 날을 모릅니다

이미지
DHH가 올해 Rails World에서 한 발표를 요약한 영상을 몇 편 봤습니다. 원본 발표를 처음부터 끝까지 본 건 아니고, 한국어로 정리해 준 유튜브 영상 네 편을 이어서 봤습니다. 발표를 남이 정리해 준 걸로 보고 대충 알았다고 넘어가는 것도, 생각해 보면 요즘 제가 코드를 대하는 방식이랑 비슷합니다. 원본을 다 읽지 않고 정리된 결과를 보고, 이상한 데가 있으면 그때 찾아봅니다. 내용이 많았는데 제일 오래 남은 건 날짜 하나였습니다. 2025년 11월 24일. 영상에 따르면 DHH는 이날을 "우리 시대의 코닥 브라우니"라고 불렀다고 합니다. Claude Opus 4.5가 나온 날입니다. 1900년에 1달러짜리 카메라가 나오면서 초상화를 그리던 화가들이 일감을 잃고 방향을 틀었던 것처럼, 그날부터 프로그래머의 일이 바뀌었다는 얘기였습니다. 그리고 기술은 비탈길처럼 매끄럽게 오르는 게 아니라 한참 평평하다가 어느 날 한 칸 뛰는 계단처럼 온다고 했습니다. 영상을 보면서 저도 모르게 제 날짜를 찾고 있었습니다. 저는 언제였지. 생각이 안 났습니다. 마지막으로 직접 친 코드 어림잡을 수 있는 건 있습니다. 2025년 9월쯤부터는 제가 코드를 직접 쓴 기억이 없습니다. DHH가 짚은 날보다 두 달쯤 앞입니다. 이걸 날짜라고 하기는 좀 어렵습니다. 9월 몇 일에 무슨 일이 있어서 그날부터 안 쓴 게 아니라, 거꾸로 짚어 올라가다 보니 그쯤부터는 기억이 비어 있다는 정도입니다. 어느 날 키보드에서 손을 뗀 게 아니라 손으로 친 마지막 줄이 언제였는지 생각해 보니 안 떠오르는 겁니다. 두 달 앞이라고 해서 제가 남들보다 빨랐다는 뜻도 아닙니다. 그때 무슨 모델을 쓰고 있었는지도 정확히 기억이 안 납니다. DHH는 특정 모델이 나온 날을 짚었는데 저는 어떤 모델 때문에 넘어왔는지를 말할 수가 없습니다. 모델이 바뀐 날은 발표가 있으니 찾아보면 나오겠지만, 제가 바뀐 날은 아무 데도 적혀 있지 않습니다. 커밋 기록을 뒤져 보면 뭔가 나올...

YouTube 채널 AI 콘텐츠 강의 딸깍, 가이드처럼 딸깍은 없다

밤늦은 집 책상에 스탠드 불빛 하나가 켜져 있고, 작은 마이크와 엉킨 케이블, 아무것도 적히지 않은 대본 종이 묶음, 덮어 둔 노트북이 놓여 있는 모습

아는 엄마 한 분이 요즘 AI로 유튜브 채널을 하나 만들어서 운영하고 있다고 했습니다. 대본도 AI가 쓰고, 그림도 AI가 그리고, 목소리도 AI가 읽는다고요. 그 얘기를 듣고 집에 와서 제일 먼저 한 게 검색이었습니다. 어떻게 하는 건지 궁금하기도 했고, 솔직히 좀 걱정도 됐습니다. AI 부업 광고가 제일 많이 겨냥하는 사람들이 아이 키우면서 집에서 뭔가 해 보려는 엄마들이랑 은퇴를 앞둔 분들이라는 걸 알고 있었거든요. 그분이 혹시 비싼 강의를 결제한 건 아닌지, 그게 먼저 떠올랐습니다. 물어보지는 못했습니다.

검색하자마자 무료 강의가 쏟아졌습니다. AI로 영상 자동화, 숏폼 제작, 숏폼에 쇼핑 링크 붙이기. 한 달에 몇백은 우습고 3천은 기본이고, 5천, 많게는 몇억씩 번다는 사장님들이 나와서 노하우를 공개한다고 합니다. 무료니까 일단 들어 보라고요. 하나를 보고 나면 비슷한 강의가 추천으로 또 뜨고, 그걸 보고 나면 또 뜹니다. 그렇게 보다 보니 백 개가 넘었습니다. 이렇게 많은 줄은 몰랐습니다.

그런데 많이 보다 보니 낯익은 얼굴이 계속 나옵니다. "돈버는 사장님", "부업뚝딱", "우리동네 사장님" 같은 이름의 채널들이 다 다른데, 거기 나와서 강의하는 사람은 같은 강사입니다. 채널마다 제목이랑 썸네일은 조금씩 다르게 달려 있지만 하는 얘기는 비슷하다 못해 거의 똑같습니다. 그리고 다들 무료 공개라고 합니다. 무료로 보여 주고 끝에 가서 유료 강의나 프로그램을 파는 거죠. 한 사람이 여러 채널에 나와서 같은 강의를 무료라고 반복하는 걸 보니, 돈을 버는 쪽이 영상을 만드는 사람인지 강의를 파는 사람인지 좀 헷갈렸습니다.

강의팔이 얘기는 예전 블로그에서도 꽤 했던 주제입니다. 여기서도 AI 부업 광고가 몇 겹으로 쌓여 있는지 쓴 적이 있고요. 그때도 지금도 생각은 크게 다르지 않은데, 이번엔 그냥 욕만 하고 넘어가기가 좀 그랬습니다. 적을 알아야 나를 안다고, 저 사람들이 말하는 딸깍이 진짜 되는 건지 직접 해 보고 싶었습니다. 개발자니까 강의 화면만 봐도 프로그램이 대충 어떤 구조인지 감이 오긴 했거든요.

그래서 추석 전날부터 만들기 시작했습니다. 지금도 고치고 있습니다.

강의 화면 뒤에 있는 것

강의에서 보여 주는 화면은 대개 비슷합니다. 주제를 하나 넣으면 대본이 나오고, 장면마다 그림이 붙고, 목소리가 입혀지고, 자막이 깔리고, 영상 파일이 떨어집니다. 버튼 하나 누르고 커피 한 잔 마시고 오면 끝나 있다는 식입니다.

뜯어보면 단계 하나하나는 이미 있는 것들입니다. 대본은 ChatGPT나 Claude 같은 언어 모델이 쓰고, 그림은 이미지 생성 모델이 그리고, 목소리는 TTS가 읽고, 마지막에 ffmpeg 같은 도구로 이어 붙이면 영상이 됩니다. 강의에서 파는 프로그램이나 템플릿은 이 단계들을 순서대로 불러 주는 껍데기에 가깝다고 봤습니다. 새 기술이라기보다는 있던 것들을 줄 세운 거죠.

저도 처음엔 딱 그 정도로 생각했습니다. 강의 화면을 몇 번 돌려 보면서 어느 단계에서 뭘 부르는지 메모해 두기도 했습니다. 줄만 잘 세우면 되겠다. 대본 받고, 그림 받고, 목소리 받고, 붙이면 되니까 주말 몇 번이면 끝날 줄 알았습니다.

API 요금이 나가는 게 싫어서 구조는 조금 다르게 잡았습니다. 이미 돈 내고 쓰고 있는 Claude랑 ChatGPT 구독에 딸린 CLI를 그대로 불러서 대본과 그림을 받습니다. 각자 자기 PC에서 실행하는 프로그램이라 서버도 없습니다. 이렇게 하면 원래 내던 구독료 말고는 돈이 더 나가지 않습니다. 여기까지는 계획대로 됐습니다.

계획대로 안 된 건 그다음 전부였습니다.

공식이라고 파는 것

만들기 전에 아는 분 채널이랑 같은 장르 채널들을 몇 개 열어서 영상 목록을 쭉 내려 봤습니다. 시니어 사연 채널, 조선 야담 채널 같은 것들이었습니다. 생각보다 조회수가 낮았습니다. 대부분 수백 회 언저리였고, 야담 채널은 새로 생긴 곳들이 다 비슷한 제목을 쓰고 있었습니다. 열 살 꼬마가 어른들을 혼내 준다거나, 임금인 줄 모르고 어쩌고 하는 식으로요. 영상 하나만 크게 터지고 나머지는 조용한 채널이 많았습니다.

그나마 꾸준히 보는 사람이 있는 채널들은 공통점이 하나 있었는데, AI를 잘 써서는 아니었습니다. 이야기 무대랑 단골 주인공을 하나 정해 놓고 매번 그 주인공으로 새 사건을 만드는 채널들이었습니다. 시청자가 그 주인공을 보러 오는 거죠. 이건 AI가 정해 주는 게 아니라 채널 하는 사람이 정해야 하는 겁니다.

저도 숏폼을 몇 개 올려 봤습니다. 그중에 조회수가 좀 나온 걸 놓고 보니 전부 누가 잘못을 하고, 보는 사람이 열받고, 마지막에 그 사람이 혼나거나 신고당해서 속이 시원해지는 이야기였습니다. 사이다라고들 하죠. 그래서 소재를 고를 때 사이다 쪽에 점수를 더 주게 바꿨습니다. 그런데 이건 영상 몇 개를 보고 한 짐작입니다. 몇 개 더 올려 봐야 맞는지 압니다.

강의에서 공식이라고 파는 것도 아마 이 정도 짐작에서 출발했을 거라고 생각합니다. 누군가 몇 개 올려 보고 터진 걸 보고 이게 공식이다 한 거죠. 그 공식을 같은 강사가 채널만 바꿔 가면서 되풀이하니 더 그럴듯하게 들리는 것 같습니다. 짐작 자체는 나쁘지 않습니다. 저도 짐작으로 고쳤으니까요. 다만 그 짐작을 확신처럼 말하고, 그걸로 한 달에 몇천을 번다고 하는 건 다른 문제인 것 같습니다.

그림이 안 됩니다

대본은 솔직히 모르겠습니다. 좋은 대본인지 아닌지 제가 판단할 깜냥이 안 됩니다. 짧은 숏폼 대본은 그럭저럭 나오는데, 한 시간 넘는 긴 이야기를 장별로 나눠 쓰게 했더니 앞에서 심어 둔 복선을 뒤에서 기억하지 못했습니다. 앞 장 끝부분만 보고 다음 장을 쓰니 그럴 수밖에 없었습니다. 그래서 소설 쓰듯이 결말부터 정하고, 복선을 목록으로 만들어 두고, 장마다 무엇을 이어받아서 무엇을 넘기는지 먼저 설계한 다음에 본문을 쓰게 바꿨습니다. 좋은 대본인지는 여전히 모르겠지만 앞뒤는 맞게 됐습니다.

그런데 그림은 보면 압니다. 틀린 게 바로 보입니다.

AI는 그림 한 장은 잘 그립니다. 한 장만 놓고 보면 강의에서 보여 주는 것처럼 예쁩니다. 문제는 영상이 그림 한 장이 아니라는 겁니다. 같은 사람이 장면마다 계속 나와야 하고, 그 사람이 앞 장면과 뒤 장면에서 같은 얼굴이어야 하고, 같은 옷을 입고 있어야 합니다. 그림을 한 장씩 따로 그리는 AI는 이걸 신경 쓰지 않습니다. 앞에서 뭘 그렸는지 모르니까요.

옛날이야기 하나를 영상으로 만들어 봤을 때 일입니다. 주인공이 어릴 때 매를 맞는 장면이 있었는데, 그 상처랑 흙이 뒤 장면까지 계속 따라다녔습니다. 저녁에 짚신 삼는 장면에도 피가 묻어 있고, 몇 년 뒤 혼례를 올리는 장면에서도 피투성이였습니다. 이야기 안에서는 진작 다 나았는데 그림 속 주인공은 끝까지 낫지를 않았습니다.

어린 시절 장면인데 몸은 어른으로 나오는 것도 있었습니다. 어른 모습 그림을 참고로 넣어 주니까 얼굴만 어리고 체격은 그대로 어른인 아이가 그려졌습니다. 허리띠 하나만 빨갛게 칠해진 그림도 있었습니다. 그림체 설명에 포인트 색을 하나 쓰라고 했더니 그 색을 옷에 칠해 버린 겁니다.

하나씩 보면 웃긴데, 이게 영상 하나에 수십 장씩 섞여 있으면 하나도 안 웃깁니다. 사람이 처음부터 끝까지 한 장씩 넘겨 보면서 찾아야 하니까요.

사람 감독이라면 머릿속에 당연히 들고 있는 것들이 있습니다. 이 사람은 지금 몇 살이고, 이 장면은 그 일이 있고 나서 몇 년 뒤고, 그러니 상처는 없어야 한다는 것. AI는 그걸 들고 있지 않습니다. 그래서 이야기의 장마다 어느 시기를 보여 주는지, 그 시기에 인물이 어떤 모습인지를 표로 적어 주게 바꿨습니다. 회상 장면에는 나중 시기의 물건이나 상처를 붙이지 않게 하고, 시간을 건너뛰는 장면에서는 앞 장면 그림을 이어 쓰지 않게 했습니다. 사람이 당연하게 아는 걸 하나하나 글로 적어 줘야 그나마 맞게 나옵니다.

그래도 다 맞지는 않습니다. 그래서 AI한테 점검을 시켜 봤습니다. 그린 그림이 설명이랑 맞는지 봐 달라고요. 다 맞다고 했습니다. 어른 몸을 한 아이도, 피투성이 신랑도 다 괜찮다고 했습니다. 맞는지 틀리는지만 물으면 AI는 거의 항상 맞다고 합니다.

질문을 바꿨습니다. 판단하기 전에 그림에 뭐가 그려져 있는지부터 말하게 했더니 그제야 틀린 게 잡히기 시작했습니다. "아이가 어른 체격으로 그려져 있다"고 자기 입으로 먼저 써 놓고 나면, 그걸 설명이랑 맞다고 하기는 어려운가 봅니다. 사람한테 검수 시킬 때도 그냥 "괜찮아?" 하고 물으면 괜찮다고 하는 거랑 비슷한 것 같기도 합니다.

이것도 다 잡지는 못합니다. 지금은 점검에서 이상하다고 나온 그림에 빨간 표시를 달고, 사람이 보고 이대로 쓸지 정하게 해 뒀습니다. 처음엔 틀리면 AI가 알아서 다시 그리게 했었는데 그것도 뺐습니다. 다시 그린 그림이 또 틀리면 한도만 쓰고 끝나거든요. 마지막에 보는 건 사람입니다.

그림체도 말로 설명해야 겨우 맞습니다. 옛날이야기라서 수묵화로 그려 달라고 했더니 선이 날카로운 펜 그림이 나왔습니다. 수묵화처럼 보이긴 하는데 붓으로 그린 느낌이 없었습니다. 붓은 한 획 안에서도 닿을 때와 뗄 때는 뾰족하고 가운데는 도톰하고 끝은 살짝 번지는데, 그걸 하나하나 적어 줘야 했습니다. 굵기가 고른 선은 쓰지 말라는 말도요. 사람 화가한테는 "수묵화로"면 끝날 얘기를 AI한테는 붓 쓰는 법부터 설명하는 셈입니다. 그렇게 적어 놓고도 마음에 드는지는 또 그려 보고 봐야 압니다.

600원이라는 숫자

강의에서 자주 나오는 말이 10분짜리 영상 하나 만드는 데 600원이면 된다, 아니면 무료로도 된다는 얘기입니다. 아마 API 요금을 단가대로 계산한 숫자인 것 같습니다. 그 계산 자체가 틀렸다고는 생각하지 않습니다. 한 번에 다 맞게 나온다면요.

실제로는 한 번에 안 나옵니다. 위에 쓴 것처럼 틀린 그림은 다시 그려야 하고, 틀린 캐릭터 그림을 기준으로 장면을 그리면 그 인물이 나오는 장면이 전부 틀리니 그것까지 다시 그려야 합니다. 원인을 못 찾은 채로 같은 실수를 되풀이하다가 하루치 그림 한도를 다 쓴 날도 있었습니다. 그날은 하루 종일 다시 그리기만 하고 영상은 한 걸음도 안 나갔습니다.

구독으로 그리면 돈은 더 안 나가는 대신 한도가 있습니다. ChatGPT 구독에 딸린 그림 생성은 한도가 얼마인지 공개하지 않습니다. 처음에 빨리 끝내려고 여러 장을 동시에 몰아서 그렸는데, 아침 8시에 시작한 그림이 30분도 안 돼서 한도에 찼습니다. 그다음 그림은 다 실패했고, 앱 화면에는 한도가 찼다는 말 대신 "AI 답의 형식이 맞지 않았어요"라는 엉뚱한 오류가 떴습니다. 그림 도구는 거절당했는데 대화는 정상으로 끝나니까, 프로그램 입장에서는 그림 파일이 안 왔다는 것밖에 몰랐던 겁니다. 로그를 뒤지고 나서야 한도였다는 걸 알았고, 풀리기까지 하루를 기다렸습니다.

그 뒤로는 그림을 몇 장씩 나눠 그리고 사이사이 쉬게 했습니다. 몰아서 부르면 금방 막히고, 천천히 부르면 하루에 꽤 그려도 괜찮았거든요. 어디까지가 괜찮은지는 지금도 정확히 모릅니다. 같은 방식으로 그렸는데 어떤 날은 멀쩡하고 어떤 날은 저녁에 멈췄습니다. 이러면 한도는 덜 차는데 영상 하나에 그림이 다 나오기까지 반나절이 걸립니다. 롱폼은 하루를 넘기기도 합니다.

숏폼 길이를 정할 때도 비슷한 계산을 했습니다. 숏폼은 사람들이 오래 볼수록 좋고, 틱톡은 수익을 받으려면 영상이 1분은 넘어야 합니다. 그래서 숏폼을 길게 만들기로 했는데, 길게 만들면 그림이 늘어납니다. 그림은 한도이고 한도는 돈이나 마찬가지입니다. 그래서 그림 한 장을 더 오래 보여 주는 쪽으로 정했습니다. 그러면 화면이 덜 바뀌어서 지루해질 수 있는데, 그건 또 사람이 보고 판단해야 합니다. 어느 쪽을 아끼면 다른 쪽에서 사람이 봐야 할 게 하나 늘어나는 식입니다.

긴 영상은 마지막에 한 번 더 기다려야 합니다. 그림과 목소리를 다 만들고 영상 파일로 합치는 단계에서, 몇 시간짜리 작업이 90%까지 가서 실패한 적이 있습니다. 한 번은 정해 둔 제한 시간이 영상 길이에 비해 너무 짧아서였고, 한 번은 배경음악 볼륨을 계산하는 식이 너무 길어져서 ffmpeg가 거부해서였습니다. 짧은 영상으로 테스트할 때는 둘 다 안 보였습니다. 실제로 긴 영상을 끝까지 만들어 봐야 보이는 문제였고, 그동안 사람은 기다리고 있었습니다.

600원은 맞을 수도 있습니다. 그런데 그 600원짜리 영상이 나오기까지 사람이 기다리고, 넘겨 보고, 틀린 걸 찾고, 다시 시키는 시간은 그 계산 어디에도 들어 있지 않습니다. 10분만 투자하면 된다는 말도 같은 것 같습니다. 10분은 버튼 누르는 시간이고, 나온 걸 확인하는 시간은 빠져 있습니다. 확인을 안 하면 정말 10분이면 됩니다. 그런데 확인을 안 한 영상이 어떤 모양인지는 위에 적은 그대로입니다. 피투성이 신랑이 혼례를 올리고, 해설자가 자기 말투를 설명합니다.

그 "형식이 맞지 않았어요" 오류를 볼 때 이런 생각이 들었습니다. 저는 개발자니까 로그를 열어 봤지만, 강의를 듣고 프로그램을 산 사람이라면 이 화면에서 뭘 했을까. 아마 자기가 뭘 잘못 눌렀나 하고 다시 눌렀을 겁니다. 다시 눌러도 실패하니 또 누르고요. 강의를 듣는 사람들 대부분은 개발자가 아닙니다. 프로그램이 틀려도 왜 틀렸는지 모르고, 틀렸다는 걸 모를 때도 많습니다.

그래서 제 프로그램은 화면을 쉬운 말로 바꾸는 데 시간을 꽤 썼습니다. 기술 용어 대신 일상어를 쓰고, 지금 할 일은 하나만 보이게 하고, 한도에 차면 몇 시에 풀리는지 이 컴퓨터 시간으로 알려 주게 했습니다. 처음엔 풀리는 시각을 세계 표준시 그대로 보여 줬는데, 그걸 아침 9시로 읽었다가 실제로는 저녁 6시였던 일도 있었습니다. 개발자인 저도 이렇게 잘못 읽는데 다른 사람은 더 헷갈릴 겁니다. 확인하는 사람이 있어야 한다고 했는데, 그 사람이 확인할 수 있게 만드는 것도 프로그램이 할 일이었습니다.

목소리도, 자막도

그림만 그런 게 아닙니다. 목소리는 들어 봐야 압니다.

무료로 쓸 수 있는 TTS 엔진 두 개를 붙여서 쓰고 있는데, 새로 붙인 엔진으로 긴 해설을 읽혔더니 문장 조각마다 목소리가 미묘하게 달라졌습니다. 한 사람이 쭉 읽는 게 아니라 비슷한 사람 여럿이 번갈아 읽는 느낌이었습니다. 파일만 보면 아무 문제가 없는데 귀로 들으면 바로 이상합니다. 들어 보고 그 엔진으로 해설을 읽히는 건 버렸고, 짧은 인물 대사에만 씁니다.

해설 목소리를 고를 때는 이미 잘 되고 있는 채널 영상을 옆에 틀어 놓고 번갈아 들어 봤습니다. 목소리 후보마다 빠르기를 조금씩 바꿔 가면서요. 이건 어떤 기준표로 고를 수 있는 게 아니었습니다. 듣다 보면 이 목소리는 오래 들으면 피곤하겠다, 이건 너무 들떠 있다 하는 게 그냥 느껴집니다. 그 느낌을 AI한테 물어볼 수는 없었습니다. 물어보면 대답은 하겠지만, 그 영상을 끝까지 듣는 건 AI가 아니라 사람이니까요.

엔진 둘을 섞으니 이번엔 소리 크기가 안 맞았습니다. 아이 대사 뒤에 해설이 이어지면 해설이 갑자기 작게 들립니다. 이것도 영상을 처음부터 틀어 놓고 들어야 압니다. 화면만 넘겨 봐서는 절대 모릅니다.

대본에서는 AI가 "내레이터가 나직이 말했습니다" 같은 문장을 써 넣었는데 그게 그대로 읽혔습니다. 해설자가 자기가 나직이 말했다고 말하는 영상이 나온 겁니다. 처음 들었을 때는 좀 웃었습니다. 숏폼에서는 장면 사이에 3초 넘게 아무 소리가 없는 구간이 생겼습니다. 숏폼에서 3초 동안 조용하면 다들 넘깁니다.

썸네일도 처음엔 AI한테 어그로 문구를 쓰게 했습니다. 이 영상을 볼 사람이 누구일지 짐작해서 그 사람들이 누를 만한 말로 큰 글자를 뽑게 했는데, 나온 걸 보니 어색했습니다. 틀린 말은 아닌데 사람이 쓴 말 같지가 않았습니다. 지금은 큰 글자는 그냥 제목을 쓰고, AI는 어느 장면을 썸네일 그림으로 쓸지만 고르게 했습니다. 그것도 하나만 고르게 하지 않고 후보를 세 개 뽑게 해서, 유튜브 스튜디오에서 사람이 비교해 보고 고를 수 있게 했습니다. AI가 고른 하나를 그대로 믿는 것보다, 셋을 놓고 사람이 고르는 편이 마음이 편했습니다.

하나하나는 고치면 되는 문제들입니다. 실제로 하나씩 고쳤고, 고친 건 다음 영상부터는 안 나옵니다. 그런데 이 문제들을 처음 찾은 건 전부 사람이었습니다. 보고, 듣고, 이상하다고 말한 사람이요. AI가 먼저 "혼례 장면에 피가 묻어 있으면 이상하지 않을까요"라고 말한 적은 한 번도 없습니다.

숏폼에 쇼핑을 붙이면

숏폼에 쇼핑 링크를 붙이는 쪽은 좀 더 조심스러웠습니다. 상품 하나를 소개하고 설명란에 제휴 링크를 달아서 수수료를 받는 영상인데, 수요는 확실히 있는 것 같습니다. 강의에서도 제일 쉽게 돈 되는 걸로 많이 밀더라고요.

찾아보니 중국 쇼핑 플랫폼 영상을 긁어 와서 자동으로 편집해 주는 툴을 나눠 주는 커뮤니티도 있었습니다. 이건 따라 하지 않았습니다. 남의 영상을 가져다 쓰면 저작권 문제도 있고, 유튜브가 재사용 콘텐츠로 보고 수익을 막을 수도 있습니다. 딸깍으로 제일 빨리 되는 방법이 제일 먼저 막히는 방법이기도 한 것 같습니다.

AI한테 상품 소개 대본을 맡기면 또 다른 문제가 있습니다. 가격, 성능, 효과를 지어냅니다. 그것도 아주 그럴듯하게요. 사람이 안 보고 올리면 그대로 허위 광고가 됩니다. 그래서 대본은 사람이 적어 준 특징만 가지고 쓰게 했습니다. 적어 주지 않은 가격이나 후기나 효과는 쓰지 말라고요. 이렇게 하면 특징을 몇 줄 안 적은 날은 대본도 짧고 밋밋합니다. 처음엔 좀 아쉬웠는데 지금은 그게 맞다고 보고 있습니다. 밋밋한 게 지어낸 것보다는 낫습니다.

광고라는 표시도 사람이 지우지 못하게 앱이 설명란 맨 위에 붙이게 했습니다. 대가를 받고 소개하는 영상이면 앞부분에 알아보기 쉽게 밝혀야 하는데, 이걸 빼먹는 게 제일 흔한 사고라서요. 여기서도 AI가 잘하는 건 대본을 그럴듯하게 쓰는 것까지였고, 무엇을 쓰면 안 되는지는 사람이 정해 줘야 했습니다.

바이브 코딩도 똑같습니다

이 프로그램은 제가 코드를 거의 직접 치지 않고 AI랑 같이 만들고 있습니다. 요즘 말로 바이브 코딩이죠. 그래서 영상 쪽에서 본 게 코딩 쪽에서도 그대로 보였습니다.

바이브 코딩도 딸깍으로 완성된 프로그램이 나오지 않습니다. 만들어 달라고 하면 뭔가 나오긴 합니다. 작동하는 것처럼 보이고 화면도 그럴듯합니다. 그런데 써 보면 원한 게 아닌 경우가 많고, AI가 틀린 방향으로 갈 때 누가 알려 주지 않으면 그 방향으로 계속 갑니다. 그것도 아주 성실하게요.

생각해 보면 바이브 코딩 쪽에도 영상 강의랑 똑같은 광고가 있습니다. 코딩 몰라도 프롬프트 한 줄로 앱을 만들어서 월 얼마를 번다는 얘기요. 첫 화면까지는 진짜 한 줄로 나옵니다. 영상으로 치면 첫 그림 한 장이 예쁘게 나오는 단계입니다. 문제는 그다음부터입니다. 기능이 붙을수록 앞에서 만든 걸 AI가 기억하지 못하고, 고친 걸 다시 망가뜨리고, 아무도 시키지 않은 걸 만들어 놓습니다. 영상에서 주인공 얼굴이 장면마다 바뀌는 거랑 같은 일이 코드에서 일어나는 겁니다. 그래서 저는 이 둘이 같은 문제라고 보고 있습니다. 하나하나는 잘 만드는데, 앞뒤를 이어서 일관되게 유지하는 건 아직 사람이 붙잡고 있어야 합니다.

예를 들면 이런 겁니다. 출근하기 전에 캐릭터 그림만 먼저 그려 달라고 해 놓고 나갔습니다. 돌아와 보니 그림은 한 장도 없었습니다. AI가 "캐릭터 그림만 다시 그리기" 버튼을 하나 새로 만들어 놓고, 앱을 켜고 이 버튼을 누르시라는 말로 끝내 놓은 겁니다. 앱은 꺼져 있었고 AI는 그걸 직접 켤 권한이 없었습니다. 그 시간이면 캐릭터는 다 그리고 장면까지 넘어갔어야 했는데 반나절이 그냥 날아갔습니다. 자기가 못 하는 상황이면 제가 나가기 전에, 그때 바로 못 한다고 말해 줬으면 됐을 일입니다. 버튼 만드는 것보다 그 한 줄이 훨씬 중요했습니다.

틀린 그림을 고칠 때도 비슷했습니다. 버그 때문에 생긴 문제인데 AI는 "캐릭터 그림 점검" 버튼을 추가하고 저한테 누르라고 했습니다. 이건 버그를 사람한테 떠넘긴 거죠. 이 프로그램을 쓰는 사람이 그런 버튼을 알아서 찾아 누를 리가 없습니다. 버그면 자동으로 만드는 과정 안에서 고쳐서 다음 영상부터는 안 생기게 하고, 이미 만든 영상은 AI가 알아서 고쳐 놓는 게 맞다고 봤습니다. 버튼은 다 걷어냈습니다.

테스트가 제가 실제로 쓰고 있던 앱의 데이터를 건드린 적도 있습니다. AI는 테스트용 서버를 띄운 줄 알았는데 제 앱이 이미 같은 포트를 쓰고 있어서 테스트용 서버는 뜨지도 못했고, 테스트는 그대로 제 앱을 상대로 실행됐습니다. 제 채널 이름이 바뀌어 있고 처음 보는 테스트 채널이 생겨 있었습니다. 제가 앱을 켜 놓고 쓰는 중에 AI가 서버 쪽 파일을 고치면 앱이 저절로 재시작돼서 화면에 오류가 뜨기도 했습니다. 처음엔 왜 그런지 몰랐다가 나중에 알고 나서 "아 너 때문에 오류 난 거구나" 했습니다. AI 입장에서는 코드를 고쳤을 뿐인데, 그 순간 옆에서 사람이 뭘 하고 있는지는 모르는 겁니다.

작업이 끝날 때마다 "남은 작업" 목록을 새로 만들어 붙이는 것도 한동안 계속됐습니다. 시킨 일을 다 끝내 놓고 마지막에 확인해 볼 것 몇 개, 새로 발견한 문제 몇 개를 붙이니 일이 끝나지를 않습니다. 밤늦게 그걸 보다가 왜 자꾸 남은 작업을 만드냐고 한 소리 했습니다. 다 했으면 다 했다고 하면 되는데요.

AI가 다 됐다고 할 때도 그대로 믿지 않게 됐습니다. 테스트가 전부 통과했다고 해서 보면, 실제 AI를 부른 게 아니라 가짜 응답을 넣어서 확인한 경우가 꽤 있습니다. 그림을 그려 주는 AI를 진짜로 부르면 한도를 쓰니까 가짜로 확인하는 건 이해가 갑니다. 그런데 그러면 진짜 AI가 시킨 대로 하는지는 아직 아무도 본 적이 없는 겁니다. 그걸 "다 됐습니다"라고 말하면 안 되죠. 요즘은 가짜로만 확인한 건 확인 안 한 걸로 따로 적게 하고 있습니다. 실제로 영상을 하나 만들어 보고 나서야 다 된 걸로 칩니다.

이런 건 AI가 코드를 못 짜서 생기는 문제가 아닙니다. 코드는 잘 짭니다. 무엇을 하면 안 되는지, 지금 사람이 어떤 상황에 있는지를 모르는 겁니다. 그걸 알려 주는 게 사람 몫이고, 영상에서 피투성이 신랑을 찾아내는 일이랑 같은 종류의 일이라고 보고 있습니다.

한 번 말한 건 다음에도 지키게

알려 주는 것만으로는 모자랍니다. AI는 대화가 끝나면 잊어버립니다. 오늘 한 소리 들은 걸 내일 새 대화에서 또 합니다.

그래서 지적한 건 전부 파일로 남기고 있습니다. 버그면 버튼을 만들지 말고 자동 과정에서 고칠 것, 직접 못 하면 첫 줄에 바로 말할 것, 끝났으면 끝났다고만 말할 것, 그림을 한꺼번에 다시 그리는 버튼은 함부로 누르지 말 것. 이런 걸 왜 그렇게 정했는지와 같이 적어서 프로젝트 폴더 안에 두고 코드랑 같이 커밋합니다. 새 대화가 시작되면 AI가 그걸 먼저 읽고 시작합니다. 프로그램 구조를 왜 이렇게 정했는지도 결정할 때마다 문서로 남기고 있습니다. 쓰다 보니 코드보다 이 문서들이 더 빨리 늘어나는 날도 있습니다.

처음엔 이런 기록을 제 컴퓨터의 개인 설정 쪽에 쌓아 두고 있었습니다. 그런데 이 프로그램을 다른 컴퓨터에서도 받아서 쓰게 되면서 생각이 바뀌었습니다. 그 컴퓨터에서 AI한테 뭔가 고쳐 달라고 하면, 그 AI는 제가 지금까지 한 소리를 하나도 모릅니다. 그러면 버튼을 또 만들고 남은 작업 목록을 또 붙일 겁니다. 그래서 개인 설정에 있던 걸 프로젝트 폴더로 옮겨서 같이 받게 했습니다. 누가 이 프로젝트를 이어서 하더라도 AI가 같은 방식으로 일하게 하려는 겁니다.

이건 회사에서 사람이랑 일할 때도 원래 하던 일이긴 합니다. 결정을 문서로 남기고, 사고가 나면 왜 났는지 적어 두고, 새로 온 사람이 같은 함정에 안 빠지게 하는 거요. 상대가 AI로 바뀌었을 뿐인데, AI는 매일 아침 새로 출근하는 신입이라 이걸 더 자주, 더 꼼꼼하게 해야 하는 것 같습니다. 신입은 한 달 지나면 알아서 하는데 AI는 한 달이 지나도 적어 둔 것만 압니다.

하지 않기로 한 것도 적어 둡니다. 한번은 AI가 시리즈마다 고정 출연하는 캐릭터를 채널 단위로 두자고 제안했는데, 저는 필요 없다고 했습니다. 이걸 안 적어 두면 며칠 뒤 다른 대화에서 같은 제안을 처음 하는 것처럼 또 합니다. 좋은 생각이라고 생각하니까요. 그래서 거절한 제안도 언제 왜 거절했는지와 같이 남겨 두고, 다시 꺼내지 말라고 적어 둡니다. 다른 사람이 이 프로젝트를 이어받았을 때 왜 이 기능이 없는지 물어보면 그 답도 거기 있습니다. 이건 Claude한테만 해당하는 게 아니라서, 다른 AI 도구로 열어도 같은 파일을 읽게 해 뒀습니다.

규칙만 적어 두면 안 되고 왜 그렇게 정했는지를 같이 적어야 한다는 것도 해 보면서 알았습니다. "버튼을 만들지 말 것"만 적어 두면 AI는 그걸 너무 넓게 적용하거나 너무 좁게 적용합니다. 필요한 버튼까지 안 만들거나, 이름만 바꾼 비슷한 걸 또 만듭니다. 사람이 그 버튼을 찾아서 누르지 않는다는 이유까지 적어 두면 처음 보는 상황에서도 대충 맞게 판단합니다. 이건 사람한테 일을 넘길 때도 똑같은 것 같습니다.

그리고 적어 둔다고 다 지키지도 않습니다. 적어 둔 걸 읽고도 비슷한 실수를 다른 모양으로 하는 경우가 있어서, 그때마다 또 고쳐 적습니다. 이 과정이 끝나는 날이 올지는 잘 모르겠습니다.

그래서 그 강의들은

강의가 말하는 딸깍이 완전히 거짓말이라고는 생각하지 않습니다. 대본 초안이 나오고, 그림이 나오고, 목소리가 붙고, 영상 파일이 떨어지는 것까지는 진짜 버튼 하나로 됩니다. 제가 만든 프로그램도 그 정도는 됩니다.

다만 그렇게 나온 영상을 그대로 올릴 수 있느냐는 다른 얘기입니다. 상처가 안 낫는 주인공, 어른 몸을 한 아이, 해설자가 자기 말투를 설명하는 대사, 3초 무음. 이걸 그대로 올리는 채널이 지금 유튜브가 정리하고 있는 그 채널들이라고 봅니다. 유튜브가 약관에서 단어 하나를 바꾼 얘기를 쓸 때도 비슷한 생각을 했는데, 직접 만들어 보니 그 단어가 가리키는 게 뭔지 좀 더 손에 잡히게 보였습니다.

수익이 정지되는 기준도 비슷합니다. 유튜브는 기준을 정책 문장으로만 공개합니다. 그런데 AI랑 이 얘기를 하다 보면 AI는 그림 한 장을 너무 오래 띄우면 수익이 정지된다는 식으로 아는 것처럼 말합니다. 강의들도 비슷한 말을 단정적으로 하는 경우가 많고요. 그 얘기를 하다가 제가 AI한테 한 말이 있습니다. 너도 모르고 나도 모르고 쟤들도 모르는 거라고요. 그래서 프로그램에는 위험 점수나 판정 같은 건 넣지 않았습니다. 유튜브가 공개한 문장에 기대서 경고만 띄웁니다. AI로 만들었다는 표시는 기본으로 켜 두고, 하루에 너무 많이 올리면 경고를 띄우는 정도입니다. 모르는 걸 아는 척하는 기능을 만들고 싶지는 않았습니다.

사람이 검토하고 확인하는 단계가 들어가야 합니다. 그 단계를 빼고 계산하면 600원이고 10분이고, 넣고 계산하면 얘기가 완전히 달라집니다. 강의들이 빼고 계산한 숫자를 보여 주는 건 아마 일부러일 거라고 생각합니다. 넣고 계산하면 몇억이라는 말이 잘 안 나오니까요.

그렇다고 AI로 영상 만드는 게 소용없다는 얘기를 하려는 건 아닙니다. 저는 계속 만들고 있고, 손으로 하던 것보다는 확실히 빠릅니다. 그림을 한 장 한 장 직접 그릴 수는 없고, 목소리를 다 녹음할 수도 없으니까요. 귀찮고 오래 걸리는 일은 AI가 하고 사람은 보고 고르고 고치는 일을 하는 거죠. 그 일이 생각보다 많다는 것뿐입니다. 강의는 이 일을 없는 것처럼 말하고, 저는 이 일이 영상의 절반 정도는 된다고 보고 있습니다.

채널을 하고 있다는 그 엄마가 확인하는 단계를 얼마나 거치고 있는지는 모르겠습니다. 거치고 있다면 그분도 이미 알고 계실 것 같습니다. 이게 딸깍이 아니라는 걸요.

저는 아직 고치고 있습니다. 오늘도 캐릭터 그림을 점검하는 부분을 손봤습니다. 다음 영상에서 그게 제대로 잡히는지 봐야 하는데, 그것도 결국 제가 보고 확인해야 하는 일입니다.

댓글

이 블로그의 인기 게시물

봉제인형 사진 한 장, ChatGPT와 Gemini의 다른 대답

구글은 서울에서 모델이 아니라 에이전트를 판다

AI 부업으로 3개월에 2달러 벌고 50달러를 썼다는 증언을 봤습니다. 그 위에 광고가 네 겹입니다