홈으로

AIWorksMAGAZINEField Notes

FIELD TESTED

Field NoteField Notes

첫 영상은 정확했습니다. 그런데 프레젠테이션 같았습니다

GPT-6 소식을 설명하는 영상을 AI로 만들었습니다. 한 번 완성하고, 접고, 다시 만들었습니다. 그 사이에 있었던 일을 적습니다.

글 김종하읽는 시간 5분

ChatGPT가 긴 글 대신 누를 수 있는 화면으로 답하기 시작했다는 글을 쓰고 나서, 글만으로는 부족하다고 느꼈습니다. 화면이 달라졌다는 이야기를 글로만 전하는 게 어색했습니다. 그래서 영상을 만들기로 했습니다.

처음 만든 영상은 24초였습니다. 왼쪽에 설명 문구가 있고 오른쪽에 화면이 나옵니다. 먼저 글로 된 긴 답이 흐르고, 다음에 체크 칸이 있는 정산표가 나와 금액이 바뀝니다. 숫자도 맞고 순서도 맞았습니다.

영상 1이전

처음 만든 24초 설명형 영상

틀린 곳이 없는데 아쉬웠습니다

다 보고 난 제 반응은 이랬습니다. 기능 설명은 정확한데 프레젠테이션 같다. 화면 구성도, 색도, 리듬도 발표 자료의 것이었습니다.

저에게는 기준이 하나 있었습니다. 얼마 전 강의 첫 시간에 틀었던 70초 오프닝 영상입니다.

그래서 Claude에게 두 영상을 나란히 놓고 무엇이 다른지 분석해 달라고 했습니다. 돌아온 답은 분명했습니다. 오프닝 영상은 창가의 드레스와 비 오는 밤의 택시처럼 실제 장소에서 시작하고, 한 사람의 이야기가 있습니다. 새 영상은 남색 바탕 위의 도형에서 시작하고, 주인공이 표입니다. 같은 구도가 16초 동안 이어지고, 자막은 화면에 이미 보이는 것을 한 번 더 설명합니다.

잘 만든 슬라이드였습니다. 보는 사람이 느끼는 대신 읽어야 했습니다.

AI가 못 만든 게 아니었습니다.

처음 기획이 기능을 설명하는 데 집중돼 있었고, 영상도 그대로 설명서가 됐습니다.

그래서 식탁으로 갔습니다

기획을 처음부터 다시 잡았습니다. 기준은 한 문장이었습니다. "이걸 AI로 만들었다고?"

기능을 설명하지 말고 상황을 보여 주기로 했습니다. 저녁을 다 먹고 계산서가 놓이는 순간입니다. 누군가 "잠깐, 나 와인 안 마셨는데?" 하고 말하는, 누구나 한 번쯤 겪어 본 그 어색한 장면입니다.

ChatGPT의 이미지 생성으로 사진 네 장을 만들었습니다. 같은 식당, 같은 다섯 명입니다. 계산서를 보며 고민하는 장면, 와인을 안 마신 사람이 손을 드는 장면, 휴대폰의 긴 글을 보며 표정이 굳는 장면, 화면을 보고 다 같이 웃는 장면입니다.

그리고 이 네 장을 Claude에게 넘겼습니다.

사진 네 장이 48초가 되기까지

영상처럼 보이지만, 사실 움직이는 장면은 하나도 없습니다. 전부 정지된 사진입니다. 카메라가 천천히 다가가고, 초점이 맞춰지고, 촛불이 흔들리고, 필름 입자가 깔립니다. 그 위에 대사 자막이 얹힙니다. 사진 네 장이 그렇게 48초가 됐습니다.

만드는 동안 걸린 곳이 몇 군데 있었습니다.

화면 속 글자가 엉터리였습니다. AI가 만든 사진 속 휴대폰과 태블릿에는 그럴듯한 화면이 들어 있었습니다. 그런데 메뉴가 영어였고 금액도 제가 쓰려던 예시와 달랐습니다. 그대로 쓰면 틀린 숫자가 나가는 셈입니다. 그래서 화면 부분을 통째로 가리고, 정확한 한글과 숫자로 만든 화면을 사진 속 기기의 기울기에 맞춰 다시 얹었습니다. 화면을 누르고 있는 손가락은 그 위에 다시 올렸습니다.

세 번째 사진은 휴대폰인데, 네 번째 사진은 태블릿이었습니다. 사진을 따로 만들다 보니 생긴 일입니다. 화면이 휴대폰 밖으로 떠올랐다가 태블릿 위로 내려앉는 연출로 이었습니다. 눈 밝은 분은 알아채실 겁니다.

영화 같은 화면비가 사람의 눈을 잘랐습니다. 위아래에 검은 띠를 두껍게 넣었더니 인물의 눈이 띠에 걸렸습니다. 띠를 줄여 드라마에서 흔히 쓰는 2:1 비율로 바꿨습니다.

컴퓨터가 버티지 못했습니다. 마지막에 영상을 뽑는 도중 메모리가 모자라 작업이 멈췄습니다. 5초씩 아홉 조각으로 나눠 하나씩 뽑은 뒤 이어 붙였습니다.

끝이 검은 화면이었습니다. 처음 완성본은 까맣게 어두워지며 끝났습니다. 마지막 장면을 2초 남짓 붙들어 두는 쪽으로 고쳤습니다.

영상 2이후

다시 만든 48초 생활 드라마형 영상인물과 장소는 AI로 생성한 이미지이고, 화면 속 UI는 실제 ChatGPT 화면이 아닙니다. 금액은 예시입니다.

두 영상은 무엇이 다른가

두 영상이 전하는 정보는 같습니다. 체크를 하나 끄면 금액이 바로 바뀐다는 것입니다.

첫 영상은 그것을 표로 보여 줍니다. 두 번째 영상은 와인을 안 마신 사람이 20,000원에서 5,000원으로 내려가고, 옆자리 친구가 "근데 와인값, 나 혼자 내는 거야?" 하고 묻는 장면으로 보여 줍니다. 숫자는 그대로인데 이번에는 누구의 돈인지가 보입니다.

아직 말할 수 없는 것

이 영상이 독자에게 실제로 더 잘 전달되는지는 모릅니다. 영상은 이제 막 공개했고, 지금까지 확인한 것은 제 눈에 달라 보인다는 것뿐입니다.

무엇 덕분에 나아졌는지도 가려내지 못했습니다. 기획이 바뀌었고, 실제 같은 사진이 들어왔고, 다시 만들 때는 Claude도 더 큰 모델(Opus)로 바꿨습니다. 세 가지가 한꺼번에 달라졌습니다.

한계도 있습니다. 사진이 네 장뿐이라 인물은 움직이지 않습니다. 음악과 효과음은 따로 구하지 않고 코드로 합성했는데, 전문가가 만든 소리와 견줄 만한지는 제가 판단하기 어렵습니다.

AIWorks의 해석AIWORKS VIEW

이번 작업에서 다시 확인한 것은 기획의 중요성이었습니다. 처음에는 기능을 정확하게 설명하는 데 집중했습니다. 다시 만들 때는 사람들이 실제로 겪을 법한 상황에서 시작했습니다.

ChatGPT가 만든 이미지와 Claude의 연출이 더해지면서 같은 기술을 소개하는 영상도 전혀 다른 모습이 됐습니다.

결국 중요한 것은 AI에게 무엇을 시킬 것인가를 넘어, 무엇을 보여주고 싶은지 먼저 생각하는 일이었습니다.

우리 회사의 ‘늘 하던 방식’은 무엇인가요?지금 반복하고 있는 일을 함께 살펴보고, AI로 바꿔 볼 수 있는 지점을 찾습니다.

무료 AI 업무 진단

이런 분께 필요합니다

  • AI로 영상이나 발표 자료를 만들어 보려는 분
  • AI 결과물이 "틀리진 않은데 밋밋했던" 경험이 있는 분
  • AI 제작 과정이 실제로 어떤지 궁금한 분

관련 서비스

FIELD TALK · 독자와의 대화

당신의 현장에서는
어떤가요?

AI로 무언가를 만들었는데 "틀리진 않았지만 아쉬웠던" 경험이 있다면, 무엇이 비어 있었는지 들려주세요.

  • 겪은 문제AI를 써 봤지만 잘 안 됐던 일
  • 다른 경험우리 현장에서는 달랐던 점
  • 궁금한 점이 글을 읽고 생긴 질문

댓글과 질문 공간은 준비 중입니다. 그 전까지는 메일로 받습니다.

메일로 이야기 보내기

이어서 읽기매거진 전체 보기