Veo 3 vs Veo 3.1:어떻게 고를까?
스펙 비교
| Veo 3 | Veo 3.1 | |
|---|---|---|
| 제작사 | Google DeepMind | Google DeepMind |
| 국가/지역 | 미국 | 미국 |
| 출시 | 2025-05 | 2025-10 |
| 생성 유형 | 텍스트→영상 + 이미지→영상 | 텍스트→영상 + 이미지→영상 |
| 클립 길이 | 8초(Flow 내에서 연장 가능) | 8초(Flow 씬 연결 시 60초 이상까지 확장) |
| 해상도 | 1080p(4K 업스케일) | 1080p(4K 업스케일) |
| 네이티브 오디오 | 네이티브 대사 + 효과음 + 배경음악(업계 최초) | 네이티브 대사 + 강화된 효과음 |
| 립싱크 | 다국어 립싱크 | 다국어 립싱크 |
| 화면 비율 | 16:9 / 9:16 | 16:9 / 9:16 |
| 참고 가격 | Google AI Pro 월 19.99달러(사용량 제한)/Ultra 월 249달러; API는 초당 과금으로 약 0.35~0.75달러/초 | Google AI 구독에 포함; API 가격은 Veo 3보다 약간 높은 수준 |
| API | ✅ 제공✅ | ✅ 제공✅ |
| 무료 이용 한도 | Gemini 앱에서 소량 체험 가능 | Gemini 앱에서 소량 체험 가능 |
5개 항목 평점 비교
Veo 3
Veo 3.1
업그레이드할지 말지, 일단 이 한 줄부터 보자
Veo 3.1은 완전히 새로 만든 모델이 아니라 Veo 3의 강화판이에요. 2025년 10월에 나왔으니 출시 간격이 겨우 다섯 달이죠. 완전히 새로운 조작 방식을 기대하진 마세요—기본 뼈대는 그대로예요. 네이티브 오디오, 기본 8초 길이, Google 생태계, 이런 것들은 다 그대로 남아 있어요. 바뀐 건 두 가지예요. 참조 이미지 제어 능력이 큰 폭으로 강화됐고, 서사 일관성이 눈에 띄게 안정됐습니다.
결론부터 말씀드릴게요. 지금 작업 흐름에서 참조 이미지나 첫/끝 프레임으로 캐릭터 생김새를 자주 제어해야 하거나, 같은 캐릭터가 반복해서 등장하는 시리즈 콘텐츠를 만든다면, 3.1로 업그레이드하는 데 망설일 이유가 없어요. 그냥 가끔 독립적인 대사 단편 몇 개 생성하는 정도라면 3.0으로 충분하니, '신버전'이라는 이유만으로 돈을 더 쓸 필요는 없습니다.
이런 짧은 호흡의 반복 업데이트 방식은 사실 기억해둘 만해요—Google은 반년을 기다렸다가 큰 버전을 한꺼번에 내놓는 대신, 사용자 피드백이 가장 집중된 문제점(캐릭터가 자꾸 달라지는 것)을 따로 뽑아내 먼저 해결했어요. 이런 접근 방식이 신기능을 한꺼번에 쌓아 올리는 것보다 훨씬 실용적이죠.
정확히 뭐가 업그레이드됐나
지시 이행력은 8점에서 9점으로 올랐어요. 이 1점의 상승은 주로 복합 지시의 실행 완성도에서 드러나요—3.0은 긴 문장에서 가끔 디테일을 한두 개 놓치곤 했는데, 3.1에서는 이 문제가 눈에 띄게 줄었습니다.
일관성은 8점에서 9점으로 올랐는데, 이게 가장 확실하게 체감되는 업그레이드예요. 3.1은 첫/끝 프레임과 다중 참조 이미지 제어 능력을 강화했고, 같은 캐릭터가 컷과 장면을 넘나들면서도 생김새와 옷차림을 유지하는 능력이 3.0보다 훨씬 탄탄해졌어요. 커뮤니티에서 나온 '이게 바로 Veo 3가 원래 이랬어야 할 모습'이라는 평가가 바로 이 부분을 가리키는 거예요.
화질과 움직임 폭, 이 두 항목의 점수는 변화가 없어요. 여전히 각각 9점과 8점인데, 이건 3.1이 전면적인 재작업이 아니라 제어력이라는 약점을 겨냥해서 보강한 거라는 걸 보여줘요.
기본 길이는 변화가 없어요. 여전히 8초부터 시작하지만, Flow에서의 장면 연장 능력은 더 강해졌어요. 60초 이상의 연속 서사까지 이어붙일 수 있게 됐는데, 시리즈 콘텐츠나 롱테이크가 필요한 경우엔 실질적인 증가분이에요.
스타일화 쪽은 두 세대 모두 강점이라고 하기 어려워요. 3.1의 설명에서도 애니메이션, 수묵화 같은 스타일 표현은 여전히 중국 모델들에 못 미친다고 언급하고 있어요. 이건 업그레이드로 해결될 문제가 아니니, 3.1에 비현실적인 기대는 하지 마세요.
세 가지 실제 시나리오, 바꿀지 말지 판단해보자
시나리오 1: 연속 3부작 브랜드 스토리 영상을 만드는데, 같은 모델이 여러 장면에 반복해서 등장해야 한다. 3.1로 업그레이드하세요. 참조 이미지 제어 강화는 3.0 시절의 '이번 화에서 얼굴이 바뀌었네' 같은 고질적인 문제를 바로 해결해줘요. 캐릭터 일관성이야말로 이번 업그레이드의 핵심 가치이고, 업그레이드하지 않는 건 스스로의 효율을 깎아먹는 셈이에요.
시나리오 2: 가끔 대사가 있는 제품 단편을 하나씩 생성하는데, 장면이 독립적이고 캐릭터가 컷을 넘나들며 이어질 필요가 없다. 3.0에 그대로 있어도 전혀 문제없어요. 가격 체계는 두 세대가 거의 같고, 업그레이드해도 이런 작업의 결과물 품질이 눈에 띄게 좋아지진 않으니, 돈을 엉뚱한 곳에 쓰는 셈이죠.
시나리오 3: Flow로 1분 넘는 연속 서사 콘텐츠, 예를 들어 페이크 다큐나 드라마 예고편 같은 걸 만든다. 3.1로 업그레이드하세요. 장면 연장과 참조 이미지 제어의 조합이 긴 콘텐츠에서 낼 수 있는 효과는 컷 수가 늘어날수록 누적돼요. 컷이 많아질수록 3.1이 3.0보다 앞서는 폭도 더 뚜렷해지니, 이런 프로젝트에서 업그레이드하지 않는 건 3.1이 발휘해야 할 가치를 낭비하는 거예요.
지갑을 더 열어야 하나
가격 체계는 거의 그대로예요. 3.1도 여전히 Google AI 구독을 따르고, Pro/Ultra 등급 구성도 그대로예요. API 과금은 살짝 올랐지만 3.0과 비교했을 때 자릿수가 달라지는 수준은 아니고, 같은 제품군 안에서의 자연스러운 인상에 가까워요. '업그레이드하면 비용이 두 배로 든다' 같은 상황은 없습니다.
가성비 점수는 두 세대 모두 6점이에요. 이 낮은 점수는 업그레이드 때문이 아니라, Google의 이 구독 체계 자체가 원래부터 대량 생산에 친절하지 않기 때문이에요. 3.1이 이 문제를 더 악화시키지도, 해결하지도 않았어요. 다시 말하면, 고민해야 할 건 업그레이드에 드는 돈이 아니라, 애초에 이 가격대를 받아들일지 말지예요.
실전 조언은 이래요. 기존 계정이라면 바로 3.1로 전환하세요. 새 버전은 기존 구독에 무료로 포함되니까 따로 돈을 낼 필요가 없고, 이 경우 업그레이드는 사실상 비용이 들지 않아요. 유일한 대가는 참조 이미지 제어의 새로운 사용법에 다시 익숙해지는 데 약간의 시간을 들이는 것뿐이에요.
커뮤니티 반응은 어떤가
3.0의 평판은 줄곧 '말할 줄 아는 AI 영상'이라는 타이틀에 안정적으로 머물러 있었어요. 3.1이 나오기 전까지 동종 업계 리뷰들도 여전히 이걸 음성-영상 동기화의 기준점으로 삼았죠. 이 기준점 위상이 3.1에 의해 뒤집힌 건 아니고, 그저 같은 회사가 자기 자신을 갱신한 거예요.
3.1이 나온 뒤 커뮤니티 분위기는 꽤 일관돼요. '이게 바로 Veo 3가 원래 이랬어야 할 모습'이라는 평가를 받고, 영화적인 톤을 추구하는 창작자들이 참조 이미지 기능에 상당히 열광하고 있어요. 반복적으로 언급되는 건 캐릭터 일관성이 드디어 안정됐다는 점이에요. 불만의 목소리도 꽤 집중돼 있는데, 여전히 구독 가격이에요. 이 불만은 3.0부터 3.1까지 이어지고 있고, 업그레이드했다고 해서 사라지지 않았어요. 두 세대의 실제 완성작은 본 사이트에 모두 수록돼 있으니 나란히 비교해볼 수 있어요. 같은 프롬프트로 3.0과 3.1을 각각 돌려보면, 캐릭터 일관성의 차이는 두세 컷만 봐도 느껴질 정도로, 스펙표를 보는 것보다 훨씬 직관적이에요.
한 줄 결론
추천: Veo 3, 이런 경우라면
- 대사가 있는 스토리 단편
- 브이로그/모큐멘터리
- 소리와 영상이 하나로 맞아떨어져야 하는 소셜 콘텐츠
추천: Veo 3.1, 이런 경우라면
- 캐릭터 일관성이 중요한 시리즈 콘텐츠
- 레퍼런스 이미지 기반 브랜드 영상
- Veo 3 사용자라면 고민 없이 업그레이드할 만함
Veo 3 실제 생성 사례
아래는 본 사이트에 수록된 Veo 3 실제 생성 원본 영상(전체 복사 가능한 프롬프트 포함, 재현 가능):
Veo 3.1 실제 생성 사례
아래는 본 사이트에 수록된 Veo 3.1 실제 생성 원본 영상(전체 복사 가능한 프롬프트 포함, 재현 가능):








