NEW클릭 한 번으로 완성되는 바이럴 UGC 광고. Studio를 만나보세요.광고 만들기
PopcraftPopcraft
Gemini Omni 1.1 Flash 하루 사용기: 40초 영상과 실제 비용 공개
제품10분 읽기

Gemini Omni 1.1 Flash 하루 사용기: 40초 영상과 실제 비용 공개

긴 글 읽기 싫으신 분들을 위한 핵심 요약. Gemini Omni 1.1 Flash는 Google이 개발한 올인원 영상 생성 모델입니다. 텍스트, 이미지 혹은 기존 영상 클립을 입력하면 자체 사운드가 포함된 완성 영상을 출력하죠. 2026년 8월 27일 업데이트된 1.1 버전에서는 실제 작업에 꼭 필요한 두 가지 기능, 최대 40초 장면 확장과 1080p/4K 해상도 출력이 추가되었습니다. 현재 Popcraft에서 바로 사용 가능합니다. 저희가 하루 종일 이 모델을 테스트하며 알아낸 가장 중요한 사실 하나만 알려드릴게요: 5초 클립을 "20초로 확장"해 달라고 요청하면 실제로는 25초가 돌아옵니다.

Google 공식 스펙실제 테스트 결과
최대 영상 길이장면 확장으로 최대 40초, 10초 단위로 증가프롬프트 하나로 40.0초 생성 완료, 실제 소요 시간 23분
영상 확장"최대 10초의 이전 컨텍스트 분석 지원"5초 원본 → 25.0초 파일 출력, 원본 프레임 완벽 보존
해상도360p ~ 4K, "전문 제작 수준 품질"트레일러 1080p, 테스트 영상 720p; 4K의 경우 30초에서 제한
오디오영상과 함께 음성, 음악, 효과음 생성트레일러 관현악 반주, 확장 영상 폭풍 배경음 정상 생성
물리"중력, 운동 에너지, 유체 역학 등 힘에 대한 직관적인 이해 지원"3종 유체가 자연스럽게 동작하는 30초 수중 잉크 확산 영상 생성
카메라파트너 인용: "역동적인 카메라 모션"드론과 오빗은 매번 성공; 휩 팬, 크레인, 돌리 줌은 완화됨

수요일 10:41. 서비스가 열렸습니다.

Batch AI가 전날 밤 자사 테스트 게이트웨이에서 이 모델을 켰습니다. 먼저 Batch AI 쪽에서 확인된 사실 두 가지부터 말씀드립니다. 이 두 가지가 모델을 어떻게 쓸지 결정하기 때문입니다: 해상도 문자열은 "4K"이고 실제로 3840×2160을 반환한다는 것, 그리고 확장은 프롬프트 트릭이 아니라 API 차원의 정식 모드라는 것입니다. 그 아래 내용은 전부 저희가 직접 버튼을 눌러 본 결과입니다.

첫 작업은 일부러 평범한 주제로 골랐습니다. 나선형 계단 위의 등대지기, 세로 비율, 5초, 720p. 약 2분 뒤 5.01초 길이로 돌아왔는데, 아무도 요청하지 않은 바람과 빗소리가 트랙에 얹혀 있었습니다. 이것이 Omni의 기본 동작입니다. Google 개발자 가이드는 이 모델이 "영상에 어울리는 오디오 트랙을 생성하려고 시도한다"고 밝히고 있고, 실제로 그렇게 합니다. 하지 말라고 지시하지 않는 한 매번 그렇습니다.

Popcraft에서 단일 프롬프트로 Gemini Omni 1.1 Flash가 생성한 40초 트레일러

11:20. 요청보다 5초 더 길게 나온 확장 영상

이 글에서 가장 값진 대목이 바로 여기입니다. 앞서 만든 5초 클립을 첨부하고 "등대지기가 램프 갤러리로 걸어 나와 램프에 불을 켠다"라고 한 줄만 적은 뒤, 총 20초로 요청했습니다.

돌아온 파일의 길이는 25.0초였습니다.

버그가 아닙니다. Google 출시 공지에는 확장이 "10초 단위로 누적 최대 40초까지" 동작한다고 적혀 있는데, 말 그대로 온전한 단위로만 붙습니다. 5초 + 10초 + 10초. 새 파일의 첫 5초는 저희 원본과 바이트 단위로 동일했고, 폭풍 소리도 이음매를 그대로 넘어 이어졌습니다. 결과물은 훌륭합니다. 다만 20초가 아닐 뿐입니다.

그래서 이 모델로 개발하시는 모든 분들께 드리는 규칙이자, Popcraft 영상 확장 패널에서 깔끔한 10/20/30/40초 대신 5초 원본 기준 15, 25, 35초 옵션을 표시하는 이유가 바로 여기에 있습니다: 원본 영상 길이에 정해진 단위만큼만 추가 확장이 가능하기 때문이죠. 요청하신 숫자가 아니라 실제 생성되어 반환된 영상의 초 단위 기준으로 과금이 적용됩니다.

"영상은 10초 단위로 확장 가능하며 누적 최대 40초까지 지원합니다." — Google, Omni 1.1 Flash 출시 공지

12:05. 40초, 프롬프트 하나

그리고 저희가 진짜 원했던 것: 할리우드 트레일러 "Pirates of the Cranberries", 16:9, 1080p, 40초, 요청은 단 한 번. Popcraft가 확장 과정을 자동으로 연결해 줍니다: 프롬프트 하나를 넣으면 40초짜리 파일 하나가 나옵니다.

23분이 걸렸습니다. 저희 예상치는 15분이었으니 이 부분은 저희가 다시 튜닝해야 할 문제입니다. 결과물은 정확히 40.0초, 1920×1080이었고, 대체로 맞는 지점에서 고조되는 오케스트라 스코어가 얹혀 있었습니다. 네 구간 내내 선장도 같고, 배도 같고, 청록-호박색 색보정도 같았습니다. 이 일관성이 바로 출시 공지에 나온 10초 컨텍스트 윈도우가 제 역할을 한 결과이며, 이 모델을 선택할 가장 강력한 근거입니다.

Omni 40초 렌더 결과: 크랜베리가 흩뿌려진 바다 위 세 척의 배

모델이 제대로 생성하지 못한 부분이 있었는데, 사실 저희 잘못이었습니다. 폭풍, 선장, 크랜베리로 가득한 보물상자, 적함, 대포 발사 마지막 장면까지 다섯 개 비트를 240단어로 빽빽하게 적은 프롬프트를 썼거든요. Omni는 모든 요소를 빠짐없이 담았지만 순서를 뒤섞어 버렸습니다. 크랜베리가 흩뿌려지는 장면이 이를 쏟아내야 할 보물상자보다 앞선 8초 시점에 나왔고, 정작 보물상자는 끝까지 제대로 열리지 않았습니다. 이 모델에서 내용이 많은 프롬프트는 실패하지 않습니다. 그냥 압축될 뿐입니다.

15:10. 좋습니다, 물리 주장을 제대로 테스트해 보겠습니다

트레일러는 물리 테스트로는 적합하지 않습니다. 한 번에 너무 많은 일이 벌어져서 크랜베리가 제대로 튀었는지조차 판단할 수 없으니까요. 그래서 그날 가장 단조로운 프롬프트를 작성했습니다. 검은 수조에 담긴 고요한 물. 10초 구간마다 유체 하나씩: 떨어지는 주황색 물방울, 남색 잉크 기둥, 그리고 뒤에서 빛을 받은 흰 안료 구름. 인물도 없고 스토리도 없으며, 느린 카메라 아크 하나, 1080p로 30초, 요청은 단 한 번이었습니다.

이날 이 모델이 만든 것 중 최고입니다. 물방울이 떨어지며 왕관 모양 물보라를 만들고, 실제 물이 그러하듯 다시 무너져 내립니다. 남색 잉크 기둥이 그 뒤로 밀려들어와 주황색 사이를 파고들지만, 두 색 중 어느 쪽도 뭉개져 흐려지지 않습니다. 흰 구름이 도착하면 역광이 그 사이로 산란되고, 앞서 등장한 유체들은 그 아래에 그대로 남아 여전히 움직입니다. 카메라 아크는 세 구간 내내 유지되며 한 번도 초기화되지 않습니다. 10초와 20초 지점의 이음매를 찾아보세요. 저희는 찾지 못했습니다.

저렴한 초안부터 먼저 만들었습니다. 저희가 권하는 작업 순서가 그렇기 때문입니다. 10초 720p 변형 네 가지(잉크, 꿀, 도미노, 뉴턴 진자)를 각각 약 2분 만에 뽑았습니다. 잉크와 진자는 좋았고, 꿀은 조금 과했으며, 도미노는 순서대로 넘어졌지만 무게감이 없었습니다. 잉크가 이겨서 30초 버전을 작성했고, 30초 버전은 초안보다 더 나은 결과로 돌아왔습니다. 트레일러는 그렇지 않았습니다. 길이가 길어질수록 스토리가 더 압축되었으니까요. 압축할 스토리가 없다면 확장은 순수하게 이득입니다.

이번 테스트 결과로 보면, 유체 역학에 관한 Google의 문장은 마케팅이 아닙니다.

16:40. 카메라 구현 검증

Google 출시 자료에서 계속 눈에 띈 또 다른 주장은 카메라에 관한 것이었습니다. Google 모델 페이지에 실린 파트너 인용문은 이 모델의 "역동적인 카메라 모션"을 칭찬하고, Vertex 프롬프트 가이드에는 이 모델이 학습한 용어 목록이 나와 있습니다: 드론, 돌리, 팬, 틸트, 트래킹, 크레인, 오빗, 휩 팬, 그리고 고급 기능이자 공식 지원되지 않는다고 표시된 "돌리 줌"까지.

그래서 오전에 사용했던 등대 배경 그대로, 30초짜리 한 컷 안에 위 카메라 동작 전부를 요청했습니다. 프롬프트 구간마다 한 가지 동작씩 지정해서요.

프롬프트와 대조하며 카메라 동작을 하나씩 평가한 결과는 다음과 같습니다:

  • 드론 접근. 성공. 파도 표면을 스치듯 날아가 현무암 절벽을 오른 뒤, 정확히 요청한 초에 등대 등불에 도착했습니다. 하루 종일 이 모델이 보여 준 카메라 움직임 중 최고의 10초였습니다.
  • 오빗. 성공. 마지막 10초는 등대지기의 뒤에서 시작해 측면을 지나 반대편 넓은 구도까지 원을 그리며 돌았고, 등대는 전 구간 내내 같은 등대로 유지되었습니다.
  • 배 쪽으로 휩 팬. 실패. 배는 수평선 위에 작게 자리하고 있었지만, 카메라가 튕기듯 꺾이지 않고 서서히 흘러갔습니다. 모델이 빠른 움직임을 느린 움직임으로 완화한 것입니다.
  • 등불 위로 크레인 업. 절반 성공. 상승은 요청하지 않은 첫 구간에서 일어났고, 정작 요청한 두 번째 구간에서는 일어나지 않았습니다.
  • 로우 앵글 푸시인 + 랙 포커스. 실패. 대신 넓은 구도로 끝났습니다.
  • 돌리 줌. 30초 프롬프트에서 일부러 뺐습니다. 앞선 10초 테스트에서 평범한 푸시인으로 돌아왔고, Google 가이드에서도 "공식 지원되지 않음"으로 분류하고 있으니 이건 납득할 만합니다.

아무도 요청하지 않은 두 가지. 첫 구간과 두 번째 구간 사이에서 카메라가 등불 유리를 그대로 통과해 안에 있는 등대지기를 찾아낸 뒤, 그녀를 따라 문 밖 갤러리로 나갑니다. 파일 어디에도 컷은 없으므로(장면 감지 도구를 직접 돌려 확인했습니다) 모델이 드론의 위치에서 그녀의 위치로 옮겨 가기 위해 전환을 스스로 만들어 낸 것입니다. 훌륭한 발명입니다. 덜 훌륭한 점: 등불 안에서는 올려 묶여 있던 그녀의 머리가 몇 초 뒤 갤러리에서는 풀려 있습니다. Google 모델 카드는 "편집 간 일관성"과 "복잡한 움직임"을 알려진 한계로 명시하고 있는데, 실제로 보이는 모습이 바로 이것입니다.

10초, 30초 테스트 전반에서 확인된 패턴은 다음과 같습니다. 드론, 오빗, 아크, 돌리 같은 느리고 부드러운 움직임은 안정적으로 구현되지만, 휩 팬이나 돌리 줌 같은 빠르거나 광학적인 움직임은 완화된 형태로 렌더링됩니다. 날카로운 전환이 필요한 샷은 별도의 짧은 클립으로 생성한 뒤 편집으로 이어 붙이는 것을 권장합니다.

프롬프트 교훈은 트레일러와 같습니다. Google 자체 가이드의 용어로, 비트마다 하나씩 동작을 이름으로 지정하면 느린 동작들은 요청한 타임코드에 정확히 도착합니다. 반면 "부드럽게", "역동적으로" 같은 느낌을 묘사하면 어느 쪽이든 느린 푸시인만 돌아옵니다.

Omni Flash 1.0과 실제로 무엇이 달라졌나요?

Google 모델 페이지는 두 버전에 같은 기능 표를 쓰고 있어서, 변경점이 유독 솔직하게 드러납니다:

기능Omni Flash (2026년 5월)Omni 1.1 Flash (2026년 8월)
텍스트 → 영상지원지원
이미지 → 영상미지원지원
참조 이미지 / 영상미지원이미지 최대 10장, 영상 최대 3개
시작 / 종료 프레임 지정미지원지원
영상 편집지원지원
영상 연장미지원지원, 최대 40초
출력 해상도720p만 지원360p, 720p, 1080p, 4K
사운드 생성음성, 음악, 효과음음성, 음악, 효과음
출처 표시SynthID, C2PASynthID, C2PA

최초의 "Gemini Omni 출시" 게시물에 나온 물리와 세계 지식에 관한 주장("중력, 운동 에너지, 유체 역학 같은 힘에 대한 향상된 직관적 이해")은 그대로 이어지며, 저희는 아래에서 그 주장을 일부러 다시 테스트했습니다. 다만 Google이 앞세우는 것은 메모리입니다. "모든 명령은 이전 명령 위에 쌓입니다. 캐릭터는 일관되게 유지되고, 물리는 무너지지 않으며, 장면은 앞선 내용을 기억합니다." 저희 트레일러를 만들어 보고 나니, 그 문장의 뒷부분은 예상했던 것보다 더 믿게 되었습니다.

모드 전환 없이 명령을 전달하는 방법은?

별도의 설정은 없으며, 여기에 익숙해지려면 잠깐 시간이 걸립니다. Google 가이드는 "기본적으로 프롬프트에 의존하고, 프롬프트로 원하는 결과가 나오지 않을 때만 태스크 파라미터를 사용할 것"을 권장합니다. 무엇을 첨부하고 무엇을 쓰는지가 곧 스위치입니다.

  • 아무것도 첨부하지 않음: 텍스트 → 영상 생성
  • 이미지 1장 첨부: 해당 이미지가 첫 프레임이 됨
  • 이미지 2장 + "첫 프레임", "마지막 프레임" 문구: 두 이미지 사이를 보간. 이 문구가 없으면 두 이미지는 피사체 참조로 처리됨
  • 이미지 최대 10장 첨부: 피사체 참조. 등장 인물과 사물의 일관성이 유지됨
  • 영상 + "눈이 내리게 해줘": 샷, 길이, 구도를 그대로 유지하는 편집
  • 영상 + "이 영상을 연장해줘": 장면 연장

많은 분들이 헷갈려 하시는 두 가지 포인트가 있습니다. 기존 클립을 첨부한 뒤 extend 키워드 없이 이어질 내용만 설명하면, 모델은 이를 영상 편집 요청으로 인식해 원본과 동일한 길이의 영상을 반환합니다. Popcraft 영상 확장 패널에서는 해당 키워드를 자동으로 추가해 주지만, API나 MCP로 호출하실 경우 직접 키워드를 입력해 주셔야 합니다.

처음 40초 렌더링을 시도하는 동료에게 전하고 싶은 말

단순한 팁 목록이 아닙니다. 실제 사용에서 가장 먼저 부딪히게 될 문제점 세 가지를 발생 순서대로 정리했습니다.

구간마다 동작 하나만. Google 가이드에는 타임코드 문법이 문서화되어 있고, 이것이 10초 구간과 완벽하게 맞아떨어집니다. 트레일러 프롬프트는 이렇게 보냈어야 했습니다:

해 질 녘 폭풍 속 해적 갤리온선, 해골 깃발, 찢어진 검은 돛. 컷 없이 이어지는 단일 롱테이크. [0-10초] 배가 파도를 가르며 나아감; 카메라가 갑판 위로 상승 [10-20초] 수염 난 선장이 키를 잡고 명령을 외침; 선원들이 일제히 응답 [20-30초] 선수에 놓인 철제 상자를 엶; 붉은 크랜베리가 넘쳐흐름 [30-40초] 적선이 포격을 가함; 선장이 커틀러스를 들어올리는 순간 크랜베리가 슬로우 모션으로 흩어짐 연출: 아나모픽 플레어, 틸 앤 엠버 색보정, 오케스트라 사운드트랙, 화면 텍스트 없음

원하는 것을 명확히 말하세요. 아무것도 없다면 없다고 말하세요. 침묵도 하나의 요청입니다. "대화 없음", "음악 없이 바람과 물 소리만" 같은 단순한 부정 표현은 가이드에서도 직접 예시로 들고 있으며 정상적으로 동작합니다. 프롬프트에 소리 관련 내용을 아예 적지 않는 것과, 소리가 없다고 명시하는 것은 완전히 다른 결과를 낳습니다.

생각보다 적은 단어로 편집하세요. Google이 직접 하는 말입니다: "영상 편집에는 간결한 프롬프트가 가장 좋습니다. 지나치게 상세한 프롬프트는 의도하지 않은 변경으로 이어질 수 있습니다." 변경할 내용을 지정하고, "나머지는 그대로 유지해 줘"를 덧붙인 뒤, 입력을 멈추세요.

Seedance 2.5, Veo 3.1 옆에서 이 모델이 놓이는 자리

저희가 여러 영상 모델을 함께 운영하는 이유는, 모든 샷에서 이기는 모델이 하나도 없기 때문입니다. Omni의 강점은 요청 한 번으로 최대 40초, 최대 4K에 자체 사운드까지 담긴 하나의 긴 클립을 만든다는 점입니다. Seedance 2.5는 훨씬 많은 참조 자료(이미지 30장, 영상 10개)를 받고 영역 단위의 정밀 편집이 가능합니다. Veo 3.1은 8초에서 프레임 단위의 정교한 제어를 제공합니다. 히어로 클립 하나와 스코어가 필요한 브리프라면 Omni로 시작하세요. 열두 개 샷 전체에서 제품이 똑같아 보여야 하는 브리프라면 Seedance로 시작하세요.

Popcraft에서의 비용은 해상도별로 최종 생성된 영상 초 단위로 청구됩니다. 초안 작성에는 720p, 최종 결과물 제출에는 1080p, 메인 하이라이트 샷에는 4K를 사용하시면 됩니다. 4K의 경우 연장 최대 길이가 30초로 제한됩니다. 슬라이더에서 3초에서 40초 사이 원하는 길이를 선택하시면 Popcraft가 내부에서 자동으로 영상을 이어 붙여 생성합니다. 슬라이더에는 모델이 안정적으로 생성 가능한 길이만 표시되며, 생성 전에 표시되는 금액 그대로 최종 청구됩니다.

직접 사용해 보고 경험해 보세요

Gemini Omni 1.1 Flash는 현재 영상 생성기, Canvas 보드, MCP 커넥터에서 모두 사용 가능합니다. 신용카드 등록 없이 100 크레딧으로 무료로 시작하실 수 있죠. 저희가 테스트했던 방식을 추천드려요: 먼저 720p 해상도로 10초 분량만 생성해 보시고 결과를 확인한 뒤 확장하시거나, 마음에 드는 기존 클립을 가져와서 확장하시는 겁니다. 이번에 생성한 트레일러와 확장 영상은 편집되지 않은 원본 그대로 사운드까지 전부 모델 페이지에서 확인하실 수 있습니다. 방금 보셨던 두 개의 30초 테스트 영상도 함께 게시되어 있으니 참고해 주세요.

참고 자료: Google의 "Gemini Omni 출시", "Gemini Omni 1.1 Flash로 더 정교한 제어 구현" 게시물, Gemini Omni Flash에 대한 Google DeepMind 모델 카드, Omni Flash와 Omni 1.1 Flash의 Gemini Enterprise Agent Platform 모델 페이지, 그리고 Gemini API 개발자 가이드. 측정값은 2026년 9월 3일 저희가 직접 측정한 것입니다.

자주 묻는 질문

Gemini Omni 1.1 Flash란 무엇인가요?
Google의 영상 모델입니다. DeepMind는 이 모델을 어떤 입력에서든 무엇이든 생성하고 편집할 수 있는 모델로 나아가는 한 단계라고 설명하며, 그 출발점이 영상입니다. 텍스트→영상, 이미지→영상, 시작/끝 프레임 보간, 피사체 참조, 영상 편집, 장면 확장을 하나의 모델로 지원하고, 영상과 함께 음성, 음악, 효과음도 생성합니다. 1.1 버전은 2026년 8월 27일에 출시되었습니다.
Gemini Omni로 생성 가능한 영상 길이는 얼마인가요?
한 번의 생성 패스로 최대 10초 분량의 영상이 만들어집니다. 장면 확장 기능은 10초 단위로 영상을 늘려 누적 최대 40초까지 확장하며, 이때 모델은 앞선 10초 분량의 맥락을 읽어 일관성을 유지합니다. Popcraft에서는 슬라이더 하나로 3초에서 40초 사이 원하는 길이를 선택하면, 입력하신 프롬프트 하나로 확장 과정이 자동으로 연결됩니다. 4K에서는 확장이 30초에서 멈춥니다.
Omni 1.1은 Omni Flash 1.0과 무엇이 달라졌나요?
장면 확장, 시작/끝 프레임 보간, 1080p 및 4K 출력, 참조 영상 기능이 새롭게 추가되었습니다. Google 모델 페이지에서 1.0 카드는 이미지→영상, 참조, 키프레임, 확장 기능을 미지원으로 표기하고 720p만 지원했던 반면, 1.1 카드는 해당 기능을 모두 지원하는 것으로 표기하고 있습니다.
Popcraft에서 Gemini Omni 1.1 Flash를 어떻게 사용해 볼 수 있나요?
영상 생성기를 열고 Gemini Omni 1.1 Flash를 선택하신 뒤 원하는 길이와 해상도를 지정하세요. 필요한 경우 참조 자료나 원본 영상을 첨부한 다음 생성 버튼을 누르시면 됩니다. 카드 등록 없이 100 크레딧으로 무료로 시작하실 수 있습니다. 또한 Canvas 보드 내에서 사용하실 수 있으며 Popcraft MCP 커넥터를 통해서도 접근 가능합니다.

직접 사용해 보실 준비가 되셨나요? 지금 바로 Popcraft를 시작하세요.

Gemini Omni 1.1 Flash 사용해보기