📰 핵심 요약

Gemini가 Omni 1.1 Flash 버전을 출시했다. 일련의 창작 제어 기능과 생성형 영상 기능이 추가되었으며, Google AI Studio의 Gemini API를 통해 개발자에게 공개된다. 목표는 생성형 영상 도구가 더 높은 제어 가능성과 더 빠른 반복 속도를 갖추도록 하고, 정식 제품 배포에 걸맞은 품질 요구사항을 충족시키는 것이다.

이번 업데이트의 핵심 기능은 세 가지다. 첫 번째는 ‘장면 확장’(Scene Extension)으로, 기존 영상의 끝부분에서부터 이어지는 후속 장면을 매끄럽게 생성할 수 있다. Omni 1.1은 최대 10초 분량의 이전 장면 내용을 참조 자료로 분석할 수 있어, 마지막 1초만 참조할 수 있었던 구버전 모델에 비해 크게 향상되었으며, 화면의 연속성과 서사적 일관성이 더욱 개선되었다. 매회 최대 10초까지 확장 가능하며, 누적으로 최대 총 40초까지 확장할 수 있다. 개발자는 Gemini API의 interactions.create 메서드를 통해 previous_interaction_id 파라미터를 입력함으로써 이전 영상 구간을 연결할 수 있다.

두 번째는 ‘시작·종료 프레임 지정’ 기능이다. 사용자는 한 장면의 시작 화면과 종료 화면을 각각 설정할 수 있으며, 모델은 두 핵심 프레임 사이를 연결하는 자연스러운 전환 영상을 생성한다. 복잡한 카메라 워크의 회전, 줌 전환, 매끄러운 루프 클립 등의 장면에 적합하다.

세 번째는 360p 해상도의 드래프트 모드다. Omni 1.1의 표준 해상도인 720p와 비교했을 때, 360p는 생성 속도가 최대 60%까지 향상되며 비용은 3분의 1 수준에 불과하다. 빠른 프로토타이핑, 스토리보드 초안 반복 작업, 개발 플랫폼에서의 빠른 미리보기 렌더링에 적합하다.


💬 JudyAI Lab 인사이트

Gemini가 Omni 1.1 Flash 버전을 출시하고 Google AI Studio의 Gemini API를 통해 개발자에게 공개했다. 핵심은 생성형 영상의 제어 가능성과 반복 속도를 정식 제품 배포 수준으로 끌어올리는 데 있으며, 단순히 데모 차원에 머무르지 않는다는 점이다.

이번 업데이트에서 AI 빌더가 주목할 만한 부분은 세 가지 기능 뒤에 공통적으로 깔린 사고방식이다. 장면 확장은 참조 화면을 1초에서 10초로, 누적 기준 최대 40초까지 늘렸고, 시작·종료 프레임 제어는 카메라 워크와 전환을 예측 가능하게 만들었으며, 360p 드래프트 모드는 더 낮은 비용으로 더 빠른 반복 속도를 확보했다. 이는 생성형 영상 도구가 ‘일회성 산출물’에서 ‘제어 가능하고 반복 가능한’ 워크플로 설계로 옮겨가고 있음을 보여준다. 개발자는 더 이상 프롬프트 하나를 던지고 결과를 기다리는 데 그치지 않고, 영상 편집을 하듯 단계별로 이어붙이고 조정하며 빠르게 시행착오를 거칠 수 있다. 생성형 AI를 제품에 통합하고 있는 팀이라면, ‘낮은 비용의 초안 먼저, 고품질 완성본은 나중에’라는 계층적 설계 사고방식을 참고할 만하다.

생성형 영상 API를 검토하고 있다면, 먼저 이것부터 명확히 해두는 게 좋다. 당신의 제품에 필요한 것은 한 번에 완성되는 품질인가, 아니면 반복적으로 다듬을 수 있는 유연성인가.


📅 원문 정보


🔗 더 읽어보기