모델 가이드

Gemini Omni Flash: Google의 대화형 AI 비디오 모델

Gemini Omni Flash는 빠른 대화형 비디오 생성 및 편집을 위한 Google의 모델 제품군으로, API 출력으로 비디오를 제공합니다.

텍스트-비디오
이미지-비디오
비디오 편집

Gemini Omni Flash란?

Gemini Omni Flash는 빠른 대화형 비디오 생성 및 편집을 위해 구축된 Google AI 모델 제품군입니다. Google의 Gemini API 문서는 Gemini Omni 1.1 Flash를 현재 안정적인 API 모델로 지정하고 있으며, API 출력 형식으로 비디오를 명시하고 있습니다. Gemini Omni Flash API는 텍스트, 이미지 또는 지원되는 비디오 입력을 기반으로 작동합니다. Google은 프롬프트로 비디오 생성, 이미지 애니메이션, 업로드된 클립 편집 또는 확장, 상태 저장 상호작용을 통한 결과 개선 등에 대한 워크플로우를 문서화하고 있습니다. 이 가이드는 독립적인 모델 가이드입니다. Story321은 Gemini Omni Flash가 자사의 비디오 도구를 구동한다고 주장하지 않습니다.

문서화된 기능

텍스트-비디오

Google이 문서화한 Gemini API 워크플로우를 통해 텍스트 프롬프트에서 비디오를 생성합니다.

이미지-비디오

이미지를 시작점으로 사용하여 애니메이션 비디오 결과물을 생성합니다.

대화형 편집

Interactions API와 이전 상호작용 ID를 사용하여 이전 결과를 계속 개선합니다.

비디오 편집 및 확장

Google은 업로드된 비디오 편집과 적격 클립에 확장을 추가하는 방법을 문서화하고 있습니다.

프레임 보간

제공된 첫 프레임과 마지막 프레임으로 전환 비디오를 생성합니다.

다중 출력 옵션

공식 문서에는 선택한 워크플로우 및 가용성에 따라 360p, 720p, 1080p 및 4K 출력 옵션이 명시되어 있습니다.

현재 API 정보

Features
Gemini Omni Flash
안정적인 API 모델
gemini-omni-1.1-flash
프리뷰 API 모델
gemini-omni-flash-preview
문서화된 입력
텍스트, 이미지, 비디오; 편집 또는 확장을 위해 업로드된 비디오는 최대 10초의 적격 클립으로 제한됩니다.
문서화된 출력
비디오
문서화된 비디오 길이
3~10초
문서화된 프레임 속도
24 FPS
문서화된 컨텍스트 창
1,048,576 토큰

활용 가능한 분야

프롬프트 기반 짧은 클립

작성된 장면, 동작 또는 시각적 방향으로부터 간단한 비디오 개념을 프로토타이핑합니다.

정지 이미지 애니메이션

이미지-비디오 워크플로우가 적합할 때 제공된 이미지를 짧은 움직이는 샷으로 변환합니다.

반복적인 비디오 방향 설정

생성된 결과에 대한 대화를 이어가며 매번 처음부터 편집을 시작하지 않도록 합니다.

짧은 클립 수정

적격 업로드 클립을 편집하거나 공식 워크플로우가 지원하는 경우 연속 장면을 추가합니다.

접근 및 가용성

Google은 Gemini API에서 Gemini Omni Flash를 문서화하고 있으며, Gemini Omni 1.1 Flash에 대한 AI Studio 진입점을 제공합니다. 모델 식별자, 지역별 가용성 및 지원되는 기능이 변경될 수 있으므로 워크플로우를 구축하기 전에 Google의 최신 문서를 확인하세요. 모델 이름은 Google 자료에서 더 넓은 Gemini Omni 제품군을 지칭할 수 있으며, Gemini Omni 1.1 Flash는 현재 모델 문서에 명시된 안정적인 API 모델입니다.

주요 제한 사항

Documented limitation

Google은 일부 편집 및 확장 워크플로우에 대해 EEA, 스위스, 영국을 포함한 지역별 제한을 명시하고 있습니다.

Documented limitation

업로드된 비디오 편집 및 확장은 최대 10초의 지원되는 클립으로 제한되며, 확장은 비디오 끝에 추가됩니다.

Documented limitation

Google의 현재 API 가이드는 음성 편집, 오디오 참조, 다중 비디오 워크플로우가 설명된 워크플로우에서 지원되지 않거나 사용할 수 없다고 명시하고 있습니다.

Documented limitation

Gemini Omni Flash 모델 카드는 편집 일관성, 복잡한 동작, 정확한 텍스트 렌더링에 관한 제한 사항을 설명합니다.

Gemini Omni Flash FAQ

Gemini Omni Flash는 텍스트-비디오 모델인가요?

Google은 Gemini Omni Flash에 대한 텍스트-비디오 워크플로우를 문서화하고 있습니다. 현재 모델 페이지에는 API에서 텍스트, 이미지, 비디오 입력과 비디오 출력이 명시되어 있습니다.

안정적인 Gemini Omni Flash API 모델은 무엇인가요?

Google의 현재 모델 문서에는 gemini-omni-1.1-flash가 안정적인 API 모델로, gemini-omni-flash-preview가 프리뷰 모델로 나열되어 있습니다.

Gemini Omni Flash는 비디오를 편집할 수 있나요?

Google은 지원되는 업로드 클립의 편집 및 확장과 상태 저장 대화형 개선을 문서화하고 있습니다. 가용성 및 워크플로우 제한이 적용됩니다.

Story321은 Gemini Omni Flash를 사용하나요?

이 페이지는 정보 제공용 모델 가이드입니다. Gemini Omni Flash가 Story321 비디오 도구를 구동한다고 명시하지 않습니다.

적합한 비디오 워크플로우 선택하기

프로젝트에 Story321의 비디오 도구를 사용하거나, Gemini Omni Flash 자체를 평가할 때 Google의 공식 문서를 검토하세요.

모델 세부 정보는 링크된 공식 출처를 기반으로 하며, Google이 API를 업데이트함에 따라 변경될 수 있습니다.