Gemini Omni
Gemini Omni モデルは統一された非同期ジョブ API で呼び出します。POST /api/generate でタスクを開始し、完了するまで GET /api/generate/{taskId} をポーリングします。このファミリーは 3 個のエンドポイントを提供します。
概要
すべてのエンドポイントは同じ外枠を共有し、変わるのは model と input フィールドだけです。モデルマーケットの playground から任意に実行できます。
認証
/api-keys で API キーを作成し、Bearer トークンとして送信します。ログイン中のブラウザからのリクエストはセッション cookie 経由でも動作します。
Authorization: Bearer <YOUR_API_KEY>タスクの作成
POST https://api.lithovas.com/api/generateボディ:{ "model": "<slug>", "input": { … } }
レスポンス:{ "taskId": "<id>", "state": "waiting" }
結果の照会
GET https://api.lithovas.com/api/generate/<taskId>レスポンス:{ "taskId", "state": "waiting" | "success" | "fail", "resultUrls": [ … ], "creditsConsumed", "failMsg", "balance" }
state が success または fail になるまでこのエンドポイントをポーリングしてください。失敗したタスクは課金されません。エンドポイント
| モデル | タスク | model slug |
|---|---|---|
| Gemini Omni Video | Text to Video | gemini-omni-video |
| Gemini Omni Audio | Text to Speech | gemini-omni-audio |
| Gemini Omni Character | Chat | gemini-omni-character |
Gemini Omni Video · Text to Video
gemini-omni-videopromptstring必須Video prompt describing content, style, camera language, or actions
image_urlsarray<string>任意Array of reference image URLs (max 7, each <=20MB)
audio_idsarray<string>任意Audio IDs from gemini-omni-audio for narration/dialogue (max 3)
video_listarray<object>任意Source video clips with trim ranges (max 1, <=100MB, <=30s)
character_idsarray<string>任意Character IDs from gemini-omni-character API (max 3)
durationenum<string>任意Generated video duration in seconds
aspect_ratioenum<string>任意Video aspect ratio (16:9 landscape, 9:16 portrait)
seedinteger任意Random seed [0, 2147483647] for reproducibility
resolutionenum<string>任意Output video resolution
curl -X POST https://api.lithovas.com/api/generate \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-omni-video",
"input": {
"prompt": "A cinematic red panda surfing through neon rain at dusk.",
"image_urls": [
"https://example.com/input.jpg"
],
"audio_ids": [
"https://example.com/reference.mp3"
],
"video_list": [],
"character_ids": [
"https://example.com/file"
],
"duration": "4",
"aspect_ratio": "16:9",
"seed": 42,
"resolution": "720p"
}
}'Gemini Omni Audio · Text to Speech
gemini-omni-audioaudio_idenum<string>必須Voice character preset selection
namestring必須Voice identifier (max 210 characters)
voice_descriptionstring任意Timbre, style, rate, emotion characteristics (max 20000 chars)
example_dialoguestring任意Sample speech utterance for voice preview (max 120 chars)
curl -X POST https://api.lithovas.com/api/generate \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-omni-audio",
"input": {
"audio_id": "achernar",
"name": "example",
"voice_description": "example",
"example_dialogue": "example"
}
}'Gemini Omni Character · Chat
gemini-omni-characterdescriptionsstring必須Character appearance, identity, style, clothing, or personality
image_urlsarray<string>必須Array of character reference image URLs (max 1, <=20MB each)
audio_idsarray<string>任意Audio IDs from gemini-omni-audio for voice traits/persona
character_namestring任意Character name
curl -X POST https://api.lithovas.com/api/generate \
-H "Authorization: Bearer $API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-omni-character",
"input": {
"descriptions": "example",
"image_urls": [
"https://example.com/input.jpg"
],
"audio_ids": [
"https://example.com/reference.mp3"
],
"character_name": "example"
}
}'