マーケットサポート← アプリに戻る

Gemini Omni

Gemini Omni モデルは統一された非同期ジョブ API で呼び出します。POST /api/generate でタスクを開始し、完了するまで GET /api/generate/{taskId} をポーリングします。このファミリーは 3 個のエンドポイントを提供します。

概要

すべてのエンドポイントは同じ外枠を共有し、変わるのは modelinput フィールドだけです。モデルマーケットの playground から任意に実行できます。

認証

/api-keys で API キーを作成し、Bearer トークンとして送信します。ログイン中のブラウザからのリクエストはセッション cookie 経由でも動作します。

Authorization: Bearer <YOUR_API_KEY>

タスクの作成

POST
POST https://api.lithovas.com/api/generate

ボディ:{ "model": "<slug>", "input": { … } }

レスポンス:{ "taskId": "<id>", "state": "waiting" }

結果の照会

GET
GET https://api.lithovas.com/api/generate/<taskId>

レスポンス:{ "taskId", "state": "waiting" | "success" | "fail", "resultUrls": [ … ], "creditsConsumed", "failMsg", "balance" }

非同期
タスク作成の 200 は、タスクが受理されたことを意味するだけで、完了ではありません。statesuccess または fail になるまでこのエンドポイントをポーリングしてください。失敗したタスクは課金されません。

エンドポイント

モデルタスクmodel slug
Gemini Omni VideoText to Videogemini-omni-video
Gemini Omni AudioText to Speechgemini-omni-audio
Gemini Omni CharacterChatgemini-omni-character

Gemini Omni Video · Text to Video

POSTText to Videogemini-omni-video
input フィールド
promptstring必須

Video prompt describing content, style, camera language, or actions

image_urlsarray<string>任意

Array of reference image URLs (max 7, each <=20MB)

audio_idsarray<string>任意

Audio IDs from gemini-omni-audio for narration/dialogue (max 3)

video_listarray<object>任意

Source video clips with trim ranges (max 1, <=100MB, <=30s)

character_idsarray<string>任意

Character IDs from gemini-omni-character API (max 3)

durationenum<string>任意

Generated video duration in seconds

aspect_ratioenum<string>任意

Video aspect ratio (16:9 landscape, 9:16 portrait)

seedinteger任意

Random seed [0, 2147483647] for reproducibility

resolutionenum<string>任意

Output video resolution

cURL
curl -X POST https://api.lithovas.com/api/generate \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-omni-video",
  "input": {
    "prompt": "A cinematic red panda surfing through neon rain at dusk.",
    "image_urls": [
      "https://example.com/input.jpg"
    ],
    "audio_ids": [
      "https://example.com/reference.mp3"
    ],
    "video_list": [],
    "character_ids": [
      "https://example.com/file"
    ],
    "duration": "4",
    "aspect_ratio": "16:9",
    "seed": 42,
    "resolution": "720p"
  }
}'

Gemini Omni Audio · Text to Speech

POSTText to Speechgemini-omni-audio
input フィールド
audio_idenum<string>必須

Voice character preset selection

namestring必須

Voice identifier (max 210 characters)

voice_descriptionstring任意

Timbre, style, rate, emotion characteristics (max 20000 chars)

example_dialoguestring任意

Sample speech utterance for voice preview (max 120 chars)

cURL
curl -X POST https://api.lithovas.com/api/generate \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-omni-audio",
  "input": {
    "audio_id": "achernar",
    "name": "example",
    "voice_description": "example",
    "example_dialogue": "example"
  }
}'

Gemini Omni Character · Chat

POSTChatgemini-omni-character
input フィールド
descriptionsstring必須

Character appearance, identity, style, clothing, or personality

image_urlsarray<string>必須

Array of character reference image URLs (max 1, <=20MB each)

audio_idsarray<string>任意

Audio IDs from gemini-omni-audio for voice traits/persona

character_namestring任意

Character name

cURL
curl -X POST https://api.lithovas.com/api/generate \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-omni-character",
  "input": {
    "descriptions": "example",
    "image_urls": [
      "https://example.com/input.jpg"
    ],
    "audio_ids": [
      "https://example.com/reference.mp3"
    ],
    "character_name": "example"
  }
}'