Skip to main content
POST
Generate content (Gemini)
本頁使用與 生成內容(Gemini) 相同的 generateContent 操作,上方 playground 已預先填入純文字對話範例。以下說明可加入 generationConfig 的 Gemini 原生欄位,以便透過結構化 parts 請求音訊理解或音訊生成。
請將 generationConfig.responseModalities 設為 ["AUDIO"] 以要求音訊輸出,並設定 generationConfig.speechConfig.voiceConfig.prebuiltVoiceConfig.voiceName 來選擇生成語音時要使用的預建聲音。

Gemini 原生請求欄位

當你需要音訊輸出時,請在 model 路徑參數中使用具備文字轉語音能力的模型,例如 gemini-2.5-flash-preview-tts

範例:請求語音音訊

回應欄位

回應遵循標準 generateContent 結構。當要求音訊輸出時,回傳的 parts 會包含內嵌音訊資料而非文字:
array
模型回傳的候選回應。
object
Token 計量資訊,包括 promptTokenCountcandidatesTokenCounttotalTokenCount
object
在適用情況下的 prompt 阻擋回饋資訊。

回應範例

200

授權

Authorization
string
header
必填

Your DGrid API key. All endpoints use Authorization: Bearer <DGRID_API_KEY>.

路徑參數

model
string
必填

Target model ID, such as gemini-1.5-pro.

主體

application/json
contents
object[]

Input content array with role and parts.

generationConfig
object

Generation configuration.

回應

Generated content candidates.

candidates
object[]

Candidate responses returned by the model.

usageMetadata
object

Token accounting metadata.