Skip to main content
POST
Generate content (Gemini)
Esta página usa la misma operación generateContent que Generar contenido (Gemini), con el playground de arriba rellenado previamente para chat de texto plano. Las notas a continuación describen los campos nativos de Gemini que puede agregar a generationConfig para solicitar comprensión o generación de audio con parts estructuradas.
Establezca generationConfig.responseModalities en ["AUDIO"] para solicitar salida de audio y configure generationConfig.speechConfig.voiceConfig.prebuiltVoiceConfig.voiceName para elegir una voz predefinida para el habla generada.

Campos de solicitud nativos de Gemini

Use un modelo con capacidad de texto a voz, como gemini-2.5-flash-preview-tts, en el parámetro de ruta model cuando solicite salida de audio.

Ejemplo: solicitar audio de voz

Campos de respuesta

La respuesta sigue la forma estándar de generateContent. Cuando se solicita salida de audio, las parts devueltas contienen datos de audio inline en lugar de texto:
array
Respuestas candidatas devueltas por el modelo.
object
Contabilidad de tokens, incluido promptTokenCount, candidatesTokenCount y totalTokenCount.
object
Información de bloqueo del prompt cuando corresponda.

Ejemplo de respuesta

200

Autorizaciones

Authorization
string
header
requerido

Your DGrid API key. All endpoints use Authorization: Bearer <DGRID_API_KEY>.

Parámetros de ruta

model
string
requerido

Target model ID, such as gemini-1.5-pro.

Cuerpo

application/json
contents
object[]

Input content array with role and parts.

generationConfig
object

Generation configuration.

Respuesta

Generated content candidates.

candidates
object[]

Candidate responses returned by the model.

usageMetadata
object

Token accounting metadata.