Skip to main content
POST
Generate content (Gemini)
Cette page utilise la même opération generateContent que Générer du contenu (Gemini), avec le playground ci-dessus prérempli pour un chat en texte brut. Les notes ci-dessous décrivent les champs multimodaux natifs Gemini que vous pouvez ajouter à contents[].parts pour analyser des images, de l’audio, de la vidéo ou des médias mixtes dans une seule requête.
Chaque part peut transporter des données inline (octets encodés en base64 plus un type MIME) en plus d’instructions textuelles, ce qui permet au modèle de raisonner sur plusieurs modalités en un seul appel.

Champs de requête natifs Gemini

Les champs génériques contents et generationConfig affichés dans le playground acceptent la forme imbriquée suivante pour la reconnaissance multimodale :
Vous pouvez mélanger plusieurs parts dans un même tour, par exemple une part text contenant l’instruction, suivie d’une ou plusieurs parts inlineData contenant les médias à analyser.

Exemple : analyser une image

Champs de réponse

La réponse suit la forme standard generateContent. Les champs les plus pertinents pour la reconnaissance média sont :
array
Réponses candidates renvoyées par le modèle.
object
Métadonnées de comptabilité des tokens, notamment promptTokenCount, candidatesTokenCount et totalTokenCount. Les médias inline (images, audio, vidéo) consomment des tokens de prompt en plus des éventuelles parts textuelles.

Exemple de réponse

200

Autorisations

Authorization
string
header
requis

Your DGrid API key. All endpoints use Authorization: Bearer <DGRID_API_KEY>.

Paramètres de chemin

model
string
requis

Target model ID, such as gemini-1.5-pro.

Corps

application/json
contents
object[]

Input content array with role and parts.

generationConfig
object

Generation configuration.

Réponse

Generated content candidates.

candidates
object[]

Candidate responses returned by the model.

usageMetadata
object

Token accounting metadata.