Google 的向量模型,用于将输入内容转换为数值向量,支持语义检索和相似度计算。
SentencePiece (Gemini)Google 的向量模型,用于将输入内容转换为数值向量,支持语义检索和相似度计算。
Pistes pour commencer l’évaluation ; les entrées et options prises en charge figurent dans la section d’accès API.
Vérifiez si le point de terminaison renvoie des embeddings ou reclasse les documents. Utilisez le même prétraitement pour l’indexation et les requêtes.
/v1beta/models/gemini-embedding-001:generateContent| Paramètre | Type | Défaut / plage | Description |
|---|---|---|---|
inputrequis | string | — | Texte ou tableau de textes à vectoriser |
dimensions | integer | >= 1 | Tronquer les vecteurs à autant de dimensions |
encoding_format | enum | = float | Encodage filaire pour les vecteurs |
user | string | — | Identifiant d'utilisateur final pour la surveillance des abus |
Remplacer <YOUR_API_KEY> par la clé API de votre page de jetons.
Toutes les requêtes doivent inclure Authorization: Bearer <TOKEN> . Les points de terminaison au format Anthropic acceptent à la place x-api-key .
Générez des jetons depuis la page Jetons ; vous pouvez les restreindre par modèle, groupe, IP et limites de débit.
| Paramètre | Type | Défaut / plage | Description |
|---|---|---|---|
inputrequis | string | — | Texte ou tableau de textes à vectoriser |
dimensions | integer | >= 1 | Tronquer les vecteurs à autant de dimensions |
encoding_format | enum | = float | Encodage filaire pour les vecteurs |
user | string | — | Identifiant d'utilisateur final pour la surveillance des abus |
| Fournisseur | RPM | TPM | RPD |
|---|---|---|---|
| default | 5.4K | 1.1M | 107K |
| Google AI Studio | 3.4K | 685K | 69K |
| Google Vertex | 3.9K | 772K | 77K |
RPM = requêtes/minute, TPM = jetons/minute, RPD = requêtes/jour. Les limites s'appliquent par groupe de jetons.
Google 的向量模型,用于将输入内容转换为数值向量,支持语义检索和相似度计算。
Créez une clé API autorisée à utiliser gemini-embedding-001, puis utilisez l’identifiant exact et un point de terminaison pris en charge dans la section d’accès API. Les champs dépendent du point de terminaison choisi.
Le tarif dépend du groupe de fournisseurs choisi et de l’unité de facturation du modèle. Les prix actuels d’entrée, de sortie, par requête ou par média sont affichés sur cette page avant l’inscription.
Le catalogue indique une fenêtre de contexte de 2048 tokens. Vérifiez les limites du point de terminaison sélectionné.
Vérifiez si le point de terminaison renvoie des embeddings ou reclasse les documents. Utilisez le même prétraitement pour l’indexation et les requêtes.
