Gemini

gemini-embedding-001

GoogleBasé sur les jetons

Google 的向量模型,用于将输入内容转换为数值向量,支持语义检索和相似度计算。

textembeddingscontext:2048
Tarif à partir de
Entree / Sortie · 1M
Contexte
2K
Fenêtre d'entrée maximale
Modalités
→
Sorti
Jul 2025

Tarification par fournisseur

Google AI Studio
-70%
谷歌官方接口
Entree$0.15$0.045/ 1M
Sortie$0.15$0.045/ 1M
Google Vertex
-50%
谷歌官方接口
Entree$0.15$0.075/ 1M
Sortie$0.15$0.075/ 1M

Capacités / Modalités prises en charge

Embeddings
Entree
Sortie

Fournisseur & confidentialité

Fournisseur
GoogleDocuments
Tokeniseur
SentencePiece (Gemini)
Licence
Proprietary (commercial)Propriétaire
Rétention des données13 joursNon utilisé pour l'entraînement amont par défaut

Performances

À propos de gemini-embedding-001

Google 的向量模型,用于将输入内容转换为数值向量,支持语义检索和相似度计算。

Cas d’usage et prompts

Pistes pour commencer l’évaluation ; les entrées et options prises en charge figurent dans la section d’accès API.

Cas d’usage à explorer

  • Évaluez la recherche sémantique avec des requêtes et des documents représentatifs.
  • Comparez la qualité de recherche sur votre propre base de connaissances avant de connecter un assistant.

Conseils pratiques

Vérifiez si le point de terminaison renvoie des embeddings ou reclasse les documents. Utilisez le même prétraitement pour l’indexation et les requêtes.

Accès API

Exemples de code

RequêtePOST/v1beta/models/gemini-embedding-001:generateContent
Exemple de requête
Paramètres
ParamètreTypeDéfaut / plageDescription
inputrequis
string—Texte ou tableau de textes à vectoriser
dimensions
integer>= 1Tronquer les vecteurs à autant de dimensions
encoding_format
enum
=float
Encodage filaire pour les vecteurs
user
string—Identifiant d'utilisateur final pour la surveillance des abus

Remplacer <YOUR_API_KEY> par la clé API de votre page de jetons.

Authentification

Toutes les requêtes doivent inclure Authorization: Bearer <TOKEN> . Les points de terminaison au format Anthropic acceptent à la place x-api-key .

Générez des jetons depuis la page Jetons ; vous pouvez les restreindre par modèle, groupe, IP et limites de débit.

Paramètres pris en charge

Generation parameters
ParamètreTypeDéfaut / plageDescription
inputrequis
string—Texte ou tableau de textes à vectoriser
dimensions
integer>= 1Tronquer les vecteurs à autant de dimensions
encoding_format
enum
=float
Encodage filaire pour les vecteurs
user
string—Identifiant d'utilisateur final pour la surveillance des abus

Limites de débit

FournisseurRPMTPMRPD
Google AI Studio3.4K685K69K
Google Vertex3.9K772K77K

RPM = requêtes/minute, TPM = jetons/minute, RPD = requêtes/jour. Les limites s'appliquent par groupe de jetons.

Questions fréquentes sur gemini-embedding-001

Qu’est-ce que gemini-embedding-001 ?

Google 的向量模型,用于将输入内容转换为数值向量,支持语义检索和相似度计算。

Comment appeler gemini-embedding-001 ?

Créez une clé API autorisée à utiliser gemini-embedding-001, puis utilisez l’identifiant exact et un point de terminaison pris en charge dans la section d’accès API. Les champs dépendent du point de terminaison choisi.

Comment gemini-embedding-001 est-il facturé ?

Le tarif dépend du groupe de fournisseurs choisi et de l’unité de facturation du modèle. Les prix actuels d’entrée, de sortie, par requête ou par média sont affichés sur cette page avant l’inscription.

Quelle est la fenêtre de contexte de gemini-embedding-001 ?

Le catalogue indique une fenêtre de contexte de 2048 tokens. Vérifiez les limites du point de terminaison sélectionné.

Comment évaluer gemini-embedding-001 pour mon projet ?

Vérifiez si le point de terminaison renvoie des embeddings ou reclasse les documents. Utilisez le même prétraitement pour l’indexation et les requêtes.