Gemini

gemini-embedding-2

Google按量计费
别名:gemini-embedding-2-preview

Google 的向量模型,用于将输入内容转换为数值向量,支持语义检索和相似度计算。

textimageaudiovideofileembeddingscontext:8192
起始价格
输入 / 输出 · 1M
上下文
8.2K
最大输入窗口
模态
→
发布于
Apr 2026

按供应商定价

Google AI Studio
省70%
谷歌官方接口
输入$0.2$0.06/ 1M
输出$0.8$0.24/ 1M
图片$0.45$0.135/ 1M
音频输入$6.5$1.95/ 1M
Google Vertex
省50%
谷歌官方接口
输入$0.2$0.1/ 1M
输出$0.8$0.4/ 1M
图片$0.45$0.225/ 1M
音频输入$6.5$3.25/ 1M

能力 / 支持的模态

嵌入
输入
输出

厂商与数据隐私

厂商
Google文档
分词器
SentencePiece (Gemini)
许可证
Proprietary (commercial)商业闭源
数据保留72 天默认不会用于上游训练

性能

关于 gemini-embedding-2

Google 的向量模型,用于将输入内容转换为数值向量,支持语义检索和相似度计算。

使用场景与提示词

以下内容用于开始评估;支持的输入与选项请查看 API 接入模块。

可探索的使用场景

  • 使用有代表性的查询和文档评估语义搜索效果。
  • 在接入下游助手前,先用自己的知识库比较检索质量。

实用建议

确认接口返回的是向量还是文档重排结果,并保持建库与查询的预处理方式一致。

接入 API

调用示例

请求POST/v1beta/models/gemini-embedding-2:generateContent
请求示例
参数
参数类型默认值 / 范围说明信息
input必填
string—需要向量化的文本或文本数组
dimensions
integer>= 1将向量截断到指定维度
encoding_format
enum
=float
向量传输的编码格式
user
string—用于风险审计的终端用户标识

替换 <YOUR_API_KEY> 替换为令牌设置中的 API Key。

身份验证

所有请求必须携带 Authorization: Bearer <TOKEN> 请求头。Anthropic 格式的端点也接受 x-api-key 请求头。

在「令牌」页面生成 API Key,可以按模型、分组、IP、速率等维度精细化授权。

支持的参数

Generation parameters
参数类型默认值 / 范围说明信息
input必填
string—需要向量化的文本或文本数组
dimensions
integer>= 1将向量截断到指定维度
encoding_format
enum
=float
向量传输的编码格式
user
string—用于风险审计的终端用户标识

速率限制

供应商RPMTPMRPD
Google AI Studio4.4K875K88K
Google Vertex9.1K1.8M181K

RPM = 每分钟请求数,TPM = 每分钟 token 数,RPD = 每日请求数。限制按令牌分组生效。

关于 gemini-embedding-2 的常见问题

gemini-embedding-2 是什么?

Google 的向量模型,用于将输入内容转换为数值向量,支持语义检索和相似度计算。

如何调用 gemini-embedding-2?

创建具有 gemini-embedding-2 访问权限的 API 密钥,然后使用 API 接入模块中的准确模型 ID 和受支持的接口。请求字段取决于所选接口。

gemini-embedding-2 如何计费?

费用取决于所选供应商分组和模型计费单位。注册前即可在本页查看当前输入、输出、单次请求或媒体价格。

gemini-embedding-2 的上下文窗口有多大?

模型目录配置的上下文窗口为 8192 tokens。具体请求限制请查看所选接口。

如何评估 gemini-embedding-2 是否适合我的项目?

确认接口返回的是向量还是文档重排结果,并保持建库与查询的预处理方式一致。