gemini-embedding-2-previewGoogle 的向量模型,用于将输入内容转换为数值向量,支持语义检索和相似度计算。
Google 的向量模型,用于将输入内容转换为数值向量,支持语义检索和相似度计算。
以下内容用于开始评估;支持的输入与选项请查看 API 接入模块。
确认接口返回的是向量还是文档重排结果,并保持建库与查询的预处理方式一致。
/v1beta/models/gemini-embedding-2:generateContent| 参数 | 类型 | 默认值 / 范围 | 说明信息 |
|---|---|---|---|
input必填 | string | — | 需要向量化的文本或文本数组 |
dimensions | integer | >= 1 | 将向量截断到指定维度 |
encoding_format | enum | = float | 向量传输的编码格式 |
user | string | — | 用于风险审计的终端用户标识 |
替换 <YOUR_API_KEY> 替换为令牌设置中的 API Key。
所有请求必须携带 Authorization: Bearer <TOKEN> 请求头。Anthropic 格式的端点也接受 x-api-key 请求头。
在「令牌」页面生成 API Key,可以按模型、分组、IP、速率等维度精细化授权。
| 参数 | 类型 | 默认值 / 范围 | 说明信息 |
|---|---|---|---|
input必填 | string | — | 需要向量化的文本或文本数组 |
dimensions | integer | >= 1 | 将向量截断到指定维度 |
encoding_format | enum | = float | 向量传输的编码格式 |
user | string | — | 用于风险审计的终端用户标识 |
| 供应商 | RPM | TPM | RPD |
|---|---|---|---|
| Google AI Studio | 4.4K | 875K | 88K |
| Google Vertex | 9.1K | 1.8M | 181K |
RPM = 每分钟请求数,TPM = 每分钟 token 数,RPD = 每日请求数。限制按令牌分组生效。
Google 的向量模型,用于将输入内容转换为数值向量,支持语义检索和相似度计算。
创建具有 gemini-embedding-2 访问权限的 API 密钥,然后使用 API 接入模块中的准确模型 ID 和受支持的接口。请求字段取决于所选接口。
费用取决于所选供应商分组和模型计费单位。注册前即可在本页查看当前输入、输出、单次请求或媒体价格。
模型目录配置的上下文窗口为 8192 tokens。具体请求限制请查看所选接口。
确认接口返回的是向量还是文档重排结果,并保持建库与查询的预处理方式一致。
