Gemini

gemini-2.5-flash-lite

Googleトークンベース
APIキーを作成

Google 的 gemini-2.5-flash-lite 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。

textimageaudiovideofilecachingcode_interpreterfunction_callingtoolsweb_searchstructured_outputjson_modereasoningvisioncontext:1048576
最低料金
入力 / 出力 · 1M
コンテキスト
1M
最大入力ウィンドウ
最大出力
65.5K
1 回の応答あたりの最大トークン数
モダリティ
→
知識のカットオフ
Jan 2025
公開日
Jul 2025

サプライヤー別料金

Google AI Studio
-70%
谷歌官方接口
入力$0.1$0.03/ 1M
出力$0.4$0.12/ 1M
キャッシュ読み取り$0.01$0.003/ 1M
Google Vertex
-50%
谷歌官方接口
入力$0.1$0.05/ 1M
出力$0.4$0.2/ 1M
キャッシュ読み取り$0.01$0.005/ 1M

機能 / サポートされるモダリティ

プロンプトキャッシュコードインタプリタ関数呼び出しツールウェブ検索構造化出力JSON モード理由ビジョン
入力
出力

プロバイダーとデータ保護

プロバイダー
トークナイザー
SentencePiece (Gemini)
ライセンス
Proprietary (commercial)プロプライエタリ
データ保持42 日デフォルトで上流の学習には使用されません

パフォーマンス

gemini-2.5-flash-lite について

Google 的 gemini-2.5-flash-lite 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。

使用例とプロンプト

評価を始めるためのヒントです。対応する入力とオプションは API アクセス欄を参照してください。

検討できる使用例

  • 読者、文体、形式を明確にして文章を作成・修正します。
  • 提供された文書を要約し、回答を原文と照合します。

実用的なヒント

指示と資料を分け、期待する出力と例を示してください。ツール使用や構造化出力は対応が明記されている場合のみ試します。

プロンプト例

次の文書を五つの要点にまとめてください。確認済みの事実と未解決の質問を分け、関連箇所を引用し、不明な情報を創作しないでください。文書:[テキストを貼り付け]

API を利用

コードサンプル

リクエストPOST/v1beta/models/gemini-2.5-flash-lite:generateContent
リクエスト例
パラメータ
パラメータタイプデフォルト / 範囲説明
temperature
number
=10 ~ 2
サンプリング温度。低いほど決定論的になります
top_p
number
=10 ~ 1
核サンプリングの累積確率
max_tokens
integer>= 1レスポンスの最大トークン数
frequency_penalty
number
=0-2 ~ 2
頻出トークンの繰り返しを抑制します
presence_penalty
number
=0-2 ~ 2
新しい話題への展開を促進します
stop
array—生成を停止する文字列を最大 4 個まで
seed
integer—可能な限り再現性のあるサンプリングシード
n
integer
=1>= 1
生成する候補数
stream
boolean
=false
Server-Sent Events でトークンをストリーミング
response_format
object—JSON オブジェクトまたはスキーマ準拠の出力を強制します
tools
array—モデルが呼び出せるツール / 関数の宣言
tool_choice
string
autononerequired
ツール選択ポリシーまたは具体的なツール名
logprobs
boolean
=false
トークンごとの対数確率を返します
top_logprobs
integer0 ~ 20トークンごとに返される上位対数確率の数
logit_bias
object—トークンごとの logit バイアス
user
string—悪用検知用のエンドユーザー識別子

置換 <YOUR_API_KEY> をトークン設定の API キーに置き換えてください。

認証

すべてのリクエストには Authorization: Bearer <TOKEN> ヘッダーが必要です。Anthropic 形式のエンドポイントでは x-api-key ヘッダーも利用できます。

トークンページから API キーを発行できます。モデル、グループ、IP、レート制限ごとに細かく権限を設定可能です。

対応パラメータ

Generation parameters
パラメータタイプデフォルト / 範囲説明
temperature
number
=10 ~ 2
サンプリング温度。低いほど決定論的になります
top_p
number
=10 ~ 1
核サンプリングの累積確率
max_tokens
integer>= 1レスポンスの最大トークン数
frequency_penalty
number
=0-2 ~ 2
頻出トークンの繰り返しを抑制します
presence_penalty
number
=0-2 ~ 2
新しい話題への展開を促進します
stop
array—生成を停止する文字列を最大 4 個まで
seed
integer—可能な限り再現性のあるサンプリングシード
n
integer
=1>= 1
生成する候補数
stream
boolean
=false
Server-Sent Events でトークンをストリーミング
response_format
object—JSON オブジェクトまたはスキーマ準拠の出力を強制します
tools
array—モデルが呼び出せるツール / 関数の宣言
tool_choice
string
autononerequired
ツール選択ポリシーまたは具体的なツール名
logprobs
boolean
=false
トークンごとの対数確率を返します
top_logprobs
integer0 ~ 20トークンごとに返される上位対数確率の数
logit_bias
object—トークンごとの logit バイアス
user
string—悪用検知用のエンドユーザー識別子

レート制限

サプライヤーRPMTPMRPD
Google AI Studio480191K9.5K
Google Vertex870350K18K

RPM = 1 分あたりリクエスト数、TPM = 1 分あたりトークン数、RPD = 1 日あたりリクエスト数。制限はトークングループ単位で適用されます。

gemini-2.5-flash-lite に関するよくある質問

gemini-2.5-flash-lite とは?

Google 的 gemini-2.5-flash-lite 模型,支持文本、图像、音频、视频、文件输入和文本输出。支持推理、工具调用、结构化输出。

gemini-2.5-flash-lite を呼び出すには?

gemini-2.5-flash-lite へのアクセス権がある API キーを作成し、API アクセス欄の正確なモデル ID と対応エンドポイントを使用してください。リクエスト項目は選択したエンドポイントによって異なります。

gemini-2.5-flash-lite の料金体系は?

料金は選択したプロバイダーグループとモデルの課金単位で決まります。現在の入力、出力、リクエスト、またはメディア料金は登録前にこのページで確認できます。

gemini-2.5-flash-lite のコンテキストウィンドウは?

モデルカタログには 1048576 トークンのコンテキストウィンドウが設定されています。リクエスト制限は選択したエンドポイントで確認してください。

gemini-2.5-flash-lite の最大出力は?

モデルカタログには最大 65536 トークンの出力が設定されています。リクエスト設定でさらに低い上限を指定する場合があります。

自分のプロジェクトに gemini-2.5-flash-lite が適しているか評価するには?

指示と資料を分け、期待する出力と例を示してください。ツール使用や構造化出力は対応が明記されている場合のみ試します。