跳到正文
价格
Google

Gemini 3.8 Flash API

Gemini 3.8 Flash 面向代码与长流程智能体任务。本页展示 NewRouters 实时价格、当前配置的限制及原生 Gemini API 请求。

输入 / 输出
文本文本
可用
输入 / 输出价格80% OFF
$0.15/ 1M
/
$0.75/ 1M
美元 / 百万 Token
缓存输入
$0.015/ 1M
平台价格 · USD
上下文窗口
128,000tokens
最大输出:16,384 tokens

API 调用示例

API 文档 ↗
POST获取 API Key ↗
curl 'https://newrouters.com/v1beta/models/gemini-3.8-flash:generateContent' \
  -H "Content-Type: application/json" \
  -H "x-goog-api-key: $MODEL_API_KEY" \
  --data '{
  "contents": [
    {
      "role": "user",
      "parts": [
        {
          "text": "用三个简明步骤解释 HTTP 请求的工作过程。"
        }
      ]
    }
  ],
  "generationConfig": {
    "maxOutputTokens": 1024
  }
}'

在服务端环境变量中设置 MODEL_API_KEY,使用此模型的原生 API,费用按账号价格结算。

文档:鉴权与 Key · 错误处理

Gemini 3.8 Flash 价格

先估算一次请求的费用,再选择适合工作流的预算。

用量数量单价费用
tokens$0.15/ 1M$0.00015
tokens$0.015/ 1M$0
tokens$0.75/ 1M$0.000375
tokens$0.75/ 1M$0
每次请求费用$0.000525

按公开美元价格估算,实际费用以账号价格与最终用量回执为准。

模型价格明细
规格平台价格官方参考
输入$0.15 / 百万 Token$0.75 相比官方约省 80%
缓存输入$0.015 / 百万 Token$0.075 相比官方约省 80%
输出$0.75 / 百万 Token$3.75 相比官方约省 80%
推理$0.75 / 百万 Token$3.75 相比官方约省 80%

Gemini 3.8 Flash API · 使用示例

从一个清晰的任务开始。以下为请求示例,可复制后用于你的 API 调用。

解释与问答

向刚开始学习编程的人解释 HTTP 请求与响应,用三个步骤和一个简单例子说明。

USER MESSAGE
01

把复杂概念讲清楚

给出读者背景、回答长度和期望结构,让模型围绕明确的问题组织回答。

代码与开发

用 TypeScript 编写一个带指数退避的异步重试函数,说明适合重试的错误,并给出调用示例。

USER MESSAGE
02

从需求到代码

描述语言、输入输出和边界条件,把代码生成与解释放进同一次请求。

整理与规划

为一个三人团队制定两周的产品原型计划,按日期列出目标、交付物与需要确认的问题。

USER MESSAGE
03

让信息更有条理

提供任务背景和具体约束,将材料整理为便于阅读和继续使用的结构。

Gemini 3.8 Flash 是什么?

Gemini 3.8 Flash 面向代码与长流程智能体任务。本页展示 NewRouters 实时价格、当前配置的限制及原生 Gemini API 请求。

使用下方的模型 ID 与支持的原生端点发起请求。通过系统指令定义任务与回答方式,通过消息传递上下文;接入应用时,可根据模型的能力与 Token 上限配置请求。

Gemini 3.8 Flash 规格

规格Gemini 3.8 Flash
模型 IDgemini-3.8-flash
模型厂商Google
调用接口/v1beta/models/{model}:generateContent · /v1beta/models/{model}:streamGenerateContent · /v1/interactions · /v1beta/interactions
上下文上限128,000 tokens
最大输出16,384 tokens
当前声明能力参见当前原生接口契约
协议与能力详情

协议与能力

gemini · gemini-3.8-flash

上下文上限
128000
最大输出
16384

Gemini 3.8 Flash 与同类模型对比

规格Gemini 3.8 FlashGemini 3.1 Pro PreviewGemini 3.7 Flash
厂商GoogleGoogleGoogle
输入 → 输出文本文本文本文本文本文本
选择依据当前模型同为 gemini 协议 · 计费单位一致同为 gemini 协议 · 计费单位一致
上下文 / 最大输出128,000 / 16,384128,000 / 16,384128,000 / 16,384
起始价格$0.15 / 百万 Token$0.4 / 百万 Token$0.15 / 百万 Token

根据工作流需要的输入类型、输出规格和计费单位选择模型。使用同一提示词进行试用,可以更直接地比较模型在你实际场景中的表现。

将 Gemini 3.8 Flash 接入你的应用

保留原生请求格式,将 API 地址切换到平台入口。准备一个有模型访问权限的 Key,并在调用记录中核对状态与费用。

查看接入示例

Gemini 3.8 Flash API · 常见问题

了解 API 接入、Token 计费与模型能力。

Gemini 3.8 Flash 如何计费?

费用由实际 Token 用量与账号价格决定。输入、输出,以及支持的缓存或推理计费项分别列在价格表中。计算器按公开美元价格估算,最终费用以调用回执为准。

如何获取 API Key?

点击“获取 API Key”打开接入指南,登录 NewRouters 账号,准备有权访问此模型的 Key,再复制 API 示例。

可以使用哪些 API 端点?

支持的端点:/v1beta/models/{model}:generateContent、/v1beta/models/{model}:streamGenerateContent、/v1/interactions、/v1beta/interactions。可在 API 示例中切换端点,查看对应的原生请求格式。

支持流式输出吗?

当前路由未声明流式能力,请使用该 API 支持的响应格式。

支持工具调用和结构化输出吗?

工具调用:未声明;结构化输出:未声明。具体请求字段以所选原生端点为准。

在哪里查看用量与费用?

保留请求 ID,在账号的 LLM 调用记录中查看状态、Token 用量和扣费。调用记录不作为提示词和回答的对话存档。

探索 LLM 的应用场景

全部 LLM 模型 ↗

接入主题 / 开发文档

全部文档 ↗