让 AI 写代码、操作工具或连续完成几步任务时,开发者不仅关心它会不会做,还在意响应速度、价格和服务是否稳定。9 月 2 日,Google 的 Gemini 3.8 Flash 进入 OpenRouter。后者是模型路由平台——它能在 Google AI Studio 和 Google Vertex 两家服务商之间分配请求,并在一方出错时尝试切换。Google 称,新版相较 3.7 Flash,在软件工程、Agent 任务(让模型调用工具并分步办事)和多步推理上有显著提升;材料未给出具体评测成绩。
更值得 API(软件接入模型的统一入口)开发者留意的是同步出现的批处理版本。批处理会把不急着返回的大量任务集中排队执行,适合离线分析或数据标注;其每百万输入、输出 token(模型切分文字后的基本单位)价格分别为 0.375 和 1.875 美元,正好是普通入口 0.75 和 3.75 美元的一半。两个入口均提供约 104.9 万 token 的上下文窗口,可接收文本、图片、视频、PDF 和音频,并支持工具调用与结构化输出。