谷歌与OpenAI在周四同步释放了同一信号:AI的速度已经足以让智能体用户感到惊艳,两家公司各自推出了超快模型。然而,两款产品的发布方式截然不同,目前只有一款对公众开放。

谷歌正式推出Gemini 3.7 Flash,这是其最新针对软件编码和自主业务工作流优化的模型。OpenAI则开放了GPT-5.6 Sol Ultrafast的有限预览,这是一个新的服务层级,以每秒最多750个输出token的速度运行其最强模型。
Gemini 3.7 Flash是正式商用版本,支持最多100万输入token(约75万单词)和6.4万输出token,可处理文本、图像、视频、音频和PDF,并支持工具调用和计算机控制。谷歌将其定位为低成本“大脑”,用于自主系统规划任务、减少人工干预完成多步骤工作。公司表示,该模型并未为了速度牺牲质量,反而同时提升能力和效率——完成测试编码任务仅需2分13秒,而此前的Flash模型耗时超过5分钟,质量差距也相当明显。

OpenAI的Ultrafast并非新模型,而是GPT-5.6 Sol——即发布前用AI红队针对提示注入攻击进行加固的同一模型——在芯片厂商Cerebras提供的更快算力轨道上运行。其速度约为GPT-5.6 Sol标准版的14倍。Cerebras的晶圆级芯片每秒可生成高达750个token(约560个单词),足以让语音智能体在通话中实时思考。
关键数据:谷歌自己的基准表显示,Gemini 3.7 Flash在18个测试类别中的11项上领先于Claude Sonnet 5、GPT-5.6 Terra等模型,其中包括Code Arena网页开发得分1588 Elo,以及企业工作流AutomationBench的30.4%得分。这是基于谷歌自家方法论的测试,所以领先优势只能视为公司单方面声明。

和所有Gemini Flash模型一样,价格十分低廉:年内输入token每百万0.75美元,输出token每百万3.75美元,是Gemini 3.6 Flash原始定价的一半。该优惠价到12月31日截止,之后翻倍至1.5美元和7.5美元——对谷歌模型而言仍然便宜。
OpenAI除客户评价外,尚未公布Ultrafast的直接对比得分。Jane Street AI工程师John Crepezzi在OpenAI公告中表示,Cerebras的速度“让模型使用方式产生了不同”。Podium产品负责人Courtland Lykins称其“在语音技术栈中价值不可估量”,并表示这种速度“彻底改变了通话体验”。该服务目前仅限邀请制。
这轮速度竞赛正值AI实验室从“谁最聪明”转向“谁快到足够支撑智能体”。谷歌的时机很有针对性:旗舰产品Gemini 3.5 Pro仍未发布,且没有公布日期,此时距3.6 Flash发布已过三周,距DeepMind领导层调整(Demis Hassabis被副手Koray Kavukcuoglu取代)仅过去几天。OpenAI则选择租用Cerebras的速度,而非等待自家算力栈。
Gemini 3.7 Flash现已在全球160多个国家上线;GPT-5.6 Sol Ultrafast仍停留在邀请测试阶段。
