Google和OpenAI同日发布超快AI模型,分别推出了Gemini 3.7 Flash和GPT-5.6 Sol Ultrafast,旨在提升AI代理的响应速度。Google的模型现已全面上线,而OpenAI的版本仅限邀请。
Google发布的Gemini 3.7 Flash是一款通用模型,支持多达100万输入token(约75万单词),可处理文本、图像、视频、音频和PDF,并能调用工具和控制计算机。Google将其定位为自主系统的大脑,可在较少人工干预下完成多步骤任务。该模型在编码测试中仅用2分13秒,而上一代Flash需要5分钟以上,质量也有明显提升。
OpenAI的Ultrafast并非新模型,而是基于GPT-5.6 Sol,通过与芯片公司Cerebras合作,将速度提升约14倍,达到每秒750个token(约560个单词)。该速度足以让语音代理在通话中实时思考。Cerebras的晶圆级芯片提供了这一性能。
在基准测试中,Google声称Gemini 3.7 Flash在18项测试中11项领先,包括Code Arena网页开发得分1588 Elo和AutomationBench企业工作流30.4%。价格方面,Gemini 3.7 Flash每百万输入token仅0.75美元,输出token 3.75美元,年底前为半价,之后翻倍但仍具竞争力。OpenAI未公布Ultrafast的对比数据,但客户反馈极佳,Jane Street的AI工程师称速度“开启了不同的使用方式”。
此次速度竞赛正值AI实验室从“谁更聪明”转向“谁足够快”的阶段。Google的Gemini 3.5 Pro仍缺席,DeepMind领导层也进行了调整。而OpenAI则借助Cerebras的芯片加速。目前,Gemini 3.7 Flash已在160多个国家上线,GPT-5.6 Sol Ultrafast仍仅限邀请。
