谷歌Gemini 3.8 Flash即将发布,AI进化再升级
新智元消息,Claude 5.1刚发布,OpenAI的Astra紧随其后,谷歌也对此做出了回应。最新消息显示,Gemini 3.8 Flash将在明日亮相,AI领域又将迎来一轮热潮。虽然Gemini 3.5 Pro未如预期上线,但许多人更关注的是其发布时间。遗憾的是,谷歌已决定放弃Gemini 3.5 Pro。自今年5月的I/O大会以来,已有近四个月时间,而Gemini 3.5 Pro的进展堪忧,让谷歌不得不将其搁置。而相对而言,Gemini 4.0目前在预训练中表现良好,后续进展也在顺利进行。
据WSJ独家报道,Gemini 3.8 Flash(代号「Skimaki」)在编程能力方面表现出色。在谷歌内部进行的编码工具Jetski的测试中,3.8 Flash的表现明显超越了Opus模型。该模型的研发始于几个月前,早于谷歌高层的重大变动。虽然Hassabis与首席科学家Jeff Dean相继辞职让外界对Gemini的未来感到担忧,但内部进展依然稳定。谷歌选择优先发布Gemini 3.8 Flash,主要是因为其参数较少,计算需求更低,便于迅速取得成果。有内部人士透露,从今年初以来,谷歌投入了更多资源,专注于提升Gemini的编程能力,尤其是在“强化学习”方面,希望通过试错方式让AI掌握新技能。同时,谷歌DeepMind和其他实验室在推进多个项目,即使某个项目受阻,其他项目还能支持。
虽然Gemini 3.5 Pro未及预期,Gemini 4.0尚未揭晓,而OpenAI和Anthropic在前沿模型和编程代理的竞争中表现出色。信息称OpenAI的下一代Astra将采用一种新型推理方式“循环深度”,提高了性能。谷歌在劈柴承诺后,除了发布3.7 Flash,一直未推出能引发关注的新模型。或许就在今晚,Gemini 3.8 Flash将正式亮相。 球友会登录
在发布前,谷歌对Gemini进行了预热,新增了智能视频理解能力。通过上传一段I/O大会的视频,模型Gemini 3.7 Flash的Token消耗显著降低了88%。据谷歌官方消息,Gemini的3.7 Flash、3.6 Flash、3.5 Flash-Lite都具备该能力,并可在Google AI Studio和Gemini Enterprise Agent Platform上使用。开启此功能后,标准视频分析的Token消耗最多减少88%,分析成本降低66%,而准确率则提高了7%。令人欣慰的是,谷歌并未对这项功能另行收费。
Gemini的这一突破使其具备了“动态处理”能力,过去模型被动接受固定帧率的视频流,而现在它能够自主选择内容和速度。此举使得在视频理解上,模型做到了前所未有的进步。官方博客列举了多个高难度应用场景,比如亚秒级片段检索、长视频中的快速信息提取及异常检测等。这一系列新功能使得视频处理的精确度得到了显著提升,为今后的应用带来了更大的可能性。