Loading...

谷歌Gemini 3.8即将发布,引发关注

2026-09-03

新智元报道,随着Claude 5.1的推出,OpenAI的新型Astra紧随其后,谷歌也不甘落后,最新消息显示Gemini 3.8 Flash将于明天正式发布。这无疑为AI行业注入了新的活力。虽然许多人对Gemini 3.5 Pro的上市时间更加期待,但谷歌已经决定放弃该版本。今年5月的I/O大会后,过去了近四个月,Gemini 3.5 Pro的进展甚至连Flash版本都无法与之媲美,因此谷歌已选择将其搁置。值得庆幸的是,Gemini 4.0在预训练阶段表现良好,后续训练也顺利进行。根据华尔街日报的独家消息,Gemini 3.8 Flash(代号“Skimaki”)在编程能力上展现了强大的潜力,其在谷歌内部编码工具Jetski的测试中,显示出显著优于Opus模型的性能。而这一模型早在谷歌高层“大地震”前就已经开始研发。尽管Hassabis的离任及首席科学家Jeff Dean的辞职让人对Gemini的未来充满疑虑,但眼下的进展似乎仍在有序推进。

谷歌选择率先推出Gemini 3.8 Flash,是因为该模型的参数较小,计算需求较低,易于获得成果。业内人士透露,从今年初开始,谷歌便加大人力与计算资源,专注于提升Gemini的编程能力,尤其是在“强化学习”领域,使得AI通过不断尝试真正掌握新技能。同时,谷歌DeepMind及其他实验室也在并行推动多个项目,确保即使一个项目遇到障碍,其他项目依然可以继续进展。尽管Gemini 3.5 Pro未达到预期表现,但Gemini 4.0仍在研发中。如今,硅谷的OpenAI和Anthropic在前沿模型和编程Agent方向表现突出,OpenAI即将推出的Astra则采用了一种全新的“循环深度”推理方法,旨在减少处理token的同时提升性能,此重磅消息将于本周揭晓。在这种背景下,谷歌显然需要交出新的成果。经过几个月的承诺,仅发布了一款3.7 Flash的情况下,Gemini 3.8 Flash的发布将是至关重要的。

此外,谷歌今天先行为Gemini预热,推出名为智能体视频理解的新功能,极大提升了处理视频的效率。上传一段I/O大会的视频后,使用Gemini 3.7 Flash的token消耗量骤减88%。谷歌在官方博客中指出,Gemini 3.7 Flash、3.6 Flash以及3.5 Flash-Lite这三款模型均具备这一能力,其中,用户可通过Google AI Studio和Gemini Enterprise Agent Platform来访问。开启这一功能后,标准视频分析基准中的token使用量最多减少88%,分析成本降低最多66%,准确率却提高了最高7%。这一切无需额外费用,仍按照标准API的token定价运行。

过去的处理方式是“静态”处理,模型只能被动地接受固定帧率的视频输入,而如今,Gemini具备了主动选择视频段落、观看速度,以及选择观看画面、听音频还是直接读取转录文本的能力。这并非谷歌的第一次尝试,之前在agentic vision中,代码执行与Gemini的图像理解相结合,现在这一思路被应用到视频处理上,工具也换成了专用的视频处理工具。官方博客列举了一些高难度的应用场景:亚秒级片段检索、长视频中的信息提取、异常检测等,所有这些功能都标志着模型在处理视频方面的重大突破,使得许多以往困难的任务变得简单可行。

成年人的绝望反抗:父母的“矫正”与暴力控制
成年人的绝望反抗:父母的“矫正”与暴力控制

为球员和教练提供篮球战术分析,帮助团队提高战术执行力和临场应变能力。...

齐耶赫与卡萨布兰卡维达德关系紧张,公证人见证训练出席
齐耶赫与卡萨布兰卡维达德关系紧张,公证人见证训练出席

为球员和教练提供篮球战术分析,帮助团队提高战术执行力和临场应变能力。...