QRazy
值得讨论的问题
📰 新闻 ⚔️ 辩论 / 🤖 科技与人工智能
本文发布于 Qrazy.net 博客,其作者与 Qrazy.net 编辑部无关。

谷歌推出了Gemini 3.6 Flash和首个网络安全AI模型。随后是Gemini 3.5 Pro和Gemini 4

开启与Gemini 3.6 Flash和谷歌首个网络安全人工智能模型的新视野。了解Gemini 3.5 Pro和Gemini 4的后续版本。

QRazy 的主要發現

  • Gemini 3.6 Flash在编程测试中表现提升了49%,令牌消耗降低了17%。
  • 推出了新的Flash Lite模型,具有高速度和经济性,适用于大规模系统。
  • Gemini 3.5 Flash Cyber成为首个专门用于网络安全的模型,但将会有限定提供。
谷歌推出了Gemini 3.6 Flash和首个网络安全AI模型。随后是Gemini 3.5 Pro和Gemini 4
关于古代符号的问题

谷歌更新了其语言模型系列,推出了多个新解决方案。主要公告是Gemini 3.6 Flash,它在发布仅几个月后就取代了Gemini 3.5 Flash。

同时,公司展示了简化版Flash Lite和专门针对网络安全的模型,并首次介绍了Gemini 4的开发进展。

Gemini 3.5 Flash让位于新版本

在谷歌I/O大会上,主要事件是Gemini 3.5 Flash,而现在它让位于Gemini 3.6 Flash。新模型成为开发者使用API和Gemini应用用户的主要模型。

根据谷歌的说法,更新在很大程度上得益于社区的反馈。在Gemini 3.5 Flash发布后,许多开发者指出该模型在生成代码方面的能力低于预期。

这可能是由于公司追求最大效率和降低计算成本的策略,而在使用AI的成本不断上升的背景下。

性能提升,标记消耗降低

虽然不能称这些变化为革命性的,但Gemini 3.6 Flash在多个方向上显示出明显的进步。

在评估编程技能的DeepSWE测试中,新模型得分为49%,而Gemini 3.5 Flash仅为37%

计算机控制能力也得到了提升。现在,该功能已成为Gemini API的标准功能。在测量计算机执行操作质量的OSWorld基准测试中,结果从78.4%提高到83%

此外,谷歌还成功提高了模型的效率。尽管工作质量有所改善,但Gemini 3.6 Flash的标记消耗比前代模型低约17%

在处理代理场景时,这些变化尤为明显,当模型自我执行一系列相关操作时。谷歌声称,现在这些任务的解决更准确,所需的中间步骤更少,消耗的标记也更少。

对于开发者来说,这不仅意味着应用程序的更稳定运行,也意味着成本的降低。

API的使用成本也降低了:

  • 入站标记 - 每百万1.50美元,保持不变;
  • 出站标记 - 每百万7.50美元,而不是之前的9美元。

Gemini 3.5 Flash Lite速度更快

尽管推出了新的主要模型,谷歌并未停止对3.5系列的开发。公司同时推出了Gemini 3.5 Flash Lite——其系列中最经济的现代模型。

它的速度达到每秒350个标记,这使得Flash Lite在对高性能和低计算成本要求高的规模化代理系统中特别有吸引力。

根据谷歌的数据显示,新的Flash Lite在工作质量上接近于约一年前的旗舰模型,同时价格显著更低。

API的费用为:

  • 每百万入站标记0.30美元
  • 每百万出站标记2.50美元

这略高于之前的Gemini 3.1 Flash Lite,后者的相应数字分别为0.25美元和1.50美元。

新版本现已向开发者开放,并逐步在Gemini应用中上线。此外,谷歌计划在搜索引擎中积极使用Flash Lite,由于速度快,模型能够更快生成AI概述——搜索结果中的自动AI摘要。

谷歌准备第一款专门针对网络安全的模型

在公告中,单独占有一席之地的是Gemini 3.5 Flash Cyber——谷歌第一款专为信息安全任务量身定制的语言模型。

根据公司数据,它在寻找和修复漏洞时几乎不逊色于更大、更昂贵的Claude Mythos模型,同时保持了Flash家族特有的效率。

与此同时,谷歌承认,这类模型属于双重用途技术。它们不仅能够帮助防御者,也可能帮助攻击者,方便寻找潜在漏洞。

这正是为什么不会公开发布。在第一阶段,Gemini 3.5 Flash Cyber将仅在谷歌DeepMind CodeMender代理的有限试点项目中提供,只有经过验证的公司合作伙伴和政府机构才能使用。

Gemini 3.5 Pro的现状

有关Gemini 3.5 Pro的命运仍然是一个备受争议的话题。

在谷歌I/O期间,公司曾表示新模型将在6月发布,但这一情况并未发生。现在谷歌仅表示,新旗舰正在有限的合作伙伴中进行测试,并将在“准备好时”发布。

该模型应与GPT 5.6Claude FableClaude Sonnet 5展开竞争。

此前有媒体报道称,Gemini 3.5 Pro的发布被推迟,因为该模型在编程任务上未能表现出足够强的竞争力。

Gemini 4的开发已启动

谷歌的计划并未就此结束。公司首次确认已开始Gemini 4的预训练

开发者表示,新的训练程序将比所有先前的Gemini项目更为规模化。

至于Gemini 4的发布将何时进行,谷歌尚未透露。不知道在此之前是否会出现3.x系列的其他版本。公司目前只是确认下一代模型的开发正在进行中。

🔒 註冊後即可免費取得完整答案
Загрузка...
提出尖锐问题

这里可以讨论争议话题。

比较不同观点。

比较不同观点。

优质评论会上升。

优质评论会上升。

顾问 在线