Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber的推出
我们的最新Gemini模型在效率、延迟和可靠性方面提供了构建大规模AI代理的能力。开发者和客户需要更高的令牌效率、更低的延迟和更可靠的性能。我们的Flash系列模型旨在满足效率与质量的最佳平衡,以支持代理工作流的扩展。
3.6 Flash:更高效的工作马模型
3.6 Flash是基于3.5 Flash的进一步优化,具有更好的编码、知识工作和多模态性能。根据人工分析指数,其输出令牌使用量比3.5 Flash减少了17%,在一些基准测试中,如Datacurve的DeepSWE,观察到高达65%的减少,且每个输出令牌的成本更低。
// 示例代码:3.6 Flash的性能比较
float efficiency3_6 = 1 - (tokens_used_3_6 / tokens_used_3_5);
3.5 Flash-Lite:最快的3.5级模型
3.5 Flash-Lite是我们最快、最具性价比的模型,能够以350个输出令牌每秒的速度运行,显著优于之前的Flash-Lite版本。它的定价为$0.3/1M输入令牌和$2.5/1M输出令牌,为开发者提供了强大的性价比。
3.5 Flash Cyber:高效的网络安全解决方案
3.5 Flash Cyber专为发现和修复网络安全漏洞而设计,能在多个3.5 Flash Cyber代理协同工作的情况下生成综合报告。它在流行基准CyberGym中表现出色,并将通过CodeMender向政府和受信任的合作伙伴提供。
结论
Gemini 3.6 Flash及3.5系列模型现已可用,欢迎开发者通过Google AI Studio和Gemini应用进行体验。同时,期待3.5 Pro的发布。
博主点评: Gemini 3.6 Flash和3.5系列模型的推出标志着AI代理技术的又一次飞跃,尤其在效率和成本方面的优化,将大幅提升开发者的生产力和应用场景的扩展性。