Google正式发布了三款新的Gemini模型:Gemini 3.6 Flash、3.5 Flash-Lite以及专注于网络安全的3.5 Flash Cyber。
这一系列新模型旨在平衡效率与质量,为大规模构建和扩展AI智能体工作流提供更高的token效率、更低的延迟以及更好的性能表现。
Google透露新一代Gemini 4模型的预训练工作也已经正式启动,而3.5 Pro将尽快发布。作为核心主力模型的Gemini 3.6 Flash,在编程、知识工作和多模态任务上的表现均实现了跨越式提升,3.6 Flash相比前代减少了17%的输出token消耗,并且在执行多步骤工作流时仅需更少的推理过程。配合进一步下调的API价格,3.6 Flash显著降低了每个Agent任务的总体成本,并原生内置了Computer Use功能。
针对高吞吐量和极低延迟需求,Google推出了该系列最快的模型3.5 Flash-Lite,其每秒可输出多达350个token。专为漏洞挖掘和修复打造的3.5 Flash Cyber模型通过多智能体协作对抗复杂的网络威胁,该模型目前仅面向政府及受信任的合作伙伴开放试点。
目前,3.6 Flash与3.5 Flash-Lite已通过Google AI Studio、Gemini App、API等渠道开放使用。
via 匿名