📰 本频道不定期推送科技数码类新资讯,欢迎关注!
©️ 发布的内容不代表本频道立场,和你意见不一样的话欢迎在评论区留言表达,但请注意言辞,面斥不雅。
‼️ 关联群组定期清理不活跃成员和僵尸号,误封请联系管理员。
🔗 博客: https://yummy.best
💬 群组: @GodlyGroup
📬 投稿: @GodlyNewsBot
🪧 广告合作: @yummybest_bot.
©️ 发布的内容不代表本频道立场,和你意见不一样的话欢迎在评论区留言表达,但请注意言辞,面斥不雅。
‼️ 关联群组定期清理不活跃成员和僵尸号,误封请联系管理员。
🔗 博客: https://yummy.best
💬 群组: @GodlyGroup
📬 投稿: @GodlyNewsBot
🪧 广告合作: @yummybest_bot.
Google正式发布了三款新的Gemini模型:Gemini 3.6 Flash、3.5 Flash-Lite以及专注于网络安全的3.5 Flash Cyber。
这一系列新模型旨在平衡效率与质量,为大规模构建和扩展AI智能体工作流提供更高的token效率、更低的延迟以及更好的性能表现。
Google透露新一代Gemini 4模型的预训练工作也已经正式启动,而3.5 Pro将尽快发布。作为核心主力模型的Gemini 3.6 Flash,在编程、知识工作和多模态任务上的表现均实现了跨越式提升,3.6 Flash相比前代减少了17%的输出token消耗,并且在执行多步骤工作流时仅需更少的推理过程。配合进一步下调的API价格,3.6 Flash显著降低了每个Agent任务的总体成本,并原生内置了Computer Use功能。
针对高吞吐量和极低延迟需求,Google推出了该系列最快的模型3.5 Flash-Lite,其每秒可输出多达350个token。专为漏洞挖掘和修复打造的3.5 Flash Cyber模型通过多智能体协作对抗复杂的网络威胁,该模型目前仅面向政府及受信任的合作伙伴开放试点。
目前,3.6 Flash与3.5 Flash-Lite已通过Google AI Studio、Gemini App、API等渠道开放使用。
via 匿名
有网友表示 Google 已开始发送邮件警告在 Gemini 中试图绕过或规避滥用行为防范措施 / 安全过滤器的用户,Google 在邮件中表示继续违反可能会无法使用服务,目前,OpenAI 的 Codex 和 Anthropic 的 Claude Code 也采用类似政策。
via 匿名
Google之前曾表示会在 6 月推出新的 Gemini 3.5 Pro 模型。不过,知情人士称,由于需要花更多时间从早期测试者那里收集反馈并对模型进行微调,现已将发布时间调整为 7 月。
消息人士称,Google推迟新模型的发布时间,以便有更多时间从早期测试者收集真实的使用场景。报道称,新模型目前已在谷歌的 Antigravity 平台以及 AI 基准测试网站 LMArena 上,向部分用户开放。
现在,你可以用 AI 重新remix(混剪)别人的 YouTube Shorts
Google发布了一项新的 YouTube Shorts Remix 功能:借助 Gemini Omni,用户可以重塑他人的短视频剪辑风格,甚至把自己“融入”到别人的作品中。
现在,当你在某个 YouTube Shorts 的底部点击 remix 图标时,会看到一个“reimagine”选项。你可以在这里给 Gemini 下指令,让它把视频变成像素风、动漫风,甚至是“伪纪录片”风格的恐怖片。不过功能不止于此——你还能进一步修改内容,比如把角色的头部变得更大、加入背景演员、把人改扮成海盗,甚至直接把自己加到画面中。
创作者可以选择启用或关闭“remix”视频的功能。
🗒 标签: #YouTube #Gemini #AI
📢 频道: @GodlyNews1
🤖 投稿: @GodlyNewsBot
Google发布了一项新的 YouTube Shorts Remix 功能:借助 Gemini Omni,用户可以重塑他人的短视频剪辑风格,甚至把自己“融入”到别人的作品中。
现在,当你在某个 YouTube Shorts 的底部点击 remix 图标时,会看到一个“reimagine”选项。你可以在这里给 Gemini 下指令,让它把视频变成像素风、动漫风,甚至是“伪纪录片”风格的恐怖片。不过功能不止于此——你还能进一步修改内容,比如把角色的头部变得更大、加入背景演员、把人改扮成海盗,甚至直接把自己加到画面中。
创作者可以选择启用或关闭“remix”视频的功能。
这是一款提供全天候免提协助的智能眼镜,将于今秋上市。
新款音频眼镜可让 Gemini 随时为你提供帮助,比如拍照、在新城市导航,或将音频内容进行实时翻译。Audio Glasses支持与 Android 及 iOS 手机配对使用。
• Gemini 月活用户达9 亿
谷歌搜索现在由Gemini 3.5加持、具备大规模执行任务能力
该功能将先向 Google AI Pro 和 Ultra 订阅用户逐步推出
Google 推出CodeMender API,一种代码安全代理,可自动发现并修复关键的软件漏洞。
今天,我们将邀请一小部分精选专家来进行测试,并计划很快更广泛地推出。
面向科学的 Gemini,旨在加速科研进程
Gemini 已经可以帮助解决复杂问题,而我们全新的 GoogleLabs 原型还能进一步简化更多日常科研任务,包括:
• 跟进最新论文
• 把研究目标转化成可直接使用的代码
• 生成新的假设
AI 模拟是面向科学的中另一个强有力的工具,能够帮助我们理解并预测动态系统。
Google 推出Google Pics
Google Workspace 新增一款全新产品,让你获得更强的创作掌控力。
这是一款图像创建与编辑工具,几乎能帮你做出任何想要的作品——比如派对传单和信息图表。它会自动识别并分割照片中的各个对象,理解它们之间的关系,让你只需点击几下就能轻松完成编辑。
Pics 将于今天先向一小部分“可信测试员”开放,随后在今年夏天晚些时候,面向全球的 Google AI Pro 和 Ultra 订阅用户推出。
Stitch by Google现在能够实时生成移动端和 Web 应用的界面(UI)
今天起开始免费向全球用户逐步推出。
你可以让 Stitch 根据你的提示设计一款移动端应用,并通过语音和文字编辑备注对设计进行打磨——就像和设计伙伴协作一样。准备上线时,可将设计导入 Google Antigravity 或 GoogleAIStudio ,并进行发布。
Google Flow多项更新
• 新增Gemini Omni Flash:只需提供简短提示和风格参考,Gemini Omni 就能在保留原始性能的同时,改变现有场景的环境,添加视觉效果及其他元素。
• 新增Google Flow 代理:集成Gemini 的智能代理能力,现在你的智能体可以同时执行多个操作。该代理还能凭借对上下文的精准理解,完成大规模编辑任务。
• 新增Google Flow 工具:现在你可以为任何你想到的创意工具“尽情编写代码”,比如设计视频特效或手绘动画。你还能在Google Flow上直接创建、分享并对这些工具进行再创作(remix)。
• 新增Google Flow Music:还在脑海里挥之不去的旋律?现在你可以在 Google Flow Music 上创作自己的歌曲。你只要把即兴创作录进 Google Flow Music,并用你想要的音乐风格来给它下指令——比如更精致的 R&B。Google Flow Music 会先给你打好基础,之后你就能直接在这个工具里继续微调完善。
新增 Universal Cart(环球购物车),Google 上全新的购物中心
你可以在Google引擎、Gemini App、YouTube或Gmail购物时,将商品添加到购物车。
系统将查找优惠和降价信息,给你带来价格历史的洞察,并在某件商品重新上架时及时提醒你。
它能帮你发现隐藏的优惠。由于它是基于 Google 钱包打造的,你的购物车会识别你的支付方式特权、会员/忠诚度信息以及商家优惠,这样你就不会错过任何优惠或积分。
• 通用商务协议(Universal Commerce Protocol:一项开源标准,它为代理和系统提供共同语言,使所有关键参与者能够携手协作。
• Agent Payments Protocol(AP2):让你的 AI 代理在明确边界与责任的框架下,安全地替你完成支付。
• Android Halo: 为你的代理在 Android 设备上提供的全新空间。今年晚些时候,它将让你一眼掌握各个代理的状态,从屏幕顶部就能直接看到他们的进展。Halo 将支持与 Gemini Spark 及其他兼容的智能代理协同工作。
同时,顶级Google AI Ultra 方案价格下调到每月 200 美元
Google推出Gemini Spark
它基于 Gemini 3.5 运行,并构建在 Antigravity 之上,因此能够在后台轻松完成长时间运行的任务。
由于它是在 Google Cloud 的专用虚拟机上运行的,你甚至不必一直保持笔记本电脑开机。
Spark 将与 Google 的工具实现无缝集成,并很快也会通过 MCP 与第三方进行集成。
macOS 应用今天起面向所有用户开放下载;Gemini Spark 将在美国逐步推送给 Google AI Ultra 订阅用户;全新的语音体验也将在未来几周内在全球范围内向所有用户上线。
🗒 标签: #Google #Gemini #Spark
📢 频道: @GodlyNews1
🤖 投稿: @GodlyNewsBot
这是你的 24/7 个人 AI 助理,随时帮你更好地管理数字生活:在你的指挥和指令下代表你采取行动。
它基于 Gemini 3.5 运行,并构建在 Antigravity 之上,因此能够在后台轻松完成长时间运行的任务。
由于它是在 Google Cloud 的专用虚拟机上运行的,你甚至不必一直保持笔记本电脑开机。
Spark 将与 Google 的工具实现无缝集成,并很快也会通过 MCP 与第三方进行集成。
macOS 应用今天起面向所有用户开放下载;Gemini Spark 将在美国逐步推送给 Google AI Ultra 订阅用户;全新的语音体验也将在未来几周内在全球范围内向所有用户上线。
用户可以利用自然语言来编辑视频
今天起,全球范围内的 Google AI Plus、Pro 和 Ultra 订阅用户可在 GeminiApp 和 Google Flow 中使用。
将于本周起免费逐步推出:YouTube Shorts 和 YouTube Create 应用。
接下来几周,将通过 API 方式向开发者和企业客户开放。
我们现已向所有 GeminiApp 用户推出 3.5 Flash,并在 Google 搜索中开放 AI 模式。
Gemini 3.5 Pro将于6月发布。
首个发布的是3.5 Flash,这是我们迄今为止用于智能体与编码的最强模型 。
Gemini 3.5 Flash 以远低于其他领先模型的价格,提供快速且始终稳定的表现。
它能够在超大规模代码库中进行规划与推理,并部署子代理在更长的时间跨度里并行协作。
它在编码与“代理式”基准测试上(如 Terminal-Bench 2.1、GDPval-AA 和 MCP Atlas)表现超过 3.1 Pro。
Google研究人员分析代码后认为这或许是用AI生成的,例如代码出现了“虚构”的 CVSS 评分。同时还表示不认为Gemini被用于其中。
根据Google威胁情报组(GTIG)发布的报告,“主要网络犯罪威胁团伙”原本计划利用该漏洞实施一次“大规模的漏洞利用事件”,以便绕过某款未披露名称的“开源、基于网页的系统管理工具”上的双因素(2FA)认证。
Google研究人员在用于该漏洞利用的 Python 脚本中发现了线索,显示这可能获得了 AI 的帮助,例如“捏造出来的 CVSS 分数”和“结构化、教科书式”的排版风格,这些都与 LLM 训练数据中的模式相吻合。
该漏洞利用源于平台 2FA 系统中的“高层语义逻辑缺陷”——开发者将一个“信任假设”硬编码进了系统。此事还延续了此前数周的纠结与讨论:各类面向网络安全的 AI 模型(如 Anthropic 的 Mythos)到底有多强;以及最近披露的一处 Linux 漏洞(Copy Fail),据称也是在 AI 的协助下被发现的。
这是Google首次发现有证据表明AI参与了此类攻击事件。不过,Google的研究人员表示:“我们不认为 Gemini 被用于其中。同时也指出,黑客正在越来越多地使用 AI 来寻找并利用安全漏洞。”
报告还提到,攻击者也将 AI 作为目标,称“GTIG 观察到,对手正日益瞄准为 AI 系统提供能力的集成组件,例如自主技能(autonomous skills)以及第三方数据连接器”。
报告还详细介绍了黑客如何通过“以角色驱动的越狱”来让 AI 为他们挖掘安全漏洞:例如,有一个示例提示要求 AI 假装自己是安全专家。黑客还会把包含大量漏洞信息的整个代码仓库喂给 AI 模型,并以使用 OpenClaw 的方式显示出,“他们似乎希望在受控环境中打磨由 AI 生成的载荷,以便在上线部署前提高漏洞利用的成功率与可靠性”。
现在, Google 助理将被更聪明、对话感更强的升级版所取代。
Google正准备为已内置“Google”功能的车辆推出更新,把车载的 Gemini AI 助手带到这些车型上。
根据Google的公告,这次升级将取代现有的 Google Assistant,并将提供更自然、更顺畅的对话体验,同时还能获取车辆专属信息、调整车辆设置等。
符合条件的用户在其车辆中登录了 Google 账户后,升级到 Gemini 的选项就会出现在车内界面。
Google 表示,公司计划在不久的将来把升级推广到更多地区和语言,并且“让驾驶员能够在 Gmail、日历以及 Google Home 等应用中安全查看自己的信息”。
彻底终结AI“御三家”时代,与OpenAI的“两强对垒”格局落定。
Google将向Anthropic公司投资最高400亿美元,进一步深化这两家公司之间的合作关系。双方在人工智能竞赛中既是伙伴,又是对手。
Anthropic周五表示,Google承诺以3800亿美元的最新估值即刻投入100亿美元现金。Google将在Anthropic达成业绩里程碑后再追加投资300亿美元,同时大力扩充Anthropic的算力规模。
Anthropic是Google芯片和云服务的重要客户,而Google正大力拓展这些业务,以弥补其核心收入来源——搜索广告业务增长趋于成熟的不足。
Google Cloud将在未来五年内为Anthropic提供5吉瓦的算力,从2027年开始陆续上线,后续还可能追加数吉瓦。此次协议是本月早些时候Anthropic、Google与博通公司签署合作协议的进一步扩展。
Google 的TPU是英伟达芯片最具竞争力的替代方案之一,在这个对算力需求极为庞大的行业中,TPU对Anthropic及其他AI开发者而言是稀缺而宝贵的资源。
Google:Gemini Enterprise第一季度付费月活跃用户数环比增长40%。
目前Google所有新代码中,75%由AI生成。
Google Cloud AI使用量达到每分钟160亿Tokens
🗒 标签: #Google #Gemini #AI
📢 频道: @GodlyNews1
🤖 投稿: @GodlyNewsBot
目前Google所有新代码中,75%由AI生成。
Google Cloud AI使用量达到每分钟160亿Tokens
https://gemini.google/mac/
Gemini 将新增“Notebooks”功能
Google宣布,Gemini 将新增notebooks(笔记本)功能,方便你在使用 AI 聊天机器人时把与某个主题相关的内容集中管理。你可以把文件、以往对话和自定义设置等加入notebooks,Gemini 在与你对话时会把这些内容作为上下文参考。
该功能与 ChatGPT 在 2024 年推出的 Projects类似:都可以把某个主题相关的内容集中保存。
Google称“可以把notebooks当作在Google产品中共享的个人知识库。”
此外,Gemini 的notebooks会与Google的 NotebookLM AI 研究工具同步,在一个应用中添加的资料来源会在另一个应用中同步显示。
🗒 标签: #Google #Gemini #Notebooks
📢 频道: @GodlyNews1
🤖 投稿: @GodlyNewsBot
该功能在本周通过网页版向 AI Ultra、Pro 和 Plus 订阅用户上线,预计将在“未来几周”扩展到移动端和免费用户。
Google宣布,Gemini 将新增notebooks(笔记本)功能,方便你在使用 AI 聊天机器人时把与某个主题相关的内容集中管理。你可以把文件、以往对话和自定义设置等加入notebooks,Gemini 在与你对话时会把这些内容作为上下文参考。
该功能与 ChatGPT 在 2024 年推出的 Projects类似:都可以把某个主题相关的内容集中保存。
Google称“可以把notebooks当作在Google产品中共享的个人知识库。”
此外,Gemini 的notebooks会与Google的 NotebookLM AI 研究工具同步,在一个应用中添加的资料来源会在另一个应用中同步显示。
Google 推出Gemini Embedding 2(其首款原生支持多模态的嵌入模型)
Gemini Embedding 2 是我们首个原生多模态嵌入模型,能把文本、图像、视频、音频和文档映射到同一嵌入空间,从而实现不同媒体间的统一检索和分类功能,并能在 100 多种语言中理解语义意图。
这大大简化了复杂的处理流程,并提升了多种多模态应用的效果——例如用于检索增强生成(RAG)、语义搜索、情感分析和数据聚类等任务。
由于不再局限于单一模态处理,该模型能原生识别交错的多模态输入,因此可在一次请求中同时输入图像和文本等多种数据。由此模型能把握不同媒体类型之间复杂而微妙的关联,更准确地理解真实世界中的复杂信息。
🗒 标签: #Google #Gemini #多模态
📢 频道: @GodlyNews1
🤖 投稿: @GodlyNewsBot
现已通过 Gemini API 和 Vertex AI 以公测形式向公众开放预览。
Gemini Embedding 2 是我们首个原生多模态嵌入模型,能把文本、图像、视频、音频和文档映射到同一嵌入空间,从而实现不同媒体间的统一检索和分类功能,并能在 100 多种语言中理解语义意图。
这大大简化了复杂的处理流程,并提升了多种多模态应用的效果——例如用于检索增强生成(RAG)、语义搜索、情感分析和数据聚类等任务。
• 文本:支持最多 8192 个输入tokens的广泛上下文环境
• 图像:每次请求最多可处理 6 张,支持 PNG 和 JPEG 格式
• 视频:支持最多 120 秒的 MP4 或 MOV 格式视频输入
• 音频:可以直接接收并生成音频的嵌入向量,无需先把音频转成文本
• 文档:直接嵌入最多 6 页的 PDF 文件
由于不再局限于单一模态处理,该模型能原生识别交错的多模态输入,因此可在一次请求中同时输入图像和文本等多种数据。由此模型能把握不同媒体类型之间复杂而微妙的关联,更准确地理解真实世界中的复杂信息。
性能优于2.5 Flash,价格更低
原定于3月31日的弃用日期,推迟至6月1日
影响范围:Gemini API 及Google AI Studio
Agentic Vision 是 Gemini 3 Flash 的一项新能力,它把视觉推理和代码执行结合起来,能够以视觉证据为依据给出答案,表达更直观可靠。
在 Gemini 3 Flash 中,Agentic Vision 把图像理解从被动的查看变成主动的探究。
模型会生成并运行 Python 代码来主动处理或分析图像,例如裁剪、旋转、添加注释,或执行计算与统计(比如计数边界框)。并以视觉证据为依据给出结论。
Agentic Vision 现已通过 Gemini API 在 Google AI Studio 和 Vertex AI 中提供。它也开始在 Gemini 应用中逐步推出(可在模型下拉菜单中选择“Thinking”访问)。