企业 AI 的下一轮价值验证会发生在高频、持续运行的垂直任务里;采购方应同时要求任务成功率、误动作率、人工接管率和单位任务成本,而不是只看模型基准。
今日结论
用量制 AI 已经进入 FinOps 常态。预算上限、成本归属和原始用量导出不再是采购后的补充工作,而是允许 agent 扩张之前的上线条件。
美国前沿模型发布正在增加一个不透明的外部依赖:政府最多 30 天的预发布评测。模型商与企业客户都应把审查延迟、访问限制和版本替代写进交付计划。
AI 产品与应用
Project Perception 开放预览,网络防御从告警助手走向红、蓝、绿队 agent 闭环
查看完整拆解
微软确认 Project Perception 于 8 月 3 日进入全球公开预览。系统用红队 agent 寻找潜在入侵路径,蓝队 agent 结合上下文判断真实风险,绿队 agent 执行修复;首个场景是软件漏洞管理,并把专用模型 MAI-Cyber-1-Flash 接入 MDASH 多模型 agent 团队。微软报告该配置在 CyberGym 达到 96%,比 Mythos 高 12 个百分点,同时较现有 MDASH 配置节省近 50% 成本。微软官方说明
产品意义不只是自动写一份漏洞摘要,而是把发现、判断和修复连接成可持续运行的控制回路。安全团队在试用时应把自动执行范围限制在可回滚动作,分别记录三类 agent 的证据链与责任人,并用自身资产、漏洞类型和误报成本复测;官方基准不能直接替代生产环境验收。
微软确认 Project Perception 于 8 月 3 日进入全球公开预览。系统用红队 agent 寻找潜在入侵路径,蓝队 agent 结合上下文判断真实风险,绿队 agent 执行修复;首个场景是软件漏洞管理,并把专用模型 MAI-Cyber-1-Flash 接入 MDASH 多模型 agent 团队。微软报告该配置在 CyberGym 达到 96%,比 Mythos 高 12 个百分点,同时较现有 MDASH 配置节省近 50% 成本。微软官方说明
产品意义不只是自动写一份漏洞摘要,而是把发现、判断和修复连接成可持续运行的控制回路。安全团队在试用时应把自动执行范围限制在可回滚动作,分别记录三类 agent 的证据链与责任人,并用自身资产、漏洞类型和误报成本复测;官方基准不能直接替代生产环境验收。
模型与技术进展
Gemini in Docs 的 11 种新增语言进入 Scheduled Release 部署期
查看完整拆解
Google 的新版 Gemini in Docs 已于 8 月 1 日开始向 Scheduled Release 域渐进部署,新增普通话、荷兰语、马来语、希伯来语、波兰语、土耳其语、捷克语、印尼语、瑞典语、丹麦语和挪威语。能力不止翻译:用户可从零生成带格式文档、跨全文改写、匹配既有写作风格与文档格式,并在启用 Workspace Intelligence 后调用 Drive、Gmail、Chat 与网页上下文。Google Workspace 官方更新
多语言入口把“文档生成”变成跨系统上下文汇聚。对中文团队,真正的部署检查不是能否写中文,而是 Gemini for Workspace in Drive 与智能功能是否开启、哪些邮件和文件会进入上下文、建议改动由谁批准,以及跨语言生成后如何保留来源。渐进部署最长可达 15 天,单个租户在 8 月 4 日尚未看到功能不等于异常。
Google 的新版 Gemini in Docs 已于 8 月 1 日开始向 Scheduled Release 域渐进部署,新增普通话、荷兰语、马来语、希伯来语、波兰语、土耳其语、捷克语、印尼语、瑞典语、丹麦语和挪威语。能力不止翻译:用户可从零生成带格式文档、跨全文改写、匹配既有写作风格与文档格式,并在启用 Workspace Intelligence 后调用 Drive、Gmail、Chat 与网页上下文。Google Workspace 官方更新
多语言入口把“文档生成”变成跨系统上下文汇聚。对中文团队,真正的部署检查不是能否写中文,而是 Gemini for Workspace in Drive 与智能功能是否开启、哪些邮件和文件会进入上下文、建议改动由谁批准,以及跨语言生成后如何保留来源。渐进部署最长可达 15 天,单个租户在 8 月 4 日尚未看到功能不等于异常。
投融资与商业动态
GitHub 退役 Copilot Billing Preview,AI 用量成本正式并入原生账单治理
查看完整拆解
GitHub 于 8 月 3 日退役 Copilot Billing Preview 应用,原因是其底层报告已无法覆盖现有账单设置中的个人级预算、成本中心和用量池分配。企业改用原生 AI usage 页面查看、分组、筛选和导出 AI Credits,用预算限制支出,并可通过用量报告与 Billing API 获取原始数据。GitHub 官方变更说明;用量制计费说明
这不是 Copilot 服务收缩,而是成本管理从过渡应用转成平台原生能力。自 6 月起所有 Copilot 计划已按 AI Credits 用量计费,代码审查还会消耗 GitHub Actions 分钟;工程负责人因此需要同时管理 AI Credits 与 runner 成本,并把预算归属到团队或个人。当天未发现可信度与重要性更高的新大型融资交易。
GitHub 于 8 月 3 日退役 Copilot Billing Preview 应用,原因是其底层报告已无法覆盖现有账单设置中的个人级预算、成本中心和用量池分配。企业改用原生 AI usage 页面查看、分组、筛选和导出 AI Credits,用预算限制支出,并可通过用量报告与 Billing API 获取原始数据。GitHub 官方变更说明;用量制计费说明
这不是 Copilot 服务收缩,而是成本管理从过渡应用转成平台原生能力。自 6 月起所有 Copilot 计划已按 AI Credits 用量计费,代码审查还会消耗 GitHub Actions 分钟;工程负责人因此需要同时管理 AI Credits 与 runner 成本,并把预算归属到团队或个人。当天未发现可信度与重要性更高的新大型融资交易。
政策、伦理与安全
白宫称先进模型自愿评测安排已完成,但关键规则仍未公开
查看完整拆解
白宫官员 8 月 3 日表示,依据 6 月 2 日行政命令制定的先进模型自愿评测安排已在截止日前完成,OpenAI、Anthropic 与 Google 曾对草案提供反馈,政府还在接触更多企业。已知设计包括:开发者与政府判断在研模型是否适用;政府可在发布前最多 30 天访问模型;同时规定保密、网络安全、内部人员风险、知识产权保护和可信合作方早期访问要求。模型覆盖门槛与网络能力评测流程被列为机密。Axios 报道;白宫行政命令
白宫官员 8 月 3 日表示,依据 6 月 2 日行政命令制定的先进模型自愿评测安排已在截止日前完成,OpenAI、Anthropic 与 Google 曾对草案提供反馈,政府还在接触更多企业。已知设计包括:开发者与政府判断在研模型是否适用;政府可在发布前最多 30 天访问模型;同时规定保密、网络安全、内部人员风险、知识产权保护和可信合作方早期访问要求。模型覆盖门槛与网络能力评测流程被列为机密。Axios 报道;白宫行政命令
X 平台高信号
1. Project Perception 从发布预告转为可申请的公开预览 信号标题:微软多智能体网络防御于 8 月 3 日开放预览 类型:产品访问变化 / 网络安全 来源或链接:[微软官方发布及 @MSFTSecurity 入口](https://blogs.microsoft.com/blog/2026/07/27/rethinking-security-for-the-age-of-ai/) 核心观点:本日新增事实是公开预览节点到达;红队 agent 寻路、蓝队 agent 判险、绿队 agent 修复被接入同一持续防御系统,首个落地场景是漏洞管理。 为什么重要:安全 AI 开始从生成建议转向调用真实防护动作,评估单位也必须从回答质量改为端到端处置结果。 影响:试点应限定可回滚动作、保留每次判断的证据与请求者身份,并在自有漏洞集上复测 96% CyberGym 和近 50% 成本节省的厂商数字。 验证状态:开放预览日期、三类 agent 分工、基准与成本数据均由微软一手发布确认;效果数字尚无独立第三方复现。 2. Copilot Billing Preview 退役,成本控制迁入 GitHub 原生设置 信号标题:Copilot 过渡性账单应用于 8 月 3 日停止服务 类型:计费管理变化 / 开发者平台 来源或链接:[GitHub 官方变更说明](https://github.blog/changelog/2026-07-07-copilot-billing-preview-app-will-be-retired-on-august-3/) 核心观点:退役的是预览应用,不是用量报表;AI usage 页面、个人级预算、成本中心、用量池分配、导出与 Billing API 成为正式替代入口。 为什么重要:这表明 GitHub 已把 AI Credits 当作需要日常治理的云成本,而非席位订阅里的模糊附加项。 影响:依赖旧应用导出或看板的组织应切换数据源,并把 Copilot 代码审查消耗的 AI Credits 与 Actions 分钟一起计入团队成本。 验证状态:退役日期、替代入口和预算能力由 GitHub 一手发布确认。 3. Gemini in Docs 的中文等 11 种语言进入受控发布域 信号标题:Scheduled Release 域开始接收多语言 Gemini 文档能力 类型:访问范围变化 / 企业生产力 来源或链接:[Google Workspace 官方更新](https://workspaceupdates.googleblog.com/2026/07/expanded-language-support-for-gemini-in-Google-Docs.html) 核心观点:从 8 月 1 日开始的渐进部署正在进行,普通话等 11 种语言可获得生成完整初稿、全文改写、匹配风格与匹配格式等能力;Workspace Intelligence 可扩展至 Drive、Gmail、Chat 和网页上下文。 为什么重要:非英语团队首次更完整地获得跨文档和跨通信源生成入口,采用范围会明显扩大。 影响:管理员应复核 Drive 中 Gemini 与 Workspace 智能功能的开关、可访问数据范围和审批规则;租户可见性可能在 15 天部署期内分批到达。 验证状态:语言清单、能力范围、管理员前提、套餐与部署节奏均由 Google 一手发布确认。 4. HubSpot 撤回原定 8 月 4 日生效的数据条款,产品节点不能按旧通知理解 信号标题:Contact Discovery 的原始 8 月 4 日说明已被官方标记失效 类型:平台规则变化 / CRM 数据 来源或链接:[HubSpot 官方撤回说明](https://community.hubspot.com/t/we-got-this-wrong-and-we-are-fixing-it/152063);[当前数据丰富化说明](https://knowledge.hubspot.com/records/how-data-enrichment-works-in-hubspot) 核心观点:今天到达原计划节点,但 HubSpot 已在 7 月 5 日明确撤回 7 月 1 日公布的条款,并表示重新评估数据丰富化的清晰选择方式;当前知识库称该功能默认关闭,只有客户操作后才启用,且 AI 模型训练与数据丰富化是两个独立设置。 为什么重要:把旧邮件中的 8 月 4 日当作仍有效的自动数据共享生效日,会同时误判产品状态与合规责任。 影响:管理员应以当前租户设置和最新知识库为准,分别核查数据丰富化与 AI 模型训练;在官方重新确认前,不应依据已撤回通知假定 Contact Discovery 已按原方案上线。 验证状态:条款撤回、重新评估承诺、当前默认关闭状态与设置分离均由 HubSpot 一手页面确认;未发现新的官方页面重新确认原方案在本日生效。 5. 白宫完成先进模型自愿评测安排,但对外仍不可见 信号标题:政府预发布评测从起草阶段转入企业沟通 类型:政府评测 / 模型发布条件 来源或链接:[Axios 当日报道](https://www.axios.com/2026/08/03/white-house-finalizes-ai-framework-behind-closed-doors);[白宫 6 月 2 日行政命令](https://www.whitehouse.gov/presidential-actions/2026/06/promoting-advanced-artificial-intelligence-innovation-and-security/) 核心观点:8 月 3 日的新增事实是白宫宣布已按期完成相关安排,并称正在与更多企业讨论下一步;已知设计允许政府在发布前最多 30 天访问适用模型,但覆盖门槛、正式文本和启动日仍未公开。 为什么重要:模型发布节奏可能受政府评测影响,而客户无法仅凭公开信息判断哪些模型会被纳入。 影响:采购与产品团队应要求供应商说明审查是否影响发布日期、地域可用性、客户白名单与回退版本,并给关键上线项目预留延期空间。 验证状态:完成状态、三家实验室反馈、最长 30 天访问期与 8 月 4 日企业会议来自 Axios 对白宫官员及知情人士的当日报道;行政命令由白宫一手文件确认,具体安排未公开,故其操作细节仍未完全验证。 6. Google Earth 回滚生成式卫星图像,水印不再被视为充分防线 信号标题:Nano Banana 2 图像生成功能因虚假灾害与冲突图像被暂停 类型:产品规则变化 / 合成内容安全 来源或链接:[The Atlantic 对 Google 回滚声明的原始报道](https://www.theatlantic.com/technology/2026/07/google-earth-ai-images/688145/);[TechRadar 后续核验](https://www.techradar.com/ai-platforms-assistants/google-pulling-nano-banana-from-google-earth-after-one-day-shows-how-bad-our-ai-misinformation-problem-has-got) 核心观点:Google 在上线不足两天后撤回 Google Earth 内的生成图像入口;此前依赖 SynthID 和用户自行核验,随后改为暂停产品并补强防护。 为什么重要:当生成内容继承权威地图产品的视觉可信度时,事后水印不足以抵消传播中的误认风险。 影响:涉及新闻、灾害、保险、地产和 OSINT 的产品应把真实观测层与生成层硬隔离,并在导出图像上使用持续可见标识和来源链。 验证状态:回滚与 Google 声明由两家媒体直接引述确认;未找到 Google 独立公告页,故以一手回应经媒体交叉核验。
Project Perception 从发布预告转为可申请的公开预览
Project Perception 从发布预告转为可申请的公开预览 信号标题:微软多智能体网络防御于 8 月 3 日开放预览 类型:产品访问变化 / 网络安全 来源或链接:微软官方发布及 @MSFTSecurity 入口 核心观点:本日新增事实是公开预览节点到达;红队 agent 寻路、蓝队 agent 判险、绿队 agent 修复被接入同一持续防御系统,首个落地场景是漏洞管理。 为什么重要:安全 AI 开始从生成建议转向调用真实防护动作,评估单位也必须从回答质量改为端到端处置结果。 影响:试点应限定可回滚动作、保留每次判断的证据与请求者身份,并在自有漏洞集上复测 96% CyberGym 和近 50% 成本节省的厂商数字。 验证状态:开放预览日期、三类 agent 分工、基准与成本数据均由微软一手发布确认;效果数字尚无独立第三方复现。
Copilot Billing Preview 退役,成本控制迁入 GitHub…
Copilot Billing Preview 退役,成本控制迁入 GitHub 原生设置 信号标题:Copilot 过渡性账单应用于 8 月 3 日停止服务 类型:计费管理变化 / 开发者平台 来源或链接:GitHub 官方变更说明 核心观点:退役的是预览应用,不是用量报表;AI usage 页面、个人级预算、成本中心、用量池分配、导出与 Billing API 成为正式替代入口。 为什么重要:这表明 GitHub 已把 AI Credits 当作需要日常治理的云成本,而非席位订阅里的模糊附加项。 影响:依赖旧应用导出或看板的组织应切换数据源,并把 Copilot 代码审查消耗的 AI Credits 与 Actions 分钟一起计入团队成本。 验证状态:退役日期、替代入口和预算能力由 GitHub 一手发布确认。
Gemini in Docs 的中文等 11 种语言进入受控发布域
Gemini in Docs 的中文等 11 种语言进入受控发布域 信号标题:Scheduled Release 域开始接收多语言 Gemini 文档能力 类型:访问范围变化 / 企业生产力 来源或链接:Google Workspace 官方更新 核心观点:从 8 月 1 日开始的渐进部署正在进行,普通话等 11 种语言可获得生成完整初稿、全文改写、匹配风格与匹配格式等能力;Workspace Intelligence 可扩展至 Drive、Gmail、Chat 和网页上下文。 为什么重要:非英语团队首次更完整地获得跨文档和跨通信源生成入口,采用范围会明显扩大。 影响:管理员应复核 Drive 中 Gemini 与 Workspace 智能功能的开关、可访问数据范围和审批规则;租户可见性可能在 15 天部署期内分批到达。 验证状态:语言清单、能力范围、管理员前提、套餐与部署节奏均由 Google 一手发布确认。
HubSpot 撤回原定 8 月 4 日生效的数据条款,产品节点不能按旧通知理解
HubSpot 撤回原定 8 月 4 日生效的数据条款,产品节点不能按旧通知理解 信号标题:Contact Discovery 的原始 8 月 4 日说明已被官方标记失效 类型:平台规则变化 / CRM 数据 来源或链接:HubSpot 官方撤回说明;当前数据丰富化说明 核心观点:今天到达原计划节点,但 HubSpot 已在 7 月 5 日明确撤回 7 月 1 日公布的条款,并表示重新评估数据丰富化的清晰选择方式;当前知识库称该功能默认关闭,只有客户操作后才启用,且 AI 模型训练与数据丰富化是两个独立设置。 为什么重要:把旧邮件中的 8 月 4 日当作仍有效的自动数据共享生效日,会同时误判产品状态与合规责任。 影响:管理员应以当前租户设置和最新知识库为准,分别核查数据丰富化与 AI 模型训练;在官方重新确认前,不应依据已撤回通知假定 Contact Discovery 已按原方案上线。 验证状态:条款撤回、重新评估承诺、当前默认关闭状态与设置分离均由 HubSpot 一手页面确认;未发现新的官方页面重新确认原方案在本日生效。
白宫完成先进模型自愿评测安排,但对外仍不可见
白宫完成先进模型自愿评测安排,但对外仍不可见 信号标题:政府预发布评测从起草阶段转入企业沟通 类型:政府评测 / 模型发布条件 来源或链接:Axios 当日报道;白宫 6 月 2 日行政命令 核心观点:8 月 3 日的新增事实是白宫宣布已按期完成相关安排,并称正在与更多企业讨论下一步;已知设计允许政府在发布前最多 30 天访问适用模型,但覆盖门槛、正式文本和启动日仍未公开。 为什么重要:模型发布节奏可能受政府评测影响,而客户无法仅凭公开信息判断哪些模型会被纳入。 影响:采购与产品团队应要求供应商说明审查是否影响发布日期、地域可用性、客户白名单与回退版本,并给关键上线项目预留延期空间。 验证状态:完成状态、三家实验室反馈、最长 30 天访问期与 8 月 4 日企业会议来自 Axios 对白宫官员及知情人士的当日报道;行政命令由白宫一手文件确认,具体安排未公开,故其操作细节仍未完全验证。
Google Earth 回滚生成式卫星图像,水印不再被视为充分防线
Google Earth 回滚生成式卫星图像,水印不再被视为充分防线 信号标题:Nano Banana 2 图像生成功能因虚假灾害与冲突图像被暂停 类型:产品规则变化 / 合成内容安全 来源或链接:The Atlantic 对 Google 回滚声明的原始报道;TechRadar 后续核验 核心观点:Google 在上线不足两天后撤回 Google Earth 内的生成图像入口;此前依赖 SynthID 和用户自行核验,随后改为暂停产品并补强防护。 为什么重要:当生成内容继承权威地图产品的视觉可信度时,事后水印不足以抵消传播中的误认风险。 影响:涉及新闻、灾害、保险、地产和 OSINT 的产品应把真实观测层与生成层硬隔离,并在导出图像上使用持续可见标识和来源链。 验证状态:回滚与 Google 声明由两家媒体直接引述确认;未找到 Google 独立公告页,故以一手回应经媒体交叉核验。