AI 工具采购必须把“可用量”当作价格核心:月费不变而额度回落,同样会抬高每个完成任务的成本,企业应以任务吞吐和失败重跑量核算真实单价。
今日结论
开源模型的护城河正在外移到入口与生态:权重本身越来越容易获得,真正稀缺的是开发者分发、推理容量、应用内默认入口和可复现的生产评测。
模型公司正在争夺两种控制权:对上要控制数据、算力和分发,对下要保留拒绝特定用途的权利;商业合作若缺少访问连续性与用途边界条款,技术选型会迅速变成经营风险。
AI 产品与应用
Claude Code 永久额度高于旧基线,但低于当前促销水平
查看完整拆解
Anthropic 的 Claude 开发者账号宣布:自 9 月 14 日起,Pro、Max、Team 与按席位计费的 Enterprise 计划,其 Claude Code 标准周额度将永久提高到旧基线的 125%;在此之前,当前 150% 的临时额度继续有效。换算后,新政策相对当前水平减少约 16.7%。Anthropic 官方 X 帖;BleepingComputer 核验与换算
这不是标价变化,却会直接改变重度开发团队的单位产出成本。当前周用量若超过额度条的约五分之六,9 月 14 日后同样工作负载就无法在订阅额度内完成。采购方应把模型组合、并发任务、上下文长度和超额 API 成本纳入容量预算,而不是把“永久增加 25%”误读为相对今天继续加量。
Anthropic 的 Claude 开发者账号宣布:自 9 月 14 日起,Pro、Max、Team 与按席位计费的 Enterprise 计划,其 Claude Code 标准周额度将永久提高到旧基线的 125%;在此之前,当前 150% 的临时额度继续有效。换算后,新政策相对当前水平减少约 16.7%。Anthropic 官方 X 帖;BleepingComputer 核验与换算
这不是标价变化,却会直接改变重度开发团队的单位产出成本。当前周用量若超过额度条的约五分之六,9 月 14 日后同样工作负载就无法在订阅额度内完成。采购方应把模型组合、并发任务、上下文长度和超额 API 成本纳入容量预算,而不是把“永久增加 25%”误读为相对今天继续加量。
模型与技术进展
腾讯 Hy4 preview 把 1M 上下文与产品分发同时开源落地
查看完整拆解
腾讯 8 月 28 日发布并开源 Hy4 preview。模型采用 MoE 架构,总参数 770B、激活参数 49B,上下文超过 1M tokens;已进入 WorkBuddy、CodeBuddy、元宝和 ima,并可经腾讯云 TokenHub 与 OpenRouter 调用。WorkBuddy 与 CodeBuddy 提供两周免费体验,Hy3 的免费期延长至 9 月 30 日。腾讯官方发布
腾讯披露的 163 名内部专家、203 个工程任务盲测中,Hy4 preview 平均得分 2.99/4.00,略高于其给出的 GLM-5.3 与 Kimi K3 对照;这些仍是厂商自测,尚不能替代独立评估。真正值得跟踪的是“模型—办公/编码产品—云 API”同步上线:企业评估开源模型时,应把实际任务成功率、显存需求和迁移成本放在参数量之前。
腾讯 8 月 28 日发布并开源 Hy4 preview。模型采用 MoE 架构,总参数 770B、激活参数 49B,上下文超过 1M tokens;已进入 WorkBuddy、CodeBuddy、元宝和 ima,并可经腾讯云 TokenHub 与 OpenRouter 调用。WorkBuddy 与 CodeBuddy 提供两周免费体验,Hy3 的免费期延长至 9 月 30 日。腾讯官方发布
腾讯披露的 163 名内部专家、203 个工程任务盲测中,Hy4 preview 平均得分 2.99/4.00,略高于其给出的 GLM-5.3 与 Kimi K3 对照;这些仍是厂商自测,尚不能替代独立评估。真正值得跟踪的是“模型—办公/编码产品—云 API”同步上线:企业评估开源模型时,应把实际任务成功率、显存需求和迁移成本放在参数量之前。
投融资与商业动态
NVIDIA 拟以 129 亿美元收购 Hugging Face,交易状态仍未获双方确认
查看完整拆解
The Information 引述知情人士称 NVIDIA 已同意以 129 亿美元收购 Hugging Face;但同期 Business Insider 称谈判尚未形成签署协议。TechCrunch 向两家公司求证,截至本期截稿双方均未回应。TechCrunch 报道与状态核验
若成交,NVIDIA 买到的不只是模型仓库,还包括数百万开发者的发现、评测与部署入口,并可把开放权重需求导向自身 GPU 和云容量。129 亿美元相对 Hugging Face 2023 年 45 亿美元估值显著上升,而报道所称年化收入约 1.5 亿美元,说明估值主要押注生态控制力。当前最重要的商业纪律是:不要把报道中的“同意收购”当成正式完成,仍需等待公司公告、交易文件和监管条件。
The Information 引述知情人士称 NVIDIA 已同意以 129 亿美元收购 Hugging Face;但同期 Business Insider 称谈判尚未形成签署协议。TechCrunch 向两家公司求证,截至本期截稿双方均未回应。TechCrunch 报道与状态核验
若成交,NVIDIA 买到的不只是模型仓库,还包括数百万开发者的发现、评测与部署入口,并可把开放权重需求导向自身 GPU 和云容量。129 亿美元相对 Hugging Face 2023 年 45 亿美元估值显著上升,而报道所称年化收入约 1.5 亿美元,说明估值主要押注生态控制力。当前最重要的商业纪律是:不要把报道中的“同意收购”当成正式完成,仍需等待公司公告、交易文件和监管条件。
政策、伦理与安全
法院撤销五角大楼对 Anthropic 的供应链风险认定
查看完整拆解
美国加州北区联邦地区法院法官 Rita Lin 在 59 页裁定中认定,五角大楼把 Anthropic 列为供应链风险的措施“违法且缺乏依据”,并阻止其继续执行。争议源于 Anthropic 拒绝允许 Claude 用于美国国内监控或自主武器;政府主张供应商不能限制军事用途,Anthropic 则主张该处罚构成对其安全立场的言论报复。Reuters 报道;AP 报道
裁决为 AI 供应商拒绝高风险用途提供了程序性保护,但不等于 Anthropic 已恢复全部政府业务:其在华盛顿特区针对另一项可能波及民用政府合同的认定仍有诉讼在审。对公共部门采购而言,模型用途边界、停用权和争议解决机制需要在合同阶段写清,不能在部署后再靠行政认定或临时封禁处理。
美国加州北区联邦地区法院法官 Rita Lin 在 59 页裁定中认定,五角大楼把 Anthropic 列为供应链风险的措施“违法且缺乏依据”,并阻止其继续执行。争议源于 Anthropic 拒绝允许 Claude 用于美国国内监控或自主武器;政府主张供应商不能限制军事用途,Anthropic 则主张该处罚构成对其安全立场的言论报复。Reuters 报道;AP 报道
裁决为 AI 供应商拒绝高风险用途提供了程序性保护,但不等于 Anthropic 已恢复全部政府业务:其在华盛顿特区针对另一项可能波及民用政府合同的认定仍有诉讼在审。对公共部门采购而言,模型用途边界、停用权和争议解决机制需要在合同阶段写清,不能在部署后再靠行政认定或临时封禁处理。
X 平台高信号
1. 信号标题:ChatGPT 开始自动把满 18 岁账户转为成人设置 类型:账户规则 / 年龄访问 来源或链接:[OpenAI 帮助中心](https://help.openai.com/en/articles/20001262-what-changes-when-a-chatgpt-user-turns-18) 核心观点:符合条件的账户正逐步启用自动转换;系统在识别用户已满 18 岁后,默认关闭青少年保护、解除已连接的家长控制,并提前约一周通知账户持有人及已连接的家长或监护人。 为什么重要:年龄识别不再只决定未成年人进入何种体验,也开始自动触发权限、内容保护和家庭连接的退出流程。 影响:面向青少年的学校与家庭部署需要记录年龄误判、重新验证和家长连接中断的处理流程;成人若仍需要额外保护,必须自行重新开启敏感内容限制或重新建立控制关系。 验证状态:转换规则、通知时间和重新验证路径均由 OpenAI 一手帮助文档确认;功能为逐步推出,不代表所有地区和账户已同时生效。 2. 信号标题:Gemini 3.5 Transcribe 进入公开预览并给出按音频分钟计价 类型:产品访问 / API 定价 来源或链接:[Google 官方发布](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-5-transcribe/);[Google Cloud 定价页](https://cloud.google.com/gemini-enterprise-agent-platform/generative-ai/pricing) 核心观点:开发者可在 Gemini API 与 Google AI Studio 使用实时和录音两种转写模型;Google Cloud 给出的估算混合价格约为实时 0.009 美元/音频分钟、文件转写 0.005 美元/音频分钟,后者支持最长 60 分钟文件。 为什么重要:语音 agent 的基础成本正在从“每小时转写服务”降为可直接嵌入通用模型 API 的分钟级组件,并同时提供说话人识别、时间戳和自定义词表。 影响:客服、会议纪要和现场字幕团队可重新测算自建流水线;但“智能清理”会改写口头表达,审计、医疗或法律场景仍应保存原始音频并单独评估逐字准确率。 验证状态:访问渠道、功能与价格由 Google 一手页面确认;4.0% 实时和 2.6% 非实时平均词错率为 Google 引用第三方 Artificial Analysis 的结果,需按具体语言、噪声和行业词表复测。 3. 信号标题:AWS 承诺在 2027—2028 年新增部署 200 万块 NVIDIA GPU 类型:基础设施投入 / 硬采购量 来源或链接:[AWS 与 NVIDIA 联合公告](https://press.aboutamazon.com/aws/2026/8/aws-and-nvidia-to-deliver-2-million-additional-gpus-and-next-generation-infrastructure-for-agentic-and-physical-ai) 核心观点:AWS 将在 2027—2028 年新增 200 万块 Blackwell Ultra、Rubin 与 Rubin Ultra GPU,并计划为美国政府安全基础设施部署其中 10 万块;此前 AWS 已宣布自 2026 年起增加逾 100 万块 NVIDIA GPU。 为什么重要:这是可量化的多年供给承诺,说明训练、agent 与物理 AI 需求已被云厂商写入跨代芯片采购,而非停留在季度资本开支口径。 影响:企业可预期 GPU 供给继续扩张,但跨代部署也会带来电力、网络、折旧和利用率风险;长期算力合同需要明确具体芯片代际、上线区域和未按期交付的补偿。 验证状态:数量、时间范围、芯片代际及美国政府部分均由两家公司一手联合公告确认;具体采购金额、区域分配和实际到货进度未披露。 4. 信号标题:Anthropic 向首批实验室和制造商开放 Model Hardware Standard 研究预览 类型:平台规则 / 物理设备访问 来源或链接:[Anthropic 官方说明](https://www.anthropic.com/news/model-hardware-standard-research-preview) 核心观点:MHS 用统一驱动把显微镜、移液器、机械臂等可编程设备暴露给 agent,并通过 read/write 原语、设备描述与安全限制减少定制集成;当前仅向申请通过的科研机构和先进制造商开放,未来计划开源。 为什么重要:agent 的权限边界从文件和 SaaS API 扩展到真实设备,设备发现、命令白名单、状态回传与物理安全限制开始成为同一产品层的问题。 影响:实验室自动化供应商可把数周至数月的设备适配压缩到更短周期,但在无人值守前仍需独立急停、碰撞检测、操作日志和人工放行;Anthropic 自己也披露模型会因缺少物理直觉而错误重试。 验证状态:研究预览范围、技术机制和案例由 Anthropic 一手发布确认;Genentech、华盛顿大学和 CMU 的结果仍属合作方概念验证,未形成跨设备独立复现。 5. 信号标题:LAION-BVD 的“开放”分为公开元数据与受限媒体访问 类型:数据访问 / 训练资源规则 来源或链接:[LAION 项目页](https://projects.laion.ai/bvd/);[arXiv 论文](https://arxiv.org/abs/2608.24845) 核心观点:项目公布 13 亿条平台视频 URL、8000 万段已下载视频和约 1000 万小时总时长,并生成 5500 万条带合成描述的片段与 3 亿帧图像;公开可直接获得的核心是 URL 与元数据,原始视频和处理后媒体须按研究用途申请访问。 为什么重要:大规模多模态训练数据的“可见、可申请、可商用”是三种不同权限;只看数据集规模会高估中小团队能够立即使用的训练资产。 影响:研究团队在启动下载和训练前,应核对访问批准、存储成本、平台条款、版权与内容安全责任;商业团队不能把研究开放自动等同于可用于产品训练。 验证状态:规模、生成流程和研究发布由 LAION 项目页与论文确认;具体访问层级需以数据仓库审批条款为准,模型效果为作者报告,尚无独立大规模复现。
1. 信号标题:ChatGPT 开始自动把满 18 岁账户转为成人设置 类型:账户规则 / 年龄访问 来源或链接:OpenAI 帮助中心 核心观点:符合条件的账户正逐步启用自动转换;系统在识别用户已满 18 岁后,默认关闭青少年保护、解除已连接的家长控制,并提前约一周通知账户持有人及已连接的家长或监护人。 为什么重要:年龄识别不再只决定未成年人进入何种体验,也开始自动触发权限、内容保护和家庭连接的退出流程。 影响:面向青少年的学校与家庭部署需要记录年龄误判、重新验证和家长连接中断的处理流程;成人若仍需要额外保护,必须自行重新开启敏感内容限制或重新建立控制关系。 验证状态:转换规则、通知时间和重新验证路径均由 OpenAI 一手帮助文档确认;功能为逐步推出,不代表所有地区和账户已同时生效。
2. 信号标题:Gemini 3.5 Transcribe 进入公开预览并给出按音频分钟计价 类型:产品访问 / API 定价 来源或链接:Google 官方发布;Google Cloud 定价页 核心观点:开发者可在 Gemini API 与 Google AI Studio 使用实时和录音两种转写模型;Google Cloud 给出的估算混合价格约为实时 0.009 美元/音频分钟、文件转写 0.005 美元/音频分钟,后者支持最长 60 分钟文件。 为什么重要:语音 agent 的基础成本正在从“每小时转写服务”降为可直接嵌入通用模型 API 的分钟级组件,并同时提供说话人识别、时间戳和自定义词表。 影响:客服、会议纪要和现场字幕团队可重新测算自建流水线;但“智能清理”会改写口头表达,审计、医疗或法律场景仍应保存原始音频并单独评估逐字准确率。 验证状态:访问渠道、功能与价格由 Google 一手页面确认;4.0% 实时和 2.6% 非实时平均词错率为 Google 引用第三方 Artificial Analysis 的结果,需按具体语言、噪声和行业词表复测。
3. 信号标题:AWS 承诺在 2027—2028 年新增部署 200 万块 NVIDIA GPU 类型:基础设施投入 / 硬采购量 来源或链接:AWS 与 NVIDIA 联合公告 核心观点:AWS 将在 2027—2028 年新增 200 万块 Blackwell Ultra、Rubin 与 Rubin Ultra GPU,并计划为美国政府安全基础设施部署其中 10 万块;此前 AWS 已宣布自 2026 年起增加逾 100 万块 NVIDIA GPU。 为什么重要:这是可量化的多年供给承诺,说明训练、agent 与物理 AI 需求已被云厂商写入跨代芯片采购,而非停留在季度资本开支口径。 影响:企业可预期 GPU 供给继续扩张,但跨代部署也会带来电力、网络、折旧和利用率风险;长期算力合同需要明确具体芯片代际、上线区域和未按期交付的补偿。 验证状态:数量、时间范围、芯片代际及美国政府部分均由两家公司一手联合公告确认;具体采购金额、区域分配和实际到货进度未披露。
4. 信号标题:Anthropic 向首批实验室和制造商开放 Model Hardware Standard 研究预览 类型:平台规则 / 物理设备访问 来源或链接:Anthropic 官方说明 核心观点:MHS 用统一驱动把显微镜、移液器、机械臂等可编程设备暴露给 agent,并通过 read/write 原语、设备描述与安全限制减少定制集成;当前仅向申请通过的科研机构和先进制造商开放,未来计划开源。 为什么重要:agent 的权限边界从文件和 SaaS API 扩展到真实设备,设备发现、命令白名单、状态回传与物理安全限制开始成为同一产品层的问题。 影响:实验室自动化供应商可把数周至数月的设备适配压缩到更短周期,但在无人值守前仍需独立急停、碰撞检测、操作日志和人工放行;Anthropic 自己也披露模型会因缺少物理直觉而错误重试。 验证状态:研究预览范围、技术机制和案例由 Anthropic 一手发布确认;Genentech、华盛顿大学和 CMU 的结果仍属合作方概念验证,未形成跨设备独立复现。
5. 信号标题:LAION-BVD 的“开放”分为公开元数据与受限媒体访问 类型:数据访问 / 训练资源规则 来源或链接:LAION 项目页;arXiv 论文 核心观点:项目公布 13 亿条平台视频 URL、8000 万段已下载视频和约 1000 万小时总时长,并生成 5500 万条带合成描述的片段与 3 亿帧图像;公开可直接获得的核心是 URL 与元数据,原始视频和处理后媒体须按研究用途申请访问。 为什么重要:大规模多模态训练数据的“可见、可申请、可商用”是三种不同权限;只看数据集规模会高估中小团队能够立即使用的训练资产。 影响:研究团队在启动下载和训练前,应核对访问批准、存储成本、平台条款、版权与内容安全责任;商业团队不能把研究开放自动等同于可用于产品训练。 验证状态:规模、生成流程和研究发布由 LAION 项目页与论文确认;具体访问层级需以数据仓库审批条款为准,模型效果为作者报告,尚无独立大规模复现。