← 吴兆华个人网站站内作者版本 · 本页为长期 canonical · 最近核验 2026-07-21
GLOBAL AI / INTELLIGENCE
07.18—07.19
ROLLING UPDATE
GLOBAL AI INTELLIGENCE · BEIJING CALENDAR EDITION

今日全球
AI 情报

16 SIGNALS6 CORE DOSSIERS07.18—07.19ROLLING UPDATE
Qwen官方账号发布Qwen3.8-Max-Preview与2.4T参数信息的截图
01 / FRONTIER MODELS

前沿模型的参照系正在被中美玩家共同改写

WAIC现场展示真武M890芯片与超节点实例
02 / WAIC / FULL-STACK DELIVERY

WAIC的真正增量,是把模型接进算力、工作流与机器人

纽约证券交易所交易员资料图
03 / COMPUTE / CAPITAL

算力从稀缺资源,变成必须证明回报的长期资产

一分钟速览

16 SIGNALS / READ IN 60 SEC

六个核心情报专题

FACT · CHANGE · WATCH · IMPACT
01 · FRONTIER MODELS

前沿模型的参照系正在被中美玩家共同改写

Qwen把2.4T预览版与开放权重承诺绑定,xAI把Kimi写进下一代模型路线图,而Kimi K3又在7月18日获得更多全球独立报道。三条新闻共同说明:参数、开放路线、成本和真实任务能力正在进入同一张竞争表。

01

事实与状态

Alibaba Qwen厂商发布价值 4/5

Qwen3.8-Max-Preview上线:2.4T参数,官方承诺后续开放权重

Qwen官方于7月19日16:10宣布Qwen3.8-Max-Preview进入Token Plan、Qoder和QoderWork,并称模型规模达2.4T、完整版本将开放权重。

补充事实官方称Qwen3.8是其当前最强模型之一,并自评仅次于Fable 5;Preview已可在阿里Token Plan、Qoder和QoderWork体验。

事实边界2.4T是厂商披露的参数规模,不等于独立验证的能力;“仅次于Fable 5”是厂商排名主张;官方用词是“即将开放权重”,并非已经开源。

xAI / Elon Musk厂商发布价值 3/5

马斯克确认Grok 4.6路线:2T模型下周完成初始训练,公开点名Kimi

马斯克在X回复中称xAI的2T模型将在下周完成初始训练,速度与Token效率接近Grok 4.5,并称其“可能超过Kimi”;随后确认名称为Grok 4.6。

补充事实公开回复称2T模型在各方面优于1.5T版本,并希望保持接近Grok 4.5的速度与Token效率。IT之家同时记录马斯克确认“Grok 4.6”这一名称。

事实边界模型仍未完成初始训练,xAI尚未公布发布日期、技术报告或独立评测;“可能超过Kimi”是马斯克的预测,2T参数也不是能力保证。

Moonshot AI / Kimi K3权威报道价值 4/5

Kimi K3 的影响从发布转向全球竞争与成本重估

海外媒体与独立榜单记录K3在前端编码评测跃升;但综合榜单口径并不一致,不能写成“全面击败Fable 5或GPT-5.6”。

补充事实TechRadar与Washington Post的窗口内报道共同指向:K3的前端编码能力显著跃升,成本竞争受到关注;但现有证据不支持“所有维度全面领先”。

事实边界厂商基准、众包Arena和综合指数的题目、权重与推理预算不同,不能直接横向硬排名。

真正的变化

竞争重点已不再只是“谁发布了新模型”,而是谁能同时提供前沿能力、可承受成本与可部署路径。Kimi成为xAI公开参照,Qwen承诺开放权重,意味着中国模型正参与定义全球能力与成本基线。

接下来观察

Qwen权重、许可证与独立评测;Grok 4.6是否如期完成训练并给出技术报告;Kimi K3在不同任务、推理预算和部署环境中的可复现表现。

实际影响对象

个人

用户会获得更多强模型选择,但厂商排行不能替代实测。

公司

采购评估应同时比较任务效果、价格、部署权利和供应稳定性。

产业

开放模型正在压缩闭源前沿模型的定价与叙事空间。

国家

中国模型从追赶对象转为全球实验室公开使用的竞争参照。

02 · WAIC / FULL-STACK DELIVERY

WAIC的真正增量,是把模型接进算力、工作流与机器人

阿里把芯片、公共云超节点、开源软件栈和Agent云连成完整链路;腾讯把智能体推向海外协作渠道、移动端与机器人;商汤则把多模态模型与国产基础设施伙伴体系同步推出。

02

事实与状态

Alibaba Cloud / T-Head权威报道价值 5/5

阿里在WAIC打出“芯片—软件栈—Agent云”组合拳

阿里云发布灵骏真武M890超节点实例并在乌兰察布开放邀测,平头哥开源T-Head SAIL软件栈,同时发布Agent Native Cloud及AgentTeams、Agentic Computer。

补充事实M890实例以64卡算力单元提供服务并已开放邀测;SAIL提供SDK、内核驱动、性能分析与调试工具;Agent Native Cloud覆盖基础设施、开发平台和云桌面。现场所称800GB/s互联、单节点10T MoE推理及3倍训练性能均属于厂商口径。

事实边界M890芯片并非7月18日首次出现,窗口内真正的新事件是公共云超节点实例邀测、SAIL开放以及Agent Native Cloud产品化;性能数字尚缺独立基准。

Tencent厂商发布价值 3/5

腾讯把智能体推向海外与移动端,并升级具身智能全栈

腾讯在WAIC上线ADP 4.0海外版,发布WorkBuddy独立App,并公布具身模型、机器人智能体与云端EaaS方案。

补充事实报道列出的新增组件包括Hy-Embodied-VLA-0.5、VLM-1.0、RxBrain-1.0,以及TairosAgent、Apexio等产品;相关能力与落地数量均按腾讯发布口径呈现。

事实边界当前增量事实主要来自大会发布与媒体转述,尚缺独立客户侧效果数据,不能据此判断大规模商业化已经完成。

SenseTime厂商发布价值 3/5

商汤发布U1 Pro,并把多模态模型接入国产算力生态

商汤称U1 Pro统一理解、生成和行动、支持原生8K;同场公布20家国产化伙伴。能力数字属于厂商主张。

真正的变化

中国大厂的竞争对象正在从“单个模型能力”转向端到端交付:算力是否可用、工具链是否开放、Agent能否进入工作流、机器人能否由云端持续服务。产品栈越完整,客户迁移成本和平台黏性也越高。

接下来观察

M890实例的扩大可用范围与客户基准;腾讯海外版的真实采用、数据边界和机器人项目;商汤U1 Pro的独立效果、价格和国产软硬件适配范围。

实际影响对象

个人

开发者获得更多国产算力与Agent入口。

公司

采购对象从单模型变成芯片、云、工具链、治理和运维责任的组合。

产业

AI平台竞争向分发、具身执行与全栈交付延伸。

国家

自主AI基础设施开始以公共云和开放软件栈的形式争取生态。

03 · COMPUTE / CAPITAL

算力从稀缺资源,变成必须证明回报的长期资产

全球芯片股回调让资本开始追问AI投入的现金流回报;与此同时,Meta与Anthropic被报讨论最高100亿美元的两年期算力合作。市场与交易两端都在重估算力的价值和风险。

03

事实与状态

全球AI与半导体资产权威报道价值 4/5

全球AI与芯片股继续降温,资本开始追问回报

Reuters、AP与Bloomberg均记录芯片及AI相关资产下跌;费城半导体指数周跌约10%,较6月高点回落约20%。

Meta / Anthropic权威报道价值 4/5

Meta 与 Anthropic 商谈最高100亿美元算力合作

NYT线索经Reuters转述,FT独立跟进:双方讨论两年期算力安排;谈判早期、尚未签约,也可能不会完成。

真正的变化

算力不再只以“卡数”和资本开支衡量,而更像能源或容量合同:要看利用率、期限、价格、交付与现金流。竞争对手也可能互为供应方,模型阵营与基础设施阵营的边界正在交叉。

接下来观察

芯片与云厂商财报中的AI收入、利用率和自由现金流;Meta—Anthropic谈判是否签约、交付规模与价格;市场回调是否扩散到数据中心融资。

实际影响对象

个人

AI主题资产波动会继续放大,单日行情不能替代基本面判断。

公司

AI预算必须给出利用率、回收期和供应连续性。

产业

算力供应关系将更合同化、金融化和跨阵营化。

国家

大规模算力竞争会同时受资本成本与基础设施政策约束。

04 · SOCIAL LICENSE

AI数据中心第一次把“社会许可”推到全国议程

Reuters记录7月18日美国42州共142场抗议,地方报道确认部分活动实际举行。居民关注的不是抽象AI能力,而是电价、用水、土地、税收补贴和谁承担基础设施成本。

04

事实与状态

HumansFirst / 美国地方社区权威报道价值 4/5

AI数据中心扩张首次遭遇全美协调抗议

Reuters更新记录7月18日全美42州共142场抗议;地方媒体确认部分现场活动实际举行。

真正的变化

数据中心项目的约束从芯片、电力与审批,扩展到地方选民和公共成本分配。社会接受度会直接影响选址、工期、税收激励和项目规模,成为AI基础设施的硬变量。

接下来观察

地方许可是否延迟或附加条件;电价、水资源与电网升级成本如何分摊;项目是否迁址、缩减或增加社区补偿。

实际影响对象

个人

居民会更直接参与AI基础设施的成本与收益讨论。

公司

选址模型必须纳入社区沟通、公用事业与政治风险。

产业

数据中心建设周期和合规成本可能继续上升。

国家

AI竞争政策需要同时回答地方公共利益问题。

05 · GOVERNANCE / SECURITY

治理开始从原则,落到评测机构、董事会责任和补丁清单

美国讨论统一前沿模型评测机构;意大利央行要求金融机构把高级AI纳入DORA韧性治理;NVD新增Langflow漏洞记录。它们分别对应模型准入、组织责任和技术暴露面。

05

事实与状态

美国政府 / Demis Hassabis权威报道价值 4/5

美国讨论前沿模型统一评测机构,Hassabis继续推动框架

报道称政府内部考虑类FINRA的独立机构;方案尚在审阅,职权、资金和SEC角色均未确定。

Banca d’Italia已核实价值 5/5

意大利央行把高级AI风险纳入DORA韧性治理

正式沟通要求受监管机构建立董事会计划,覆盖第三方依赖、暴露面、补丁、监测和韧性测试,并在年底前报告。

Langflow已核实价值 4/5

NVD新增Langflow代码注入与远程执行风险记录

NVD在窗口内新增CVE-2026-9135等记录;当前证据证明漏洞记录发布,不等于已发生在野利用。

真正的变化

AI治理正在形成三层可执行结构:模型发布前要评测,组织层要有董事会计划与第三方风险管理,系统层要进入漏洞和补丁流程。治理不再只是伦理宣言,而是持续运营成本。

接下来观察

美国方案是否进入正式程序并明确权限;意大利受监管机构如何提交计划与报告;Langflow受影响版本、补丁覆盖率和在野利用证据。

实际影响对象

个人

自托管Agent工具的用户要核对版本并收紧网络暴露。

公司

建立AI资产、模型供应商、凭据、补丁和恢复测试清单。

产业

模型与Agent平台的合规门槛将从发布延伸到持续运营。

国家

安全评测制度可能成为影响全球模型准入的标准工具。

06 · MODEL SUPPLY

模型商业化的下一战,是套餐边界与可连续工作时间

Anthropic把Fable 5纳入部分订阅套餐,同时把Claude Code周限额临时提高50%。两条产品更新都指向同一问题:高成本模型和编码Agent如何在用户需求、容量与价格之间分配供给。

06

事实与状态

Anthropic厂商发布价值 3/5

Fable 5 留在会员体系,但套餐分层更清晰

7月20日起,Fable 5 纳入 Max 与 Team Premium 的50%周限额;Pro 与 Team Standard 继续按 usage credits 使用。

Anthropic Claude Code厂商发布价值 3/5

Claude Code 周限额提高50%,延续至8月19日

Anthropic 面向 Pro、Max、Team 与基于席位的 Enterprise 用户,把 Claude Code 周限额提高50%。

真正的变化

用户感知的产品能力不再只有模型分数,还包括能否稳定获得额度、可连续工作多久、超额成本如何计算。套餐设计正在成为模型竞争的一部分。

接下来观察

7月20日后Fable 5的真实额度、credits消耗与排队;Claude Code促销到期后是否延续;高峰期是否出现额外限流。

实际影响对象

个人

高频用户短期获得更多可用量,但要关注套餐和到期边界。

公司

团队席位的真实产能与预算需要重新评估。

产业

模型厂商会更多通过套餐、额度和credits管理稀缺供给。

国家

影响主要停留在产品供给与开发者生态层面。

其他值得跟踪

LOW HEAT · REAL SIGNAL
WAIC Academic官方日程截图
WAIC Academic厂商发布价值 2/5

首届WAIC Academic进入正式会期

事实与状态
官方日程显示首届WAICA于7月18日启动,设置论文报告与最佳论文现场评选。
真正的变化
高质量AI情报不能只追产品发布;论文评价、人才流动和议题设置决定中长期技术供给。
接下来观察
最佳论文与正式论文集;后续引用、开源成果和人才流动;议题是否影响下一阶段产业研发。
实际影响对象
个人:研究者与学生获得新的公开交流信号。;产业:企业可更早接触研究与人才。;国家:有助于提升中国在AI研究议题上的国际连接。
MiMo-Code官方GitHub提交截图
Xiaomi MiMo厂商发布价值 2/5

MiMo-Code新增数据、设计与销售技能包

事实与状态
小米MiMo官方仓库新增数据分析、产品设计、销售技能包,并补充技能包自动补全与中英文支持。
真正的变化
比营销口号更重要的是产品实际增加了哪些可调用技能;这是Agent业务化落地的直接信号。
接下来观察
功能是否进入正式版本;开发者采用量、问题反馈和修复速度;技能包能否沉淀为稳定接口。
实际影响对象
个人:开发者可以直接核对提交内容。;公司:业务技能包正成为Agent进入组织流程的产品入口。