前沿模型的参照系正在被中美玩家共同改写
Qwen把2.4T预览版与开放权重承诺绑定,xAI把Kimi写进下一代模型路线图,而Kimi K3又在7月18日获得更多全球独立报道。三条新闻共同说明:参数、开放路线、成本和真实任务能力正在进入同一张竞争表。
Qwen official X post · 2026-07-19 · 点击查看原图
Elon Musk official X reply · screenshot preserved by IT之家 · 点击查看原图
Associated Press source page · 点击查看原图事实与状态
Qwen3.8-Max-Preview上线:2.4T参数,官方承诺后续开放权重
Qwen官方于7月19日16:10宣布Qwen3.8-Max-Preview进入Token Plan、Qoder和QoderWork,并称模型规模达2.4T、完整版本将开放权重。
补充事实官方称Qwen3.8是其当前最强模型之一,并自评仅次于Fable 5;Preview已可在阿里Token Plan、Qoder和QoderWork体验。
事实边界2.4T是厂商披露的参数规模,不等于独立验证的能力;“仅次于Fable 5”是厂商排名主张;官方用词是“即将开放权重”,并非已经开源。
马斯克确认Grok 4.6路线:2T模型下周完成初始训练,公开点名Kimi
马斯克在X回复中称xAI的2T模型将在下周完成初始训练,速度与Token效率接近Grok 4.5,并称其“可能超过Kimi”;随后确认名称为Grok 4.6。
补充事实公开回复称2T模型在各方面优于1.5T版本,并希望保持接近Grok 4.5的速度与Token效率。IT之家同时记录马斯克确认“Grok 4.6”这一名称。
事实边界模型仍未完成初始训练,xAI尚未公布发布日期、技术报告或独立评测;“可能超过Kimi”是马斯克的预测,2T参数也不是能力保证。
Kimi K3 的影响从发布转向全球竞争与成本重估
海外媒体与独立榜单记录K3在前端编码评测跃升;但综合榜单口径并不一致,不能写成“全面击败Fable 5或GPT-5.6”。
补充事实TechRadar与Washington Post的窗口内报道共同指向:K3的前端编码能力显著跃升,成本竞争受到关注;但现有证据不支持“所有维度全面领先”。
事实边界厂商基准、众包Arena和综合指数的题目、权重与推理预算不同,不能直接横向硬排名。
真正的变化
竞争重点已不再只是“谁发布了新模型”,而是谁能同时提供前沿能力、可承受成本与可部署路径。Kimi成为xAI公开参照,Qwen承诺开放权重,意味着中国模型正参与定义全球能力与成本基线。
接下来观察
Qwen权重、许可证与独立评测;Grok 4.6是否如期完成训练并给出技术报告;Kimi K3在不同任务、推理预算和部署环境中的可复现表现。
实际影响对象
用户会获得更多强模型选择,但厂商排行不能替代实测。
采购评估应同时比较任务效果、价格、部署权利和供应稳定性。
开放模型正在压缩闭源前沿模型的定价与叙事空间。
中国模型从追赶对象转为全球实验室公开使用的竞争参照。












