MaaS 平台周度追踪
第 2026-08-04 期 · 完整周报归档
火山方舟(豆包) | 豆包搜索服务上线(7/28) | AI手机7-8月、Seedance API |
阿里百炼 | Qwen3.8正式版发布+API上线(8/3),下周开源权重 | Qwen3.8开源、千问办公上线钉钉 |
百度千帆 | 无新动态 | 8/12 DeepSeek-R1更新、8/14 Turbo升级 |
腾讯混元 | 无新动态 | V4原厂直供即将上线TokenHub |
硅基流动 | 无新动态 | 上市进程推进 |
智谱AI | GLM-5.5泄露:3T+参数,8月发布 | GLM-5.5发布(8月) |
Kimi | 无新动态 | 最快6个月内上市 |
MiniMax | H3正式开源(8/3),港股通在即 | 本周可能纳入港股通、M3 Pro(9-10月) |
DeepSeek | V4-Flash公测(7/31)、V4 GA推迟至8月中旬、融资暂停 | V4 GA(8/10-20)、第二轮融资 |
01头条新增阿里正式发布Qwen3.8正式版——2.4万亿参数,API上线千问AI平台,下周开源权重
8月3日,阿里巴巴正式发布新一代基座大模型Qwen3.8,总参数量2.4万亿,在编程(Coding)和专业办公(Cowork)方面能力大幅提升。今日放榜的权威三方榜单Arena中,阿里Qwen模型仅次于Anthropic的Claude系列,整体性能处于全球大模型第一梯队。关键信息:①API已上线千问AI平台,国内每百万Tokens输入12元、输出36元,隐式缓存命中仅1.5元;②国际价格仅为Opus5的40%(输入)与24%(输出);③Qwen3.8-Max预计下周开源,同时还将开源Qwen3.8-27B蒸馏版本;④阿里真武M890超节点已成功适配Qwen3.8,Agentic推理场景最多可实现1.5倍性能提升;⑤同步推出Agent产品"千问办公"(QwenWork),已开放网页端和PC客户端,钉钉PC端及手机端入口将于近期上线。这是继7月19日预览版后的正式版发布,兑现了"正式版将开放权重开源"的承诺。(跟进报道预览版:2026-07-24/07-31)
02MiniMax头条新增MiniMax H3正式开源——全模态生成模型,海光DCU与壁仞科技Day0适配
8月3日,MiniMax正式开源新一代多模态生成模型MiniMax H3。H3是一款通用的全模态生成模型,支持对文本、图像、视频、声音组成的多模态上下文的统一理解能力,能够输出具备原生双声道的音视频,最高可支持15s 2K分辨率。关键进展:①海光信息同步实现Day0极速适配,当日完成该模型在海光DCU平台的全流程适配、部署与性能验证;②壁仞科技基于SGLang推理框架,快速完成MiniMax H3在壁砺™系列GPU上的Day0适配与调优;③MiniMax股价当日涨超13%,MINIMAX-W报231.6港元;④预计8月初(本周内)有望获纳入港股通交易。此前7月31日MiniMax已正式发布H3并宣布计划开放权重,本周兑现开源承诺。(跟进报道H3发布:2026-07-31)
03DeepSeek头条新增DeepSeek V4-Flash正式版API开启公测——Agent能力远超V4-Pro预览版,价格极具竞争力
7月31日,DeepSeek官宣DeepSeek-V4-Flash正式版API开启公测。关键信息:①V4-Flash正式版大幅升级Agent能力,基准测试得分已远超V4-Pro预览版——Agent智能体终极测试中V4-Flash正式版得分25.2,接近Opus-4.8的25.7,远高于V4-Pro预览版的15.8;②价格维持极低水平:输入1元/百万Tokens,输出2元/百万Tokens;③相同任务GPT最强大模型需1分47秒,V4-Flash仅花40秒,价格相差几十倍至百倍。此外,据7月28日媒体报道,DeepSeek V4正式版(V4 GA)可能推迟到8月10-20日之间发布,DeepSeek已启动自研Harness工具封闭测试,测试结束后约1-2周开放V4 GA。DeepSeek第二轮融资谈判也已临时暂停。
04智谱头条跟进智谱GLM-5.5泄露信息曝光——3T+参数开放权重模型,目标对标GPT-6/Fable 5
8月2日,海外科技媒体WinCentral发布GLM-5.5泄露信息汇总。关键泄露信息:①GLM-5.5预计8月发布,总参数可能超过3万亿(3T+),远超此前社区预期的1万亿;②将继续开放权重(open-weight);③重点聚焦编码、推理和自主AI Agent能力;④目标直接对标GPT-6和Anthropic Fable 5/Mythos 5级别;⑤智谱可能跳过GLM-5.3直接发布GLM-5.5。截至8月4日,智谱官方尚未发布GLM-5.5的正式公告、模型卡或API端点。
05关注新增火山引擎上线豆包搜索服务——面向AI Agent时代的全面重构
7月28日,火山引擎正式上线豆包搜索服务。官方称为面向AI Agent时代的全面重构,重点解决传统AI搜索在长流程任务中信息不全、信源质量参差不齐等问题。核心能力:①能够跟随Agent任务推进自动调整检索方向,发现信息缺失时主动发起补充搜索,对多条网页内容进行交叉比对验证;②从网站站点和创作者两个维度建立权威分级体系,融合全域互联网信息、行业专业知识及字节跳动独家内容资源;③Agent原生输出,支持直接输出Markdown和结构化数据;④在SimpleQA、FreshQA、BrowseComp-ZH等多项公开评测中表现优异。接入方式包括独立API/Skill/MCP,以及Agent Plan一键配置。
06DeepSeek关注新增DeepSeek第二轮融资谈判暂停——V4 GA可能推迟至8月中旬
据7月26日彭博报道和7月28日国内媒体消息,DeepSeek已口头通知部分潜在投资者暂停第二轮融资协议签署。此轮融资原计划募集至少100亿元人民币,目标投后估值超4800亿元。同时,DeepSeek V4正式版(V4 GA)发布时间可能从7月中旬推迟至8月10-20日之间。DeepSeek正为自研Harness工具启动封闭测试,测试结束后约1-2周开放V4 GA。这意味着DeepSeek V4正式版上线时将面对更强竞争环境(GPT-6、GLM-5.5等可能已进入市场)。
各平台详细追踪9 个平台
豆包搜索服务正式上线(新增报道,7月28日):详见本周头条第5条。面向AI Agent时代重构,支持自动补充搜索、交叉验证、权威分级、Agent原生输出。
近期回顾 4 条
模型列表页面7月20日更新:确认Seed-Evolving为当前最新模型。
火山引擎FORCE Link巡展多项发布(7月17日):SeedEdit 3.0、同声传译2.0、豆包1.6升级、扣子开源等。
豆包大模型日均Token调用量突破180万亿,IDC数据中国公有云MaaS市场份额49.5%稳居第一。
豆包AI手机预计7-8月面世。
Qwen3.8正式版发布(新增报道,8月3日):详见本周头条第1条。2.4万亿参数,API已上线,下周开源权重+27B蒸馏版。
千问办公(QwenWork)同步推出:企业级Agent产品,已开放网页端和PC客户端。
近期回顾 6 条
Qwen3.7-Flash上线(7月25日):多模态理解与Agent能力全面提升。
Qwen3.8-Max-Preview发布(7月19日):2.4万亿参数,原生多模态,日间1折夜间0.2折。
Qwen-Audio-3.0-TTS(7月14日):Plus版全球登顶,Flash版首包300ms。
Qwen-Image-3.0-Pro(7月21日):支持长文本输入与图中图密集排版。
Qwen3-Coder正式发布(7月23日):480B参数激活35B的MoE模型。
第二批模型下线延期至10月10日。
近期回顾 5 条
7月18日更新节点已按计划执行:ERNIE-4.5-300B-A47B-Base-Paddle导入推理上线、Qwen3系列导入推理上线、ERNIE-4.5-VL视频理解上线。
Kimi-K2.5和MiniMax-M2.5于7月9日退役下线。
ERNIE-4.5-Turbo-32K/128K预计8月14日全面升级。
DeepSeek-R1预计8月12日自动更新至250528版本。
ERNIE 5.1-Preview在LMArena中国模型排名第一。
近期回顾 4 条
腾讯混元Hy3正式发布(7月6日):MoE架构,总参数295B、激活21B,256K上下文。Agent能力质变——WorkBuddy任务成功率从72%跃升至90%。Apache 2.0开源。
姚顺雨统一管理混元大语言模型部与多模态模型部(7月23日):组建"基础模型部",成为混元技术研发一号人物。
TokenHub模型列表7月16日更新:DeepSeek-V3.2已下线,Kimi K3已上架。
DeepSeek-V4原厂直供计划7月中旬上线(尚未正式公告上线)。
近期回顾 4 条
Kimi K3已上架硅基流动:首页标注"Kimi-K3 可以在 SiliconFlow 上使用"。
硅基流动向港交所递交上市申请(6月30日):2025年营收5533万元(同比增653%),净亏损3.45亿元。注册用户1028万。平台已上架170+模型。
截至2026年4月日均词元吞吐量约5,785亿次,单日最高约10,714亿次。
当前定价体系:DeepSeek-V4-Pro输入12元/M Tokens,输出24元;V4-Flash输入1元,输出2元;GLM-5.2输入6元,输出28元;Kimi-K2.7-Code输入6.50元,输出27元。
GLM-5.5泄露信息汇总曝光(跟进报道,8月2日):详见本周头条第4条。3T+参数、开放权重、对标GPT-6/Fable 5。截至8月4日官方尚未正式公告。
近期回顾 7 条
GLM-PPE推理模型发布(7月16日):专注Agentic Coding场景。
GLM-5.2(6月17日全量开放,MIT开源):753B参数,百万token稳定上下文。
智谱ARR冲击10亿美元(7月报道):5个月增长15倍,核心增长来自Coding路线。
智谱数亿元收购中科加禾(7月17日):强化国产算力适配与推理优化。
唐杰发布《巨浪已来》内部信(7月11日):"Touch High(摸高)计划"。
年内三次提价累计涨幅83%,调用量反增400%。
智谱已纳入恒生科技指数(6月8日生效)。
近期回顾 7 条
K3完整权重与技术报告正式开源(7月27日):2.88万亿参数,KDA架构,896专家激活16个,Modified MIT许可证。
Formula Tools API正式上线(7月30日):支持联网搜索等官方工具通过标准function tool协议集成,限时免费。
K3开源后生态快速扩展:登顶HuggingFace本周热门模型榜;华为昇腾完成Day0推理适配;OsmanticAI发布KDA高性能算子(H20 prefill速度提升1.72-2.22倍);Kimi Code更新支持K3。
K3性价比数据:BrowseComp基准单次任务成本仅为GPT-5.6 Sol的一半,较Claude Fable 5便宜近一个数量级。
上市计划推进中:已向投资人发送上市议案,预计最快6个月内完成港交所上市,估值可能超300亿美元。
ARR突破3亿美元(6月中旬):API收入占总收入70%+。
最快6个月内:港交所上市。
H3正式开源(新增报道,8月3日):详见本周头条第2条。全模态生成模型,海光DCU与壁仞科技Day0适配。
股价大涨13%:MINIMAX-W报231.6港元,成交额6.91亿港元。
预计8月初纳入港股通:MiniMax于今年1月9日港股上市,需满足上市满6个月及20个交易日要求,预计8月初具备纳入港股通资格。
近期回顾 9 条
高盛重申"买入"评级(7月24日):12个月目标价860港元。M3日处理万亿级Token,API已实现健康毛利率。
美银证券维持"买入"评级:目标价500港元。4月ARR已达4亿美元,年底目标10亿美元。
M3 Pro发布窗口明确:预计9-10月推出,参数约2.7万亿,稀疏注意力+KV Cache优化。
MiniMax Agent全栈开发功能发布(7月16日)。
完成160亿港元新一轮融资(7月10日)。
M3正式开源(6月15日):428B参数,MSA稀疏注意力架构,1M上下文。
已纳入恒生科技指数(6月8日生效)。
本周内:可能获纳入港股通。
9-10月:M3 Pro发布(2.7万亿参数)。
V4-Flash正式版API开启公测(新增报道,7月31日):详见本周头条第3条。Agent能力远超V4-Pro预览版,价格极具竞争力。
V4 GA可能推迟至8月10-20日(新增报道):自研Harness工具封闭测试中,测试结束后1-2周开放V4 GA。
第二轮融资谈判暂停(新增报道):原计划募集至少100亿元,投后估值超4800亿元。已口头通知部分投资者暂停。
近期回顾 5 条
V4正式版7月20日发布:V4-Pro(1.6T参数,激活49B)和V4-Flash(284B参数,激活13B),均支持1M上下文。
旧API已于7月24日正式废弃:deepseek-chat和deepseek-reasoner停止服务。
峰谷定价已生效:V4 Pro高峰输出12元/M Tokens(平时6元),V4 Flash高峰输出4元(平时2元)。高峰时段:每日9:00-12:00和14:00-18:00。
DSSpark推理加速框架(7月2日发布):V4推理速度提升60-85%。
DeepSeek完成首轮外部融资(6月16日):募资超500亿元,投后估值突破3380亿元。
趋势洞察5 条
01. 8月3日成为国产大模型"超级发布日"——Qwen3.8、MiniMax H3、GLM-5.5泄露同日引爆
8月3日,阿里Qwen3.8正式版和MiniMax H3开源同日发布,加上GLM-5.5泄露信息在8月2日曝光,形成了一个史无前例的国产大模型密集发布窗口。Qwen3.8(2.4万亿参数)走"企业级多模态+办公Agent"路线,H3走"全模态统一理解与生成"路线,GLM-5.5(3T+参数泄露)走"开放权重+对标Fable 5"路线。三家头部平台同时选择8月初发布,标志着下半年国产大模型竞争已全面打响。
02. 开源权重成为"标配"——一周内三个万亿级模型开放权重
MiniMax H3(8月3日开源)、Qwen3.8-Max(下周开源)、Qwen3.8-27B(下周开源)——加上7月27日已开源的Kimi K3(2.88万亿),短短两周内有4个万亿级或十亿级模型开放权重。开源已不再是"次品处理",而是头部平台的战略选择。智谱GLM-5.5泄露信息也显示将继续开放权重。这标志着"开放权重"已成为中国大模型行业的默认策略。
03. DeepSeek进入"战略调整期"——V4 GA推迟+融资暂停
DeepSeek正面临前所未有的竞争压力。V4-Pro预览版在Artificial Analysis排名已跌至25位,低于Kimi K2.7 Code;V4-Flash正式版虽Agent能力出色但定位偏轻量。V4 GA推迟至8月10-20日意味着DeepSeek正式版上线时将直面GLM-5.5、Qwen3.8正式版、MiniMax H3等强敌。第二轮融资暂停更增加了不确定性。不过V4-Flash正式版在Agent测试中接近Opus-4.8的表现(25.2 vs 25.7),以1元/2元的极低定价,可能成为"性价比之王"。
04. 国产算力适配成为新赛道——海光、壁仞、昇腾竞相Day0适配
MiniMax H3开源当天,海光信息和壁仞科技同步完成Day0适配——这已形成模式。此前Kimi K3开源时华为昇腾也完成了Day0适配。国产大模型开源后,国产算力厂商迅速跟进适配,形成"国产模型+国产算力"的完整闭环。壁仞科技基于SGLang推理框架、海光基于DCU平台,都在争抢"开源生态第一适配"的位置。这标志着国产算力生态已从"被动适配"转向"主动竞速"。
05. MaaS平台搜索能力成为新竞争维度
火山引擎上线豆包搜索服务,面向AI Agent时代重构搜索能力——支持自动补充搜索、交叉验证、权威分级、Agent原生输出。这标志着MaaS平台的竞争已从"模型能力"扩展到"工具链能力"。此前Kimi的Formula Tools API也是类似方向。搜索能力作为Agent的核心工具,正成为各平台差异化竞争的关键维度。
关注时间点14 项
本周内 | MiniMax可能获纳入港股通 | MiniMax |
8月(预计) | 智谱GLM-5.5发布(3T+参数,泄露信息) | 智谱AI |
8月10-20日(预计) | DeepSeek V4 GA正式版发布 | DeepSeek |
下周 | Qwen3.8-Max开源权重+Qwen3.8-27B开源 | 阿里百炼 |
7月-8月 | 豆包AI手机面世 | 火山方舟 |
即将上线 | DeepSeek V4原厂直供上线腾讯TokenHub | 腾讯混元/DeepSeek |
即将上线 | 千问办公(QwenWork)钉钉入口 | 阿里百炼 |
8月12日 | 百度千帆DeepSeek-R1更新至250528 | 百度千帆 |
8月14日 | 百度千帆ERNIE-4.5-Turbo全面升级 | 百度千帆 |
8月23日 | Qwen3-Coder-Plus限时优惠截止 | 阿里百炼 |
9-10月 | MiniMax M3 Pro发布(2.7万亿参数) | MiniMax |
最快6个月内 | 月之暗面港交所上市 | Kimi |
10月10日 | 阿里百炼所有剩余模型统一下线 | 阿里百炼 |
2027年1月 | 智谱约40%股份将陆续解禁 | 智谱AI |
已报道事件索引26 期
- [2026-08-04]
阿里Qwen3.8正式版发布+API上线(8/3)、MiniMax H3正式开源(8/3)、DeepSeek V4-Flash正式版公测(7/31)、DeepSeek V4 GA推迟至8月中旬+融资暂停、智谱GLM-5.5泄露3T+参数(8/2)、火山引擎豆包搜索服务上线(7/28)
- [2026-07-31]
Kimi K3 Formula Tools API上线(7/30)、K3生态快速扩展(昇腾Day0适配/HuggingFace登顶/KDA算子优化/Kimi Code更新)、MiniMax 8月6日有望纳入港股通(美银目标价500港元/ARR 4亿美元)、DeepSeek V4三模态版本界面曝光(快速/专家/视觉)、智谱GLM-5.5进入8月发布窗口、阿里Qwen3.8-Max正式版即将发布+开源、腾讯TokenHub等待V4原厂直供上线
- [2026-07-28]
Kimi K3完整权重+技术报告+Infra技术正式开源(7/27)、Qwen3.7-Flash上线(7/25)、高盛重申MiniMax买入目标价860港元、智谱GLM-5.5预计8月发布(摩根大通/路透社)、智谱ARR冲击10亿美元、智谱收购中科加禾、DeepSeek旧API正式废弃(7/24)、K3发现Linux零日漏洞
- [2026-07-24]
DeepSeek V4正式版发布(7/20)、Qwen3.8-Max-Preview发布、GLM-PPE发布、GLM-5.5确认即将推出、Qwen-Audio-3.0-TTS发布、Qwen-Image-3.0-Pro邀测上线、Kimi算力承压暂停C端订阅、MiniMax H3 WAIC曝光、K3多平台上架、DeepSeek旧API废弃日(7/24)
- [2026-07-21]
DeepSeek V4灰度测试、百度千帆7月18日更新已执行、阿里百炼7月产品月刊、Kimi K3权重开源倒计时、DeepSeek旧API废弃倒计时、腾讯云TokenHub等待V4原厂直供
- [2026-07-17]
Kimi K3正式发布、Kimi Playground上线、火山引擎FORCE Link巡展多项发布、MiniMax Agent全栈开发功能发布、拟人化互动办法实施+豆包智能体下线、腾讯云V3.2下线、DeepSeek V4正式版本周上线倒计时
- [2026-07-14]
Seedance 2.5正式上线体验中心、智谱唐杰《巨浪已来》内部信发布"摸高"计划、阿里Qwen3-30B-A3B-Thinking-2507推理模型发布
- [2026-07-12]
MiniMax完成160亿港元融资、闫俊杰承诺AGI前不领薪、百度千帆Qwen3-Embedding流控放大按计划上线
- [2026-07-11]
阿里百炼第二批模型下线延期至10月10日、火山方舟Agent Plan文档更新
- [2026-07-10]
MiniMax解禁首日大跌18%、阿里禁Claude正式生效、千问智能体功能下线
- [2026-07-09]
MiniMax解禁首日大跌18%、智谱解禁首日涨13%
- [2026-07-08]
阿里百炼第一批历史快照模型正式下线、中国互联网大会开幕、花旗下调MiniMax目标价60%
- [2026-07-07]
腾讯混元Hy3正式发布、MiniMax股价从高点跌72%
- [2026-07-06]
阿里全面禁用Claude Code、豆包/千问同步下线智能体功能、阿里云Qoder企业版发布
- [2026-07-04]
豆包付费订阅上线、智谱AI市值波动
- [2026-07-03]
Kimi K3确认本月发布、美团LongCat-2.0发布、DeepSeek峰谷定价热议
- [2026-07-02]
DeepSeek DSpark推理加速框架发布、阿里百炼7月13日将下线历史主线模型(→已延期至10月10日)
- [2026-07-01]
Kimi新一轮融资启动(估值315亿美元)、MiniMax M2.1发布
- [2026-06-30]
美团LongCat-2.0发布、腾讯开源Hunyuan-A13B、百度文心4.5系列开源、硅基流动递交上市申请
- [2026-06-29]
OpenAI GPT-5.6有限预览发布、百度千帆Token Plan企业版发布
- [2026-06-27]
MiniMax Hailuo 2.3视频模型发布
- [2026-06-25]
DeepSeek V4.1正式发布
- [2026-06-24]
火山方舟·豆包2.1 Pro正式发布、豆包付费订阅服务上线
- [2026-06-17]
智谱GLM-5.2正式上线并开源
- [2026-06-16]
硅基流动完成超20亿元B轮融资
- [2026-06-12]
MiniMax M3正式开源、Kimi K2.7 Code开源发布