AI大模型周报:智谱认领“牛来模型”;云从科技上半年营收下滑超四成;传爱诗科技已秘交招股书;传月之暗面与微软、亚马逊洽谈Kimi K3托管分成…

本期速览:

1. 智谱认领“牛来模型”;

2. 传爱诗科技已秘交招股书;

3. 云从科技上半年营收下滑超四成;

4. 传月之暗面与微软、亚马逊等洽谈Kimi K3托管分成;

5. 腾讯辟谣重组AI游戏部门传闻;

6. MiniMax上半年B端收入首超C端。

1.智谱认领牛来模型,背后由10万张国产芯片支撑

智谱于8月26日正式上线并开源轻量旗舰多模态模型GLM-5.3-Flash,该模型即此前以“Ox Alpha”匿名身份上线并登顶OpenRouter调用榜的“牛来”模型。

模型总参数320B,激活参数18B,采用混合注意力架构,已按MIT协议在Hugging Face开源。

该模型推理服务由10万张国产芯片集群承载,供应商传闻涉及华为、摩尔线程等,硬件效率接近英伟达GPU水平。

在国际评测中,模型综合智能得分与Claude Opus 4.8持平,但API定价仅为后者的四十分之一。受此影响,智谱港股当日收涨12.62%,市值重返5000亿港元。

2.爱诗科技已秘交招股书,有望成为视频生成第一股

爱诗科技已秘密递交招股书,有望成为国内视频生成第一股,公司对此不予置评。

该公司由字节跳动前视觉技术负责人王长虎与光源资本前执行董事谢旭璋于2023年共同创立,主打PixVerse系列视频生成模型,已形成V系列通用视频、R系列实时交互和C系列影视垂直三条产品线,V6可生成最长15秒1080P视频。

自创立以来,爱诗科技累计融资超50亿元,今年7月完成C+轮,阿里巴巴领投,投后估值超20亿美元。

截至今年7月,全球注册用户达1.5亿,月活超1500万,去年10月ARR超4000万美元,约80%来自C端订阅,海外用户占大部分。

市场传出可灵、生数科技等筹备IPO传闻,爱诗若率先上市将成为视频生成第一股。

3.云从科技上半年营收下滑超四成,净亏损减亏超六成

云从科技8月21日披露2026年半年度报告,上半年实现营业收入1亿元,同比下降40.67%;归母净利润亏损7877.45万元,上年同期亏损2.3亿元,同比减亏65.72%;扣非净利润亏损9752.93万元。

营收下降主要系上年同期部分算力建设类项目集中验收形成较高基数,本期此类项目验收规模同比减少所致。公司综合毛利率回升至42.82%,较上年同期的37.73%提升约5个百分点。

4.传月之暗面正与微软、亚马逊等洽谈Kimi K3托管分成

据路透社 8 月 26 日报道,三位知情人士透露,月之暗面正与微软、亚马逊和谷歌洽谈收入分成协议,计划让三家美国云巨头在各自平台上托管其旗舰模型 Kimi K3。

月之暗面寻求从微软 Azure、亚马逊云科技和谷歌云上与 K3 相关服务产生的收入中抽取最高 30% 的分成。若达成协议,这将成为中国 AI 公司与美国大型云服务商之间首个大型收入分成合作。

知情人士称,相关讨论仍处于早期阶段,核心未决分歧主要集中在收入拆分机制、数据访问权限及 Token 消耗量审计等方面。月之暗面尚未回应置评请求,微软、谷歌和亚马逊均拒绝发表评论。

该公司成立于 2023 年,由杨植麟创立,背后有阿里巴巴等资本支持。据市场消息,该公司今年 5 月完成超 20 亿美元融资,市场传闻其正筹备港股上市,相关上市计划尚未得到公司确认。

5.腾讯回应重组AI游戏部门传闻:报道失实,系误读

8月25日,针对腾讯互动娱乐事业群(IEG)重组AI游戏部门的传闻,腾讯相关人士回应称报道内容存在大量失实,所谓“成立新部门”系误读。

此前有消息称IEG计划将CROS旗下的ARC Lab与游戏AI引擎部整合,并扩大至400-500人。

腾讯方面澄清,游戏技术公线本就设有游戏AI引擎部,长期对外招募AI专业人才,该部门聚焦游戏研运管线的AI提效与玩法创新。相关团队架构并非传闻所述的重组整合,而是早已存在的常态化业务单元。

6.MiniMax上半年营收1.17亿美元,B端收入首超C端

8月26日,MiniMax发布2026年半年度业绩报告,这是其上市后首份中期成绩单。

上半年实现营收1.17亿美元,同比增长283.1%,半年收入已超过2025年全年7900万美元的总收入。期内净亏损3.58亿美元,同比收窄11%;但经调整净亏损2.93亿美元,同比扩大111.2%。

收入结构发生显著变化,开放平台及其他AI企业服务收入达7390万美元,同比增长703.1%,占总收入比例由去年同期的30.3%升至63.4%,首次成为第一大收入来源。AI原生产品收入4264万美元,同比增长100.9%,占比降至36.6%。

毛利率从12.1%提升至17.9%。海外收入仍占六成,达7083万美元。截至6月底,公司持有现金余额约13.23亿美元。

7.抖音集团将上线全新短剧App“免费短剧”

抖音集团即将上线一款全新独立短剧App,产品直接命名为“免费短剧”。据8月27日消息,该产品已研发完成,预计近期择日正式上线。

此前抖音已拥有红果免费短剧、咸柠免费短剧等多款产品,其中红果免费短剧月活跃用户已达3.56亿。

京东发布“超脑”大模型3.0

当前短剧行业用户规模超8.5亿,商业模式正从付费解锁向免费加广告变现迁移。但免费模式需持续承担版权采购成本,盈利高度依赖广告收入,新产品上线后的商业化可持续性仍是核心考验。

8.阿里发布全新Qoder,定位智能体工作台

阿里于8月27日发布全新Qoder,产品定位从此前的AI编程工具升级为以Coding能力为核心的智能体工作台。

用户通过自然语言描述目标,Qoder可自主理解上下文、制定计划、调用工具并执行验证,采用Harness技术架构形成“读—改—验证—迭代”闭环能力。

产品内置Qwen3.8-Max等多款模型,提供Auto智能调度,可根据任务特点自动匹配模型。

原版Qoder IDE自2025年8月发布以来,已累计服务全球超600万用户和超10万家企业。

新版Qoder提供编程和通用两种模式,并接入40多个连接器、70多个插件和2万多个技能,可将代码仓库、项目管理及云服务等纳入AI工作流。

产品矩阵覆盖桌面端、IDE、CLI、移动端等多种形态。即日起至9月1日,个人版每日可领取500 Credits,企业用户使用Qwen3.8系列模型享五折优惠。

9.腾讯发布并开源新一代大语言模型Hy4 preview

腾讯混元于8月28日发布并开源新一代大语言模型Hy4 preview,总参数770B,激活参数49B,上下文长度突破1M。

模型采用混合专家架构,定位为生产力场景,在腾讯内部163名专家参与的203个工程任务盲测中,得分略优于GLM 5.3和Kimi K3。

Hy4 preview已在腾讯云TokenHub和OpenRouter上线,用户可通过WorkBuddy、CodeBuddy、元宝等产品体验,定价为输入6元/百万tokens、输出18元/百万tokens。

腾讯表示该版本为Hy4迭代的早期版本,预训练和后训练仍有提升空间,将持续敏捷迭代。

10.微信开源WeMM-Embedding多模态模型

腾讯微信视觉团队近日开源了通用多模态嵌入模型系列WeMM-Embedding。

该系列包含2B、4B和9B三种参数规模的模型,基于Qwen3.5架构,可将文本、图像、视频及视觉文档等多种输入统一映射为向量,用于搜索、推荐和内容匹配等场景。

模型权重与代码已同步在GitHub和Hugging Face发布,采用Apache 2.0开源协议。

性能方面,2B模型在MMEB-v2评测中取得77.9分,已超越此前领先的8B开源基线;9B模型进一步达到80.6分,登顶该榜单第一。

该模型已大规模部署于微信视频号、公众号、朋友圈及电商服务等推荐和搜索场景中。技术报告已同步发布,编号为arXiv 2608.24053。

11.京东发布“超脑”大模型3.0

京东于8月26日在第十八届国际交通技术与设备展览会上发布超脑大模型3.0,由PreX预测、OptiX决策、OmniX多模态、GeoX时空、EmbodiedX具身五大供应链原生大模型协同构成,搭建了决策AI、流程AI、物理AI三位一体的技术体系,形成感知、预测、决策、执行、反馈的完整闭环。

相比2.0版本,超脑3.0在运作效率、运营成本等方面均有提升,亿级包裹端到端路径规划求解时间从分钟级缩短至秒级。

决策AI负责全局调度,车辆自动化调度率达86%;流程AI打通各业务系统数据壁垒,仓储员工作业效率提升13.8%;物理AI驱动自研狼族机器人军团,异狼分拣机械臂已在多个物流园区24小时运行,独狼无人配送车在国内及沙特等海外试点运行。

12.千问办公上线标准模式,任务生成速度提升约100%

8月26日晚,阿里旗下千问办公首发上线Qwen3.8-Flash模型,同步推出标准模式。即日起所有用户可通过标准模式体验新模型。

未来千问办公的模型供给将简化为标准和高级两种模式,约95%的日常任务通过标准模式即可完成。

在真实办公场景测试中,千问办公标准模式的单任务生成速度提升约100%,Token消耗平均减少75%。Qwen3.8-Flash采用MoE架构,千亿级总参数实现超越Claude Opus 4.6的性能。

千问大模型团队与千问办公团队联合推出了办公专属版本,针对多步规划、工具选择、上下文压缩等场景进行了专项训练调优。

13.蚂蚁百灵推出金融增强模型Ling-3.0-flash-Fin

蚂蚁百灵于8月28日推出金融增强模型Ling-3.0-flash-Fin,由蚂蚁集团携手中金公司及行业专家共同打造,定位为百灵首个金融增强模型。 

模型延续Ling-3.0-flash的124B总参数、5.1B激活参数架构,通过金融语料持续预训练和领域后训练,强化了对年报、财务工作簿等复杂金融内容的处理能力,聚焦信息检索、研究推理、估值建模和研报撰写四大核心能力。

模型在蚂蚁与中金联合打造的FinFIRST等多个金融基准测试中表现优于多款通用模型,通用能力得分由38分提升至41分。

蚂蚁百灵宣布,模型将在OpenRouter开启为期一个月的限时免费API调用,模型权重将于下周正式开源,FinFIRST金融搜索基准也将同步开源。

本期观察

总体来看,本周大模型行业延续了高频迭代与密集资本运作的双重节奏。

模型层面,智谱、腾讯、蚂蚁、阿里等头部厂商密集发布或开源新模型,产品形态从通用对话向金融、编程、办公、物流等垂直场景快速渗透,行业竞争已从模型能力本身延伸至行业定制与成本效率的比拼。

与此同时,微信开源WeMM-Embedding、京东发布超脑3.0,反映出大模型正在加速嵌入搜索推荐、供应链调度等核心业务系统,从技术工具向生产力基础设施演进。

资本层面,爱诗科技冲刺IPO、月之暗面与海外云巨头洽谈分成、MiniMax交出上市后首份成绩单,显示一级市场退出通道逐步打开,头部公司开始接受二级市场的检验。B端收入在MiniMax收入结构中首超C端,也揭示了AI公司商业化路径正在从追求用户规模转向更可持续的企业服务模式。

整体而言,大模型行业已度过单纯的技术展示阶段,进入产品落地、商业验证与资本回报并行的新周期。国产算力的规模化部署与国际合作的试探性推进,则为下一阶段的竞争格局增添了新的变量。