登录路演时代
忘记密码
忘记密码
忘记密码
欢迎注册路演时代
已有账号?马上登陆
国联民生计算机 小吕说AI纪要
发布来源: 路演时代 时间: 2026-07-20 15:19:44 0

计算机首席 吕伟

团队提出两大新关注方向,周末发布两篇深度报告,分别围绕豆包商业化开启、多点数智展开。在市场关注大模型代码领域进步的同时,豆包凭借流量规模与交互能力已成长为国民级应用。其商业化进程持续推进,包括第二代AI手机落地、出行领域与曹操出行开展合作、后续向电商场景拓展,是大模型行业商业化的重要拐点,建议重点关注。

下周市场反弹的优先级关注标的。第一类是业绩确定性最强、增速最高、估值位置较好的【浪潮信息】和错杀【智谱】为首选。浪潮中报业绩高增(上半年业绩有望超去年全年业绩)。国内大厂资本开支持续上调,公司作为国内头部互联网大厂核心服务器供应商,受益于国内算力扩张与出海双重红利,同时将资源向高毛利产品和订单倾斜,利润率改善趋势有望延续。公司全球CPU龙头核心合作伙伴,产业链话语权与产品布局带来溢价,连续4年蝉联中国液冷服务器市场第一,AI算力方向有效发明专利数量位居国内第一,超节点在头部厂商率先落地。

 

智谱因为K3显著错杀:

 

1)GLM5.3将延续Scaling law,预计重回开源SOTA。

 

GLM5使用了22T 数据训练,后续使用仓库级代码数据、特定环境合成推理数据、长文本数据、agent数据以及大量合成数据,扩展数据维度。此外,在后训练、基础设施层面还有更大规模优化。

 

2)GLM5.5将采用全新架构有望全面对标Fable。

 

闭源顶尖coding模型行列。GLM 5.3之后的下一代模型将采用全新的模型架构,该架构可支撑模型规模比当前GLM 5代模型大得多,同时能保持很高的训练和推理效率,既可以支撑继续探索智能上界,也能支持大规模落地使用;该模型的目标是实际体验全面对标Fable级别模型,而非仅在部分基准测试中达标。

第二类是弹性大、预期差突出的集智股份,当前订单已开始快速增长,其既是液冷赛道核心标的,也是基于ARM CPU与GPU异构打造算力基础设施的全球稀缺算力租赁标的。公司液冷方管自动校直机是卡位全球液冷龙头上游的“卖铲人”,子公司予琚智能推出行业唯一校直+校扭+在线3D轮廓检测成套专用设备,校正精度稳定0.1–0.3mm/m,稀缺性和先发优势凸显,已切入台达等英伟达MGX机架核心液冷龙头供应链。同时,发挥Arm CPU与异构芯片优势打造ARM底座的“硅基流动”,通过100%全资子公司浙江之江易算(注册资本增资至1亿元)控股杭州集智新易算,与潘东创立的Fedimoss(盛见科技)深度技术合作;团队拥有完整ARM分布式推理底层技术,与软银Ampere达成官方工程合作,配套MoE去中心化异构推理学术论文提供学术支撑。

 

计算机 白青瑞

行业整体层面,上周五K3发布后全球市场反馈积极,说明国内大模型整体水平正持续追上海外。会议当日千问3.8同步发布,从第三方内测玩家的测试结果来看,千问3.8、智谱GLM-5.2、K3均处于同一能力梯队,印证国内大模型与国产卡适配等环节的成熟度。

行业阶段判断,国内大模型已进入类似美国2025年1月的模型竞赛阶段,当时Anthropic、谷歌、OpenAI三家公司轮番发布模型、争夺榜单首位,最终共同拉高行业估值上限,而非拉低其他厂商估值。国内当前刚进入该阶段,市场认知切换尚需时间,行业贝塔行情是更值得把握的核心方向。

总结三大核心的关于智谱的观点。

模型架构潜力突出。智谱当前模型参数量成长潜力最大;其他友商包括后续将发布新版本的DeepSeek,模型参数量多在1.5T至3T区间。公司下个版本将采用全新架构,预计参数量将扩充至1-2T甚至3T以上,可实现在榜单成绩与使用体验上全面超越GPT-4o级别模型。

补齐多模态能力后有望重回行业头部。公司近期将发布达到开源SOTA级别的模型。此前智谱GLM-5.2在部分测试中表现不及K3、GPT-4o,核心原因是缺失多模态能力。从行业相关人士的公开动态来看,市场对智谱下一个版本补齐多模态能力的呼声最高。一旦新版本补齐多模态能力,凭借其优秀的模型架构,智谱有望超越GPT-4o,重回国内第一、全球第三的位置。

当前市值具备布局价值。智谱当前市值处于相对低位,且已纳入港股通。回顾过往,公司上市初期500多亿市值时团队便持续看好,伴随国内大模型第一波行情市值上涨至五六千亿;市值回调至4000亿时,团队重点推荐GLM-5.2带来的全球代码能力第三的逻辑。后续建议重点关注智谱补齐多模态后的新版本模型。

 

计算机 郭新宇

AI Agent正从对话交互向交易闭环演进,大模型厂商的商业化路径正从按Token计费延伸至按交易额抽佣,这是值得重视的结构性变化。

这一变化的逻辑起点,在于AI手机作为终端入口率先取得合规突破。 7月8日,网信部门完成7款手机端侧AI大模型备案,涵盖Apple智能(集成阿里千问)、华为小艺、OPPO、vivo、小米、三星及努比亚豆包。IDC预测2026年AI手机出货1.47亿台、占比53%。手机作为高频使用终端,天然具备用户触达与场景感知能力,大模型厂商通过端侧落地获得自有用户入口,这是后续商业化的前提。

有了入口,流量基础正快速形成。 截至2026年6月,豆包日均Token调用量突破180万亿、同比超10倍,火山引擎以49.5%份额居中国MaaS市场第一;截至2026年3月,豆包月活约3.45亿。更关键的是交互体验升级——语音输入效率为键盘的3倍以上,支持多模态输入和意图自动拆解,大模型正从"问答工具"转变为"用户可依赖的流量入口"。

入口和流量到位后,商业模式自然从Token计费向交易闭环延伸。 豆包已推出三级订阅(标准68元/月、加强200元、高级500元),但更具意义的是:各类垂直服务正通过MCP化接入AI流量入口,成为Agent可调用的标准化Skill。用户表达需求后,Agent自动调用垂直服务完成匹配与下单,交易在Agent内闭环。大模型厂商的角色从API提供者转变为交易撮合方,计费模式从按Token延伸至按交易额抽佣——这是底层商业逻辑的根本变化。

这一模式已在出行、电商、零售三大场景落地。 出行:曹操出行运力接入豆包,用户口述需求即自动匹配运力,全流程在豆包内闭环;电商:腾讯元宝打通京东小程序生态,商品卡片直接跳转下单;零售:多点数智作为首批内测开发者接入微信Agent,携手胖东来搭建对话式购物闭环。垂直场景中具备系统能力与数据积累的服务商,有望成为Agent调用的核心节点,获取流量分发与交易撮合的卡位价值。

以多点数智为例,其AI价值在C端、B端、具身智能端三个维度同步释放,核心壁垒在于覆盖万家门店的全栈数据积淀。 C端:多点通过MCP化接入前端大流量入口,成为链接Agent与万家门店的编排层,有望从软件服务费延伸至按交易额抽佣;B端:十大智能体覆盖选品、定价、补货、巡检,构建D-BRAIN智能多点大脑,逐步替代传统商超ERP/SaaS;具身智能端:与灵心巧手(全球高自由度灵巧手份额超80%)合资成立灵美智能数核(北京)科技有限公司,将AI决策与末端执行融合,形成"思考到行动"的全流程闭环。

继续重点看好集智股份:集智股份核心合作方Fedimoss发布跨环境AI推理云ATHER:打破AI推理中成本、性能、部署复杂度的"不可能三角",开启ARM CPU推理全新范式。1)ARM纯CPU推理凸显性价比:基于OCI Ampere 90核CPU实例,通过ARM SME矩阵扩展加速GEMM算子等技术优化,在无损输出前提下显著提升解码效率。2)CPU+GPU异构推理:同一GPU可服务的模型规模显著增大,单位推理成本大幅下降。针对MoE模型“贵HBM被冷参数占满”的痛点,进行算子级解耦。3)高性能GPU推理:针对Agent长程推理任务,提出三级KV Cache协同压缩,使显存消耗增长远慢于上下文长度增长。同时将计算密集的Prefill和带宽瓶颈的Decode分离到不同GPU实例组,提升GPU资产ROI。

集智股份通过100%全资子公司浙江之江易算(注册资本增资至1亿元)控股杭州集智新易算,与潘东创立的Fedimoss(盛见科技)深度技术合作,打造ARM的“硅基流动”。对标硅基流动:根据IDC数据,硅基流动为国内第一大独立Token推理厂商,冲刺港股特专科技上市,上市后或将实现较高流动性溢价。

 

温馨提示:内容源于第三方以及公开平台,仅供用户参考,恕本平台对内容合法性、真实性、准确性不承担责任。如有异议/反馈可与平台客服联系处理(微信:_LYSD_)。