端侧AI

2026-07-19 18:29:431
端侧AI:模型政策产品等多重催化,估值低位重点看好
月之暗面发布 Kimi K3,为全球首个2.8T参数量开源模型。国产模型整体迭代速度加快,参数量、模型能力上限继续提升。
7月15日,国家网信办首批端侧AI大模型备案通过,Apple智能、华为小艺、小米澎湃AI等正式获准上线,端侧AI迈入商业可用阶段。
基本面角度,下游需求旺盛,端侧AI+机器人+车载等增量(通信模组->智能模组),端侧公司普遍目前估值较低位。
端侧AIoT:广和通美格智能乐鑫科技、模组龙头等

端侧NPU:AI终端迈入“0到1”,专用算力成为硬件分水岭

人工智能时代真正的“0到1”,不是概念被提出,而是原本停留在研发和验证阶段的技术,开始进入手机、汽车、机器人及家庭终端,成为消费者可以实际使用的产品。0代表没有,1代表正式落地。

AI手机与普通手机最大的硬件差异,在于是否具备端侧NPU算力单元。没有NPU,终端更多只是“普通手机+AI软件”,复杂计算仍需依赖云端;配置专用NPU后,设备才能在本地完成语音交互、实时翻译、图像生成、智能修图和个人助理等任务,同时兼顾低时延、低功耗、离线运行和隐私保护。大模型决定AI手机可以做什么,NPU则决定这些功能能否真正装进终端并稳定运行。

随着Apple智能、鸿蒙AI及国产手机大模型加速落地,端侧NPU有望由旗舰手机逐步向中端机型、AIoT、智能座舱和边缘设备渗透。

相关标的包括:瑞芯微全志科技,聚焦端侧AI SoC;晶晨股份,受益智能家居与多媒体终端升级;芯原股份,提供NPU IP及芯片定制服务;云天励飞,布局边缘AI推理芯片;美格智能,覆盖智能模组、端侧算力及AI终端方案;九联科技,对应鸿蒙生态、AI终端和边缘计算场景。

Kimi K3:国产模型首次进入海外SOTA定价区间,正式进入主力模型池
K3总参数2.8万亿,支持100万Token上下文和原生视觉。Frontend Code Arena前端设计能力排名第一;Artificial Analysis智能指数57分,按模型配置排名全球第4,紧随Fable 5和GPT-5.6 Sol的两档高推理配置。
K3的核心是超稀疏MoE与长任务架构协同。
K3采用896选16的超稀疏专家模型,每个Token从896个专家中选择16个,按路由专家数量计算,激活比例仅1.79%;Stable LatentMoE在扩大专家总容量的同时保持稀疏激活;KDA用可更新状态压缩长上下文,并保留部分完整注意力,缓解KV Cache和带宽压力;注意力残差按内容调用前序层信息,改善深层信息传递;Mooncake分离式推理和预填充缓存进一步复用长任务中的重复前缀,官方称编程负载缓存命中率超过90%。
长程任务能力是当前兵家必争之地。
kimi官方案例包括48小时无人值守完成芯片设计,以及120多轮递归改进生成ASIC产业交互式研究网站。
定价是本次最有投资含义的信号。
K3每百万Token输入3美元、输出15美元,与Claude Sonnet 5标准价一致,输出价为GPT-5.6 Sol的一半。我们认为,这是国产模型首次主动进入海外SOTA价值定价区间。
官方建议K3部署在64张以上加速器组成的超节点。
这反映了896选16超稀疏MoE对专家并行和高带宽互联的要求。稀疏MoE避免每个Token激活全部专家参数,但没有消除2.8万亿参数权重的承载需求和跨卡通信压力。
K3改变了国产模型在我工作流里的位置,上一个是GLM5.2。
路演时领导应该见过,我的CC Switch长期接着Claude、GPT、GLM和Kimi。过去我主要让国产模型处理简单、重复任务,一方面用于持续实测能力,另一方面用于平衡成本;K3发布后,我愿意把Kimi调入主力模型池,直接承担复杂研究、长时程编码和知识工作。
国产模型已经进入主力模型池、并继续冲击全球能力前沿。

Kimi K3发布,国产模型能力与商业化进一步突破

【Kimi K3能力大幅跃进,国产模型加速追赶全球前沿】

7月17日,月之暗面发布新一代旗舰模型Kimi K3,面向软件工程、知识工作及深度推理等复杂智能场景,支持100万Token上下文窗口,进一步强化长程任务处理能力。此前K3已面向部分用户开展灰度测试,海外社区反馈显示,其在编程、网页开发及复杂Agent任务中的表现较上一代明显提升,部分测试者认为已达到Claude Opus 4.8水平,《金融时报》报道援引两名知情人士称,Kimi K3预计在主流基准测试中超过Claude Opus 4.8,但仍可能弱于更强的Claude Fable。

【模型能力升级推动价格体系上移】

Kimi K3 API缓存命中输入、未命中输入及输出价格分别为2元、20元和100元/百万Token,定价较此前Kimi系列模型明显提升。较高的输出价格一方面反映模型参数规模扩大(2.8万亿),以及长上下文、深度推理及复杂任务执行带来的算力成本,另一方面也说明国内模型不仅具备可以通过性价比优势获客,也有能力转向依靠模型能力提升实现API价值量增长。

【国产模型ARR快速增长,商业化与估值中枢同步提升】

据《科创板日报》报道kimi新一轮融资投前估值升至315亿美元;截至6月中旬,公司ARR已突破3亿美元,其中API收入占整体收入七成以上。Kimi收入增长主要由模型迭代带动开发者使用量和API收入提升,表明其商业模式正在由消费者订阅进一步向开发者及企业级调用延伸。DeepSeek正在寻求以约5000亿元人民币、折合740亿美元估值启动新一轮融资;the information报道其年化收入约为4亿至5亿美元。国产头模型能力升级、API调用增长和估值提升之间的正向循环逐步形成。

作者声明: 本文转载自第三方,旨在提供资讯参考,并非证券推荐或投资建议。作者对内容的真实性、准确性不承担保证责任。本文不构成任何投资建议或证券推荐。截至发文日,作者与文中提及的标的不存在持仓关系。

合规声明:本站发布的所有文章及观点均系个人研究共享,投资心得交流,不代表本站立场,且不构成任何形式的投资建议。投资者据此操作,风险自担,请务必保持独立审慎的决策态度。