观点一:模型能力持续迭代并降本,以Gpt6为例的循环架构或致蒸馏成本提高
#DeepSeekV4.1-Flash发布、能力升级同时降价。9月10日起,高峰时段每百万Token未缓存输入/输出价为2/8元,较前代Flash分别降低33%/11%;缓存命中输入降至0.04元、降低60%,闲时再减半。模型原生支持视觉理解及1M上下文,架构优化与低价结合,有望扩大长任务Agent的应用范围。
#KimiK2.8Preview上线、Coding与Agent能力继续升级。9月11日全量上线Kimi Code,沿用会员订阅模式。官方称性能接近K3、思考效率较K2.7 Code明显提升,并将最高1M上下文开放至全部会员档。
#GPT6Astra引发反蒸馏讨论、能力迁移门槛或提高。据外媒报道,Astra或通过循环调用Transformer层增加内部有效计算深度。若有效CoT等过程监督减少,同等数据下的蒸馏效率或下降(增加蒸馏成本但答案与任务轨迹仍可用于行为学习)。
观点二:融资能力及商业化进展为模型公司重要指标
#Kimi推进FDE伙伴计划、ARR据报约10亿美元。9月10日启动企业合作伙伴计划,与华胜天成、金山云等共建前线部署工程师(FDE)队伍,覆盖需求诊断、系统集成与生产部署。另据彭博,8月ARR约10亿美元,26年年末ARR或可达20亿美元。
#智谱拟通过配售及可转债融资50亿美元、补充研发与算力投入。9月11日,公司拟以每股714港元配售约2197万股H股,较当日收盘价折让约10%,约20亿美元;另同步发行总额201.4亿元人民币(约30亿美元)于2027年9月到期的美元零息可转换债券,初始转股价为892.5港元(溢价约12.5%)。所得款项拟用于研发、算力部署及业务扩张等。
观点三:RSI或为模型下一步发展路径
#OpenAI披露研究自动化进展、AI开始加速AI研发。公司称“自动化研究实习生”已可在人类指导下完成原需研究员数日的限定任务(原定26年秋季目标达成);8月中旬Agent运行时长约为人工工时3.1倍,研究人员日均API使用成本超600美元,目标在2028年3月实现“自动化AI研究员”目标(完善的RSI)。
OpenRouter 数据 track:整体调用量继续提升,本周Hy4p贡献近一半Token净增量,Mimo及Gemini新模型逐步起量。
#总Token约122.61万亿、环比+7.1%;文本请求约55.83亿次,环比+11.1%。
按slug口径,#Hy4preview以17.75万亿Token、约+26.2%贡献最大绝对增量(约+3.68万亿);MiMo V2.5、Gemini3.8 Flash分别约+120.1%、+195.8%。DeepSeekV4.1 Flash新slug录得约2.22万亿Token。
作者声明: 本文转载自第三方,旨在提供资讯参考,并非证券推荐或投资建议。作者对内容的真实性、准确性不承担保证责任。本文不构成任何投资建议或证券推荐。截至发文日,作者与文中提及的标的不存在持仓关系。