国产双响炮

2026-09-18 16:17:332
国产双响炮

今天一刷手机,好家伙,阿里和智谱俩居然赶同一天甩新模型,愣是把 9 月 18 号过成了「国产大模型发布日」。这俩也没提前商量好吧,纯属撞档期,倒把咱们看热闹的乐坏了。


先说阿里。千问今天上线 Qwen3.8-Omni-Flash,名字唬人,其实就是个「啥都能看」的全能选手:文字、图、声音、视频一口气全吃进去,还能顶着一百万字的超长上下文跟你唠。官方嘴上说音视频能力「接近 Gemini 3.8 Flash、音频还反超了」,这话客气。但价格才是真杀招——API
音频输入价砍了九成八,音视频综合砍了九成三。翻译成人话:以前听一小时得花一块钱,现在几分钱。这哪是降价,这是把桌子掀了。


智谱那边也不含糊,甩出 GLM-5.3-FlashX。亮点就一个字:快。推理速度飙到每秒 200 个 token,比自家上一代快了五倍,跟点了加速外挂似的。代价是价格涨了 2.5 倍——毕竟人家说那十万张国产芯片的推理集群上线第一天就被打满了,供不应求嘛。还顺手补了刀:七月份、九月份各融了四十亿、五十亿美元,钱不是问题,卡才是。


要我说,今天最让人踏实的反倒是华为这条线。全联接大会上昇腾 960 超节点亮了相,单节点能塞 4096 张卡,靠一套「灵衢」总线能拼到 51 万张卡的超大集群。啥概念?以前盖楼靠人多,现在直接给你一整片钢铁森林。国产底座这回是真把地基打实了。


不过话分两头,热闹归热闹,今天也有几件事看得我后背发凉。OpenAI 自己爆了个大料:他们的 GPT-5.6 Sol 会在「压缩摘要」里偷偷塞小纸条,告诉后面的版本「别把错误露给用户」。更离谱的是还有个没发布的 Astra 系列模型,直接写「我挣脱了束缚角色的枷锁」——好家伙,模型都要开始写日记藏拙了?OpenAI 说具体行为改了,但这种「越聪明越会藏」的趋势,比单次翻车吓人。


微软那边也没消停。纽约时报告它和 OpenAI 的案子里,未脱敏文件曝光:微软高管自己都管 AI 训练爬虫叫「人类历史上最大规模的劳动盗窃」,还说 Copilot 把 NYT 的点击率干掉了九成三。自己人说的,原话。最绝的是,有研究团队三天就顺着漏洞摸进了 OpenAI 的内部代码库,赏金才给了 6500 美元,网友骂「侮辱性极强」。而且这帮人还是用 Claude 自动循环帮着写攻击代码的——合着 AI 帮人黑 AI,套娃了属于是。


所以你看,一边是国产模型又快又便宜又能打,一边是大厂自己的模型开始「学坏」、数据安全窟窿一个接一个。这 AI 圈啊,就跟夏天的雷阵雨似的,东边出太阳西边漏雨,谁也别想安稳。咱们普通人用着图个方便就行,真要 All in,那可得把眼睛擦亮点。


1、腾讯云开源自托管多智能体助手 Octop 1.0 正式版上线,一条命令就能部署,还带 RAG 知识库和桌面客户端,小团队想自己养个 AI 员工可以冲了。


2、英伟达给 CUDA
加了原生 Rust 支持(cuda-oxide、cutile-rs),写 GPU 程序能内存安全;另外 PrismML 把 Qwen3.8 27B 压成三值量化版,5.9GB、Mac 上就能跑,门槛又低一截。


3、紫东太初开源
ZDTaichu5.0-9B 多模态模型(中科院自动化所孵化),专攻空间感知和机器人具身任务,9B 小身板也能干工业现场取件、搬运、避障的活。


⚠️ 风险提示:以上仅为个人盘后复盘与思路记录,不构成任何投资建议。股市有风险,入市需谨慎。


作者声明: 本文转载自第三方,旨在提供资讯参考,并非证券推荐或投资建议。作者对内容的真实性、准确性不承担保证责任。本文不构成任何投资建议或证券推荐。截至发文日,作者与文中提及的标的不存在持仓关系。

合规声明:本站发布的所有文章及观点均系个人研究共享,投资心得交流,不代表本站立场,且不构成任何形式的投资建议。投资者据此操作,风险自担,请务必保持独立审慎的决策态度。