OpenAI新技术:键值缓存,成本降低50%以上
OpenAI采用KV Cache(键值缓存)新技术,将所需的NviDia图形处理器数量减少至仅几百个,这个数字小得惊人。
星环科技688031:NV英伟达存储架构合作商+实锤KV Cache键值缓存。公司为大模型推理打造 GPU 原生数据库,底层内置动态 KV Cache 分层管理引擎,实现三级KV 缓存自动调度,解决长上下文、多并发推理显存瓶颈,深度适配英伟达GPU生态;产品配套LLM推理平台,内置上下文KV Cache键值缓存优化模块,私有化智算集群批量落地政务、金融AI场景。

公司正在研发的新一代
AI 数据库--认知数据库,该产品的 GPU 原生版本已携手主流芯片厂商英伟达开展联合调优, 旨在为数据分析场景带来高效的 GPU 加速能力。

公司在GPU上加速数据处理效率,获得了让人振奋的性能进展:其中在SQL上,在关系型数据库的标准TPC-DS(全 99 个场景)150GB数据规模的测试中,性能较128vCore传统CPU性能提升约 26 倍,相关数据在英伟达GTC大会数据加速专场中被认可。

特别声明:文章内容根据公开信息整理,不作为买卖参考,如有不妥请联系删改。
作者声明: 本文转载自第三方,旨在提供资讯参考,并非证券推荐或投资建议。作者对内容的真实性、准确性不承担保证责任。本文不构成任何投资建议或证券推荐。截至发文日,作者与文中提及的标的不存在持仓关系。