维度网讯,中国星环科技推出GPU原生认知数据库(Transwarp Cognitive Database),将SQL数据库、知识库与记忆系统融为一体,旨在为AI Agents(智能体)提供一站式的数据、知识与记忆能力支撑,降低AI原生应用规模化落地的成本与门槛。
企业AI正从大模型问答向AI Agents演进。与传统一次响应的大语言模型不同,AI Agents会围绕目标持续执行“推理—行动—观察—修正”的多轮循环,反复访问数据、检索知识、调用工具并更新任务状态。星环科技指出,传统CPU架构仅有数十至百级通用计算核心,内存带宽约100-400GB/s,在处理高频、多轮、并发任务时,CPU与GPU间的数据搬运成为关键瓶颈。以GPU为中心重构数据库计算架构,可利用其上万并行核心和TB/s级高带宽显存,承载大规模数据扫描、复杂聚合、文档解析和向量计算等高并行负载。同时,通过GPU-Initiated Direct Storage(GIDS)技术,由GPU直接发起存储访问,可减少数据中转与内存拷贝。
该数据库在技术层面实现了五项突破。第一,GPU加速结构化数据分析。在TPC-DS SF1000测试中完成99项查询任务,性能达到开源CPU数据库DuckDB的70倍;与Snowflake、Databricks对比,性能最高提升66倍,性价比最高提升14倍。第二,GPU加速文档处理与知识召回。基于COSMIC文档解析服务,在OmniDocBench复杂文档上处理性能提升10倍;GPU向量索引构建性能最高提升近50倍,检索吞吐最高提升238倍。在国产算力适配方面,已完成海光DCU优化,向量索引构建由天级缩短至分钟级,检索性能相比CPU最高提升58倍。第三,显存利用率提升20倍。通过数据卸载和索引搜索优化,显存消耗降低至约5%,即使将95%的计算相关数据卸载至内存或SSD,搜索吞吐仍可达传统CPU索引的12倍。第四,记忆能力在BEAM 500K长程情景记忆与LongMemEval-S长对话记忆两项基准测试中整体准确率分别达到79.6%和92.8%。第五,支持自然语言驱动,将用户需求自动转化为可执行的数据工作流,贯通数据开发、治理、分析与报告生成全过程。

在真实场景验证中,OfficeQA Pro复杂企业知识问答测试中,包含近百年美国财政部公报近万页文档及133项推理任务,端到端AI推理性能提升约6倍,准确率达到79.3%。在金融量化因子回测中,相较CPU方案最高实现5881倍性能提升。在信贷全链路经营与风险分析中,面对4.8亿条明细数据,整体性能提升449倍。
此外,星环科技将推出认知数据库云服务,包含Data Factory和Token Factory。Data Factory可在同等成本下实现10倍以上性能提升,支持从Snowflake、Databricks等云数据库一键迁移。Token Factory可实现输入吞吐提升10倍、输出吞吐提升20%至80%,用于提升企业级AI推理效率。

注:文中性能及评测数据来自星环科技内部测试结果与公开基准,具体表现受软硬件配置、数据规模及测试方法影响。










