
“我们把数据库完整地搬到了GPU上运行,性能比CPU快20到100倍。”在WAIC 2026“认知涌现·数据新生”人工智能主题论坛上,星环科技创始人、CEO孙元浩接受记者采访时,用一句话概括了企业在WAIC推出的新品亮点——“这在全球还没有第二家企业做到。”
他口中的“搬”,不是把几张表挪个地方,而是重构了数据库的整个执行引擎、存储管理和事务处理逻辑。过去几十年,数据库默认长在CPU上;今天,为了让AI Agent真正跑起来,星环科技决定把它的家搬到GPU里。

AI Agent一来,CPU数据库先撑不住了
为什么非得搬家?孙元浩解释,AI的使用方式变了。
“以前的AI是一问一答,叫One Shot。现在变成了一个Loop——Agent会推理、行动、调用数据库、观察结果,发现不对再修改、再重来。”一个任务里,Agent可能反复调取数据几百次,每次响应慢了,整个流程就卡死。“以前人查数据库等几秒可以接受,现在Agent等不了。”

与此同时,AI Agent带来的高频数据访问,也让传统CPU架构数据库逐渐成为新的瓶颈。传统架构里,GPU负责推理,CPU负责查数据,两者通过PCIe通道来回搬运。“很多客户告诉我们,推理过程的大量时间都耗在数据等待上。”CPU只有几百个核心,内存带宽每秒几百GB;而GPU拥有上万核心、数TB/s的显存带宽。用CPU去扛Agent的并发数据访问,就像用小水管去浇万亩良田。
孙元浩判断,未来三到五年,计算机将从“CPU中心”彻底转向“GPU中心”,因此,数据库必须先行一步。
不只快,还要“懂”记忆,能“免搬”
作为面向AI Agents设计的新一代AI数据库,星环科技GPU原生认知数据库首次将GPU原生计算能力与认知能力深度融合,将数据分析、知识检索、可信上下文供给与长期记忆管理统一纳入同一数据底座,实现数据库从“数据管理”向“认知服务”的跨越。

在采访中,孙元浩特别强调“原生”二字:“如果只是把少数算子扔到GPU上当协处理器,瓶颈还在数据传输,加速比只有1.5倍,没有经济性。我们是把全套功能完整迁移,提速才有20倍起跳。”
企业曾做过实验:同一组100G标准数据集,某知名云数据平台跑了6分多钟,星环的产品只用了10秒,差距达40倍。而在TPC-DS标准测试中,对比Snowflake、Databricks,性能提升66倍,性价比提升14倍。
但孙元浩认为,快只是基础,面向AI Agent更重要的是“认知”和“记忆”。数据库内置了长期记忆和会话记忆,Agent跨会话也能延续理解,记忆准确率超过90%,在BEAM 500K等基准测试中超过了主流开源记忆系统。“你可以把所有文档、只言片语都扔进去,它会自动整理,结合行业知识分类、建立关联。未来大模型提问时,数据库能直接给出最精准的答案,避免反复循环。”
“这就不是简单的存储工具了,它开始理解内容。”孙元浩说,“这也是我们叫它‘认知数据库’的原因。”
三个场景跑得最快
谈到落地,孙元浩给出了三个率先应用的场景。
第一个是AI推理加速。“比如处理几百页的合同或报告,过去大模型解析加检索要几分钟甚至更久,我们可以压缩到十几秒,用户体验完全不同。”第二个是传统数据处理加速。“科研和算法训练前的数据整理,报表分析、BI看板,原来跑很久的任务现在快几十倍。第三个是实时计算。实时反欺诈、交易监测、传感器数据处理,都需要毫秒级响应,“这个场景非GPU不可”。
哪些行业反馈最积极?孙元浩列举了金融、制造、零售、交通和科技公司。“金融最爱尝鲜;制造业非结构化数据多,整理起来头疼;零售想精准营销;交通要处理实时传感器;科技公司则希望提升并发和用户体验。”
除了数据库本身,星环科技的整体布局围绕三个方向展开。孙元浩表示,首先是把数据平台变成“AI就绪”——帮AI自己整理非结构化数据的元数据,不再靠人工标注。其次是用AI驱动数据开发、治理和分析,“以后不用写程序,自动化完成”。第三就是把所有数据处理的负载都放到GPU上跑。
孙元浩坦言,过去数据库是给人用的,现在未来的数据库是给AI用的。当数据基础设施开始直接面向AI Agent,就需要从架构到能力都重新设计。星环科技选择把完整数据库功能搬到GPU上,正是为这场底层重构交出的第一份答卷。
盛达优配配资提示:文章来自网络,不代表本站观点。