属实
韩国AI芯片企业Deinoticia公布了其“生成用GPU、检索用VDPU”的分工架构,并在美国公开了四卡服务器的性能数据。该公司采用GPU与VDPU(向量数据处理单元)各司其职的设计思路:GPU负责大语言模型的生成任务,VDPU则承担检索类工作负载,以提升整体服务器效率。
据该公司公布的内容,Deinoticia没有让单一芯片同时承担生成与检索两类任务,而是将生成式AI所需的计算交给GPU,将检索相关的向量处理工作交由自主开发的VDPU处理。这种分工设计旨在让两类芯片各自在擅长的工作负载上发挥性能,从而优化服务器的整体资源配置。
检索型AI应用对向量数据处理有大量需求,Deinoticia认为由专用VDPU承担这部分任务,可以减轻GPU的负担,使GPU更专注于生成任务。
Deinoticia此次在美国公开了搭载四张卡的服务器配置下的性能表现。该公司希望通过在美国市场公开实测数据,向海外客户展示其产品的实际性能水平。
不过,此次公开的具体性能测试细节以及与竞品的对比情况,目前公开信息中尚不完全明确,相关数据的第三方验证情况也尚未得到确认。
选择在美国公开服务器性能数据,被外界解读为Deinoticia瞄准北美AI基础设施市场的举措。随着生成式AI应用推动服务器需求快速增长, niche芯片厂商正尝试通过差异化架构切入由大型GPU厂商主导的市场。
Verdict: 属实