人工智能

消息称DeepSeek准备适配国产GPU

字号+作者:快科技 来源:快科技 2025-02-02 07:01 评论(创建话题) 收藏成功收藏本文

DeepSeek在研发大模型时绕过了英伟达的护城河CUDA,这让美国不少巨头们感到了很大的威胁,而现在这件事才刚刚开始。DeepSeek真的绕过了CUDA,那这件事意味着'...

DeepSeek在研发大模型时绕过了英伟达的护城河CUDA,这让美国不少巨头们感到了很大的威胁,而现在这件事才刚刚开始。DeepSeek真的绕过了CUDA,那这件事意味着什么?对此,北京航空航天大学黄雷副教授接受采访时表示,绕过CUDA,可以直接根据GPU的驱动函数做一些新的开发,从而实现更加细粒度的操作。O7N品论天涯网

O7N品论天涯网

譬如DeepSeek在多节点通信时绕过了CUDA直接使用PTX(ParallelThreadExecution),其最多只能实现以算法的方式来高效利用硬件层面的加速。O7N品论天涯网

一旦速度变得更快,打个比方这就意味着别人家的模型要训练十天,而DeepSeek只需要训练五天,那么就能给模型喂更多的数据,即能让模型在同等时间内看到更多的数据,间接提高模型的效果。O7N品论天涯网

按照消息人士的说法,DeepSeek拥有一些擅长写PTX语言的内部开发者。O7N品论天涯网

那么,假如它之后使用国产GPU,其在硬件适配方面将会更得心应手,其只要了解这些硬件驱动提供的一些基本函数接口,就可以仿照英伟达GPU硬件的编程接口去写相关的代码,从而让自家大模型更加容易适配国产硬件。O7N品论天涯网

本网除标明“PLTYW原创”的文章外,其它文章均为转载或者爬虫(PBot)抓取; 本文只代表作者个人观点,不代表本站观点,仅供大家学习参考。本网站属非谋利性质,旨在传播马克思主义和共产主义历史文献和参考资料。凡刊登的著作文献侵犯了作者、译者或版权持有人权益的,可来信联系本站删除。 本站邮箱[email protected]