免费阅读
返回
菜单
上一章查看最新章节下一章

436. 新的冲击 DeepSeek

作品:重生之AI教父作者:CloseAI
如果本章错误,请点击报错10秒纠正

%。

也就是说,当你使用万卡集群的时候,想让每一张卡都能顺顺利利地把工作给完成了,这个可能性只有可怜的三分之一。

而只要一张卡出现了问题,就势必会对整个集群产生影响,中止训练。

为了避免这种一卡罢工,万卡围观的情况发生,孟繁岐投入了大量的资源和时间。

可GPT4o,以及具有推理功能的o1之上,使用旧有办法继续提升性能的空间并不太大了。

孟繁岐这边收效甚微,便给了追赶者们极大的机会。

原本性能差了closeai许多的诸多大厂们,都在过去的这段时间里大大缩短了大模型性能之间的差距。

“从根本上来看,硬件设备对我的限制其实远超软件算法。”孟繁岐此前一直认为自己失去先知优势后,无法继续软件上的突破将会是最大的问题。

如今看来并非如此,随着与孟繁岐关系亲近的那个男人下台,拜老登政府限制英伟达的计算设备出口中国。

这让一心想要走在算法技术最前沿倍感压力。

虽然以他和老黄以及英伟达的关系,可以通过诸多方式绕开此禁令。可不论如何,这都称得上是巨大的困扰。

倍感无奈的孟繁岐开始向内寻求算法突破,以期待能够降低自己对显卡设备的需求。

可原本孟繁岐比较看好的两个技术方向,都没有取得预期的成功。

其一,孟繁岐很早就意识到,早期深度学习模型大多依赖于FP32(32位浮点数)的高精度计算,虽然结果准确,但计算量和存储需求巨大。

根据前世的经验,孟繁岐早早就推动了FP16(16位浮点数)训练和推理。这种格式可以节约一半的计算资源,虽然会稍稍影响模型的性能,但在针对性的优化下几乎可以忽略不计,这也是前世的主流训练模式。

如今,被计算设备所限制的孟繁岐被迫探索准确度更差的FP8(8位浮点数)。

前世的通识是,该模式计算效率极高,但精度损失更大,适用范围非常有限。

往往是在训练完成之后,进行FP8的格式转换,以节约模型的推理使用成本。直接在训练的时候采用这种格式是从未被证实过的。

为此,黄仁勋甚至在显卡的硬件设计上对FP8提供了一定的优化可支持,但半年的时间过去了,孟繁岐并没有看到自己预期的效果。

另一方面上,孟繁岐同时在寻求“稀疏”这一概

…。。
   本章没完,请点击下—页继续阅读!如果被转码了请退出转码或者更换浏揽器即可。
  温馨提示:亲爱的读者,如果你觉得本站还好,为了避免丢失和转马,请勿依赖搜索访问,建议你使用[华为刘揽器]或[Firefox火狐刘揽器]访问并收蔵【苍穹小说】 m.cqgeyin.net。我们将会持续为你更新,还建议你注册会员使用书架功能追书阅读更方便。
上一页 123下一页
上一章查看最新章节下一章
临时书架加入书签回顶部↑

看了《重生之AI教父》的书友还喜欢看

公路求生,开玩具车也能当榜一?
作者:老酒抽到上上签
简介: 【公路求生?无CP?微群像】一睁眼,花浅穿着睡衣抱着猫,被丢进了公路求生游戏。
更新时间:2026-03-03 23:16:00
最新章节:第九十四章预知
牛啊牛啊!男主们又被抢走了
作者:岁也
简介: 【快穿渣女万人迷+修罗场+顶级勾引+黑原女主+无固定cp】\n桑雪是一个坏女人,死后...
更新时间:2026-03-03 23:43:44
最新章节:他太优秀了怎么办?13
重生在星际选择成为药剂师
作者:长尾兔子
简介: 陈房子年纪轻轻便猝死了,死前啥都没有,没有房子没有存款没有恋人,浑身散发着满满的社畜...
更新时间:2026-03-03 23:39:08
最新章节:732 反正早上已经看过了,再洗洗也无所谓了
诸天:开局拐走雄霸之女幽若
作者:一个大兵55
简介: 觉醒穿越诸天的超能力,空降风云世界湖心小筑,开局被幽若用剑指着脖子。
更新时间:2026-03-03 23:30:23
最新章节:第197章指点灵感大王,得《黑水诀》
重生八零,苏小姐杀疯了
作者:倾城五儿
简介: 苏瑶死前才知道,自己一辈子未婚。她被江家骗了一辈子,为江家奉献了自己的一辈子。
更新时间:2026-03-03 23:27:00
最新章节:第175章 离了
家父刘备,望父成龙
作者:周府
简介: 汉室衰弱,群雄逐鹿。徐州陶谦、兖州曹操、扬州袁术,窥探中原。刘公初居小沛,深陷纷争,...
更新时间:2026-03-03 22:54:19
最新章节:第24章我胜则曹忧,我败则曹喜
书名:

本站若有图片广告属于第三方接入,非本站所为,广告内容与本站无关,不代表本站立场,请谨慎阅读。

Copyright © 2020 苍穹小说 All Rights Reserved.kk

SiteMap