第10章 忽悠傻了 (第2/3页)
H100非常紧张,这是英伟达在去年才发布的新一代旗舰。
因为阿美莉卡官方在去年10月发布的出口管制,加上ChatGPT的横空出世,导致整个华国,H100都格外少。
也就是腾讯云在海外也有数据中心,他们可以把卡买到海外,然后国内研发海外训练。
赵立明只觉得自己的女儿被忽悠瘸了。
赵佩璇开口道:“爸,第一,我也没说要H100啊,A100也行啊。
另外陈曦他给了一个非常具有可行性的方案。
直接拉GPT的数据来作为训练集,这是现成的数据,能够大大节约时间。
我觉得这是非常具备可行性的方案,给他一点机会未尝不可。
你也说过,大部分时候求稳,但当机会出现的时候,该赌就得赌。”
赵立明被气笑了:“我是让你该赌的时候就赌,但你看看他背景,唯一有可信度的背景是来自伊戈尔·巴布什金的背书,还只是远程聊过。
他没有去硅谷,没有在DeepMind工作,也没有在推特工作。
背书力度太弱了,你明白吗?
另外,你以为用GPT的数据来训练是什么很了不起的方案,是什么天才的灵光一闪。
那是因为你了解的太少,你没有从事这一行,你在江城科技大学学的是四十年前的数据结构和C语言。
你没有关注开源社区的前沿动态。
华盛顿大学和艾伦人工智能研究所在ChatGPT发布的第一时间就发表了论文,论文名字叫Self-Instruct。
你所谓的用GPT数据训练只是一句话,人家已经写成论文,并且进行了实验。
Self-Instruct的核心内容就是让大模型自己生成自己的训练数据。
他们把方法都公布了,一个迭代的过程。
先准备一小批人工写的指令,这些作为例子来引导模型生成新任务。
用当前模型提示它生成新的、更多样的指令。
比如给它几个种子例子,让它发明新任务。
为每个新指令生成输入和输出。
对生成的指令,再让模型生成对应的Input和 Output。
这样就得到一条完
(本章未完,请点击下一页继续阅读)
『加入书签,方便阅读』