返回第10章 忽悠傻了  法师归来,速通地球!首页

关灯 护眼     字体:

上一页 目录 下一页

    第10章 忽悠傻了 (第2/3页)

    H100非常紧张,这是英伟达在去年才发布的新一代旗舰。

    因为阿美莉卡官方在去年10月发布的出口管制,加上ChatGPT的横空出世,导致整个华国,H100都格外少。

    也就是腾讯云在海外也有数据中心,他们可以把卡买到海外,然后国内研发海外训练。

    赵立明只觉得自己的女儿被忽悠瘸了。

    赵佩璇开口道:“爸,第一,我也没说要H100啊,A100也行啊。

    另外陈曦他给了一个非常具有可行性的方案。

    直接拉GPT的数据来作为训练集,这是现成的数据,能够大大节约时间。

    我觉得这是非常具备可行性的方案,给他一点机会未尝不可。

    你也说过,大部分时候求稳,但当机会出现的时候,该赌就得赌。”

    赵立明被气笑了:“我是让你该赌的时候就赌,但你看看他背景,唯一有可信度的背景是来自伊戈尔·巴布什金的背书,还只是远程聊过。

    他没有去硅谷,没有在DeepMind工作,也没有在推特工作。

    背书力度太弱了,你明白吗?

    另外,你以为用GPT的数据来训练是什么很了不起的方案,是什么天才的灵光一闪。

    那是因为你了解的太少,你没有从事这一行,你在江城科技大学学的是四十年前的数据结构和C语言。

    你没有关注开源社区的前沿动态。

    华盛顿大学和艾伦人工智能研究所在ChatGPT发布的第一时间就发表了论文,论文名字叫Self-Instruct。

    你所谓的用GPT数据训练只是一句话,人家已经写成论文,并且进行了实验。

    Self-Instruct的核心内容就是让大模型自己生成自己的训练数据。

    他们把方法都公布了,一个迭代的过程。

    先准备一小批人工写的指令,这些作为例子来引导模型生成新任务。

    用当前模型提示它生成新的、更多样的指令。

    比如给它几个种子例子,让它发明新任务。

    为每个新指令生成输入和输出。

    对生成的指令,再让模型生成对应的Input和 Output。

    这样就得到一条完

    (本章未完,请点击下一页继续阅读)

『加入书签,方便阅读』

上一页 目录 下一页