第246章 openAI团队

    第246章 openAI团队 (第2/3页)

    让AI做数学题,和让AI聊天,是两种完全不同的难度。

    聊天可以靠大量的语料库和模式匹配来糊弄过去。

    但做数学题不行。

    数学题需要精确的逻辑推理,哪怕中间错了一步,最终答案就是错的。

    而且别说数学题,现在OpenAI连连贯的对话都很难做到,往往几句以后就在胡说八道去了。

    “不可能。”伊利亚很笃定说,

    “靠多层LSTM,目前根本做不到这个程度。”

    LSTM,长短期记忆网络,是目前自然语言处理领域最主流的架构。

    伊利亚在谷歌大脑的时候就是这个领域的顶尖研究者,他写过的几篇关于序列模型和循环神经网络的论文,至今还是这个领域的基石。

    没有人比他更清楚LSTM能做到什么,不能做到什么。

    “上下文理解?可以有。简单的多轮对话?也可以有。

    但是精确的数学推理……这是两回事。

    如果那个初中生跟你说他用的是标准框架,那要么是你没看清楚,要么就是他做了某种欺骗。”

    格雷格在旁边点了点头,他也是从技术岗上来的,对这个问题有相同的判断:

    “而且一个人写的代码量能有多大?”

    萨姆没有马上表态,他靠在椅背上,手指在桌子上轻轻敲着,看着马斯克的脸,像是在判断对方是不是在夸大其词。

    马斯克被三个人轮番质疑,也不着急,靠在椅背上,把脚翘起来,慢悠悠地说:

    “我亲眼看到的。”

    “那你问他了吗?用的什么框架?”伊利亚问。

    “我没问技术细节。”

    马斯克耸了耸肩,

    “我当时光顾着惊讶了。再说了,就算他告诉我,我一个搞物理和商业的,也未必听得懂。”

    伊利亚沉默了手无意识地转着一支笔。

    格雷格忍不住又开口了:

    “假设,我是说假设,那个初中生真的做出了你说的那种智能体。

    那只能说明一种可能,他用的根本不是多层LSTM。”

    “那能用什么?”萨姆问。

    格雷格把目前主流的几个框架都过了一遍

    (本章未完,请点击下一页继续阅读)