第246章 openAI团队
第246章 openAI团队 (第2/3页)
让AI做数学题,和让AI聊天,是两种完全不同的难度。
聊天可以靠大量的语料库和模式匹配来糊弄过去。
但做数学题不行。
数学题需要精确的逻辑推理,哪怕中间错了一步,最终答案就是错的。
而且别说数学题,现在OpenAI连连贯的对话都很难做到,往往几句以后就在胡说八道去了。
“不可能。”伊利亚很笃定说,
“靠多层LSTM,目前根本做不到这个程度。”
LSTM,长短期记忆网络,是目前自然语言处理领域最主流的架构。
伊利亚在谷歌大脑的时候就是这个领域的顶尖研究者,他写过的几篇关于序列模型和循环神经网络的论文,至今还是这个领域的基石。
没有人比他更清楚LSTM能做到什么,不能做到什么。
“上下文理解?可以有。简单的多轮对话?也可以有。
但是精确的数学推理……这是两回事。
如果那个初中生跟你说他用的是标准框架,那要么是你没看清楚,要么就是他做了某种欺骗。”
格雷格在旁边点了点头,他也是从技术岗上来的,对这个问题有相同的判断:
“而且一个人写的代码量能有多大?”
萨姆没有马上表态,他靠在椅背上,手指在桌子上轻轻敲着,看着马斯克的脸,像是在判断对方是不是在夸大其词。
马斯克被三个人轮番质疑,也不着急,靠在椅背上,把脚翘起来,慢悠悠地说:
“我亲眼看到的。”
“那你问他了吗?用的什么框架?”伊利亚问。
“我没问技术细节。”
马斯克耸了耸肩,
“我当时光顾着惊讶了。再说了,就算他告诉我,我一个搞物理和商业的,也未必听得懂。”
伊利亚沉默了手无意识地转着一支笔。
格雷格忍不住又开口了:
“假设,我是说假设,那个初中生真的做出了你说的那种智能体。
那只能说明一种可能,他用的根本不是多层LSTM。”
“那能用什么?”萨姆问。
格雷格把目前主流的几个框架都过了一遍
(本章未完,请点击下一页继续阅读)